DeepSeek-V4-Pro (1.6T MoE) tiene 1600 mil millones de parámetros. Con cuantización estándar de 4 bits y 8K de contexto, necesita aproximadamente 1074.0 GB de VRAM — pesos más caché y sobrecarga del runtime.
VRAM por cuantización
| Precisión | Pesos | Caché/Búfer | VRAM total |
|---|---|---|---|
| 2-bit (IQ2_XXS) | 512.0 GB | 192.0 GB | 706.0 GB |
| 4-bit (Q4_K_M) | 880.0 GB | 192.0 GB | 1074.0 GB |
| 8-bit (Q8_0) | 1680.0 GB | 192.0 GB | 1874.0 GB |
| 16-bit (FP16) | 3200.0 GB | 192.0 GB | 3394.0 GB |
¿Qué GPU puede ejecutar DeepSeek-V4-Pro (1.6T MoE) (a 4 bits)?
| Clase de GPU | VRAM | DeepSeek-V4-Pro (1.6T MoE) (1074.0 GB) |
|---|---|---|
| 8 GB · RTX 5060 / 4060 | 8 GB | No cabe |
| 12 GB · RTX 5070 / 3060 | 12 GB | No cabe |
| 16 GB · RTX 5070 Ti / 4080 | 16 GB | No cabe |
| 24 GB · RTX 4090 / 3090 | 24 GB | No cabe |
| 32 GB · RTX 5090 | 32 GB | No cabe |
| 48 GB · 2×24 / RTX 6000 Ada | 48 GB | No cabe |
| 128 GB · M-series / RTX Spark | 128 GB | No cabe |
Obtén el número exacto para tu equipo
Elige tu modelo, cuantización y longitud de contexto — la calculadora muestra toda la matemática de VRAM y te dice exactamente qué hardware encaja.
Abrir la calculadora de IA local →
Las cifras de VRAM son estimaciones reproducibles (pesos + caché KV + sobrecarga) y varían según el runtime y el formato de cuantización. Datos vigentes al 2026-07-05.