Tecnología

DeepSeek V4 ya es estable: open weight, 1 millón de tokens de contexto y precios que hacen quedar mal a todos

DeepSeek V4 — lanzamiento oficial estable

Después de semanas en preview, DeepSeek V4 llegó a su versión oficial estable en julio de 2026. La empresa china actualizó su API, retiró los modelos antiguos (deepseek-chat y deepseek-reasoner quedan deprecados) y presentó dos nuevas versiones con números que siguen poniendo en jaque a los modelos occidentales.

Dos modelos, contexto de 1 millón de tokens

La familia V4 tiene dos variantes. V4-Pro es el modelo grande: 1.6 billones de parámetros totales en arquitectura MoE (Mixture of Experts), con 49 billones activos por inferencia. En benchmarks de código, V4-Pro llega al 80.6% en SWE-bench Verified — a solo 0.2 puntos de Claude Opus 4.6. V4-Flash es la opción rápida y barata: 284B parámetros totales, 13B activos, pensado para producción a escala.

Lo más llamativo de la arquitectura V4 es que el contexto de 1 millón de tokens no es una feature opcional sino el default para ambos modelos. No es un add-on de pago como en otros providers — simplemente así funcionan. Eso significa que podés mandarle documentos enteros, codebases completas o conversaciones larguísimas sin recortar nada.

Los precios, que son el chiste de siempre

DeepSeek V4 introduce por primera vez un sistema de precios peak y off-peak. En horario pico (9–12 AM y 14–18 hs Beijing) el costo es el doble. Fuera de esas horas, los precios son:

V4-Pro: $0.435 por millón de tokens de entrada y $0.87 por millón de salida. Comparado con modelos de rendimiento similar en proveedores occidentales (que cobran entre $10 y $25 por millón de tokens de salida), estamos hablando de una diferencia de 10 a 30 veces. V4-Flash baja aún más: $0.28 por millón de salida en off-peak, y los cache hits de entrada a $0.0028 — básicamente gratis para prompts repetitivos.

Open weight: lo podés bajar y hostearlo vos

La otra noticia importante es que los pesos de ambos modelos están disponibles para descargar bajo licencia MIT. Si tenés hardware, podés correr V4-Flash localmente sin pagar nada. V4-Pro es más exigente (requiere infraestructura seria para los 1.6T de parámetros), pero V4-Flash es accesible para quien tenga un servidor decente.

Para el usuario común que usa IA a través de apps o interfaces web, la implicación más directa es que los servicios construidos sobre DeepSeek van a ser significativamente más baratos que los equivalentes sobre GPT o Claude. Es la misma dinámica de siempre con DeepSeek: presión de precios que obliga a todo el mercado a ajustar. El contexto de 1M tokens como default hace que sea particularmente competitivo para casos de uso con documentos largos.