Tecnología

DeepSeek V4-Pro-0813: sale de preview, machaca benchmarks de agentes y sube los precios el sábado

DeepSeek V4-Pro-0813 model release

El martes 13 de agosto, DeepSeek actualizó silenciosamente su endpoint de API principal y pasó al modelo DeepSeek-V4-Pro-0813: la versión de disponibilidad general (GA) de su modelo insignia, que hasta ahora estaba en preview desde abril. No hubo anuncio oficial grande. Solo apareció en la página de precios y empezó a rodar en DeepSeek Chat y la API.

Y los números que circulan por redes impresionan.

Qué cambió en los benchmarks

El foco de V4-Pro-0813 está en tareas agénticas: código, ejecución de herramientas, operaciones de terminal y flujos de trabajo multi-paso. Los benchmarks publicados por DeepSeek muestran saltos importantes respecto al modelo preview de abril:

  • Terminal Bench 2.1: de 72.1 a 87.9 — casi empatando con Fable 5 que tiene 88
  • CyberGym: de 52.7 a 83.3
  • DeepSWE: de 12.8 a 62.7
  • AutomationBench: mejora comparable

Para ponerlo en contexto: según quienes lo están probando en producción, el modelo entrega rendimiento comparable a Fable 5 de Anthropic en tareas de agente, pero a un costo aproximadamente 57 veces menor usando los precios actuales (antes del aumento del sábado).

Las specs del modelo

V4-Pro-0813 es el mismo modelo masivo de siempre: 1.6 billones de parámetros totales con arquitectura MoE (Mixture of Experts), donde solo se activan unos 49 mil millones por token. Contexto de 1 millón de tokens y hasta 384.000 tokens de salida. Soporta tool calling, modo de razonamiento y la Responses API.

La mala noticia: sube el precio el sábado 16

Acá está el truco. DeepSeek anunció que a las 16:00 UTC del sábado 16 de agosto, los precios de la API suben de forma significativa, y estrenan además un sistema de hora pico y hora baja.

El cambio más dramático: el modelo V4-Pro pasará de USD 0,87 por millón de tokens de salida a USD 3,96 en hora pico (y USD 1,98 en hora baja). Los tokens de entrada cache-hit pueden subir hasta 12 veces en hora pico. El V4-Flash también sube, aunque menos.

La explicación de DeepSeek es que los precios ultra-bajos con los que respondieron a OpenAI en julio desataron una demanda que supera su capacidad de cómputo (operan con alrededor de 20.000 GPUs H100, bastante menos que los grandes labs occidentales). El sistema de hora pico/baja apunta a distribuir el tráfico de forma más pareja.

¿Qué significa para el usuario promedio?

Si usás DeepSeek de forma casual vía chat en deepseek.com, nada cambia por ahora. Los aumentos afectan al acceso por API, que es lo que usan los desarrolladores y herramientas como Cursor o ClinePass.

Para quien programa o usa agentes de IA con acceso directo a la API, esta semana es el momento de stockear créditos o evaluar si el nuevo precio sigue siendo competitivo. Spoiler: incluso con el aumento, V4-Pro sigue siendo más barato que los modelos equivalentes de OpenAI o Anthropic. Pero ya no es el absurdo precio de regalo que fue en julio.

El dato adicional que vale la pena destacar: en julio 2026, DeepSeek fue el segundo laboratorio de IA con más tokens consumidos en el mundo, solo detrás de Anthropic. La demanda no es un tema menor.