Lanzamiento oficial silencioso a medianoche
A las 23:00 del 13 de agosto de 2026, la página de modelos en la documentación oficial de la API de DeepSeek se actualizó discretamente, cambiando el identificador del modelo a DeepSeek-V4-Pro-0813. DeepSeek no celebró ninguna presentación virtual ni realizó ninguna campaña previa en redes sociales. Aun así, la actualización escaló rápidamente al primer puesto de Hacker News, acumulando 692 votos a favor y 246 comentarios de la comunidad.
Esta estrategia de actualización silenciosa reduce los costes de migración para las integraciones existentes. Los desarrolladores que llaman a la API no necesitan modificar la lógica del código de sus aplicaciones, ya que el sistema enruta automáticamente las peticiones hacia la versión 0813 más reciente. Los identificadores antiguos como deepseek-chat y deepseek-reasoner ya se habían retirado a finales de julio, mapeándose respectivamente a los modos sin razonamiento y con razonamiento de la arquitectura Flash. Esta estrategia de lanzamiento discreto demuestra que la infraestructura de la API ha alcanzado una madurez de alta disponibilidad, sin necesidad de probar la elasticidad del sistema mediante picos repentinos de tráfico publicitario.
Figura: Página oficial de «Modelos y precios» de DeepSeek, con la versión del modelo actualizada a DeepSeek-V4-Pro-0813. Fuente: Plataforma abierta de DeepSeek
Los benchmarks de Agentes superan a la versión ligera
Repasando la evolución de la serie V4, cuando se presentó la fase Preview en abril de 2026, DeepSeek anunció simultáneamente la versión Pro con 1,6 billones (1.6T) de parámetros y la versión ligera Flash con 284.000 millones (284B) de parámetros. Sin embargo, tras el lanzamiento oficial de V4-Flash-0731 el 31 de julio, la versión ligera superó temporalmente a la versión Preview insignia en pruebas como Terminal Bench (82.7 frente a 61.8). El lanzamiento de esta versión GA 0813 restablece con firmeza el liderazgo de rendimiento de la versión Pro dentro de la serie.
| Benchmark | V4 Pro 0813 | V4 Pro Preview | Fable 5 |
|---|---|---|---|
| HLE (Sin herramientas / Con herramientas) | 42.7 / 60.0 | 37.7 / 48.2 | 53.3 / 63.0 |
| Terminal Bench 2.1 | 87.9 | 72.1 | 88.0 |
| Cybergym | 83.3 | 52.7 | 83.1 |
| DeepSWE | 62.7 | 12.8 | 70.0 |
| DSBench-FullStack | 71.1 | 41.8 | — |
Los datos oficiales de referencia muestran aumentos significativos en la capacidad de ejecución de agentes de V4 Pro 0813. En particular, la puntuación de DeepSWE se disparó de 12.8 en la fase Preview a 62.7, Terminal Bench 2.1 aumentó de 72.1 a 87.9, y Cybergym superó a Fable 5 con 83.3 puntos. El salto de casi cinco veces en DeepSWE demuestra la capacidad de generalización efectiva del modelo en escenarios de reparación de código multietapa de largo recorrido.
Figura: Benchmarks oficiales de DeepSeek V4 Pro 0813 (evaluación de Agentes). Fuente: Publicación oficial de DeepSeek / recopilado por deepseekv4pro.com
Por supuesto, todas estas métricas provienen de las pruebas internas del fabricante. En las evaluaciones de agentes, la configuración del entorno (Harness), el formato del prompt y el número de pasos de razonamiento influyen de forma notable en las puntuaciones finales. En tareas sin herramientas como HLE o razonamiento profundo en repositorios, el modelo aún mantiene una distancia objetiva respecto a Opus 4.8, lo que requerirá verificaciones independientes de la comunidad.
Ampliación arquitectónica y asignaciones pendientes de ingeniería
En cuanto a las especificaciones técnicas, V4 Pro 0813 mantiene una arquitectura de Mezcla de Expertos (MoE) con un total de 1,6T de parámetros, activando 49B de parámetros en cada paso de inferencia. El modelo admite de forma nativa una ventana de contexto de 1M de tokens, con un límite máximo de salida por respuesta de 384K tokens. En cuanto a las capacidades de API, la versión GA añade soporte para la API Responses e integra una capa de compatibilidad con la API de Anthropic, continuación de prefijos de diálogo y completado de código FIM.
A pesar de contar con un conjunto completo de funciones de API, aún existen vacíos en el ecosistema oficial de herramientas. El marco de agentes autodesarrollado “DeepSeek Harness”, muy esperado por la comunidad, no se lanzó junto con la versión oficial, y la documentación sigue recomendando hosts de agentes de terceros como OpenAI Codex, Claude Code o OpenClaw. Además, el anuncio de la API no especificó claramente si los pesos de código abierto de la versión 0813 se distribuirán bajo la licencia MIT.
La capacidad de contexto de 1M combinada con el límite de salida de 384K permite indexar repositorios de código completos en proyectos empresariales. Sin embargo, la falta de un entorno de ejecución oficial obliga a los desarrolladores empresariales a diseñar sus propios mecanismos de recorte de contexto y gestión de estados. La no liberación del marco oficial Harness significa que los desarrolladores de nivel empresarial deberán seguir construyendo entornos de pruebas seguros (sandboxes) y lógica de orquestación por su cuenta.
Segmentación comercial tras el triple diferencial de precios
Junto con la estabilización del producto, se ha modificado la estrategia de facturación por tramos. La página oficial de precios señala que las tarifas por fallos de caché en la entrada y las tarifas de salida para V4 Pro 0813 son de 3,00 RMB ($0,435) y 6,00 RMB ($0,87) por millón de tokens, respectivamente. En comparación con las tarifas de Flash 0731 (1,00 RMB y 2,00 RMB), estos precios base se han triplicado.
| Concepto de facturación | V4-Pro-0813 | V4-Flash-0731 |
|---|---|---|
| Entrada · Acierto de caché | 0,025 RMB ($0,003625) | 0,02 RMB ($0,0028) |
| Entrada · Fallo de caché | 3,00 RMB ($0,435) | 1,00 RMB ($0,14) |
| Salida | 6,00 RMB ($0,87) | 2,00 RMB ($0,28) |
| Límite de concurrencia por cliente | 500 | 2500 |
Además del incremento en el coste por token, la capacidad de concurrencia se ha reducido drásticamente. El límite de concurrencia por cliente para la versión Pro se fija en 500, una quinta parte del límite de 2500 asignado a la versión Flash. Asimismo, se sigue aplicando un multiplicador de precio de 2x durante las horas punta. La combinación de restricciones de concurrencia y un precio tres veces superior establece una estrategia clara de dos vías: Flash se orienta a llamadas masivas de alta frecuencia, mientras que Pro se enfoca en razonamientos complejos de mayor valor.
Una señal aún más clara aparece en las notas a pie de página en inglés de la web de precios. El texto oficial indica explícitamente que la empresa planea ajustar al alza la tarifa general de los servicios API en un futuro próximo, anunciando una subida de precios considerable. Varios medios del sector ya habían filtrado estos planes a principios de agosto, y el anuncio oficial confirma ahora esa intención comercial. El aviso de aumento de precios y las restricciones de concurrencia marcan el fin definitivo de la fase en la que los altos volúmenes de llamadas estaban subvencionados por precios artificialmente bajos.
El fin de la era de API baratas y las nuevas reglas de competición
El lanzamiento oficial de DeepSeek V4 Pro 0813 demuestra la rápida velocidad de iteración de ingeniería de los modelos de vanguardia de arquitectura abierta en pruebas de agentes. Sin embargo, no se trata de una simple mejora técnica, sino de un punto de inflexión donde DeepSeek acelera su monetización comercial.
A medida que aumentan los costes de I+D y el consumo de recursos de cómputo, la estrategia inicial de expansión de mercado basada en API de bajo coste llega a su fin. A través de la tarifación diferenciada entre Flash y Pro, la compañía dirige la demanda de alto volumen y bajo coste hacia modelos ligeros, reservando las tareas complejas de alto valor para el modelo insignia con mayor margen. La posterior subida general de tarifas obligará a los clientes empresariales a reevaluar el rendimiento real de su inversión en el uso de la API.
En esta nueva etapa en la que los precios de las API caminan hacia una valoración razonable, las guerras de precios basadas únicamente en el coste del token pierden su atractivo. La calidad global de entrega, la tasa de éxito en tareas de agentes a largo plazo y la eficiencia en la optimización del contexto reemplazarán a las ofertas baratas como los nuevos indicadores para evaluar el valor real de un proveedor de modelos.
Enlaces de referencia:
- DeepSeek API Docs: Models & Pricing
- DeepSeek V4 Hub: V4 Pro 0813 Arrives With Strong Agent Scores
- Chao News: DeepSeek V4 Pro GA lanzado: Contexto de 1M + 384K de salida, 3 veces más caro que Flash
- Discusión en HN (49274600): DeepSeek V4 Pro 0813