La familia V4 de DeepSeek ha superado su fase de vista previa original. DeepSeek V4 Flash entró en beta pública como V4-Flash-0731 el 31 de julio, mientras que DeepSeek V4 Pro alcanzó GA como V4-Pro-0813 el 13 de agosto en APP, Web y API. Ambos modelos mantienen el diseño de contexto de un millón de tokens y la arquitectura MoE de la familia V4, con Flash optimizado para la eficiencia y Pro posicionado como el modelo de razonamiento y Agente de mayor capacidad.
La versión GA de Pro eleva materialmente la línea base para cualquier previsión sobre V4.1. DeepSeek afirma que la versión GA aporta capacidades de Agente significativamente mejoradas, especialmente en entornos de producción, y ahora ofrece compatibilidad nativa con Responses API y niveles de esfuerzo de razonamiento bajo, alto y máximo tanto en V4-Pro como en V4-Flash. La versión actual del modelo en la API figura explícitamente como DeepSeek-V4-Pro-0813. Entonces, ¿dónde encaja ahora DeepSeek V4.1? El reportaje de mayo de The Information decía que DeepSeek planeaba un lanzamiento de V4.1 en junio con herramientas empresariales más sólidas y soporte multimodal. Esa ventana ya pasó, y el registro de lanzamientos actual de DeepSeek sigue sin incluir una ficha o entrada de lanzamiento de V4.1. La interpretación más segura es, por tanto, una posible iteración de V4 posterior a GA cuyos objetivos reportados podrían aún llegar bajo el nombre V4.1 o mediante actualizaciones adicionales de V4.

Los hitos confirmados usan el registro de cambios de DeepSeek; el plan de V4.1 en junio provino de The Information.
¿Qué es DeepSeek-V4.1?
DeepSeek-V4.1 se entiende mejor como una iteración de V4 no confirmada y posterior a GA, no como un modelo oficial publicado de DeepSeek. La familia V4 ya tiene un punto de control de producción en V4-Pro-0813, así que V4.1 ahora representaría una actualización de capacidades a mitad de ciclo más que el paso necesario para completar el despliegue original de V4. DeepSeek no ha publicado una ficha del modelo V4.1, informe técnico, registro de cambios de la API ni tabla de benchmarks.
| Pregunta | Respuesta actual | Confianza |
|---|---|---|
| ¿DeepSeek ha anunciado oficialmente “V4.1”? | No. El registro de lanzamientos actual de DeepSeek no tiene entrada ni ficha de V4.1. | Alta |
| ¿Se informó de un lanzamiento de V4.1? | Sí. The Information informó un plan de junio con herramientas empresariales y multimodalidad. | Media |
| ¿Ocurrió la ventana reportada para junio? | No apareció un lanzamiento oficial independiente de V4.1 durante esa ventana. | Alta |
| ¿Cuál es el último hito V4 confirmado? | V4-Flash-0731 entró en beta pública el 31 de julio y V4-Pro-0813 alcanzó GA el 13 de agosto. | Alta |
| ¿Podría V4.1 lanzarse todavía como modelo aparte? | Sí, pero el nombre, las especificaciones y el calendario siguen sin confirmarse. | Baja/Media |
Especificaciones esperadas de DeepSeek-V4.1
Dado que DeepSeek no ha publicado especificaciones de V4.1, la tabla siguiente separa las capacidades V4 actuales confirmadas de las expectativas direccionales. “Esperado” significa una continuación razonable de V4 o una capacidad reportada por los medios, no una especificación oficial de V4.1.
| Dimensión | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 (esperado) |
|---|---|---|---|
| Familia de modelos | V4 | V4 | Probable iteración de la familia V4 |
| Arquitectura | Atención híbrida MoE derivada de V4 | MoE derivada de V4; GA construida sobre la estructura Preview | Probable derivado de V4; no confirmado |
| Parámetros totales/activos | 284B / 13B | 1.6T / 49B | Desconocido; sin cifra pública fiable |
| Ventana de contexto | 1M | 1M | Probablemente al menos la base de V4 |
| Salida máxima | Máximo API 384K | Máximo API 384K | Desconocido |
| Esfuerzo de razonamiento | Bajo / alto / máximo | Bajo / alto / máximo | Se espera que preserve o amplíe los controles actuales |
| Responses API | Compatible | Compatible | Esperado si se construye sobre la pila API actual de V4 |
| Entrada nativa de imagen/archivo | No admitida en la Responses API actual | No admitida en la Responses API actual | Dirección multimodal reportada; no confirmada |
| Herramientas empresariales/Agente | Functions, búsqueda web, apply_patch / soporte Codex | Functions, búsqueda web, apply_patch / soporte Codex | Área reportada de énfasis; la ampliación de MCP sigue sin confirmarse |
| Pesos abiertos | Sí | Sí, pesos de V4-Pro-0813 disponibles | Posible para un punto de control V4.1; no confirmado |
| Estado oficial | Lanzamiento de API en beta pública | GA | Sin fecha oficial de lanzamiento ni ficha de modelo |
¿Qué podría ser nuevo en DeepSeek-V4.1?
Programación agentiva más sólida sin un modelo más grande
La evidencia más sólida de lo que sigue a V4 es ahora la actualización GA de V4-Pro-0813. DeepSeek afirma que la capacidad de Agente mejoró sustancialmente en entornos de producción, con Terminal Bench 2.1 en 87.9, NL2Repo en 61.5 y DeepSWE en 62.7. V4-Flash-0731 ya había mostrado que el posentrenamiento por sí solo podía producir grandes avances de Agente sin cambiar la arquitectura o el tamaño del modelo.
Si V4.1 es una actualización a mitad de ciclo, el objetivo realista ya no es simplemente “mejor que V4 Preview”. Debería preservar o superar la línea base de Agente de V4-Pro-0813, a la vez que mejora la ejecución de software de largo horizonte, la fiabilidad a nivel de repositorio, la orquestación de herramientas y la consistencia en producción.
Mejor uso de herramientas y APIs de Agente más completas
La pila V4 actual ya proporciona a Flash y Pro compatibilidad con Responses API y está adaptada específicamente para Codex. La tabla de compatibilidad de Responses API admite llamadas a funciones y búsqueda web del lado del servidor, mientras que los tipos de herramientas file_search, code_interpreter, computer_use y MCP aún se ignoran. Eso hace que una cobertura más amplia de herramientas empresariales sea una oportunidad más clara para V4.1 que simplemente añadir la propia Responses API.
El soporte nativo para MCP sigue siendo una dirección de mejora plausible, pero no está confirmado. Una tesis defendible para V4.1 es una integración empresarial y de Agentes más profunda sobre una superficie de API que ya admite Responses, flujos orientados a Codex, salida estructurada y llamadas a herramientas.
La entrada multimodal podría ser la mayor mejora a nivel de producto
The Information informó que V4.1 estaba planificado con soporte multimodal. Esto sigue siendo el posible diferenciador más claro a nivel de producto porque la actual Responses API de DeepSeek indica que no se admiten entradas de imagen ni de archivos. Si un futuro punto de control V4.1 añade comprensión nativa visual o de archivos, ampliaría DeepSeek hacia flujos de trabajo de documentos, capturas de pantalla y programación visual que la API actual solo de texto no cubre.
Hasta que DeepSeek publique una ficha del modelo V4.1 o un esquema de API, las modalidades exactas, límites de resolución, comportamiento de audio/vídeo y benchmarks multimodales deberían seguir etiquetados como desconocidos.
Rendimiento de frontera con costo al nivel de DeepSeek
El bajo costo de inferencia sigue siendo una de las fortalezas más diferenciadas de DeepSeek, pero el precio oficial cambió con el despliegue completo de V4. La tabla de precios actual usa tarifas pico/fuera de pico: la entrada con fallo de caché de V4-Flash es de $0.22 fuera de pico / $0.44 en pico y la salida es de $0.66 / $1.32 por 1M de tokens; la entrada de V4-Pro es de $0.66 / $1.32 y la salida de $1.98 / $3.96. Las tarifas fuera de pico son la mitad de las tarifas en hora pico.
Rendimiento esperado en benchmarks de DeepSeek-V4.1
Aún no hay puntuaciones oficiales de V4.1. La línea base más sólida de la familia V4 es ahora DeepSeek-V4-Pro-0813 GA, que sustituye a Pro Preview como punto de referencia para el rendimiento de Agentes. DeepSeek reporta 87.9 en Terminal Bench 2.1, 61.5 en NL2Repo, 83.3 en Cybergym, 62.7 en DeepSWE y 74.1 en Toolathlon-Verified, junto con mejoras en AutomationBench y DSBench.

Figura 6. Valores oficiales de benchmarks de Agente de DeepSeek-V4-Pro-0813 GA, visualizados a partir del registro de cambios de DeepSeek.
| Benchmark | V4-Pro-0813 | V4-Flash-0731 | V4-Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 87.9 | 82.7 | 72.1 |
| NL2Repo | 61.5 | 54.2 | 38.5 |
| Cybergym | 83.3 | 76.7 | 52.7 |
| DeepSWE | 62.7 | 54.4 | 12.8 |
| Toolathlon-Verified | 74.1 | 70.3 | 55.9 |
| Agents' Last Exam | 25.7 | 25.2 | 16.5 |
| AutomationBench (Public) | 31.8 | 25.1 | 12.8 |
| DSBench-FullStack | 71.1 | 68.7 | — |
| DSBench-Hard | 67.2 | 59.6 | — |

Figura 7. V4-Pro-0813 frente a V4-Flash-0731 en benchmarks comunes de Agentes. Los valores provienen del registro de cambios de DeepSeek; el arnés y los ajustes de razonamiento pueden afectar las comparaciones entre modelos.
La progresión sugiere tres expectativas fundamentadas para V4.1. Primero, un lanzamiento significativo de V4.1 debería al menos preservar la línea base GA de V4-Pro-0813, no solo superar la antigua Preview. Segundo, DeepSeek sigue extrayendo mejoras mediante posentrenamiento y optimización de Agentes, en lugar de escalar únicamente el número de parámetros. Tercero, la actualización más valiosa de V4.1 podría ser una capacidad multimodal y de herramientas empresariales más amplia si el rendimiento central de Agentes ya está cerca del límite de diseño de V4.
DeepSeek-V4.1 vs V4-Flash vs V4-Pro
| Dimensión | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 esperado |
|---|---|---|---|
| Posicionamiento | Modelo de Agente/programación rápido y eficiente | Modelo V4 actual de mayor capacidad de razonamiento/Agente | Posible mejora de capacidades a mitad de ciclo |
| Escala | 284B totales / 13B activos | 1.6T totales / 49B activos | Desconocida |
| Contexto | 1M | 1M | Probablemente al menos 1M si deriva de V4 |
| Programación con Agentes | Muy sólida tras el posentrenamiento 0731 | Línea base oficial de Agente más fuerte en V4 | Se espera que iguale o supere la GA de Pro |
| Esfuerzo de razonamiento | Bajo / alto / máximo | Bajo / alto / máximo | Se espera que preserve o amplíe los controles |
| Responses API | Compatible | Compatible | Esperado si se construye sobre la pila V4 |
| Entrada multimodal | No hay entrada de imagen/archivo en la Responses API actual | No hay entrada de imagen/archivo en la Responses API actual | Posibilidad reportada; no confirmada |
| Costo oficial de la API | Nivel V4 inferior; precios pico/fuera de pico | Nivel V4 superior; precios pico/fuera de pico | Desconocido |
| Estado | Lanzamiento oficial de API en beta pública | GA | No anunciado por DeepSeek |
¿Para qué se utilizará DeepSeek-V4.1?
Si se mantiene la dirección reportada, V4.1 sería más atractivo donde la familia V4 actual ya es fuerte pero aún carece de capacidades de producto más amplias.
- Agentes de programación a escala de repositorio. La comprensión de código de largo contexto, la generación de parches, los bucles de pruebas y la ejecución en terminal son el encaje más claro dado los avances de Agente en V4-Pro-0813 y Flash-0731.
- Investigación empresarial y flujos de trabajo con documentos. Una base de contexto de 1M, compatibilidad con Responses API e integración web/de herramientas puede soportar grandes conjuntos de conocimiento internos, corpus de políticas y documentación técnica. V4.1 sería más útil aquí si añade recuperación o herramientas de archivos más ricas.
- Agentes autónomos sensibles al costo. V4-Flash sigue siendo especialmente atractivo para bucles repetidos de planificación y llamadas a herramientas, mientras que V4-Pro ofrece un nivel de mayor capacidad. V4.1 sería atractivo si mantiene esta disciplina de costos.
- Análisis de documentos visuales y capturas de pantalla. Esto se convierte en un caso de uso nativo importante solo si la capacidad multimodal reportada se entrega formalmente.
- Implementaciones privadas o personalizadas. DeepSeek ha publicado los pesos de V4-Pro-0813 y V4-Flash-0731, por lo que un punto de control V4.1 publicado por separado podría ser atractivo para organizaciones que necesitan autoalojamiento o adaptación al dominio. La disponibilidad de pesos abiertos para V4.1 no está confirmada.
Lo que aún no sabemos
El mayor riesgo al escribir un artículo de “próximamente” es convertir una extrapolación plausible en especificación falsa. Estos puntos deben permanecer explícitamente abiertos hasta que DeepSeek publique material de primera mano:
- Si “DeepSeek-V4.1” será el nombre oficial del modelo.
- Si V4.1 es un punto de control distinto o una etiqueta separada para mejoras más allá de V4-Flash-0731 y V4-Pro-0813.
- Recuento total de parámetros, parámetros activados y cualquier cambio arquitectónico.
- Entradas multimodales exactas y si se admiten imagen, audio, vídeo o archivos.
- Soporte nativo para MCP, computer-use, file-search o code-interpreter.
- Puntuaciones oficiales de benchmarks y ajustes de evaluación.
- Precios de la API, disponibilidad de pesos abiertos y términos comerciales para un punto de control V4.1 separado. Una fecha de lanzamiento firme.
Reflexiones finales
DeepSeek-V4.1 es interesante precisamente porque el ciclo V4 actual muestra que DeepSeek puede hacer a la familia materialmente más fuerte sin introducir una arquitectura completamente nueva. La actualización de posentrenamiento Flash-0731 aportó grandes mejoras de Agente, y el lanzamiento GA de Pro-0813 elevó esa línea base otra vez al tiempo que añadió compatibilidad nativa con Responses API y un esfuerzo de razonamiento más flexible.
La tesis más creíble para V4.1 no es, por tanto, “un misterioso modelo de un billón de parámetros”. Es un V4 más maduro: ejecución de Agentes en producción más sólida, herramientas empresariales más amplias, potencial entrada multimodal nativa y un equilibrio más ajustado entre la eficiencia de Flash y el razonamiento de nivel Pro. La gran incertidumbre es si DeepSeek enviará esas mejoras bajo el nombre V4.1.
Los desarrolladores ya pueden probar DeepSeek V4 Flash y DeepSeek V4 Pro a través de CometAPI, mientras que la página de DeepSeek V4.1 puede usarse para seguir la disponibilidad en CometAPI si un modelo separado se vuelve accionable. CometAPI proporciona una capa de API unificada para comparar DeepSeek con otros modelos de frontera sin reconstruir la integración para cada proveedor.
