A família V4 da DeepSeek já superou sua fase de preview original. DeepSeek V4 Flash entrou em beta público como V4-Flash-0731 em 31 de julho, enquanto o DeepSeek V4 Pro alcançou GA como V4-Pro-0813 em 13 de agosto no APP, Web e API. Os dois modelos mantêm o design de contexto de um milhão de tokens e a arquitetura MoE da família V4, com o Flash otimizado para eficiência e o Pro posicionado como o modelo de Agente e raciocínio de maior capacidade.
O lançamento GA do Pro eleva materialmente a linha de base para qualquer previsão V4.1. A DeepSeek afirma que o build GA traz capacidades de Agente significativamente aprimoradas, especialmente em ambientes de produção, e agora oferece suporte nativo à Responses API tanto para V4-Pro quanto para V4-Flash, além de níveis de esforço de raciocínio baixo, alto e máximo. A versão atual do modelo na API está explicitamente listada como DeepSeek-V4-Pro-0813. Então, onde se encaixa o DeepSeek V4.1 agora? O relatório de maio da The Information disse que a DeepSeek planejava um lançamento do V4.1 em junho com ferramentas empresariais mais fortes e suporte multimodal. Essa janela passou, e o registro de lançamentos atual da DeepSeek ainda não contém cartão de modelo ou entrada de lançamento do V4.1. A interpretação mais segura é, portanto, uma possível iteração pós-GA do V4 cujas metas relatadas ainda podem chegar sob o nome V4.1 ou por meio de atualizações adicionais do V4.

Os marcos confirmados usam o change log da DeepSeek; o plano anterior de V4.1 em junho veio da The Information.
O que é o DeepSeek-V4.1?
O DeepSeek-V4.1 é melhor entendido como uma iteração pós-GA do V4 não confirmada, não como um modelo da DeepSeek oficialmente lançado. A família V4 já possui um checkpoint de produção no V4-Pro-0813, então o V4.1 agora representaria uma atualização de capacidade no meio do ciclo, em vez do passo necessário para completar o rollout original do V4. A DeepSeek não publicou cartão do modelo V4.1, relatório técnico, changelog da API ou tabela de benchmarks.
| Pergunta | Resposta atual | Confiança |
|---|---|---|
| A DeepSeek anunciou oficialmente “V4.1”? | Não. O registro de lançamentos atual da DeepSeek não tem entrada ou cartão de modelo V4.1. | Alta |
| Um lançamento V4.1 foi relatado? | Sim. A The Information relatou um plano de junho com ferramentas empresariais e suporte multimodal. | Média |
| A janela de junho relatada ocorreu? | Não surgiu um V4.1 oficial separado durante essa janela. | Alta |
| Qual é o marco V4 confirmado mais recente? | V4-Flash-0731 entrou em beta público em 31 de julho e V4-Pro-0813 alcançou GA em 13 de agosto. | Alta |
| O V4.1 ainda pode ser lançado como modelo separado? | Sim, mas o nome, as especificações e o timing permanecem não confirmados. | Baixa/Média |
Especificações esperadas do DeepSeek-V4.1
Como a DeepSeek não publicou especificações do V4.1, a tabela abaixo separa as capacidades V4 atuais confirmadas das expectativas direcionais. “Esperado” significa uma continuação razoável do V4 ou uma capacidade reportada pela mídia, não uma especificação oficial do V4.1.
| Dimensão | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 (esperado) |
|---|---|---|---|
| Família do modelo | V4 | V4 | Provável iteração da família V4 |
| Arquitetura | MoE derivada do V4 com atenção híbrida | MoE derivada do V4; GA construído sobre a estrutura Preview | Provavelmente derivada do V4; não confirmado |
| Parâmetros totais/ativos | 284B / 13B | 1,6T / 49B | Desconhecido; nenhum número público confiável |
| Janela de contexto | 1M | 1M | Provavelmente pelo menos a linha de base do V4 |
| Saída máxima | Máximo de 384K na API | Máximo de 384K na API | Desconhecido |
| Esforço de raciocínio | Baixo / alto / máximo | Baixo / alto / máximo | Espera-se preservar ou ampliar os controles atuais |
| Responses API | Suportada | Suportada | Esperado se construído no stack atual do V4 |
| Entrada nativa de imagem/arquivo | Não suportada na Responses API atual | Não suportada na Responses API atual | Direção multimodal relatada; não confirmada |
| Ferramentas Enterprise/Agente | Functions, web search, apply_patch / suporte a Codex | Functions, web search, apply_patch / suporte a Codex | Área de ênfase relatada; expansão de MCP permanece não confirmada |
| Pesos abertos | Sim | Sim, pesos do V4-Pro-0813 disponíveis | Possível para um checkpoint V4.1 separado; não confirmado |
| Status oficial | Lançamento de API em beta público | GA | Sem data de lançamento oficial ou cartão de modelo |
O que pode ser novo no DeepSeek-V4.1?
Codificação agentizada mais forte sem um modelo maior
A evidência mais forte do que vem depois do V4 é agora a atualização GA do V4-Pro-0813. A DeepSeek afirma que a capacidade de Agente melhorou substancialmente em ambientes de produção, com Terminal Bench 2.1 em 87,9, NL2Repo em 61,5 e DeepSWE em 62,7. O V4-Flash-0731 já havia mostrado que apenas o pós-treinamento adicional poderia produzir grandes ganhos de Agente sem alterar a arquitetura ou o tamanho do modelo.
Se o V4.1 for uma atualização de meio de ciclo, o alvo realista não é mais simplesmente “melhor que o V4 Preview”. Ele precisaria preservar ou superar a linha de base de Agente do V4-Pro-0813 enquanto melhora a execução de software de longo horizonte, a confiabilidade em nível de repositório, a orquestração de ferramentas e a consistência em produção.
Melhor uso de ferramentas e APIs de Agente mais completas
O stack V4 atual da DeepSeek já oferece suporte à Responses API tanto para o Flash quanto para o Pro e é especificamente adaptado ao Codex. A tabela de compatibilidade da Responses API suporta chamadas de função e web search do lado do servidor, enquanto os tipos de ferramentas file_search, code_interpreter, computer_use e MCP ainda são ignorados. Isso torna uma cobertura mais ampla de ferramentas empresariais uma oportunidade mais clara para o V4.1 do que simplesmente adicionar a própria Responses API.
O suporte nativo a MCP ainda é uma direção plausível de upgrade, mas permanece não confirmado. Uma tese defensável para o V4.1 é uma integração empresarial e de Agente mais profunda sobre uma superfície de API que já suporta Responses, fluxos de trabalho orientados ao Codex, saída estruturada e chamadas de ferramentas.
Entrada multimodal pode ser a maior atualização no nível de produto
A The Information relatou que o V4.1 foi planejado com suporte multimodal. Isso continua sendo o diferenciador de produto mais claro possível porque a Responses API atual da DeepSeek afirma que entradas de imagem e arquivo não são suportadas. Se um futuro checkpoint V4.1 adicionar compreensão nativa de conteúdo visual ou de arquivos, isso expandiria a DeepSeek para fluxos de trabalho de documentos, capturas de tela e programação visual que a API apenas de texto atual não cobre.
Até que a DeepSeek publique um cartão de modelo V4.1 ou um esquema de API, as modalidades exatas, limites de resolução, comportamento de áudio/vídeo e benchmarks multimodais devem permanecer marcados como desconhecidos.
Desempenho de fronteira com custo ao nível da DeepSeek
Baixo custo de inferência continua sendo uma das forças mais diferenciadas da DeepSeek, mas a precificação oficial mudou com o rollout completo do V4. A tabela de preços atual usa tarifas de pico/fora de pico: a entrada com cache-miss do V4-Flash é $0,22 fora de pico / $0,44 em pico e a saída é $0,66 / $1,32 por 1M tokens; a entrada do V4-Pro é $0,66 / $1,32 e a saída é $1,98 / $3,96. As tarifas fora de pico são metade das tarifas de pico.
Desempenho esperado em benchmarks do DeepSeek-V4.1
Ainda não há pontuações oficiais de benchmarks do V4.1. A linha de base mais forte da família V4 atualmente é o DeepSeek-V4-Pro-0813 GA, que substitui o Pro Preview como ponto de referência para desempenho de Agente. A DeepSeek reporta 87,9 no Terminal Bench 2.1, 61,5 no NL2Repo, 83,3 no Cybergym, 62,7 no DeepSWE e 74,1 no Toolathlon-Verified, juntamente com ganhos no AutomationBench e no DSBench.

Figura 6. Valores oficiais de benchmark de Agente do DeepSeek-V4-Pro-0813 GA, visualizados a partir do change log da DeepSeek.
| Benchmark | V4-Pro-0813 | V4-Flash-0731 | Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 87,9 | 82,7 | 72,1 |
| NL2Repo | 61,5 | 54,2 | 38,5 |
| Cybergym | 83,3 | 76,7 | 52,7 |
| DeepSWE | 62,7 | 54,4 | 12,8 |
| Toolathlon-Verified | 74,1 | 70,3 | 55,9 |
| Agents' Last Exam | 25,7 | 25,2 | 16,5 |
| AutomationBench (Público) | 31,8 | 25,1 | 12,8 |
| DSBench-FullStack | 71,1 | 68,7 | — |
| DSBench-Hard | 67,2 | 59,6 | — |

Figura 7. V4-Pro-0813 versus V4-Flash-0731 em benchmarks comuns de Agente. Os valores vêm do change log da DeepSeek; o harness e as configurações de raciocínio podem afetar comparações entre modelos.
A progressão sugere três expectativas baseadas em evidências para o V4.1. Primeiro, um lançamento V4.1 significativo deve ao menos preservar a linha de base GA do V4-Pro-0813, não apenas superar o antigo Preview. Segundo, a DeepSeek ainda está extraindo ganhos por meio de pós-treinamento e otimização de Agente, em vez de apenas escalar a contagem de parâmetros. Terceiro, a atualização mais valiosa do V4.1 pode ser uma capacidade multimodal e de ferramentas empresariais mais ampla se o desempenho central de Agente já estiver próximo do topo do envelope de design do V4.
DeepSeek-V4.1 vs V4-Flash vs V4-Pro
| Dimensão | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 esperado |
|---|---|---|---|
| Posicionamento | Modelo de Agente/codificação rápido e eficiente | Modelo V4 atual de maior capacidade de raciocínio/Agente | Possível upgrade de capacidade no meio do ciclo V4 |
| Escala | 284B total / 13B ativos | 1,6T total / 49B ativos | Desconhecido |
| Contexto | 1M | 1M | Provavelmente pelo menos 1M se derivado do V4 |
| Codificação de Agente | Muito forte após o pós-treinamento 0731 | Linha de base oficial de Agente mais forte do V4 | Espera-se atender ou superar a linha de base do Pro GA |
| Esforço de raciocínio | Baixo / alto / máximo | Baixo / alto / máximo | Espera-se preservar ou ampliar os controles |
| Responses API | Suportada | Suportada | Esperado se construído no stack atual do V4 |
| Entrada multimodal | Sem entrada de imagem/arquivo na Responses API atual | Sem entrada de imagem/arquivo na Responses API atual | Possibilidade relatada; não confirmada |
| Custo oficial da API | Camada V4 inferior; preços pico/fora de pico | Camada V4 superior; preços pico/fora de pico | Desconhecido |
| Status | Lançamento oficial de API em beta público | GA | Não anunciado pela DeepSeek |
Para que será usado o DeepSeek-V4.1?
Se a direção relatada se mantiver, o V4.1 seria mais atraente onde a família V4 atual já é forte, mas ainda carece de capacidades de produto mais amplas.
1. Repositórios em escala para agentes de codificação. Compreensão de código de longo contexto, geração de patches, loops de teste e execução em terminal são os encaixes mais claros dados os ganhos de Agente do V4-Pro-0813 e do Flash-0731.
2. Pesquisas empresariais e fluxos de trabalho de documentos. Uma linha de base de 1M de contexto, suporte à Responses API e integração web/ferramentas podem suportar grandes conjuntos de conhecimento internos, corpora de políticas e documentação técnica. O V4.1 se tornaria mais útil aqui se adicionar recuperação mais rica ou ferramentas de arquivos.
3. Agentes autônomos sensíveis a custo. O V4-Flash permanece particularmente atraente para loops repetidos de planejamento e chamadas de ferramentas, enquanto o V4-Pro oferece uma camada de maior capacidade. O V4.1 seria atraente se preservar essa disciplina de custo.
4. Análise de documentos visuais e capturas de tela. Isso se torna um caso de uso nativo importante apenas se a capacidade multimodal relatada for entregue formalmente.
5. Implantações privadas ou personalizadas. A DeepSeek lançou os pesos do V4-Pro-0813 e do V4-Flash-0731, portanto um checkpoint V4.1 lançado separadamente pode permanecer atraente para organizações que precisam de self-hosting ou adaptação de domínio. A disponibilidade de pesos abertos para o próprio V4.1 não está confirmada.
O que ainda não sabemos
O maior risco ao escrever um artigo “em breve” é transformar extrapolação plausível em especificação falsa. Estes pontos devem permanecer explicitamente em aberto até que a DeepSeek publique material de primeira mão:
- Se “DeepSeek-V4.1” será o nome oficial do modelo.
- Se o V4.1 é um checkpoint distinto ou um rótulo separado para melhorias além de V4-Flash-0731 e V4-Pro-0813.
- Contagem total de parâmetros, contagem de parâmetros ativados e quaisquer mudanças arquiteturais.
- Entradas multimodais exatas e se imagem, áudio, vídeo ou arquivos são suportados.
- Suporte nativo a MCP, computer-use, file-search ou code-interpreter.
- Pontuações oficiais de benchmarks e configurações de avaliação.
- Preços da API, disponibilidade de pesos abertos e termos comerciais para um checkpoint V4.1 separado. Uma data de lançamento firme.
Considerações finais
O DeepSeek-V4.1 é interessante precisamente porque o ciclo V4 atual mostra que a DeepSeek pode tornar a família materialmente mais forte sem introduzir uma arquitetura completamente nova. A atualização de pós-treinamento do Flash-0731 entregou grandes ganhos de Agente, e o lançamento GA do Pro-0813 elevou essa linha de base novamente enquanto adicionou suporte nativo à Responses API e níveis de esforço de raciocínio mais flexíveis.
A tese mais plausível para o V4.1, portanto, não é “um misterioso novo modelo de trilhões de parâmetros”. É um V4 mais maduro: execução de Agente em produção mais forte, ferramentas empresariais mais amplas, potencialmente entrada multimodal nativa e um equilíbrio mais ajustado entre a eficiência do Flash e o raciocínio em nível Pro. A incerteza central é se a DeepSeek entregará essas melhorias sob o nome V4.1.
Os desenvolvedores já podem testar o DeepSeek V4 Flash e o DeepSeek V4 Pro via CometAPI, enquanto a página do DeepSeek V4.1 pode ser usada para acompanhar a disponibilidade na CometAPI se um modelo separado se tornar acionável. A CometAPI fornece uma camada de API unificada para comparar a DeepSeek com outros modelos de fronteira sem reconstruir a integração para cada provedor.
