DeepSeek Vision and Grok Imagine models are now live on CometAPI →
new/Pesquisa CometAPI

DeepSeek-V4.1 chega em breve: especificações esperadas, benchmarks e funcionalidades

O DeepSeek-V4.1 é interessante precisamente porque o atual ciclo V4 mostra que a DeepSeek pode tornar a família materialmente mais forte .

CometAPI
AnnaEquipe de pesquisa de modelos e API de IA
Atualizado Aug 24, 2026 12 min de leitura
DeepSeek-V4.1 chega em breve: especificações esperadas, benchmarks e funcionalidades
Use este padrão

Faça a primeira chamada à API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

A família V4 da DeepSeek já superou sua fase de preview original. DeepSeek V4 Flash entrou em beta público como V4-Flash-0731 em 31 de julho, enquanto o DeepSeek V4 Pro alcançou GA como V4-Pro-0813 em 13 de agosto no APP, Web e API. Os dois modelos mantêm o design de contexto de um milhão de tokens e a arquitetura MoE da família V4, com o Flash otimizado para eficiência e o Pro posicionado como o modelo de Agente e raciocínio de maior capacidade.

O lançamento GA do Pro eleva materialmente a linha de base para qualquer previsão V4.1. A DeepSeek afirma que o build GA traz capacidades de Agente significativamente aprimoradas, especialmente em ambientes de produção, e agora oferece suporte nativo à Responses API tanto para V4-Pro quanto para V4-Flash, além de níveis de esforço de raciocínio baixo, alto e máximo. A versão atual do modelo na API está explicitamente listada como DeepSeek-V4-Pro-0813. Então, onde se encaixa o DeepSeek V4.1 agora? O relatório de maio da The Information disse que a DeepSeek planejava um lançamento do V4.1 em junho com ferramentas empresariais mais fortes e suporte multimodal. Essa janela passou, e o registro de lançamentos atual da DeepSeek ainda não contém cartão de modelo ou entrada de lançamento do V4.1. A interpretação mais segura é, portanto, uma possível iteração pós-GA do V4 cujas metas relatadas ainda podem chegar sob o nome V4.1 ou por meio de atualizações adicionais do V4.

DeepSeek-V4.1 chega em breve: especificações esperadas, benchmarks e funcionalidades

Os marcos confirmados usam o change log da DeepSeek; o plano anterior de V4.1 em junho veio da The Information.

O que é o DeepSeek-V4.1?

O DeepSeek-V4.1 é melhor entendido como uma iteração pós-GA do V4 não confirmada, não como um modelo da DeepSeek oficialmente lançado. A família V4 já possui um checkpoint de produção no V4-Pro-0813, então o V4.1 agora representaria uma atualização de capacidade no meio do ciclo, em vez do passo necessário para completar o rollout original do V4. A DeepSeek não publicou cartão do modelo V4.1, relatório técnico, changelog da API ou tabela de benchmarks.

PerguntaResposta atualConfiança
A DeepSeek anunciou oficialmente “V4.1”?Não. O registro de lançamentos atual da DeepSeek não tem entrada ou cartão de modelo V4.1.Alta
Um lançamento V4.1 foi relatado?Sim. A The Information relatou um plano de junho com ferramentas empresariais e suporte multimodal.Média
A janela de junho relatada ocorreu?Não surgiu um V4.1 oficial separado durante essa janela.Alta
Qual é o marco V4 confirmado mais recente?V4-Flash-0731 entrou em beta público em 31 de julho e V4-Pro-0813 alcançou GA em 13 de agosto.Alta
O V4.1 ainda pode ser lançado como modelo separado?Sim, mas o nome, as especificações e o timing permanecem não confirmados.Baixa/Média

Especificações esperadas do DeepSeek-V4.1

Como a DeepSeek não publicou especificações do V4.1, a tabela abaixo separa as capacidades V4 atuais confirmadas das expectativas direcionais. “Esperado” significa uma continuação razoável do V4 ou uma capacidade reportada pela mídia, não uma especificação oficial do V4.1.

DimensãoV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 (esperado)
Família do modeloV4V4Provável iteração da família V4
ArquiteturaMoE derivada do V4 com atenção híbridaMoE derivada do V4; GA construído sobre a estrutura PreviewProvavelmente derivada do V4; não confirmado
Parâmetros totais/ativos284B / 13B1,6T / 49BDesconhecido; nenhum número público confiável
Janela de contexto1M1MProvavelmente pelo menos a linha de base do V4
Saída máximaMáximo de 384K na APIMáximo de 384K na APIDesconhecido
Esforço de raciocínioBaixo / alto / máximoBaixo / alto / máximoEspera-se preservar ou ampliar os controles atuais
Responses APISuportadaSuportadaEsperado se construído no stack atual do V4
Entrada nativa de imagem/arquivoNão suportada na Responses API atualNão suportada na Responses API atualDireção multimodal relatada; não confirmada
Ferramentas Enterprise/AgenteFunctions, web search, apply_patch / suporte a CodexFunctions, web search, apply_patch / suporte a CodexÁrea de ênfase relatada; expansão de MCP permanece não confirmada
Pesos abertosSimSim, pesos do V4-Pro-0813 disponíveisPossível para um checkpoint V4.1 separado; não confirmado
Status oficialLançamento de API em beta públicoGASem data de lançamento oficial ou cartão de modelo

O que pode ser novo no DeepSeek-V4.1?

Codificação agentizada mais forte sem um modelo maior

A evidência mais forte do que vem depois do V4 é agora a atualização GA do V4-Pro-0813. A DeepSeek afirma que a capacidade de Agente melhorou substancialmente em ambientes de produção, com Terminal Bench 2.1 em 87,9, NL2Repo em 61,5 e DeepSWE em 62,7. O V4-Flash-0731 já havia mostrado que apenas o pós-treinamento adicional poderia produzir grandes ganhos de Agente sem alterar a arquitetura ou o tamanho do modelo.

Se o V4.1 for uma atualização de meio de ciclo, o alvo realista não é mais simplesmente “melhor que o V4 Preview”. Ele precisaria preservar ou superar a linha de base de Agente do V4-Pro-0813 enquanto melhora a execução de software de longo horizonte, a confiabilidade em nível de repositório, a orquestração de ferramentas e a consistência em produção.

Melhor uso de ferramentas e APIs de Agente mais completas

O stack V4 atual da DeepSeek já oferece suporte à Responses API tanto para o Flash quanto para o Pro e é especificamente adaptado ao Codex. A tabela de compatibilidade da Responses API suporta chamadas de função e web search do lado do servidor, enquanto os tipos de ferramentas file_search, code_interpreter, computer_use e MCP ainda são ignorados. Isso torna uma cobertura mais ampla de ferramentas empresariais uma oportunidade mais clara para o V4.1 do que simplesmente adicionar a própria Responses API.

O suporte nativo a MCP ainda é uma direção plausível de upgrade, mas permanece não confirmado. Uma tese defensável para o V4.1 é uma integração empresarial e de Agente mais profunda sobre uma superfície de API que já suporta Responses, fluxos de trabalho orientados ao Codex, saída estruturada e chamadas de ferramentas.

Entrada multimodal pode ser a maior atualização no nível de produto

A The Information relatou que o V4.1 foi planejado com suporte multimodal. Isso continua sendo o diferenciador de produto mais claro possível porque a Responses API atual da DeepSeek afirma que entradas de imagem e arquivo não são suportadas. Se um futuro checkpoint V4.1 adicionar compreensão nativa de conteúdo visual ou de arquivos, isso expandiria a DeepSeek para fluxos de trabalho de documentos, capturas de tela e programação visual que a API apenas de texto atual não cobre.

Até que a DeepSeek publique um cartão de modelo V4.1 ou um esquema de API, as modalidades exatas, limites de resolução, comportamento de áudio/vídeo e benchmarks multimodais devem permanecer marcados como desconhecidos.

Desempenho de fronteira com custo ao nível da DeepSeek

Baixo custo de inferência continua sendo uma das forças mais diferenciadas da DeepSeek, mas a precificação oficial mudou com o rollout completo do V4. A tabela de preços atual usa tarifas de pico/fora de pico: a entrada com cache-miss do V4-Flash é $0,22 fora de pico / $0,44 em pico e a saída é $0,66 / $1,32 por 1M tokens; a entrada do V4-Pro é $0,66 / $1,32 e a saída é $1,98 / $3,96. As tarifas fora de pico são metade das tarifas de pico.

Desempenho esperado em benchmarks do DeepSeek-V4.1

Ainda não há pontuações oficiais de benchmarks do V4.1. A linha de base mais forte da família V4 atualmente é o DeepSeek-V4-Pro-0813 GA, que substitui o Pro Preview como ponto de referência para desempenho de Agente. A DeepSeek reporta 87,9 no Terminal Bench 2.1, 61,5 no NL2Repo, 83,3 no Cybergym, 62,7 no DeepSWE e 74,1 no Toolathlon-Verified, juntamente com ganhos no AutomationBench e no DSBench.

DeepSeek-V4.1 chega em breve: especificações esperadas, benchmarks e funcionalidades

Figura 6. Valores oficiais de benchmark de Agente do DeepSeek-V4-Pro-0813 GA, visualizados a partir do change log da DeepSeek.

BenchmarkV4-Pro-0813V4-Flash-0731Pro Preview
Terminal Bench 2.187,982,772,1
NL2Repo61,554,238,5
Cybergym83,376,752,7
DeepSWE62,754,412,8
Toolathlon-Verified74,170,355,9
Agents' Last Exam25,725,216,5
AutomationBench (Público)31,825,112,8
DSBench-FullStack71,168,7
DSBench-Hard67,259,6

DeepSeek-V4.1 chega em breve: especificações esperadas, benchmarks e funcionalidades

Figura 7. V4-Pro-0813 versus V4-Flash-0731 em benchmarks comuns de Agente. Os valores vêm do change log da DeepSeek; o harness e as configurações de raciocínio podem afetar comparações entre modelos.

A progressão sugere três expectativas baseadas em evidências para o V4.1. Primeiro, um lançamento V4.1 significativo deve ao menos preservar a linha de base GA do V4-Pro-0813, não apenas superar o antigo Preview. Segundo, a DeepSeek ainda está extraindo ganhos por meio de pós-treinamento e otimização de Agente, em vez de apenas escalar a contagem de parâmetros. Terceiro, a atualização mais valiosa do V4.1 pode ser uma capacidade multimodal e de ferramentas empresariais mais ampla se o desempenho central de Agente já estiver próximo do topo do envelope de design do V4.

DeepSeek-V4.1 vs V4-Flash vs V4-Pro

DimensãoV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 esperado
PosicionamentoModelo de Agente/codificação rápido e eficienteModelo V4 atual de maior capacidade de raciocínio/AgentePossível upgrade de capacidade no meio do ciclo V4
Escala284B total / 13B ativos1,6T total / 49B ativosDesconhecido
Contexto1M1MProvavelmente pelo menos 1M se derivado do V4
Codificação de AgenteMuito forte após o pós-treinamento 0731Linha de base oficial de Agente mais forte do V4Espera-se atender ou superar a linha de base do Pro GA
Esforço de raciocínioBaixo / alto / máximoBaixo / alto / máximoEspera-se preservar ou ampliar os controles
Responses APISuportadaSuportadaEsperado se construído no stack atual do V4
Entrada multimodalSem entrada de imagem/arquivo na Responses API atualSem entrada de imagem/arquivo na Responses API atualPossibilidade relatada; não confirmada
Custo oficial da APICamada V4 inferior; preços pico/fora de picoCamada V4 superior; preços pico/fora de picoDesconhecido
StatusLançamento oficial de API em beta públicoGANão anunciado pela DeepSeek

Para que será usado o DeepSeek-V4.1?

Se a direção relatada se mantiver, o V4.1 seria mais atraente onde a família V4 atual já é forte, mas ainda carece de capacidades de produto mais amplas.

1. Repositórios em escala para agentes de codificação. Compreensão de código de longo contexto, geração de patches, loops de teste e execução em terminal são os encaixes mais claros dados os ganhos de Agente do V4-Pro-0813 e do Flash-0731.

2. Pesquisas empresariais e fluxos de trabalho de documentos. Uma linha de base de 1M de contexto, suporte à Responses API e integração web/ferramentas podem suportar grandes conjuntos de conhecimento internos, corpora de políticas e documentação técnica. O V4.1 se tornaria mais útil aqui se adicionar recuperação mais rica ou ferramentas de arquivos.

3. Agentes autônomos sensíveis a custo. O V4-Flash permanece particularmente atraente para loops repetidos de planejamento e chamadas de ferramentas, enquanto o V4-Pro oferece uma camada de maior capacidade. O V4.1 seria atraente se preservar essa disciplina de custo.

4. Análise de documentos visuais e capturas de tela. Isso se torna um caso de uso nativo importante apenas se a capacidade multimodal relatada for entregue formalmente.

5. Implantações privadas ou personalizadas. A DeepSeek lançou os pesos do V4-Pro-0813 e do V4-Flash-0731, portanto um checkpoint V4.1 lançado separadamente pode permanecer atraente para organizações que precisam de self-hosting ou adaptação de domínio. A disponibilidade de pesos abertos para o próprio V4.1 não está confirmada.

O que ainda não sabemos

O maior risco ao escrever um artigo “em breve” é transformar extrapolação plausível em especificação falsa. Estes pontos devem permanecer explicitamente em aberto até que a DeepSeek publique material de primeira mão:

  • Se “DeepSeek-V4.1” será o nome oficial do modelo.
  • Se o V4.1 é um checkpoint distinto ou um rótulo separado para melhorias além de V4-Flash-0731 e V4-Pro-0813.
  • Contagem total de parâmetros, contagem de parâmetros ativados e quaisquer mudanças arquiteturais.
  • Entradas multimodais exatas e se imagem, áudio, vídeo ou arquivos são suportados.
  • Suporte nativo a MCP, computer-use, file-search ou code-interpreter.
  • Pontuações oficiais de benchmarks e configurações de avaliação.
  • Preços da API, disponibilidade de pesos abertos e termos comerciais para um checkpoint V4.1 separado. Uma data de lançamento firme.

Considerações finais

O DeepSeek-V4.1 é interessante precisamente porque o ciclo V4 atual mostra que a DeepSeek pode tornar a família materialmente mais forte sem introduzir uma arquitetura completamente nova. A atualização de pós-treinamento do Flash-0731 entregou grandes ganhos de Agente, e o lançamento GA do Pro-0813 elevou essa linha de base novamente enquanto adicionou suporte nativo à Responses API e níveis de esforço de raciocínio mais flexíveis.

A tese mais plausível para o V4.1, portanto, não é “um misterioso novo modelo de trilhões de parâmetros”. É um V4 mais maduro: execução de Agente em produção mais forte, ferramentas empresariais mais amplas, potencialmente entrada multimodal nativa e um equilíbrio mais ajustado entre a eficiência do Flash e o raciocínio em nível Pro. A incerteza central é se a DeepSeek entregará essas melhorias sob o nome V4.1.

Os desenvolvedores já podem testar o DeepSeek V4 Flash e o DeepSeek V4 Pro via CometAPI, enquanto a página do DeepSeek V4.1 pode ser usada para acompanhar a disponibilidade na CometAPI se um modelo separado se tornar acionável. A CometAPI fornece uma camada de API unificada para comparar a DeepSeek com outros modelos de fronteira sem reconstruir a integração para cada provedor.

Continuar aprendendo

Conecte este artigo à próxima decisão.

Ver todos os tópicos
Publicado em Aug 23, 2026
Última atualização Aug 24, 2026
0 visualizações
Revisado para maior clareza, atribuição de fontes e terminologia de API atual.

Pronto para reduzir os custos de desenvolvimento de IA em 20%?

Comece gratuitamente em minutos. Créditos de avaliação gratuita incluídos. Não é necessário cartão de crédito.

Leia Mais