Especificações técnicas do GPT-5.4-2026-03-05
| Item | GPT-5.4-2026-03-05 |
|---|---|
| Família do modelo | GPT-5 |
| Provedor | OpenAI |
| Data de lançamento | March 5, 2026 |
| Janela de contexto | 1,050,000 tokens |
| Máx. de tokens de saída | 128,000 |
| Tipos de entrada | Texto, Imagem |
| Tipos de saída | Texto |
| Áudio | Não suportado |
| Controles de raciocínio | none, low, medium, high, xhigh |
| Suporte a ferramentas | Pesquisa na web, Pesquisa de arquivos, Interpretador de código, Geração de imagens |
| Data de corte do conhecimento | Aug 31, 2025 |
| Estabilidade do snapshot | Comportamento do modelo bloqueado |
O que é o GPT-5.4?
GPT-5.4 é um lançamento de fronteira unificador que reúne melhorias das linhas recentes de raciocínio e codificação (incluindo o trabalho GPT-5.3-Codex) em um único modelo voltado para trabalho profissional de conhecimento. Ele é posicionado como um modelo “Thinking” para raciocínio mais profundo e passível de direcionamento, e como uma variante “Pro” para clientes que exigem o mais alto desempenho/throughput. Os temas-chave do lançamento são: (1) entendimento com contexto mais longo e em escala de documentos, (2) capacidades aprimoradas de uso de ferramentas e “uso de computador” (controle de apps, edição de planilhas/apresentações) e (3) menos erros factuais e planejamento multi-etapas mais robusto.
Principais recursos do GPT-5.4
- Capacidade enorme de contexto longo (1M+ tokens experimental): o GPT-5.4 oferece sessões experimentais de 1,05M de tokens (com preços/limites), viabilizando raciocínio sobre livros inteiros / bases de código inteiras e síntese multi-documento. Para disponibilidade geral, a janela padrão permanece em ≈272K tokens.
- Uso de ferramentas multi-etapas aprimorado e “uso de computador” nativo: melhor controle de desktop/navegador para fluxos de trabalho agentes (teclado/mouse via uma interface de uso de computador), pesquisa na web que persiste entre rodadas e um novo mecanismo de Tool Search para encontrar conectores/ferramentas de forma eficiente. Relatórios da OpenAI indicam resultados no estado da arte em múltimos benchmarks de uso de computador e agentes web.
- Geração/edição de planilhas, documentos e apresentações: ajuste específico para fluxos de trabalho de escritório; benchmarks internos mostram grandes ganhos em modelagem de planilhas e qualidade de apresentações. A OpenAI também lançou um suplemento ChatGPT para Excel junto com o release.
- Controlabilidade e modos de raciocínio: o modo “Thinking” produz um plano/preâmbulo explícito para tarefas longas e permite direcionamento durante a resposta (ajustar instruções durante a geração). Níveis de esforço de raciocínio permitem ao usuário trocar latência por cadeias de raciocínio mais profundas.
- Compreensão multimodal aprimorada: melhor interpretação de imagens e gráficos em alta resolução (entrada de imagem), usada para entendimento de documentos e apresentações.
- Postura de segurança: a OpenAI trata o GPT-5.4 como um modelo com alta capacidade cibernética e aplica proteções reforçadas semelhantes às mitigações do GPT-5.3-Codex.
Desempenho em benchmarks
| GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | |
|---|---|---|---|
| GDPval (vitórias ou empates) | 83.0% | 70.9% | 70.9% |
| SWE-Bench Pro (Public) | 57.7% | 56.8% | 55.6% |
| OSWorld-Verified | 75.0% | 74.0%* | 47.3% |
| Toolathlon | 54.6% | 51.9% | 46.3% |
| BrowseComp | 82.7% | 77.3% | 65.8% |
GPT-5.4 vs. modelos comparáveis
| Model | Context Window | Key Strength |
|---|---|---|
| GPT-5.4-2026-03-05 | 1,050,000 tokens | Raciocínio de fronteira + fluxos de trabalho com agentes |
| GPT-5.3 Instant | Smaller | Mais rápido em tarefas do dia a dia |
| Claude Opus / Sonnet | ~200k tokens | Raciocínio de longo formato |
| Gemini 3 Pro | ~1M tokens | Raciocínio multimodal |
Diferença principal: GPT-5.4 foca fortemente em fluxos de trabalho de produtividade profissional e capacidades de agente, especialmente quando integrado a ferramentas externas.
Casos de uso representativos em produção
- Fluxos de trabalho corporativos de documentos e compliance: processamento de contratos longos, extração de obrigações e elaboração de comentários em corpora multi-documento (beneficia-se das opções de contexto de 272K→1M para síntese em uma única sessão).
- Automação de planilhas e modelagem financeira: geração de fórmulas, criação de modelos multi-aba a partir de especificações em inglês simples, reconciliação de entradas — a OpenAI reporta grandes ganhos em tarefas no estilo de banco de investimento júnior.
- Automação agentiva e “uso de computador”: fluxos de trabalho automatizados de navegador/desktop (instalação, QA, orquestração de ferramentas) e cadeias de ferramentas multi-etapas (integrações com Zapier citadas como parceiras).
- Engenharia de software e manutenção de código: geração de código, refatorações e tarefas de agente em terminal/CLI (ganhos relatados no Terminal-Bench). Para bases de código grandes, a janela de contexto longa ajuda, mas deve ser validada conforme as heurísticas da tarefa.
- Aumento de produtividade de knowledge workers: síntese de pesquisa (melhorias no BrowseComp), geração de slides e design visual para apresentações.
Como acessar a API do GPT-5.4
Etapa 1: Cadastre-se para obter a chave de API
Faça login em cometapi.com. Se você ainda não é nosso usuário, registre-se primeiro. Entre no seu console CometAPI. Obtenha a credencial de acesso (API key) da interface. Clique em “Add Token” na seção de token de API no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.

Etapa 2: Envie solicitações para a API do GPT-5.4
Selecione o endpoint “gpt-5.4” para enviar a solicitação de API e defina o corpo da solicitação. O método e o corpo da solicitação são obtidos na documentação da API em nosso site. Nosso site também oferece teste no Apifox para sua conveniência. Substitua <YOUR_API_KEY> pela sua chave CometAPI real da sua conta. O URL base é Chat Completions e Responses.
Insira sua pergunta ou solicitação no campo content — é isso que o modelo responderá. Processe a resposta da API para obter a resposta gerada.
Etapa 3: Recuperar e verificar os resultados
Processe a resposta da API para obter a resposta gerada. Após o processamento, a API responde com o status da tarefa e os dados de saída.