Visão geral da API do Claude Sonnet 5
A Claude Sonnet 5 API é o modelo mais novo da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos com contexto longo e trabalho profissional do dia a dia. No CometAPI, o ID do modelo é claude-sonnet-5, exposto tanto pelo endpoint nativo Anthropic Messages quanto por um endpoint de chat compatível com OpenAI, para que desenvolvedores possam escolher entre controles específicos do Claude e uma camada de integração portátil multi-modelo.
Especificações técnicas
| Item | Especificação |
|---|---|
| Model name | Claude Sonnet 5 |
| API model ID | claude-sonnet-5 |
| Provider | Anthropic |
| CometAPI provider code | anthropic |
| Input types | Entrada de texto e imagem; entrada de PDF/documento listada nos recursos do catálogo do CometAPI |
| Output type | Texto |
| Context window | 1M tokens, padrão e máximo no Claude Sonnet 5 |
| Maximum output tokens | 128k tokens na API Messages síncrona |
| Adaptive thinking | Sim; ativado por padrão |
| Extended thinking | Manual thinking: {type: "enabled", budget_tokens: N} é removido e retorna um erro 400 |
| Effort control | Suportado por meio do parâmetro effort; a Anthropic observa que a API e o Claude Code adotam alto esforço por padrão |
| Sampling parameters | temperature, top_p ou top_k fora do padrão retornam um erro 400 |
| Reliable knowledge cutoff | janeiro de 2026 |
| Training data cutoff | janeiro de 2026 |
O que é o Claude Sonnet 5?
Claude Sonnet 5 é o modelo Sonnet de próxima geração da Anthropic e uma atualização direta do Claude Sonnet 4.6. A Claude Sonnet 5 API é o modelo mais novo da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos com contexto longo e trabalho profissional do dia a dia.
O modelo reduz a diferença de capacidade entre Sonnet e Opus. As notas de lançamento da Anthropic afirmam que o Sonnet 5 se aproxima do Claude Opus 4.8 em desempenho agentic, ao mesmo tempo em que mantém o papel mais rápido e eficiente da classe Sonnet. Ele foi projetado para desenvolvedores que precisam de um seguimento mais forte do que o Sonnet 4.6 sem mover todo o fluxo de trabalho para um modelo de nível Opus.
Para usuários de API, o Sonnet 5 também muda como o processo de geração é controlado. O raciocínio adaptativo é ativado por padrão, orçamentos manuais de raciocínio estendido não são mais aceitos e parâmetros de amostragem fora do padrão são rejeitados. Migrações de produção a partir do Sonnet 4.6 devem, portanto, retestar orçamentos de tokens, remover orçamentos de raciocínio manual e evitar sobrescritas de temperature/top-p/top-k.
Recursos e destaques do Claude Sonnet 5
1. Codificação agentic e trabalho em terminal mais fortes
A Anthropic posiciona o Claude Sonnet 5 como seu modelo Sonnet mais agentic até agora. No system card, o Claude Sonnet 5 alcança 85,2% no SWE-bench Verified, 63,2% no SWE-bench Pro, 78,3% no SWE-bench Multilingual e 80,4% no Terminal-Bench 2.1. Esses resultados tornam a Claude Sonnet 5 API bastante adequada para revisão de código, investigação de bugs, planejamento de migração, geração de testes e agentes de engenharia autônomos.
2. Raciocínio com contexto longo de 1M tokens
O Claude Sonnet 5 oferece uma janela de contexto de 1M tokens por padrão. A Anthropic observa que o modelo usa um novo tokenizador que produz aproximadamente 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6, portanto, os desenvolvedores devem recontar prompts e revisar as configurações de max_tokens ao migrar. A janela de contexto grande continua sendo uma vantagem para tarefas em escala de repositório, revisão de políticas, planilhas financeiras, pesquisa com vários documentos e longos históricos de suporte ao cliente.
3. Capacidade multimodal de documentos e uso de computador
A visão geral atual dos modelos Claude afirma que os modelos atuais suportam entrada de texto e imagem com saída de texto, capacidades multilíngues e visão. O Sonnet 5 obtém 67,5% sem ferramentas e 81,6% com ferramentas no GDP.pdf, 81,2% no OSWorld-Verified e 86,7% com ferramentas no ChartMuseum, indicando força prática em documentos densos, tarefas no estilo GUI e raciocínio sobre gráficos.
4. Controles específicos do Claude via CometAPI
O CometAPI expõe o Claude Sonnet 5 por meio de /v1/messages para integrações no estilo Anthropic e de /v1/chat/completions para roteamento compatível com OpenAI. Use o endpoint nativo Messages quando precisar de recursos específicos do Claude, como raciocínio adaptativo, controle de esforço, cache de prompt, ferramentas no servidor ou formatos de resposta da Anthropic. Use o endpoint compatível com OpenAI quando seu aplicativo já padroniza chamadas de chat no estilo OpenAI e você deseja comparar o Claude Sonnet 5 com GPT, Gemini ou outros modelos do catálogo CometAPI.
Desempenho em benchmarks
Os materiais de lançamento da Anthropic e o system card do Claude Sonnet 5 reportam ganhos amplos em relação ao Claude Sonnet 4.6, especialmente em codificação, busca agentic, raciocínio multimodal e desempenho em tarefas profissionais.
| Capability | Benchmark | Resultado do Claude Sonnet 5 | Observações |
|---|---|---|---|
| Coding repair | SWE-bench Verified | 85,2% | 500 tarefas verificadas de engenharia de software |
| Harder coding repair | SWE-bench Pro | 63,2% | Diffs maiores em vários arquivos e problemas mais difíceis no repositório |
| Multilingual coding | SWE-bench Multilingual | 78,3% | 300 tarefas em 9 linguagens de programação |
| Terminal coding agents | Terminal-Bench 2.1 | 80,4% | Recompensa média em 445 execuções |
| Agentic coding | FrontierCode v1 | 38,8% | Tarefas reais no estilo pull request da Cognition |
| Cursor production coding tasks | CursorBench | 61,2% | Medido independentemente pela Cursor; o Sonnet 4.6 obteve 49% |
| Agentic web search | BrowseComp | 84,7% | Raciocínio adaptativo no esforço máximo com limite de 10M tokens e compactação de contexto |
| Computer use | OSWorld-Verified | 81,2% | Taxa de sucesso na primeira tentativa, média de cinco execuções |
| Professional PDF reasoning | GDP.pdf | 67,5% sem ferramentas, 81,6% com | Taxa média de aprovação nos critérios em 100 prompts de PDF profissionais |
| Chart understanding | ChartMuseum | 70,1% sem ferramentas, 86,7% com | Forte melhoria em relação ao Sonnet 4.6 |
| Office document reasoning | OfficeQA / OfficeQA Pro | 73,3% / 59,4% | Pontuações de correspondência exata em um ambiente de avaliação orientado a agentes |
| Economic work tasks | GDPval-AA v2 | ELO 1618 | Avaliação independente da Artificial Analysis; classificado em segundo, atrás do Claude Fable 5 no resumo do system card |

Claude Sonnet 5 vs Sonnet 4.6 vs Opus 4.8 vs Claude Fable 5
| Model | Função na mesma categoria | Melhor uso | Nota de seleção |
|---|---|---|---|
| Claude Sonnet 5 | Modelo Sonnet rápido e de alta inteligência para agentes e código | Agentes de código, trabalho com contexto longo, análise de documentos, automação de produção | Escolha quando o Sonnet 4.6 não for forte o suficiente, mas um modelo de nível Opus não for necessário para cada solicitação. |
| Claude Sonnet 4.6 | Modelo Sonnet de produção anterior | Workflows Sonnet existentes, menor risco de migração, prompts estabelecidos | Atualize para o Sonnet 5 para codificação agentic mais forte e melhor desempenho em tarefas profissionais, mas reteste orçamentos de tokens e parâmetros de API. |
| Claude Opus 4.8 | Modelo mais capaz de nível Opus | Raciocínio complexo, trabalho de alta autonomia, tarefas agentic de longo horizonte mais difíceis | Use quando a tarefa exigir maior pico de raciocínio; o Sonnet 5 pode igualar ou se aproximar em algumas tarefas agentic em certos níveis de esforço. |
| Claude Fable 5 | Modelo mais capaz amplamente lançado da Anthropic | Workloads de capacidade máxima e exigentes tarefas agentic de longo horizonte | Use como referência de topo quando a qualidade for mais importante do que permanecer na classe Sonnet. |
Como usar a Claude Sonnet 5 API no CometAPI
A Claude Sonnet 5 API é o modelo mais novo da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos com contexto longo e trabalho profissional do dia a dia. No CometAPI, o ID do modelo é claude-sonnet-5, exposto tanto pelo endpoint nativo Anthropic Messages quanto por um endpoint de chat compatível com OpenAI, para que desenvolvedores possam escolher entre controles específicos do Claude e uma camada de integração portátil multi-modelo.
Preparação: inscreva-se para obter a chave de API
Faça login em cometapi.com. Se você ainda não é nosso usuário, registre-se primeiro. Acesse seu console da CometAPI. Obtenha a credencial de acesso (API key) da interface. Clique em “Add Token” no API token no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.
Etapa 1: use o endpoint nativo Anthropic Messages
Use /v1/messages quando quiser o comportamento mais próximo da API do Claude por meio do CometAPI. Este é o melhor caminho para raciocínio adaptativo, controle de esforço, cache de prompt, ferramentas no servidor, streaming e blocos de conteúdo de resposta no estilo Claude.
Para o Claude Sonnet 5, não envie orçamentos manuais de raciocínio estendido como thinking: {"type": "enabled", "budget_tokens": 32000}. A Anthropic recomenda raciocínio adaptativo e controle de esforço em seu lugar.
Etapa 2: use o endpoint compatível com OpenAI para roteamento portátil
Use /v1/chat/completions quando seu aplicativo já usar chamadas de chat no estilo OpenAI ou quando quiser comparar o Claude Sonnet 5 com outros modelos do catálogo CometAPI por trás do mesmo padrão de cliente.
Etapa 3: reteste os prompts antes da produção
Ao migrar do Claude Sonnet 4.6, reconte os prompts com o novo tokenizador, remova parâmetros de amostragem fora do padrão e revise os limites de saída. O Sonnet 5 produz mais tokens para o mesmo texto do que o Sonnet 4.6, e os tokens de raciocínio adaptativo compartilham o orçamento de max_tokens com o texto final da resposta.
Por que usar o CometAPI para o Claude Sonnet 5?
O CometAPI oferece aos desenvolvedores um marketplace único de modelos para Claude Sonnet 5, modelos da classe Claude Opus, modelos da classe GPT, modelos da classe Gemini e outros sistemas de IA de ponta. Isso é útil quando as equipes querem uma única chave de API, comparação de modelos, lançamentos graduais, roteamento com fallback e migrações mais fáceis entre provedores.
Especificamente para o Claude Sonnet 5, o valor do CometAPI está na estratégia de endpoints duplos. As equipes podem usar o endpoint Anthropic Messages para recursos nativos do Claude e o endpoint compatível com OpenAI para aplicativos que já padronizam solicitações no estilo chat-completions. Isso permite que as equipes de engenharia testem a Claude Sonnet 5 API em fluxos de trabalho realistas de código, documentos e agentes sem precisar reconstruir toda a camada de integração primeiro.
Casos de uso recomendados do CometAPI para o Claude Sonnet 5
Claude Sonnet 5 é um forte candidato padrão para:
- Agentes de código que leem repositórios, geram patches e explicam alterações.
- Assistentes de revisão de código que priorizam bugs e risco de regressão.
- Análise de documentos com contexto longo em PDFs, políticas, contratos e dossiês de pesquisa.
- Fluxos de investigação de suporte ao cliente que combinam tíquetes, logs, documentos e histórico de contas.
- Revisão de segurança e triagem defensiva de vulnerabilidades.
- Copilotos de análise de dados que explicam tabelas, gráficos e métricas de negócios.
- Fluxos de pesquisa orientados a agentes que navegam, resumem, comparam e citam fontes.
- Assistentes de operações internas que precisam de execução confiável em várias etapas.
Para clientes do CometAPI, uma boa política inicial é:
| Carga de trabalho | Estratégia de modelo recomendada |
|---|---|
| Tarefas de codificação e de agentes de alto valor | Padrão em claude-sonnet-5 com esforço mais alto |
| Síntese de documentos longos | Use claude-sonnet-5 com empacotamento cuidadoso de contexto |
| Classificação ou extração simples | Use um modelo rápido mais barato, a menos que a qualidade exija o Sonnet 5 |
| Tarefas sensíveis de segurança | Use o Sonnet 5 com logging, verificações de intenção e UX ciente de políticas |
| Workflows legados do Sonnet | Execute avaliações A/B antes de substituir o Sonnet 4.6 |
| Aplicativos multi-modelo | Use roteamento e lógica de fallback do CometAPI |
Quanto realmente custa o Claude Sonnet 5?
O Claude Sonnet 5 usa precificação baseada em tokens de API.
| Preço | Tokens de entrada | Tokens de saída |
|---|---|---|
| Introdução (até 31 de agosto de 2026) | $2 / 1M tokens | $10 / 1M tokens |
| Padrão (a partir de 1 de setembro de 2026) | $3 / 1M tokens | $15 / 1M tokens |
A Anthropic também oferece taxas com desconto para cache de prompt e processamento em lote. Uma mudança importante é que o Sonnet 5 usa um novo tokenizador, que normalmente produz cerca de 30% mais tokens para o mesmo texto do que o Sonnet 4.6, então os custos reais podem ser um pouco maiores, mesmo que o preço por token não tenha mudado.
Desempenho da Claude Sonnet 5 API no CometAPI
O Claude Sonnet 5 foi projetado para equilibrar velocidade, qualidade de raciocínio e custo.
Principais melhorias incluem:
- Desempenho de codificação mais forte
- Melhores fluxos de trabalho agentic (planejamento e execução de tarefas em várias etapas)
- Suporte nativo a janelas de contexto de 1 milhão de tokens
- Até 128K tokens de saída
- Uso de ferramentas aprimorado (navegador, terminal, APIs)
- Raciocínio adaptativo ativado por padrão
Comparado ao Sonnet 4.6, a Anthropic relata ganhos notáveis em:
- Engenharia de software
- Raciocínio complexo
- Conclusão autônoma de tarefas
- Compreensão de contexto longo
O modelo é destinado como uma substituição direta do Sonnet 4.6 com mudanças mínimas na API.
O que os desenvolvedores constroem com o Claude Sonnet 5
Desenvolvedores costumam usar o Claude Sonnet 5 para:
Assistentes de codificação com IA
- Geração de código
- Refatoração
- Depuração
- Geração de testes
Agentes de IA
- Automação de navegador
- Assistentes de pesquisa
- Agentes de suporte ao cliente
- Automação de tarefas
Aplicações empresariais
- Busca de conhecimento
- Assistentes de documentação interna
- Automação de fluxos de trabalho
- Análise de negócios
Geração de conteúdo
- Escrita técnica
- Textos de marketing
- Relatórios
- Documentação
Processamento de dados
- Extração de informações
- Resumo de documentos
- Classificação
- Geração de JSON estruturado
Como o Sonnet 5 combina raciocínio forte com custos de API relativamente baixos, ele é adequado para aplicações de produção que precisam de qualidade e escalabilidade.