Visão geral da API Claude Sonnet 5
A Claude Sonnet 5 API é o modelo mais recente da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos de longo contexto e trabalho profissional do dia a dia. No CometAPI, o ID do modelo é claude-sonnet-5, exposto tanto pelo endpoint nativo Messages da Anthropic quanto por um endpoint de chat compatível com OpenAI, para que os desenvolvedores possam escolher entre controles específicos do Claude e uma camada de integração multimodelo portátil.
Especificações técnicas
| Item | Especificação |
|---|---|
| Nome do modelo | Claude Sonnet 5 |
| ID do modelo na API | claude-sonnet-5 |
| Provedor | Anthropic |
| Código do provedor no CometAPI | anthropic |
| Tipos de entrada | Entrada de texto e imagem; entrada de PDF/documento está listada nos recursos do catálogo do CometAPI |
| Tipo de saída | Texto |
| Janela de contexto | 1M tokens, padrão e máximo no Claude Sonnet 5 |
| Máximo de tokens de saída | 128k tokens na API Messages síncrona |
| Raciocínio adaptativo | Sim; ativado por padrão |
| Raciocínio estendido | Raciocínio manual: {type: "enabled", budget_tokens: N} é removido e retorna um erro 400 |
| Controle de esforço | Suportado por meio do parâmetro effort; a Anthropic observa que a API e o Claude Code têm padrão de alto esforço |
| Parâmetros de amostragem | temperature, top_p ou top_k diferentes do padrão retornam erro 400 |
| Data de corte de conhecimento confiável | janeiro de 2026 |
| Data de corte do treinamento | janeiro de 2026 |
O que é o Claude Sonnet 5?
Claude Sonnet 5 é o modelo Sonnet de próxima geração da Anthropic e uma atualização direta do Claude Sonnet 4.6. A Claude Sonnet 5 API é o modelo mais recente da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos de longo contexto e trabalho profissional do dia a dia.
O modelo reduz a lacuna de capacidade entre Sonnet e Opus. As notas de lançamento da Anthropic afirmam que o Sonnet 5 se aproxima do Claude Opus 4.8 em desempenho agentivo, mantendo o papel mais rápido e eficiente da classe Sonnet. Ele é projetado para desenvolvedores que precisam de um acompanhamento mais forte do que o Sonnet 4.6, sem migrar todos os fluxos de trabalho para um modelo de nível Opus.
Para usuários de API, o Sonnet 5 também muda a forma como a geração é controlada. O raciocínio adaptativo é ativado por padrão, orçamentos manuais de raciocínio estendido não são mais aceitos e parâmetros de amostragem fora do padrão são rejeitados. Migrações de produção do Sonnet 4.6 devem, portanto, retestar orçamentos de tokens, remover orçamentos de raciocínio manual e evitar sobrescrever temperature/top-p/top-k.
Recursos e destaques do Claude Sonnet 5
1. Codificação orientada a agentes mais forte e trabalho em terminal
A Anthropic posiciona o Claude Sonnet 5 como seu modelo Sonnet mais orientado a agentes até agora. No system card, o Claude Sonnet 5 atinge 85.2% no SWE-bench Verified, 63.2% no SWE-bench Pro, 78.3% no SWE-bench Multilingual e 80.4% no Terminal-Bench 2.1. Esses resultados tornam a Claude Sonnet 5 API bem adequada para revisão de código, investigação de bugs, planejamento de migração, geração de testes e agentes de engenharia autônomos.
2. Raciocínio de longo contexto com 1M tokens
O Claude Sonnet 5 oferece uma janela de contexto de 1M tokens por padrão. A Anthropic observa que o modelo usa um novo tokenizador que produz aproximadamente 30% mais tokens para o mesmo texto do que o Claude Sonnet 4.6, então os desenvolvedores devem recontar prompts e revisitar as configurações de max_tokens ao migrar. A grande janela de contexto continua sendo uma grande vantagem para tarefas em escala de repositório, revisão de políticas, planilhas financeiras, pesquisa com múltiplos documentos e longos históricos de suporte ao cliente.
3. Capacidade multimodal para documentos e uso de computador
A visão geral atual dos modelos Claude afirma que os modelos atuais suportam entrada de texto e imagem com saída em texto, capacidades multilíngues e visão. O Sonnet 5 marca 67.5% sem ferramentas e 81.6% com ferramentas no GDP.pdf, 81.2% no OSWorld-Verified e 86.7% com ferramentas no ChartMuseum, indicando força prática em documentos densos, tarefas no estilo GUI e raciocínio com gráficos.
4. Controles específicos do Claude via CometAPI
O CometAPI expõe o Claude Sonnet 5 por meio de /v1/messages para integrações no estilo Anthropic e /v1/chat/completions para roteamento compatível com OpenAI. Use o endpoint nativo Messages quando precisar de recursos específicos do Claude, como raciocínio adaptativo, controle de esforço, cache de prompts, ferramentas no servidor ou formatos de resposta da Anthropic. Use o endpoint compatível com OpenAI quando seu app já padroniza chamadas de chat no estilo OpenAI e você quiser comparar o Claude Sonnet 5 com GPT, Gemini ou outros modelos do catálogo do CometAPI.
Desempenho em benchmarks
Os materiais de lançamento da Anthropic e o system card do Claude Sonnet 5 relatam ganhos amplos em relação ao Claude Sonnet 4.6, especialmente em codificação, busca agentiva, raciocínio multimodal e desempenho em tarefas profissionais.
| Capacidade | Benchmark | Resultado do Claude Sonnet 5 | Observações |
|---|---|---|---|
| Correção de código | SWE-bench Verified | 85.2% | 500 tarefas verificadas de engenharia de software |
| Correção de código mais difícil | SWE-bench Pro | 63.2% | Diffs maiores de múltiplos arquivos e problemas mais difíceis no repositório |
| Codificação multilíngue | SWE-bench Multilingual | 78.3% | 300 tarefas em 9 linguagens de programação |
| Agentes de codificação em terminal | Terminal-Bench 2.1 | 80.4% | Recompensa média ao longo de 445 execuções |
| Codificação orientada a agentes | FrontierCode v1 | 38.8% | Tarefas reais no estilo pull request da Cognition |
| Tarefas de produção no Cursor | CursorBench | 61.2% | Medido independentemente pela Cursor; o Sonnet 4.6 obteve 49% |
| Busca web orientada a agentes | BrowseComp | 84.7% | Raciocínio adaptativo no esforço máximo com limite de 10M tokens e compactação de contexto |
| Uso de computador | OSWorld-Verified | 81.2% | Taxa de sucesso na primeira tentativa, média de cinco execuções |
| Raciocínio profissional em PDF | GDP.pdf | 67.5% sem ferramentas, 81.6% com ferramentas | Taxa média de aprovação nos critérios em 100 prompts de PDFs profissionais |
| Entendimento de gráficos | ChartMuseum | 70.1% sem ferramentas, 86.7% com ferramentas | Grande melhoria em relação ao Sonnet 4.6 |
| Raciocínio em documentos Office | OfficeQA / OfficeQA Pro | 73.3% / 59.4% | Pontuações de correspondência exata em um arcabouço orientado a agentes |
| Tarefas econômicas de trabalho | GDPval-AA v2 | ELO 1618 | Avaliação independente da Artificial Analysis; classificado em segundo lugar atrás do Claude Fable 5 no resumo do system card |

Claude Sonnet 5 vs Sonnet 4.6 vs Opus 4.8 vs Claude Fable 5
| Modelo | Papel na mesma categoria | Melhor uso | Nota de seleção |
|---|---|---|---|
| Claude Sonnet 5 | Modelo Sonnet rápido e de alta inteligência para agentes e código | Agentes de codificação, trabalho de longo contexto, análise de documentos, automação de produção | Escolha quando o Sonnet 4.6 não for forte o suficiente, mas um modelo de nível Opus não for necessário para cada requisição. |
| Claude Sonnet 4.6 | Modelo de produção Sonnet anterior | Fluxos de trabalho Sonnet existentes, menor risco de migração, prompts estabelecidos | Atualize para o Sonnet 5 para codificação orientada a agentes e desempenho melhor em tarefas profissionais, mas reteste orçamentos de tokens e parâmetros de API. |
| Claude Opus 4.8 | Modelo mais capaz de nível Opus | Raciocínio complexo, trabalho de alta autonomia, tarefas de agente de longo horizonte mais difíceis | Use quando a tarefa exigir maior pico de raciocínio; o Sonnet 5 pode igualar ou se aproximar em algumas tarefas agentivas em níveis de esforço selecionados. |
| Claude Fable 5 | Modelo amplamente lançado mais capaz da Anthropic | Cargas de trabalho de capacidade máxima e trabalho agentivo exigente | Use como referência de ponta quando a qualidade importa mais do que usar a classe Sonnet. |
Como usar a API Claude Sonnet 5 no CometAPI
A Claude Sonnet 5 API é o modelo mais recente da classe Sonnet da Anthropic para agentes de código, fluxos de trabalho com uso de ferramentas, raciocínio em documentos de longo contexto e trabalho profissional do dia a dia. No CometAPI, o ID do modelo é claude-sonnet-5, exposto tanto pelo endpoint nativo Messages da Anthropic quanto por um endpoint de chat compatível com OpenAI, para que os desenvolvedores possam escolher entre controles específicos do Claude e uma camada de integração multimodelo portátil.
Preparação: inscreva-se para obter a chave de API
Faça login em cometapi.com. Se você ainda não é nosso usuário, registre-se primeiro. Acesse seu console do CometAPI. Obtenha a credencial de acesso (chave de API) da interface. Clique em “Adicionar Token” no token de API no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.
Etapa 1: use o endpoint Messages nativo da Anthropic
Use /v1/messages quando quiser o comportamento mais próximo da API do Claude por meio do CometAPI. Esse é o melhor caminho para raciocínio adaptativo, controle de esforço, cache de prompts, ferramentas no servidor, streaming e blocos de conteúdo de resposta no estilo Claude.
Para o Claude Sonnet 5, não envie orçamentos manuais de raciocínio estendido como thinking: {"type": "enabled", "budget_tokens": 32000}. A Anthropic recomenda raciocínio adaptativo e controle de esforço em seu lugar.
Etapa 2: use o endpoint compatível com OpenAI para roteamento portátil
Use /v1/chat/completions quando seu aplicativo já usar chamadas de chat no estilo OpenAI ou quando quiser comparar o Claude Sonnet 5 com outros modelos do catálogo do CometAPI por trás do mesmo padrão de cliente.
Etapa 3: reteste os prompts antes da produção
Ao migrar do Claude Sonnet 4.6, reconte os prompts com o novo tokenizador, remova parâmetros de amostragem fora do padrão e revise os limites de saída. O Sonnet 5 produz mais tokens para o mesmo texto do que o Sonnet 4.6, e os tokens de raciocínio adaptativo compartilham o orçamento de max_tokens com o texto final da resposta.
Por que usar o CometAPI para o Claude Sonnet 5?
O CometAPI oferece aos desenvolvedores um único marketplace de modelos para Claude Sonnet 5, modelos da classe Claude Opus, modelos da classe GPT, modelos da classe Gemini e outros sistemas de IA de ponta. Isso é útil quando as equipes desejam uma única chave de API, comparação de modelos, lançamentos em etapas, roteamento de fallback e migração mais fácil entre provedores.
Especificamente para o Claude Sonnet 5, o valor do CometAPI é a estratégia de endpoint duplo. As equipes podem usar o endpoint Messages da Anthropic para recursos nativos do Claude e usar o endpoint compatível com OpenAI para apps que já padronizam requisições no estilo chat-completions. Isso permite que equipes de engenharia testem a API do Claude Sonnet 5 em fluxos de trabalho realistas de código, documentos e agentes sem reconstruir toda a camada de integração primeiro.
Casos de uso recomendados no CometAPI para o Claude Sonnet 5
O Claude Sonnet 5 é um forte candidato padrão para:
- Agentes de codificação que leem repositórios, geram patches e explicam mudanças.
- Assistentes de revisão de código que priorizam bugs e risco de regressão.
- Análise de documentos de longo contexto em PDFs, políticas, contratos e pacotes de pesquisa.
- Fluxos de investigação de suporte ao cliente que combinam tickets, logs, docs e histórico de contas.
- Revisão de segurança e triagem defensiva de vulnerabilidades.
- Copilotos de análise de dados que explicam tabelas, gráficos e métricas de negócios.
- Fluxos de pesquisa orientados a agentes que navegam, resumem, comparam e citam fontes.
- Assistentes de operações internas que precisam de execução confiável em múltiplas etapas.
Para clientes do CometAPI, uma boa política inicial é:
| Carga de trabalho | Estratégia de modelo recomendada |
|---|---|
| Tarefas de alto valor em codificação e agentes | Padrão para claude-sonnet-5 com esforço mais alto |
| Síntese de documentos longos | Use claude-sonnet-5 com empacotamento cuidadoso de contexto |
| Classificação ou extrapção simples | Use um modelo rápido mais barato, a menos que a qualidade exija o Sonnet 5 |
| Tarefas de segurança sensíveis | Use o Sonnet 5 com logging, verificações de intenção e UX consciente de políticas |
| Fluxos de trabalho Sonnet legados | Execute avaliações A/B antes de substituir o Sonnet 4.6 |
| Aplicações multimodelo | Use roteamento do CometAPI e lógica de fallback |
Quanto realmente custa o Claude Sonnet 5?
O Claude Sonnet 5 usa precificação por tokens de API.
| Preços | Tokens de entrada | Tokens de saída |
|---|---|---|
| Introdutório (até 31 de agosto de 2026) | $2 / 1M tokens | $10 / 1M tokens |
| Padrão (a partir de 1 de setembro de 2026) | $3 / 1M tokens | $15 / 1M tokens |
A Anthropic também oferece tarifas com desconto para cache de prompt e processamento em lotes. Uma mudança importante é que o Sonnet 5 usa um novo tokenizador, que normalmente produz cerca de 30% mais tokens para o mesmo texto do que o Sonnet 4.6, portanto os custos no mundo real podem ser um pouco maiores, mesmo que o preço por token não tenha mudado.
Desempenho da API Claude Sonnet 5 no CometAPI
O Claude Sonnet 5 foi projetado para equilibrar velocidade, qualidade de raciocínio e custo.
Principais melhorias incluem:
- Desempenho de codificação mais forte
- Melhores fluxos de trabalho orientados a agentes (planejar e executar tarefas em múltiplas etapas)
- Suporte nativo a janelas de contexto de 1 milhão de tokens
- Até 128K tokens de saída
- Uso de ferramentas aprimorado (navegador, terminal, APIs)
- Raciocínio adaptativo ativado por padrão
Em comparação com o Sonnet 4.6, a Anthropic relata ganhos notáveis em:
- Engenharia de software
- Raciocínio complexo
- Conclusão autônoma de tarefas
- Entendimento de longo contexto
O modelo é destinado como uma substituição direta do Sonnet 4.6 com mudanças mínimas de API.
O que os desenvolvedores constroem com o Claude Sonnet 5
Os desenvolvedores normalmente usam o Claude Sonnet 5 para:
Assistentes de codificação com IA
- Geração de código
- Refatoração
- Depuração
- Geração de testes
Agentes de IA
- Automação de navegador
- Assistentes de pesquisa
- Agentes de suporte ao cliente
- Automação de tarefas
Aplicações corporativas
- Busca de conhecimento
- Assistentes de documentação interna
- Automação de fluxos de trabalho
- Análises de negócios
Geração de conteúdo
- Escrita técnica
- Copy de marketing
- Relatórios
- Documentação
Processamento de dados
- Extração de informação
- Resumo de documentos
- Classificação
- Geração de JSON estruturado
Como o Sonnet 5 combina raciocínio forte com custos de API relativamente baixos, ele é bem adequado para aplicações de produção que precisam de qualidade e escalabilidade.