GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/Pesquisa CometAPI

O que é o Claude Sonnet 5.5? Benchmarks, preços e acesso à API

Explore as especificações do Claude Sonnet 5.5, a janela de contexto de 1M, benchmarks, preços, recursos de programação, comparações e acesso à API.

CometAPI
Deon GoodwinEquipe de pesquisa de modelos e API de IA
Atualizado Sep 29, 2026 14 min de leitura
O que é o Claude Sonnet 5.5? Benchmarks, preços e acesso à API
Use este padrão

Faça a primeira chamada à API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 é o mais novo modelo da classe Sonnet da Anthropic, lançado em 28 de setembro de 2026. Ele é posicionado como o complemento mais rápido e de menor custo ao Claude Opus 5.5 para programação, trabalho agentivo bem delimitado, produção de documentos, uso de computador e análise multimodal.

O modelo mantém a precificação padrão de $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída. A Anthropic relata geração de saída mais de 30% mais rápida do que o Sonnet 5 e custos por tarefa até 30% menores porque o modelo mais novo frequentemente conclui o trabalho com menos tokens e etapas.

Os resultados publicados incluem 70.6% no Terminal-Bench 4.0, 55.5% no CursorBench 4.0, 1844 no GDPval-AA v2.1 e 80.1% no OSWorld 2.1. O valor prático não é um único score isolado: o Sonnet 5.5 se aproxima do Opus 5.5 em várias avaliações de trabalho profissional, mantendo preços padrão de tokens mais baixos.

Principais pontos

  • Claude Sonnet 5.5 é o segundo modelo da família Claude 5.5 e é otimizado para produção rápida, não para as tarefas mais ambíguas e abertas.
  • Ele oferece janela de contexto de 1M tokens, até 128K tokens de saída, entrada de texto e imagem, raciocínio adaptativo, uso de ferramentas e respostas estruturadas.
  • A precificação padrão da Claude API é $2/M de entrada, $10/M de saída, $0.20/M para leituras de cache e $2.50/M para gravações de cache de cinco minutos.
  • A Anthropic relata saída 30%+ mais rápida que o Sonnet 5 e ganhos fortes em programação, uso de computador, compreensão de gráficos e trabalho de conhecimento de longo prazo.
  • O ID do modelo na Claude API é claude-sonnet-5-5; desenvolvedores também podem acessar o Claude Sonnet 5.5 API na CometAPI.

O que é Claude Sonnet 5.5?

Claude Sonnet 5.5 é o mais novo modelo Sonnet de uso geral da Anthropic e o segundo lançamento da família Claude 5.5 após o Claude Opus 5.5. A Anthropic o posiciona como um complemento mais rápido e de menor custo ao Opus, em vez de um substituto direto ao carro-chefe.

A distinção é prática: o Opus 5.5 é voltado para trabalho complexo e ambíguo que exige julgamento sustentado, enquanto o Sonnet 5.5 é otimizado para tarefas bem demarcadas, correção de bugs, iteração rápida, programação, produção de documentos e fluxos profissionais de alto volume.

Quais são os recursos mais importantes do Claude Sonnet 5.5?

O modelo combina uma janela de contexto de 1M tokens, até 128K tokens de saída, entrada de texto e imagem, raciocínio adaptativo, esforço ajustável, uso de ferramentas, saídas estruturadas, cache de prompt, processamento em lote e suporte via Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform na AWS. Para equipes de produção, o diferencial não é um único recurso, mas sim geração rápida, menor uso de tokens por tarefa e desempenho próximo ao Opus em várias cargas profissionais bem definidas.

Benchmarks do Claude Sonnet 5.5

A Anthropic relata ganhos substanciais em programação, trabalho profissional de longo horizonte, uso de computador e entendimento visual. A tabela abaixo resume os resultados de avaliação publicados pela empresa.

Benchmark e fonte oficialClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% em XhighNão divulgado publicamente
FrontierCode 1.1 Main46.2% em Max42.4%54.4%49.3% / 52.1% em Xhigh
CursorBench 4.055.5%34.1%57.8%Não divulgado publicamente
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% com tools54.9%67.7%Não informado na tabela-fonte
OSWorld 2.180.1%57.0%81.8%Não informado na tabela-fonte
Chartography61.6%15.6%64.4%53.6%

Avaliação: condições e ressalvas: Os scores não são todos medidos no mesmo nível de esforço. O resultado de 66.4% do Opus 5.5 no Terminal-Bench é reportado em Xhigh. A Anthropic observa que o Sonnet 5.5 pode pontuar mais baixo em Max do que em Xhigh no FrontierCode porque etapas de revisão extras podem introduzir timeouts ou edições fora do escopo. A Artificial Analysis executou o GDPval-AA e o AA-Briefcase em uma implantação pré-lançamento do Sonnet 5.5 afetada por um bug de saída estruturada que, segundo a Anthropic, já foi corrigido. Os números de GPT-6 Sol entre fornecedores também devem ser tratados como observações datadas porque a OpenAI corrigiu um problema de codificação de imagem em 25 de setembro de 2026.

O que os resultados significam: o Sonnet 5.5 não está simplesmente à frente do Sonnet 5 em scores isolados. Ele se aproxima muito do Opus 5.5 em programação, trabalho profissional, uso de computador e reconhecimento de gráficos, mantendo preços na faixa do Sonnet. A Anthropic também relata que, em esforço Low ou Medium, o Sonnet 5.5 pode superar o melhor score do Sonnet 5 em várias avaliações a aproximadamente um décimo do custo por tarefa. Essa combinação de capacidade, velocidade e eficiência por tarefa é sua principal vantagem competitiva.

Quão bom é o Claude Sonnet 5.5?

Programação

A melhoria também é operacional. A Anthropic relata que o Sonnet 5.5 entende codebases mais rapidamente, agrupa chamadas de ferramentas com mais eficiência, usa menos etapas e reduz o custo por tarefa concluída. O FrontierCode testa se as mudanças de código propostas são integráveis (mergeable), enquanto o CursorBench usa tarefas ambíguas e multifileiro extraídas de sessões reais de programação; os ganhos refletem, portanto, execução e julgamento em nível de repositório, não apenas geração de código curto. Essas mudanças importam para correção de bugs, revisão de código, execução de testes e agentes de programação de longa duração.

O que é o Claude Sonnet 5.5? Benchmarks, preços e acesso à API

Trabalho do conhecimento

As melhorias vão além da programação. O GDPval-AA testa tarefas profissionais do mundo real em 44 ocupações e nove grandes setores, então o score de 1844 do Sonnet 5.5 — versus 1449 do Sonnet 5 e 1846 do Opus 5.5 — sugere que seus ganhos se transferem para análise prática, produção de documentos e apoio à decisão, e não ficam confinados a testes laboratoriais de raciocínio.

A Anthropic destaca análise financeira, síntese de documentos, criação de slides, trabalho com planilhas, interpretação de gráficos, checagem de fontes, recuperação de informação e escrita profissional como áreas em que o modelo melhora.

Testadores iniciais também relataram melhorias menos quantificáveis: colaboração mais clara, julgamento conversacional mais natural e um olhar mais apurado para design. A Anthropic afirma que o modelo pode dar acabamento a interfaces de usuário e seguir modelos de slides de perto o suficiente para produzir decks que exigem edição mínima; em um teste interno de revisão operacional, dois especialistas avaliaram o primeiro rascunho como pronto para envio sem alterações.

A implicação mais ampla é que o Sonnet 5.5 deve ser entendido como um modelo para trabalho profissional, não apenas um modelo de programação mais barato.

Uso do computador

O Sonnet 5.5 marca 80.1% no OSWorld 2.1, comparado a 57.0% do Sonnet 5 e 81.8% do Opus 5.5. O OSWorld avalia a capacidade de operar ambientes gráficos de computador, então o resultado indica uma grande melhora geracional e desempenho próximo ao Opus para fluxos que envolvem navegadores, ferramentas de desktop e entendimento de interfaces multimodais. Os resultados do Chartography mostram um padrão semelhante no reconhecimento visual de gráficos: 61.6% para o Sonnet 5.5 versus 15.6% para o Sonnet 5.

Velocidade

A Anthropic relata que o Sonnet 5.5 gera saída mais de 30% mais rápido que o Sonnet 5, tornando-o o modelo Sonnet mais rápido no lançamento. A saída mais veloz se combina com menos chamadas de ferramentas e menor uso de tokens para encurtar loops de agentes, reduzir o tempo de espera durante iteração de código e melhorar a vazão em suporte e outros fluxos de alto volume.

Quanto custa o Claude Sonnet 5.5?

Preços e fonte oficialClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Leituras de cache$0.20 / 1M$0.16 / 1M$0.20 / 1M
Gravações de cache de cinco minutos$2.50 / 1M$2 / 1M$5 / 1M
Tokens de entrada$2 / 1M$1.60/M$4 / 1M
Tokens de saída$10 / 1M$8.00/M$20 / 1M

Nas taxas padrão por token, o Sonnet 5.5 custa metade do Opus 5.5 para entrada e saída. A Anthropic também diz que o novo Sonnet muitas vezes precisa de menos tokens para terminar o mesmo trabalho do que o Sonnet 5, reduzindo o custo por tarefa concluída.

Estes são os preços padrão da Claude API. Preços de provedores de nuvem, processamento regional, duração de cache, descontos por lote e regras de contexto longo podem alterar o custo efetivo.

Quais mudanças de segurança o Claude Sonnet 5.5 introduz?

A Anthropic diz que sua auditoria comportamental automatizada cobriu cerca de 1.850 cenários e constatou que o Sonnet 5.5 melhorou ou igualou o Sonnet 5 na maioria das medidas testadas de alinhamento, resistência a mau uso e honestidade.

Salvaguardas de cibersegurança

Como o Sonnet 5.5 tem capacidades cibernéticas mais fortes que seu predecessor, a Anthropic está implementando salvaguardas semelhantes às usadas para modelos mais capazes. Desenvolvimento de software rotineiro e correção de bugs comuns continuam suportados, enquanto algumas tarefas de cibersegurança de maior risco podem recuar para um caminho de modelo mais seguro.

Salvaguardas de biologia

O modelo usa as mesmas salvaguardas de biologia do Sonnet 5, mirando um conjunto restrito de solicitações potencialmente nocivas enquanto deixa a maior parte do trabalho de pesquisa, educação e clínico sem impacto.

Proteções anti-destilação

A Anthropic afirma que o Sonnet 5.5 é o primeiro modelo Sonnet a ser lançado com classificadores de segurança projetados para impedir extração de raciocínio por meio de ataques de destilação em escala industrial. Ele também expande o pensamento preservado, vinculando o conteúdo de raciocínio à conta e à conversa que o criou, de modo que o raciocínio não possa ser livremente destacado e reproduzido em outro lugar. A maioria dos desenvolvedores não notará essa mudança, mas sistemas que movem conversas entre contas ou alteram o estado de conversa anterior devem revisar a orientação de migração.

Essas declarações descrevem as salvaguardas relatadas pela Anthropic, não uma garantia independente de segurança para toda implantação. As equipes devem avaliar o modelo em relação ao seu próprio modelo de ameaças, políticas e fluxos de alto risco.

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

O Claude Sonnet 5.5 é posicionado como o modelo de produção rápido e eficiente deste grupo. A Anthropic relata que ele gera saídas mais de 30% mais rápido que o Claude Sonnet 5 enquanto mantém o mesmo preço de token de headline. O Claude Opus 5.5 mira trabalhos mais difíceis e ambíguos, enquanto o GPT-6 Sol é a comparação mais próxima da OpenAI para programação de longo contexto e fluxos agentivos.

DimensãoClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
PosicionamentoModelo de produção Sonnet anteriorPotência de produção rápida e eficienteRaciocínio complexo de pontaFluxos complexos de programação e agentes
Janela de contexto1M1M1M1.05M
Saída máxima128K128K128K128K
Controles de raciocínioEsforço adaptativoEsforço adaptativoRaciocínio adaptativo, sempre ativonone, low, medium, high, xhigh e max
Entrada multimodalTexto e imagensTexto e imagensTexto e imagensTexto e imagens
Disponibilidade de APIClaude API e grandes nuvensClaude API e grandes nuvensClaude API e grandes nuvensResponses API e Chat Completions
Preço padrão de entrada/saída por 1M$2 / $10$2 / $10$4 / $20$2 / $10 para prompts de até 272K tokens de entrada
VelocidadeLinha de baseMais de 30% mais rápido que o Sonnet 5Otimizado para trabalho mais difícil e longoVaria pelo esforço de raciocínio
FrontierCode 1.142.4%46.2% em Max54.4%49.3% / 52.1% em Xhigh
GDPval-AA v2.11449184418461487
Mais adequado paraCargas existentes do SonnetCodificação e agentes profissionais de alto volumeTarefas difíceis, ambíguas e de longa duraçãoProgramação, agentes, ferramentas e fluxos de longo contexto nativos do OpenAI

Esses números de benchmark são observações entre fornecedores, e não rankings controlados e permanentes. Os resultados dependem dos níveis de esforço e das condições de implantação.

Como acessar e chamar o Claude Sonnet 5.5 via CometAPI?

O Claude Sonnet 5.5 está disponível via Claude, Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure. Desenvolvedores que desejam uma interface compatível com OpenAI para vários provedores podem chamar o modelo via Claude Sonnet 5.5 API na CometAPI com o identificador de modelo claude-sonnet-5-5.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analyze this codebase and identify the three highest-impact bugs.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

Para uso em produção, armazene a chave de API em uma variável de ambiente e avalie níveis de esforço, cache, chamadas de ferramentas, comportamento de tentativas e consumo de tokens por tarefa.

O que é a configuração de esforço no Claude Sonnet 5.5?

O Claude Sonnet 5.5 oferece níveis de esforço ajustáveis que trocam velocidade e uso de tokens por profundidade de raciocínio. A Anthropic define esforço Medium por padrão nos apps Claude e no Claude Code, enquanto a Claude Platform usa High como padrão.

Níveis mais baixos de esforço servem para trabalho rotineiro ou altamente estruturado. Níveis mais altos permitem mais raciocínio e verificação para tarefas mais difíceis de programação, análise e agentes. O orçamento de produção deve, portanto, considerar esforço, uso de ferramentas e custo total de conclusão de tarefa, e não apenas o preço por token.

API: O que há de novo em relação ao Sonnet 5

Cinco mudanças podem quebrar ou alterar integrações existentes do Sonnet 5:

  1. Thinking-off migrations: integrações que desativaram thinking devem migrar para thinking: {"type": "between_tools"}. Essa configuração desliga o raciocínio inicial preservando o comportamento de raciocínio entre ferramentas.
  2. Forced tool use: escolhas de ferramentas forçadas agora retornam erro; use seleção automática de ferramentas com esquemas estritos quando apropriado.
  3. Thinking-block preservation: blocos de pensamento estão atrelados ao modelo e à conversa. Reenvie-os inalterados e não assuma que eles podem ser reproduzidos após alterar mensagens de sistema anteriores, ferramentas ou o contexto da conta.
  4. Computer-use tool version: na Claude API e no Google Cloud, a ferramenta mais antiga computer_20251124 não é mais aceita; migre para o conjunto de ferramentas de computador atualmente documentado.
  5. Advisor compatibility: a ferramenta advisor rejeita Claude Opus 4.8, Opus 4.7 e Sonnet 5 como advisors.

Uma mudança adicional no formato da resposta pode falhar silenciosamente: texto gerado entre chamadas de ferramentas pode aparecer em blocos de pensamento em vez de blocos de texto. Aplicações que transmitem mensagens de progresso devem processar respostas por tipo de bloco e configurar um modo de exibição apropriado. O Sonnet 5.5 também adiciona esforço por mensagem em beta, mensagens de sistema no meio da conversa, mudanças de ferramentas no meio da conversa em beta, comprimento mínimo de prompt armazenável em cache de 512 tokens, processamento em lote, suporte à Files API, entrada de PDF e visão, e ferramentas tanto no servidor quanto no cliente.

O que o Claude Sonnet 5.5 significa para a família Claude 5.5?

  • Claude Opus 5.5: trabalho complexo, de alto julgamento e longo horizonte.
  • Claude Sonnet 5.5: produção eficiente, programação, agentes e trabalho profissional.
  • Claude Haiku 5.5: anunciado como o próximo membro de alto throughput e sensível a custos da família.

A mudança mais ampla é em direção a medir custo por tarefa bem-sucedida, velocidade de inferência e roteamento de modelos, em vez de focar apenas no preço bruto por token ou em um único benchmark.

Conclusão

Claude Sonnet 5.5 é uma atualização focada em eficiência para a camada de produção da Anthropic. Ele mantém a precificação padrão de $2/$10 do Sonnet 5 enquanto adiciona janela de contexto de 1M tokens, até 128K tokens de saída, geração substancialmente mais rápida e ganhos fortes em programação, uso de computador, entendimento visual e trabalho do conhecimento.

O argumento mais forte para o modelo é a economia do workload: quão confiável e rapidamente ele conclui uma tarefa, quantas chamadas de ferramentas e tokens consome e com que frequência um fluxo ainda precisa escalar para o Opus 5.5. As equipes devem validar esses fatores em suas próprias tarefas e tratar benchmarks entre fornecedores como observações datadas, não como rankings permanentes.

Continuar aprendendo

Conecte este artigo à próxima decisão.

Ver todos os tópicos
Publicado em Sep 29, 2026
Última atualização Sep 29, 2026
0 visualizações
Revisado para maior clareza, atribuição de fontes e terminologia de API atual.

Pronto para reduzir os custos de desenvolvimento de IA em 20%?

Comece gratuitamente em minutos. Créditos de avaliação gratuita incluídos. Não é necessário cartão de crédito.

Leia Mais