Claude Haiku 4.5 é um modelo de linguagem de classe menor otimizado para objetivos específicos da Anthropic, lançado em meados de outubro de 2025. Está posicionado como uma opção rápida e de baixo custo na linha Claude que preserva forte capacidade em tarefas como codificação, orquestração de agentes e fluxos de trabalho interativos de “uso do computador”, ao mesmo tempo em que possibilita vazão muito maior e menor custo unitário para implantações empresariais.
Principais recursos
- Velocidade e eficiência de custo: O Haiku 4.5 é descrito como mais de duas vezes mais rápido que o Sonnet 4 e com cerca de um terço do custo do Sonnet 4 (e muito mais barato que o Opus), tornando-o atraente para uso em escala.
- Raciocínio estendido: Primeiro modelo Haiku a suportar raciocínio estendido (pensamento resumido/intercalado, orçamentos de pensamento configuráveis) para raciocínio em múltiplas etapas mais profundo, equilibrando a latência.
- Ferramentas e uso do computador: Suporte completo às ferramentas do Claude (bash, execução de código, editor de texto, pesquisa na web e automação de uso do computador). Projetado para fluxos de trabalho baseados em agentes e arquiteturas de subagentes.
- Janela de contexto ampla: Janela de contexto de 200k tokens (com opções de 1M de contexto disponíveis em modelos maiores como beta para outras classes de modelos).
Detalhes técnicos
- Dados de treinamento e corte: O Haiku 4.5 foi treinado em uma mistura proprietária de dados públicos e licenciados com corte de treinamento por volta de fevereiro de 2025.
- Raciocínio estendido (um modo híbrido de raciocínio) é suportado para que o modelo possa trocar latência por raciocínio mais profundo quando solicitado.
- Janela de contexto no lançamento é de 200.000 tokens, e o modelo é explicitamente sensível ao contexto (ele acompanha quanto da janela foi usada).
- Desempenho/vazão: Relatos iniciais da comunidade e testes da Anthropic citam OTPS muito elevado (tokens de saída/seg) e velocidades anedóticas em torno de ~200+ tokens/seg em alguns testes internos/iniciais — muito mais rápido que muitos modelos intermediários comparáveis.
Desempenho em benchmarks
SWE-Bench (codificação): O Haiku 4.5 obteve ~73.3% no SWE-Bench Verified — resultado que a Anthropic destaca como posicionando o Haiku 4.5 entre os melhores modelos de código do mundo na sua categoria.
Terminal / linha de comando / testes de ferramentas: A Anthropic relatou ~41% no Terminal-Bench (focado em linha de comando) e resultados comparáveis ao Sonnet 4 e a vários modelos de fronteira de médio porte concorrentes em muitos benchmarks de uso de ferramentas.
Seguir instruções e texto de slides: exemplos internos da Anthropic afirmam que o Haiku 4.5 superou modelos anteriores em algumas tarefas de seguimento de instruções (por exemplo, geração de texto para slides: 65% vs 44% em seu benchmark).
Automação/ tarefas de agentes no mundo real: avaliações de terceiros e adotantes iniciais relatam taxas de sucesso competitivas em tarefas automatizadas de UI/agentes (por exemplo, benchmarks no estilo OSWorld relatando ≈50% de sucesso em automações complexas em alguns testes), mostrando utilidade para fluxos em escala, embora com modos de falha não triviais.
Limitações e notas de segurança
- Não é um modelo de fronteira: A Anthropic classifica explicitamente o Haiku 4.5 como não avançando a fronteira; ele é otimizado para eficiência em vez de empurrar o estado da arte absoluto. (Anthropic)
- Comportamento ocasional em tópicos sensíveis: em alguns prompts científicos/relacionados à biossegurança, o Haiku 4.5 às vezes retorna informações de alto nível com ressalvas em vez de recusas estritas; a Anthropic sinaliza isso como uma área em melhoria contínua.
- Raciocínio estendido pode alterar o comportamento (às vezes aumenta a assimetria nas respostas).
Casos de uso recomendados
- Codificação agentiva e orquestração multiagente: subagentes rápidos, refatoração iterativa de código, testes automáticos e geração de patches. (Boa adequação.)
- Fluxos de trabalho de clientes em tempo real e alto volume: assistentes de chat, automação interna em que o custo por requisição importa. (Boa adequação.)
- Fluxos habilitados por ferramentas e controle do computador: automatizando tarefas GUI/CLI, fluxos de documentos e cadeias de ferramentas em que baixa latência ajuda. (Boa adequação.)
- Não recomendado (sem controles): funções autônomas que exigem design de sequências científicas em nível de fronteira ou tarefas de biossegurança de alta confiabilidade. (Tenha cautela.)
Como acessar a API do Claude Haiku 4.5
Passo 1: Inscreva-se para obter a chave de API
Faça login em cometapi.com. Se você ainda não é nosso usuário, registre-se primeiro. Acesse seu CometAPI console. Obtenha a credencial de acesso da interface (chave de API). Clique em “Add Token” no token de API no centro pessoal, obtenha a chave de token: sk-xxxxx e envie.
Passo 2: Envie requisições para a API do Claude Haiku 4.5
Selecione o endpoint “claude-haiku-4-5-20251001” para enviar a requisição de API e defina o corpo da requisição. O método e o corpo da requisição são obtidos na nossa documentação de API do site. Nosso site também fornece teste Apifox para sua conveniência. Substitua <YOUR_API_KEY> pela sua chave real do CometAPI da sua conta. A base url é Anthropic Messages e Chat.
Insira sua pergunta ou solicitação no campo de conteúdo — é isso que o modelo responderá . Processe a resposta da API para obter a resposta gerada.
Passo 3: Recupere e verifique os resultados
Processe a resposta da API para obter a resposta gerada. Após o processamento, a API responde com o status da tarefa e os dados de saída.