A Anthropic lançou o Fable 5.1 em 1º de setembro de 2026 como seu modelo de disponibilidade geral mais capaz para codificação e trabalho de conhecimento. O modelo mira trabalhos de longo horizonte: codificação de múltiplas horas, pesquisa em múltiplas etapas, trabalho profissional intensivo em documentos e agentes que usam ferramentas repetidamente enquanto retêm grandes quantidades de contexto.
O Claude Fable 5.1 combina uma janela de contexto de 1M tokens, até 128K tokens de saída, entrada de texto e imagem e raciocínio adaptativo sempre ativo. O preço base permanece $10 de entrada e $50 de saída por MTok; a mudança de custo importante é $0,25 por MTok para leituras de cache.
Visão geral das especificações do Claude Fable 5.1
As especificações abaixo vêm da documentação do modelo da Anthropic. Os preços são os de tabela da Anthropic e devem ser mantidos separados de qualquer preço da CometAPI.
| Especificação oficial | Claude Fable 5.1 |
|---|---|
| Lançamento e ID do modelo | 1º de setembro de 2026 — claude-fable-5-1 |
| Função principal | Raciocínio exigente e trabalho agentivo de longo horizonte |
| Contexto e saída máxima | Contexto de 1M tokens — até 128K de saída |
| Entrada → saída | Texto e imagens → texto |
| Raciocínio e esforço padrão da API | Raciocínio adaptativo, sempre ativo — Esforço alto |
| Data de corte de conhecimento confiável | junho de 2026 |
| Preços de tabela | $10 entrada — $50 saída — $0.25 leitura de cache por MTok |
Dois detalhes importam além dos números brutos. A janela de contexto de 1M está disponível por padrão, em vez de um nível especial de contexto longo. O raciocínio adaptativo fica sempre ativado, enquanto o esforço controla quanto trabalho o modelo realiza; a Anthropic diz que o padrão é Alto no Claude Code e Médio no Claude Cowork e no Claude.ai.
O que é o Claude Fable 5.1
O Claude Fable 5.1 é o modelo de fronteira da Anthropic para trabalhos em que um sistema precisa continuar raciocinando, usando ferramentas e preservando contexto por muitas etapas. Em vez de focar em trocas curtas de perguntas e respostas, ele é projetado para execução sustentada: explorar uma base de código, executar fluxos de trabalho no terminal, sintetizar grandes conjuntos de documentos e concluir tarefas profissionais que podem levar horas.
Seu pacote definidor é uma janela de contexto de 1M tokens com até 128K de saída, entrada de texto e imagem e raciocínio adaptativo que permanece habilitado ao longo de uma solicitação. Isso permite que um agente mantenha instruções extensas, material de referência, resultados de ferramentas e decisões intermediárias em um único contexto de trabalho, ajustando o esforço de raciocínio à dificuldade de cada etapa.
O melhor encaixe é um fluxo de trabalho de alto valor em que falhas, retrabalho ou perda de contexto custam mais do que o preço premium de tokens. Exemplos incluem engenharia em escala de repositório, pesquisa em múltiplas etapas, agentes de uso de computador, análise de documentos com muitas exigências de conformidade e automação de negócios com chamadas de ferramentas repetidas. Para classificação rotineira, extração em alto volume ou chat sensível à latência, um nível Claude de menor custo pode continuar sendo o melhor ponto de partida.
O uso padrão do Fable exige retenção de 30 dias para monitoramento de segurança. Clientes corporativos elegíveis podem usar retenção zero de dados enquanto os Enterprise Frontier Safeguards são implantados; a Anthropic diz que a arquitetura planejada armazena dados monitorados em infraestrutura de nuvem controlada pelo cliente. Equipes reguladas devem verificar termos específicos da conta antes da implantação.
Claude Fable 5.1 vs. Fable 5: o que mudou?
A versão 5.1 não é um salto uniforme de capacidade. As mudanças mais claras são custo menor de contexto repetido e execução muito mais forte em pesquisa agentiva, codificação em terminal e fluxos de trabalho de negócios, enquanto o raciocínio geral assistido por ferramentas avança apenas ligeiramente.
| Dimensão | Claude Fable 5 | Claude Fable 5.1 | Mudança |
|---|---|---|---|
| Entrada / saída base | $10 / $50 por MTok | $10 / $50 por MTok | Sem mudança |
| Leitura de cache | $1.00 por MTok | $0.25 por MTok | 75% menor |
| Terminal-Bench-Science 0.1 | 24.7% | 52.6% | +27.9 pontos |
| Terminal-Bench 4.0 | 42.0% | 55.8% | +13.8 pontos |
| AutomationBench | 17.1% | 31.4% | +14.3 pontos |
| HLE with tools | 63.8% | 65.0% | +1.2 pontos |
Leituras de cache são 75% mais baratas enquanto os preços base permanecem estáveis
A entrada permanece $10 por MTok e a saída $50 por MTok, então a taxa principal não caiu. A mudança material é o preço da leitura de cache caindo de $1.00 para $0.25 por MTok. Isso importa mais para agentes que recarregam repetidamente um prefixo longo contendo repositórios, políticas, documentos, definições de ferramentas e estado anterior. O custo por fluxo de trabalho concluído pode cair mesmo quando as taxas de entrada nova e saída não mudam.
Pesquisa científica agentiva apresenta o maior ganho
O Terminal-Bench-Science 0.1 sobe de 24.7% para 52.6%, um ganho de 27.9 pontos percentuais e mais que o dobro da pontuação anterior. Esta é a evidência mais forte de que o Fable 5.1 melhora a execução de longo horizonte: planejar uma investigação, operar ferramentas, interpretar resultados e se recuperar de erros intermediários.
Codificação em terminal e automação de negócios melhoram de forma significativa
O Terminal-Bench 4.0 aumenta de 42.0% para 55.8%, enquanto o AutomationBench sobe de 17.1% para 31.4%. Esses resultados apontam para melhor conclusão de tarefas de ponta a ponta, não apenas melhor geração de código. As equipes devem esperar o maior benefício em fluxos de trabalho que exigem que o modelo inspecione um ambiente, escolha ações, use ferramentas e verifique resultados ao longo de várias etapas.
O raciocínio geral melhora menos do que a execução
O Humanity’s Last Exam com ferramentas passa de 63.8% para 65.0%, apenas 1.2 pontos, e o CursorBench aumenta em 2.9 pontos. A comparação, portanto, não sustenta a afirmação genérica de que toda capacidade melhorou igualmente. O Fable 5.1 é melhor entendido como uma atualização focada em execução, cujos ganhos mais fortes aparecem quando o raciocínio precisa ser sustentado por ferramentas e cadeias longas de tarefas.
Resultado da comparação: Usuários existentes do Fable 5 executando agentes longos e pesados em ferramentas têm a razão mais clara para atualizar: leituras de cache substancialmente mais baratas e menos falhas em benchmarks orientados à execução. Equipes que usam prompts curtos ou tarefas de conhecimento geral devem validar os ganhos menores em relação à latência e ao custo total antes de migrar.
Desempenho em benchmarks do Claude Fable 5.1
A tabela oficial de benchmarks da Anthropic compara o novo modelo com seu predecessor, o Claude Opus 5, e o GPT-5.6 Sol. As linhas selecionadas abaixo cobrem pesquisa, codificação, trabalho de conhecimento, uso de computador e automação.
| Benchmark oficial | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
O gráfico acima é a imagem oficial de benchmarks da Anthropic copiada do documento de origem, não um gráfico redesenhado localmente. A Anthropic observa um erro padrão de ±3.5–4.5 pontos para o Terminal-Bench-Science e diz que salvaguardas de produção estavam habilitadas durante a avaliação. Diferenças pequenas devem, portanto, ser tratadas com cautela.

Fonte:Gráfico oficial de benchmark do Anthropic Fable 5.1
Como ler os resultados de benchmark
Essas pontuações não devem ser interpretadas como medidas universais de qualidade do modelo. A Anthropic avaliou o Claude Fable 5.1 com salvaguardas de produção habilitadas, e algumas tarefas de benchmark podem ser afetadas por intervenções dessas salvaguardas. O Terminal-Bench-Science também relata um erro padrão de aproximadamente ±3.5–4.5 pontos percentuais por modelo.
Os resultados do OSWorld 2.0 usam a versão de tarefas de agosto de 2026 dos autores do benchmark, portanto, não devem ser comparados diretamente com pontuações de versões anteriores de tarefas.
Preços do Claude Fable 5.1
Preços de entrada e saída
A Anthropic lista o Claude Fable 5.1 a $10 por MTok de entrada e $50 por MTok de saída. A API do Claude Fable 5.1 na CometAPI está a $8 por MTok de entrada e $40 por MTok de saída, uma redução de 20% em relação às taxas oficiais de tabela. Essas são tarifas baseadas em uso; verifique a página do modelo ao vivo antes da produção porque preços de plataforma e regras de cobrança podem mudar.
Preços do cache de prompt
A Anthropic precifica uma escrita de cache de 5 minutos em $12.50 por MTok, uma escrita de cache de 1 hora em $20 por MTok e uma leitura de cache em $0.25 por MTok. A taxa de leitura é 75% abaixo dos $1 por MTok do Fable 5, então agentes de longa duração que reutilizam repositórios, políticas, definições de ferramentas ou estado anterior se beneficiam mais do que prompts curtos e pontuais.
Exemplo de custo de fluxo de trabalho de um agente
Um agente que lê 150K tokens em cache em cada um de 1.000 passos consome 150 MTok de leituras de cache. Na taxa de $0.25 do Fable 5.1, esse componente custa $37.50; na taxa de $1 do Fable 5, custaria $150 — uma economia de $112.50. Entrada nova, saída, escritas em cache e cobranças de plataforma continuam adicionais, então as equipes devem comparar o custo total por fluxo de trabalho bem-sucedido em vez do custo do cache isoladamente.
Por que a precificação do cache muda a economia de agentes
Uma solicitação convencional pode gastar a maior parte da conta em entrada nova e saída. Um agente é diferente: cada passo de ferramenta pode reler um prefixo grande em cache contendo política, código, documentos, definições de ferramentas e estado anterior. A redução de 75% na leitura de cache da Anthropic beneficia desproporcionalmente os loops longos.
Por exemplo, um agente que relê 150K tokens em cache ao longo de 1.000 passos consome 150 milhões de tokens de leitura de cache. A $1 por MTok, esse componente custa $150; a $0.25 por MTok, custa $37.50. Este exemplo exclui entrada nova, saída, escritas em cache e cobranças de plataforma, mas mostra por que preços base inalterados ainda podem produzir um custo menor por tarefa concluída.
A Anthropic estima cerca de 25% de redução de custo para cargas típicas faturadas por token e até aproximadamente 45% para cargas altamente agentivas. Estas são estimativas por mistura de cargas, não um desconto universal em todos os tokens.
Claude Fable 5.1 vs Opus 5 vs Sonnet 5
O modelo de fronteira é o teto de capacidade, mas a Anthropic recomenda o nível Opus como ponto de partida para a maioria das cargas. O nível Sonnet continua sendo a escolha mais rápida e de menor custo quando taxa de transferência e latência importam mais do que a confiabilidade máxima de longo horizonte. Para uma análise mais profunda de dois modelos, veja a comparação Fable vs Sonnet da CometAPI.
| Dimensão | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| Janela de contexto | 1M | 1M | 1M |
| Saída máxima | 128K | 128K | 128K |
| Preço de tabela entrada/saída | $10 / $50 | $5 / $25 | $2 / $10 |
| Latência comparativa | Mais lenta | Moderada | Rápida |
| Melhor adequação | Agentes e raciocínio mais difíceis de longo horizonte | Ponto de partida premium padrão | Trabalho de alto volume priorizando velocidade e custo |
Resultado da seleção: Comece com o nível de menor custo que atenda à tarefa. Escale apenas quando avaliações em produção mostrarem que o modelo de fronteira eleva a taxa de resultados aceitos, reduz tentativas ou diminui o custo total por fluxo de trabalho bem-sucedido.
Mudanças de migração que desenvolvedores devem testar
O novo modelo é em grande parte um sucessor plug-and-play, mas a Anthropic documenta três mudanças incompatíveis que afetam frameworks de agentes e conversas longas.
| Mudança de migração | O que acontece | Ação necessária do desenvolvedor |
|---|---|---|
| Escolha forçada de ferramenta | tool_choice = any ou uma ferramenta nomeada retorna HTTP 400 | Use auto, instrua o modelo e imponha esquemas estritos quando necessário |
| Blocos de raciocínio em trocas de modelo | Modelos mais antigos não conseguem ler os novos blocos de raciocínio | Teste roteadores e espere que blocos de raciocínio sejam descartados ao rotear para trás |
| Edição de turnos anteriores | Histórico alterado pode invalidar blocos de raciocínio | Mantenha históricos append-only ou use padrões de compactação compatíveis |
Também teste esforço por mensagem, mensagens de sistema com escopo por turno, atualizações de progresso entre chamadas de ferramentas, comportamento do cache e proveniência de conteúdo antes de mover tráfego de produção. O tutorial da API do Fable existente continua sendo o melhor lugar para configuração genérica de SDK e exemplos de requisição.
Quem deve usar o Claude Fable 5.1?
O Claude Fable 5.1 é melhor para cargas em que raciocínio sustentado e conclusão bem-sucedida importam mais do que latência mínima ou preço por token. Escolha-o quando a tarefa abrange muitas etapas, usa ferramentas repetidamente ou tem valor de negócio suficiente para que evitar execuções com falhas e retrabalho possa compensar os custos premium do modelo.
- Engenharia em escala de repositório: depuração, migrações, refatoração de múltiplos arquivos, execução de testes e agentes de codificação autônomos.
- Pesquisa em múltiplas etapas: busca, avaliação de evidências, execução de análises e produção de um relatório final fundamentado.
- Trabalho com grandes documentos e profissional: contratos, documentação técnica, material financeiro, planilhas e fluxos de apresentações.
- Uso de computador e automação: tarefas que exigem chamadas de ferramentas repetidas, navegação de interface, verificação e recuperação de erros intermediários.
Para classificação rotineira, extração em alto volume ou chat sensível à latência, comece com o Claude Opus 5 ou o Claude Sonnet 5
Disponibilidade via CometAPI
Em 4 de setembro de 2026, a página do modelo na CometAPI lista o Claude Fable 5.1 como ativo e operacional. O ID do modelo é claude-fable-5-1.
- Crie ou entre em uma conta CometAPI e gere uma chave de API no dashboard.
- Selecione o Claude Fable 5.1 e passe
claude-fable-5-1como ID do modelo. - Envie requisições pelo endpoint compatível com Anthropic
/v1/messagesou pelo endpoint compatível com OpenAI/v1/chat/completions. - Execute uma avaliação em estilo de produção para confirmar latência, tratamento de contexto, comportamento de ferramentas e cobrança antes de migrar tráfego.
Os desenvolvedores também podem acessar o modelo diretamente via Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform na AWS.
Conclusão
O Claude Fable 5.1 é melhor entendido como uma atualização de execução. A evidência mais convincente não é a janela de contexto de 1M inalterada nem o preço premium base de $10/$50; é a grande melhoria em pesquisa agentiva, codificação em terminal e automação, combinada com leituras de cache substancialmente mais baratas.
Use-o quando uma tarefa é difícil, demorada e valiosa o suficiente para que menos execuções com falhas possam justificar o preço premium. Para trabalho rotineiro, de alto volume ou sensível à latência, comece com um nível de menor custo e escale apenas quando sua própria avaliação mostrar uma melhora mensurável em resultados concluídos.
FAQs
O Claude Fable 5.1 está disponível via API?
Sim. A Anthropic lista o Claude Fable 5.1 como ativo desde 1º de setembro de 2026. Ele está disponível via Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform na AWS.
Quanto custa a API do Claude Fable 5.1?
O preço oficial de tabela da Anthropic é $10 por MTok de entrada e $50 por MTok de saída. A CometAPI atualmente lista $8 de entrada e $40 de saída por MTok. Verifique o preço da rota ao vivo antes da implantação.
Qual é o tamanho da janela de contexto do Claude Fable 5.1?
O modelo suporta uma janela de contexto de 1M tokens e até 128K tokens de saída. Grande capacidade não elimina a necessidade de testar qualidade de recuperação, latência e custo com documentos de produção.
O que mudou do Claude Fable 5 para o 5.1?
As maiores mudanças práticas são pesquisa agentiva e execução em terminal mais fortes, redução do preço de leitura de cache de $1 para $0.25 por MTok, controles de esforço por mensagem, atualizações de progresso e proveniência de conteúdo. A migração também exige testar escolha forçada de ferramenta, blocos de raciocínio em trocas de modelo e históricos de conversa editados.
O Claude Fable 5.1 é melhor do que o Claude Opus 5?
Não para toda carga. O Fable 5.1 é a opção de maior capacidade para trabalho exigente de longo horizonte, mas é mais lento e mais caro. A Anthropic recomenda começar a maioria das cargas com o Claude Opus 5 e subir quando avaliações de maior esforço ainda ficarem aquém.
Posso usar o Claude Fable 5.1 via CometAPI?
Sim. A CometAPI atualmente lista o Claude Fable 5.1 como ativo sob o ID de modelo claude-fable-5-1, com endpoints compatíveis com Anthropic e com OpenAI.
O Claude Fable 5.1 suporta uso forçado de ferramentas?
Não. A Anthropic documenta que tool_choice definido como any ou uma ferramenta nomeada retorna HTTP 400. Use auto ou none, depois guie a seleção de ferramentas com instruções e esquemas de entrada estritos quando necessário.
