GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
guide/Pesquisa CometAPI

Como usar a API Claude Fable 5.1

Aprenda a chamar Claude Fable 5.1 por meio da CometAPI, configurar o esforço, usar ferramentas, lidar com mudanças incompatíveis e realizar migração

CometAPI
Mia MarenEquipe de pesquisa de modelos e API de IA
Atualizado Sep 16, 2026 18 min de leitura
Como usar a API Claude Fable 5.1
Use este padrão

Faça a primeira chamada à API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Resumo rápido: Para usar a Claude Fable 5.1 API na CometAPI, prepare uma chave de API, defina o ID do modelo como claude-fable-5-1 e valide uma requisição pequena antes de construir um fluxo de trabalho mais longo. Este guia aborda acesso, esforço, streaming, ferramentas, cache, migração e verificações de produção. Trate a implantação como algo além de trocar a string do modelo: confirme a compatibilidade da rota, valide as saídas e meça a qualidade das tarefas aceitas, a latência e o custo antes de ampliar o uso.

Principais pontos

  • Faça uma primeira requisição funcionar: confirme credenciais, acesso ao modelo, o endpoint escolhido e uma resposta utilizável com dados de teste não sensíveis.
  • Escolha o esforço deliberadamente: comece em alto, depois compare outras configurações em tarefas representativas em vez de usar esforço máximo em toda requisição. Claude Code tem padrão Alto. Claude Cowork / Claude.ai tem padrão Médio.
  • Reveja o comportamento de migração: a seleção forçada de ferramenta é rejeitada; mantenha etapas obrigatórias do fluxo de trabalho e validação de argumentos de ferramenta no código da aplicação.
  • Meça o fluxo de trabalho completo: acompanhe uso de cache, custo de tokens, latência, recusas, comportamento de fallback e se o resultado final passa por seus critérios de aceitação.

Para contexto, veja o rastreador anterior do Fable 5.1 da CometAPI e o Tutorial da API Fable 5. Este artigo se concentra no fluxo de integração atual.

O que é Claude Fable 5.1?

Claude Fable 5.1 é o modelo geralmente disponível de maior capacidade da Anthropic para programação ambiciosa, pesquisa em múltiplas etapas, uso de computador e fluxos de trabalho profissionais intensivos em documentos. A Anthropic recomenda iniciar a maioria das cargas com Claude Opus 5 e escalar para Fable 5.1 quando avaliações de alto esforço com o Opus ainda ficarem aquém.

A distinção é operacional: o Fable 5.1 foi projetado para continuar trabalhando em etapas dependentes, se recuperar após uma chamada de ferramenta com falha, verificar resultados e relatar progresso durante execuções longas. Isso pode melhorar as taxas de conclusão, mas também torna custo, latência e observabilidade elementos centrais da implantação.

Especificações da Claude Fable 5.1 API

Especificação oficialClaude Fable 5.1
ProvedoraAnthropic
ID do modeloclaude-fable-5-1
Data de lançamento1º de setembro de 2026
Janela de contexto1,000,000 tokens
Saída máxima128,000 tokens
Entrada e saídaTexto e imagens para texto
PensamentoAdaptativo, sempre ativo
Esforço padrãoA API é Alto, Claude Code tem padrão Alto, Claude Cowork / Claude.ai tem padrão Médio
Níveis de esforçolow, medium, high, xhigh, max
Corte de conhecimentoJune 2026
Preço oficial$10 entrada / $50 saída por milhão de tokens
Leitura de cache$0.25 por milhão de tokens

A visão geral oficial confirma uma janela de contexto de 1M e saída máxima de 128K. O raciocínio adaptativo está sempre ativo; a profundidade do raciocínio é controlada pelo esforço em vez de um orçamento tradicional de tokens de “pensamento”.

Claude Fable 5.1 API: Desempenho oficial em benchmarks

O resumo de benchmarks é propositalmente compacto porque o objetivo principal do artigo é a implementação. Os resultados abaixo indicam onde o prêmio da API tem maior probabilidade de importar.

Benchmark da AnthropicClaude Fable 5.1Claude Fable 5Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21,853 Elo1,7231,8241,711
OSWorld 2.0, parcial77.9%72.9%75.4%
Humanity's Last Exam, sem tools60.9%57.8%56.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Como usar a API Claude Fable 5.1

Comparação oficial de benchmarks do Claude Fable 5.1 pela Anthropic

O maior ganho geracional neste conjunto é no Terminal-Bench-Science: 52.6% versus 24.7%. O AutomationBench sobe de 17.1% para 31.4%, enquanto o Terminal-Bench 4.0 melhora para 55.8%. O resultado é um forte argumento para testar o Fable 5.1 em agentes de pesquisa, programação de longa duração e automação empresarial — não para rotear todas as requisições curtas para o modelo mais caro.

O que mudou em relação à Claude Fable 5 API?

DimensãoClaude Fable 5.1Claude Fable 5Impacto da migração
Papel centralAgentes duradouros e pesquisa mais fortesModelo público original classe MythosReavaliar os fluxos mais difíceis
Escolha de ferramenta forçadaRetorna um erroAntes era suportadaRemover qualquer forçamento e o nomeado
Histórico de raciocínioRegras de compatibilidade mais rígidasComportamento anteriorManter históricos apenas com append
Atualizações de progressoAtualizações legíveis entre chamadas de ferramentaNão disponível desta formaExpor status de execução longa
Esforço por mensagemDisponível em betaNão disponível desta formaAjustar profundidade na conversa
Preço de leitura de cache$0.25 / MTok$1.00 / MTokRecalcular economia em contextos longos
Preço de entrada/saída$10 / $50 por MTok$10 / $50 por MTokSem mudança na lista

Três alterações incompatíveis

Uso forçado de ferramenta não é mais suportado

O Claude Fable 5.1 rejeita valores de tool_choice que forçam qualquer ferramenta ou uma ferramenta nomeada, retornando um erro 400 invalid-request. Mantenha a seleção automática, use schemas rígidos ou saídas estruturadas para validação e imponha etapas obrigatórias do fluxo de trabalho na orquestração da aplicação em vez de forçar uma chamada de ferramenta pelo modelo.

Modelos anteriores não conseguem ler blocos de raciocínio do Fable 5.1

A compatibilidade de raciocínio é unidirecional: o Fable 5.1 pode consumir blocos de raciocínio criados por modelos Claude anteriores compatíveis, mas modelos anteriores não conseguem ler blocos criados pelo Fable 5.1. Um roteador ou fallback que mude para um modelo anterior pode descartar esses blocos antes da inferência, então integrações devem registrar trocas de modelo e testar explicitamente o comportamento de fallback.

Editar turnos anteriores invalida o raciocínio preservado

Alterar um prompt de sistema anterior, definição de ferramenta, mensagem ou bytes de arquivo referenciado pode invalidar blocos de raciocínio posteriores. Trate o prefixo da conversa como somente append, use instruções no meio da conversa em vez de reescrever o histórico e monitore transformações de incompatibilidade de prefixo durante a migração.

Cinco capacidades adicionais da API

Esforço por mensagem

Aplicações podem alterar o esforço durante uma conversa sem invalidar o cache de prompt. Esta capacidade beta permite que um fluxo de trabalho reduza o esforço em acompanhamentos rotineiros e o aumente para etapas difíceis de planejamento, depuração ou verificação.

Mensagens de sistema com escopo por turno

Uma mensagem de sistema beta pode se aplicar a um turno e deixar de ser renderizada após a próxima mensagem do usuário, permanecendo inalterada no histórico. Isso é útil para instruções temporárias em loops de ferramentas, pois preserva tanto a correspondência do cache de prompt quanto a validade de blocos de raciocínio posteriores.

Atualizações de progresso legíveis entre chamadas de ferramenta

Com a opção beta de exibição de progresso, blocos selecionados de raciocínio podem carregar breves atualizações de status que uma aplicação pode mostrar aos usuários enquanto o raciocínio privado permanece oculto. Agentes de execução longa devem tratar essas atualizações como status operacional, não como respostas finais.

Preço mais baixo de leitura de cache

Leituras de cache custam $0.25 por milhão de tokens, um quarto da taxa de leitura de cache do Fable 5, enquanto os preços base de entrada e saída permanecem inalterados. Isso pode reduzir materialmente o custo de sessões longas que reutilizam repetidamente um prefixo estável em cache.

Proveniência de conteúdo

O texto gerado carrega a marca d’água estatística da Anthropic, enquanto mídias suportadas recuperadas pela Files API podem incluir C2PA Content Credentials assinadas. Esses mecanismos de proveniência não adicionam tokens ao prompt nem exigem mudanças no formato da requisição.

O que você precisa antes de usar a Claude Fable 5.1 API?

  • Uma conta e chave de API: acesse a CometAPI e gere uma chave no console de chaves de API. Verifique o acesso ao modelo e se sua conta está pronta para cobrança por uso antes de enviar chamadas de teste.
  • Um runtime local: use um terminal com curl para o primeiro exemplo HTTP. Para os exemplos em Python, prepare Python e pip em um ambiente isolado e então instale o SDK usado pelo exemplo escolhido.
  • Uma rota selecionada: a Claude Fable 5.1 API na CometAPI oferece formatos Messages e Chat Completions. Use a URL base e o formato de requisição correspondentes; não misture payloads.
  • Configuração segura: defina COMETAPI_KEY fora de arquivos versionados, use claude-fable-5-1 como ID do modelo e garanta que sua rede alcance https://api.cometapi.com.
  • Um teste seguro e verificação de aceitação: comece com um prompt curto e não sensível. Confirme que a resposta contém conteúdo utilizável, inspecione o uso e o status da conclusão e verifique os requisitos de tratamento de dados da sua organização antes de enviar documentos ou logs reais.

Como acessar a Claude Fable 5.1 pela CometAPI

A CometAPI expõe a Claude Fable 5.1 por meio de uma rota Messages compatível com a Anthropic e uma rota Chat Completions compatível com a OpenAI. Use Messages quando precisar de esforço nativo, raciocínio, cache e semântica de ferramentas do Claude; use Chat Completions quando sua aplicação já se padroniza no SDK da OpenAI.

Etapa 1: Armazene a chave de API

export COMETAPI_KEY="your-cometapi-key"
$env:COMETAPI_KEY="your-cometapi-key"

Etapa 2: Faça a primeira requisição via Messages

curl https://api.cometapi.com/v1/messages \
  --header "Authorization: Bearer $COMETAPI_KEY" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-fable-5-1",
    "max_tokens": 2048,
    "messages": [{
      "role": "user",
      "content": "Review this deployment architecture and list the three highest-risk failure modes."
    }]
  }'

Etapa 3: Use o SDK Python da Anthropic

pip install anthropic
import os
import anthropic

client = anthropic.Anthropic(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com",
)

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    messages=[{
        "role": "user",
        "content": "Find the root cause of this test failure and propose a verified patch.",
    }],
)

print(response.content[0].text)

Etapa 4: Use o SDK Python da OpenAI

pip install openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{
        "role": "user",
        "content": "Design a migration plan for this service.",
    }],
)

print(response.choices[0].message.content)

Como funciona o raciocínio da API Claude Fable 5.1?

Modelos anteriores não podem ler blocos de raciocínio do Claude Fable 5.1

Blocos de raciocínio produzidos pelo Fable 5.1 não são retrocompatíveis com modelos Claude anteriores. Se um fluxo de trabalho muda de modelo no meio da conversa, remova blocos de raciocínio incompatíveis ou inicie um novo branch mantendo apenas as mensagens visíveis ao usuário e os resultados de ferramentas necessários para a próxima requisição.

Editar turnos anteriores invalida o raciocínio preservado

Um bloco de raciocínio preservado é vinculado criptograficamente ao estado anterior da conversa. Alterar um prompt de sistema anterior, definição de ferramenta, mensagem do usuário, resposta do assistente ou resultado de ferramenta pode quebrar esse vínculo e acionar um erro de histórico de raciocínio. Mantenha o prefixo reproduzido estável byte a byte e acrescente novos turnos em vez de reescrever os antigos.

Raciocínio preservado entre turnos

Quando o prefixo da conversa permanece inalterado, o raciocínio preservado pode carregar um estado útil de raciocínio para turnos posteriores. Armazene blocos de raciocínio com sua ordem original de mensagens, reproduza-os apenas para um modelo compatível e trate uma edição no histórico como um novo branch de conversa, em vez de mutar a transcrição existente.

Controle o raciocínio com o esforço

Comece trabalhos difíceis em produção com esforço alto, depois teste configurações menores em turnos rotineiros e mais altas apenas quando a melhoria na qualidade das tarefas aceitas justificar latência e tokens adicionais. Como o esforço pode mudar entre turnos, uma conversa não precisa mais de um único nível de raciocínio do início ao fim.

O Fable 5.1 usa raciocínio adaptativo como seu único modo de raciocínio. Comece com esforço alto e depois meça configurações menores para trabalho rotineiro e xhigh ou max apenas quando a capacidade adicional justificar custo e latência.

EsforçoPapel recomendadoTrade-off
lowTrabalho rotineiro bem especificadoMais rápido e econômico
mediumTráfego de produção equilibradoProfundidade moderada
highTrabalho difícil padrãoMelhor ponto de partida
xhighProgramação longa e agentesMais latência e tokens
maxTarefas mais difíceis de maior valorCusto e latência secundários
response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=8192,
    output_config={"effort": "high"},
    messages=[{
        "role": "user",
        "content": "Audit this repository migration plan.",
    }],
)

Claude Fable 5.1 API: transmita respostas longas, use ferramentas e cache de prompt

Configure em conjunto os seguintes controles: esforço de raciocínio, streaming, execução de ferramentas, cache de prompt e o tratamento de salvaguardas e dados retidos. Cada um afeta como uma requisição de longa duração é observada, validada e operada.

Transmita respostas longas

Streaming é o padrão mais seguro para tarefas longas e de alto esforço, pois evita esperar que uma resposta grande seja concluída antes que a aplicação receba qualquer saída.

with client.messages.stream(
    model="claude-fable-5-1",
    max_tokens=8192,
    output_config={"effort": "high"},
    messages=[{
        "role": "user",
        "content": "Analyze these logs and produce a remediation plan.",
    }],
) as stream:
    for text in stream.text_stream:
        print(text, end="", flush=True)

Use ferramentas sem escolha forçada

O Fable 5.1 rejeita a seleção forçada de ferramenta usando tool_choice do tipo any ou uma ferramenta nomeada. Use seleção automática, schemas rígidos, valide argumentos de ferramenta no código da aplicação e controle a sequência obrigatória do fluxo de trabalho fora do modelo. Se um fluxo exigir que uma ferramenta específica seja executada, não confie em tool_choice para impor a sequência. Faça a aplicação invocar essa ferramenta ou implemente a etapa exigida no código de orquestração.

tools = [{
    "name": "search_incidents",
    "description": "Search recent production incidents",
    "input_schema": {
        "type": "object",
        "properties": {
            "service": {"type": "string"},
            "days": {"type": "integer"},
        },
        "required": ["service", "days"],
    },
}]

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    tools=tools,
    tool_choice={"type": "auto"},
    messages=[{
        "role": "user",
        "content": "Review checkout incidents from the last 30 days.",
    }],
)

Use cache de prompt para contextos longos

A Anthropic lista leituras de cache a $0.25 por milhão de tokens, um quarto da taxa do Fable 5. Coloque instruções de sistema estáveis, schemas de ferramentas e material de referência grande antes do conteúdo dinâmico do usuário e verifique acertos de cache nos metadados de uso.

messages = [{
    "role": "user",
    "content": [
        {
            "type": "text",
            "text": large_reference_document,
            "cache_control": {"type": "ephemeral"},
        },
        {
            "type": "text",
            "text": "Identify obligations that changed in this revision.",
        },
    ],
}]

Trate salvaguardas e retenção de dados

A Anthropic afirma que muitas solicitações sinalizadas de cibersegurança e biologia são roteadas para modelos menos capazes. Trate uma recusa ou fallback como um estado da aplicação: registre o motivo de parada, mostre uma mensagem apropriada ao usuário e direcione para uma alternativa aprovada quando a política permitir.

O Fable também exige retenção de dados de 30 dias por padrão para monitoramento de segurança. Confirme a elegibilidade organizacional e as configurações de retenção antes de depurar uma requisição sintaticamente válida como se fosse apenas um problema de formato de API.

Fable 5.1 vs Opus 5 vs Sonnet 5

Dimensão de decisãoClaude Fable 5.1Claude Opus 5Claude Sonnet 5
Contexto / saída máx.1M / 128K1M / 128K1M / 128K
Preço oficial entrada/saída$10 / $50$5 / $25$2 / $10
Latência relativaMais lentaModeradaRápida
Esforço padrãohighhighhigh
Força principalMáxima capacidade de longo horizonteRaciocínio geral premiumEquilíbrio velocidade/custo
Melhor papel em produçãoEscalonamento de capacidadeTrabalho complexo padrãoBase para alto volume

Resultado da seleção: inicie o tráfego rotineiro no Sonnet 5, use o Opus 5 para trabalho geral complexo e escale apenas as tarefas mais difíceis ou repetidamente falhas para o Fable 5.1. Isso segue a orientação da Anthropic e evita que o raciocínio premium se torne o custo padrão de toda requisição.

Preços via CometAPI

RotaEntrada / MTokSaída / MTokLeitura de cache / MTok
Preço de lista da Anthropic$10$50$0.25
Preço listado na CometAPI$8$40Verifique a rota ativa
Diferença nominal entrada/saída20% mais baixo20% mais baixoVaria por rota

A página do modelo na CometAPI é a fonte da verdade para disponibilidade e preços atuais da rota. Para uma requisição com 100,000 tokens de entrada sem cache e 10,000 tokens de saída, a estimativa simples da CometAPI é $1.20; o custo real pode mudar com cache, raciocínio, comportamento em lote e roteamento. Os preços estão sujeitos a alterações; verifique a página do modelo antes do orçamento de produção.

Lista de verificação de migração a partir do Fable 5

  1. Altere o ID do modelo de claude-fable-5 para claude-fable-5-1.
  2. Remova forçamento de tool_choice any e de ferramenta nomeada; use auto.
  3. Substitua suposições antigas de orçamento de “pensamento” por output_config.effort.
  4. Comece a avaliação em esforço alto e ajuste com tarefas reais.
  5. Mantenha históricos somente com append quando contiverem blocos de raciocínio preservados.
  6. Aumente max_tokens para execuções longas de alto esforço.
  7. Verifique acertos de cache nos metadados de uso.
  8. Trate recusas e fallbacks como estados explícitos.
  9. Reproduza rastros de produção e compare taxa de tarefas aceitas, latência e custo.

Estratégia de migração mais segura: mantenha históricos somente com append. O Fable 5.1 pode preservar blocos de raciocínio entre turnos, mas blocos reproduzidos são vinculados ao estado anterior da conversa; alterar prompts de sistema, ferramentas ou mensagens anteriores pode invalidar esse vínculo.

Erros comuns da API

Erro 400 após mudar chamadas de ferramenta

Causa provável: uso forçado de tool_choice com any ou uma ferramenta nomeada. Use auto e imponha a sequência exigida na lógica da aplicação.

claude-fable-5.1 não funciona

O ID canônico usa hifens: claude-fable-5-1.

A saída termina antes do esperado

effort controls how much reasoning the model performs, while max_tokens limits the response token budget. Higher effort can require more output budget, so production applications should tune both independently. Raise max_tokens where justified and stream long responses.

O cache de prompt nunca acerta

Mantenha o prefixo em cache estável byte a byte; timestamps, reordenar ferramentas e mudar mensagens de sistema impedem a reutilização.

Uma resposta com sucesso HTTP não contém resposta normal

Inspecione stop_reason e metadados de fallback em vez de tratar toda recusa como erro de transporte.

Reproduzir o histórico gera um erro de raciocínio

Não edite turnos anteriores antes de blocos de raciocínio preservados do Fable 5.1. Use histórico somente com append ou os controles de migração atuais.

Como usar a Claude Fable 5.1 API em produção?

Separe roteamento de requisições, execução do modelo, execução de ferramentas, validação e avaliação. Registre ID do modelo, esforço, latência, uso de tokens, uso de cache, motivo de parada, comportamento de fallback e sucesso final da tarefa.

Use o Fable 5.1 para migrações em repositórios inteiros, depuração difícil, agentes de longa execução, pesquisa profunda, síntese de grandes documentos e tarefas de alto valor em que modelos mais baratos falham repetidamente. Evite usá-lo como padrão para resumos, classificação, extração e respostas curtas de atendimento ao cliente.

Exemplo: Investigar um incidente no checkout

Uma equipe pode fornecer erros de checkout sanitizados, diffs de implantações recentes e runbooks relevantes. A aplicação recupera registros de incidentes correspondentes e então pede ao modelo que classifique possíveis causas e conecte cada hipótese a evidências. Um engenheiro revisa as etapas diagnósticas propostas e aprova um teste em um sandbox usando transações sintéticas. O critério de aceitação é comportamento reproduzível, evidências rastreáveis e aprovação em verificações de regressão; qualquer remediação em produção requer aprovação humana separada.

Exemplo: Analisar mudanças em requisitos operacionais

Uma equipe pode fornecer um manual operacional aprovado, políticas de suporte e um rascunho revisado. Mantenha o material de referência inalterado como contexto estável e então peça ao modelo que compare obrigações alteradas, equipes responsáveis, prazos e exceções. Cada constatação proposta deve referenciar as passagens relevantes em ambas as versões e distinguir mudanças explícitas de interpretações incertas. O critério de aceitação é um revisor confirmar cada mudança relatada contra a evidência citada antes de atualizar procedimentos ou notificar equipes afetadas.

Conclusão

Claude Fable 5.1 não é uma simples atualização da string do modelo. Seu comportamento em ferramentas forçadas, regras de histórico de raciocínio, controles de esforço, economia de cache e recursos de progresso em longas execuções exigem uma migração deliberada.

A implantação mais eficaz usa o Claude Sonnet 5 para volume rotineiro, o Claude Opus 5 para tráfego complexo padrão e o Claude Fable 5.1 como uma escalada medida de capacidade. Promova-o apenas quando a conclusão de tarefas aceitas melhorar o suficiente para justificar o custo e a latência totais.

Continuar aprendendo

Conecte este artigo à próxima decisão.

Ver todos os tópicos
Publicado em Sep 16, 2026
Última atualização Sep 16, 2026
1 visualizações
Revisado para maior clareza, atribuição de fontes e terminologia de API atual.

Pronto para reduzir os custos de desenvolvimento de IA em 20%?

Comece gratuitamente em minutos. Créditos de avaliação gratuita incluídos. Não é necessário cartão de crédito.

Leia Mais