GPT-6 Astra is now live on CometAPI →
ai-model/Recherche CometAPI

Qu'est-ce que Claude Fable 5.1 ?

Explorez les spécifications en un coup d’œil, les benchmarks officiels, la tarification du cache, les modifications liées à la migration, les garde-fous et les comparaisons avec Opus 5 et Sonnet 5.

CometAPI
Mia MarenÉquipe de recherche sur les modèles IA et API
Mis à jour Sep 4, 2026 15 min de lecture
Qu'est-ce que Claude Fable 5.1 ?
Utiliser ce modèle

Passez le premier appel API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Anthropic a publié Fable 5.1 le 1er septembre 2026 comme son modèle le plus performant généralement disponible pour le développement et le travail de connaissance. Le modèle cible des tâches à long horizon : codage sur plusieurs heures, recherche en plusieurs étapes, travail professionnel riche en documents, et agents qui utilisent des outils à répétition tout en conservant de larges quantités de contexte.

Claude Fable 5.1 combine une fenêtre de contexte de 1M de tokens, jusqu’à 128K tokens de sortie, une entrée texte et image, et un raisonnement adaptatif toujours activé. La tarification de base reste de $10 en entrée et $50 en sortie par MTok ; le changement de coût important est de $0.25 par MTok pour les lectures du cache.

Spécifications de Claude Fable 5.1 en un coup d’œil

Les spécifications ci-dessous proviennent de la documentation du modèle d’Anthropic. Les prix sont les tarifs catalogue d’Anthropic et doivent être distingués de tout prix CometAPI.

Official specificationClaude Fable 5.1
Release and model IDSeptember 1, 2026 — claude-fable-5-1
Primary roleDemanding reasoning and long-horizon agentic work
Context and maximum output1M-token context — up to 128K output
Input → outputText and images → text
Thinking and default API effortAdaptive thinking, always on — High effort
Reliable knowledge cutoffJune 2026
List pricing$10 input — $50 output — $0.25 cache read per MTok

Deux détails comptent au-delà des chiffres bruts. La fenêtre de contexte 1M est disponible par défaut plutôt que comme un palier spécial long contexte. Le raisonnement adaptatif est toujours activé, tandis que le paramètre d’effort contrôle l’intensité du travail effectué par le modèle ; Anthropic indique que la valeur par défaut est High dans Claude Code et Medium dans Claude Cowork et Claude.ai.

Qu’est-ce que Claude Fable 5.1

Claude Fable 5.1 est le modèle de pointe d’Anthropic pour des tâches où un système doit continuer à raisonner, utiliser des outils et préserver le contexte sur de nombreuses étapes. Plutôt que de viser de courts échanges questions-réponses, il est conçu pour l’exécution soutenue : explorer une base de code, exécuter des workflows en terminal, synthétiser de larges ensembles de documents et accomplir des tâches professionnelles pouvant durer des heures.

Son ensemble distinctif est une fenêtre de contexte de 1M de tokens avec jusqu’à 128K de sortie, une entrée texte et image, et un raisonnement adaptatif qui reste activé tout au long d’une requête. Cela permet à un agent de conserver de longues instructions, des sources, des résultats d’outils et des décisions intermédiaires dans un même contexte de travail, tout en ajustant l’effort de raisonnement à la difficulté de chaque étape.

Le meilleur ajustement est un workflow à forte valeur où l’échec, les reprises ou la perte de contexte coûtent plus que le prix premium au token. Des exemples incluent l’ingénierie à l’échelle d’un dépôt, la recherche en plusieurs phases, les agents d’utilisation d’ordinateur, l’analyse documentaire contraignante en matière de conformité et l’automatisation métier avec des appels d’outils répétés. Pour de la classification courante, de l’extraction à grand volume ou du chat sensible à la latence, un palier Claude moins coûteux peut rester un meilleur point de départ.

L’utilisation par défaut de Fable exige une conservation de 30 jours pour la supervision de sécurité. Les clients entreprise éligibles peuvent utiliser une conservation à zéro donnée pendant le déploiement d’Enterprise Frontier Safeguards ; Anthropic indique que l’architecture prévue stocke les données supervisées dans une infrastructure cloud contrôlée par le client. Les équipes réglementées doivent vérifier les conditions spécifiques au compte avant le déploiement.

Claude Fable 5.1 vs. Fable 5 : Qu’est-ce qui a changé ?

La version 5.1 n’est pas un saut uniforme des capacités. Les changements les plus clairs sont un coût moindre pour le contexte répété et une exécution bien plus forte en recherche agentique, codage en terminal et workflows métier, tandis que le raisonnement général assisté par outils n’évolue que légèrement.

DimensionClaude Fable 5Claude Fable 5.1Change
Base input / output$10 / $50 per MTok$10 / $50 per MTokNo change
Cache read$1.00 per MTok$0.25 per MTok75% lower
Terminal-Bench-Science 0.124.7%52.6%+27.9 points
Terminal-Bench 4.042.0%55.8%+13.8 points
AutomationBench17.1%31.4%+14.3 points
HLE with tools63.8%65.0%+1.2 points

Les lectures du cache sont 75 % moins chères tandis que les prix de base restent stables

L’entrée reste à $10 par MTok et la sortie à $50 par MTok, donc le tarif d’en-tête n’a pas baissé. Le changement matériel est la baisse du prix de lecture du cache de $1.00 à $0.25 par MTok. Cela compte surtout pour les agents qui rechargent à répétition un long préfixe contenant des dépôts, politiques, documents, définitions d’outils et état antérieur. Leur coût par workflow complété peut diminuer même si les tarifs d’entrée fraîche et de sortie ne changent pas.

La recherche scientifique agentique affiche le plus grand gain

Terminal-Bench-Science 0.1 passe de 24.7% à 52.6%, un gain de 27.9 points de pourcentage et plus du double du score précédent. C’est la preuve la plus forte que Fable 5.1 améliore l’exécution à long horizon : planifier une investigation, opérer des outils, interpréter des résultats et se remettre d’erreurs intermédiaires.

Le codage en terminal et l’automatisation métier s’améliorent de manière significative

Terminal-Bench 4.0 augmente de 42.0% à 55.8%, tandis qu’AutomationBench passe de 17.1% à 31.4%. Ces résultats indiquent une meilleure réalisation de bout en bout des tâches, et pas seulement une meilleure génération de code. Les équipes devraient s’attendre au plus grand bénéfice dans des workflows qui exigent du modèle qu’il inspecte un environnement, choisisse des actions, utilise des outils et vérifie les résultats sur plusieurs étapes.

Le raisonnement général progresse moins que l’exécution

Humanity’s Last Exam avec outils passe de 63.8% à 65.0%, seulement 1.2 point, et CursorBench augmente de 2.9 points. La comparaison ne soutient donc pas l’affirmation selon laquelle chaque capacité s’est améliorée de manière égale. Il vaut mieux comprendre Fable 5.1 comme une mise à niveau axée sur l’exécution, dont les gains les plus forts apparaissent lorsque le raisonnement doit être soutenu via des outils et de longues chaînes de tâches.

Résultat de la comparaison : Les utilisateurs existants de Fable 5 exécutant des agents longs et riches en outils ont la raison la plus claire de mettre à niveau : des lectures du cache substantiellement moins chères et moins d’échecs sur des benchmarks orientés exécution. Les équipes utilisant de courts prompts ou des tâches de connaissance générales devraient valider les gains plus modestes par rapport à la latence et au coût total avant de migrer.

Performances de Claude Fable 5.1 aux benchmarks

Le tableau officiel des benchmarks d’Anthropic compare le nouveau modèle à son prédécesseur, Claude Opus 5, et à GPT-5.6 Sol. Les lignes sélectionnées ci-dessous couvrent la recherche, le codage, le travail de connaissance, l’utilisation d’ordinateur et l’automatisation.

Official benchmarkClaude Fable 5.1Claude Fable 5Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77.9%72.9%75.4%
OSWorld 2.0 strict41.7%36.1%39.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Le graphique ci-dessus est l’image de benchmark officielle d’Anthropic copiée depuis le document source, et non un graphique redessiné localement. Anthropic note une erreur standard ±3.5–4.5 points pour Terminal-Bench-Science et indique que des garde-fous de production étaient activés lors de l’évaluation. Les petites différences doivent donc être traitées avec prudence.

Qu'est-ce que Claude Fable 5.1 ?

Source :Graphique de benchmark officiel Anthropic Fable 5.1

Comment lire les résultats des benchmarks

Ces scores ne doivent pas être interprétés comme des mesures universelles de la qualité d’un modèle. Anthropic a évalué Claude Fable 5.1 avec des garde-fous de production activés, et certaines tâches de benchmark peuvent être affectées par des interventions de ces garde-fous. Terminal-Bench-Science signale également une erreur standard d’environ ±3.5–4.5 points de pourcentage par modèle.

Les résultats OSWorld 2.0 utilisent la version des tâches d’août 2026 des auteurs du benchmark, ils ne doivent donc pas être directement comparés aux scores de versions de tâches antérieures.

Tarification de Claude Fable 5.1

Tarification de l’entrée et de la sortie

Anthropic liste Claude Fable 5.1 à $10 par MTok d’entrée et $50 par MTok de sortie. L’API Claude Fable 5.1 dans CometAPI est à $8 par MTok d’entrée et $40 par MTok de sortie, soit une réduction de 20 % par rapport aux tarifs catalogue officiels. Ce sont des tarifs à l’usage ; vérifiez la page du modèle en direct avant la production, car les prix de la plateforme et les règles de facturation peuvent changer.

Tarification du cache de prompt

Anthropic facture une écriture de cache de 5 minutes à $12.50 par MTok, une écriture de 1 heure à $20 par MTok, et une lecture de cache à $0.25 par MTok. Le tarif de lecture est 75 % inférieur à $1 par MTok de Fable 5, de sorte que les agents longue durée qui réutilisent des dépôts, des politiques, des définitions d’outils ou un état antérieur en profitent davantage que les prompts courts, ponctuels.

Exemple de coût de flux de travail d’agent

Un agent qui lit 150K tokens mis en cache à chacune de 1,000 étapes consomme 150 MTok de lectures de cache. Au tarif de $0.25 de Fable 5.1, ce composant coûte $37.50 ; au tarif de $1 de Fable 5, il coûterait $150 — soit $112.50 d’économie. L’entrée fraîche, la sortie, les écritures de cache et les frais de plateforme restent additionnels, donc les équipes devraient comparer le coût total par flux de travail réussi plutôt que le seul coût du cache.

Pourquoi la tarification du cache change l’économie des agents

Une requête conventionnelle peut dépenser l’essentiel de sa facture en entrée fraîche et en sortie. Un agent, c’est différent : chaque étape d’outil peut relire un large préfixe mis en cache contenant politique, code, documents, définitions d’outils et état antérieur. La réduction de 75 % du prix de lecture de cache d’Anthropic bénéficie de manière disproportionnée aux boucles longues.

Par exemple, un agent qui relit 150K tokens mis en cache sur 1,000 étapes consomme 150 millions de tokens de lecture de cache. À $1 par MTok, ce composant coûte $150 ; à $0.25 par MTok, il coûte $37.50. Cet exemple exclut l’entrée fraîche, la sortie, les écritures de cache et les frais de plateforme, mais il montre pourquoi des prix de base inchangés peuvent tout de même produire un coût inférieur par tâche complétée.

Anthropic estime environ 25 % de coût en moins pour des charges typiques facturées au token et jusqu’à environ 45 % pour des charges hautement agentiques. Ce sont des estimations selon le mix de charge, pas une remise universelle sur chaque token.

Claude Fable 5.1 vs Opus 5 vs Sonnet 5

Le modèle de pointe représente le plafond de capacité, mais Anthropic recommande le palier Opus comme point de départ pour la plupart des charges. Le palier Sonnet reste le choix plus rapide et moins coûteux lorsque le débit et la latence comptent davantage que la fiabilité maximale à long horizon. Pour une analyse plus approfondie à deux modèles, voir la comparaison Fable vs Sonnet de CometAPI.

DimensionClaude Fable 5.1Claude Opus 5Claude Sonnet 5
Context window1M1M1M
Maximum output128K128K128K
Input / output list price$10 / $50$5 / $25$2 / $10
Comparative latencySlowerModerateFast
Best fitHardest long-horizon agents and reasoningDefault premium starting pointHigh-volume work prioritizing speed and cost

Résultat de la sélection : Commencez par le palier le moins coûteux qui satisfait la tâche. N’escaladez que lorsque des évaluations en production montrent que le modèle de pointe augmente le taux de résultats acceptés, réduit les retentatives ou diminue le coût total par flux de travail réussi.

Modifications de migration que les développeurs doivent tester

Le nouveau modèle est en grande partie un successeur prêt à l’emploi, mais Anthropic documente trois changements incompatibles qui affectent les frameworks d’agents et les longues conversations.

Migration changeWhat happensRequired developer action
Forced tool choicetool_choice = any or a named tool returns HTTP 400Use auto, instruct the model, and enforce strict schemas when needed
Thinking blocks across model switchesOlder models cannot read the new thinking blocksTest routers and expect reasoning blocks to be dropped when routing backward
Editing earlier turnsChanged history can invalidate thinking blocksKeep histories append-only or use supported compaction patterns

Testez également l’effort par message, les messages système au scope d’un tour, les mises à jour de progression entre les appels d’outils, le comportement du cache et la provenance du contenu avant de transférer du trafic en production. Le tutoriel d’API Fable existant reste la meilleure ressource pour la configuration générique du SDK et des exemples de requêtes.

Qui devrait utiliser Claude Fable 5.1 ?

Claude Fable 5.1 convient le mieux aux charges où le raisonnement soutenu et la réussite comptent davantage que la latence minimale ou le prix au token. Choisissez-le lorsque la tâche s’étend sur de nombreuses étapes, utilise des outils à répétition ou porte une valeur métier suffisante pour que la réduction des exécutions échouées et des reprises compense le coût premium du modèle.

  • Repository-scale engineering : débogage, migrations, refactorings multi-fichiers, exécution de tests et agents de codage non supervisés.
  • Recherche multi-étapes : recherche, évaluation des preuves, exécution d’analyses et production d’un rapport final étayé.
  • Travail sur documents volumineux et professionnel : contrats, documentation technique, documents financiers, feuilles de calcul et workflows de présentation.
  • Utilisation d’ordinateur et automatisation : tâches nécessitant des appels d’outils répétés, la navigation d’interface, la vérification et la récupération après des erreurs intermédiaires.

Pour la classification courante, l’extraction à grand volume ou le chat sensible à la latence, commencez avec Claude Opus 5 ou Claude Sonnet 5

Disponibilité via CometAPI

Au 4 septembre 2026, la page modèle CometAPI liste Claude Fable 5.1 comme actif et opérationnel. L’ID du modèle est claude-fable-5-1.

  1. Créez ou connectez-vous à un compte CometAPI et générez une clé API dans le tableau de bord.
  2. Sélectionnez Claude Fable 5.1 et passez claude-fable-5-1 comme ID de modèle.
  3. Envoyez des requêtes via l’endpoint compatible Anthropic /v1/messages ou l’endpoint compatible OpenAI /v1/chat/completions.
  4. Exécutez une évaluation en conditions de production pour confirmer la latence, la gestion du contexte, le comportement des outils et la facturation avant de migrer du trafic.

Les développeurs peuvent également accéder au modèle directement via la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS.

Conclusion

Claude Fable 5.1 doit être compris comme une mise à niveau d’exécution. La preuve la plus convaincante n’est ni la fenêtre de contexte 1M inchangée ni le tarif premium de base $10/$50 ; ce sont la grande amélioration en recherche agentique, en codage en terminal et en automatisation, combinée à des lectures du cache substantiellement moins chères.

Utilisez-le lorsque la tâche est difficile, longue et suffisamment précieuse pour que moins d’exécutions échouées justifient une tarification premium. Pour du travail routinier, à grand volume ou sensible à la latence, commencez par un palier moins coûteux et n’escaladez que lorsque votre propre évaluation montre une amélioration mesurable des résultats complétés.

FAQ

Claude Fable 5.1 est-il disponible via une API ?

Oui. Anthropic liste Claude Fable 5.1 comme actif depuis le 1er septembre 2026. Il est disponible via la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS.

Combien coûte l’API Claude Fable 5.1 ?

Le tarif catalogue officiel d’Anthropic est de $10 par MTok d’entrée et $50 par MTok de sortie. CometAPI liste actuellement $8 en entrée et $40 en sortie par MTok. Vérifiez le tarif de la route en direct avant le déploiement.

Quelle est la taille de la fenêtre de contexte de Claude Fable 5.1 ?

Le modèle prend en charge une fenêtre de contexte de 1M de tokens et jusqu’à 128K tokens de sortie. La grande capacité ne supprime pas la nécessité de tester la qualité de la recherche, la latence et le coût avec des documents de production.

Qu’est-ce qui a changé entre Claude Fable 5 et 5.1 ?

Les changements pratiques les plus importants sont une recherche agentique et une exécution en terminal plus fortes, une baisse du prix de lecture du cache de $1 à $0.25 par MTok, des contrôles d’effort par message, des mises à jour de progression et la provenance du contenu. La migration exige également de tester le choix d’outil forcé, les blocs de raisonnement entre changements de modèle et les historiques de conversation édités.

Claude Fable 5.1 est-il meilleur que Claude Opus 5 ?

Pas pour chaque charge. Fable 5.1 est l’option de plus haute capacité pour un travail exigeant à long horizon, mais il est plus lent et plus coûteux. Anthropic recommande de démarrer la plupart des charges avec Claude Opus 5 et de monter en gamme lorsque des évaluations à effort plus élevé restent insuffisantes.

Puis-je utiliser Claude Fable 5.1 via CometAPI ?

Oui. CometAPI liste actuellement Claude Fable 5.1 comme actif sous l’ID de modèle claude-fable-5-1, avec des endpoints compatibles Anthropic et OpenAI.

Claude Fable 5.1 prend-il en charge l’utilisation forcée d’outils ?

Non. Anthropic documente que tool_choice défini sur any ou un outil nommé renvoie HTTP 400. Utilisez auto ou none, puis guidez la sélection des outils avec des instructions et des schémas d’entrée stricts lorsque nécessaire.

Continuer à apprendre

Reliez cet article à la décision suivante.

Voir tous les sujets
Publié le Sep 4, 2026
Dernière mise à jour Sep 4, 2026
0 vues
Revu pour la clarté, l'attribution des sources et la terminologie API actuelle.

Prêt à réduire vos coûts de développement IA de 20 % ?

Démarrez gratuitement en quelques minutes. Crédits d'essai offerts. Aucune carte bancaire requise.

En savoir plus