TL;DR
Claude Sonnet 5.5 est le tout nouveau modèle de classe Sonnet d’Anthropic, publié le 28 septembre 2026. Il est positionné comme le complément plus rapide et moins coûteux de Claude Opus 5.5 pour le codage, le travail agentique bien borné, la production de documents, l’utilisation d’ordinateurs et l’analyse multimodale.
Le modèle conserve une tarification standard de 2 $ par million de jetons d’entrée et de 10 $ par million de jetons de sortie. Anthropic indique une génération de sortie plus de 30 % plus rapide que Sonnet 5 et des coûts au niveau des tâches pouvant être jusqu’à 30 % plus bas, car le nouveau modèle termine souvent le travail avec moins de jetons et d’étapes.
Les résultats publiés incluent 70,6 % sur Terminal-Bench 4.0, 55,5 % sur CursorBench 4.0, 1844 sur GDPval-AA v2.1, et 80,1 % sur OSWorld 2.1. La valeur pratique ne réside pas dans un score isolé : Sonnet 5.5 se rapproche d’Opus 5.5 sur plusieurs évaluations de travail professionnel tout en conservant des prix standard de jetons inférieurs.
Points clés
- Claude Sonnet 5.5 est le deuxième modèle de la famille Claude 5.5 d’Anthropic et est optimisé pour le travail de production rapide plutôt que pour les tâches les plus ambiguës et ouvertes.
- Il prend en charge une fenêtre de contexte de 1M de jetons, jusqu’à 128K jetons de sortie, l’entrée texte et image, la pensée adaptative, l’usage d’outils et les réponses structurées.
- La tarification standard de l’API Claude est de 2 $/M à l’entrée, 10 $/M à la sortie, 0,20 $/M pour les lectures de cache et 2,50 $/M pour les écritures de cache sur cinq minutes.
- Anthropic signale une production de sortie 30 % plus rapide que Sonnet 5 et de fortes améliorations en codage, utilisation d’ordinateur, compréhension de graphiques et travail de connaissance à long horizon.
- L’identifiant du modèle dans l’API Claude est claude-sonnet-5-5 ; les développeurs peuvent aussi accéder à l’API Claude Sonnet 5.5 dans CometAPI.
Qu’est-ce que Claude Sonnet 5.5 ?
Claude Sonnet 5.5 est le tout nouveau modèle Sonnet polyvalent d’Anthropic et la deuxième publication de la famille Claude 5.5 après Claude Opus 5.5. Anthropic le positionne comme un complément plus rapide et moins coûteux d’Opus plutôt que comme un remplacement direct du porte-étendard.
La distinction est pratique : Opus 5.5 vise le travail complexe et ambigu nécessitant un jugement soutenu, tandis que Sonnet 5.5 est optimisé pour les tâches bien bornées, la correction de bogues, l’itération rapide, le codage, la production de documents et les workflows professionnels à grand volume.
Quelles sont les fonctionnalités les plus importantes de Claude Sonnet 5.5 ?
Le modèle combine une fenêtre de contexte de 1M de jetons, jusqu’à 128K jetons de sortie, l’entrée texte et image, la pensée adaptative, l’effort ajustable, l’usage d’outils, les sorties structurées, la mise en cache d’invite, le traitement par lots, et une prise en charge via l’API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et la Claude Platform sur AWS. Pour les équipes de production, la combinaison déterminante n’est pas une seule fonctionnalité, mais la génération rapide, une utilisation de jetons par tâche plus faible et des performances proches d’Opus sur plusieurs charges professionnelles bien définies.
Benchmarks de Claude Sonnet 5.5
Anthropic rapporte des gains substantiels en codage, travail professionnel à long horizon, utilisation d’ordinateur et compréhension visuelle. Le tableau ci-dessous résume les résultats d’évaluation publiés par l’entreprise.
| Benchmark et source officielle | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70,6 % | 10,3 % | 66,4 % à Xhigh | Non publié |
| FrontierCode 1.1 Main | 46,2 % à Max | 42,4 % | 54,4 % | 49,3 % / 52,1 % à Xhigh |
| CursorBench 4.0 | 55,5 % | 34,1 % | 57,8 % | Non publié |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64,5 % avec outils | 54,9 % | 67,7 % | Non indiqué dans le tableau source |
| OSWorld 2.1 | 80,1 % | 57,0 % | 81,8 % | Non indiqué dans le tableau source |
| Chartography | 61,6 % | 15,6 % | 64,4 % | 53,6 % |
Éléments de contexte et réserves concernant l’évaluation : Les scores ne sont pas tous mesurés au même niveau d’effort. Le 66,4 % d’Opus 5.5 sur Terminal-Bench est rapporté à Xhigh. Anthropic note que Sonnet 5.5 peut obtenir un score inférieur à Max qu’à Xhigh sur FrontierCode, car des étapes de relecture supplémentaires peuvent entraîner des expirations ou des modifications hors périmètre. Artificial Analysis a exécuté GDPval-AA et AA-Briefcase sur un déploiement préversion de Sonnet 5.5 affecté par un bogue de sortie structurée qu’Anthropic dit avoir depuis corrigé. Les chiffres inter-fournisseurs pour GPT-6 Sol doivent également être considérés comme des observations datées, car OpenAI a corrigé un problème d’encodage d’images le 25 septembre 2026.
Ce que signifient les résultats : Sonnet 5.5 n’est pas simplement devant Sonnet 5 sur des scores isolés. Il se rapproche beaucoup d’Opus 5.5 sur le codage, le travail professionnel, l’utilisation d’ordinateur et la reconnaissance de graphiques tout en conservant des prix de jetons de niveau Sonnet. Anthropic indique également qu’à Low ou Medium, Sonnet 5.5 peut dépasser le meilleur score de Sonnet 5 sur plusieurs évaluations avec environ un dixième du coût par tâche. Cette combinaison de capacité, de vitesse et d’efficacité au niveau de la tâche est son principal avantage compétitif.
Quelle est la qualité de Claude Sonnet 5.5 ?
Programmation
L’amélioration est aussi opérationnelle. Anthropic indique que Sonnet 5.5 comprend plus rapidement les bases de code, regroupe les appels d’outils plus efficacement, utilise moins d’étapes et réduit le coût par tâche complétée. FrontierCode teste si les modifications de code proposées sont fusionnables, tandis que CursorBench utilise des tâches ambiguës multi-fichiers issues de sessions de codage réelles ; les gains reflètent donc l’exécution et le jugement au niveau du dépôt, et pas seulement la génération de court code. Ces évolutions comptent pour la correction de bogues, la revue de code, l’exécution des tests et les agents de codage de longue durée.

Travail intellectuel
Les améliorations vont au-delà de la programmation. GDPval-AA évalue des tâches professionnelles réelles couvrant 44 métiers et neuf grandes industries ; ainsi, le score de 1844 pour Sonnet 5.5 — contre 1449 pour Sonnet 5 et 1846 pour Opus 5.5 — suggère que ses gains se transfèrent à l’analyse pratique, la production de documents et l’aide à la décision plutôt que de rester confinés à des tests de raisonnement en laboratoire.
Anthropic met en avant l’analyse financière, la synthèse documentaire, la création de diapositives, le travail sur feuilles de calcul, l’interprétation de graphiques, la vérification des sources, la recherche d’information et la rédaction professionnelle comme domaines d’amélioration du modèle.
Les premiers testeurs ont également signalé des améliorations moins quantifiables : collaboration plus claire, jugement conversationnel plus naturel et meilleur sens du design. Anthropic affirme que le modèle peut apporter du polissage aux interfaces utilisateur et suivre des modèles de diapositives de manière suffisamment fidèle pour produire des présentations nécessitant un minimum d’édition ; dans un test interne d’examen opérationnel, deux experts ont jugé le premier jet prêt à être envoyé sans modifications.
L’implication plus large est que Sonnet 5.5 doit être compris comme un modèle de travail professionnel, pas seulement comme un modèle de codage moins cher.
Utilisation de l’ordinateur
Sonnet 5.5 obtient 80,1 % sur OSWorld 2.1, contre 57,0 % pour Sonnet 5 et 81,8 % pour Opus 5.5. OSWorld évalue la capacité à opérer des environnements informatiques graphiques ; le résultat indique donc une grande amélioration générationnelle et des performances proches d’Opus pour les workflows impliquant navigateurs, outils de bureau et compréhension d’interfaces multimodales. Les résultats sur Chartography montrent un schéma similaire en reconnaissance de graphiques : 61,6 % pour Sonnet 5.5 contre 15,6 % pour Sonnet 5.
Vitesse
Anthropic rapporte que Sonnet 5.5 génère la sortie plus de 30 % plus rapidement que Sonnet 5, en faisant le modèle Sonnet le plus rapide au lancement. Une sortie plus rapide, combinée à moins d’appels d’outils et à une consommation de jetons réduite, raccourcit les boucles d’agents, réduit le temps d’attente lors du codage itératif et améliore le débit dans le support et d’autres workflows à grand volume.
Combien coûte Claude Sonnet 5.5 ?
| Tarification et source officielle | Claude Sonnet 5.5 | CometAPI : Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| Lectures de cache | 0,20 $ / 1M | 0,16 $ / 1M | 0,20 $ / 1M |
| Écritures de cache sur cinq minutes | 2,50 $ / 1M | 2 $ / 1M | 5 $ / 1M |
| Jetons d’entrée | 2 $ / 1M | 1,60 $/M | 4 $ / 1M |
| Jetons de sortie | 10 $ / 1M | 8,00 $/M | 20 $ / 1M |
Aux tarifs standard par jeton, Sonnet 5.5 coûte deux fois moins cher qu’Opus 5.5 à l’entrée comme à la sortie. Anthropic indique aussi que le nouveau Sonnet nécessite souvent moins de jetons pour terminer le même travail que Sonnet 5, réduisant le coût par tâche complétée.
Il s’agit des prix standard de l’API Claude. Les tarifs des fournisseurs cloud, le traitement régional, la durée du cache, les remises de lot et les règles de long contexte peuvent modifier le coût effectif.
Quelles évolutions de sécurité Claude Sonnet 5.5 introduit-il ?
Anthropic indique que son audit comportemental automatisé a couvert environ 1 850 scénarios et a constaté que Sonnet 5.5 s’améliorait ou égalait Sonnet 5 sur la plupart des mesures testées d’alignement, de résistance aux abus et d’honnêteté.
Garde-fous en cybersécurité
Parce que Sonnet 5.5 a des capacités cyber plus solides que son prédécesseur, Anthropic déploie des garde-fous similaires à ceux utilisés pour les modèles plus capables. Le développement logiciel courant et la correction de bogues ordinaires restent pris en charge, tandis que certaines tâches de cybersécurité plus risquées peuvent basculer vers un chemin de modèle plus sûr.
Garde-fous en biologie
Le modèle utilise les mêmes garde-fous en biologie que Sonnet 5, ciblant un ensemble restreint de demandes potentiellement nuisibles tout en laissant la plupart des travaux de recherche, d’éducation et cliniques inchangés.
Protections anti-distillation
Anthropic indique que Sonnet 5.5 est le premier modèle Sonnet à être lancé avec des classificateurs de sécurité conçus pour empêcher l’extraction de raisonnement via des attaques de distillation industrielles. Il étend également la pensée préservée, liant le contenu de la réflexion au compte et à la conversation qui l’ont créé afin que le raisonnement ne puisse pas être librement détaché et rejoué ailleurs. La plupart des développeurs ne remarqueront pas ce changement, mais les systèmes qui déplacent des conversations entre comptes ou modifient l’état de conversation antérieur devraient consulter les consignes de migration.
Ces affirmations décrivent les garde-fous rapportés par Anthropic, et non une garantie indépendante de sécurité pour chaque déploiement. Les équipes devraient évaluer le modèle selon leur propre modèle de menace, leurs politiques et leurs workflows à haut risque.
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
Claude Sonnet 5.5 est positionné comme le modèle de production rapide et efficace de ce groupe. Anthropic rapporte qu’il génère des sorties plus de 30 % plus vite que Claude Sonnet 5 tout en conservant le même prix d’en-tête par jeton. Claude Opus 5.5 cible des travaux plus ardus et plus ambigus, tandis que GPT-6 Sol est la comparaison la plus proche chez OpenAI pour le codage en long contexte et les workflows agentiques.
| Dimension | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Positionnement | Ancien modèle de production Sonnet | Cheval de bataille de production rapide et efficace | Raisonnement complexe haut de gamme | Responses API and Chat Completions |
| Fenêtre de contexte | 1M | 1M | 1M | 1,05M |
| Sortie maximale | 128K | 128K | 128K | 128K |
| Contrôles de raisonnement | Effort adaptatif | Effort adaptatif | Pensée adaptative, toujours activée | none, low, medium, high, xhigh, and max |
| Entrée multimodale | Texte et images | Texte et images | Texte et images | Texte et images |
| Disponibilité API | API Claude et grandes plateformes cloud | API Claude et grandes plateformes cloud | API Claude et grandes plateformes cloud | Responses API and Chat Completions |
| Prix standard entrée / sortie par 1M | 2 $ / 10 $ | 2 $ / 10 $ | 4 $ / 20 $ | 2 $ / 10 $ pour des invites jusqu’à 272K jetons d’entrée |
| Vitesse | Référence | Plus de 30 % plus rapide que Sonnet 5 | Optimisé pour des tâches plus difficiles et de plus longue durée | Varie selon le niveau d’effort de raisonnement |
| FrontierCode 1.1 | 42,4 % | 46,2 % à Max | 54,4 % | 49,3 % / 52,1 % à Xhigh |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| Idéal pour | Charges existantes de Sonnet | Agents professionnels et de codage à grand volume | Tâches difficiles, ambiguës et de longue durée | Codage, agents, outils et workflows long contexte natifs d’OpenAI |
Ces chiffres de benchmark sont des observations inter-fournisseurs rapportées, plutôt que des classements contrôlés et permanents. Les résultats dépendent des réglages d’effort et des conditions de déploiement.
Comment accéder à Claude Sonnet 5.5 et l’appeler via CometAPI ?
Claude Sonnet 5.5 est disponible via Claude, la Claude Platform, Amazon Web Services, Google Cloud et Microsoft Azure. Les développeurs souhaitant une interface compatible OpenAI unique pour plusieurs fournisseurs peuvent appeler le modèle via l’API Claude Sonnet 5.5 dans CometAPI avec l’identifiant de modèle claude-sonnet-5-5.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "Analysez cette base de code et identifiez les trois bogues ayant le plus d'impact.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
Pour un usage en production, stockez la clé API dans une variable d’environnement et évaluez les réglages d’effort, la mise en cache, l’appel d’outils, le comportement de reprise et la consommation de jetons au niveau de la tâche.
Qu’est-ce que le paramètre d’effort dans Claude Sonnet 5.5 ?
Claude Sonnet 5.5 prend en charge des niveaux d’effort ajustables qui échangent vitesse et consommation de jetons contre profondeur de raisonnement. Anthropic fixe par défaut Medium dans les applications Claude et Claude Code, tandis que la Claude Platform utilise High par défaut.
Les réglages d’effort plus bas conviennent aux travaux routiniers ou hautement structurés. Les niveaux plus élevés permettent davantage de raisonnement et de vérification pour les tâches de codage, d’analyse et agentiques plus difficiles. La budgétisation en production devrait donc considérer l’effort, l’utilisation d’outils et le coût total de complétion de la tâche plutôt que le seul prix par jeton.
API : quoi de neuf par rapport à Sonnet 5
Cinq changements peuvent casser ou modifier des intégrations Sonnet 5 existantes :
- Thinking-off migrations : les intégrations qui désactivaient la réflexion doivent passer à thinking: {"type": "between_tools"}. Ce réglage désactive la réflexion en amont tout en préservant le raisonnement entre les outils.
- Forced tool use : les choix d’outil forcés renvoient désormais une erreur ; utilisez la sélection automatique d’outils avec des schémas stricts lorsque cela convient.
- Thinking-block preservation : les blocs de réflexion sont liés au modèle et à la conversation. Renvoyez-les inchangés et ne supposez pas qu’ils puissent être rejoués après modification des messages système antérieurs, des outils ou du contexte de compte.
- Computer-use tool version : sur l’API Claude et Google Cloud, l’ancien outil computer_20251124 n’est plus accepté ; migrez vers l’ensemble d’outils « computer » actuellement documenté.
- Advisor compatibility : l’outil advisor rejette Claude Opus 4.8, Opus 4.7 et Sonnet 5 comme conseillers.
Un changement additionnel de la forme des réponses peut échouer silencieusement : du texte généré entre des appels d’outil peut apparaître dans des blocs de réflexion au lieu de blocs de texte. Les applications qui diffusent des messages d’avancement devraient traiter les réponses par type de bloc et définir un mode d’affichage approprié. Sonnet 5.5 ajoute aussi l’effort par message en bêta, des messages système en milieu de conversation, des changements d’outils en milieu de conversation en bêta, une longueur minimale d’invite mise en cache de 512 jetons, le traitement par lots, la prise en charge de l’API Files, l’entrée PDF et vision, ainsi que des outils côté serveur et côté client.
Que signifie Claude Sonnet 5.5 pour la famille Claude 5.5 ?
- Claude Opus 5.5 : travail complexe, à haut jugement, sur un long horizon.
- Claude Sonnet 5.5 : production efficace, codage, agents et travail professionnel.
- Claude Haiku 5.5 : annoncé comme le prochain membre à haut débit et sensible au coût de la famille.
Le mouvement plus large consiste à mesurer le coût par tâche réussie, la vitesse d’inférence et le routage de modèle plutôt que de se concentrer uniquement sur le prix brut du jeton ou un seul benchmark.
Conclusion
Claude Sonnet 5.5 est une mise à niveau axée sur l’efficacité du niveau de production d’Anthropic. Il conserve la tarification standard de Sonnet 5 à 2 $/10 $ par million de jetons tout en ajoutant une fenêtre de contexte de 1M de jetons, jusqu’à 128K jetons de sortie, une génération nettement plus rapide et de solides gains en codage, utilisation d’ordinateur, compréhension visuelle et travail intellectuel.
L’argument le plus fort pour le modèle est l’économie du workload : avec quelle fiabilité et rapidité il termine une tâche, combien d’appels d’outils et de jetons il consomme, et à quelle fréquence un workflow nécessite encore une escalade vers Opus 5.5. Les équipes devraient valider ces facteurs sur leurs propres tâches et considérer les benchmarks inter-fournisseurs comme des observations datées plutôt que des classements permanents.
