TL;DR
Claude Sonnet 5.5 è il modello più recente della classe Sonnet di Anthropic, rilasciato il 28 settembre 2026. È posizionato come il complemento più veloce e a costo inferiore rispetto a Claude Opus 5.5 per coding, lavoro agentico ben delimitato, produzione di documenti, uso del computer e analisi multimodale.
Il modello mantiene prezzi standard di $2 per milione di token di input e $10 per milione di token di output. Anthropic riporta una generazione dell’output oltre il 30% più veloce di Sonnet 5 e costi per attività fino al 30% inferiori perché il modello più recente spesso completa il lavoro con meno token e passaggi.
I risultati pubblicati includono 70.6% su Terminal-Bench 4.0, 55.5% su CursorBench 4.0, 1844 su GDPval-AA v2.1 e 80.1% su OSWorld 2.1. Il valore pratico non è un singolo punteggio isolato: Sonnet 5.5 si avvicina a Opus 5.5 in diverse valutazioni di lavoro professionale mantenendo prezzi dei token inferiori.
Punti chiave
- Claude Sonnet 5.5 è il secondo modello della famiglia Claude 5.5 di Anthropic ed è ottimizzato per il lavoro di produzione rapido piuttosto che per i compiti più ambigui e open-ended.
- Supporta una finestra di contesto da 1M token, fino a 128K token di output, input di testo e immagini, pensiero adattivo, uso di strumenti e risposte strutturate.
- I prezzi standard della Claude API sono $2/M input, $10/M output, $0.20/M letture cache e $2.50/M scritture cache di cinque minuti.
- Anthropic riporta oltre il 30% di output più veloce rispetto a Sonnet 5 e forti miglioramenti in coding, uso del computer, comprensione di grafici e lavoro conoscitivo a lungo orizzonte.
- L’ID del modello nella Claude API è claude-sonnet-5-5; gli sviluppatori possono anche accedere alla Claude Sonnet 5.5 API in CometAPI.
Che cos’è Claude Sonnet 5.5?
Claude Sonnet 5.5 è il nuovo modello Sonnet general-purpose di Anthropic e il secondo rilascio nella famiglia Claude 5.5 dopo Claude Opus 5.5. Anthropic lo posiziona come un complemento più veloce e a costo inferiore rispetto a Opus, non come un sostituto diretto del flagship.
La distinzione è pratica: Opus 5.5 è rivolto a lavori complessi e ambigui che richiedono giudizio sostenuto, mentre Sonnet 5.5 è ottimizzato per attività ben definite, correzione di bug, iterazione rapida, coding, produzione di documenti e workflow professionali ad alto volume.
Quali sono le caratteristiche più importanti di Claude Sonnet 5.5?
Il modello combina una finestra di contesto da 1M token, fino a 128K token di output, input testo+immagini, pensiero adattivo, sforzo regolabile, uso di strumenti, output strutturati, prompt caching, elaborazione in batch e supporto tramite Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform su AWS. Per i team di produzione, la combinazione definente non è una singola funzionalità ma generazione veloce, minore uso di token per attività e prestazioni vicine a Opus su diversi carichi di lavoro professionali ben delimitati.
Benchmark di Claude Sonnet 5.5
Anthropic riporta miglioramenti sostanziali in coding, lavoro professionale a lungo orizzonte, uso del computer e comprensione visiva. La tabella seguente riassume i risultati di valutazione pubblicati dalla società.
| Benchmark e fonte ufficiale | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% a Xhigh | Non riportato pubblicamente |
| FrontierCode 1.1 Main | 46.2% a Max | 42.4% | 54.4% | 49.3% / 52.1% a Xhigh |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | Non riportato pubblicamente |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64.5% con strumenti | 54.9% | 67.7% | Non riportato nella tabella di origine |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% | Non riportato nella tabella di origine |
| Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
Condizioni di valutazione e avvertenze: I punteggi non sono tutti misurati con la stessa impostazione di sforzo. Il risultato 66.4% di Opus 5.5 su Terminal-Bench è riportato a Xhigh. Anthropic osserva che su FrontierCode Sonnet 5.5 può ottenere un punteggio inferiore a Max rispetto a Xhigh perché passaggi di revisione aggiuntivi possono introdurre timeout o modifiche fuori ambito. Artificial Analysis ha eseguito GDPval-AA e AA-Briefcase su una distribuzione pre-release di Sonnet 5.5 interessata da un bug negli output strutturati che Anthropic afferma sia stato risolto. Le cifre cross-vendor di GPT-6 Sol dovrebbero essere considerate osservazioni datate perché OpenAI ha corretto un problema di codifica delle immagini il 25 settembre 2026.
Cosa significano i risultati: Sonnet 5.5 non è semplicemente avanti a Sonnet 5 su punteggi isolati. Si avvicina molto a Opus 5.5 su coding, lavoro professionale, uso del computer e riconoscimento di grafici mantenendo i prezzi di fascia Sonnet. Anthropic riporta anche che, a Low o Medium, Sonnet 5.5 può superare il miglior punteggio di Sonnet 5 in diverse valutazioni a circa un decimo del costo per attività. Questa combinazione di capacità, velocità ed efficienza a livello di task è il suo principale vantaggio competitivo.
Quanto è valido Claude Sonnet 5.5?
Programmazione
Il miglioramento è anche operativo. Anthropic riporta che Sonnet 5.5 comprende le codebase più rapidamente, raggruppa le chiamate agli strumenti in modo più efficiente, usa meno passaggi e riduce il costo per attività completata. FrontierCode verifica se le proposte di modifica del codice sono integrabili (mergeable), mentre CursorBench utilizza attività ambigue su più file tratte da reali sessioni di coding; i progressi riflettono quindi esecuzione e giudizio a livello di repository, non solo generazione di codice breve. Questi cambiamenti contano per correzione di bug, code review, esecuzione di test e agenti di coding di lunga durata.

Lavoro della conoscenza
I miglioramenti vanno oltre la programmazione. GDPval-AA testa compiti professionali reali in 44 occupazioni e nove settori principali, quindi il punteggio di 1844 di Sonnet 5.5 — contro 1449 per Sonnet 5 e 1846 per Opus 5.5 — suggerisce che i progressi si trasferiscono ad analisi pratiche, produzione di documenti e supporto alle decisioni, e non restano confinati a test di ragionamento da laboratorio.
Anthropic evidenzia analisi finanziaria, sintesi di documenti, creazione di slide, lavoro su fogli di calcolo, interpretazione di grafici, verifica delle fonti, recupero di informazioni e scrittura professionale come aree in cui il modello migliora.
I primi tester hanno riportato anche miglioramenti meno quantificabili: collaborazione più chiara, giudizio conversazionale più naturale e un occhio più attento al design. Anthropic afferma che il modello può aggiungere rifinitura alle interfacce utente e seguire i template per le slide abbastanza fedelmente da produrre deck che richiedono modifiche minime; in un test interno di revisione operativa, due esperti hanno giudicato la prima bozza pronta per l’invio senza cambiamenti.
L’implicazione più ampia è che Sonnet 5.5 va inteso come un modello per il lavoro professionale, non solo come un modello di coding più economico.
Uso del computer
Sonnet 5.5 ottiene 80.1% su OSWorld 2.1, rispetto al 57.0% di Sonnet 5 e all’81.8% di Opus 5.5. OSWorld valuta la capacità di operare ambienti grafici del computer, quindi il risultato indica un grande miglioramento generazionale e prestazioni quasi pari a Opus per workflow che coinvolgono browser, strumenti desktop e comprensione di interfacce multimodali. I risultati Chartography mostrano un andamento simile nel riconoscimento visivo dei grafici: 61.6% per Sonnet 5.5 contro 15.6% per Sonnet 5.
Velocità
Anthropic riporta che Sonnet 5.5 genera output oltre il 30% più velocemente di Sonnet 5, rendendolo il modello Sonnet più veloce al lancio. Output più rapido si combina con meno chiamate agli strumenti e minore uso di token per accorciare i loop degli agenti, ridurre i tempi d’attesa durante il coding iterativo e migliorare la capacità nei workflow di supporto e altri ad alto volume.
Quanto costa Claude Sonnet 5.5?
| Prezzi e fonte ufficiale | Claude Sonnet 5.5 | CometAPI: Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| Letture cache | $0.20 / 1M | $0.16 / 1M | $0.20 / 1M |
| Scritture cache di cinque minuti | $2.50 / 1M | $2 / 1M | $5 / 1M |
| Token di input | $2 / 1M | $1.60/M | $4 / 1M |
| Token di output | $10 / 1M | $8.00/M | $20 / 1M |
Ai prezzi standard per token, Sonnet 5.5 costa la metà di Opus 5.5 per input e output. Anthropic afferma anche che il nuovo Sonnet spesso necessita di meno token per completare lo stesso lavoro rispetto a Sonnet 5, riducendo il costo per attività completata.
Questi sono i prezzi standard della Claude API. I prezzi dei provider cloud, l’elaborazione regionale, la durata della cache, gli sconti per i batch e le regole per i contesti lunghi possono modificare il costo effettivo.
Quali novità in tema di sicurezza introduce Claude Sonnet 5.5?
Anthropic afferma che il suo audit comportamentale automatizzato ha coperto circa 1.850 scenari e ha riscontrato che Sonnet 5.5 è migliorato o ha eguagliato Sonnet 5 sulla maggior parte delle misure testate di allineamento, resistenza all’uso improprio e veridicità.
Salvaguardie per la cybersicurezza
Poiché Sonnet 5.5 ha capacità cyber più forti del suo predecessore, Anthropic sta implementando salvaguardie simili a quelle utilizzate per modelli più capaci. Lo sviluppo software di routine e la normale correzione di bug restano supportati, mentre alcuni compiti di cybersicurezza a maggior rischio possono ripiegare su un percorso di modello più sicuro.
Salvaguardie per la biologia
Il modello utilizza le stesse salvaguardie biologiche di Sonnet 5, mirando a un insieme ristretto di richieste potenzialmente dannose pur lasciando invariata la maggior parte del lavoro di ricerca, didattica e clinico.
Protezioni anti-distillazione
Anthropic afferma che Sonnet 5.5 è il primo modello Sonnet a essere lanciato con classificatori di sicurezza progettati per prevenire l’estrazione del ragionamento tramite attacchi di distillazione su scala industriale. Espande anche il pensiero preservato, collegando i contenuti di thinking all’account e alla conversazione che li hanno creati, in modo che il ragionamento non possa essere liberamente staccato e riprodotto altrove. La maggior parte degli sviluppatori non noterà questa modifica, ma i sistemi che spostano conversazioni tra account o alterano lo stato delle conversazioni precedenti dovrebbero rivedere le linee guida di migrazione.
Queste dichiarazioni descrivono le salvaguardie riportate da Anthropic, non una garanzia indipendente di sicurezza per ogni distribuzione. I team dovrebbero valutare il modello rispetto al proprio modello di minaccia, alle politiche e ai workflow ad alto rischio.
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
Claude Sonnet 5.5 è posizionato come il modello di produzione veloce ed efficiente in questo gruppo. Anthropic riporta che genera output oltre il 30% più velocemente di Claude Sonnet 5 mantenendo lo stesso prezzo per token. Claude Opus 5.5 è rivolto a lavori più difficili e ambigui, mentre GPT-6 Sol è il confronto OpenAI più vicino per coding a lungo contesto e workflow agentici.
| Dimensione | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Posizionamento | Precedente modello Sonnet per la produzione | Cavallo di battaglia per la produzione: veloce ed efficiente | Ragionamento complesso di fascia alta | Complex coding and agentic workflows |
| Finestra di contesto | 1M | 1M | 1M | 1.05M |
| Output massimo | 128K | 128K | 128K | 128K |
| Controlli di ragionamento | Sforzo adattivo | Sforzo adattivo | Pensiero adattivo, sempre attivo | none, low, medium, high, xhigh, and max |
| Input multimodale | Testo e immagini | Testo e immagini | Testo e immagini | Testo e immagini |
| Disponibilità API | Claude API e principali piattaforme cloud | Claude API e principali piattaforme cloud | Claude API e principali piattaforme cloud | Responses API and Chat Completions |
| Prezzo standard input/output per 1M | $2 / $10 | $2 / $10 | $4 / $20 | $2 / $10 for prompts up to 272K input tokens |
| Velocità | Baseline | Oltre il 30% più veloce di Sonnet 5 | Ottimizzato per lavori più difficili e di lunga durata | Varia in base allo sforzo di ragionamento |
| FrontierCode 1.1 | 42.4% | 46.2% a Max | 54.4% | 49.3% / 52.1% a Xhigh |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| Più adatto a | Carichi di lavoro Sonnet esistenti | Coding ad alto volume e agenti professionali | Attività difficili, ambigue e di lunga durata | OpenAI-native coding, agents, tools, and long-context workflows |
Queste cifre di benchmark sono osservazioni cross-vendor, non classifiche controllate o permanenti. I risultati dipendono dalle impostazioni di sforzo e dalle condizioni di distribuzione.
Come si accede e si richiama Claude Sonnet 5.5 tramite CometAPI?
Claude Sonnet 5.5 è disponibile tramite Claude, Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure. Gli sviluppatori che desiderano un’unica interfaccia compatibile con OpenAI per più provider possono chiamare il modello tramite la Claude Sonnet 5.5 API in CometAPI con l’identificatore del modello claude-sonnet-5-5.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "Analyze this codebase and identify the three highest-impact bugs.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
Per l’uso in produzione, archivia la chiave API in una variabile d’ambiente e valuta impostazioni di sforzo, caching, chiamata agli strumenti, comportamento di retry e consumo di token a livello di task.
Che cos’è l’impostazione di sforzo in Claude Sonnet 5.5?
Claude Sonnet 5.5 supporta livelli di sforzo regolabili che scambiano velocità e uso dei token con profondità di ragionamento. Anthropic imposta di default Medium nelle app Claude e in Claude Code, mentre la Claude Platform predefinisce High.
Impostazioni di sforzo inferiori si adattano a lavori di routine o altamente strutturati. Impostazioni più alte consentono più ragionamento e controlli per coding, analisi e compiti agentici più difficili. La pianificazione dei budget di produzione dovrebbe quindi considerare sforzo, uso degli strumenti e costo totale di completamento dell’attività, non solo il prezzo per token.
API: novità rispetto a Sonnet 5
Cinque cambiamenti possono interrompere o alterare le integrazioni esistenti con Sonnet 5:
- Migrazioni con thinking disattivato: le integrazioni che disabilitavano il thinking dovrebbero passare a thinking: {"type": "between_tools"}. Questa impostazione disattiva il thinking iniziale preservando il ragionamento tra gli strumenti.
- Uso forzato degli strumenti: le scelte forzate degli strumenti ora restituiscono un errore; usare la selezione automatica degli strumenti con schemi rigorosi quando opportuno.
- Conservazione dei blocchi di thinking: i blocchi di thinking sono legati al modello e alla conversazione. Reinviali invariati e non presumere che possano essere riprodotti dopo aver cambiato messaggi di sistema precedenti, strumenti o contesto dell’account.
- Versione dello strumento di uso del computer: sulla Claude API e su Google Cloud, il vecchio strumento computer_20251124 non è più accettato; migrare all’attuale toolset per il computer documentato.
- Compatibilità dell’advisor: lo strumento advisor rifiuta Claude Opus 4.8, Opus 4.7 e Sonnet 5 come advisor.
Un’ulteriore modifica nella forma della risposta può fallire in modo silenzioso: il testo generato tra le chiamate agli strumenti può comparire nei thinking blocks invece che nei text blocks. Le applicazioni che eseguono lo streaming dei messaggi di avanzamento dovrebbero elaborare le risposte per tipo di blocco e impostare una modalità di visualizzazione appropriata. Sonnet 5.5 introduce anche lo sforzo per messaggio in beta, messaggi di sistema a conversazione in corso, modifiche agli strumenti a conversazione in corso in beta, una lunghezza minima cacheable del prompt di 512 token, elaborazione in batch, supporto per la Files API, input PDF e vision e strumenti sia lato server sia lato client.
Cosa significa Claude Sonnet 5.5 per la famiglia Claude 5.5?
- Claude Opus 5.5: lavoro complesso, ad alto giudizio e lungo orizzonte.
- Claude Sonnet 5.5: produzione efficiente, coding, agenti e lavoro professionale.
- Claude Haiku 5.5: annunciato come il prossimo membro ad alto throughput e sensibile ai costi della famiglia.
Il cambiamento più ampio è verso la misurazione del costo per attività riuscita, della velocità d’inferenza e del routing dei modelli, piuttosto che concentrarsi solo sul prezzo grezzo per token o su un singolo benchmark.
Conclusione
Claude Sonnet 5.5 è un aggiornamento incentrato sull’efficienza per il livello di produzione di Anthropic. Mantiene i prezzi standard di Sonnet 5 a $2/$10 aggiungendo una finestra di contesto da 1M token, fino a 128K token di output, una generazione sostanzialmente più veloce e forti miglioramenti in coding, uso del computer, comprensione visiva e lavoro conoscitivo.
Il punto di forza del modello sono l’economia dei carichi di lavoro: quanto rapidamente e con quale affidabilità completa un compito, quante chiamate agli strumenti e quanti token consuma e con quale frequenza un workflow richiede ancora l’escalation a Opus 5.5. I team dovrebbero convalidare questi fattori sui propri compiti e considerare i benchmark cross-vendor come osservazioni datate piuttosto che classifiche permanenti.
