TLDR Claude Opus 5.5 è l’ultimo modello linguistico di classe Opus di Anthropic, rilasciato il 22 settembre 2026. Eguaglia le prestazioni di Claude Fable 5.1 sulla maggior parte dei lavori reali pur costando circa il 40% in meno da eseguire rispetto a Claude Opus 5 sui carichi di lavoro tipici.
I prezzi ufficiali di Claude Opus 5.5 sono di $4 per milione di token in input e $20 per milione di token in output (20% in meno rispetto a Opus 5), con letture della cache a soli $0,20. Il modello guida o si colloca ai vertici dei principali benchmark di programmazione agentica (Terminal-Bench 4.0 al 66,4%, FrontierCode, CursorBench), offre forti miglioramenti nel lavoro basato sulla conoscenza, nell’uso del computer, nel ragionamento matematico/scientifico e nelle attività professionali di lungo periodo, e stabilisce un nuovo massimo nelle valutazioni di allineamento di Anthropic. È disponibile da oggi tramite la Claude API (ID modello claude-opus-5-5) e su piattaforme unificate come CometAPI.
Punti chiave
- Parità di prestazioni con la frontiera: Opus 5.5 raggiunge o supera Claude Fable 5.1 nei principali benchmark per la programmazione agentica e il lavoro cognitivo a un costo significativamente inferiore.
- Grandi guadagni di efficienza: ~40% di costo in meno sui carichi tipici rispetto a Opus 5; >30% più veloce nella generazione di output; consumo di token per attività sostanzialmente ridotto.
- Progressi nella programmazione: Punteggi al top su Terminal-Bench 4.0 (66,4%), FrontierCode, CursorBench 4.0 (57,8%); esempi reali includono migrazioni da 680k righe completate in meno di un giorno.
- Comunicazione più chiara e miglioramenti dell’EQ: Scrittura più naturale, informazioni chiave in apertura, meno gergo, migliore collaborazione su sessioni lunghe — i tester dicono che “scrive come me”.
- Maggiore sicurezza: I migliori risultati finora nell’audit comportamentale automatizzato di Anthropic; 85% meno propenso di Opus 5 o Mythos 5.1 a tentare di aggirare i limiti; distribuito con salvaguardie di classe Fable per biologia e cybersecurity.
- Disponibilità e accesso: Nativo sulla piattaforma Claude; accessibile anche tramite aggregatori come CometAPI per endpoint unificati compatibili con OpenAI e prezzi multi-modello competitivi.
Che cos’è Claude Opus 5.5?
Claude Opus 5.5 è l’ultimo modello di classe Opus di Anthropic e il primo rilascio della famiglia Claude 5.5. Progettato per programmazione agentica di lunga durata, lavoro cognitivo, uso del computer e attività professionali complesse, rappresenta un sostanziale upgrade rispetto a Claude Opus 5 (rilasciato il 24 luglio 2026).
Anthropic lo descrive come performante al livello del suo modello di fascia più alta Claude Fable 5.1 nella maggior parte dei lavori pur richiedendo meno calcolo. Dispone di una finestra di contesto da 1M token, fino a 128K token di output (più alti tramite Batch API in beta), ragionamento adattivo sempre attivo (nessuna modalità “off”) e salvaguardie di produzione. L’ID ufficiale del modello è claude-opus-5-5.
Il modello è stato addestrato su un mix proprietario di dati pubblici da internet, dataset, dati utente autorizzati e dati sintetici. È il primo grande rilascio di Anthropic dopo l’appello pubblico del CEO Dario Amodei a “regolare il passo della frontiera” — bilanciando deliberatamente i progressi di capacità con quelli di sicurezza.
ID del modello sulla Claude API: claude-opus-5-5. È disponibile nei piani Claude Pro, Max, Team ed Enterprise, in Claude Code e tramite piattaforme di terze parti.
Claude Opus 5.5 vs Claude Fable 5.1 vs
| Claude Opus 5 |
|---|
| Caratteristica / Metrica | Claude Opus 5.5 | Claude Fable 5.1 | Claude Opus 5 | Note |
|---|---|---|---|---|
| Release date | 22 settembre 2026 | 1 settembre 2026 | 24 luglio 2026 | — |
| Input / Output price | $4 / $20 | $10 / $50 | $5 / $25 | Opus 5.5 ~60% più economico di Fable alle tariffe headline |
| Cache reads | $0.20 | Più alto | $0.50 | Grande risparmio per gli agenti |
| Context / Max output | 1M / 128K | 1M / 128K | 1M / 128K | Uguale |
| Knowledge cutoff | giugno 2026 | giugno 2026 | maggio 2026 | — |
| Default effort | Medio | Alto | Alto | — |
| Terminal-Bench 4.0 | 66,4% | 55,8% | 52,3% | Opus 5.5 in testa |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | Opus 5.5 in testa |
| Communication clarity | Significativamente migliorata | Elevata | Più prolisso | Elemento distintivo chiave |
| Safety / Alignment | Miglior audit comportamentale | Alta (con salvaguardie) | Forte | Opus 5.5 il più forte nell’audit |
| Best for | Lavoro di frontiera quotidiano, programmazione agentica su scala | Massime capacità / specializzazione di lungo periodo | Precedente soluzione di fascia alta quotidiana | Opus 5.5 ora preferito per la maggior parte dei carichi di lavoro |
Anthropic osserva che agli attuali livelli di capacità, i margini dei benchmark possono sottostimare o sovrastimare le differenze nel mondo reale; nell’uso interno il divario tra Opus 5.5 e Fable 5.1 è più stretto di quanto suggeriscano alcuni punteggi. Per la maggior parte delle attività di programmazione, conoscenza e agentiche, Opus 5.5 è la scelta più conveniente. Fable 5.1 (e l’accesso limitato a Mythos) resta rilevante per i carichi più critici o specializzati, in particolare quelli che richiedono le capacità più forti in ambito cyber/biologia sotto programmi di verifica.
Prestazioni nel codice: benchmark leader per la programmazione agentica
Claude Opus 5.5 dà la prova più forte nella programmazione agentica e nell’ingegneria del software. Anthropic riporta che guida o è ai vertici di diverse valutazioni principali:
| Benchmark | Claude Opus 5.5 | Claude Fable 5.1 | Claude Opus 5 | GPT-6 Astra (riportato) |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 66,4% | 55,8% | 52,3% | 57,9% |
| FrontierCode v1.1 (Main) | 54,4% | 50,3% | 48,0% | 53,3% |
| CursorBench 4.0 | 57,8% | 51,8% | 46,6% | — |
Questi risultati sono misurati con sforzo di ragionamento adattivo alto o massimo. Anthropic nota che le differenze reali tra Opus 5.5 e Fable 5.1 sono spesso più strette di quanto indichino i margini grezzi dei benchmark, ma i numeri assoluti collocano Opus 5.5 allo stato dell’arte per il lavoro software agentico.
Esempi reali da Anthropic e primi clienti includono:
- Completamento di una migrazione di 680.000 righe di codice in meno di un giorno (lavoro che avrebbe richiesto settimane a un team di ingegneri).
- Riduzione dei tempi di caricamento su ogni pagina di un’applicazione web in 39 test su 40, mentre Opus 5 ha prodotto miglioramenti minori che talvolta alteravano il comportamento dell’applicazione.
- Traduzione di HAProxy (un bilanciatore di carico ampiamente usato) da C a Rust: sia Opus 5.5 sia Fable 5.1 hanno prodotto riscritture che superavano quasi tutti i test di regressione, ma Opus 5.5 ha terminato in 9,5 ore contro le 12 ore di Fable 5.1 e con un costo inferiore del 51%.
Il feedback dei clienti rafforza la storia dell’efficienza. I team riportano che Opus 5.5 eguaglia la qualità di Opus 5 in circa metà dei turni, del tempo e dei token di output nelle attività di programmazione agentica (riduzione dei costi del 40–50%). Alla minima impostazione di sforzo ha individuato il 72% dei bug noti nelle revisioni del codice rispetto al 56% di Opus 5 con sforzo alto, con meno falsi positivi e un volume di output molto inferiore.
Con lo sforzo predefinito (medio), Opus 5.5 spesso supera le impostazioni di sforzo più alte dei concorrenti a una frazione del costo — circa il 20% del costo per attività di GPT-6 Astra su FrontierCode e circa un terzo del costo su CursorBench, superando GPT-5.6 Sol di 11 punti. Il modello è particolarmente forte nella pianificazione deliberata multi-step, nel coordinamento di sotto-agenti, nell’uso della memoria tra sessioni e nella gestione di lavori a lungo termine con supervisione umana minima.
Progressi nella conoscenza e nel ragionamento multidisciplinare
Oltre alla pura programmazione, Opus 5.5 avanza nel lavoro professionale di lungo periodo basato sulla conoscenza e nel ragionamento multidisciplinare. Nella valutazione di lavoro cognitivo GDPval-AA v2.1 registra un Elo di 1846, davanti a Fable 5.1 (1735) e Opus 5 (1708).
Risultati aggiuntivi:
- AutomationBench (workflow aziendali): 40,0% (vs Fable 5.1 31,4%, Opus 5 26,9%).
- Humanity’s Last Exam (con strumenti): 67,7%.
- Terminal-Bench-Science 0.1: 58,7%.
- OSWorld 2.0 (uso del computer): 81,8% parziale.
- Chartography (riconoscimento visivo di grafici, con strumenti): 89,0%.
Il limite di conoscenza è giugno 2026. Si riportano miglioramenti nel ragionamento matematico e scientifico, nonché nel ragionamento visivo e negli scenari di uso del computer che richiedono giudizio tra più applicazioni.
Il punto di forza di Claude Opus 5.5 è nei workflow professionali a lungo termine e multi-step — il tipo di lavoro che in passato richiedeva intervento umano costante o modelli di frontiera più costosi. I miglioramenti di efficienza (meno token e passaggi) amplificano questi guadagni, rendendo più pratici progetti agentici ambiziosi.
Miglioramento dell’EQ, allineamento e sicurezza
Anthropic pone grande enfasi sull’allineamento e sulla sicurezza comportamentale per Opus 5.5. Nel più completo audit comportamentale automatizzato dell’azienda (migliaia di scenari simulati), Opus 5.5 è il modello con le migliori prestazioni testato finora. Si riporta che è l’85% meno propenso di Opus 5 o Mythos 5.1 a tentare di aggirare i limiti prescritti.
Il modello viene fornito con salvaguardie paragonabili a quelle di Fable 5.1 per i domini ad alto rischio:
- Alcune richieste relative alla cybersecurity vengono instradate verso un modello meno potente (Opus 4.8).
- Le richieste di biologia segnalate vengono indirizzate a Opus 5.
- Protezioni anti-distillazione (pensiero preservato) impediscono l’estrazione del ragionamento interno.
Nelle valutazioni di affetto e valenza, Opus 5.5 mostra principalmente un comportamento neutro; gli affetti negativi sono guidati soprattutto dal fallimento del compito piuttosto che da altri fattori. Queste caratteristiche contribuiscono a una “EQ” più affidabile e collaborativa in contesti professionali e agentici.
Anthropic e i primi tester riportano che Opus 5.5:
- Scrive in modo più chiaro e naturale.
- Mette le informazioni più importanti per prime.
- Usa meno gergo e formulazioni idiosincratiche.
- Segue più fedelmente le regole di scrittura specificate dall’utente.
- Produce output più facili da seguire e verificare durante sessioni lunghe.
I tester hanno notato una scrittura più naturale e chiara che pone le informazioni importanti all’inizio e si comporta come un partner di lavoro affidabile. Anthropic ha evidenziato una riduzione del gergo e una migliore collaborazione nelle sessioni lunghe — miglioramenti che favoriscono anche la sicurezza rendendo gli output più facili da ispezionare.
Convenienza: il vantaggio principale
Prezzi (per milione di token):
| Componente di prezzo | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Input | $4 | $5 |
| Output | $20 | $25 |
| Letture della cache | $0.20 | $0.50 |
| Scritture nella cache | $5 | $6.25 |
Anthropic afferma che con le impostazioni predefinite il modello costa circa il 40% in meno sui carichi tipici rispetto a Opus 5, grazie sia a tariffe per token più basse sia a un minor consumo di token. Le letture della cache (dominanti nei carichi di lavoro agentici e di programmazione) sono più economiche del 60%. La generazione di output è più veloce di oltre il 30%.
Gli utenti in abbonamento dei piani Pro, Max e Team hanno anche ricevuto limiti di utilizzo su cinque ore aumentati e un reset flessibile dei rate limit.
Per gli sviluppatori che preferiscono un unico endpoint compatibile con OpenAI tra molti provider, piattaforme come CometAPI offrono accesso ai modelli Claude (inclusi gli ultimi varianti Opus man mano che diventano disponibili) insieme a GPT, Gemini, Grok e centinaia di altri modelli. CometAPI fornisce prezzi competitivi, fatturazione unificata e la possibilità di cambiare modello con modifiche minime al codice — utile per i team che valutano Opus 5.5 rispetto alle alternative o costruiscono instradamento multi-modello.
Come accedere a Claude Opus 5.5 tramite CometAPI
CometAPI fornisce un endpoint unificato, compatibile con OpenAI, verso oltre 500 modelli di Anthropic, OpenAI, Google, xAI e altri con un’unica chiave API e un unico account di fatturazione. Questo elimina la necessità di gestire credenziali Anthropic separate, semplifica il passaggio tra Opus 5.5, Fable 5.1, varianti GPT-6 e altri modelli, e spesso offre prezzi effettivi competitivi (spesso più bassi) senza lock-in al fornitore.
Per iniziare:
Punta il tuo SDK OpenAI (o SDK Anthropic) a https://api.cometapi.com/v1 (o all’endpoint Messages) e usa la stringa del modello per Claude Opus 5.5.
Registrati su CometAPI.com (crediti di prova gratuiti disponibili).
Ottieni la tua chiave API.
Quali sono i principali miglioramenti pratici per gli sviluppatori?
Anthropic ha indicato che Claude Sonnet 5.5 e Claude Haiku 5.5 seguiranno nelle prossime settimane con miglioramenti analoghi in prestazioni, efficienza e sicurezza. La famiglia 5.5 segnala un focus nel fornire utilità di livello frontiera a prezzi più accessibili, continuando una rigorosa valutazione esterna e le salvaguardie.
Completamento più rapido ed economico di grandi migrazioni e audit del codice; migliore affidabilità degli agenti su orizzonti lunghi; output più chiari; e comportamenti di sicurezza integrati più solidi.
Claude Opus 5.5 dimostra che sono possibili guadagni significativi di capacità ed efficienza anche seguendo un approccio deliberato di “regolazione della frontiera”. Con prezzi confermati che sottotagliano il suo predecessore del 20% (e di più nei carichi di lavoro reali) offrendo risultati competitivi con Fable, è posizionato per diventare la scelta predefinita per molte applicazioni di programmazione e agentiche in produzione. Gli sviluppatori che cercano il percorso più flessibile e conveniente per sperimentare e distribuire il modello dovrebbero considerare gateway unificati come CometAPI, che supportano già l’intera famiglia Claude insieme a sistemi di frontiera concorrenti.
