Anthropic ha rilasciato Fable 5.1 il 1° settembre 2026 come il suo modello generalmente disponibile più capace per coding e lavoro di conoscenza. Il modello è rivolto a lavori a lungo termine: coding di più ore, ricerca multi-step, lavoro professionale con molti documenti e agenti che utilizzano ripetutamente strumenti mantenendo grandi quantità di contesto.
Claude Fable 5.1 combina una finestra di contesto da 1M token, fino a 128K token di output, input di testo e immagini e pensiero adattivo sempre attivo. Il prezzo base resta $10 per MTok in input e $50 per MTok in output; il cambiamento di costo importante è $0.25 per MTok per le letture della cache.
Specifiche di Claude Fable 5.1 a colpo d'occhio
Le specifiche sottostanti provengono dalla documentazione del modello di Anthropic. I prezzi sono quelli di listino Anthropic e vanno tenuti separati da eventuali prezzi CometAPI.
| Specifica ufficiale | Claude Fable 5.1 |
|---|---|
| Release e ID modello | 1° settembre 2026 — claude-fable-5-1 |
| Ruolo principale | Lavoro di ragionamento impegnativo e agentico a lungo termine |
| Contesto e output massimo | Contesto da 1M token — fino a 128K di output |
| Input → output | Testo e immagini → testo |
| Pensiero ed effort API predefinito | Pensiero adattivo, sempre attivo — Effort alto |
| Cutoff affidabile della conoscenza | Giugno 2026 |
| Prezzi di listino | $10 input — $50 output — $0.25 lettura cache per MTok |
Due dettagli contano oltre i numeri grezzi. La finestra di contesto da 1M è disponibile di default, non come un livello speciale di lungo contesto. Il pensiero adattivo è sempre attivo, mentre i controlli dell’effort determinano quanto lavoro il modello esegue; Anthropic afferma che il default è Alto in Claude Code e Medio in Claude Cowork e Claude.ai.
Che cos'è Claude Fable 5.1
Claude Fable 5.1 è il modello di frontiera di Anthropic per lavori in cui un sistema deve continuare a ragionare, usare strumenti e preservare il contesto su molti step. Invece di puntare a brevi scambi di domande e risposte, è progettato per un’esecuzione prolungata: esplorare un codebase, eseguire workflow da terminale, sintetizzare grandi insiemi di documenti e completare attività professionali che possono richiedere ore.
Il suo pacchetto distintivo è una finestra di contesto da 1M token con fino a 128K di output, input di testo e immagini e pensiero adattivo che rimane abilitato durante tutta una richiesta. Questo consente a un agente di mantenere istruzioni estese, materiale sorgente, risultati degli strumenti e decisioni intermedie in un unico contesto di lavoro, regolando l’effort di ragionamento in base alla difficoltà di ogni step.
L’uso ideale è un workflow ad alto valore in cui fallimenti, rifacimenti o perdita di contesto costano più del prezzo premium a token. Esempi includono ingegneria alla scala del repository, ricerca multi-stage, agenti di uso del computer, analisi documentale con forti requisiti di conformità e automazione aziendale con chiamate ripetute agli strumenti. Per classificazioni di routine, estrazione ad alto volume o chat sensibili alla latenza, un livello Claude a costo inferiore può rimanere il punto di partenza migliore.
L’uso predefinito di Fable richiede una retention di 30 giorni per il monitoraggio della sicurezza. I clienti enterprise idonei possono usare zero data retention mentre vengono introdotte le Enterprise Frontier Safeguards; Anthropic afferma che l’architettura pianificata archivia i dati monitorati in infrastruttura cloud controllata dal cliente. I team regolamentati dovrebbero verificare i termini specifici dell’account prima della distribuzione.
Claude Fable 5.1 vs. Fable 5: cosa è cambiato?
La release 5.1 non rappresenta un salto uniforme di capacità. I cambiamenti più chiari sono un costo inferiore per i contesti ripetuti e una esecuzione molto più forte in ricerca agentica, coding da terminale e flussi di lavoro aziendali, mentre il ragionamento generale assistito da strumenti avanza solo leggermente.
| Dimensione | Claude Fable 5 | Claude Fable 5.1 | Variazione |
|---|---|---|---|
| Input / output base | $10 / $50 per MTok | $10 / $50 per MTok | Nessun cambio |
| Lettura cache | $1.00 per MTok | $0.25 per MTok | -75% |
| Terminal-Bench-Science 0.1 | 24.7% | 52.6% | +27.9 punti |
| Terminal-Bench 4.0 | 42.0% | 55.8% | +13.8 punti |
| AutomationBench | 17.1% | 31.4% | +14.3 punti |
| HLE con strumenti | 63.8% | 65.0% | +1.2 punti |
Le letture della cache costano il 75% in meno mentre i prezzi base restano invariati
L’input resta $10 per MTok e l’output resta $50 per MTok, quindi il prezzo di copertina non è sceso. Il cambiamento sostanziale è la lettura della cache che scende da $1.00 a $0.25 per MTok. Questo conta soprattutto per agenti che ricaricano ripetutamente un lungo prefisso contenente repository, policy, documenti, definizioni di strumenti e stato precedente. Il loro costo per workflow completato può diminuire anche quando i tassi di input fresco e di output non cambiano.
La ricerca scientifica agentica mostra il guadagno più grande
Terminal-Bench-Science 0.1 sale da 24.7% a 52.6%, un aumento di 27.9 punti percentuali e più del doppio del punteggio precedente. Questa è la prova più forte che Fable 5.1 migliora l’esecuzione a lungo termine: pianificare un’indagine, operare strumenti, interpretare risultati e recuperare da errori intermedi.
Coding da terminale e automazione aziendale migliorano in modo significativo
Terminal-Bench 4.0 aumenta da 42.0% a 55.8%, mentre AutomationBench sale da 17.1% a 31.4%. Questi risultati indicano un migliore completamento delle attività end-to-end, non solo una migliore generazione di codice. I team dovrebbero aspettarsi il massimo beneficio in workflow che richiedono al modello di ispezionare un ambiente, scegliere azioni, usare strumenti e verificare i risultati su più step.
Il ragionamento generale migliora meno dell’esecuzione
Humanity?s Last Exam con strumenti passa da 63.8% a 65.0%, solo 1.2 punti, e CursorBench aumenta di 2.9 punti. Il confronto quindi non supporta un’affermazione generalizzata secondo cui tutte le capacità sono migliorate in egual misura. Fable 5.1 va compreso come un upgrade focalizzato sull’esecuzione i cui guadagni più forti emergono quando il ragionamento deve essere sostenuto attraverso strumenti e lunghe catene di attività.
Risultato del confronto: gli utenti esistenti di Fable 5 che eseguono agenti lunghi e ricchi di strumenti hanno il motivo più chiaro per aggiornare: letture della cache sostanzialmente più economiche e meno fallimenti nei benchmark orientati all’esecuzione. I team che usano prompt brevi o attività di conoscenza generali dovrebbero validare i guadagni più piccoli rispetto a latenza e costo totale prima di migrare.
Prestazioni benchmark di Claude Fable 5.1
La tabella benchmark ufficiale di Anthropic confronta il nuovo modello con il suo predecessore, Claude Opus 5, e GPT-5.6 Sol. Le righe selezionate di seguito coprono ricerca, coding, lavoro di conoscenza, uso del computer e automazione.
| Benchmark ufficiale | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Il grafico sopra è l’immagine ufficiale dei benchmark Anthropic copiata dal documento sorgente, non un grafico ridisegnato localmente. Anthropic segnala un errore standard di ±3.5–4.5 punti per Terminal-Bench-Science e afferma che le salvaguardie di produzione erano abilitate durante la valutazione. Piccole differenze dovrebbero quindi essere trattate con cautela.

Fonte: Grafico ufficiale di benchmark di Anthropic Fable 5.1
Come leggere i risultati del benchmark
Questi punteggi non dovrebbero essere interpretati come misure universali della qualità del modello. Anthropic ha valutato Claude Fable 5.1 con le salvaguardie di produzione abilitate e alcuni task del benchmark potrebbero essere influenzati da interventi delle salvaguardie. Terminal-Bench-Science riporta anche un errore standard di circa ±3.5–4.5 punti percentuali per modello.
I risultati OSWorld 2.0 utilizzano la release di compiti degli autori del benchmark di agosto 2026, quindi non dovrebbero essere confrontati direttamente con punteggi provenienti da release di compiti precedenti.
Prezzi di Claude Fable 5.1
Prezzi di input e output
Anthropic lista Claude Fable 5.1 a $10 per MTok di input e $50 per MTok di output. Claude Fable 5.1 API in CometAPI è a $8 per MTok di input e $40 per MTok di output, una riduzione del 20% rispetto ai tassi ufficiali di listino. Questi sono tassi basati sull’uso; verificare la pagina del modello live prima della produzione perché prezzi di piattaforma e regole di fatturazione possono cambiare.
Prezzi della cache del prompt
Anthropic prezza una scrittura in cache di 5 minuti a $12.50 per MTok, una scrittura in cache di 1 ora a $20 per MTok e una lettura della cache a $0.25 per MTok. Il tasso di lettura è inferiore del 75% rispetto a $1 per MTok di Fable 5, quindi agenti di lunga durata che riutilizzano repository, policy, definizioni di strumenti o stato precedente ne traggono più beneficio rispetto a prompt brevi una tantum.
Esempio di costo del flusso di lavoro di un agente
Un agente che legge 150K token in cache a ogni uno dei 1,000 step consuma 150 MTok di letture della cache. Al tasso di $0.25 di Fable 5.1, quel componente costa $37.50; al tasso di $1 di Fable 5, costerebbe $150—un risparmio di $112.50. Input fresco, output, scritture in cache e addebiti di piattaforma restano aggiuntivi, quindi i team dovrebbero confrontare il costo totale per workflow riuscito piuttosto che il solo costo della cache.
Perché il prezzo della cache cambia l’economia degli agenti
Una richiesta convenzionale può spendere la maggior parte della bolletta su input freschi e output. Un agente è diverso: ogni step di strumento può rileggere un grande prefisso in cache contenente policy, codice, documenti, definizioni di strumenti e stato precedente. La riduzione del 75% delle letture della cache di Anthropic beneficia in modo sproporzionato i loop lunghi.
Per esempio, un agente che rileggere 150K token in cache su 1,000 step consuma 150 milioni di token di lettura della cache. A $1 per MTok, quel componente costa $150; a $0.25 per MTok, costa $37.50. Questo esempio esclude input freschi, output, scritture in cache e addebiti di piattaforma, ma mostra perché prezzi base invariati possono produrre un costo inferiore per attività completata.
Anthropic stima circa il 25% di costo in meno per carichi di lavoro tipici a fatturazione a token e fino a circa il 45% per carichi altamente agentici. Si tratta di stime basate sul mix di workload, non di uno sconto universale su ogni token.
Claude Fable 5.1 vs Opus 5 vs Sonnet 5
Il modello di frontiera è il livello massimo di capacità, ma Anthropic consiglia il livello Opus come punto di partenza per la maggior parte dei carichi di lavoro. Il livello Sonnet rimane la scelta più veloce e a costo inferiore quando throughput e latenza contano più dell’affidabilità massima a lungo termine. Per un’analisi più approfondita a due modelli, vedere il confronto Fable vs Sonnet di CometAPI.
| Dimensione | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| Finestra di contesto | 1M | 1M | 1M |
| Output massimo | 128K | 128K | 128K |
| Prezzo di listino input/output | $10 / $50 | $5 / $25 | $2 / $10 |
| Latenza comparativa | Più lenta | Moderata | Veloce |
| Miglior adattamento | Agenti e ragionamento più difficili a lungo termine | Punto di partenza premium predefinito | Lavoro ad alto volume che privilegia velocità e costo |
Risultato della selezione: partire dal livello a costo inferiore che soddisfa l’attività. Escalare solo quando le valutazioni in produzione mostrano che il modello di frontiera aumenta il tasso di risultati accettati, riduce i retry o abbassa il costo totale per workflow riuscito.
Modifiche di migrazione che gli sviluppatori devono testare
Il nuovo modello è per lo più un successore drop-in, ma Anthropic documenta tre breaking change che influiscono sui framework di agenti e sulle conversazioni lunghe.
| Modifica di migrazione | Cosa succede | Azione richiesta agli sviluppatori |
|---|---|---|
| Scelta forzata dello strumento | tool_choice = any o uno strumento nominato restituisce HTTP 400 | Usare auto, istruire il modello e applicare schemi rigorosi quando necessario |
| Blocchi di pensiero tra switch di modello | I modelli più vecchi non possono leggere i nuovi blocchi di pensiero | Testare i router e aspettarsi che i blocchi di ragionamento vengano rimossi quando si effettua un routing all’indietro |
| Modifica dei turn precedenti | La storia modificata può invalidare i blocchi di pensiero | Mantenere le storie solo in append o usare pattern di compattazione supportati |
Testare anche l’effort per messaggio, i messaggi di sistema con scope per turn, gli aggiornamenti di avanzamento tra chiamate di strumenti, il comportamento della cache e la provenienza dei contenuti prima di spostare traffico in produzione. L’esistente tutorial API Fable rimane il posto migliore per setup generico degli SDK ed esempi di richieste.
Chi dovrebbe usare Claude Fable 5.1?
Claude Fable 5.1 è ideale per carichi di lavoro in cui ragionamento sostenuto e completamento con successo contano più della latenza minima o del prezzo a token. Sceglierlo quando l’attività copre molti step, usa strumenti ripetutamente o ha un valore di business sufficiente per cui evitare esecuzioni fallite e rifacimenti può compensare i costi premium del modello.
- Ingegneria alla scala del repository: debugging, migrazioni, refactoring multi-file, esecuzione di test e agenti di coding non presidiati.
- Ricerca multi-step: ricerca, valutazione delle evidenze, esecuzione di analisi e produzione di un report finale fondato.
- Lavoro su grandi documenti e professionale: contratti, documentazione tecnica, materiale finanziario, fogli di calcolo e flussi di presentazione.
- Uso del computer e automazione: attività che richiedono chiamate ripetute agli strumenti, navigazione di interfacce, verifica e recupero da errori intermedi.
Per classificazioni di routine, estrazione ad alto volume o chat sensibili alla latenza, iniziare con Claude Opus 5 o Claude Sonnet 5
Disponibilità tramite CometAPI
Al 4 settembre 2026, la pagina del modello CometAPI elenca Claude Fable 5.1 come live e operativo. L’ID del modello è claude-fable-5-1.
- Creare o accedere a un account CometAPI e generare una chiave API nel dashboard.
- Selezionare Claude Fable 5.1 e passare
claude-fable-5-1come ID modello. - Inviare richieste tramite l’endpoint compatibile con Anthropic
/v1/messageso l’endpoint compatibile con OpenAI/v1/chat/completions. - Eseguire una valutazione in stile produzione per confermare latenza, gestione del contesto, comportamento degli strumenti e fatturazione prima di migrare il traffico.
Gli sviluppatori possono anche accedere al modello direttamente tramite Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform su AWS.
Conclusione
Claude Fable 5.1 va compreso come un upgrade dell’esecuzione. L’evidenza più convincente non è la finestra di contesto invariata da 1M o il prezzo premium base $10/$50; è il grande miglioramento nella ricerca agentica, nel coding da terminale e nell’automazione, combinato con letture della cache sostanzialmente più economiche.
Usarlo quando un’attività è difficile, di lunga durata e abbastanza preziosa da giustificare prezzi premium grazie a un minor numero di esecuzioni fallite. Per lavoro di routine, ad alto volume o sensibile alla latenza, iniziare con un livello a costo inferiore ed escalare solo quando la vostra valutazione mostra un miglioramento misurabile dei risultati completati.
Domande frequenti
Claude Fable 5.1 è disponibile tramite API?
Sì. Anthropic elenca Claude Fable 5.1 come attivo dal 1° settembre 2026. È disponibile tramite Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform su AWS.
Quanto costa l’API di Claude Fable 5.1?
Il prezzo ufficiale di Anthropic è $10 per MTok di input e $50 per MTok di output. CometAPI attualmente elenca $8 in input e $40 in output per MTok. Verificare il prezzo del percorso live prima della distribuzione.
Quanto è grande la finestra di contesto di Claude Fable 5.1?
Il modello supporta una finestra di contesto da 1M token e fino a 128K token di output. La grande capacità non elimina la necessità di testare qualità del retrieval, latenza e costo con documenti di produzione.
Cosa è cambiato da Claude Fable 5 a 5.1?
I cambiamenti pratici più grandi sono una ricerca agentica e un’esecuzione da terminale più forti, una riduzione del prezzo di lettura della cache da $1 a $0.25 per MTok, controlli dell’effort per messaggio, aggiornamenti di avanzamento e provenienza dei contenuti. La migrazione richiede anche il test della scelta forzata dello strumento, dei blocchi di pensiero tra switch di modello e delle storie di conversazione modificate.
Claude Fable 5.1 è migliore di Claude Opus 5?
Non per ogni carico di lavoro. Fable 5.1 è l’opzione a capacità maggiore per lavoro impegnativo a lungo termine, ma è più lento e più costoso. Anthropic raccomanda di iniziare la maggior parte dei carichi di lavoro con Claude Opus 5 e salire quando valutazioni a effort più alto risultano ancora insufficienti.
Posso usare Claude Fable 5.1 tramite CometAPI?
Sì. CometAPI attualmente elenca Claude Fable 5.1 come live sotto l’ID modello claude-fable-5-1, con endpoint compatibili con Anthropic e OpenAI.
Claude Fable 5.1 supporta l’uso forzato degli strumenti?
No. Anthropic documenta che impostare tool_choice su any o su uno strumento nominato restituisce HTTP 400. Usare auto o none, quindi guidare la selezione degli strumenti con istruzioni e schemi di input rigorosi quando necessario.
