Claude Haiku 4.5 è un modello linguistico di classe più piccola, ottimizzato per uno scopo, di Anthropic, rilasciato a metà ottobre 2025. È posizionato come opzione veloce e a basso costo nella gamma Claude che mantiene una forte capacità in attività come programmazione, orchestrazione di agenti e flussi di lavoro interattivi di “uso del computer”, consentendo un throughput molto più elevato e un costo unitario inferiore per implementazioni enterprise.
Caratteristiche principali
- Velocità ed efficienza sui costi: Haiku 4.5 è descritto come più di due volte più veloce di Sonnet 4 e circa un terzo del costo di Sonnet 4 (e molto più economico di Opus), rendendolo interessante per utilizzi su larga scala.
- Pensiero esteso: Primo modello Haiku a supportare il pensiero esteso (pensiero riassunto/intercalato, budget di ragionamento configurabili) per un ragionamento multi-step più profondo bilanciando la latenza.
- Strumenti e uso del computer: Supporto completo per gli strumenti Claude (bash, esecuzione di codice, editor di testo, ricerca web e automazione dell’uso del computer). Progettato per flussi di lavoro basati su agenti e architetture di sotto-agenti.
- Ampia finestra di contesto: Finestra di contesto da 200k token (con opzioni da 1M di contesto disponibili sui modelli più grandi come beta per altre classi di modelli).
Dettagli tecnici
- Dati di addestramento e cutoff: Haiku 4.5 è stato addestrato su un mix proprietario di dati pubblici e con licenza con cutoff di addestramento intorno a febbraio 2025.
- Extended-thinking (una modalità di ragionamento ibrida) è supportato così che il modello possa scambiare latenza con un ragionamento più profondo quando richiesto.
- Finestra di contesto al rilascio è di 200.000 token, e il modello è esplicitamente context-aware (tiene traccia di quanto della finestra è stato utilizzato).
- Prestazioni / throughput: Le prime segnalazioni della community e i test di Anthropic indicano OTPS molto elevati (output token/sec) e velocità aneddotiche intorno a ~200+ token/sec in alcuni test interni/preliminari — molto più veloce di molti modelli comparabili di fascia media.
Prestazioni nei benchmark
SWE-Bench (coding): Haiku 4.5 ha ottenuto ~73.3% su SWE-Bench Verified — un risultato che Anthropic evidenzia come posizionare Haiku 4.5 tra i migliori modelli di programmazione al mondo per la sua classe.
Test Terminale / riga di comando / strumenti: Anthropic ha riportato ~41% su Terminal-Bench (incentrato sulla riga di comando) e risultati comparabili a Sonnet 4 e a diversi modelli di frontiera di fascia media concorrenti su molti benchmark di uso degli strumenti.
Rispetto delle istruzioni e testo delle slide: esempi interni di Anthropic affermano che Haiku 4.5 ha superato i modelli precedenti in alcune attività di rispetto delle istruzioni (ad es., generazione di testo per slide: 65% vs 44% per un precedente modello premium nel loro benchmark).
Automazione reale / attività di agenti: valutazioni di terze parti e primi adottanti riportano tassi di successo competitivi su attività automatizzate UI/agent (per esempio, benchmark in stile OSWorld o agent che riportano ≈50% di successo su automazioni complesse in alcuni test), mostrando utilità per flussi di lavoro su scala sebbene con modalità di errore non banali.
Limitazioni e note sulla sicurezza
- Non è un modello di frontiera: Anthropic classifica esplicitamente Haiku 4.5 come non avanzante la frontiera; è ottimizzato per l’efficienza piuttosto che spingere lo stato dell’arte assoluto. (Anthropic)
- Comportamento occasionale su temi sensibili: in alcuni prompt scientifici/relativi alla biosicurezza Haiku 4.5 talvolta restituisce informazioni di alto livello con avvertenze anziché rifiuti rigorosi; Anthropic lo segnala come area in miglioramento continuo.
- Il pensiero esteso può modificare il comportamento (a volte aumenta l’asimmetria nelle risposte).
Casi d’uso consigliati
- Programmazione agentica e orchestrazione multi-agente: sotto-agenti veloci, refactoring iterativo del codice, autotest e generazione di patch. (Adatto.)
- Flussi cliente in tempo reale e ad alto volume: assistenti chat, automazione interna dove il costo per richiesta conta. (Adatto.)
- Flussi con strumenti e controllo del computer: automazione di attività GUI/CLI, flussi documentali e catene di strumenti dove la bassa latenza aiuta. (Adatto.)
- Non consigliato (senza controlli): ruoli standalone che richiedono progettazione di sequenze scientifiche a livello di frontiera o attività di biosicurezza ad alta affidabilità. (Agire con cautela.)
Come accedere all’API di Claude Haiku 4.5
Passaggio 1: Registrati per ottenere la chiave API
Accedi a cometapi.com. Se non sei ancora nostro utente, registrati prima. Accedi alla tua CometAPI console. Ottieni la chiave API di credenziali di accesso dell’interfaccia. Fai clic su “Add Token” all’API token nel centro personale, ottieni la chiave del token: sk-xxxxx e invia.
Passaggio 2: Invia richieste all’API di Claude Haiku 4.5
Seleziona l’endpoint “claude-haiku-4-5-20251001” per inviare la richiesta API e imposta il corpo della richiesta. Il metodo e il corpo della richiesta sono ottenuti dalla documentazione API del nostro sito web. Il nostro sito fornisce anche test Apifox per tua comodità. Sostituisci <YOUR_API_KEY> con la tua chiave CometAPI effettiva dal tuo account. L’URL base è Anthropic Messages e Chat.
Inserisci la tua domanda o richiesta nel campo content — è a questo che il modello risponderà. Elabora la risposta dell’API per ottenere la risposta generata.
Passaggio 3: Recupera e verifica i risultati
Elabora la risposta dell’API per ottenere la risposta generata. Dopo l’elaborazione, l’API risponde con lo stato dell’attività e i dati di output.