Specifiche tecniche di GPT-5.4-2026-03-05
| Voce | GPT-5.4-2026-03-05 |
|---|---|
| Famiglia di modelli | GPT-5 |
| Fornitore | OpenAI |
| Data di rilascio | March 5, 2026 |
| Finestra di contesto | 1,050,000 tokens |
| Token massimi in output | 128,000 |
| Tipi di input | Text, Image |
| Tipi di output | Text |
| Audio | Not supported |
| Controlli di ragionamento | none, low, medium, high, xhigh |
| Supporto degli strumenti | Web search, File search, Code interpreter, Image generation |
| Limite di conoscenza | Aug 31, 2025 |
| Stabilità dello snapshot | Locked model behavior |
Che cos’è GPT-5.4?
GPT-5.4 è una release di frontiera unificante che integra i miglioramenti delle recenti linee di ragionamento e di coding (incluso il lavoro di GPT-5.3-Codex) in un unico modello mirato al lavoro professionale della conoscenza. È posizionato come modello “Thinking” per un ragionamento più profondo e guidabile e come variante “Pro” per i clienti con i massimi requisiti di prestazioni/throughput. I temi chiave della release sono: (1) contesto più lungo e comprensione su scala documentale, (2) capacità migliorate di uso degli strumenti e di “uso del computer” (controllo di app, modifica di fogli di calcolo/presentazioni), e (3) minori errori fattuali e pianificazione a più fasi più robusta.
Caratteristiche principali di GPT-5.4
- Capacità di contesto molto esteso (sperimentale 1M+ token): GPT-5.4 supporta sessioni sperimentali da 1.05M token (con prezzi/limiti), abilitando ragionamento su interi libri/intere codebase e sintesi multi-documento. Per la disponibilità generale la finestra standard resta ≈272K token.
- Uso degli strumenti multi-step migliorato e “uso del computer” nativo: migliore controllo di desktop/browser per flussi agentici (tastiera/mouse tramite un’interfaccia di uso del computer), ricerca web che persiste tra i turni e un nuovo meccanismo di Tool Search per trovare connettori/strumenti in modo efficiente. OpenAI riporta risultati allo stato dell’arte su molte benchmark di uso del computer e agenti web.
- Generazione/modifica di fogli di calcolo, documenti e presentazioni: ottimizzazioni specifiche per i flussi di lavoro d’ufficio; benchmark interni mostrano grandi miglioramenti nella modellazione dei fogli di calcolo e nella qualità delle presentazioni. OpenAI ha inoltre lanciato un componente aggiuntivo ChatGPT per Excel insieme alla release.
- Steerabilità e modalità di ragionamento: la modalità “Thinking” produce un piano/preambolo esplicito per compiti lunghi e supporta la guida a metà risposta (regolando le istruzioni durante la generazione). I livelli di sforzo di ragionamento consentono agli utenti di scambiare latenza con un ragionamento a catena più profondo.
- Comprensione multimodale potenziata: migliore interpretazione di immagini e grafici ad alta risoluzione (input immagine), utile per la comprensione dei documenti e le presentazioni.
- Impostazione di sicurezza: OpenAI considera GPT-5.4 un modello con elevate capacità informatiche e applica protezioni avanzate simili alle mitigazioni di GPT-5.3-Codex.
Prestazioni nei benchmark
| GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | |
|---|---|---|---|
| GDPval (vittorie o pareggi) | 83.0% | 70.9% | 70.9% |
| SWE-Bench Pro (Public) | 57.7% | 56.8% | 55.6% |
| OSWorld-Verified | 75.0% | 74.0%* | 47.3% |
| Toolathlon | 54.6% | 51.9% | 46.3% |
| BrowseComp | 82.7% | 77.3% | 65.8% |
GPT-5.4 vs Modelli comparabili
| Modello | Finestra di contesto | Punto di forza principale |
|---|---|---|
| GPT-5.4-2026-03-05 | 1,050,000 tokens | Ragionamento di frontiera + flussi di lavoro agentici |
| GPT-5.3 Instant | Smaller | Faster everyday tasks |
| Claude Opus / Sonnet | ~200k tokens | Long-form reasoning |
| Gemini 3 Pro | ~1M tokens | Multimodal reasoning |
Differenza chiave: GPT-5.4 si concentra fortemente sui flussi di lavoro di produttività professionale e sulle capacità degli agenti, in particolare quando è integrato con strumenti esterni.
Casi d’uso rappresentativi in produzione
- Flussi di lavoro documentali e di compliance aziendale: elaborazione di contratti lunghi, estrazione di obblighi e stesura di commenti su corpora multi-documento (beneficia delle opzioni di contesto da 272K→1M per la sintesi in sessione singola).
- Automazione dei fogli di calcolo e modellazione finanziaria: generazione di formule, creazione di modelli multi-foglio da specifiche in linguaggio semplice, riconciliazione degli input — OpenAI riporta grandi progressi su attività in stile junior investment-banking.
- Automazione agentica e “uso del computer”: flussi automatizzati su browser/desktop (installazione, QA, orchestrazione di strumenti) e catene di strumenti multi-step (integrazioni Zapier citate come partner d’uso).
- Ingegneria del software e manutenzione del codice: generazione di codice, refactoring e attività degli agenti su terminale/CLI (riportati miglioramenti su Terminal-Bench). Per codebase di grandi dimensioni, la finestra di contesto ampia aiuta ma va validata rispetto alle euristiche del compito.
- Potenziamento dei knowledge worker: sintesi di ricerca (miglioramenti su BrowseComp), generazione di slide e design visivo per presentazioni.
Come accedere all’API di GPT-5.4
Passo 1: Registrati per la chiave API
Accedi a cometapi.com. Se non sei ancora nostro utente, registrati prima. Accedi alla tua CometAPI console. Ottieni la chiave API di accesso all’interfaccia. Fai clic su “Aggiungi token” nella sezione dei token API del centro personale, ottieni la chiave del token: sk-xxxxx e invia.

Passo 2: Invia richieste all’API GPT-5.4
Seleziona l’endpoint “gpt-5.4” per inviare la richiesta API e imposta il corpo della richiesta. Il metodo e il corpo della richiesta sono ottenuti dalla documentazione API del nostro sito web. Il nostro sito fornisce anche test Apifox per tua comodità. Sostituisci <YOUR_API_KEY> con la tua effettiva chiave CometAPI del tuo account. L’URL di base è Chat Completions e Responses.
Inserisci la tua domanda o richiesta nel campo content — è ciò a cui il modello risponderà. Elabora la risposta dell’API per ottenere l’output generato.
Passo 3: Recupera e verifica i risultati
Elabora la risposta dell’API per ottenere l’output generato. Dopo l’elaborazione, l’API risponde con lo stato dell’attività e i dati di output.