Technische Spezifikationen von GPT-5.4-2026-03-05
| Element | GPT-5.4-2026-03-05 |
|---|---|
| Modellfamilie | GPT-5 |
| Anbieter | OpenAI |
| Veröffentlichungsdatum | 5. März 2026 |
| Kontextfenster | 1.050.000 Token |
| Maximale Ausgabetoken | 128.000 |
| Eingabetypen | Text, Bild |
| Ausgabetypen | Text |
| Audio | Nicht unterstützt |
| Reasoning-Steuerung | keine, niedrig, mittel, hoch, sehr hoch |
| Tool-Unterstützung | Websuche, Dateisuche, Code-Interpreter, Bildgenerierung |
| Wissensstand | 31. August 2025 |
| Schnappschuss-Stabilität | Fixiertes Modellverhalten |
Was ist GPT-5.4?
GPT-5.4 ist ein vereinheitlichter Spitzen-Release, der Verbesserungen aus jüngsten Reasoning- und Coding-Linien (einschließlich der Arbeiten zu GPT-5.3-Codex) in einem einzigen Modell für professionelle Wissensarbeit zusammenführt. Es ist als „Thinking“-Modell für tieferes, steuerbares Reasoning und als „Pro“-Variante für Kunden mit höchsten Anforderungen an Leistung/Durchsatz positioniert. Zentrale Themen des Releases sind: (1) längerer Kontext und Verständnis auf Dokumentebene, (2) verbesserte Tool- und „Computerbenutzungs“-Fähigkeiten (Steuerung von Apps, Bearbeitung von Tabellen/Präsentationen) und (3) weniger Faktfehler und stärkeres mehrstufiges Planen.
Hauptfunktionen von GPT-5.4
- Enorme Langkontext-Fähigkeit (experimentell 1 Mio.+ Token): GPT-5.4 unterstützt experimentelle Sitzungen mit 1,05 Mio. Token (mit Preisgestaltung/Limitierungen) und ermöglicht Schlussfolgerungen über ganze Bücher/Gesamtsysteme von Code sowie multidokumentare Synthesen. Für die allgemeine Verfügbarkeit bleibt das Standardfenster bei ≈272K Token.
- Verbesserte mehrstufige Tool-Nutzung & native „Computerbenutzung“: bessere Desktop-/Browser-Steuerung für agentische Workflows (Tastatur/Maus über eine Computer-Use-Schnittstelle), Websuche, die über mehrere Runden hinweg bestehen bleibt, sowie ein neuer Mechanismus Tool Search, um Connectoren/Tools effizient zu finden. OpenAI berichtet über State-of-the-Art-Erfolge auf mehreren Benchmarks zu Computerbenutzung und Web-Agenten.
- Tabellen‑, Dokument‑ und Präsentationserstellung/-bearbeitung: gezieltes Tuning für Office-Workflows; interne Benchmarks zeigen große Fortschritte bei Tabellenmodellen und der Qualität von Präsentationen. Parallel zum Release hat OpenAI ein ChatGPT-für-Excel-Add-in veröffentlicht.
- Steuerbarkeit & Reasoning-Modi: Der „Thinking“-Modus erzeugt für lange Aufgaben einen expliziten Plan/Vorspann und unterstützt Steuerung während der Antwort (Anweisungen während der Generierung anpassen). Stufen für den Reasoning-Aufwand erlauben es, Latenz gegen tieferes schrittweises Denken zu tauschen.
- Verbessertes multimodales Verständnis: bessere Interpretation hochauflösender Bilder und Diagramme (Bildeingabe), genutzt für Dokumentverständnis und Präsentationen.
- Sicherheitsausrichtung: OpenAI behandelt GPT-5.4 als ein Modell mit hohen Cyber-Fähigkeiten und setzt erweiterte Schutzmaßnahmen ähnlich den GPT-5.3-Codex-Mitigationen ein.
Benchmark-Leistung
| GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | |
|---|---|---|---|
| GDPval (Siege oder Gleichstand) | 83,0% | 70,9% | 70,9% |
| SWE-Bench Pro (Öffentlich) | 57,7% | 56,8% | 55,6% |
| OSWorld-Verified | 75,0% | 74,0%* | 47,3% |
| Toolathlon | 54,6% | 51,9% | 46,3% |
| BrowseComp | 82,7% | 77,3% | 65,8% |
GPT-5.4 vs. vergleichbare Modelle
| Modell | Kontextfenster | Zentrale Stärke |
|---|---|---|
| GPT-5.4-2026-03-05 | 1.050.000 Token | Spitzen-Reasoning + Agent-Workflows |
| GPT-5.3 Instant | Kleiner | Schnell für Alltagsaufgaben |
| Claude Opus / Sonnet | ~200k Token | Langformiges Denken |
| Gemini 3 Pro | ~1M Token | Multimodales Schlussfolgern |
Wesentlicher Unterschied: GPT-5.4 fokussiert stark auf professionelle Produktivitäts-Workflows und Agent-Fähigkeiten, insbesondere in Verbindung mit externen Tools.
Repräsentative Anwendungsfälle in der Produktion
- Unternehmensdokument- & Compliance-Workflows: Verarbeitung langer Verträge, Extraktion von Verpflichtungen und Verfassen von Kommentaren über multidokumentare Korpora hinweg (profitiert von den Kontextoptionen 272K→1M für Einzelsitzungs-Synthese).
- Tabellenautomation & Finanzmodellierung: Generieren von Formeln, Aufbau mehrblättriger Modelle aus Spezifikationen in Alltagssprache, Abgleich von Eingaben — OpenAI berichtet über große Fortschritte bei Aufgaben im Stil von Junior-Investmentbanking.
- Agentische Automatisierung & „Computerbenutzung“: automatisierte Browser-/Desktop-Workflows (Installation, QA, Tool-Orchestrierung) und mehrstufige Tool-Ketten (Zapier-Integrationen werden als Anwendungspartner genannt).
- Softwareentwicklung & Code-Wartung: Codegenerierung, Refactorings und Agentenaufgaben im Terminal/CLI (Verbesserungen in Terminal-Benchmarks). Für große Codebasen hilft das lange Kontextfenster, muss jedoch anhand von Aufgabenheuristiken validiert werden.
- Unterstützung von Wissensarbeitern: Forschungssynthese (Verbesserungen bei BrowseComp), Folienerstellung und visuelles Design für Präsentationen.
Zugriff auf die GPT-5.4-API
Schritt 1: Für API-Schlüssel registrieren
Melden Sie sich bei cometapi.com an. Wenn Sie noch kein Nutzer sind, registrieren Sie sich bitte zuerst. Melden Sie sich in Ihrer CometAPI-Konsole an. Holen Sie sich den Zugriffsberechtigungs-API-Schlüssel der Schnittstelle. Klicken Sie im persönlichen Zentrum beim API-Token auf „Add Token“, erhalten Sie den Token-Schlüssel: sk-xxxxx und senden Sie ihn ab.

Schritt 2: Anfragen an die GPT-5.4-API senden
Wählen Sie den „gpt-5.4“-Endpoint, um die API-Anfrage zu senden, und setzen Sie den Request Body. Anfragemethode und Request Body sind in der API-Dokumentation auf unserer Website zu finden. Unsere Website bietet zu Ihrer Bequemlichkeit außerdem Apifox-Tests. Ersetzen Sie <YOUR_API_KEY> durch Ihren tatsächlichen CometAPI-Schlüssel aus Ihrem Konto. Die Basis-URL ist Chat Completions und Responses.
Fügen Sie Ihre Frage bzw. Anfrage in das content-Feld ein — darauf antwortet das Modell. Verarbeiten Sie die API-Antwort, um die generierte Antwort zu erhalten.
Schritt 3: Ergebnisse abrufen und verifizieren
Verarbeiten Sie die API-Antwort, um die generierte Antwort zu erhalten. Nach der Verarbeitung antwortet die API mit dem Aufgabenstatus und den Ausgabedaten.