Specyfikacja techniczna GPT-5.4-2026-03-05
| Pozycja | GPT-5.4-2026-03-05 |
|---|---|
| Rodzina modeli | GPT-5 |
| Dostawca | OpenAI |
| Data wydania | 5 marca 2026 |
| Okno kontekstu | 1,050,000 tokenów |
| Maks. liczba tokenów wyjściowych | 128,000 |
| Typy wejścia | Text, Image |
| Typy wyjścia | Text |
| Audio | Nieobsługiwane |
| Sterowanie rozumowaniem | none, low, medium, high, xhigh |
| Obsługa narzędzi | Web search, File search, Code interpreter, Image generation |
| Data odcięcia wiedzy | Aug 31, 2025 |
| Stabilność migawki | Locked model behavior |
Czym jest GPT-5.4?
GPT-5.4 to przełomowe, unifikujące wydanie, które łączy ulepszenia z niedawnych linii rozumowania i programowania (w tym prace GPT-5.3-Codex) w jeden model ukierunkowany na profesjonalną pracę z wiedzą. Jest pozycjonowany jako model „Thinking” do głębszego, sterowalnego rozumowania oraz wariant „Pro” dla klientów wymagających najwyższej wydajności/przepustowości. Kluczowe motywy wydania to: (1) dłuższy kontekst i rozumienie na skalę dokumentu, (2) ulepszone możliwości narzędzi i „computer use” (sterowanie aplikacjami, edycja arkuszy/prezentacji) oraz (3) mniej błędów faktograficznych i silniejsze planowanie wieloetapowe.
Główne funkcje GPT-5.4
- Ogromna zdolność długiego kontekstu (eksperymentalnie 1M+ tokenów): GPT-5.4 obsługuje eksperymentalne sesje 1.05M tokenów (z cennikiem/limitami), umożliwiające rozumowanie na poziomie całej książki/całej bazy kodu oraz syntezę wielodokumentową. W ogólnej dostępności standardowe okno pozostaje ≈272K tokenów.
- Ulepszone wieloetapowe użycie narzędzi i natywne „computer use”: lepsza kontrola pulpitu/przeglądarki dla agentowych przepływów pracy (klawiatura/mysz przez interfejs computer-use), wyszukiwanie w sieci utrzymujące się między rundami oraz nowy mechanizm Tool Search do efektywnego znajdowania konektorów/narzędzi. OpenAI raportuje najlepsze w klasie wyniki na wielu benchmarkach computer-use i web-agent.
- Generowanie/edycja arkuszy kalkulacyjnych, dokumentów i prezentacji: specjalne dostrojenie pod biurowe przepływy pracy; wewnętrzne benchmarki pokazują duże zyski w modelowaniu arkuszy i jakości prezentacji. OpenAI uruchomiło także dodatek ChatGPT for Excel wraz z tym wydaniem.
- Sterowalność i tryby rozumowania: tryb „Thinking” tworzy jawny plan/wstęp dla długich zadań i wspiera sterowanie w trakcie odpowiedzi (korygowanie instrukcji podczas generowania). Poziomy nakładu rozumowania pozwalają użytkownikom wymieniać opóźnienie na głębsze rozumowanie łańcuchowe.
- Ulepszone rozumienie multimodalne: lepsza interpretacja obrazów i wykresów w wysokiej rozdzielczości (wejście obrazowe), wykorzystywana do zrozumienia dokumentów i prezentacji.
- Podejście do bezpieczeństwa: OpenAI traktuje GPT-5.4 jako model o wysokich możliwościach cyber i wdraża wzmocnione zabezpieczenia podobne do mechanizmów GPT-5.3-Codex.
Wyniki benchmarków
| GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | |
|---|---|---|---|
| GDPval (wygrane lub remisy) | 83.0% | 70.9% | 70.9% |
| SWE-Bench Pro (Public) | 57.7% | 56.8% | 55.6% |
| OSWorld-Verified | 75.0% | 74.0%* | 47.3% |
| Toolathlon | 54.6% | 51.9% | 46.3% |
| BrowseComp | 82.7% | 77.3% | 65.8% |
GPT-5.4 vs modele porównywalne
| Model | Okno kontekstu | Kluczowa zaleta |
|---|---|---|
| GPT-5.4-2026-03-05 | 1,050,000 tokens | Przełomowe rozumowanie + przepływy pracy agentowe |
| GPT-5.3 Instant | Smaller | Faster everyday tasks |
| Claude Opus / Sonnet | ~200k tokens | Long-form reasoning |
| Gemini 3 Pro | ~1M tokens | Multimodal reasoning |
Kluczowa różnica: GPT-5.4 mocno koncentruje się na profesjonalnych przepływach pracy zwiększających produktywność oraz możliwościach agentów, szczególnie w integracji z narzędziami zewnętrznymi.
Reprezentatywne przypadki użycia w produkcji
- Przepływy dokumentów i zgodności (enterprise): przetwarzanie długich umów, wyodrębnianie zobowiązań i tworzenie komentarzy w korpusach wielodokumentowych (korzysta z opcji kontekstu 272K→1M dla syntezy w pojedynczej sesji).
- Automatyzacja arkuszy i modelowanie finansowe: generowanie formuł, budowa wieloarkuszowych modeli na podstawie specyfikacji w prostym angielskim, uzgadnianie danych wejściowych — OpenAI raportuje duże zyski przy zadaniach w stylu młodszych analityków bankowości inwestycyjnej.
- Automatyzacja agentowa i „computer use”: zautomatyzowane przepływy przeglądarkowe/pulpitowe (instalacja, QA, orkiestracja narzędzi) oraz wieloetapowe łańcuchy narzędzi (wskazywane integracje z Zapier jako partner użycia).
- Inżynieria oprogramowania i utrzymanie kodu: generowanie kodu, refaktoryzacje oraz zadania agentowe w terminalu/CLI (raportowane zyski na Terminal-Bench). W dużych bazach kodu długie okno kontekstu pomaga, lecz wymaga walidacji względem heurystyk zadania.
- Wspomaganie pracowników wiedzy: synteza badań (ulepszenia BrowseComp), generowanie slajdów i projektowanie wizualne prezentacji.
Jak uzyskać dostęp do interfejsu API GPT-5.4
Krok 1: Uzyskaj klucz API
Zaloguj się do cometapi.com. Jeśli nie jesteś jeszcze naszym użytkownikiem, zarejestruj się najpierw. Zaloguj się do CometAPI console. Uzyskaj poświadczenie dostępu — klucz API interfejsu. Kliknij „Add Token” przy tokenie API w centrum osobistym, uzyskaj klucz tokenu: sk-xxxxx i prześlij.

Krok 2: Wyślij żądania do interfejsu API GPT-5.4
Wybierz endpoint „gpt-5.4”, aby wysłać żądanie API i ustaw korpus żądania. Metoda żądania i korpus żądania są dostępne w dokumentacji API na naszej stronie. Nasza strona udostępnia także test w Apifox dla wygody. Zamień <YOUR_API_KEY> na rzeczywisty klucz CometAPI ze swojego konta. base url is Chat Completions and Responses.
Wstaw swoje pytanie lub prośbę do pola content — na to model odpowie. Przetwórz odpowiedź API, aby uzyskać wygenerowaną odpowiedź.
Krok 3: Pobierz i zweryfikuj wyniki
Przetwórz odpowiedź API, aby uzyskać wygenerowaną odpowiedź. Po przetworzeniu API zwraca status zadania i dane wyjściowe.