TL;DR
Zaktualizowane ceny: Standardowe stawki GPT-5.6 dla krótkiego kontekstu to teraz $5 za wejście / $30 za wyjście dla Sol, $2 / $12 dla Terra oraz $0.20 / $1.20 dla Luna za 1 milion tokenów.
30 lipca 2026 r. OpenAI obniżyło ceny GPT-5.6 Terra o 20% i ceny Luna o 80%. Ceny Sol pozostają bez zmian.
Zwracaj uwagę na ukryte czynniki kosztów: ogólny alias gpt-5.6 kieruje do Sol, żądania powyżej 272K tokenów wejściowych podlegają wyższym stawkom dla długiego kontekstu, a tokeny wyjściowe nadal kosztują 6× więcej niż wejściowe we wszystkich trzech poziomach.
Dla obciążeń Sol wrażliwych na opóźnienia nowy Fast mode od OpenAI oferuje do 2.5× szybsze przetwarzanie przy 2× cenie Standard.
OpenAI API Pricing at a Glance
Dla użytkowników szukających szeroko informacji o cenach OpenAI API pierwsze pytanie zwykle brzmi: za który obecny model faktycznie płacę? Poniższa tabela daje zwięzły obraz kilku aktualnych modeli tekstowych OpenAI, zanim dokładniej przyjrzymy się GPT-5.6.
(> Aktualizacja cen — 30 lipca 2026: OpenAI obniżyło ceny API GPT-5.6 Terra o 20% i Luna o 80%. Terra kosztuje teraz $2 za 1M tokenów wejściowych i $12 za 1M tokenów wyjściowych, podczas gdy Luna kosztuje $0.20 za wejście i $1.20 za wyjście. Ceny Sol pozostają bez zmian.)
| Model | Input / 1M tokens | Cached input | Output / 1M tokens |
|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $30.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $1.20 |
| gpt-5.5 | $5.00 | $0.50 | $30.00 |
| gpt-5.4 | $2.50 | $0.25 | $15.00 |
| gpt-5.4-mini | $0.75 | $0.075 | $4.50 |
| gpt-5.4-nano | $0.20 | $0.02 | $1.25 |
W nowej cenie Luna dorównuje stawce wejściowej $0.20 modelu GPT-5.4 nano, oferując jednocześnie nieco niższą stawkę wyjściową $1.20 w porównaniu z $1.25.
Źródło*:* OpenAI API pricing
Najważniejszy wzorzec łatwo przeoczyć: tokeny wyjściowe GPT-5.6 kosztują 6× tyle co tokeny wejściowe w Sol, Terra i Luna. Długie odpowiedzi, gadatliwe agenty i przepływy silnie obciążające rozumowanie mogą zatem szybciej podnosić koszty niż niewielkie zmiany długości promptu.
Szerszy przegląd rodziny GPT-5.6 — w tym możliwości modeli, pozycjonowanie, benchmarki, dostęp do API i kluczowe funkcje premiery — znajdziesz w OpenAI's GPT-5.6 announcement or CometAPI's GPT-5.6 guide. Ten artykuł koncentruje się konkretnie na cenach, kalkulacjach kosztów i czynnikach, które mogą wpłynąć na Twój rzeczywisty rachunek za API.
Ceny GPT-5.6: Sol vs Terra vs Luna
GPT-5.6 wprowadza trzy poziomy cenowe. OpenAI pozycjonuje Sol jako flagową trasę, Terra jako zrównoważoną opcję, a Luna jako tańszy poziom dla obciążeń o dużej skali.
Aby głębiej poznać możliwości, sposób dostępu do API GPT-5.6 i przypadki użycia każdego modelu, szczegóły zobacz tutaj o model GPT-5.6.
Standardowe ceny GPT-5.6 dla żądań z ≤272K tokenów wejściowych
| Model | Krótkie wejście | Buforowane wejście | Zapis do pamięci podręcznej | Krótkie wyjście | Długie wejście | Buforowane wejście (długi kontekst) | Zapis do pamięci podręcznej (długi kontekst) | Długie wyjście |
|---|---|---|---|---|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 | $10.00 | $1.00 | $12.50 | $45.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 | $4.00 | $0.40 | $5.00 | $18.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 | $0.40 | $0.04 | $0.50 | $1.80 |
Źródło*:* OpenAI API pricing
Cennik dla długiego kontekstu: Żądania z więcej niż 272K tokenów wejściowych korzystają z wyższych stawek. Wejście, buforowane wejście i zapisy do pamięci podręcznej są rozliczane według 2× standardowej stawki, natomiast wyjście według 1.5×. Wyższe stawki dotyczą całego żądania.
Rozsądnym punktem wyjścia jest testowanie Luna dla prostszych, wysokowolumenowych zadań, Terra dla zrównoważonych obciążeń aplikacyjnych i Sol dla najtrudniejszych lub najbardziej krytycznych zadań. To nie są uniwersalne rekomendacje: dokładność, ponowienia, zachowanie narzędzi i kontrola jakości przez ludzi mogą przeważyć nad różnicą w cenie katalogowej.
Jedna ważna uwaga dotycząca aliasu
Wskazówki OpenAI dotyczące modeli (https://developers.openai.com/api/docs/guides/latest-model) stwierdzają, że ogólny alias gpt-5.6 kieruje do gpt-5.6-sol.
Oznacza to, że żądanie wysłane do gpt-5.6 korzysta z poziomu cenowego Sol. Jeśli Twoje obciążenie działa dobrze na Terra lub Luna, używaj jawnych identyfikatorów modeli zamiast zakładać, że ogólny alias wybierze najtańszy odpowiedni poziom.
Przykład 1: Typowe żądanie API
Zacznijmy od typowej struktury żądania:
- 1,000 tokenów wejściowych
- 500 tokenów wyjściowych
| Model | Miesięczny koszt wejścia | Miesięczny koszt wyjścia | Suma |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $4,000 | $6,000 | $10,000 |
| gpt-5.6-luna | $400 | $600 | $1,000 |
Przy tym obciążeniu nowe ceny Luna obniżają szacunkowy miesięczny rachunek za tokeny z $5,000 do $1,000, podczas gdy Terra spada z $12,500 do $10,000.
Obliczenie dla Sol:
(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020
Ten przykład pokazuje też, dlaczego długość wyjścia ma znaczenie. Mimo że żądanie zawiera dwukrotnie więcej tokenów wejściowych niż wyjściowych, część wyjściowa stanowi 75% kosztu tokenów Sol, ponieważ wyjście jest wycenione sześciokrotnie wyżej niż wejście.
W przypadku czatu, agentów i generowania kodu ograniczenie zbędnej rozwlekłości może czasem przynieść większe oszczędności niż przycinanie krótkiego promptu systemowego.
Przykład 2: Miesięczny koszt w skali
Załóżmy teraz, że aplikacja obsługuje 1 milion żądań miesięcznie, średnio:
- 2,000 tokenów wejściowych na żądanie
- 500 tokenów wyjściowych na żądanie
To daje 2 miliardy tokenów wejściowych i 500 milionów tokenów wyjściowych miesięcznie.
| Model | Miesięczny koszt wejścia | Miesięczny koszt wyjścia | Suma |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $5,000 | $7,500 | $12,500 |
| gpt-5.6-luna | $2,000 | $3,000 | $5,000 |
Różnica jest na tyle duża, że uzasadnia testy trasowania, ale najniższy wiersz nie jest automatycznie najlepszym wyborem produkcyjnym. Jeśli tańszy model powoduje więcej ponowień, nieudanych zadań lub ręcznych weryfikacji, całkowity koszt przepływu pracy może być wyższy.
Ceny dla długiego kontekstu: co się dzieje powyżej 272K tokenów?
Modele GPT-5.6 obsługują okno kontekstu 1.05M tokenów, ale OpenAI stosuje wyższe stawki, gdy żądanie zawiera więcej niż 272,000 tokenów wejściowych.
Dla tych żądań z długim kontekstem:
- wejście jest rozliczane według 2× stawki dla krótkiego kontekstu
- buforowane wejście i zapisy do pamięci podręcznej także według 2×
- wyjście jest rozliczane według 1.5×
- Wyższe stawki dotyczą całego żądania, a nie tylko tokenów powyżej 272K
Dla Sol zmienia to wejście z $5 na $10 za 1M tokenów i wyjście z $30 na $45. Ta sama struktura mnożników dotyczy Terra i Luna.
To tworzy próg kosztowy w pobliżu 272K. Dla obciążeń bliskich tego progu zredukuj zduplikowane fragmenty z wyszukiwania, nieaktualną historię rozmowy, zbędne pliki repozytorium lub rozwlekłe wyjście narzędzi przed wysłaniem żądania. Zobacz przewodnik optymalizacji kosztów OpenAI po dodatkowe wskazówki redukcji tokenów.
Ceny Standard, Batch, Flex i Priority
Dla kwalifikujących się obciążeń tekstowych GPT-5.6 OpenAI oferuje wiele poziomów przetwarzania.
| Poziom | Sol wejście/wyjście | Terra wejście/wyjście | Luna wejście/wyjście | Typowe zastosowanie |
|---|---|---|---|---|
| Standard | $5 / $30 | $2 / $12 | $0.20 / $1.20 | Normalny ruch synchroniczny |
| Batch | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Zadania asynchroniczne offline |
| Flex | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Obciążenia wrażliwe na koszty tolerujące wolniejsze tempo |
| Fast mode | $10 / $60 | $4 / $24 | $0.40 / $2.40 | Ruch o krótkim kontekście wrażliwy na opóźnienia |
Batch i Flex pozostają około 50% tańsze niż ceny Standard. Priority Processing przemianowano na Fast mode 30 lipca 2026 r., choć istniejące żądania używające service_tier: "priority" pozostają kompatybilne.
Dla GPT-5.6 Sol Fast mode zapewnia do 2.5× szybsze przetwarzanie niż Standard przy 2× cenie za token Standard, bez zmiany inteligencji modelu. Najbardziej odpowiedni jest wtedy, gdy opóźnienie odczuwane przez użytkownika ma na tyle duże znaczenie, by uzasadnić premię.
Buforowanie promptu: kiedy oszczędza koszty w GPT-5.6 ?
W GPT-5.6 zapisy do pamięci podręcznej kosztują 1.25× normalnej stawki wejściowej, podczas gdy odczyty z pamięci podręcznej otrzymują niższą cenę za buforowane wejście.
Rozważmy wielokrotnie używany prefiks 100,000 tokenów w Sol:
| Czynność | Koszt |
|---|---|
| Przetworzenie raz jako normalne, niebuforowane wejście | $0.50 |
| Zapis prefiksu do pamięci podręcznej | $0.63 |
| Późniejsze odczytanie z pamięci podręcznej | $0.05 |
Dwa użycia bez buforowania kosztują $1.00. Jeden zapis do cache plus jeden dopasowany odczyt z cache kosztują $0.675, oszczędzając $0.325 w tym uproszczonym przykładzie.
Granice tego przykładu: Ta kalkulacja porównuje wyłącznie koszt wejścia wielokrotnego prefiksu. Nie obejmuje tokenów wyjściowych, innego niebuforowanego wejścia, narzędzi ani ponowień. Rzeczywiste oszczędności zależą od tego, czy prefiks spełnia wymagania buforowania i jak często jest faktycznie ponownie używany.
Buforowanie jest więc najbardziej użyteczne dla długich, stabilnych prefiksów promptu, które otrzymują powtarzające się, dopasowane żądania. Zapis do pamięci podręcznej, który nigdy nie jest ponownie użyty, zwiększa koszt zamiast go obniżać.
Przewodnik po buforowaniu promptów OpenAI dokumentuje ceny zapisu do cache, odczyty z cache, jawne punkty podziału i zachowanie TTL.
Inne koszty, które mogą zmienić Twój rachunek za OpenAI API
Tokeny rozumowania i tryb Pro
Tokeny rozumowania są rozliczane jak tokeny wyjściowe, nawet jeśli nie są wyświetlane jako widoczny tekst odpowiedzi. Wyższe ustawienia rozumowania mogą więc zwiększyć łączną liczbę tokenów wyjściowych i opóźnienie.
Tam, gdzie jest to obsługiwane, reasoning.mode = "pro" lepiej traktować jako konfigurację do benchmarkowania, a nie domyślną regułę oszczędności kosztów czy jakości. OpenAI nie podaje osobnej stałej dopłaty Pro dla tego trybu; wpływ kosztowy wynika z wynikowego zużycia tokenów. Rozsądną bazą jest przetestowanie Standard i Pro na reprezentatywnych zadaniach oraz porównanie skuteczności zadań, łącznej liczby tokenów wyjściowych, opóźnień i liczby ponowień.
Wyszukiwanie w sieci i inne narzędzia
OpenAI obecnie podaje standardowe wyszukiwanie w sieci w cenie $10 za 1,000 wywołań, plus tokeny zawartości wyszukiwania rozliczane wg stawki wybranego modelu. Dwa wyszukiwania w sieci przy małym żądaniu Luna mogą zatem kosztować więcej niż tokeny modelu dla tego żądania.
OpenAI podaje też odrębną cenę web search preview dla modeli bez rozumowania w wysokości $25 za 1,000 wywołań, przy czym tokeny zawartości wyszukiwania są bezpłatne. Sprawdź dokładne połączenie narzędzia i modelu na oficjalnej stronie cen, zamiast stosować jedną stawkę za wyszukiwanie do każdego endpointu.
Przetwarzanie regionalne
Kwalifikujące się endpointy przetwarzania regionalnego lub rezydencji danych dla modeli wydanych 5 marca 2026 r. lub później mają dopłatę 10% zgodnie ze stroną cen OpenAI. Zespoły korporacyjne z wymaganiami rezydencji powinny uwzględnić ten czynnik w szacunkach budżetu.
Jak obliczyć koszt OpenAI API
Dla podstawowego żądania:
Koszt tokenów =
(tokeny wejściowe / 1M × stawka wejściowa)
- (tokeny wyjściowe / 1M × stawka wyjściowa)
Na potrzeby planowania produkcyjnego rozszerz to o:
Całkowity koszt przepływu pracy =
- niebuforowane wejście
- buforowane wejście
- zapisy do pamięci podręcznej
- tokeny wyjściowe i rozumowania
- opłaty za narzędzia
- korekty związane z poziomem usługi
- dopłata za region, jeśli dotyczy
- ponowienia i żądania awaryjne
Najbardziej użytecznym KPI jest często:
Koszt na udane zadanie = całkowity koszt przepływu pracy / udane zadania
Zapobiega to sztucznemu atrakcyjnemu wyglądaniu tańszej stawki za tokeny, gdy jednocześnie powoduje ona więcej błędów lub pracy przeglądowej.
Jak wybrać właściwy model bez przepłacania
Użyj tabeli cen jako punktu wyjścia, a następnie testuj na rzeczywistych zadaniach.
- Zacznij od najtańszego modelu, który wydaje się zdolny wykonać zadanie. Luna może być rozsądnym pierwszym testem dla prostych, wysokowolumenowych prac, ale nie zakładaj, że będzie najlepsza dla każdego wyodrębniania czy podsumowania.
- Mierz długość wyjścia. Tokeny wyjściowe GPT-5.6 kosztują 6× tokenów wejściowych, więc gadatliwe odpowiedzi zasługują na uwagę.
- Obserwuj próg 272K. Jego przekroczenie zmienia stawki dla całego żądania.
- Używaj Batch lub Flex dla kwalifikujących się, niepilnych prac. Przetestuj ograniczenia operacyjne przed przeniesieniem ruchu produkcyjnego.
- Buforuj tylko ponownie używalne prefiksy. Mierz rzeczywiste trafienia cache zamiast zakładać, że długi prompt należy buforować.
- Śledź narzędzia i ponowienia. Mogą zniweczyć oszczędności z tańszego modelu.
Dla zespołów porównujących trasy u różnych dostawców cennik CometAPI zapewnia aktualny, przekrojowy widok modeli. CometAPI Quickstart i Cookbook można użyć do uruchamiania tego samego zestawu testów w wielu trasach zgodnych z OpenAI.
FAQ
Ile kosztuje GPT-5.6 w 2026 roku?
Cena zależy od modelu. Standardowe stawki GPT-5.6 dla krótkiego kontekstu wahają się od $1 za wejście / $6 za wyjście za 1M tokenów dla Luna do $5 / $30 dla Sol. Dostępne są także tańsze modele, takie jak GPT-5.4 mini i nano. Sprawdź dokładny model na żywej stronie cen OpenAI.
Czy ceny ChatGPT API są takie same jak ceny GPT-5.6?
„Ceny ChatGPT API” bywa potocznie używane w odniesieniu do cen OpenAI API dla modeli obsługujących czat, ale subskrypcje ChatGPT i rozliczanie API to oddzielne produkty. Zużycie API jest wyceniane według konkretnego modelu i typu użycia.
Który model GPT-5.6 jest najtańszy?
gpt-5.6-luna jest najtańszym modelem GPT-5.6, w cenie $0.20 za 1M tokenów wejściowych i $1.20 za 1M tokenów wyjściowych. 30 lipca OpenAI obniżyło obie stawki o 80%, czyniąc Luna znacznie bardziej ekonomicznym wyborem dla agentów o dużym wolumenie, klasyfikacji, przetwarzania dokumentów i dobrze zdefiniowanych przepływów z narzędziami.
Jakiego modelu używa gpt-5.6?
Wskazówki OpenAI dotyczące modeli stwierdzają, że alias gpt-5.6 kieruje do gpt-5.6-sol. Używaj jawnych identyfikatorów Terra lub Luna, gdy chcesz te poziomy.
Kiedy obowiązuje cennik dla długiego kontekstu w GPT-5.6?
Gdy wejście przekracza 272,000 tokenów, GPT-5.6 stosuje wyższe stawki dla całego żądania: 2× stawki związane z wejściem i 1.5× stawki wyjściowe.
Czy Batch i Flex są tańsze niż Standard dla GPT-5.6?
Dla kwalifikujących się obciążeń GPT-5.6, wymienione stawki Batch i Flex są około 50% niższe niż Standard. Mają inne charakterystyki przetwarzania, więc potwierdź, że obciążenie może tolerować te ograniczenia.
Czy zapisy do pamięci podręcznej w GPT-5.6 kosztują więcej?
Tak. Zapisy do pamięci podręcznej w GPT-5.6 są wycenione na 1.25× normalnej stawki wejściowej, podczas gdy dopasowane odczyty z cache używają obniżonej ceny buforowanego wejścia. Oszczędności zależą od faktycznego ponownego użycia.
Porównaj koszty GPT-5.6 na własnym obciążeniu
Tabele cen to punkt wyjścia. Rzeczywisty koszt zależy od promptów, długości wyjścia, współczynnika trafień cache, narzędzi, ponowień i skuteczności zadań.
Z CometAPI możesz testować GPT-5.6 Sol, Terra, Luna i inne modele przez jedno API zgodne z OpenAI, używając tego samego obciążenia.
Następne kroki: porównaj aktualne ceny modeli, skorzystaj z CometAPI Quickstart, lub użyj CometAPI Cookbook, aby zbudować powtarzalne ewaluacje modeli.
Wybierz najtańszą trasę, która nadal spełnia Twoje wymagania jakościowe, dotyczące opóźnień i niezawodności.
