GPT-5.6 Luna price down 80%, Terra down 20% →

Fala modeli z lipca 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 itd.

CometAPI
AnnaAug 1, 2026
Fala modeli z lipca 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 itd.

TL;DR: W lipcu 2026 w ciągu około trzech tygodni ukazało się sześć ważnych modeli: trzy poziomy rodziny GPT-5.6 od OpenAI (Sol/Terra/Luna), Gemini 3.6 Flash od Google, Grok 4.5 od xAI, Kimi K3 od Moonshot AI, Claude Opus 5 od Anthropic oraz GLM-5.2 od Zhipu. Żaden nie jest uniwersalnie najlepszym wyborem. Praktyczna decyzja zależy od głębokości rozumowania, wydajności w kodowaniu, kosztu za token, wymagań dotyczących kontekstu oraz tego, czy ważna jest możliwość wdrożenia z otwartymi wagami. To porównanie opiera się na aktualnych informacjach oficjalnych dostawców i listach CometAPI; twierdzenia z benchmarków są opatrzone źródłem, a nie traktowane jako jednolity ranking.

Najważniejsze wnioski:

  • GPT-5.6 to nie jeden model — to trzy (Sol, Terra, Luna) w trzech różnych przedziałach cenowych, a wybór niewłaściwego poziomu to większy błąd kosztowy niż wybór niewłaściwej rodziny modeli.
  • Gemini 3.6 Flash i GLM-5.2 publikują okno kontekstu o wielkości 1,000,000 tokenów; Kimi K3 również oferuje ten sam poziom — rozmiar kontekstu przestał różnicować czołowe modele tej generacji.
  • GLM-5.2 i Kimi K3 obsługują wdrożenia z otwartymi wagami, ale nie korzystają z tej samej licencji. GLM-5.2 jest wydany na licencji MIT License; Kimi K3 korzysta z odrębnej Kimi K3 License, której warunki komercyjne należy przeanalizować przed samodzielnym hostowaniem lub oferowaniem dostępu w modelu usługi.
  • Claude Opus 5 został oficjalnie wydany. Anthropic ogłosił go 24 lipca 2026 r. z oknem kontekstu 1M tokenów, maksymalnie 128K synchronicznego wyjścia oraz oficjalnymi cenami $5 za milion tokenów wejściowych i $25 za milion tokenów wyjściowych; CometAPI obecnie podaje $4/$20.

Co faktycznie trafiło na rynek w tym miesiącu

Lipiec 2026 był wyjątkowo intensywnym miesiącem dla modeli granicznych i około‑granicznych. W mniej więcej trzy tygodnie OpenAI wypuściło rodzinę GPT-5.6 (9 lip), xAI wydało Grok 4.5 (8 lip), Moonshot AI wydało Kimi K3 (16 lip), Google wydało Gemini 3.6 Flash (21 lip), a Anthropic oficjalnie uruchomił Claude Opus 5 (24 lip). GLM-5.2 od Zhipu pojawił się nieco wcześniej, w czerwcu, ale jego kontekst 1M tokenów i otwarte wydanie na licencji MIT sprawiają, że jest relewantny dla tych samych decyzji zakupowych i wdrożeniowych.

Praktyczne pytanie dla każdego budującego na tych modelach nie brzmi, który jest najlepszy w oderwaniu od zastosowania, lecz który potwierdzony wariant pasuje do konkretnego zadania. Te sześć modeli istotnie różni się kosztami, kontekstem, zachowaniem w kodowaniu, licencjonowaniem i elastycznością wdrożenia.

Ceny i specyfikacje, zestawione obok siebie

Wszystkie poniższe ceny dotyczą miliona tokenów. Gdy model występuje w kilku poziomach, każdy jest wymieniony osobno.

ModelWejścieWyjścieOkno kontekstuLicencjaData wydania
GPT-5.6 Sol$5.00$30.00Brak publicznej specyfikacjiWłasnościowa9 lipca 2026
GPT-5.6 Terra$2.50$15.00Brak publicznej specyfikacjiWłasnościowa9 lipca 2026
GPT-5.6 Luna$1.00$6.00Brak publicznej specyfikacjiWłasnościowa9 lipca 2026
Grok 4.5$2.00$4.00Brak publicznej specyfikacjiWłasnościowa8 lipca 2026
Kimi K3$3.00$15.001,048,576 tokenówOtwarte wagi (Kimi K3 License)16 lipca 2026
Gemini 3.6 Flash$1.50$7.501,048,576 tokenów (65,536 tokenów wyjściowych)Własnościowa21 lipca 2026
GLM-5.2$1.40$4.411,000,000 tokenówOtwarte (MIT License)13 czerwca 2026
Claude Opus 5$5.00$25.001,000,000 tokenów (128K tokenów wyjściowych)Własnościowa24 lipca 2026

*Oficjalne stawki dostawców pokazane powyżej; zunifikowane API stosujące standardowy rabat obniżyłoby każdą z nich proporcjonalnie — celem tabeli jest względna różnica między modelami, a nie cena przy kasie konkretnego sprzedawcy.

Z tabeli cen i specyfikacji wyłania się kilka kwestii. Sol, najwyższy poziom GPT-5.6, jest wyceniony pod graniczne rozumowanie i prace agentowe, a nie codzienne użycie, podczas gdy cena wyjścia Grok 4.5 jest relatywnie niska jak na jego pozycjonowanie. GLM-5.2 ma najniższą wymienioną cenę wyjścia w tej grupie i korzysta z liberalnej licencji MIT. Kimi K3 również udostępnia pobieralne wagi i kontekst 1M tokenów, ale na odrębnej Kimi K3 License, a nie MIT. Gemini 3.6 Flash, Kimi K3, GLM-5.2 i Claude Opus 5 publikują okna kontekstu rzędu 1M tokenów, więc pojemność kontekstu sama w sobie nie wystarcza już do wyboru między nimi. Stawki wymienione przez CometAPI są na ogół niższe niż ceny katalogowe dostawców, ale ocena na poziomie obciążenia roboczego pozostaje bardziej użyteczna niż porównywanie cen za token w oderwaniu od zastosowania.

Do czego faktycznie każdy z nich jest dostrojony

GPT-5.6 Sol jest pozycjonowany pod graniczne rozumowanie, agentowe kodowanie i długohoryzontową pracę techniczną — obsługuje tryb "Max Reasoning Effort" i "Ultra Mode", który uruchamia równolegle sub‑agentów. To poziom do sięgania przy trudnych, wieloetapowych problemach, a nie rutynowych zadaniach, biorąc pod uwagę różnicę cen wobec Terra i Luna.

GPT-5.6 Terra to zbalansowany środkowy poziom — codzienna produktywność, dokumentacja, wsparcie w kodowaniu i automatyzacja biznesowa. Dla większości zapleczy aplikacji, które nie potrzebują konkretnie głębi rozumowania Sol, Terra jest bardziej obronnym wyborem domyślnym.

GPT-5.6 Luna celuje w lekkie, wysokonakładowe użycie: klasyfikację, ścieżki wsparcia klienta, onboarding, powtarzalną generację treści. Przy $1.00/$6.00 za milion tokenów (przed ewentualnym rabatem bramki) cena jest skrojona pod taki właśnie wysokonakładowy, niskozłożony workload — a dodatkowo obsługuje ceny dla cache’owanego wejścia z 90% zniżką względem standardowej stawki wejściowej, co ma tu większe znaczenie niż przy wyższych poziomach ze względu na powtarzalność takich zadań.

Grok 4.5 nie publikuje jasno określonej specjalizacji tak jak poziomy GPT-5.6, ale jego wycena plasuje go między opcją budżetową a średnią — warto bezpośrednio porównać go w benchmarkach z Terra lub Kimi K3 dla konkretnego obciążenia, zamiast wnioskować pozycjonowanie wyłącznie z ceny.

Kimi K3 to model Mixture‑of‑Experts o 2.8 biliona parametrów, zbudowany do długohoryzontowego kodowania, multimodalnej pracy z wiedzą oraz obszernej analizy dokumentów lub repozytoriów w ramach kontekstu 1M tokenów. Moonshot AI udostępnił pełne wagi, więc samodzielne hostowanie jest możliwe, ale wydanie korzysta z Kimi K3 License, która zawiera warunki komercyjne różniące się od standardowego wydania MIT.

Gemini 3.6 Flash to wydanie Google ukierunkowane na efektywność: explicite przedstawione jako przyrostowy następca 3.5 Flash zoptymalizowany pod koszt i opóźnienia, a nie nowy model graniczny, z realnymi zyskami w benchmarkach kodowania i agentowych, przy niższej cenie za token wyjściowy niż u poprzednika. To wybór do agentowych obciążeń, gdzie liczy się zarówno efektywność tokenowa, jak i koszt na ukończone zadanie, równie mocno co sama surowa zdolność.

GLM-5.2 to bardziej liberalnie licencjonowana otwarta opcja w tym porównaniu. Z.ai wydało go na MIT License z kontekstem 1M tokenów i wyraźnym naciskiem na długohoryzontowe kodowanie, użycie narzędzi oraz regulowany nakład rozumowania. Zespoły mogą uzyskać do niego dostęp przez API albo uruchamiać opublikowane wagi lokalnie, zgodnie z własnymi wymaganiami infrastrukturalnymi i ewaluacyjnymi.

Porównanie możliwości w zakresie kodowania

Te sześć wydań celuje w różne wzorce inżynierskie, więc zdolności kodowania najlepiej rozumieć jako dopasowanie do obciążenia, a nie pojedynczy ranking.

  • Claude Opus 5 najlepiej sprawdza się przy trudnym debugowaniu, analizie przyczyn źródłowych, dużych refaktoryzacjach i długotrwałych agentach programowych; Anthropic podkreśla silniejsze zachowania weryfikacji i iteracji.
  • GPT-5.6 Sol, Terra i Luna oferują stopniowaną ścieżkę od złożonego kodowania i rozumowania po zrównoważone prace deweloperskie i wysokonakładową asystę kodową.
  • Gemini 3.6 Flash jest dostrojony do szybkich agentowych pętli kodowania, gdzie liczy się opóźnienie i koszt na iterację.
  • Kimi K3 jest projektowany do długohoryzontowego kodowania na bardzo dużych repozytoriach, z kontekstem 1M tokenów i pobieralnymi wagami.
  • GLM-5.2 łączy długohoryzontowe kodowanie, użycie narzędzi, regulowany nakład rozumowania i lokalne wdrożenie na licencji MIT.
  • Grok 4.5 najlepiej traktować jako kandydata do bezpośredniej ewaluacji względem pozostałych, ponieważ jego oficjalne pozycjonowanie nie daje takiego rozbicia specjalizacji kodowej jak stopniowana rodzina GPT.

Kompromisy częstego porównywania (i przełączania się między) modeli

To nie jest argument za gonitwą za każdym nowym wydaniem. Przełączanie produkcyjnych obciążeń na nowy model za każdym razem ma realne koszty: ponowne testowanie promptów, ponowną walidację jakości wyjścia oraz ponowne przeliczenie kosztu na zadanie względem faktycznego ruchu, a nie syntetycznego benchmarku. Zunifikowane API nie usuwa tej pracy ewaluacyjnej, ale usuwa narzut związany z osobnymi kontami i osobnym rozliczaniem przy samym przeprowadzeniu porównania — możliwość wywołania GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3 i GLM-5.2 tym samym kształtem żądania i z jednym rachunkiem sprawia, że realnie da się przetestować więcej niż jednego kandydata przed podjęciem decyzji, zamiast z rozpędu trzymać się dostawcy, u którego już mamy klucz.

To realna przewaga, a nie pełne rozwiązanie — nie zastępuje czytania właściwej dokumentacji każdego modelu i nie czyni wyboru modelu wolnym od opisanych powyżej kosztów przełączania. Obniża natomiast koszt sprawdzenia, który model faktycznie pasuje do danego obciążenia, co jest innym (i uczciwszym) stwierdzeniem niż „ten model jest najlepszy”.

FAQ

Jaki jest najlepszy model AI wydany w lipcu 2026? Nie ma jednej najlepszej odpowiedzi. GPT-5.6 Sol i Claude Opus 5 celują w wymagające rozumowanie i kodowanie; Gemini 3.6 Flash akcentuje efektywne pętle agentowe; Kimi K3 łączy długi kontekst z otwartymi wagami; a GLM-5.2 łączy długohoryzontowe możliwości z licencją MIT. Właściwy wybór zależy od obciążenia roboczego i ograniczeń wdrożeniowych.

Czy GPT-5.6 to jeden model czy kilka? Trzy: Sol (flagowy, graniczne rozumowanie), Terra (zbalansowany, do codziennego użytku) i Luna (szybki i niskokosztowy, zadania wysokonakładowe) — każdy wyceniony osobno, od $0.80/$4.80 za milion tokenów dla Luna do $4.00/$24.00 dla Sol.

Czy Claude Opus 5 został oficjalnie wydany? Tak. Anthropic ogłosił Claude Opus 5 24 lipca 2026. Oficjalne wydanie opisuje okno kontekstu 1M tokenów i pozycjonuje model do złożonego agentowego kodowania i pracy z wiedzą; oficjalne ceny API to $5 za milion tokenów wejściowych i $25 za milion tokenów wyjściowych.

Który z tych modeli jest najtańszy w użyciu na dużą skalę? Według wymienionych cen wyjścia u dostawców w tabeli GLM-5.2 jest najtańszą opcją i jest dostępny na licencji MIT. Kimi K3 również ma otwarte wagi, ale jego odrębna Kimi K3 License i znacznie większy rozmiar modelu zmieniają ekonomię samodzielnego hostowania. GPT-5.6 Luna to najtańsza własnościowa opcja dostępna wyłącznie przez API, ujęta tutaj.

Czy muszę wybrać jeden model i się do niego zobowiązać, czy mogę przetestować kilka? Przetestowanie więcej niż jednego względem własnych promptów i ruchu jest zwykle warte kosztu przygotowania przed skierowaniem ruchu produkcyjnego — zunifikowane API (CometAPI i inne) konkretnie to tańsze, bo usuwa narzut osobnych kont przy samym porównaniu, choć nie zastępuje lektury dokumentacji każdego modelu.

Podsumowanie

Fala wydań z lipca 2026 nie przyniosła jednego jednoznacznego zwycięzcy. Przyniosła sześć potwierdzonych opcji, które różnie rozkładają akcenty między głębią rozumowania, wydajnością w kodowaniu, kosztem tokenów, kontekstem i licencjonowaniem. GPT-5.6 Sol i Claude Opus 5 celują w najtrudniejsze prace z zakresu rozumowania i inżynierii oprogramowania; Gemini 3.6 Flash i GPT-5.6 Luna stawiają na efektywność; Kimi K3 zapewnia otwarte wagi i multimodalny kontekst 1M na własnej licencji; a GLM-5.2 oferuje alternatywę 1M na licencji MIT. Wszystkie są dostępne przez CometAPI pod jednym kluczem, co ułatwia kontrolowane testy, ale wybór modelu powinien nadal opierać się na promptach, narzędziach, celach opóźnień i kryteriach sukcesu dla właściwego obciążenia.

Gotowy na obniżenie kosztów rozwoju AI o 20%?

Zacznij za darmo w kilka minut. Dołączone kredyty na bezpłatny okres próbny. Karta kredytowa nie jest wymagana.

Czytaj więcej