TL;DR
Grok 5 to model graniczny nowej generacji SpaceXAI. xAI potwierdziło w styczniu 2026 r., że model był w trakcie trenowania, a późniejsze zgłoszenie SpaceX do U.S. Securities and Exchange Commission wskazało COLOSSUS II jako platformę treningową.
Elon Musk publicznie mówił o celu rzędu około 6 bilionów parametrów oraz multimodalnym wsparciu obejmującym tekst, obrazy, wideo i audio. Podczas rozmowy wynikowej SpaceX w sierpniu 2026 r. powiedział, że Grok 5 jest planowany do wydania przed końcem 2026 r. i uwzględni około 25 lat danych SpaceX. Aktualizację opisały CLS oraz ME News.
Równie istotne jest to, czego nie upubliczniono: xAI nie opublikowało karty modelu, wyników benchmarków, cen API, specyfikacji okna kontekstu, liczby aktywnych parametrów ani ostatecznego planu dostępu. Te otwarte kwestie są zebrane w sekcji Czego jeszcze nie wiemy, zamiast być przedstawiane w całym artykule jako ustalone specyfikacje.
Najważniejsze wnioski
- xAI potwierdziło, że Grok 5 jest w trakcie trenowania.
- Musk opisał docelową skalę około 6 bilionów parametrów oraz wsparcie dla wejść tekstowych, obrazów, wideo i audio.
- Zgłoszenie SpaceX do SEC łączy Grok 5 z COLOSSUS II i opisuje dalszą rozbudowę z wykorzystaniem systemów NVIDIA GB200 i GB300.
- SpaceX podało, że następna faza rozbudowy COLOSSUS II ma dodać co najmniej 220,000 procesorów GB300 i ponad 400 megawatts mocy obliczeniowej.
- Musk powiedział, że Grok 5 będzie trenowany na korpusie danych SpaceX gromadzonych przez około 25 lat.
- Najnowszy publiczny cel to wydanie przed końcem 2026 r., po planowanych aktualizacjach Grok 4.6 i Grok 4.7.
- Architektura, długość kontekstu, wyniki benchmarków, ceny API, poziomy produktowe i dokładna data premiery pozostają nieujawnione.
Czym jest Grok 5?
Grok 5 to kolejny duży model bazowy w rodzinie Grok. Następuje po Grok 4.5, które SpaceXAI pozycjonuje wokół programowania, zadań agentowych i pracy wiedzochłonnej.
Pierwszy szczegółowy publiczny opis pojawił się podczas rozmowy Elona Muska w 2025 r. na Baron Investment Conference. Musk omówił model celujący w około 6 bilionów parametrów i działający w trybie multimodalnym na tekście, obrazach, wideo i audio. Później pojawiły się wtórne podsumowania na NxCode oraz na stronie referencyjnej Grok 5 w Grokipedii.
Bardziej formalne potwierdzenie nadeszło, gdy xAI ogłosiło, że Grok 5 jest w treningu. Następnie zgłoszenie papierów wartościowych SpaceX połączyło model z COLOSSUS II i opisało, że systemy Grok następnej generacji celują w wyższą dokładność rozumowania, głębszą integrację multimodalną oraz lepszą wydajność w domenach specjalistycznych.
Najnowsza publiczna aktualizacja pojawiła się podczas rozmowy wynikowej SpaceX 4 sierpnia 2026 r. Musk powiedział, że Grok 5 ma trafić na rynek przed końcem roku i wykorzysta pełny korpus danych SpaceX wytworzony przez około ćwierć wieku. Pozycjonuje to model na skrzyżowaniu prac xAI nad AI ogólnego przeznaczenia, środowiska informacji w czasie rzeczywistym X oraz operacji inżynieryjnych SpaceX.
Rysunek 1. Oficjalny przegląd działalności AI SpaceX łączy infrastrukturę obliczeniową, modele graniczne i dane w czasie rzeczywistym. Źródło: SpaceX SEC roadshow presentation
Co nowego w Grok 5?
Cel: 6 bilionów parametrów
Deklarowany przez Muska cel około 6 bilionów parametrów umieściłby Grok 5 znacznie powyżej skali publicznie omawianej dla wcześniejszych generacji Grok. Liczbę tę należy traktować jako cel rozwojowy: xAI nie opublikowało jeszcze finalnej liczby parametrów, liczby aktywnych parametrów ani konfiguracji wdrożeniowej.
xAI ma wcześniejsze doświadczenia z rzadkimi modelami ekspertowymi. Jego otwarte wydanie Grok-1 było modelem mixture-of-experts o 314 miliardach parametrów, który aktywował tylko część wag dla każdego tokena. Ta historia ma znaczenie dla Grok 5, ale nie przesądza o architekturze niewydanego jeszcze modelu.
COLOSSUS II i dane inżynieryjne SpaceX
Zgłoszenie SpaceX do SEC stwierdza, że COLOSSUS II jest używany do trenowania granicznych modeli następnej generacji, w tym Grok 5. Opisuje ono także wdrożenia na dużą skalę GB200 i GB300 oraz dalszą rozbudowę zaprojektowaną tak, by dodać co najmniej 220,000 procesorów GB300.
Musk powiedział też, że model uwzględni około 25 lat danych SpaceX. Ten korpus ma duże znaczenie, ponieważ może zawierać nie tylko gotowe dokumenty techniczne, lecz także decyzje projektowe, wyniki testów, analizy awarii, rewizje oprogramowania, zapisy produkcyjne i prace weryfikacyjne.
To ujawnienie dostarcza jasnego powodu, dla którego xAI może kłaść nacisk na inżynierię i wydajność w domenach specjalistycznych. Nie ujawnia jednak, które zbiory danych zostaną włączone, jak będą filtrowane oraz jaka część korpusu zostanie użyta podczas pretrenowania, post-treningu lub w mechanizmach wyszukiwania/odwołań.
Kierunek multimodalny
Musk opisał Grok 5 jako obejmujący tekst, obrazy, wideo i audio. Zgłoszenie SpaceX osobno wskazuje głębszą integrację multimodalną jako cel dla kolejnej generacji modeli granicznych.
Ten kierunek jest spójny z szerszym ekosystemem produktów xAI, który już teraz obejmuje funkcje głosowe, obrazowe i wideo. Publiczne ujawnienia potwierdzają multimodalność jako cel, ale nie precyzują, czy Grok 5 wykorzysta jeden zunifikowany model dla wszystkich modalności, czy skoordynuje kilka wyspecjalizowanych komponentów.
Uczenie ze wzmocnieniem, wyszukiwanie i agenci
Oficjalne ogłoszenie Grok 4.5 pokazuje kierunek prac xAI po treningu wstępnym. Grok 4.5 był trenowany na setkach tysięcy zadań, z naciskiem na wieloetapową inżynierię oprogramowania i prace techniczne. Niektóre wdrożenia agentowe trwały godziny i były oceniane automatycznie oraz z użyciem modeli.
Obecne produkty Grok wspierają także wyszukiwanie w sieci, wyszukiwanie w X, wywoływanie funkcji i wykonywanie kodu. Dokumentacja deweloperska Grok przedstawia te narzędzia jako część istniejącego ekosystemu modelu, a dokumentacja multi-agentowa xAI opisuje równoległych agentów badawczych, którzy wyszukują, analizują, weryfikują krzyżowo i syntetyzują informacje.
Te możliwości stanowią faktograficzny punkt odniesienia do zrozumienia kierunku xAI. Nie ujawniono jednak, czy Grok 5 zintegrował je natywnie, rozszerzył, czy opakował jako oddzielne usługi.
Czego jeszcze nie wiemy
Grok 5 został publicznie potwierdzony, ale jego finalne specyfikacje produktowe pozostają w dużej mierze nieujawnione. Poniższe punkty to projekcje oparte na istniejących modelach xAI, obecnych cenach, publicznej infrastrukturze i strategii produktowej. Nie należy ich traktować jako ogłoszonych specyfikacji Grok 5.
| Obszar | Co jest publiczne | Bieżąca projekcja |
|---|---|---|
| Architektura | Nie opublikowano architektury Grok 5. | Rzadki projekt MoE jest prawdopodobny, ale niepotwierdzony. |
| Okno kontekstu | Brak oficjalnej długości kontekstu Grok 5. | 500K–1M tokenów to rozsądny zakres planistyczny. |
| Wydajność | Brak benchmarków Grok 5. | Największe zyski mogą pojawić się w agentach o długim horyzoncie i inżynierii. |
| Cennik API | Brak cen lub cennika. | Prawdopodobna premia względem Grok 4.5, z droższymi trybami Heavy lub agentowymi. |
| Warianty produktu | Nie ogłoszono linii Grok 5. | Prawdopodobne poziomy Standard, Heavy i multi-agent. |
| Wydanie i dostęp | Cel przed końcem 2026 r. | Prawdopodobny etapowy preview, po którym nastąpi dostęp przez API i dla firm. |
Architektura i aktywne parametry
Rzadka architektura mixture-of-experts jest główną hipotezą, ponieważ uczyniłaby wielotrylionowy model bardziej praktycznym w trenowaniu i serwowaniu. Grok-1 daje precedens, ale xAI mogło znacząco zmienić trasowanie, mechanizm uwagi, pamięć lub projekt multimodalny od czasu tamtego wydania.
Liczba 6 bilionów parametrów nie ujawnia też, ile parametrów byłoby aktywnych na token. To rozróżnienie zadecyduje o koszcie inferencji, opóźnieniach, wymaganiach sprzętowych i realnym znaczeniu skali modelu.
Okno kontekstu
Grok 4.5 obsługuje okno kontekstu 500,000 tokenów, a wieloagentowy system badawczy xAI działał na poziomie miliona tokenów. Zakres 500,000–1,000,000 tokenów jest więc rozsądną projekcją dla Grok 5, zwłaszcza w przypadku dużych baz kodu, plików multimodalnych i długotrwałych zadań.
Ostateczna liczba może mieć mniejsze znaczenie niż skuteczne przywoływanie informacji, kompresja kontekstu, opóźnienia i cena. Nominalne okno miliona tokenów wniosłoby ograniczoną wartość, jeśli model nie potrafiłby wiarygodnie wydobywać z niego szczegółów lub gdyby użycie długiego kontekstu było zaporowo drogie.
Wydajność
Grok 5 nie ma opublikowanych wyników benchmarków. Oficjalne wyniki Grok 4.5 stanowią punkt odniesienia: 83.3% na Terminal-Bench 2.1, 64.7% na SWE-bench Pro, 62.0% na DeepSWE 1.0, 53.0% na DeepSWE 1.1 i 29.0% na SWE Marathon.

Rysunek 4. Bazowa linia benchmarków inżynieryjnych Grok 4.5, odtworzona z oficjalnych wyników opublikowanych przez SpaceXAI. Źródło: Introducing Grok 4.5 To są wyniki Grok 4.5, a nie wyniki Grok 5.
Rozsądnym oczekiwaniem na start byłaby poprawa niezawodności w pracy terminalowej, zmianach w wielu plikach i długotrwałych zadaniach inżynieryjnych. Najbardziej znaczące zyski mogą pojawić się w zakresie dokańczania zadań, odzyskiwania po błędach, powtarzalnego użycia narzędzi i multimodalnej syntezy dowodów, a nie w konwencjonalnych benchmarkach jednokrokowych.
Konkretnych celów wyników — takich jak wysokie 80% na Terminal-Bench czy niskie do średnich 70% na SWE-bench Pro — nie można traktować inaczej niż spekulacyjnie, dopóki xAI nie opublikuje wyników i szczegółów testów.
Cennik API
Obecnie Grok 4.5 kosztuje 2 USD za milion tokenów wejściowych i 6 USD za milion tokenów wyjściowych, z wyższymi stawkami dla długiego kontekstu powyżej opublikowanego progu.
Grok 5 prawdopodobnie będzie wyceniony z premią ze względu na skalę i spodziewany nakład rozumowania. Zakres planistyczny rzędu 3–5 USD za milion tokenów wejściowych i 10–15 USD za milion tokenów wyjściowych jest do obrony, ale nie jest to ogłoszona stawka.
Tryby Heavy lub multi-agent mogą być wyceniane poprzez wyższe stawki tokenowe, łączny użytek agentów, wysiłek rozumowania lub czas obliczeń. xAI może też agresywnie wycenić model standardowy, aby konkurować cenowo i wydajnościowo, tak jak w przypadku Grok 4.5.
Warianty produktu i tryby multi-agent
xAI już teraz oferuje produkty Heavy reasoning i badania multi-agentowe, więc prawdopodobna jest warstwowa oferta Grok 5. Model standardowy mógłby obsługiwać codzienne żądania, podczas gdy tryb Heavy lub multi-agent mógłby przydzielać więcej tokenów rozumowania i równoległych agentów do trudnych prac badawczych, programistycznych lub inżynieryjnych.
Liczba agentów może stać się dynamiczna zamiast stałej. xAI nie ogłosiło jednak, czy te możliwości będą częścią bazowego modelu Grok 5, osobnymi endpointami, funkcjami subskrypcyjnymi czy warstwą orkiestracji poza modelem.
Pozycja konkurencyjna i prawdopodobne zastosowania
Grok 5 najprawdopodobniej będzie konkurował bezpośrednio w inżynierii oprogramowania, badaniach technicznych, analizie informacji w czasie rzeczywistym i multimodalnych przepływach pracy agentów. Dane SpaceX mogą wyróżnić go w inżynierii fizycznej i analizie systemowej, a natywny dostęp do X może wzmocnić badania w czasie rzeczywistym.
Prawdopodobne zastosowania obejmują programowanie na dużych repozytoriach, analizę testów i awarii, przeglądy projektowe, syntezę dokumentacji technicznej, diagnostykę multimodalną, badania rynku i newsów oraz przepływy łączące wyszukiwanie, wykonywanie kodu, pracę na plikach i długotrwałych agentów.
Te przewagi będą zależeć od realizacji. Specjalistyczne dane nie gwarantują automatycznie lepszego osądu inżynieryjnego, a informacja w czasie rzeczywistym nie gwarantuje automatycznie poprawności faktów. O tym, czy Grok 5 stanie się praktyczną alternatywą dla innych modeli granicznych, zadecydują niezawodność, weryfikacja źródeł, opóźnienia i koszty.
Dokładna data wydania i dostęp
Publiczny cel to wydanie przed końcem 2026 r. Doniesienia CLS i ME News wskazują, że najpierw pojawią się Grok 4.6 i Grok 4.7.
Ta sekwencja sugeruje premierę w czwartym kwartale, ale nie podaje konkretnego miesiąca ani dnia. Listopad lub grudzień są prawdopodobne, lecz niepotwierdzone.
Na podstawie wcześniejszych premier Grok, dostęp może rozpocząć się przez grok.com, aplikacje mobilne Grok, poziomy X Premium+ lub SuperGrok oraz wybranych partnerów, zanim pojawi się szersza dostępność przez API i dla przedsiębiorstw. CometAPI i inne bramki modelowe mogą dodać model po uzyskaniu oficjalnego dostępu do API, ale nie ogłoszono harmonogramu integracji.
Zasadnicze rozróżnienie jest proste: istnienie Grok 5, platforma treningowa, cel liczby parametrów, ambicje multimodalne, plan wykorzystania danych SpaceX i cel wydania do końca roku są publiczne. Jego finalna architektura, długość kontekstu, wydajność, ceny, opakowanie produktowe i mechanika uruchomienia — nie.
