Podsumowanie
Grok 4.7 ma teraz najjaśniejszy przedpremierowy sygnał: dziesięciodniowe odliczanie od 2 września wskazuje na spodziewaną premierę około 12 września 2026 r. Wcześniejsze wypowiedzi opisywały model o około 2,1 biliona parametrów oraz dodatkowe szkolenie z wykorzystaniem znaczących danych firmowych SpaceX. Jednak xAI nie opublikowało jeszcze karty modelu Grok 4.7, zestawu benchmarków, finalnego identyfikatora API, okna kontekstu ani oficjalnych cen. Do czasu pojawienia się tych szczegółów wydany Grok 4.6 pozostaje mierzalną produkcyjną bazą odniesienia.
Najważniejsze wnioski
- Oczekiwana data 12 września jest wywnioskowana z dziesięciodniowego odliczania Muska, a nie z oddzielnego ogłoszenia w kalendarzu xAI.
- Deklaracje o skali 2,1T i danych SpaceX są przedpremierowe; aktywne parametry, routing, architektura i metodologia treningu pozostają nieopublikowane.
- Grok 4.6 już pokazuje silne wyniki w pracach wiedzo-intensywnych i działaniach agentowych, w tym 61,3% na FrontierCode v1.1 (Extended), ale ustępuje najmocniejszemu modelowi porównawczemu w kilku trudnych ewaluacjach kodowania.
- Grok 4.7 należy oceniać po wskaźniku przyjętych zadań, niezawodności w długim horyzoncie, efektywności tokenowej, opóźnieniach i koszcie na udany wynik — a nie wyłącznie po liczbie parametrów.
- CometAPI zintegruje Grok 4.7, gdy tylko xAI oficjalnie wyda model i udostępni produkcyjny endpoint; deweloperzy powinni przed migracją zweryfikować na żywo identyfikator modelu, ceny i zachowanie odpowiedzi.
Czym jest Grok 4.7?
Grok 4.7 to zapowiedziany następca Grok 4.6 i oczekuje się, że będzie kontynuował nacisk xAI na kodowanie, inżynierię, długotrwałe działania agentowe i profesjonalną pracę wiedzo-intensywną. Publiczne dowody to obecnie wypowiedzi założyciela oraz odliczanie do premiery, a nie kompletny pakiet technicznego uruchomienia.
Najważniejsze jest rozróżnienie trzech elementów: zapowiedzianego modelu Grok 4.7, przedpremierowych sygnałów opisujących możliwą skalę i trening oraz działającego produkcjnego punktu odniesienia Grok 4.6. Deweloperzy powinni traktować Grok 4.7 jako nadchodzącego kandydata do ewaluacji, dopóki xAI nie opublikuje finalnej dokumentacji i dopóki żądanie do wydanego endpointu nie zakończy się powodzeniem.
Data wydania i harmonogram Grok 4.7
Kiedy spodziewana jest premiera Grok 4.7?
Wypowiedź Muska z 2 września, że model pojawi się za dziesięć dni, wskazuje na około 12 września 2026 r.
Źródło: Elon Musk na X, 2 września 2026 r.
Harmonogram wydania Grok 4.7
| Data | Sygnał publiczny | Interpretacja |
|---|---|---|
| Koniec lipca 2026 r. | Musk opisał model ~2,1T, poprawioną efektywność tokenów i nieco wolniejsze serwowanie. | Deklarowane przez założyciela oczekiwania dotyczące skali modelu i efektywności. |
| 12 sierpnia 2026 r. | Początkowe szkolenie opisano jako zakończone; według doniesień trening uzupełniający obejmował znaczące dane firmowe SpaceX. | Aktualizacja postępu treningu, nie potwierdzenie wydania. |
| 2 września 2026 r. | „Grok 4.7 wyjdzie za 10 dni.” | Najbardziej jednozniczne publiczne odliczanie do premiery do tej pory. |
| 12 września 2026 r. | Data kalendarzowa wywiedziona z odliczania. | Spodziewany termin; ostateczna dostępność wciąż wymaga ogłoszenia wydania przez xAI i działającego endpointu. |
Specyfikacje Grok 4.7: informacje potwierdzone i niepotwierdzone
Najbardziej użyteczny sposób czytania obecnych informacji o Grok 4.7 to oddzielenie bezpośrednich wypowiedzi założyciela od specyfikacji, których xAI nie opublikowało. Nowy wpis potwierdza jedynie nazwę modelu i odliczanie do premiery; nie dodaje parametrów technicznych ani wyników benchmarków.
| Specyfikacja | Aktualny status Grok 4.7 | Poziom wiarygodności |
|---|---|---|
| Termin wydania | Około 12 września, wnioskowany z dziesięciodniowego odliczania z 2 września | Cel ogłoszony przez założyciela |
| Skala modelu | Około 2,1T parametrów | Deklaracja założyciela |
| Trening początkowy | Opisany jako zakończony do 12 sierpnia | Deklaracja założyciela |
| Trening uzupełniający | Obejmuje znaczące dane firmowe SpaceX | Deklaracja założyciela |
| Relatywna jakość | Deklarowana znacząca przewaga nad Grok 4.6 | Niezwer. twierdzenie |
| Efektywność tokenowa | Deklarowana poprawa względem Grok 4.6 | Niezwer. twierdzenie |
| Szybkość serwowania | Oczekiwane nieco wolniejsze | Deklaracja założyciela |
| Okno kontekstu | Nieopublikowane przez xAI | Nieznane |
| Modalności wejścia/wyjścia | Nieopublikowane przez xAI | Nieznane |
| Finalny identyfikator modelu API | Niepotwierdzony w dokumentacji xAI | Nieznane |
| Oficjalne ceny | Nieopublikowane przez xAI | Nieznane |
| Oficjalne benchmarki | Brak opublikowanych dla Grok 4.7 | Nieznane |
Twierdzenie o ~2,1T parametrów nie ujawnia liczby aktywnych parametrów, rzadkości, routingu ekspertów, kosztu inferencji ani efektywnego nakładu obliczeń treningowych. Sama liczba parametrów nie przesądza o jakości produkcyjnej.
Dlaczego sygnał o treningu na danych SpaceX może mieć większe znaczenie niż 2,1T
Bardziej doniosłe może być uzupełnienie treningu danymi firmowymi SpaceX. Wysokiej jakości korpus inżynieryjny może poprawić rozumowanie techniczne, projektowanie, debugowanie, optymalizację i pracę agentów w długim horyzoncie, gdzie rozkład zadań i jakość po treningu często znaczą więcej niż sama skala.
Ten kierunek jest spójny ze strategią xAI dla wydanych modeli. Raport treningowy Grok 4.6 opisuje dłuższy bieg treningu uzupełniającego z wysokiej jakości danymi inżynieryjnymi, po którym nastąpiło nadzorowane dostrajanie i uczenie ze wzmocnieniem obejmujące programowanie, STEM, tworzenie stron WWW, optymalizację jądra i projektowanie wspomagane komputerowo.
To czyni deklarację dot. Grok 4.7 technicznie wiarygodną, ale nieudowodnioną. Rzeczywista przewaga powinna stać się widoczna po premierze w replikowalnych testach inżynieryjnych, wskaźnikach realizacji zadań, opóźnieniach i koszcie na udany wynik.
Wydajność Grok 4.7 vs Grok 4.6: co pokazuje punkt odniesienia
Nie ma jeszcze oficjalnych wyników Grok 4.7. Odpowiednim punktem porównawczym jest ewaluacja wydanego Grok 4.6. Pełny przegląd modelu znajduje się w szczegółowej analizie Grok 4.6 na CometAPI; poniższa tabela zawiera tylko najbardziej decyzyjnie istotne wiersze benchmarków.
| Oficjalna ewaluacja | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
Wynik bazowy: Grok 4.6 wykazuje realną przewagę nad Grok 4.5 we wszystkich pokazanych wierszach. Zrównuje się z GPT-5.6 Sol w ogólnym indeksie inteligencji, prowadzi w tej grupie w GDPVal-AA v2 i minimalnie wyprzedza GPT-5.6 Sol w FrontierCode. Jego główne ujawnione luki pozostają w DeepSWE i Terminal-Bench.
Te wyniki wyznaczają konkretny standard dla Grok 4.7. Jeśli większy model i inżynieryjnie ukierunkowany trening uzupełniający przełożą się na produkcję, oczekiwanym przełomem będą mocniejsze kodowanie na poziomie repozytoriów i ukończenie zadań terminalowych bez utraty siły Grok 4.6 w pracy wiedzo-intensywnej. Wiarygodnym ambitnym celem jest osiągnięcie konkurencyjności względem wydanego Claude Fable 5.1 w kodowaniu i długotrwałych przepływach pracy agentów. To prognoza do weryfikacji, a nie aktualny wynik benchmarków.
Grok 4.7 vs Grok 4.6: oczekiwane przełomy i wskazówki dot. aktualizacji
Wyciekłe i deklarowane przez założyciela sygnały sugerują pięć obszarów, w których Grok 4.7 może się poprawić. Ponieważ xAI nie opublikowało finalnych danych ewaluacyjnych, każdą z tych oczekiwań należy przekuć w mierzalny test akceptacyjny.
Programowanie na poziomie repozytorium
Grok 4.6 jest już mocny na CursorBench i FrontierCode, ale jego wyniki w DeepSWE i Terminal-Bench pozostawiają widoczną przestrzeń do poprawy. Grok 4.7 powinien wykazać wyższą akceptację poprawek, mniej regresji i lepsze odzyskiwanie w wierszu poleceń w tych samych repozytoriach, zanim zastąpi 4.6.
Niezawodność agentów w długim horyzoncie
Sygnał o danych SpaceX i obecny kierunek szkolenia agentów w xAI sugerują nacisk na wieloetapową pracę inżynieryjną. Mierz ukończone przepływy pracy, nieudane wywołania narzędzi, ponowienia, interwencje ludzkie i odzyskiwanie po błędach — nie tylko jakość końcowego tekstu.
Prace wiedzo-intensywne i rozumowanie techniczne
Grok 4.6 prowadzi już w zestawie porównawczym na GDPVal-AA v2. Grok 4.7 powinien zachować tę przewagę, jednocześnie poprawiając transfer do przeglądów projektów, syntezy badań, debugowania, optymalizacji i innych złożonych zadań technicznych.
Efektywność tokenowa
Większy model może wciąż być tańszy na zadanie zakończone sukcesem, jeśli dochodzi do poprawnych wyników w mniejszej liczbie kroków. Porównaj całkowite tokeny wejściowe, cache’owane wejście, tokeny wyjściowe, ponowienia i koszt dla tego samego zaakceptowanego rezultatu.
Kompromisy serwowania
Jeśli Grok 4.7 jest wolniejszy, zyski jakości muszą równoważyć opóźnienie. Rejestruj czas do pierwszego tokena, utrzymywaną przepustowość, całkowity czas realizacji zadania, wskaźnik błędów i koszt przy realistycznej współbieżności.
Benchmarki Grok 4.7: 5 testów weryfikujących realną przewagę nad Grok 4.6
- Sukces w inżynierii oprogramowania: mierz rozwiązane zgłoszenia, zaliczone testy, wskaźnik regresji i akceptację poprawek w reprezentatywnych repozytoriach.
- Niezawodność agentów w długim horyzoncie: śledź ukończone przepływy pracy, awarie wywołań narzędzi, ponowienia, odzyskiwanie i interwencje ludzkie w wieloetapowych przebiegach.
- Transfer do realnej inżynierii: testuj projektowanie, debugowanie, optymalizację, rozumowanie naukowe i zadania związane z CAD z ujawnionymi kryteriami oceny.
- Efektywność tokenowa na udane zadanie: porównaj całkowite tokeny i wydatki potrzebne do uzyskania tego samego zaakceptowanego wyniku.
- Opóźnienia i koszt pod obciążeniem produkcyjnym: oceń czas do pierwszego tokena, przepustowość, czas całkowity, wskaźnik błędów i koszt przy realistycznej współbieżności.
Co powinni zrobić deweloperzy przed 12 września — i jak wpisuje się w to CometAPI
Lista kontrolna dla deweloperów przed premierą
- Zbuduj stały zestaw ewaluacyjny z realnych przepływów pracy: kodowanie, badania, inżynieria i agenci.
- Uruchom go na Grok 4.6 i zarejestruj wskaźnik sukcesu, ponowienia, wywołania narzędzi, opóźnienia, tokeny i łączny koszt.
- Utrzymuj konfigurowalny wybór modelu i unikaj hardcodowania tymczasowego identyfikatora Grok 4.7.
- Obserwuj informacje o wydaniach xAI oraz stronę modelu na CometAPI, aby potwierdzić dostępność.
- Po premierze zweryfikuj okno kontekstu, modalności, kontrolki rozumowania, ceny, limity stawek i zakres wdrożenia.
- Odtwórz ten sam zestaw ewaluacyjny przed przeniesieniem ruchu produkcyjnego.
CometAPI zapewnia ujednoliconą warstwę API do dostępu do wielu dostawców modeli AI przez jedno konto i jeden wzorzec integracji. Strona śledząca Grok 4.7 jest już dostępna. CometAPI zintegruje Grok 4.7 natychmiast po oficjalnym wydaniu przez xAI i uzyskaniu dostępu do produkcyjnego endpointu.
Do tego czasu traktuj każdy przedpremierowy identyfikator, cenę czy pole możliwości jako tymczasowe. Przed skierowaniem ruchu produkcyjnego potwierdź, że trasa jest aktywna, rzeczywiste żądanie kończy się sukcesem, zwrócony model to zamierzona wersja, a aktualne ceny są widoczne w konsoli.
Perspektywa cenowa Grok 4.7 vs Grok 4.6
Opublikowana standardowa stawka Grok 4.6 wynosi $2 za 1 milion tokenów wejściowych i $6 za 1 milion tokenów wyjściowych poniżej progu długiego kontekstu. Informacje o wydaniach xAI podają wyższe stawki dla żądań powyżej 200,000 tokenów promptu. Ceny Grok 4.7 nie zostały oficjalnie ogłoszone.
| Podstawa opublikowanego cennika | Wejście / 1M | Wyjście / 1M | Status |
|---|---|---|---|
| Grok 4.6, prompt poniżej 200K | $2 | $6 | Opublikowane |
| Grok 4.6, prompt powyżej 200K | $4 | $12 | Opublikowany próg długiego kontekstu |
| Grok 4.7 | Nieogłoszone | Nieogłoszone | Potwierdzić po oficjalnej premierze |
Pozostają trzy wiarygodne kierunki cenowe: parytet z Grok 4.6 w celu przyspieszenia adopcji, wyższa półka cenowa, jeśli koszt serwowania jest istotnie większy, lub osobne stawki według długości kontekstu i szybkości. To scenariusze planistyczne, a nie prognoza xAI.
Lista kontrolna dla deweloperów przed premierą
- Zbuduj stały zestaw ewaluacyjny z realnych przepływów pracy: kodowanie, badania, inżynieria i agenci.
- Uruchom go na Grok 4.6 i zarejestruj wskaźnik sukcesu, ponowienia, wywołania narzędzi, opóźnienia, tokeny i łączny koszt.
- Utrzymuj konfigurowalny wybór modelu i unikaj hardcodowania tymczasowego identyfikatora Grok 4.7.
- Obserwuj informacje o wydaniach xAI oraz stronę modelu na CometAPI, aby potwierdzić dostępność.
- Po premierze zweryfikuj okno kontekstu, modalności, kontrolki rozumowania, ceny, limity stawek i zakres wdrożenia.
- Odtwórz ten sam zestaw ewaluacyjny przed przeniesieniem ruchu produkcyjnego.
Grok 4.7: na co zwracać uwagę dalej
Cztery wydarzenia zamienią obecne odliczanie w weryfikowalne wdrożenie produktu: oficjalny wpis xAI o wydaniu; dokumentację modelu obejmującą kontekst, modalności i kontrolki rozumowania; finalne ceny API i identyfikatory modeli; oraz replikowalne benchmarki lub ewaluacje produkcyjne.
Najbardziej użyteczne pytanie na premierę nie brzmi, czy 2,1T brzmi imponująco. Brzmi: czy Grok 4.7 wykonuje trudne zadania inżynieryjne i agentowe bardziej niezawodnie — i przy lepszym koszcie na udany wynik — niż wydany punkt odniesienia.
FAQ
Kiedy spodziewana jest premiera Grok 4.7?
Dziesięciodniowe odliczanie z 2 września wskazuje na około 12 września 2026 r. To termin wywnioskowany, a nie oddzielnie opublikowana data z kalendarza xAI.
Czy Grok 4.7 już zadebiutował?
Grok 4.7 został publicznie zasygnalizowany/zapowiedziany, ale nie otrzymał jeszcze kompletnego oficjalnego wydania dokumentacji API/modelu.
Czy Grok 4.7 ma 2,1 biliona parametrów?
Musk opisał go jako około 2,1T parametrów. xAI nie opublikowało jeszcze dokumentu architektonicznego potwierdzającego aktywne parametry ani szczegóły routingu.
Czy Grok 4.7 będzie lepszy niż Grok 4.6?
Musk zadeklarował znaczącą poprawę, ale nie istnieje oficjalna tabela benchmarków Grok 4.7. Traktuj to jako niezweryfikowane, dopóki nie będą dostępne replikowalne wyniki.
Czy Grok 4.7 będzie dostępny przez CometAPI?
Istnieje już strona śledząca CometAPI, ale finalną dostępność, identyfikator, ceny i obsługiwane formaty należy potwierdzić po oficjalnej premierze.
Wnioski końcowe
Historia Grok 4.7 przeszła od szerokiego szacunku na początek września do konkretnego odliczania. Najnowsza wypowiedź Muska wskazuje na około 12 września 2026 r., a wcześniejsze wpisy opisują model ~2,1T i trening uzupełniający z udziałem znaczących danych firmowych SpaceX.
To wyjątkowo konkretne sygnały przedpremierowe, ale nie są one kartą modelu, zestawem benchmarków ani kontraktem API. Deweloperzy powinni utrzymać Grok 4.6 jako mierzalną bazę odniesienia, przygotować kontrolowaną ewaluację już teraz i zaczekać na potwierdzenie dostępu produkcyjnego przez xAI i CometAPI przed podejmowaniem decyzji migracyjnych lub budżetowych.
