Zusammenfassung
Grok 4.7 hat nun sein bislang klarstes Vorab-Signal: Ein zehntägiger Countdown ab dem 2. September deutet auf eine erwartete Veröffentlichung um den 12. September 2026 hin. Frühere Aussagen beschrieben ein Modell mit ungefähr 2,1 Billionen Parametern und ergänzendem Training mit umfangreichen SpaceX-Unternehmensdaten. xAI hat jedoch noch keine Model Card, Benchmark-Suite, finale API-Kennung, Context Window oder offizielle Preise für Grok 4.7 veröffentlicht. Bis diese Details vorliegen, bleibt das veröffentlichte Grok 4.6 die messbare Produktions-Baseline.
Kernaussagen
- Das erwartete Datum 12. September ist aus Musks zehntägigem Countdown abgeleitet, nicht aus einer separat veröffentlichten xAI-Kalenderankündigung.
- Die 2,1T-Skala und die SpaceX-Daten-Hinweise sind Vorab-Aussagen; aktive Parameter, Routing, Architektur und Trainingsmethodik sind unveröffentlicht.
- Grok 4.6 zeigt bereits starke Ergebnisse in Wissensarbeit und Agenten-Szenarien, darunter 61,3% auf FrontierCode v1.1 (Extended), liegt jedoch bei mehreren schwierigen Coding-Evaluierungen hinter dem stärksten Vergleichsmodell.
- Grok 4.7 sollte anhand von Accepted-Task-Rate, Langzeit-Zuverlässigkeit, Token-Effizienz, Latenz und Kosten pro erfolgreichem Outcome bewertet werden – nicht allein anhand der Parameterzahl.
- CometAPI integriert Grok 4.7, sobald xAI das Modell offiziell veröffentlicht und ein Produktions-Endpunkt verfügbar ist; Entwickler sollten dennoch die Live-Model-ID, den Preis und das Antwortverhalten vor der Migration validieren.
Was ist Grok 4.7?
Grok 4.7 ist der angekündigte Nachfolger von Grok 4.6 und dürfte xAIs Schwerpunkt auf Coding, Engineering, lang laufende Agenten und professionelle Wissensarbeit fortsetzen. Die derzeitige öffentliche Evidenz besteht aus Gründer-Aussagen und einem Release-Countdown, nicht aus einem vollständigen technischen Launch-Paket.
Wesentlich ist die Unterscheidung zwischen drei Objekten: dem angekündigten Modell Grok 4.7, den Vorab-Signalen, die seine mögliche Größe und sein Training beschreiben, und der live verfügbaren Grok 4.6 Production-Baseline. Entwickler sollten Grok 4.7 als bevorstehenden Evaluations-Kandidaten behandeln, bis xAI finale Dokumentation veröffentlicht und eine Produktionsanfrage gegen den freigegebenen Endpunkt erfolgreich ist.
Grok 4.7: Erscheinungsdatum und Zeitplan
Wann wird Grok 4.7 voraussichtlich veröffentlicht?
Musks Aussage vom 2. September, dass das Modell in zehn Tagen erscheint, deutet auf etwa den 12. September 2026 hin
Quelle: Elon Musk auf X, 2. September 2026
Grok 4.7 Release-Zeitplan
| Datum | Öffentliches Signal | Interpretation |
|---|---|---|
| Ende Juli 2026 | Musk beschrieb ein Modell mit ungefähr 2,1T Parametern, verbesserter Token-Effizienz und etwas langsamerem Serving. | Vom Gründer angegebene Erwartungen zu Modellgröße und Effizienz. |
| 12. August 2026 | Das initiale Training wurde als abgeschlossen beschrieben; ergänzendes Training soll umfangreiche SpaceX-Daten enthalten haben. | Update zum Trainingsfortschritt, keine Release-Bestätigung. |
| 2. September 2026 | „Grok 4.7 kommt in 10 Tagen.“ | Der bislang klarste öffentliche Release-Countdown. |
| 12. September 2026 | Aus dem Countdown abgeleitetes Kalenderdatum. | Erwartetes Ziel; finale Verfügbarkeit erfordert einen xAI-Release-Hinweis und einen funktionierenden Endpunkt. |
Grok 4.7 Spezifikationen: Bestätigte vs. unbestätigte Informationen
Die sinnvollste Lesart der aktuellen Grok 4.7-Informationen ist, Gründer-Aussagen von Spezifikationen zu trennen, die xAI nicht veröffentlicht hat. Der neue Beitrag bestätigt nur den Modellnamen und einen Release-Countdown; er ergänzt keine technischen Parameter oder Benchmark-Ergebnisse.
| Spezifikation | Aktueller Status von Grok 4.7 | Evidenzniveau |
|---|---|---|
| Release-Timing | Um den 12. September, abgeleitet aus dem Countdown vom 2. September | Vom Gründer angekündigtes Ziel |
| Modellskala | Ungefähr 2,1T Parameter | Vom Gründer angegeben |
| Initiales Training | Bis 12. August als abgeschlossen beschrieben | Vom Gründer angegeben |
| Ergänzendes Training | Enthält umfangreiche SpaceX-Unternehmensdaten | Vom Gründer angegeben |
| Relative Qualität | Signifikant besser als Grok 4.6, wird behauptet | Unverifizierter Anspruch |
| Token-Effizienz | Verbesserungen gegenüber Grok 4.6 werden behauptet | Unverifizierter Anspruch |
| Serving-Geschwindigkeit | Erwartet etwas langsamer | Vom Gründer angegeben |
| Context Window | Nicht von xAI veröffentlicht | Unbekannt |
| Ein-/Ausgabe-Modalitäten | Nicht von xAI veröffentlicht | Unbekannt |
| Finale API-Model-ID | Nicht in xAI-Dokumentation bestätigt | Unbekannt |
| Offizielle Preise | Nicht von xAI veröffentlicht | Unbekannt |
| Offizielle Benchmarks | Für Grok 4.7 keine veröffentlicht | Unbekannt |
Die Angabe von ungefähr 2,1T Parametern nennt weder aktive Parameter, Sparsity, Expert-Routing, Inferenzkosten noch effektive Trainings-Compute. Die Parameterzahl allein kann die Produktionsqualität nicht belegen.
Warum das SpaceX-Training-Signal wichtiger sein könnte als 2,1T
Wichtiger könnte die Ergänzung durch SpaceX-Unternehmensdaten sein. Ein hochwertiger Engineering-Korpus kann technisches Schlussfolgern, Design, Debugging, Optimierung und langhorizontale Agentenarbeit verbessern, wo Aufgabenverteilung und Post-Training-Qualität oft wichtiger sind als die reine Skala.
Diese Richtung entspricht xAIs Strategie bei veröffentlichten Modellen. Der Grok 4.6 Trainingsbericht beschreibt einen längeren ergänzenden Trainingslauf mit hochwertigen Engineering-Daten, gefolgt von Supervised Fine-Tuning und Reinforcement Learning in den Bereichen Coding, STEM, Webentwicklung, Kernel-Optimierung und CAD.
Damit wirkt der Grok 4.7-Anspruch technisch plausibel, aber nicht bewiesen. Ein echter Vorteil sollte nach dem Release in reproduzierbaren Engineering-Tests, Task-Completion-Raten, Latenz und Kosten pro erfolgreichem Outcome sichtbar werden.
Grok 4.7 vs. Grok 4.6 Leistung: Was die Baseline zeigt
Es gibt noch keine offiziellen Grok 4.7-Scores. Der verantwortungsvolle Vergleichspunkt ist xAIs veröffentlichte Grok 4.6 Evaluation. Die vollständige Modellübersicht findet sich im CometAPI Grok 4.6 Deep Dive; die folgende Tabelle enthält nur die entscheidungsrelevantesten Benchmarks.
| Offizielle Bewertung | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54,0% | 73,0% | 70,0% |
| FrontierCode v1.1 (Extended) | 61,3% | 56,6% | 60,6% | 63,6% |
| Terminal-Bench v3.0 | 26,0% | 15,7% | 34,6% | 34,1% |
Baseline-Ergebnis: Grok 4.6 zeigt gegenüber Grok 4.5 in jeder aufgeführten Zeile einen realen Vorteil. Es entspricht GPT-5.6 Sol beim Gesamt-Intelligenzindex, führt diese Gruppe bei GDPVal-AA v2 an und liegt bei FrontierCode knapp vor GPT-5.6 Sol. Die Hauptlücken in den Veröffentlichungen bleiben DeepSWE und Terminal-Bench.
Diese Ergebnisse setzen einen konkreten Standard für Grok 4.7. Wenn das größere Modell und das engineering-orientierte ergänzende Training in der Produktion tragen, wäre der erwartete Durchbruch eine stärkere Repository-Level-Codierung und höhere Terminal-Task-Completion, ohne Grok 4.6s Stärke in Wissensarbeit zu verlieren. Ein glaubwürdiges Stretch-Ziel ist, mit dem veröffentlichten Claude Fable 5.1 bei Coding und lang laufenden Agenten-Workflows konkurrenzfähig zu werden. Das ist eine zu testende Prognose, keine aktuelle Benchmark-Aussage.
Grok 4.7 vs. Grok 4.6: Erwartete Durchbrüche und Upgrade-Leitfaden
Die geleakten und vom Gründer genannten Signale deuten auf fünf Bereiche hin, in denen Grok 4.7 Fortschritte machen könnte. Da xAI noch keine finalen Evaluationsdaten veröffentlicht hat, sollte jede Erwartung in einen messbaren Abnahmetest überführt werden.
Repository-Level-Coding
Grok 4.6 ist auf CursorBench und FrontierCode bereits stark, doch die Ergebnisse auf DeepSWE und Terminal-Bench lassen erkennbaren Verbesserungsbedarf. Grok 4.7 sollte auf denselben Repositories höhere Patch-Akzeptanz, weniger Regressionen und bessere Command-Line-Recovery zeigen, bevor es 4.6 ersetzt.
Langhorizontige Agenten-Zuverlässigkeit
Das SpaceX-Daten-Signal und xAIs bestehende Agenten-Trainingsrichtung deuten auf mehrstufige Engineering-Arbeit als Fokus hin. Messen Sie abgeschlossene Workflows, fehlgeschlagene Tool-Aufrufe, Retries, menschliche Eingriffe und Recovery nach Fehlern – nicht nur die Qualität des finalen Prosa-Outputs.
Wissensarbeit und technisches Schlussfolgern
Grok 4.6 führt die Vergleichsmenge bereits bei GDPVal-AA v2 an. Grok 4.7 sollte diesen Vorteil bewahren und die Übertragung auf Design-Reviews, Forschungssynthese, Debugging, Optimierung und andere komplexe technische Aufgaben verbessern.
Token-Effizienz
Ein größeres Modell kann pro erfolgreicher Aufgabe dennoch günstiger sein, wenn es mit weniger Schritten zum korrekten Ergebnis gelangt. Vergleichen Sie Gesamt-Input, gecachten Input, Output-Tokens, Retries und Kosten für dasselbe akzeptierte Resultat.
Serving-Trade-offs
Wenn Grok 4.7 langsamer ist, müssen Qualitätsgewinne die Latenz überwiegen. Protokollieren Sie Time-to-First-Token, sustained Throughput, Walltime zur Aufgabenfertigstellung, Fehlerrate und Kosten unter realistischer Parallelität.
Grok 4.7 Benchmarks: 5 Tests zur Verifizierung eines echten Upgrades gegenüber Grok 4.6
- Erfolg in der Software-Engineering-Praxis: Gelöste Issues, bestandene Tests, Regressionsrate und Patch-Akzeptanz auf repräsentativen Repositories messen.
- Langhorizontige Agenten-Zuverlässigkeit: Abgeschlossene Workflows, Tool-Call-Fehler, Retries, Recovery und menschliche Eingriffe über mehrstufige Läufe verfolgen.
- Realer Engineering-Transfer: Design, Debugging, Optimierung, wissenschaftliches Schlussfolgern und CAD-Aufgaben mit offengelegten Bewertungskriterien testen.
- Token-Effizienz pro erfolgreicher Aufgabe: Gesamt-Tokens und Ausgaben vergleichen, die für dasselbe akzeptierte Ergebnis nötig sind.
- Latenz und Kosten unter Produktionslast: Time-to-First-Token, Durchsatz, Walltime, Fehlerrate und Kosten bei realistischer Parallelität evaluieren.
Was Entwickler vor dem 12. September tun sollten – und wie CometAPI passt
Pre-Launch Developer Checklist
- Ein festes Evaluations-Set aus realen Coding-, Research-, Engineering- und Agent-Workflows erstellen.
- Gegen Grok 4.6 laufen lassen und Erfolgsrate, Retries, Tool-Aufrufe, Latenz, Tokens und Gesamtkosten protokollieren.
- Modellauswahl konfigurierbar halten und keine provisorische Grok 4.7-Kennung hardcoden.
- xAI Release Notes und die CometAPI-Modellseite auf bestätigte Verfügbarkeit beobachten.
- Nach dem Launch Kontext, Modalitäten, Reasoning-Controls, Preise, Ratenlimits und Rollout-Umfang verifizieren.
- Dasselbe Evaluations-Set erneut abspielen, bevor Produktionsverkehr umgeleitet wird.
CometAPI bietet eine einheitliche API-Schicht, um mit einem Account und einem Integrationsmuster auf mehrere AI-Model-Provider zuzugreifen. Eine Grok 4.7 Tracking-Seite ist bereits verfügbar. CometAPI wird Grok 4.7 integrieren, sobald xAI das Modell offiziell freigibt und Produktionszugang verfügbar ist.
Bis dahin sollten alle Vorab-Kennungen, Preise oder Fähigkeitsfelder als vorläufig betrachtet werden. Bevor Produktionsverkehr gesendet wird, bestätigen Sie, dass die Route live ist, eine echte Anfrage erfolgreich ist, das zurückgelieferte Modell die beabsichtigte Version ist und die aktuellen Preise in der Konsole sichtbar sind.
Grok 4.7 Preis-Ausblick vs. Grok 4.6
Der veröffentlichte Standardtarif für Grok 4.6 beträgt $2 pro 1 Million Input-Tokens und $6 pro 1 Million Output-Tokens unterhalb der Long-Context-Schwelle. xAIs Release Notes listen höhere Sätze für Anfragen über 200.000 Prompt-Tokens. Preise für Grok 4.7 wurden noch nicht offiziell angekündigt.
| Veröffentlichte Preisbasis | Input / 1 Mio | Output / 1 Mio | Status |
|---|---|---|---|
| Grok 4.6, Prompt unter 200K | $2 | $6 | Veröffentlicht |
| Grok 4.6, Prompt über 200K | $4 | $12 | Veröffentlichter Long-Context-Tarif |
| Grok 4.7 | Nicht bekannt | Nicht bekannt | Nach offiziellem Launch bestätigen |
Drei Preisrichtungen bleiben plausibel: Parität mit Grok 4.6 zur Beschleunigung der Adoption, ein Premium-Tarif, falls die Serving-Kosten deutlich höher sind, oder separate Sätze nach Context-Länge und Geschwindigkeit. Dies sind Planungsszenarien, keine xAI-Prognose.
Pre-Launch Developer Checklist
- Ein festes Evaluations-Set aus realen Coding-, Research-, Engineering- und Agent-Workflows erstellen.
- Gegen Grok 4.6 laufen lassen und Erfolgsrate, Retries, Tool-Aufrufe, Latenz, Tokens und Gesamtkosten protokollieren.
- Modellauswahl konfigurierbar halten und keine provisorische Grok 4.7-Kennung hardcoden.
- xAI Release Notes und die CometAPI-Modellseite auf bestätigte Verfügbarkeit beobachten.
- Nach dem Launch Kontext, Modalitäten, Reasoning-Controls, Preise, Ratenlimits und Rollout-Umfang verifizieren.
- Dasselbe Evaluations-Set erneut abspielen, bevor Produktionsverkehr umgeleitet wird.
Grok 4.7: Was als Nächstes zu beobachten ist
Vier Ereignisse würden den aktuellen Countdown in einen verifizierbaren Produkt-Launch verwandeln: ein offizieller xAI-Release-Post; Modelldokumentation zu Kontext, Modalitäten und Reasoning-Controls; finale API-Preise und Modellkennungen; sowie reproduzierbare Benchmarks oder Produktions-Evaluationen.
Die nützlichste Launch-Frage ist nicht, ob 2,1T groß klingt. Sondern ob Grok 4.7 schwierige Engineering- und Agenten-Aufgaben zuverlässiger erledigt – und zu besseren Kosten pro erfolgreichem Outcome – als die veröffentlichte Baseline.
FAQ
Wann wird Grok 4.7 voraussichtlich veröffentlicht?
Musks zehntägiger Countdown vom 2. September deutet auf ungefähr den 12. September 2026 hin. Dies ist ein abgeleitetes Ziel, kein separat veröffentlichter xAI-Kalendereintrag.
Wurde Grok 4.7 bereits veröffentlicht?
Grok 4.7 wurde öffentlich angeteasert/angekündigt, hat aber noch keine vollständige offizielle API-/Modell-Dokumentation erhalten.
Ist Grok 4.7 ein Modell mit 2,1 Billionen Parametern?
Musk hat es als ungefähr 2,1T Parameter beschrieben. xAI hat noch kein Architekturdokument veröffentlicht, das aktive Parameter oder Routing-Details bestätigt.
Wird Grok 4.7 besser sein als Grok 4.6?
Musk hat eine erhebliche Verbesserung behauptet, aber es existiert keine offizielle Grok 4.7 Benchmark-Tabelle. Behandeln Sie die Aussage als unbestätigt, bis reproduzierbare Ergebnisse verfügbar sind.
Wird Grok 4.7 über CometAPI verfügbar sein?
Eine CometAPI Tracking-Seite existiert bereits, doch finale Verfügbarkeit, Kennung, Preise und unterstützte Formate sollten nach dem offiziellen Launch bestätigt werden.
Schlussfolgerung
Die Geschichte um Grok 4.7 hat sich von einer groben Schätzung für Anfang September zu einem konkreten Countdown entwickelt. Musks jüngste Aussage deutet auf etwa den 12. September 2026 hin, während frühere Beiträge ein ungefähr 2,1T-Modell und ergänzendes Training mit umfangreichen SpaceX-Unternehmensdaten beschreiben.
Das sind ungewöhnlich spezifische Vorab-Signale, aber keine Model Card, keine Benchmark-Suite und kein API-Vertrag. Entwickler sollten Grok 4.6 als messbare Baseline beibehalten, jetzt eine kontrollierte Evaluation vorbereiten und auf Bestätigungen von xAI und CometAPI zur Produktionsfreigabe warten, bevor Migrations- oder Budgetentscheidungen getroffen werden.
