重點摘要
Grok 5 是 SpaceXAI 的次世代前沿模型。xAI 於 2026 年 1 月確認該模型正在訓練,隨後的一份SpaceX 提交給美國證券交易委員會的文件指出 COLOSSUS II 為其訓練平台。
Elon Musk 曾公開談到目標規模約 6 兆參數,並支援涵蓋文字、影像、影片與音訊的多模態。在 SpaceX 2026 年 8 月的財報電話會議上,他表示 Grok 5 計劃於 2026 年底前發佈,並將納入約 25 年的 SpaceX 資料。該更新由 CLS 與 ME News 報導。
同樣重要的是未公開的部分:xAI 尚未釋出模型卡、基準測試結果、API 定價、上下文視窗規格、有效參數數量或最終的存取方案。這些未解問題被整合於「我們尚未知曉的部分」,而非在全文中作為已定規格分散呈現。
關鍵要點
- xAI 已確認 Grok 5 正在訓練中。
- Musk 描述了約 6 兆參數的目標規模,並支援文字、影像、影片與音訊輸入。
- 一份SpaceX 向美國證券交易委員會提交的文件將 Grok 5 與 COLOSSUS II 連結,並描述使用 NVIDIA GB200 與 GB300 系統持續擴充。
- SpaceX 表示下一階段的 COLOSSUS II 擴充設計將新增至少 220,000 顆 GB300 處理器,以及超過 400 兆瓦的運算容量。
- Musk 表示 Grok 5 將以 SpaceX 近約 25 年的資料為訓練基礎。
- 最新的公開目標是於 2026 年底前發佈,位於計劃中的 Grok 4.6 與 Grok 4.7 更新之後。
- 架構、上下文長度、基準表現、API 定價、產品層級與確切發佈日期仍未披露。
什麼是 Grok 5?
Grok 5 是 Grok 家族中下一個主要的基礎模型。它承接了 Grok 4.5,SpaceXAI 將其定位於程式設計、代理型任務與知識工作。
第一份較為詳細的公開描述出現在 Elon Musk 於 2025 年在 Baron Investment Conference 的對談中。Musk 談到一個目標約 6 兆參數、可跨文字、影像、影片與音訊運作的模型。之後在 NxCode 與 Grokipedia 的 Grok 5 參考頁出現了次級摘要。
更正式的確認來自 xAI 宣布 Grok 5 正在訓練。隨後的SpaceX 證券文件將該模型與 COLOSSUS II 連結,並描述次世代 Grok 系統以更強的推理準確度、更深的多模態整合與更佳的專領域表現為目標。
最新的公開更新出自 2026 年 8 月 4 日的 SpaceX 財報電話會議。Musk 表示 Grok 5 目標在年底前推出,並將使用約四分之一世紀累積的完整 SpaceX 資料語料。這使該模型位於 xAI 的通用 AI 工作、X 的即時資訊環境與 SpaceX 的工程運作的交會點。
圖 1. SpaceX 的官方 AI 業務總覽連結了運算基礎設施、前沿模型與即時資料。 來源:SpaceX SEC roadshow presentation
Grok 5 有哪些新內容?
6 兆參數的目標
Musk 所述約 6 兆參數的目標會讓 Grok 5 遠高於先前 Grok 世代公開談到的規模。該數字應視為開發目標:xAI 尚未公布最終的參數總數、有效參數數量或部署配置。
xAI 先前具有稀疏專家模型的經驗。其開放的 Grok-1 釋出是一個 3,140 億參數的專家混合模型,每個 token 僅啟用部分權重。這段歷史與 Grok 5 相關,但並不代表未發佈模型的最終架構。
COLOSSUS II 與 SpaceX 工程資料
SpaceX 的證券文件指出,COLOSSUS II 正用於次世代前沿模型訓練,包括 Grok 5。文件同時描述了大規模的 GB200 與 GB300 部署,以及進一步擴充以新增至少 220,000 顆 GB300 處理器。
Musk 也表示該模型將納入約 25 年的 SpaceX 資料。這份語料的重要性在於它可能不僅包含完成的技術文件,還涵蓋設計決策、測試結果、故障調查、軟體修訂、製造紀錄與驗證工作。
這些披露提供了 xAI 強調工程與專領域表現的明確理由。然而,哪些資料集會被納入、如何篩選、以及該語料在前訓練、後訓練或檢索中的使用比例,尚未揭示。
多模態方向
Musk 將 Grok 5 描述為跨越文字、影像、影片與音訊。SpaceX 的文件也分別指出更深的多模態整合是其次世代前沿模型的目標。
此方向與 xAI 的更大產品生態系一致,其已包含語音、影像與影片功能。公開披露確立了多模態作為目標,但仍未具體說明 Grok 5 會使用單一統一模型來支援所有模態,或是協調多個專門元件。
強化學習、搜尋與代理
官方的 Grok 4.5 宣佈顯示了 xAI 的後訓練方向。Grok 4.5 在數十萬個任務上進行訓練,重點放在多步驟的軟體工程與技術工作。部分代理式試運行持續數小時,並透過自動化與基於模型的評分進行評估。
目前的 Grok 產品亦支援網頁搜尋、X 搜尋、函式呼叫與程式碼執行。Grok 開發者文件將這些工具視為現有模型生態系的一部分,而 xAI 的多代理文件則描述了可並行運作的研究代理,能搜尋、分析、交叉核對並綜整資訊。
這些能力提供了理解 xAI 方向的事實基線。Grok 5 是否會原生整合、擴展,或作為獨立服務封裝,尚未披露。
我們尚未知曉的部分
Grok 5 已獲公開確認,但其最終產品規格仍多未披露。以下要點是基於 xAI 現有模型、當前定價、公開基礎設施與產品策略的知情推測,不應被視為已宣布的 Grok 5 規格。
| 領域 | 已公開資訊 | 目前推測 |
|---|---|---|
| 架構 | 尚未公布 Grok 5 架構。 | 稀疏 MoE 設計可行,但尚未確認。 |
| 上下文視窗 | 尚無官方 Grok 5 上下文長度。 | 500K–1M tokens 為合理的規劃範圍。 |
| 效能 | 尚無 Grok 5 基準測試。 | 最大 提升可能出現在長時程代理與工程任務。 |
| API 定價 | 尚無定價或價目表。 | 可能高於 Grok 4.5,且 Heavy 或代理模式成本更高。 |
| 產品變體 | 尚未公布 Grok 5 產品線。 | 標準、 Heavy 與多代理層級皆屬可行。 |
| 發佈與存取 | 目標是在 2026 年底前推出。 | 可能先行分階段預覽,隨後開放 API 與企業存取。 |
架構與有效參數
稀疏的專家混合架構是主要推測,因為它能讓多兆參數模型更可行地訓練與服務。Grok-1 提供了前例,但自那次釋出後,xAI 可能已在路由、注意力、記憶或多模態設計上有實質改動。
6 兆參數的數字也未揭示每個 token 實際啟用多少參數。這一差異將決定推理成本、延遲、硬體需求與模型規模的實際意義。
上下文視窗
Grok 4.5 支援50 萬 token 的上下文視窗,而 xAI 的多代理研究系統已在百萬 token 的層級運作。因此,Grok 5 採用 50 萬至 100 萬 token 的範圍屬合理推測,特別針對大型程式碼庫、多模態檔案與長時間任務。
最終的數字可能不如有效召回、上下文壓縮、延遲與價格重要。若模型無法可靠地從長上下文中取回細節,或長上下文的使用成本高昂,即便名義上達到百萬 token 也價值有限。
效能
Grok 5 尚無公開的基準測試結果。Grok 4.5 的官方分數提供了基準:Terminal-Bench 2.1 為 83.3%,SWE-bench Pro 為 64.7%,DeepSWE 1.0 為 62.0%,DeepSWE 1.1 為 53.0%,SWE Marathon 為 29.0%。

圖 4. Grok 4.5 工程基準測試基線,依 SpaceXAI 公布的官方結果重建。 來源:Introducing Grok 4.5 這些是 Grok 4.5 的結果,非 Grok 5 的分數。
合理的發佈期望是終端工作、多檔案軟體變更與長時間工程任務的可靠性提升。最具意義的進步,可能出現在任務完成、錯誤恢復、重複工具使用,以及多模態證據綜整,而非傳統的單回合基準。
具體分數目標——例如 Terminal-Bench 的 80% 高位,或 SWE-bench Pro 的 70% 低至中位——在 xAI 釋出評估結果與測試細節前仍屬臆測。
API 定價
目前 Grok 4.5 的價格為每百萬輸入 tokens 2 美元、每百萬輸出 tokens 6 美元,超出已公布門檻的長上下文費率更高。
Grok 5 很可能因其規模與推理工作量而具溢價。對於標準模型,約每百萬輸入 tokens $3–$5、每百萬輸出 tokens $10–$15 的規劃範圍可被辯護,但並非已公布的費率。
Heavy 或多代理使用可能透過更高的 token 費率、代理總用量、推理工作量或運算時間計價。xAI 也可能如同 Grok 4.5 一樣,透過積極的價格-效能競爭來制定標準模型價格。
產品變體與多代理模式
xAI 已經營 Heavy 推理與多代理研究產品,因此 Grok 5 採用分層產品線屬合理推測。標準模型可處理日常請求,而 Heavy 或多代理模式可為艱難的研究、編碼或工程工作配置更多推理 tokens 與平行代理。
代理數量可能從固定轉為動態。然而,xAI 尚未宣布這些能力會成為 Grok 5 的基礎功能、獨立端點、訂閱功能,或由模型外的協同編排層提供。
競爭定位與可能的使用情境
Grok 5 最可能在軟體工程、技術研究、即時資訊分析與多模態代理工作流程中正面競爭。SpaceX 資料可能在物理工程與系統分析上帶來差異化,而對 X 的原生存取可強化即時研究。
可能的使用情境包括大型版本庫的程式開發、測試與故障分析、設計審查、技術文件綜整、多模態診斷、市場與新聞研究,以及結合搜尋、程式碼執行、檔案與長時代理的工作流程。
這些優勢最終仍取決於執行品質。專門化資料不會自動保證更佳的工程判斷,即時資訊也不會自動保證事實準確性。可靠性、來源驗證、延遲與成本,將決定 Grok 5 能否成為其他前沿模型的實用替代方案。
確切發佈日期與存取
公開的目標是在 2026 年底前發佈。CLS 與 ME News 的報導指出,Grok 4.6 與 Grok 4.7 預計會先行推出。
此順序指向第四季的發佈,但尚未確立具體的月份或日期。11 月或 12 月屬於可想像的時間點,而非已確認。
依據先前的 Grok 發佈,存取可能先透過 grok.com、Grok 行動應用、X Premium+ 或 SuperGrok 層級,以及特選合作夥伴,之後才擴大至更廣泛的 API 與企業可用性。CometAPI 與其他模型閘道可能在官方 API 存取存在後加入該模型,但尚無整合時程的公告。
關鍵區別相當明確:Grok 5 的存在、訓練平台、參數目標、多模態志向、SpaceX 資料計畫與年底發佈目標已公開;其最終架構、上下文長度、效能、定價、產品包裝與發佈機制尚未公開。
