GPT-5.6 Luna price down 80%, Terra down 20% →

Grok 5 是什麼?預期規格、功能與效能

CometAPI
AnnaAug 8, 2026
Grok 5 是什麼?預期規格、功能與效能

重點摘要

Grok 5 是 SpaceXAI 的次世代前沿模型。xAI 於 2026 年 1 月確認該模型正在訓練,隨後的一份SpaceX 提交給美國證券交易委員會的文件指出 COLOSSUS II 為其訓練平台。

Elon Musk 曾公開談到目標規模約 6 兆參數,並支援涵蓋文字、影像、影片與音訊的多模態。在 SpaceX 2026 年 8 月的財報電話會議上,他表示 Grok 5 計劃於 2026 年底前發佈,並將納入約 25 年的 SpaceX 資料。該更新由 CLSME News 報導。

同樣重要的是未公開的部分:xAI 尚未釋出模型卡、基準測試結果、API 定價、上下文視窗規格、有效參數數量或最終的存取方案。這些未解問題被整合於「我們尚未知曉的部分」,而非在全文中作為已定規格分散呈現。

關鍵要點

  • xAI 已確認 Grok 5 正在訓練中。
  • Musk 描述了約 6 兆參數的目標規模,並支援文字、影像、影片與音訊輸入。
  • 一份SpaceX 向美國證券交易委員會提交的文件將 Grok 5 與 COLOSSUS II 連結,並描述使用 NVIDIA GB200 與 GB300 系統持續擴充。
  • SpaceX 表示下一階段的 COLOSSUS II 擴充設計將新增至少 220,000 顆 GB300 處理器,以及超過 400 兆瓦的運算容量。
  • Musk 表示 Grok 5 將以 SpaceX 近約 25 年的資料為訓練基礎。
  • 最新的公開目標是於 2026 年底前發佈,位於計劃中的 Grok 4.6 與 Grok 4.7 更新之後。
  • 架構、上下文長度、基準表現、API 定價、產品層級與確切發佈日期仍未披露。

什麼是 Grok 5?

Grok 5 是 Grok 家族中下一個主要的基礎模型。它承接了 Grok 4.5,SpaceXAI 將其定位於程式設計、代理型任務與知識工作。

第一份較為詳細的公開描述出現在 Elon Musk 於 2025 年在 Baron Investment Conference 的對談中。Musk 談到一個目標約 6 兆參數、可跨文字、影像、影片與音訊運作的模型。之後在 NxCodeGrokipedia 的 Grok 5 參考頁出現了次級摘要。

更正式的確認來自 xAI 宣布 Grok 5 正在訓練。隨後的SpaceX 證券文件將該模型與 COLOSSUS II 連結,並描述次世代 Grok 系統以更強的推理準確度、更深的多模態整合與更佳的專領域表現為目標。

最新的公開更新出自 2026 年 8 月 4 日的 SpaceX 財報電話會議。Musk 表示 Grok 5 目標在年底前推出,並將使用約四分之一世紀累積的完整 SpaceX 資料語料。這使該模型位於 xAI 的通用 AI 工作、X 的即時資訊環境與 SpaceX 的工程運作的交會點。

圖 1. SpaceX 的官方 AI 業務總覽連結了運算基礎設施、前沿模型與即時資料。 來源:SpaceX SEC roadshow presentation

Grok 5 有哪些新內容?

6 兆參數的目標

Musk 所述約 6 兆參數的目標會讓 Grok 5 遠高於先前 Grok 世代公開談到的規模。該數字應視為開發目標:xAI 尚未公布最終的參數總數、有效參數數量或部署配置。

xAI 先前具有稀疏專家模型的經驗。其開放的 Grok-1 釋出是一個 3,140 億參數的專家混合模型,每個 token 僅啟用部分權重。這段歷史與 Grok 5 相關,但並不代表未發佈模型的最終架構。

COLOSSUS II 與 SpaceX 工程資料

SpaceX 的證券文件指出,COLOSSUS II 正用於次世代前沿模型訓練,包括 Grok 5。文件同時描述了大規模的 GB200 與 GB300 部署,以及進一步擴充以新增至少 220,000 顆 GB300 處理器。

Musk 也表示該模型將納入約 25 年的 SpaceX 資料。這份語料的重要性在於它可能不僅包含完成的技術文件,還涵蓋設計決策、測試結果、故障調查、軟體修訂、製造紀錄與驗證工作。

這些披露提供了 xAI 強調工程與專領域表現的明確理由。然而,哪些資料集會被納入、如何篩選、以及該語料在前訓練、後訓練或檢索中的使用比例,尚未揭示。

多模態方向

Musk 將 Grok 5 描述為跨越文字、影像、影片與音訊。SpaceX 的文件也分別指出更深的多模態整合是其次世代前沿模型的目標。

此方向與 xAI 的更大產品生態系一致,其已包含語音、影像與影片功能。公開披露確立了多模態作為目標,但仍未具體說明 Grok 5 會使用單一統一模型來支援所有模態,或是協調多個專門元件。

強化學習、搜尋與代理

官方的 Grok 4.5 宣佈顯示了 xAI 的後訓練方向。Grok 4.5 在數十萬個任務上進行訓練,重點放在多步驟的軟體工程與技術工作。部分代理式試運行持續數小時,並透過自動化與基於模型的評分進行評估。

目前的 Grok 產品亦支援網頁搜尋、X 搜尋、函式呼叫與程式碼執行。Grok 開發者文件將這些工具視為現有模型生態系的一部分,而 xAI 的多代理文件則描述了可並行運作的研究代理,能搜尋、分析、交叉核對並綜整資訊。

這些能力提供了理解 xAI 方向的事實基線。Grok 5 是否會原生整合、擴展,或作為獨立服務封裝,尚未披露。

我們尚未知曉的部分

Grok 5 已獲公開確認,但其最終產品規格仍多未披露。以下要點是基於 xAI 現有模型、當前定價、公開基礎設施與產品策略的知情推測,不應被視為已宣布的 Grok 5 規格。

領域已公開資訊目前推測
架構尚未公布 Grok 5 架構。稀疏 MoE 設計可行,但尚未確認。
上下文視窗尚無官方 Grok 5 上下文長度。500K–1M tokens 為合理的規劃範圍。
效能尚無 Grok 5 基準測試。最大 提升可能出現在長時程代理與工程任務。
API 定價尚無定價或價目表。可能高於 Grok 4.5,且 Heavy 或代理模式成本更高。
產品變體尚未公布 Grok 5 產品線。標準、 Heavy 與多代理層級皆屬可行。
發佈與存取目標是在 2026 年底前推出。可能先行分階段預覽,隨後開放 API 與企業存取。

架構與有效參數

稀疏的專家混合架構是主要推測,因為它能讓多兆參數模型更可行地訓練與服務。Grok-1 提供了前例,但自那次釋出後,xAI 可能已在路由、注意力、記憶或多模態設計上有實質改動。

6 兆參數的數字也未揭示每個 token 實際啟用多少參數。這一差異將決定推理成本、延遲、硬體需求與模型規模的實際意義。

上下文視窗

Grok 4.5 支援50 萬 token 的上下文視窗,而 xAI 的多代理研究系統已在百萬 token 的層級運作。因此,Grok 5 採用 50 萬至 100 萬 token 的範圍屬合理推測,特別針對大型程式碼庫、多模態檔案與長時間任務。

最終的數字可能不如有效召回、上下文壓縮、延遲與價格重要。若模型無法可靠地從長上下文中取回細節,或長上下文的使用成本高昂,即便名義上達到百萬 token 也價值有限。

效能

Grok 5 尚無公開的基準測試結果。Grok 4.5 的官方分數提供了基準:Terminal-Bench 2.1 為 83.3%,SWE-bench Pro 為 64.7%,DeepSWE 1.0 為 62.0%,DeepSWE 1.1 為 53.0%,SWE Marathon 為 29.0%。

Grok 5 是什麼?預期規格、功能與效能

圖 4. Grok 4.5 工程基準測試基線,依 SpaceXAI 公布的官方結果重建。 來源:Introducing Grok 4.5 這些是 Grok 4.5 的結果,非 Grok 5 的分數。

合理的發佈期望是終端工作、多檔案軟體變更與長時間工程任務的可靠性提升。最具意義的進步,可能出現在任務完成、錯誤恢復、重複工具使用,以及多模態證據綜整,而非傳統的單回合基準。

具體分數目標——例如 Terminal-Bench 的 80% 高位,或 SWE-bench Pro 的 70% 低至中位——在 xAI 釋出評估結果與測試細節前仍屬臆測。

API 定價

目前 Grok 4.5 的價格為每百萬輸入 tokens 2 美元、每百萬輸出 tokens 6 美元,超出已公布門檻的長上下文費率更高。

Grok 5 很可能因其規模與推理工作量而具溢價。對於標準模型,約每百萬輸入 tokens $3–$5、每百萬輸出 tokens $10–$15 的規劃範圍可被辯護,但並非已公布的費率。

Heavy 或多代理使用可能透過更高的 token 費率、代理總用量、推理工作量或運算時間計價。xAI 也可能如同 Grok 4.5 一樣,透過積極的價格-效能競爭來制定標準模型價格。

產品變體與多代理模式

xAI 已經營 Heavy 推理與多代理研究產品,因此 Grok 5 採用分層產品線屬合理推測。標準模型可處理日常請求,而 Heavy 或多代理模式可為艱難的研究、編碼或工程工作配置更多推理 tokens 與平行代理。

代理數量可能從固定轉為動態。然而,xAI 尚未宣布這些能力會成為 Grok 5 的基礎功能、獨立端點、訂閱功能,或由模型外的協同編排層提供。

競爭定位與可能的使用情境

Grok 5 最可能在軟體工程、技術研究、即時資訊分析與多模態代理工作流程中正面競爭。SpaceX 資料可能在物理工程與系統分析上帶來差異化,而對 X 的原生存取可強化即時研究。

可能的使用情境包括大型版本庫的程式開發、測試與故障分析、設計審查、技術文件綜整、多模態診斷、市場與新聞研究,以及結合搜尋、程式碼執行、檔案與長時代理的工作流程。

這些優勢最終仍取決於執行品質。專門化資料不會自動保證更佳的工程判斷,即時資訊也不會自動保證事實準確性。可靠性、來源驗證、延遲與成本,將決定 Grok 5 能否成為其他前沿模型的實用替代方案。

確切發佈日期與存取

公開的目標是在 2026 年底前發佈。CLSME News 的報導指出,Grok 4.6 與 Grok 4.7 預計會先行推出。

此順序指向第四季的發佈,但尚未確立具體的月份或日期。11 月或 12 月屬於可想像的時間點,而非已確認。

依據先前的 Grok 發佈,存取可能先透過 grok.com、Grok 行動應用、X Premium+ 或 SuperGrok 層級,以及特選合作夥伴,之後才擴大至更廣泛的 API 與企業可用性。CometAPI 與其他模型閘道可能在官方 API 存取存在後加入該模型,但尚無整合時程的公告。

關鍵區別相當明確:Grok 5 的存在、訓練平台、參數目標、多模態志向、SpaceX 資料計畫與年底發佈目標已公開;其最終架構、上下文長度、效能、定價、產品包裝與發佈機制尚未公開。Grok 5 是什麼?預期規格、功能與效能

0 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多