Gemini 3.8 Flash and Claude Fable 5.1 are now live on CometAPI →
technology/CometAPI 研究

Grok API 定價 2026:Grok 4.5、Token 成本與工具費用

Grok API 定價,適用於 Grok 4.5、Grok 4.3、Grok Build、Imagine、Voice、工具費用、批次折扣、優先處理與成本追蹤。

CometAPI
Mia MarenAI 模型與 API 研究團隊
更新於 Sep 3, 2026 8 分鐘閱讀
Grok API 定價 2026:Grok 4.5、Token 成本與工具費用
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR Grok API 的定價不只是單一的 token 表格。xAI 目前的 API 陣容包含 grok-4.5(每 1M input/cached-input/output tokens 分別為 $2 / $0.50 / $6)、grok-4.3$1.25 / $0.20 / $2.50),以及專注程式的 grok-build-0.1$1.00 / $0.20 / $2.00)。

隱藏成本是基礎模型行之外的所有東西:Web Search、X Search、Code Execution、Imagine、Voice、優先處理、批次模式、儲存、重試,以及使用指南違規費,都可能改變最終帳單。

對建置者而言,實際的問題不是「Grok 便宜嗎?」而是:「哪個 Grok 模型、工具與服務等級,能在每個成功任務上達到最低成本?」

Grok API 定價速覽

ItemCurrent xAI API detail
Latest flagship modelgrok-4.5
Lower-cost chat routegrok-4.3
Coding modelgrok-build-0.1
Best first tests聊天、程式代理、以搜尋為基礎的工作流程、影像/影片生成
Grok 4.5 context500k tokens
Grok 4.3 context1M tokens
Grok Build context256k tokens
Grok 4.5 price每 1M tokens:輸入 $2.00 / 快取輸入 $0.50 / 輸出 $6.00
Grok 4.3 price每 1M tokens:輸入 $1.25 / 快取輸入 $0.20 / 輸出 $2.50
Grok Build price每 1M tokens:輸入 $1.00 / 快取輸入 $0.20 / 輸出 $2.00
Tool cost caveatWeb Search、X Search、Code Execution 各為 $5 / 1k calls
Priority cost caveat套用優先處理時,token 定價為標準的 2 倍
Required telemetrytokens、cached tokens、reasoning tokens、tool calls、priority tier、cost_in_usd_ticks、success rate

影響 Grok 帳單的三個數字

  • 每 1M tokens 的快取輸入 $0.20–$0.50:對重複長提示很重要。
  • $5 / 1k 的 Web Search、X Search、或 Code Execution 呼叫:工具密集的代理,工具費可能高於 token。
  • 2x 優先 token 定價:優先處理是延遲特性,而不是預設。

為什麼 Grok API 成本不只看 token 單價

標題的 token 費率只能解釋 Grok API 帳單的一部分。以搜尋為基礎與代理式工作流程可能還會產生伺服器端工具費;而優先處理、媒體生成、儲存、重試,以及使用指南違規費,會改變每個成功任務的有效成本。

實際上線內容

xAI 的 Grok 4.5 文件與定價頁面列出 grok-4.5 為最新旗艦模型,提供 500k 的上下文視窗,定價為每 1M tokens:輸入 $2、快取輸入 $0.50、輸出 $6模型頁面將 Grok 4.5 定位為程式、工具呼叫與知識工作的旗艦路線;同時 Grok 4.3 保持為成本較低、1M 上下文的路線,而 Grok Build 在程式導向測試上仍具意義。

Grok API 定價 2026:Grok 4.5、Token 成本與工具費用

來源:xAI Grok 4.5 文件

對建置者而言,關鍵改變在於「latest」與「best route」不再是同一個決策。Grok 4.5 是新的前沿選項,但對長上下文或高流量工作負載,Grok 4.3 仍可能是成本更佳的路線。若需更深入的觀點,CometAPI 的 Grok 4.5 架構、 版本時間線與可用性概覽可提供更多背景。

開發者在討論什麼

此處引用的公開討論,焦點不是標題的 token 費率,而是複合使用、工具呼叫、速度與政策相關的請求成本。Hacker News 上的 Grok 4.3 討論r/grok 的 Grok API 定價討論提供了實務訊號,但本文的定價數據以 xAI 官方文件為準。

Grok API 定價表

xAI 的定價文件以美元列示,並區分程式、聊天、Imagine、Voice、工具、批次與優先處理。

API areaModel or modeContext / unitPrice
Code APIgrok-build-0.1256k context每 1M tokens:輸入 $1.00 / 快取輸入 $0.20 / 輸出 $2.00
Chat APIgrok-4.5500k context每 1M tokens:輸入 $2.00 / 快取輸入 $0.50 / 輸出 $6.00
Chat APIgrok-4.31M context每 1M tokens:輸入 $1.25 / 快取輸入 $0.20 / 輸出 $2.50
Chat APIgrok-4.20-multi-agent-03091M context每 1M tokens:輸入 $1.25 / 快取輸入 $0.20 / 輸出 $2.50
Chat APIgrok-4.20-0309-reasoning1M context每 1M tokens:輸入 $1.25 / 快取輸入 $0.20 / 輸出 $2.50
Chat APIgrok-4.20-0309-non-reasoning1M context每 1M tokens:輸入 $1.25 / 快取輸入 $0.20 / 輸出 $2.50
Voice APIRealtime Text Inputper message每則訊息 $0.004
Voice APIRealtimeper minute / hour每分鐘 $0.05,或每小時 $3.00
Voice APIText to Speechcharacters每 1M 字元 $15.00
Voice APISpeech to Textaudio hourREST 每小時 $0.10、串流每小時 $0.20

Grok 4.5 與其他主流 API 的價格比較

基礎 token 一行會讓 Grok 4.5 看起來比部分前沿路線更便宜,但比 Grok 4.3 貴。以下比較使用 2026 年 7 月 10 日各供應商官方頁面的文字定價,僅作快照參考,不應單獨決定路由。

ProviderModelInput priceCached inputOutput pricePricing note
xAIgrok-4.5$2.00 / 1M$0.50 / 1M$6.00 / 1M最新 Grok 旗艦
xAIgrok-4.3$1.25 / 1M$0.20 / 1M$2.50 / 1M成本較低的 Grok 聊天路線
OpenAIgpt-5.6$5.00 / 1M$0.50 / 1M$30.00 / 1M標準短上下文定價;Batch/Flex 低 50%
Anthropicclaude-sonnet-5$2.00 intro, then $3.00 / 1M$0.20 intro, then $0.30 / 1M cached read$10.00 intro, then $15.00 / 1M新品導入價至 2026/08/31
Googlegemini-3.1-pro-preview$1.25 / 1M, or $2.50 over 200k prompts$0.125 / 1M, or $0.25 over 200k prompts$10.00 / 1M, or $15.00 over 200k prompts輸出包含 thinking tokens

結論很簡單:Grok 4.5 不是最便宜的 Grok 路線,但其輸出單價低於若干高階文字模型。進入生產時,請比較「每個成功任務的總成本」,而不僅是輸入/輸出 token 行。

對影像與影片生成,計價單位從 tokens 改為圖片或秒數:

Imagine modelInput costOutput cost
grok-imagine-image-quality每張輸入影像 $0.01每張 1K 影像 $0.05、2K 影像 $0.07
grok-imagine-image每張輸入影像 $0.002每張 1K 或 2K 影像 $0.02
grok-imagine-video-1.5每張輸入影像 $0.01480p 每秒 $0.08、720p 每秒 $0.14、1080p 每秒 $0.25
grok-imagine-video每張輸入影像 $0.002、每秒輸入 $0.01480p 每秒 $0.05、720p 每秒 $0.07

若團隊測試的是媒體工作流程而非純文字聊天,CometAPI 的 Grok Imagine Video API 模型頁比單看聊天模型定價表更合適。

隱藏成本層:伺服器端工具

Grok API 可使用伺服器端工具,這些工具並非免費。定價頁指出,使用 xAI 提供工具的請求,會從兩部分計費:模型 token 使用,以及工具呼叫。

ToolTool nameCost
Web Searchweb_search$5 / 1k calls
X Searchx_search$5 / 1k calls
Code Executioncode_execution, code_interpreter$5 / 1k calls
File Attachmentsattachment_search$10 / 1k calls
Collections Searchcollections_search, file_search$2.50 / 1k calls
Image Understandingview_imageToken-based
X Video Understandingview_x_videoToken-based
Remote MCP Tools由各 MCP 伺服器定義的工具名稱無呼叫費;按 token 計費

這是本文對於打造以搜尋為基礎或代理式應用的團隊而言最重要的一段。一個簡單回答可能很便宜;而工具密集的回答,可能同時包含輸入 tokens、思考 tokens、輸出 tokens、搜尋呼叫、程式執行呼叫、檔案搜尋呼叫,以及快取提示 tokens。

請用這個實務視角來規劃:

工作流程成本 = 請求成本 + 重試請求成本 + 儲存與下載成本 + 適用的使用指南違規費

對於每個請求,token 定價、伺服器端工具呼叫、提示快取,以及任一套用的優先溢價,都已反映在 cost_in_usd_ticks

如果一個流程在每個回合都同時使用 Web Search 與 X Search,工具呼叫那一行的重要性,可能不下於模型那一行。

xAI 的定價文件也列出了使用指南違規費:若請求被判定違反使用指南,該請求仍可能被收費;對於在 Responses API 產生前即攔截的違規,xAI 列示每次請求 $0.05 的費用。對公眾面向的應用,這應納入成本與安全規劃,而非事後才考慮。

別忘了儲存與下載成本

工具呼叫不是唯一的非 token 成本。xAI 目前列示的檔案儲存為 $0.025 / GiB / 日,集合儲存為 $0.10 / GiB / 日,下載為 $0.20 / GiB 傳輸。

對簡單的聊天應用,這些成本可能不會主導;但對文件密集的 RAG 系統、持久檔案工作流程,或長期保留大型集合的應用,這些成本會逐漸重要。

範例:一個以搜尋為基礎的 Grok 請求要花多少錢?

以下是使用 Grok 4.3 定價與兩次 Web Search 呼叫的簡化示例:

成本項目假設計算成本
輸入 tokens2,000 未快取 tokens2,000 / 1M x $1.25$0.0025
輸出 tokens1,000 輸出 tokens1,000 / 1M x $2.50$0.0025
成功的 Web Search 工具呼叫次數2 次2 / 1,000 x $5.00$0.0100
請求總成本tokens + 工具$0.0050 + $0.0100$0.0150

在此例中,token 使用僅花費 $0.005,兩次 Web Search 呼叫則是 $0.01。也就是說,在尚未計入重試、優先處理、檔案搜尋、儲存或使用指南違規費之前,工具費已佔了約 67%。精確數字會因工作負載而變,但教訓一致:對以搜尋為基礎的代理,先計工具呼叫。

批次、優先與快取:三個成本控制點

1. 快取輸入是第一個槓桿

現行定價表列示,Grok 4.5 的快取輸入為 $0.50 / 1M tokens,而 Grok 4.3、Grok Build 與列出的 Grok 4.20 變體為 $0.20 / 1M tokens。這對長系統提示、重複擷取的上下文、共享指令與評測框架很重要。

在以下情況使用快取輸入:

  • 相同系統提示在多次呼叫間重複
  • 應用附帶長篇政策、工具結構或產品型錄
  • 工作流程評估大量相似任務
  • 請求模式穩定,足以重用提示區塊

2. Batch API 適合離線大量處理

xAI 的定價文件指出,Batch API 會非同步處理大量請求,通常於 24 小時內完成;且列示的 Grok 4.3 / Grok 4.20 文字模型可享 20% 批次折扣。文件也提到影像與影片生成可使用 Batch API,但按標準費率計費。

在以下情境使用批次:

  • 離線分類
  • 夜間富化
  • 合成資料生成
  • 批量摘要
  • 大型評測

不要在低延遲的產品流程中使用批次。

3. 優先處理是延遲與成本的取捨

發行說明於 2026 年 6 月引入優先處理,定價頁指出當回應確認 service_tier: "priority" 時,文字請求按標準 token 定價的 2 倍計費。

只有在延遲改善值得額外費用時才使用優先:

  • 尖峰時段的使用者聊天
  • 客服升級
  • 付費方案體驗
  • 時間敏感的代理編排

不要全域開啟優先,除非你有延遲與毛利數據支持。

如何追蹤實際的 Grok API 成本

xAI 的成本追蹤文件指出,每個推理回應都在 usage 物件中包含 cost_in_usd_ticks,涵蓋聊天補全、Responses API、影像生成與影片生成。文件也說明,工具密集的請求會把 token 成本與伺服器端工具呼叫成本一起包含在該值中。

這讓 Grok 在實務上很有用:你可以在不重建完整計費公式的情況下,量測實際請求成本。

追蹤以下欄位:

  • input_tokens
  • output_tokens
  • reasoning tokens(若可用)
  • cached prompt tokens
  • 伺服器端工具呼叫次數
  • service_tier
  • cost_in_usd_ticks
  • 重試次數
  • 最終成功或失敗

在應用分析中,將 ticks 轉為美元:

cost_usd = cost_in_usd_ticks / 10,000,000,000

接著彙報:

cost per successful task = total Grok request cost / successful tasks

Grok API 定價 2026:Grok 4.5、Token 成本與工具費用

來源:xAI 成本追蹤文件

該用哪個 Grok 模型?

xAI 的模型指引目前將 Grok 4.5 指向為涵蓋程式與各類任務的旗艦,Grok 4.3 仍是成本較低的長上下文路線。將下列表格作為起點,並用自己的「每個成功任務成本」數據驗證。

工作負載建議起點原因
高風險的聊天、程式、工具使用或推理grok-4.5最新旗艦路線、可調整的推理、能力覆蓋更廣
長上下文或成本敏感的聊天grok-4.31M 上下文、token 定價低於 Grok 4.5
專注程式成本測試grok-build-0.1輸入/輸出 token 更便宜;仍值得與 Grok 4.5 對比測試
影像生成或編輯grok-imagine-image 或 grok-imagine-image-quality按影像計價,而非 token
影片生成或編輯grok-imagine-video 或 grok-imagine-video-1.5以每秒輸出計價
語音代理Voice API realtime以每分鐘計價
以搜尋為基礎的回答搭配工具的 grok-4.5 或 grok-4.3在成本模型中納入 Web/X Search 費用

建置者應重新測試的項目

不要只看基礎 token 行就選擇 Grok。請重新測試:

  • Grok 4.5 是否能將重試降到足以彌補相對於 Grok 4.3 較高的 token 價格。
  • 對程式任務,Grok Build 是否比使用 Grok 4.5 更便宜。
  • Web Search 與 X Search 是否需要每回合都開啟,或僅在不確定時使用。
  • 快取輸入是否能帶來足夠節省,值得投入提示快取工程。
  • 優先處理是否能改善 p95 延遲到足以支付 2 倍費用。
  • Imagine 的影片成本,是否應按「每個生成資產」而非「每次請求」來評估。
  • 使用指南違規費是否會影響公開聊天機器人的毛利。

實用的 Grok API 成本評估

使用 30 個任務的評測集:

  • 10 個一般聊天或推理任務
  • 5 個程式任務
  • 5 個以搜尋為基礎的任務
  • 5 個影像或影片生成任務
  • 5 個客服或分類任務

針對每個工作負載,分別執行:

  • Grok 4.5
  • Grok 4.3
  • 程式任務使用 Grok Build
  • 你目前的預設模型
  • 更便宜的後備模型
  • 更強的後備模型

衡量:

  • 通過/失敗
  • 總請求成本
  • 工具呼叫次數
  • 重試次數
  • p50/p95 延遲
  • 快取輸入節省
  • 優先處理使用情況
  • 需要的人工作編次

接下來要關注什麼

  1. xAI 是否更改 Grok 4.5、Grok 4.3 或 Grok Build 的模型別名。
  2. 優先處理是否成為低延遲應用的預期預設。
  3. 工具密集的 Grok 應用是否能用 cost_in_usd_ticks 穩定預測成本。
  4. Grok Imagine 的影片品質是否進一步提升,值得按秒計價。
  5. 獨立評測是否在真實工作負載上驗證 Grok 4.5 的性價比主張。

常見問題

Grok API 要多少錢?

Grok 4.5 每 1M tokens:輸入 $2.00、快取輸入 $0.50、輸出 $6.00。Grok 4.3 為輸入 $1.25、快取輸入 $0.20、輸出 $2.50。Grok Build 0.1 為輸入 $1.00、快取輸入 $0.20、輸出 $2.00。

Grok API 定價只依據 tokens 嗎?

不是。文字請求是以 token 計費,但伺服器端工具會有呼叫費;Imagine 以影像或影片秒數計費;Voice 以每分鐘或每字元計費;優先處理可能加收 2 倍溢價;某些使用指南違規也可能產生每請求費用。

對程式來說,最便宜的 Grok 模型是什麼?

xAI 目前將 Grok 4.5 定位為程式與其他任務的旗艦,但 grok-build-0.1 仍是值得測試的更便宜程式路線。當品質或工具使用可靠性比 token 單價更重要時用 Grok 4.5;當成本是首要限制時用 Grok Build。

Grok 會對 Web Search 或 X Search 收費嗎?

會。Web Search 與 X Search 各列為每 1,000 次呼叫 $5,且需另計模型 token 使用。

Grok API 會顯示每次請求的實際成本嗎?

會。xAI 的成本追蹤文件指出 API 回應包含 cost_in_usd_ticks,可用 10,000,000,000 作除數轉成美元。

我應該使用優先處理嗎?

只有在延遲值得額外費用時才使用。當實際套用優先處理時,文字請求按標準 token 定價的 2 倍計費。

用 CometAPI 測試 Grok API 成本

你可以使用 CometAPI 在同一套評測工作流程中,將 Grok 類型的工作負載與 GPT、Claude、Gemini、DeepSeek 等模型一併測試。比較路線前,團隊可先查看 CometAPI 的定價頁。在程式代理、自動化工具與評測框架的設定範式上,CometAPI Cookbook 是實用的起點。從小型基準開始,記錄每個成功任務的成本,選出在你的工作負載中真正勝出的模型路線。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Jul 10, 2026
最後更新 Sep 3, 2026
384 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多