GPT-5.4 Mini 的技術規格
| 項目 | GPT-5.4 Mini(根據官方資訊與交叉驗證的估算) |
|---|---|
| 模型家族 | GPT-5.4 系列(具成本效率的「mini」變體) |
| 供應商 | OpenAI |
| 輸入類型 | 文字、圖片 |
| 輸出類型 | 文字 |
| 上下文視窗 | 400,000 個 token |
| 最大輸出 token | 128,000 個 token |
| 知識截止 | ~2024 年 5 月 31 日(繼承 mini 系列) |
| 推理支援 | 是(相較完整 GPT-5.4 為輕量級) |
| 工具支援 | 函式呼叫、網頁搜尋、檔案搜尋、代理(從 GPT-5 系列推斷) |
| 定位 | 高速、具成本效率的近前沿模型 |
什麼是 GPT-5.4 Mini?
GPT-5.4 Mini 是 GPT-5.4 的「高性價比、高速度」變體,專為「對延遲敏感且高流量」的工作負載打造。它將 GPT-5.4 的相當一部分推理、編碼與多模態能力濃縮進更小、更快的模型中,並針對生產級系統進行最佳化。
與早期的「mini」模型相比,GPT-5.4 Mini 被定位為「接近前沿的小型模型」,在大幅降低成本與回應時間的同時,表現更逼近旗艦水準。
GPT-5.4 Mini 的關鍵特性
- 高速推論:針對低延遲應用(如聊天機器人、Copilot、即時系統)進行最佳化
- 大型上下文視窗(400K):支援長文件、多步驟工作流程與代理記憶
- 強大的程式碼與代理支援:為工具使用、多步推理與分派子代理任務而設計
- 多模態輸入:同時接受文字與圖片輸入,打造更豐富的工作流程
- 具成本效率的擴充:在保留強勁推理能力的同時,成本顯著低於 GPT-5.4
- 代理管線最佳化:適用於大型模型負責規劃、mini 模型負責執行的多模型架構
GPT-5.4 Mini 的基準效能
- 在 SWE-Bench 風格的編碼任務上接近 GPT-5.4 的表現(約為旗艦表現的 94–95%)(來自發佈討論的交叉驗證估計)
- 相較於 GPT-5 Mini,在以下方面有顯著提升:
- 推理準確度
- 工具使用可靠性
- 多模態理解能力
- 在代理工作流程與編碼基準上,設計上優於先前的「mini」世代
- 速度測試:早期 API 測試者回報 GPT-5.4 Mini 約為 180–190 tokens/sec(相較於較早的 GPT-5 mini 變體,依優先模式不同約為 55–120 t/s)
👉 關鍵重點:GPT-5.4 Mini 以極低成本與低延遲,提供接近前沿的表現,非常適合可擴展系統。

代表性使用案例
- 強化編碼助理與編輯器(IDE 外掛、GitHub Copilot):快速解析脈絡、探索程式碼庫、迅速補全,適合在編輯器中對「首個 token 輸出時間」要求極高的情境。GitHub Copilot 已率先整合。
- 子代理/被委派的工作者:由主代理將格式化、小型推理步驟、grep 風格搜尋等短小快速的任務委派給便宜又快速的執行者。OpenAI 將 mini/nano 定位於此類角色。
- 高流量 API 自動化:大量程式碼生成、工單自動分流、日誌摘要等,以每次呼叫成本與延遲為首要考量的場景。社群的吞吐量數據顯示 mini 在營運層面具有實質優勢。
- 工具包裝與工具鏈:快速進行工具呼叫,由模型協調外部工具(搜尋、grep、執行測試)並回傳精煉可行的輸出。GPT-5.4 系列包含改進的「computer use」能力。
如何存取 GPT-5.4 Mini API
步驟 1:申請 API Key
登入 cometapi.com。若您尚未成為我們的用戶,請先註冊。登入您的 CometAPI console。取得介面存取憑證的 API key。在個人中心的 API token 處點選「Add Token」,取得 token key:sk-xxxxx 並提交。

步驟 2:向 GPT-5.4 Mini API 發送請求
選擇「gpt-5.4-mini」端點來發送 API 請求並設定請求本文。請求方法與請求本文可於我們網站的 API 文件取得。我們的網站亦提供 Apifox 測試以利使用。將 <YOUR_API_KEY> 替換為您帳戶中的實際 CometAPI key。base url is Chat Completions and Responses。
將您的問題或請求插入 content 欄位——這是模型將回應的內容。處理 API 回應以獲得生成的答案。
步驟 3:擷取並驗證結果
處理 API 回應以獲得生成的答案。處理後,API 會回傳任務狀態與輸出資料。