GPT-5.4 Mini 的技術規格
| 項目 | GPT-5.4 Mini(根據官方與交叉驗證的估算) |
|---|---|
| 模型家族 | GPT-5.4 系列(具成本效率的「mini」變體) |
| 提供商 | OpenAI |
| 輸入類型 | 文字、影像 |
| 輸出類型 | 文字 |
| 上下文視窗 | 400,000 tokens |
| 最大輸出 tokens | 128,000 tokens |
| 知識截止 | ~2024 年 5 月 31 日(延續 mini 系譜) |
| 推理支援 | 是(輕量 vs 完整 GPT-5.4) |
| 工具支援 | 函式呼叫、網頁搜尋、檔案搜尋、代理(從 GPT-5 家族推測) |
| 定位 | 高速、具成本效率的近前沿模型 |
什麼是 GPT-5.4 Mini?
GPT-5.4 Mini 是一款具成本效率且速度快速的 GPT-5.4 變體,專為延遲敏感與高量工作負載設計。它將 GPT-5.4 在推理、程式碼與多模態方面的大量能力帶入更小、更快、並為生產級系統最佳化的模型中。
相較於早期的「mini」模型,GPT-5.4 Mini 被定位為「近前沿」的小型模型,意味著在大幅降低成本與回應時間的同時,表現逼近旗艦等級。
主要特性
- 高速推論:針對低延遲應用(如聊天機器人、Copilot、即時系統)最佳化
- 大型上下文視窗(400K):支援長文檔、多步工作流程與代理記憶
- 強大的程式碼與代理支援:設計用於工具使用、多步推理與委派子代理任務
- 多模態輸入:同時接受文字與影像,提供更豐富的工作流程
- 具成本效率的擴展:相較 GPT-5.4 明顯更便宜,且保留強勁推理能力
- 代理管線最佳化:非常適合由大型模型規劃、小型模型執行的多模型架構
GPT-5.4 Mini 的基準表現
- 在 SWE-Bench 風格的程式設計任務上接近 GPT-5.4 的表現(約達旗艦水準的 94–95%)(根據發佈討論的交叉驗證估計)
- 相較於 GPT-5 Mini 的顯著提升:
- 推理準確度
- 工具使用可靠性
- 多模態理解
- 在代理工作流程與程式設計基準上,旨在超越以往「mini」世代
- 速度量測:早期 API 測試者回報 GPT-5.4 Mini 約 180–190 tokens/秒(相較較舊的 GPT-5 mini 變體約 55–120 t/s,取決於優先模式)
👉 關鍵要點:GPT-5.4 Mini 以更低的成本與延遲提供近前沿的效能,非常適合可擴展系統。

代表性使用場景
- 程式助理與編輯器(IDE 外掛、Copilot):快速的上下文解析、程式碼庫探索與即時補全,使 GPT-5.4 Mini 非常適合在編輯器內提供建議,特別是在「首字輸出時間」關鍵的情境。GitHub Copilot 為早期整合案例。
- 子代理/委派工作者:主代理將短小、快速的任務(格式化、小步驟推理、grep 類搜尋)委派給便宜且快速的工作者。OpenAI 將 mini/nano 定位於此角色。
- 高吞吐 API 自動化:大規模程式碼生成、工單自動分類、日誌摘要等,以每次呼叫成本與延遲為主要考量的情境。社群的吞吐量數據顯示 mini 在營運上具有顯著優勢。
- 工具封裝與工具鏈:快速工具呼叫,讓模型協調外部工具(搜尋、grep、執行測試)並產出精煉可行的輸出。GPT-5.4 系列包含更強的「電腦操作」能力。
如何存取 GPT-5.4 Mini API
步驟 1:申請 API 金鑰
登入 cometapi.com。若您尚未成為使用者,請先註冊。登入您的 CometAPI console。取得介面的存取憑證 API key。在個人中心的 API token 中點擊「Add Token」,取得 token key:sk-xxxxx 並提交。

步驟 2:向 GPT-5.4 Mini API 發送請求
選擇「gpt-5.4-mini」端點發送 API 請求,並設定請求本文。請求方法與請求本文可從我們網站的 API 文件取得。我們也提供 Apifox 測試以供方便使用。將 <YOUR_API_KEY> 替換為您帳戶中的實際 CometAPI 金鑰。基礎 URL 為 Chat Completions 與 Responses。
將您的問題或請求插入 content 欄位——模型將回應此內容。處理 API 回應以取得生成的答案。
步驟 3:擷取並驗證結果
處理 API 回應以取得生成的答案。處理完成後,API 會回傳任務狀態與輸出資料。