Kimi K3 的技術規格
| 規格 | Kimi K3 |
|---|---|
| 開發者 | Moonshot AI |
| 模型 ID | kimi-k3 |
| 模型類型 | 前沿專家混合 LLM |
| 總參數量 | 2.8 兆 |
| 專家 | 896 名專家,每個 token 啟用 16 名 |
| 上下文視窗 | 最多 1,000,000 個 token |
| 原生多模態能力 | 視覺理解;Kimi API 文件包含圖片與影片輸入示例 |
| 核心架構 | Kimi Delta Attention, Attention Residuals, Stable LatentMoE |
| 主要用例 | 程式開發、軟體工程、長上下文推理、代理任務、知識型工作、視覺推理 |
| 託管 API 存取 | Kimi API Platform, CometAPI |
| 開放權重 | 預計於 2026 年 7 月 27 日 |
什麼是 Kimi K3?
Kimi K3 是 Moonshot AI 的旗艦大型語言模型,也是該公司目前最強的基礎模型。它專為專業軟體工程、長上下文推理、自主代理與複雜的知識密集型任務而設計。與此前的 Kimi 模型不同,K3 將上下文視窗擴展至 100 萬個 token,可支援以程式碼庫為尺度的編碼、長文件分析以及多步驟代理工作流程。
該模型基於大規模專家混合架構構建,代表 Moonshot 最新的前沿模型,與 OpenAI 與 Anthropic 的領先專有系統競爭。
Kimi K3 的主要特性
- 100 萬 token 的上下文視窗 可在不需過度分塊的情況下,對大型程式碼庫、書籍、論文與企業文件進行推理。
- 為軟體工程優化,在程式碼庫層級的編碼、除錯、UI 實作與代理式開發流程上具備強勁表現。
- 為 AI 代理設計,能進行長期規劃與多步驟任務執行,而非僅限於單次提示完成。
- 推理感知的推斷,支援針對複雜問題求解調整推理力度。
- K3 帶來兩項主要架構創新:Kimi Delta Attention (KDA) 用於高效長序列處理;Attention Residuals (AttnRes) 提升跨模型深度的資訊檢索能力。
- 與 Kimi K2 相比,Kimi K3 的擴展效率約高 2.5×。
- 開放權重發布策略,相較於封閉的專有前沿模型,允許更廣泛的研究與部署。
Kimi K3 的基準測試表現
Moonshot 發布了近期前沿模型中最全面的基準測試報告之一。公開結果顯示,Kimi K3 在軟體工程、推理與代理任務上與領先的專有系統具備競爭力。
| 基準測試 | Kimi K3 | GPT-5.6 Sol | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|---|---|
| TerminalBench 2.1 | 88.3 | 88.8 | 84.6 | 84.6 |
| FrontierSWE | 81.2 | 71.3 | 86.6 | 66.7 |
| ProgramBench | 77.8 | 77.6 | 76.8 | 71.9 |
| SWE Marathon | 42.0 | 39.0 | 35.0 | 40.0 |
| BrowseComp | 91.2 | 90.4 | 88.0 | 84.3 |
| DeepSearchQA | 95.0 | — | 94.2 | 93.1 |
關鍵觀察
- Kimi K3 在 FrontierSWE 與 BrowseComp 上超越 GPT-5.6 Sol。
- 它位列公開報導中最強的程式碼模型之一。
- 長上下文軟體工程是其最大優勢之一。
- 代理基準測試將其置於接近領先專有前沿系統之列,但 Moonshot 指出最強的封閉模型在整體體驗方面仍具優勢。
限制
- 低與高推理模式已規劃,但在發佈時尚未提供。
- 在既有對話中途切換到 K3 可能降低答案品質,因為模型依賴完整的推理歷史。
- 當使用者意圖不明確時,模型偶爾會過度主動。
- 儘管基準測試表現強勁,Moonshot 明確表示 K3 並未在所有任務上超越每一個專有前沿模型。
為何在 CometAPI 上使用 Kimi K3?
對於以多個基礎模型進行開發的工程師,透過 CometAPI 存取 Kimi K3 具備多項營運優勢:
- 面向 Moonshot、OpenAI、Anthropic、Google、DeepSeek 等提供者的統一 API 端點。
- 更快速的模型切換,無需重寫應用程式邏輯。
- 在不同提供者之間保持一致的驗證與請求格式。
- 簡化計費並集中管理用量。
- 在同一基礎設施內更容易評估 Kimi K3 與其他前沿模型。
對於需要長上下文推理、企業文件智能與先進程式代理,同時希望保有開放權重模型彈性的組織而言,Kimi K3 尤其有價值。
CometAPI 上高價值的 Kimi K3 API 用例
程式代理與程式碼庫級除錯
Kimi K3 最強的公開定位是長期視野的程式開發。由 CometAPI 驅動的程式代理可向模型提供程式碼庫地圖、失敗測試輸出、錯誤日誌、相關檔案、截圖與工具結果。K3 隨後可提出計畫、呼叫工具、檢查回饋並迭代。使用串流以提供互動式進度,並在工具回合之間保留完整的助理訊息。
企業文件智能
100 萬 token 的上下文視窗對於合約、政策、申報文件、支援記錄與技術手冊極具吸引力。一種實用模式是:日常問題使用檢索,當使用者要求跨文件綜合、矛盾檢測、稽核準備,或附引用、可供董事會使用的備忘錄時,再升級至 K3。
多模態產品 QA
K3 的視覺理解使其適合檢視儀表板、著陸頁、圖表匯出、設計稿、錯誤截圖與渲染的 PDF。應要求具體輸出:無障礙問題、缺失狀態、可能的資料品質問題、文案不一致,或已優先排序的錯誤報告。
使用工具的內部助理
在內部營運中,K3 可結合推理與工具,例如 CRM 查詢、計費系統、文件搜尋、工單擷取、部署狀態與分析查詢。當事實必須來自權威系統時,使用 tool_choice 強制檢索;一旦模型取得正確的工具上下文,則切回 auto。