Claude Opus 5.2 已悄然在 Claude Code 進入灰度測試。自 2026 年 9 月 14 日起,使用者回報其在網頁端表現顯著優於 Opus 5,回應更快、輸出更乾淨,且在長程編碼任務上的持續性更強。
目前公開證據仍屬早期階段:討論多源自相同的初始測試與少量並排對比。灰度測試的行為可見,但 Anthropic 尚未發布供生產環境使用所需的穩定端點與開發者技術文件。
Status:
Gray testing in Claude Code
Official API availability:
Not announced
Public API model ID:
Not yet published
Public pricing and specifications:
Not yet published
Last checked:
September 15, 2026
什麼是 Claude Opus 5.2?
Claude Opus 5.2 是 Anthropic 的下一個 Opus 檢查點,現已透過 Claude Code 的選擇性路由露出。部分提交至 Claude Code「Opus 5」的請求會被導向新的 5.2 路由,而網頁端的 Claude 與部分第三方環境仍提供既有的 Opus 5 模型。這解釋了為何 UI 可能顯示相同的模型名稱,但結果看起來截然不同。
由於灰度測試會選擇性分流,並非每個帳號或工作階段都會接收到相同模型。差異也可能被系統提示、工具配置與推理強度設定所放大。因此,最有用的訊號是路由資訊與可重現行為變化的組合:
- 在 Claude Code 路由下生成更快;
- 更乾淨、一次成型度更高的初次實作;
- 在無需反覆提示「繼續」的情況下進行更長時間的自動工作;以及
- 在編碼任務上反覆進行修訂與測試迴圈。
5.2 slug 與路由訊號
有測試者回報,Claude Code 的可見標籤仍為「Opus 5」,而狀態檢視或請求 slug 指向 5.2。
若能以原始回應、請求紀錄或可重現的 /status 輸出顯示識別符,並可獨立驗證,證據將更有力。當前公開貼文多在重述該主張;其底層憑證尚未被驗真。
Claude Opus 5.2 灰度測試中觀察到的主要特性
早期測試者一致更關注行為,而非正式規格。
回應更快
在早期用戶測試中,被路由到的新模型相較文件所述的 Opus 5 體驗明顯更快。最終延遲仍需在公開 API 開放後測量,因為努力設定、系統負載與路由基礎設施也會影響速度。
輸出更乾淨且更完整
社群對比聲稱,新路由能產出更精緻的 SVG 與更完整的一次性實作。在逸事式的編碼測試中, reportedly 需要較少反覆互動即可達到可用結果。
更少「偷懶」行為
多位測試者表示,模型較不容易僅返回骨架、請求使用者繼續,或在完成複雜任務前提前停止。相反地,它 reportedly 會走更長的序列,並對自身輸出進行額外的通盤檢視。
更長的自主編碼迴圈
一個被廣泛重複的觀察是模型觸發了「gauntlet loop」:它會持續測試、修訂並改進程式碼,而不需要反覆指令。若可重現,這對於面向整個儲存庫的編碼代理與長視野軟體任務尤其相關。
更近期的知識
使用者提出了「Tibo test」:在關閉網路搜尋的情況下,詢問模型是否知道 "Tibo, the reset guy"。既有的 Opus 5 文件給出可靠的知識截止為 2026 年 5 月,因此若能識得更晚的線上參考,可能暗示較新的檢查點。
該測試無法單獨辨識模型版本。正確回答亦可能來自隱藏檢索、對話記憶、系統提示或其他上下文來源。這是一個知識探針——而非「Opus 5.2」名稱的證據。
Claude Opus 5.2 的基準表現
目前沒有經過驗證的 Claude Opus 5.2 基準成績,因為 Anthropic 尚未發布系統卡或評測表。
所報導在 CoBench v2 上的 62.8% 分數屬於 Anthropic 的一個內部模型「Model 2」, reportedly 比 Mythos 5 高出 12.5 分,並被廣泛用於內部編碼。此外亦有更強的 RSI 系統被討論。
Claude Opus 5.2 對比 Claude Opus 5 與 Claude Fable 5.1
三者面向相鄰但差異化的需求。Opus 5 是 Anthropic 的較低成本預設,用於複雜編碼與企業工作。Fable 5.1 是既有的高端選擇,適合最困難的推理與長視野代理任務。Opus 5.2 是新的灰度測試路由,看起來使 Opus 更接近——甚至可能超越——該前沿,同時在 Claude Code 中提升速度與持續性。
| Category | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| Current status | Gray testing in Claude Code | Publicly available | Publicly available |
| Cometapi ID | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| Best fit | Next-generation agentic coding, autonomous iteration, polished one-shot output | General complex coding and enterprise workloads at a balanced cost | The hardest reasoning, research, and long-horizon agentic work |
| Observed behavior | Faster, cleaner, more willing to iterate and finish long tasks | Capable and economical, but users report slower or less persistent behavior on some long tasks | Strongest published Claude results on demanding research and agent benchmarks; can be verbose |
| Context window | Not yet published | 1M tokens | 1M tokens |
| Maximum output | Not yet published | 128K tokens | 128K tokens |
| Reliable knowledge cutoff | Newer knowledge observed in testing; date not published | May 2026 | June 2026 |
| Official input/output price | Not yet published | $5 / $25 per MTok | $10 / $50 per MTok |
| Independent AA Intelligence Index | Not yet tested | 51 | 53 |
| Independent observed output speed | Not yet tested | 51.7 tokens/s | 65.1 tokens/s |
上述獨立數據來自 Artificial Analysis 所測的自適應推理變體。它們顯示 Fable 5.1 在 Intelligence Index 上領先 Opus 5 兩分,且在測得配置中輸出速度快約 26%,但其標價亦高出一倍。這些結果尚未包含 Opus 5.2,因為灰度測試路由未暴露穩定的公共端點供獨立基準測試。
Opus 5.2 改變了實際比較的局面。早期的 Claude Code 會話顯示,該模型比 Opus 5 回應更快,能從相同提示交付更完整的設計,並在無需催促的情況下持續測試與改進程式碼。一旦其公共 API 可用,最重要的問題將是這些改進能否在受控的代理基準上也擊敗 Fable 5.1——以及以何種價格。
Claude Opus 5.2 最適用於哪些場景
根據在灰度測試中已可見的行為,Claude Opus 5.2 尤其值得期待於:
- 儲存庫級編碼與程式碼庫現代化;
- 能跨多步驟規劃、執行、測試與修訂的長時間運行代理;
- 複雜除錯與自主 QA 迴圈;
- 高品質介面、SVG 與結構化產物生成;
- 需要在大型上下文中維持持續注意力的研究與分析;以及
- 在完成品質比最低成本更重要的企業工作流。
對於當下的生產部署,團隊應持續使用穩定的公共端點,並在 Opus 5.2 的 API 存取與服務條款發布前,保持模型層可替換。
CometAPI 如何提供對 Claude Opus 5.2 API 的存取?
當 Claude Opus 5.2 透過 CometAPI 正式可用時,開發者將能使用與其他已支援 Anthropic 模型相同的統一 API 工作流程:
- 建立 CometAPI 帳號並生成 API 金鑰。
- 為帳戶充值或選擇合適的計費選項。
- 在 CometAPI 模型目錄中查詢已發布的準確模型 ID 與價格。
- 透過支援的 Anthropic Messages 或相容的聊天端點發送請求。
- 在生產上線前,以小型測試工作負載驗證輸出品質、延遲與成本。
同時,CometAPI 已支援最新的 Claude Fable 5.1 模型。開發者可使用原生 Claude API 請求格式存取 Claude 模型,便於先行測試當前模型,並在發佈後遷移至 Opus 5.2。
為何選擇 CometAPI 來使用 Claude Opus 5.2?
一旦模型獲得正式支援,CometAPI 可減少將其加入現有 AI 堆疊所需的營運工作。統一的帳戶與 API 層,讓團隊能在不為每個模型建立獨立整合與計費關係的情況下,評估多家模型供應商。
潛在優勢包括:
- 一組 API 金鑰與計費工作流程,覆蓋廣泛的模型目錄;
- 對替代編碼與推理模型進行更快速的並排測試;
- 在模型版本變更時保持一致的整合模式;
- 依用量的存取,而無需將應用設計綁死於單一供應商;以及
- 集中化的文件與模型發現。
實際的 Opus 5.2 定價、可用性、吞吐與折扣資訊,應僅在該模型出現在 CometAPI 的線上目錄後再行說明。