Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/CometAPI 研究

什麼是 Claude Haiku 5.5?規格、基準測試、定價、功能與 API 存取

探索 Claude Haiku 5.5 的規格、1M 上下文視窗、基準測試、API 定價、功能,以及與 Haiku 4.5 和 Sonnet 5.5 的比較。

CometAPI
Deon GoodwinAI 模型與 API 研究團隊
更新於 Oct 8, 2026 6 分鐘閱讀
什麼是 Claude Haiku 5.5?規格、基準測試、定價、功能與 API 存取
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

重點摘要

Claude Haiku 5.5 是 Anthropic 的小型模型中在標準速度下最快的一款,適合高量與低延遲需求的任務。它結合了 1-million-token 的上下文視窗、128K 的標準輸出上限、自適應推理,以及每百萬輸入 token 起價 $0.10、每百萬輸出 token 起價 $0.50 的基礎定價。當提示超過 100,000 個 token 時費率會提高。對於複雜編碼與較長鏈條的代理任務,Sonnet 5.5 與 Opus 5.5 仍然更勝一籌。CometAPI Standard 定價較官方價低 20%,起價為每百萬輸入 token $0.08、每百萬輸出 token $0.40。CometAPI 模型頁面已上線並報告可用於生產環境的 API 存取。

關鍵要點

  • 官方發布:2026 年 10 月 7 日;Claude API 模型 ID:claude-haiku-5-5。
  • 起始 API 費率:在提示不超過 100K tokens 時,輸入 $0.10、輸出 $0.50(每百萬 token)。CometAPI:在官方 Standard 價的 80% 下,輸入 $0.08、輸出 $0.40(每百萬 token)。
  • 上下文與輸出:1M tokens 的上下文與 128K tokens 的標準輸出。
  • 聚焦:分類、文件擷取、路由、客服支援與委派式代理任務。
  • 新 tokenizer 對同一段文字約可多計 30% 的 tokens;評估成本應以每個被接受任務的成本為準,而非僅看每 token 價格。

什麼是 Claude Haiku 5.5?

Claude Haiku 5.5 是 Anthropic 現行 Claude 家族中輕量級的一員,為大量請求場景而設計,強調回應速度與營運成本。其主要應用包含文件處理、會話支援、資訊擷取與小型子代理工作。Anthropic 的模型概覽確認了上線日期、能力與平台識別。

Claude Haiku 5.5 是首個支援可配置 effort 等級的 Haiku 模型,讓開發者能在同一模型中權衡推理深度、延遲與 token 使用量。

Claude Haiku 5.5 的關鍵特性是什麼?

自適應思考與可調整的 effort

Haiku 5.5 能決定何時以及要進行多少推理,同時透過 effort 參數讓開發者在回應品質、延遲與 token 使用之間取得平衡。預設 effort 為 medium。對於簡單分類,可選擇低 effort;對於有歧義的擷取或工具規劃步驟,較高設定可能更合理。

大型上下文處理

1M-token 的上下文視窗使長篇文件與大量對話歷史可以裝入單一請求中。開發者仍應在適當時機使用檢索、截斷與快取:過長的上下文會帶來不必要的成本與準確性取捨,特別是在超過 100K 定價門檻之後。

低成本高吞吐處理

新的 $0.10/$0.50 起始費率,使得重複的短請求在每 token 基礎上相較前代 Haiku 顯著更便宜。然而 Anthropic 文件記錄 tokenizer 已改變:相同文字在 Haiku 4.5 上相比,約會增加 30% 的 tokens。實際在任務層級的節省因此可能小於標題式的費率降幅。

電腦操作與委派式代理任務

已發布的評測顯示,在電腦互動與工具輔助任務上的表現強於上一代 Haiku。這讓 Haiku 5.5 對於邊界清晰的代理步驟很有用,但能否成功自動化仍仰賴健全的工具權限、錯誤復原,以及對高風險動作的人審。

Claude Haiku 5.5 在基準測試上的表現如何?

Anthropic 報告在專業知識任務、電腦操作、編碼與推理方面有顯著提升。以下結果使用所報告的評測設定;不同基準的分數不應合併為單一「智能分數」。

基準測試Haiku 4.5Haiku 5.5Sonnet 5.5
GDPval-AA v2.1 (Elo)7351,6201,840
AA-Briefcase v1.1 (Elo)6141,5781,824
OSWorld 2.1,離線子集,部分計分15.7%72.4%83.9%
Humanity's Last Exam,無工具10.2%45.9%56.9%
Humanity's Last Exam,使用工具18.7%57.4%64.5%
Terminal-Bench 4.00.0%39.2%70.6%
Chartography,無工具6.4%46.4%61.6%

系統卡中標準的 Haiku 5.5 評測組態使用最大 effort 的自適應思考、預設取樣並在未特別註記時進行五次試驗;產品預設為 medium,因此標題分數並非預設設定的保證。OSWorld 使用 82 個離線任務、無網路、1080p 與 500 次動作上限。其 72.4% 為部分計分;嚴格通過率為 37.1%。GDPval-AA 與 AA-Briefcase 由 Anthropic 報告,來源為 Artificial Analysis 獨立執行的評測。

Terminal-Bench 4.0 使用 Claude Code 的 --bare 模式並啟用防護。Haiku 5.5 使用最大 effort、無後備模型且無網際網路出站,每個任務 10 次試驗;Sonnet 5.5 使用 5 次試驗,且對部分被標記的請求使用後備。Haiku 4.5 使用固定的 63,999-token 思考配額。該些組態差異對解讀 39.2% 與 70.6% 的差距至關重要。
Anthropic 的已發布基準結果提供上述分數。OSWorld 使用其離線子集;Humanity's Last Exam 區分有無工具情境,Chartography 為無工具。這些是供應商報告的結果,並非在統一組態下獨立測量。Anthropic 在其Haiku 5.5 系統卡提供評測細節;在比較你自己的結果前,請重現相應的 effort、工具、支架與配額設定。發佈摘要並未為每一行提供完整共同測試環境。

什麼是 Claude Haiku 5.5?規格、基準測試、定價、功能與 API 存取

上圖為自其系統卡重現的 Anthropic 官方評測圖表。它提供了關於評測組態的更多證據;並非本文產生的新基準。

基準解讀

OSWorld 的提升表明 Haiku 5.5 在結構化圖形任務上有了顯著實用性。然而,Terminal-Bench 中 Sonnet 5.5 的 70.6% 對比 Haiku 5.5 的 39.2% 顯示較大型模型在代理式編碼上仍具優勢。請根據實際工作流程的失敗成本與難度選擇模型。

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

維度Haiku 4.5Haiku 5.5Sonnet 5.5
上下文200K1M1M
最大標準輸出64K128K128K
Standard 輸入 / MTok$1$0.10,至 100K;超過則 $0.50$2
Standard 輸出 / MTok$5$0.50,至 100K;超過則 $2.50$10
推理固定 token 配額的延伸思考自適應;預設為 medium自適應;預設為 high
相對延遲快在標準速度下最快快
編碼深度受限任務更強的子代理更複雜的編碼
典型用途舊版小型模型部署高量工作流程複雜的生產工作流程

共同規格:三款模型皆支援文字與影像輸入並輸出文字。可透過 Claude API 與受支持的合作平台存取;模型識別與帳戶存取取決於供應商。引用的產品文件未提供參數量或詳細架構。

Haiku 5.5 對可驗證且重複的任務是合理的首選。當更強判斷力可節省重複失敗呼叫、工具重試或人工修正時,Sonnet 5.5 更具吸引力。對特別嚴苛的多步任務,Opus 5.5 亦是選項。

相對延遲標籤指標準速度模式。Anthropic 的速度說明不包含 Opus Fast Mode 在最速聲明中。像參數量等架構細節不由這些產品層級所確定。文字與影像輸入搭配文字輸出不同於影像生成。

能力比較遵循 Anthropic 的模型規格。平台存取取決於所選供應商與帳戶;任何模型層級皆不等於已發布參數量。

工作負載選擇

工作負載實務預設原因
電子郵件分類Haiku 5.5短小、重複、可驗證的決策
文件欄位擷取Haiku 5.5成本有效的結構化處理
客服分流Haiku 5.5快速回應與升級
編碼子代理Haiku 5.5低成本檔案搜尋與受控編輯
複雜除錯Sonnet 5.5更強的編碼基準表現
高風險多步推理Opus 5.5更強的高階模型
混合工作負載Haiku + Sonnet依複雜度與信心路由

Claude Haiku 5.5 要花多少錢?

為何 Haiku 5.5 宣稱「約便宜 75%」,但其 token 價格卻降低了 90%?

90% 指的是在提示不超過 100,000 tokens 時,Standard 的輸入與輸出費率降幅;更長提示則為降 50%。Anthropic 報告 Haiku 5.5 的平均運行成本約降低 75%,係考量前代模型的請求長度分布與每項任務的 token 使用變化。Tokenization 是一項因素:相同輸入文字約可計為多 30% 的 tokens,因此成本估算應使用新模型測得的計數。

Anthropic 的官方定價有兩個提示長度檔位。下表為官方美元每百萬 token 的 Standard、快取與 Batch 費率;CometAPI 比較下方對應官方 Standard 的輸入與輸出費率乘以 0.8。此比較不假設閘道折扣可與 Batch 或快取折扣疊加。

費率類別提示至 100K提示超過 100K
輸入$0.10$0.50
輸出$0.50$2.50
5-minute 快取寫入$0.125$0.625
1-hour 快取寫入$0.20$1.00
快取讀取$0.01$0.05
批次輸入(五折)$0.05$0.25
批次輸出(五折)$0.25$1.25

以上為 2026 年 10 月 8 日查核的官方 Standard、快取與 Batch 費率。提示長度決定所適用的定價檔位;較高檔位適用於整個請求,而非僅 100K 以上的 tokens。下表的 CometAPI Standard 費率等於對應官方 Standard 費率乘以 0.8。此比較不假設閘道折扣可與 Batch 或快取折扣疊加。

提示長度Token 類別官方 Standard / MTokCometAPI / MTok
至 100K tokens輸入$0.10$0.08
至 100K tokens輸出$0.50$0.40
超過 100K tokens輸入$0.50$0.40
超過 100K tokens輸出$2.50$2.00

範例:每月 100,000 個短請求

假設每個請求使用 2,000 個輸入 tokens 與 500 個輸出 tokens;每個請求皆低於 100K 門檻。忽略提示快取、工具與重試,並為說明便利起見假設不同模型的 token 計數相同。

模型 / 供應方輸入 / 月輸出 / 月總計 / 月
Haiku 4.5 — 官方 Standard$200$250$450
Haiku 5.5 — 官方 Standard$20$25$45
Sonnet 5.5 — 官方 Standard$400$500$900
Haiku 5.5 — CometAPI$16$20$36

在此範例中,100,000 個請求使用 2 億個輸入 tokens 與 5,000 萬個輸出 tokens。CometAPI 的輸入成本為 200 × $0.08 = $16,輸出成本為 50 × $0.40 = $20,每月合計 $36,相較官方的 $45 節省 $9,即 20%。此情境排除快取、工具與重試,且使用固定 token 計數;請在具代表性的輸入上測量每個被接受任務的成本,因為新的 tokenizer 會改變 token 計數。

$450 對 $45 的比較是以固定 token 計數說明 90% 費率降幅,並非承諾在等效實務工作負載下可節省 90%。Anthropic 在其發佈公告中報告,考量請求長度與 token 使用變化後,平均運行成本約降低 75%。在估算你自己的節省前,請先對具代表性的輸入重新計數並測量完成任務的成本。

在哪裡可以使用 Claude Haiku 5.5?

官方存取與雲端平台

依據 Anthropic 的可用性公告,Haiku 5.5 可透過 Claude API 與在 Amazon Web Services、Google Cloud、Microsoft Azure 上受支持的平台使用。直接 Claude API 的模型 ID 為 claude-haiku-5-5;Amazon Bedrock 使用 anthropic.claude-haiku-5-5。請使用你所選供應商核發的憑證,並查核其當前的帳戶存取要求。

透過 CometAPI 的第三方存取

CometAPI 模型頁列示 claude-haiku-5-5 可用,Standard 費率在提示至 100K 時,起價為每百萬輸入 token $0.08、每百萬輸出 token $0.40,較對應官方費率低 20%。請使用 CometAPI 核發的金鑰、CometAPI 的端點與請求格式;此路徑與直接使用 Anthropic API 不同。請在實際頁面確認可用性、定價檔位與整合細節。

切換供應商或自 Haiku 4.5 升級時,請確認模型 ID、重新計數 tokens,並測試回應上限與對話處理。實作細節與向後相容變更,請參考 Anthropic 的遷移指南。

遷移驗證

  • 更新模型 ID 並驗證端點特定的請求欄位。
  • 使用更新後的 tokenizer 重新計數 tokens,包括穩定前綴與工具定義。
  • 測試自適應思考設定、延遲分佈與回應區塊解析。
  • 檢查工具呼叫、故障復原,以及任何已儲存思考區塊的帳戶限制。
  • 比較 p50/p95 延遲、被接受任務率與總計費 tokens。
  • 對業務關鍵工作流程使用分階段發布與回滾路徑。
  • Assistant prefill 禁止使用

Haiku 5.5 遷移指南說明 tokenizer 行為、ID 與請求相容性。請省略 temperature、top_p 與 top_k。若明確提供,temperature 必須為 1,top_p 必須為 0.99;任何 top_k 值,或同時提供 temperature 與 top_p,將回傳 400 錯誤。

Claude Haiku 5.5 的限制是什麼?

Haiku 5.5 並非大型模型的通用替代。複雜編碼與長期推理仍是 Sonnet 與 Opus 的重要差異化優勢。更長的提示成本也更高,因此 1M-token 視窗應選擇性使用。自適應推理會引入生成 tokens 與延遲的變異;基準測試不構成對單一業務工作流程的保證。

對風險敏感的自動化應驗證結構化輸出、限制外部工具權限、保留稽核日誌,並在具影響的動作前要求審核。請將不確定的任務路由至更強的模型,而非僅依賴 Haiku 較低的基礎 token 價格。

結論

對於高量處理且有可量測驗收標準的情境,Claude Haiku 5.5 是具吸引力的升級選擇:更低的入門定價、更大的上下文、自適應推理,以及更強的已發布評測表現。對於複雜編程與含糊決策,Sonnet 5.5 或 Opus 5.5 可能藉由減少重試與修正而帶來更佳的整體經濟性。致勝策略是對完整工作流程進行基準測試,並依難度進行路由。

常見問題

100K 定價邊界如何影響使用快取的工作流程?

提示長度決定所屬費率檔位;請勿僅由新增文字估算費用,或假設只有超出部分使用較高檔位。請以所選模型計數整個請求,包括歷史與工具定義,然後依相關檔位整合輸入、快取寫入、快取讀取與輸出用量。在設定生產預算前,請以具代表性的快取請求對發票進行比較。

Haiku 5.5 的思考區塊可在不同帳戶間重放嗎?

它們僅能在產生它們的帳戶或與其連結的帳戶中使用。若不相關的帳戶發送已儲存的思考區塊,API 會在模型看到之前將其丟棄;請求仍可能在沒有該推理的情況下成功。請見官方遷移指南。請保留對話區塊,並在延續工具工作流程時使用原始或已連結的帳戶。閘道或帳戶變更應明確測試;匹配模型名稱不保證已儲存的思考區塊仍可使用。

為何 Haiku 5.5 會截斷 Haiku 4.5 能完成的回應?

新的 tokenizer 對相同文字可能計更多 tokens,因此不變的 max_tokens 上限可容納的等效輸出會變少。自適應思考也可能消耗輸出預算。請檢視 stop_reason 與 usage,以新模型重新計數提示,並在實際任務上重新調整輸出配額,而非直接複製舊設定。

應如何選擇 Haiku 5.5 的路由門檻?

請使用實際工作負載的標註樣本,測量被接受任務率、修正成本與延遲。對未通過明確驗證或超出測試任務範疇的請求,路由至更強的模型。請根據完整工作流程成本(包含重試與升級)調整門檻,並在變更提示、工具或 effort 後持續監控。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Oct 8, 2026
最後更新 Oct 8, 2026
0 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

閱讀更多