GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/Nghiên cứu CometAPI

Claude Sonnet 5.5 là gì?Điểm chuẩn, giá, và quyền truy cập API

Khám phá thông số kỹ thuật của Claude Sonnet 5.5, cửa sổ ngữ cảnh 1M, các điểm chuẩn, giá, tính năng viết mã, so sánh và truy cập API.

CometAPI
Deon GoodwinĐội ngũ nghiên cứu mô hình AI và API
Đã cập nhật Sep 29, 2026 16 phút đọc
Claude Sonnet 5.5 là gì?Điểm chuẩn, giá, và quyền truy cập API
Sử dụng mẫu này

Thực hiện API call đầu tiên.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 là mẫu thuộc dòng Sonnet mới nhất của Anthropic, phát hành vào ngày 28 tháng 9 năm 2026. Mẫu này được định vị là bổ sung nhanh hơn, chi phí thấp hơn cho Claude Opus 5.5, phù hợp với lập trình, công việc tác vụ rõ ràng của agent, sản xuất tài liệu, sử dụng máy tính và phân tích đa phương thức.

Mức giá chuẩn giữ nguyên ở $2 cho mỗi 1 triệu token đầu vào và $10 cho mỗi 1 triệu token đầu ra. Anthropic báo cáo tốc độ sinh đầu ra nhanh hơn hơn 30% so với Sonnet 5 và chi phí cấp tác vụ có thể thấp hơn tới 30% vì mẫu mới thường hoàn thành công việc với ít token và bước hơn.

Kết quả công bố gồm 70.6% trên Terminal-Bench 4.0, 55.5% trên CursorBench 4.0, 1844 trên GDPval-AA v2.1 và 80.1% trên OSWorld 2.1. Giá trị thực tế không nằm ở một điểm số đơn lẻ: Sonnet 5.5 tiệm cận Opus 5.5 trên nhiều đánh giá công việc chuyên nghiệp trong khi vẫn giữ mức giá token chuẩn thấp hơn.

Key Takeaways

  • Claude Sonnet 5.5 là mẫu thứ hai trong gia đình Claude 5.5 của Anthropic và được tối ưu cho công việc sản xuất nhanh thay vì các tác vụ mơ hồ, mở.
  • Hỗ trợ cửa sổ ngữ cảnh 1M token, tối đa 128K token đầu ra, đầu vào văn bản và hình ảnh, tư duy thích ứng, sử dụng công cụ và phản hồi có cấu trúc.
  • Giá chuẩn Claude API là $2/M đầu vào, $10/M đầu ra, $0.20/M đọc cache và $2.50/M ghi cache 5 phút.
  • Anthropic báo cáo đầu ra nhanh hơn 30%+ so với Sonnet 5 và cải thiện mạnh ở lập trình, sử dụng máy tính, hiểu biểu đồ và công việc tri thức đường dài.
  • Mã định danh model trong Claude API là claude-sonnet-5-5; nhà phát triển cũng có thể truy cập Claude Sonnet 5.5 API trong CometAPI.

What Is Claude Sonnet 5.5?

Claude Sonnet 5.5 là mẫu Sonnet đa dụng mới nhất của Anthropic và là phát hành thứ hai trong gia đình Claude 5.5 sau Claude Opus 5.5. Anthropic định vị nó là một bổ sung nhanh hơn và chi phí thấp hơn cho Opus, không phải là sự thay thế trực tiếp cho mẫu flagship.

Khác biệt là thực tiễn: Opus 5.5 nhắm tới công việc phức tạp, mơ hồ cần phán đoán bền bỉ, trong khi Sonnet 5.5 được tối ưu cho các tác vụ phạm vi rõ ràng, sửa lỗi, lặp nhanh, lập trình, sản xuất tài liệu và các quy trình chuyên nghiệp khối lượng lớn.

What Are the Most Important Claude Sonnet 5.5 Features?

Mẫu này kết hợp cửa sổ ngữ cảnh 1M token, tối đa 128K token đầu ra, đầu vào văn bản và hình ảnh, tư duy thích ứng, nỗ lực điều chỉnh được, sử dụng công cụ, đầu ra có cấu trúc, bộ nhớ đệm prompt, xử lý theo lô, và hỗ trợ qua Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform trên AWS. Với các đội sản xuất, giá trị cốt lõi không nằm ở một tính năng đơn lẻ mà ở sự kết hợp: sinh nhanh, dùng ít token ở cấp tác vụ và hiệu năng gần Opus trên nhiều khối công việc chuyên nghiệp phạm vi rõ ràng.

Claude Sonnet 5.5 benchmarks

Anthropic báo cáo mức tăng đáng kể ở lập trình, công việc chuyên nghiệp đường dài, sử dụng máy tính và hiểu thị giác. Bảng dưới tóm tắt các kết quả đánh giá công bố của công ty.

Benchmark và nguồn chính thứcClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% at XhighChưa được công bố công khai
FrontierCode 1.1 Main46.2% at Max42.4%54.4%49.3% / 52.1% at Xhigh
CursorBench 4.055.5%34.1%57.8%Chưa được công bố công khai
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% with tools54.9%67.7%Không được báo cáo trong bảng nguồn
OSWorld 2.180.1%57.0%81.8%Không được báo cáo trong bảng nguồn
Chartography61.6%15.6%64.4%53.6%

Điều kiện đánh giá và lưu ý: Điểm số không phải tất cả đều đo ở cùng mức nỗ lực. Kết quả 66.4% của Opus 5.5 trên Terminal-Bench được báo cáo ở mức Xhigh. Anthropic lưu ý Sonnet 5.5 có thể đạt điểm thấp hơn ở Max so với Xhigh trên FrontierCode vì các bước rà soát bổ sung có thể gây timeout hoặc chỉnh sửa ngoài phạm vi. Artificial Analysis chạy GDPval-AA và AA-Briefcase trên một bản triển khai Sonnet 5.5 trước phát hành bị ảnh hưởng bởi lỗi structured-output mà Anthropic cho biết đã được sửa. Các con số GPT-6 Sol liên nhà cung cấp cũng nên được coi là quan sát đã cũ vì OpenAI đã sửa lỗi mã hóa hình ảnh vào ngày 25 tháng 9 năm 2026.

Ý nghĩa của các kết quả: Sonnet 5.5 không chỉ đơn giản vượt Sonnet 5 ở vài điểm số lẻ. Nó tiến gần hơn nhiều tới Opus 5.5 ở lập trình, công việc chuyên nghiệp, sử dụng máy tính và nhận diện biểu đồ trong khi giữ mức giá theo bậc Sonnet. Anthropic cũng báo cáo rằng ở mức Low hoặc Medium, Sonnet 5.5 có thể vượt điểm tốt nhất của Sonnet 5 trên vài đánh giá với chi phí mỗi tác vụ xấp xỉ một phần mười. Tổ hợp năng lực, tốc độ và hiệu quả cấp tác vụ đó là lợi thế cạnh tranh chính của nó.

How Good Is Claude Sonnet 5.5?

Coding

Sự cải thiện cũng mang tính vận hành. Anthropic cho biết Sonnet 5.5 hiểu codebase nhanh hơn, gom các lệnh gọi công cụ hiệu quả hơn, dùng ít bước hơn và giảm chi phí mỗi tác vụ hoàn thành. FrontierCode kiểm tra liệu các thay đổi mã đề xuất có merge được hay không, còn CursorBench dùng các tác vụ mơ hồ, nhiều tệp rút ra từ phiên lập trình thực; do đó các cải thiện phản ánh năng lực thực thi và phán đoán cấp kho mã, không chỉ sinh mã ngắn. Những thay đổi này quan trọng cho sửa lỗi, review code, chạy kiểm thử và các agent lập trình chạy lâu.

Claude Sonnet 5.5 là gì?Điểm chuẩn, giá, và quyền truy cập API

Knowledge Work

Các cải thiện vượt ra ngoài lập trình. GDPval-AA kiểm tra các tác vụ chuyên môn thực tế trên 44 nghề và 9 ngành lớn, nên điểm 1844 của Sonnet 5.5 — so với 1449 của Sonnet 5 và 1846 của Opus 5.5 — gợi ý rằng các lợi ích chuyển giao sang phân tích thực tiễn, sản xuất tài liệu và hỗ trợ quyết định chứ không chỉ dừng ở các bài kiểm tra suy luận trong phòng thí nghiệm.

Anthropic nêu bật phân tích tài chính, tổng hợp tài liệu, tạo slide, làm bảng tính, diễn giải biểu đồ, kiểm tra nguồn, truy xuất thông tin và viết chuyên nghiệp là các lĩnh vực mẫu được cải thiện.

Người thử sớm cũng báo cáo các cải thiện khó định lượng hơn: cộng tác rõ ràng hơn, phán đoán hội thoại tự nhiên hơn và con mắt thiết kế tốt hơn. Anthropic cho biết mẫu có thể đánh bóng giao diện người dùng và theo sát template slide đủ để tạo bộ deck cần chỉnh sửa tối thiểu; trong một bài kiểm tra review vận hành nội bộ, hai chuyên gia đánh giá bản nháp đầu tiên đã sẵn sàng gửi đi mà không cần sửa.

Hàm ý rộng hơn là Sonnet 5.5 nên được hiểu như một mẫu cho công việc chuyên nghiệp, không chỉ là một mẫu lập trình rẻ hơn.

Computer Use

Sonnet 5.5 đạt 80.1% trên OSWorld 2.1, so với 57.0% của Sonnet 5 và 81.8% của Opus 5.5. OSWorld đánh giá khả năng vận hành môi trường máy tính đồ họa, nên kết quả này chỉ ra một bước nhảy thế hệ lớn và hiệu năng gần Opus cho các quy trình liên quan trình duyệt, công cụ desktop và hiểu giao diện đa phương thức. Kết quả Chartography cho thấy mô hình tương tự ở nhận diện biểu đồ trực quan: 61.6% cho Sonnet 5.5 so với 15.6% cho Sonnet 5.

Speed

Anthropic cho biết Sonnet 5.5 sinh đầu ra nhanh hơn hơn 30% so với Sonnet 5, khiến đây là mẫu Sonnet nhanh nhất khi ra mắt. Tốc độ cao kết hợp với ít lệnh gọi công cụ hơn và dùng ít token hơn rút ngắn vòng lặp agent, giảm thời gian chờ trong lập trình lặp và cải thiện thông lượng trong hỗ trợ và các quy trình khối lượng lớn khác.

How Much Does Claude Sonnet 5.5 Cost?

Giá và nguồn chính thứcClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Đọc cache$0.20 / 1M$0.16 / 1M$0.20 / 1M
Ghi cache 5 phút$2.50 / 1M$2 / 1M$5 / 1M
Token đầu vào$2 / 1M$1.60/M$4 / 1M
Token đầu ra$10 / 1M$8.00/M$20 / 1M

Ở mức giá token chuẩn, Sonnet 5.5 có chi phí bằng một nửa Opus 5.5 cho cả đầu vào và đầu ra. Anthropic cũng cho biết Sonnet mới thường cần ít token hơn để hoàn thành cùng công việc so với Sonnet 5, giúp giảm chi phí mỗi tác vụ hoàn tất.

Đây là giá chuẩn của Claude API. Giá nhà cung cấp đám mây, vùng xử lý, thời lượng cache, chiết khấu xử lý theo lô và quy tắc ngữ cảnh dài có thể làm thay đổi chi phí hiệu dụng.

What Safety Changes Does Claude Sonnet 5.5 Introduce?

Anthropic cho biết kiểm toán hành vi tự động của họ bao phủ khoảng 1.850 kịch bản và thấy rằng Sonnet 5.5 được cải thiện hoặc ngang bằng Sonnet 5 trên hầu hết các thước đo đã kiểm tra về căn chỉnh, chống lạm dụng và tính trung thực.

Cybersecurity Safeguards

Vì Sonnet 5.5 có năng lực an ninh mạng mạnh hơn phiên bản tiền nhiệm, Anthropic triển khai các biện pháp bảo vệ tương tự như dùng cho các mẫu mạnh hơn. Phát triển phần mềm thông thường và sửa lỗi thông thường vẫn được hỗ trợ, trong khi một số tác vụ an ninh mạng rủi ro cao hơn có thể được chuyển sang đường đi mẫu an toàn hơn.

Biology Safeguards

Mẫu sử dụng các biện pháp bảo vệ sinh học giống Sonnet 5, nhắm tới một tập hẹp các yêu cầu có thể gây hại trong khi phần lớn công việc nghiên cứu, giáo dục và lâm sàng vẫn không bị ảnh hưởng.

Anti-Distillation Protections

Anthropic cho biết Sonnet 5.5 là mẫu Sonnet đầu tiên ra mắt với các bộ phân loại an toàn nhằm ngăn trích xuất suy luận thông qua các cuộc tấn công chưng cất ở quy mô công nghiệp. Mẫu cũng mở rộng preserved thinking, gắn nội dung suy nghĩ với tài khoản và cuộc hội thoại đã tạo ra nó để suy luận không thể tách rời và phát lại tự do ở nơi khác. Hầu hết nhà phát triển sẽ không nhận thấy thay đổi này, nhưng các hệ thống di chuyển hội thoại giữa tài khoản hoặc thay đổi trạng thái hội thoại trước đó nên xem hướng dẫn di trú.

Các tuyên bố này mô tả những biện pháp bảo vệ do Anthropic báo cáo, không phải bảo đảm độc lập về an toàn cho mọi triển khai. Các đội nên đánh giá mẫu theo mô hình đe dọa, chính sách và quy trình rủi ro cao của riêng mình.

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

Claude Sonnet 5.5 được định vị là mẫu sản xuất nhanh, hiệu quả trong nhóm này. Anthropic báo cáo rằng nó sinh đầu ra nhanh hơn hơn 30% so với Claude Sonnet 5 trong khi giữ nguyên mức giá token. Claude Opus 5.5 nhắm tới công việc khó hơn và mơ hồ hơn, còn GPT-6 Sol là đối sánh gần nhất từ OpenAI cho lập trình ngữ cảnh dài và quy trình agentic.

Khía cạnhClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
Định vịMẫu sản xuất Sonnet trước đâyMáy kéo sản xuất nhanh, hiệu quảSuy luận phức tạp cao cấpQuy trình lập trình phức tạp và agentic
Cửa sổ ngữ cảnh1M1M1M1.05M
Đầu ra tối đa128K128K128K128K
Điều khiển suy luậnAdaptive effortAdaptive effortAdaptive thinking, luôn bậtnone, low, medium, high, xhigh, and max
Đầu vào đa phương thứcVăn bản và hình ảnhVăn bản và hình ảnhVăn bản và hình ảnhVăn bản và hình ảnh
Khả dụng APIClaude API và các nền tảng đám mây lớnClaude API và các nền tảng đám mây lớnClaude API và các nền tảng đám mây lớnResponses API và Chat Completions
Giá chuẩn đầu vào/đầu ra mỗi 1M$2 / $10$2 / $10$4 / $20$2 / $10 cho prompt lên tới 272K token đầu vào
Tốc độMốc tham chiếuNhanh hơn >30% so với Sonnet 5Tối ưu cho công việc khó, chạy lâuThay đổi theo mức nỗ lực suy luận
FrontierCode 1.142.4%46.2% at Max54.4%49.3% / 52.1% at Xhigh
GDPval-AA v2.11449184418461487
Phù hợp nhất choKhối công việc Sonnet hiện cóAgent và lập trình khối lượng lớn, công việc chuyên nghiệpTác vụ khó, mơ hồ, chạy dàiQuy trình lập trình, agent, công cụ và ngữ cảnh dài gốc OpenAI

Các con số benchmark này là quan sát liên nhà cung cấp thay vì xếp hạng kiểm soát, cố định. Kết quả phụ thuộc vào thiết lập nỗ lực và điều kiện triển khai.

How Do You Access and Call Claude Sonnet 5.5 Through CometAPI?

Claude Sonnet 5.5 có sẵn qua Claude, Claude Platform, Amazon Web Services, Google Cloud và Microsoft Azure. Nhà phát triển muốn một giao diện tương thích OpenAI cho nhiều nhà cung cấp có thể gọi mẫu qua Claude Sonnet 5.5 API trong CometAPI với mã định danh model claude-sonnet-5-5.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analyze this codebase and identify the three highest-impact bugs.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

Với môi trường sản xuất, hãy lưu khóa API trong biến môi trường và đánh giá thiết lập effort, caching, gọi công cụ, hành vi retry và mức tiêu thụ token cấp tác vụ.

What Is the Effort Setting in Claude Sonnet 5.5?

Claude Sonnet 5.5 hỗ trợ các mức nỗ lực điều chỉnh cho phép đánh đổi tốc độ và sử dụng token với độ sâu suy luận. Anthropic đặt mức mặc định là Medium trong ứng dụng Claude và Claude Code, trong khi Claude Platform mặc định là High.

Các mức effort thấp phù hợp với công việc thường lệ hoặc cấu trúc cao. Các mức cao hơn cho phép nhiều suy luận và kiểm tra hơn cho tác vụ lập trình, phân tích và agentic khó. Vì vậy, lập ngân sách sản xuất nên cân nhắc effort, việc dùng công cụ và tổng chi phí hoàn thành tác vụ thay vì chỉ giá token.

API: What’s new compared with Sonnet 5

Năm thay đổi có thể phá vỡ hoặc làm thay đổi tích hợp Sonnet 5 hiện có:

  1. Thinking-off migrations: các tích hợp đã tắt thinking nên chuyển sang thinking: {"type": "between_tools"}. Thiết lập này tắt thinking ban đầu trong khi vẫn giữ hành vi suy luận giữa các công cụ.
  2. Forced tool use: lựa chọn công cụ bắt buộc giờ sẽ trả về lỗi; hãy dùng lựa chọn công cụ tự động với schema nghiêm ngặt khi phù hợp.
  3. Thinking-block preservation: các thinking block gắn với model và cuộc hội thoại. Hãy truyền lại nguyên vẹn, và đừng giả định có thể phát lại sau khi thay đổi system message trước đó, công cụ hoặc ngữ cảnh tài khoản.
  4. Computer-use tool version: trên Claude API và Google Cloud, công cụ computer_20251124 cũ không còn được chấp nhận; hãy di trú sang bộ công cụ computer hiện được tài liệu.
  5. Advisor compatibility: công cụ advisor từ chối Claude Opus 4.8, Opus 4.7 và Sonnet 5 làm advisor.

Một thay đổi về dạng phản hồi bổ sung có thể lỗi ngầm: văn bản sinh ra giữa các lần gọi công cụ có thể xuất hiện trong thinking blocks thay vì text blocks. Ứng dụng truyền trực tiếp thông điệp tiến độ nên xử lý phản hồi theo loại block và đặt chế độ hiển thị phù hợp. Sonnet 5.5 cũng bổ sung effort theo từng message (beta), system message giữa hội thoại, thay đổi công cụ giữa hội thoại (beta), độ dài prompt tối thiểu có thể cache là 512 token, xử lý theo lô, hỗ trợ Files API, đầu vào PDF và thị giác, cùng cả công cụ phía máy chủ và phía khách.

What Does Claude Sonnet 5.5 Mean for the Claude 5.5 Family?

  • Claude Opus 5.5: công việc phức tạp, cần phán đoán cao, đường dài.
  • Claude Sonnet 5.5: sản xuất hiệu quả, lập trình, agent và công việc chuyên nghiệp.
  • Claude Haiku 5.5: đã công bố là thành viên sắp ra mắt, thông lượng cao, nhạy chi phí.

Xu hướng rộng hơn là chuyển sang đo chi phí mỗi tác vụ thành công, tốc độ suy luận và định tuyến model thay vì chỉ tập trung vào giá token thô hay một benchmark đơn lẻ.

Conclusion

Claude Sonnet 5.5 là bản nâng cấp tập trung hiệu suất cho tầng sản xuất của Anthropic. Nó giữ mức giá chuẩn $2/$10 của Sonnet 5 đồng thời bổ sung cửa sổ ngữ cảnh 1M token, tối đa 128K token đầu ra, tốc độ sinh nhanh hơn đáng kể và cải thiện mạnh ở lập trình, sử dụng máy tính, hiểu thị giác và công việc tri thức.

Lập luận mạnh nhất cho mẫu này là kinh tế học khối công việc: mức độ hoàn thành tác vụ đáng tin cậy và nhanh đến đâu, gọi bao nhiêu công cụ và tiêu thụ bao nhiêu token, và tần suất quy trình vẫn cần nâng cấp lên Opus 5.5. Các đội nên xác thực những yếu tố đó trên tác vụ của riêng mình và coi các benchmark liên nhà cung cấp là quan sát đã cũ thay vì xếp hạng cố định.

Tiếp tục học

Kết nối bài viết này với quyết định tiếp theo.

Xem tất cả chủ đề
Được xuất bản Sep 29, 2026
Cập nhật lần cuối Sep 29, 2026
0 lượt xem
Đã được xem xét về độ rõ ràng, ghi nguồn và thuật ngữ API hiện tại.

Sẵn sàng giảm 20% chi phí phát triển AI?

Bắt đầu miễn phí trong vài phút. Bao gồm tín dụng dùng thử miễn phí. Không cần thẻ tín dụng.

Đọc thêm