Tổng quan API Claude Opus 5
Claude Opus 5 API là mô hình cấp Opus của Anthropic dành cho lập trình tác tử phức tạp, tự động hóa doanh nghiệp, suy luận sâu, phân tích ngữ cảnh dài và công việc tri thức giá trị cao. Anthropic phát hành Claude Opus 5 vào ngày 24 tháng 7 năm 2026 với ID mô hình API claude-opus-5, cửa sổ ngữ cảnh 1M token, đầu ra đồng bộ tối đa 128k, tư duy thích ứng bật theo mặc định, cùng các điều khiển mới cho effort, fallback, bộ nhớ đệm prompt và thay đổi công cụ.
Thông số kỹ thuật
| Mục | Thông số |
|---|---|
| Tên mô hình | Claude Opus 5 |
| ID mô hình API | claude-opus-5 |
| Nhà cung cấp | Anthropic |
| Endpoint CometAPI gốc | POST /v1/messages |
| Endpoint CometAPI tương thích OpenAI | POST /v1/chat/completions |
| Loại đầu vào | Văn bản và hình ảnh |
| Loại đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 1M token |
| Số token đầu ra tối đa | 128k token trên Messages API đồng bộ; lên tới 300k token đầu ra trên các yêu cầu Message Batches API được hỗ trợ với header beta output-300k-2026-03-24 của Anthropic |
| Tư duy thích ứng | Có; bật theo mặc định |
| Kiểm soát effort | low, medium, high, xhigh và max; high là mặc định trên Claude API và Claude Code |
| Giá chính thức của Anthropic | $5 mỗi triệu token đầu vào và $25 mỗi triệu token đầu ra |
| Giá bộ nhớ đệm prompt | $6.25 mỗi triệu lượt ghi bộ nhớ đệm 5 phút, $10 mỗi triệu lượt ghi bộ nhớ đệm 1 giờ và $0.50 mỗi triệu lượt truy cập bộ nhớ đệm |
| Giá niêm yết trên CometAPI | $4 mỗi triệu token đầu vào và $20 mỗi triệu token đầu ra, theo trang mô hình Claude Opus 5 trên CometAPI được kiểm tra vào ngày 26 tháng 7 năm 2026 |
| Mốc kiến thức đáng tin cậy | Tháng 5 năm 2026 |
Claude Opus 5 là gì và có gì mới?
Claude Opus 5 là mô hình Opus tiếp theo sau Claude Opus 4.8. Anthropic định vị đây là mô hình khởi điểm cho lập trình tác tử phức tạp và công việc doanh nghiệp, trong khi Claude Fable 5 vẫn là lựa chọn khả năng cao hơn cho khối lượng công việc nơi trí tuệ đạt đỉnh quan trọng hơn giá hoặc độ trễ. Khác biệt thực tế là giá-hiệu năng: Anthropic cho biết Opus 5 tiến gần khả năng của Fable 5 với một nửa giá token chính thức và cải thiện đáng kể so với Opus 4.8 ở cùng mức giá chính thức.
Thay đổi lớn nhất đối với nhà phát triển là Claude Opus 5 không chỉ là một chuỗi mô hình mạnh hơn. Hành vi API của nó thay đổi theo cách ảnh hưởng đến tích hợp sản xuất. Tư duy thích ứng được bật theo mặc định, và tham số effort giờ là cách chính để cân bằng độ sâu với tốc độ và mức sử dụng token. Mô hình cũng hỗ trợ mức tối thiểu bộ nhớ đệm prompt thấp hơn là 512 token, thay đổi công cụ giữa hội thoại (beta), hành vi fallback phía máy chủ (beta), và Chế độ Fast trên Claude API. Việc tắt tư duy ở effort xhigh hoặc max sẽ trả về lỗi 400; nếu ứng dụng buộc phải tắt tư duy, hãy dùng effort high hoặc thấp hơn.
Hiệu năng điểm chuẩn của Claude Opus 5
Claude Opus 5 có hỗ trợ điểm chuẩn mạnh từ Anthropic, ARC Prize và Artificial Analysis. Anthropic báo cáo Opus 5 vượt gấp đôi Claude Opus 4.8 trên Frontier-Bench v0.1 với chi phí mỗi tác vụ thấp hơn, đạt gần 0.5% so với điểm CursorBench 3.2 đỉnh của Claude Fable 5 ở effort max, và vượt trội các mô hình khác trên một số so sánh chi phí-hiệu năng cho công việc tri thức và sử dụng máy tính.
Các nhà cung cấp điểm chuẩn độc lập đưa ra số liệu cụ thể hơn. ARC Prize báo cáo Claude Opus 5 High đạt 30.16% trên ARC-AGI-3, trong khi Opus 5 Max đạt 97.5% trên ARC-AGI-1 và 90.4% trên ARC-AGI-2 Semi-Private. Artificial Analysis báo cáo điểm Intelligence Index là 61 cho Claude Opus 5 Max, 89% trên Terminal-Bench v2.1 ở effort max, 1861 Elo trên GDPval-AA v2, và 1720 Elo trên AA-Briefcase.
| Điểm chuẩn hoặc chỉ số | Kết quả Claude Opus 5 |
|---|---|
| ARC-AGI-3 Public Demo, effort High | 30.16% |
| ARC-AGI-1, effort Max | 97.5% |
| ARC-AGI-2 Semi-Private, effort Max | 90.4% |
| Artificial Analysis Intelligence Index, effort Max | 61 |
| Terminal-Bench v2.1, effort Max | 89% |
| GDPval-AA v2, effort Max | 1861 Elo |
| AA-Briefcase, effort Max | 1720 Elo |
| Tốc độ đầu ra, effort Max | 52.6 token mỗi giây |
| Thời gian tới token câu trả lời đầu tiên, effort Max | 68.04 giây |
Những kết quả này cho thấy Claude Opus 5 mạnh nhất khi quy trình làm việc đề cao lập kế hoạch, kiểm chứng, sử dụng công cụ, hoàn thành nhiều bước và suy luận ngữ cảnh dài. Chúng cũng cho thấy sự đánh đổi về độ trễ ở thiết lập suy luận cao, vì vậy các đội sản xuất nên đánh giá chi phí mỗi tác vụ thành công thay vì chỉ thứ hạng điểm chuẩn.
Tính năng và điểm nổi bật của Claude Opus 5
Ngữ cảnh 1M token cho khối lượng công việc lớn
Claude Opus 5 hỗ trợ cửa sổ ngữ cảnh 1M token vừa là mặc định vừa là kích thước tối đa. Điều này phù hợp cho lập trình ở quy mô kho mã, hợp đồng pháp lý dài, nghiên cứu đa tài liệu, sổ làm việc tài chính, dòng thời gian sự cố, lịch sử hỗ trợ khách hàng và phân tích cơ sở tri thức doanh nghiệp.
Tư duy thích ứng theo mặc định
Khác với Claude Opus 4.8, vốn yêu cầu bật tư duy thích ứng một cách rõ ràng, Claude Opus 5 chạy với tư duy thích ứng theo mặc định. Mô hình quyết định mức tư duy cho mỗi lượt, trong khi nhà phát triển dùng effort để tinh chỉnh hành vi.
Cấp độ effort cho kiểm soát chi phí-chất lượng
Claude Opus 5 hỗ trợ các mức effort low, medium, high, xhigh và max. Anthropic khuyến nghị bắt đầu ở high, giảm xuống khi chất lượng được giữ ổn định, và tăng lên cho các tác vụ lập trình tầm xa hoặc tác tử khó nhất.
Khả năng lập trình tác tử và kiểm chứng mạnh hơn
Anthropic mô tả Opus 5 là bước nhảy so với Opus 4.8 cho lập trình tác tử, tác vụ tầm xa, rà soát mã và tìm lỗi. Trên thực tế, đây là lớp mô hình cần thử khi một tác tử AI phải kiểm tra tệp, gọi công cụ, chạy kiểm tra, sửa lỗi và hoàn thành công việc đa tệp thay vì chỉ phác thảo đoạn mã.
Kinh tế bộ nhớ đệm prompt tốt hơn cho ngữ cảnh ngắn hơn
Độ dài prompt có thể được đưa vào bộ nhớ đệm tối thiểu giảm từ 1,024 token trên Claude Opus 4.8 xuống 512 token trên Claude Opus 5. Với phiên tác tử lặp lại, prompt hệ thống dùng chung, mô tả công cụ hoặc ngữ cảnh dự án dài, bộ nhớ đệm prompt có thể giảm chi phí đầu vào lặp lại vì lượt truy cập bộ nhớ đệm có giá thấp hơn token đầu vào mới.
Thay đổi công cụ giữa hội thoại
Claude Opus 5 hỗ trợ beta thay đổi công cụ giữa hội thoại. Nhà phát triển có thể thêm hoặc bỏ công cụ sẵn có giữa các lượt trong khi vẫn giữ bộ nhớ đệm prompt, hữu ích khi tác tử chuyển từ nghiên cứu sang lập trình, từ lập trình sang kiểm thử, hoặc từ phân tích sang triển khai.
Fallback phía máy chủ cho các trường hợp từ chối
Tham số fallbacks beta của Anthropic có thể dùng chế độ fallback mặc định cho các danh mục từ chối của bộ phân loại an toàn. Đây không phải là hệ thống khả dụng chung hoặc thử lại do giới hạn tỉ lệ; nó được thiết kế cho các trường hợp Anthropic có mô hình fallback khuyến nghị cho một danh mục từ chối.
Claude Opus 5 so với Claude Sonnet 5, Opus 4.8 và Fable 5
| Khía cạnh | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| Vai trò phù hợp nhất | Lập trình tác tử phức tạp và công việc doanh nghiệp | Công việc sản xuất tốc độ cao với trí tuệ vượt trội | Chuẩn Opus trước đây và fallback/mốc so sánh cho chuyển đổi | Khả năng Claude cao nhất được phát hành rộng rãi |
| ID mô hình API | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Giá chính thức Anthropic | $5/M đầu vào, $25/M đầu ra | $2/M đầu vào và $10/M đầu ra đến hết ngày 31/8/2026; $3/M đầu vào và $15/M đầu ra từ 1/9/2026 | $5/M đầu vào, $25/M đầu ra | $10/M đầu vào, $50/M đầu ra |
| Độ trễ so sánh | Vừa phải | Nhanh | Không liệt kê trong bảng so sánh mô hình mới nhất hiện tại; chuẩn Opus trước đây | Chậm hơn |
| Tư duy thích ứng | Bật theo mặc định | Bật theo mặc định | Có sẵn nhưng không mặc định trừ khi được chỉ định | Luôn bật |
| Hỗ trợ effort | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| Mốc kiến thức | Tháng 5 năm 2026 | Tháng 1 năm 2026 | Không hiển thị trong bảng mô hình mới nhất của Anthropic | Tháng 1 năm 2026 |
| Khi nên chọn | Dùng khi độ chính xác cấp Opus quan trọng nhưng Fable 5 quá đắt hoặc chậm | Dùng cho khối lượng công việc lớn về lập trình, hỗ trợ, tài liệu và tác tử | Giữ lại cho hành vi di sản đã cố định, fallback hoặc so sánh chuyển đổi | Dùng khi khả năng cao nhất của Claude xứng đáng mức giá cao hơn |
Ngoài ra, kích thước đầu vào tối đa và cửa sổ ngữ cảnh của chúng là như nhau.
Claude Opus 5 là lựa chọn cao cấp cân bằng nhất trong nhóm này. Claude Sonnet 5 phù hợp hơn cho lưu lượng sản xuất nhạy về khối lượng, Claude Opus 4.8 chủ yếu là chuẩn di sản sau khi Opus 5 ra mắt, và Claude Fable 5 là lựa chọn khả năng cao khi chi phí là thứ yếu.
Cách sử dụng API Claude Opus 5 trên CometAPI
Bước 1: Tạo khóa CometAPI
Đăng nhập CometAPI, mở trang khóa API, tạo khóa và lưu vào biến môi trường như COMETAPI_KEY. Không đặt khóa API sản xuất trong mã phía khách, kho công khai, ảnh chụp màn hình hoặc phiếu hỗ trợ.
Bước 2: Gọi endpoint Messages gốc của Anthropic
Sử dụng tuyến /v1/messages gốc khi bạn muốn hành vi đặc trưng của Claude như tư duy thích ứng, kiểm soát effort, bộ nhớ đệm prompt, sử dụng công cụ, tìm kiếm web, streaming và khối nội dung phản hồi kiểu Anthropic.
Bước 3: Sử dụng endpoint tương thích OpenAI để định tuyến linh hoạt
Dùng /v1/chat/completions khi ứng dụng của bạn đã dùng SDK tương thích OpenAI hoặc khi bạn muốn so sánh Claude Opus 5 với GPT, Gemini, DeepSeek, Kimi, Qwen và các mô hình khác sau một lớp định tuyến.
Cho sản xuất, hãy thử nghiệm cả hai endpoint với prompt thực tế, ghi log token đầu vào, token đầu ra, hành vi bộ nhớ đệm, mức effort, độ trễ, hành vi từ chối và kết quả tác vụ cuối cùng. Sử dụng tài liệu chính thức của Anthropic làm thẩm quyền cho các tham số đặc thù của Claude và tài liệu của CometAPI cho cách hình dạng yêu cầu đó được chuyển tiếp.
Khả năng với Claude Opus 5
Claude Opus 5 phù hợp nhất với các ứng dụng nơi tính đúng đắn và khả năng hoàn thành quan trọng hơn một câu trả lời đơn rẻ tiền. Nhà phát triển có thể xây dựng tác tử lập trình ở quy mô kho mã, trợ lý chuyển đổi, công cụ điều tra lỗi, hệ thống rà soát mã, trợ lý nghiên cứu ngữ cảnh dài, bộ phân tích tài liệu pháp lý và tài chính, quy trình văn liệu khoa học, bot leo thang hỗ trợ kỹ thuật, công cụ tạo bảng tính và slide, và trợ lý vận hành tự động.
Nó cũng hữu ích như mô hình leo thang trong kiến trúc đa mô hình. Sản phẩm có thể định tuyến lưu lượng hỗ trợ hoặc trích xuất thông thường sang Claude Sonnet 5 hoặc các mô hình chi phí thấp hơn, sau đó leo thang các lượt mơ hồ, rủi ro hoặc giá trị cao sang Claude Opus 5. Mẫu hình này giữ mô hình cao cấp tập trung vào công việc nơi suy luận sâu tạo ra khác biệt về kết quả.
Sử dụng Claude Opus 5 API cho tác tử lập trình khó, gỡ lỗi nguyên nhân gốc, tái cấu trúc đa tệp, rà soát mã, phân tích tài liệu doanh nghiệp, mô hình tài chính, rà soát pháp lý, suy luận khoa học, nghiên cứu ngữ cảnh dài, tạo báo cáo chuyên nghiệp và tự động hóa vận hành. Trên CometAPI, mẫu triển khai mạnh nhất là leo thang chọn lọc: thử Claude Opus 5 so với Claude Sonnet 5, Claude Fable 5 và các lựa chọn ngoài Claude, rồi định tuyến từng khối lượng công việc theo chi phí mỗi kết quả được chấp nhận thay vì theo danh tiếng mô hình.
Vì sao dùng CometAPI cho Claude Opus 5?
CometAPI hữu ích cho Claude Opus 5 khi đội ngũ muốn một khóa API, thanh toán hợp nhất, so sánh mô hình và di chuyển dễ hơn giữa các nhà cung cấp. CometAPI tài liệu hóa cả endpoint Messages gốc của Anthropic và endpoint Chat Completions tương thích OpenAI, vì vậy các đội có thể chọn điều khiển đặc thù Claude cho quy trình nâng cao hoặc giữ hình dạng tích hợp linh hoạt cho định tuyến đa mô hình.
Hạn chế
Claude Opus 5 là mô hình suy luận cao cấp, không phải lựa chọn mặc định cho mọi yêu cầu. Ở thiết lập effort cao hơn, nó có thể dùng nhiều token hơn và tạo độ trễ thời gian tới token đầu tiên cao hơn so với các mô hình nhẹ hơn. Artificial Analysis báo cáo 68.04 giây tới token câu trả lời đầu tiên cho phép đo effort max, điều này khiến định tuyến và lựa chọn effort trở nên quan trọng cho ứng dụng hướng người dùng.
Nhà phát triển cũng nên tránh giả định các hành vi không được hỗ trợ. Anthropic chưa công bố số lượng tham số mô hình, và trọng số mô hình là sở hữu độc quyền. Chế độ Fast đang ở giai đoạn nghiên cứu trên Claude API, không có trên mọi nền tảng đám mây. Fallback phía máy chủ và thay đổi công cụ giữa hội thoại là các tính năng beta. Đối với quy trình bảo mật, Anthropic cho biết Opus 5 có thể hỗ trợ các trường hợp tìm lỗ hổng có lợi nhưng áp dụng biện pháp bảo vệ cho các tác vụ rủi ro cao như quét lỗ hổng dựa trên nhị phân, kiểm thử thâm nhập và tạo khai thác.