Tổng quan API Claude Opus 5
Claude Opus 5 API là mô hình lớp Opus của Anthropic dành cho lập trình tác nhân phức tạp, tự động hóa doanh nghiệp, lập luận sâu, phân tích ngữ cảnh dài và công việc tri thức giá trị cao. Anthropic phát hành Claude Opus 5 vào ngày 24 tháng 7, 2026, với ID mô hình API claude-opus-5, cửa sổ ngữ cảnh 1M token, đầu ra đồng bộ tối đa 128k, tư duy thích ứng bật theo mặc định, cùng các điều khiển mới cho effort, fallback, bộ nhớ đệm prompt và thay đổi công cụ.
Thông số kỹ thuật
| Hạng mục | Thông số |
|---|---|
| Tên mô hình | Claude Opus 5 |
| ID mô hình API | claude-opus-5 |
| Nhà cung cấp | Anthropic |
| Endpoint CometAPI gốc | POST /v1/messages |
| Endpoint CometAPI tương thích OpenAI | POST /v1/chat/completions |
| Loại đầu vào | Đầu vào văn bản và hình ảnh |
| Loại đầu ra | Đầu ra văn bản |
| Cửa sổ ngữ cảnh | 1M tokens |
| Số token đầu ra tối đa | 128k tokens trên Messages API đồng bộ; lên đến 300k token đầu ra trên các yêu cầu Message Batches API được hỗ trợ với header beta output-300k-2026-03-24 của Anthropic |
| Tư duy thích ứng | Có; bật theo mặc định |
| Điều khiển nỗ lực | low, medium, high, xhigh, và max; high là mặc định trên Claude API và Claude Code |
| Giá chính thức của Anthropic | $5 mỗi triệu token đầu vào và $25 mỗi triệu token đầu ra |
| Giá bộ nhớ đệm prompt | $6.25 mỗi triệu ghi cache 5 phút, $10 mỗi triệu ghi cache 1 giờ, và $0.50 mỗi triệu cache hit |
| Giá niêm yết trên CometAPI | $4 mỗi triệu token đầu vào và $20 mỗi triệu token đầu ra, theo trang mô hình CometAPI Claude Opus 5 kiểm tra vào ngày 26 tháng 7, 2026 |
| Mốc kiến thức đáng tin cậy | Tháng 5, 2026 |
Claude Opus 5 là gì và có gì mới?
Claude Opus 5 là mô hình Opus kế tiếp sau Claude Opus 4.8. Anthropic định vị nó là mô hình nên bắt đầu khi làm việc với lập trình tác nhân phức tạp và công việc doanh nghiệp, trong khi Claude Fable 5 vẫn là lựa chọn có năng lực cao hơn cho khối lượng công việc nơi trí tuệ đỉnh cao quan trọng hơn giá hoặc độ trễ. Khác biệt thực tế là giá–hiệu năng: Anthropic cho biết Opus 5 tiệm cận năng lực của Fable 5 với một nửa giá token chính thức và cải thiện đáng kể so với Opus 4.8 ở cùng mức giá chính thức.
Thay đổi lớn nhất cho nhà phát triển là Claude Opus 5 không chỉ là một chuỗi mô hình mạnh hơn. Hành vi API của nó thay đổi theo cách ảnh hưởng đến tích hợp sản xuất. Tư duy thích ứng được bật theo mặc định, và tham số effort giờ là cách chính để đánh đổi độ sâu với tốc độ và mức dùng token. Mô hình cũng hỗ trợ ngưỡng tối thiểu bộ nhớ đệm prompt thấp hơn 512 token, thay đổi công cụ giữa cuộc hội thoại (beta), fallback phía máy chủ (beta) và Fast mode trên Claude API. Việc tắt thinking ở mức effort xhigh hoặc max sẽ trả về lỗi 400; nếu một ứng dụng buộc phải tắt thinking, nên dùng effort high hoặc thấp hơn.
Hiệu năng benchmark của Claude Opus 5
Claude Opus 5 có hỗ trợ benchmark mạnh từ Anthropic, ARC Prize và Artificial Analysis. Anthropic báo cáo rằng Opus 5 vượt gấp đôi Claude Opus 4.8 trên Frontier-Bench v0.1 với chi phí mỗi tác vụ thấp hơn, đạt sát trong 0.5% điểm CursorBench 3.2 đỉnh của Claude Fable 5 ở mức effort tối đa, và vượt các mô hình khác trên những so sánh chi phí–hiệu năng được chọn cho công việc tri thức và sử dụng máy tính.
Các nhà cung cấp benchmark độc lập bổ sung số liệu cụ thể hơn. ARC Prize báo cáo rằng Claude Opus 5 High đạt 30.16% trên ARC-AGI-3, trong khi Opus 5 Max đạt 97.5% trên ARC-AGI-1 và 90.4% trên ARC-AGI-2 Semi-Private. Artificial Analysis báo cáo điểm Intelligence Index là 61 cho Claude Opus 5 Max, 89% trên Terminal-Bench v2.1 ở effort tối đa, 1861 Elo trên GDPval-AA v2, và 1720 Elo trên AA-Briefcase.
| Benchmark hoặc chỉ số | Kết quả Claude Opus 5 |
|---|---|
| ARC-AGI-3 Public Demo, High effort | 30.16% |
| ARC-AGI-1, Max effort | 97.5% |
| ARC-AGI-2 Semi-Private, Max effort | 90.4% |
| Artificial Analysis Intelligence Index, Max effort | 61 |
| Terminal-Bench v2.1, Max effort | 89% |
| GDPval-AA v2, Max effort | 1861 Elo |
| AA-Briefcase, Max effort | 1720 Elo |
| Tốc độ xuất, Max effort | 52.6 token mỗi giây |
| Thời gian đến token trả lời đầu tiên, Max effort | 68.04 giây |
Những kết quả này gợi ý Claude Opus 5 mạnh nhất khi quy trình làm việc thưởng cho việc lập kế hoạch, xác minh, sử dụng công cụ, hoàn thành nhiều bước và suy luận ngữ cảnh dài. Chúng cũng cho thấy đánh đổi độ trễ ở thiết lập lập luận cao, vì vậy các nhóm sản xuất nên đánh giá chi phí trên mỗi tác vụ thành công thay vì chỉ hạng trên benchmark.
Tính năng và điểm nổi bật của Claude Opus 5
Ngữ cảnh 1M token cho khối lượng lớn
Claude Opus 5 hỗ trợ cửa sổ ngữ cảnh 1M token cả là mặc định lẫn tối đa. Điều đó khiến nó phù hợp cho lập trình ở quy mô kho lưu trữ, hợp đồng pháp lý dài, nghiên cứu đa tài liệu, sổ làm việc tài chính, dòng thời gian sự cố, lịch sử hỗ trợ khách hàng và phân tích kho tri thức doanh nghiệp.
Tư duy thích ứng theo mặc định
Khác với Claude Opus 4.8, vốn yêu cầu bật tư duy thích ứng một cách tường minh, Claude Opus 5 chạy với tư duy thích ứng theo mặc định. Mô hình tự quyết định mức thinking cho mỗi lượt, trong khi nhà phát triển dùng effort để điều chỉnh hành vi.
Các mức effort để kiểm soát chi phí–chất lượng
Claude Opus 5 hỗ trợ các mức effort low, medium, high, xhigh, và max. Anthropic khuyến nghị bắt đầu ở high mặc định, hạ xuống khi chất lượng vẫn giữ, và tăng lên cho các tác vụ lập trình/hệ tác nhân khó với tầm nhìn dài.
Lập trình tác nhân và kiểm chứng mạnh hơn
Anthropic mô tả Opus 5 là bước nhảy so với Opus 4.8 cho lập trình tác nhân, tác vụ tầm nhìn dài, review mã và tìm lỗi. Trên thực tế, đây là lớp mô hình nên thử khi một tác nhân AI phải kiểm tra tệp, gọi công cụ, chạy kiểm tra, sửa sai và hoàn tất công việc đa tệp thay vì chỉ nháp đoạn mã.
Kinh tế bộ nhớ đệm prompt tốt hơn cho ngữ cảnh ngắn
Độ dài prompt tối thiểu có thể cache giảm từ 1,024 token trên Claude Opus 4.8 xuống 512 token trên Claude Opus 5. Với phiên tác nhân lặp lại, system prompt chung, manifest công cụ, hoặc ngữ cảnh dự án dài, bộ nhớ đệm prompt có thể giảm chi phí đầu vào lặp lại vì cache hit được định giá thấp hơn token đầu vào mới.
Thay đổi công cụ giữa cuộc hội thoại
Claude Opus 5 hỗ trợ beta thay đổi công cụ giữa cuộc hội thoại. Nhà phát triển có thể thêm hoặc bỏ công cụ khả dụng giữa các lượt trong khi vẫn giữ cache prompt, hữu ích khi tác nhân chuyển từ nghiên cứu sang lập trình, từ lập trình sang thử nghiệm, hoặc từ phân tích sang triển khai.
Fallback phía máy chủ cho các trường hợp từ chối
Tham số beta fallbacks của Anthropic có thể dùng một chế độ fallback mặc định cho các danh mục từ chối của bộ phân loại an toàn. Đây không phải là hệ thống khả dụng chung hoặc retry do giới hạn tốc độ; nó được thiết kế cho các trường hợp Anthropic có mô hình fallback khuyến nghị cho một danh mục từ chối.
Claude Opus 5 vs Claude Sonnet 5 vs Opus 4.8 vs Fable 5
| Khía cạnh | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| Vai trò phù hợp nhất | Lập trình tác nhân phức tạp và công việc doanh nghiệp | Công việc sản xuất thông minh cao với tốc độ nhanh | Chuẩn Opus trước đây và fallback di trú | Năng lực Claude cao nhất phát hành rộng rãi |
| ID mô hình API | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Giá chính thức Anthropic | $5/M đầu vào, $25/M đầu ra | $2/M đầu vào và $10/M đầu ra đến 31/8/2026; $3/M đầu vào và $15/M đầu ra từ 1/9/2026 | $5/M đầu vào, $25/M đầu ra | $10/M đầu vào, $50/M đầu ra |
| Độ trễ tương đối | Vừa phải | Nhanh | Không liệt kê trong bảng so sánh mẫu mới nhất hiện tại; chuẩn Opus trước đây | Chậm hơn |
| Tư duy thích ứng | Bật theo mặc định | Bật theo mặc định | Có nhưng không mặc định trừ khi được chỉ định | Luôn bật |
| Hỗ trợ effort | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| Mốc kiến thức | Tháng 5, 2026 | Tháng 1, 2026 | Không hiển thị trong bảng mô hình mới nhất của Anthropic | Tháng 1, 2026 |
| Khi nào nên chọn | Dùng khi độ chính xác cấp Opus quan trọng nhưng Fable 5 quá đắt hoặc chậm | Dùng cho khối lượng lớn: lập trình, hỗ trợ, tài liệu và quy trình tác nhân | Duy trì hành vi cố định cho hệ thống cũ, fallback, hoặc so sánh khi di trú | Dùng khi năng lực Claude cao nhất hiện có biện minh cho chi phí cao hơn |
Ngoài ra, đầu vào tối đa và cửa sổ ngữ cảnh của chúng là như nhau.
Claude Opus 5 là lựa chọn cao cấp cân bằng nhất trong nhóm này. Claude Sonnet 5 phù hợp hơn cho lưu lượng sản xuất nhạy về khối lượng, Claude Opus 4.8 chủ yếu là chuẩn kế thừa sau khi Opus 5 ra mắt, và Claude Fable 5 là lựa chọn năng lực cao khi chi phí là yếu tố phụ.
Cách dùng Claude Opus 5 API trên CometAPI
Bước 1: Tạo khóa CometAPI
Đăng nhập CometAPI, mở trang khóa API, tạo khóa và lưu vào biến môi trường như COMETAPI_KEY. Không đặt khóa API sản xuất trong mã phía khách, kho công khai, ảnh chụp màn hình hoặc phiếu hỗ trợ.
Bước 2: Gọi endpoint Messages gốc của Anthropic
Dùng tuyến /v1/messages gốc khi bạn muốn hành vi đặc thù của Claude như tư duy thích ứng, điều khiển effort, bộ nhớ đệm prompt, sử dụng công cụ, tìm kiếm web, streaming và khối nội dung phản hồi kiểu Anthropic.
Bước 3: Dùng endpoint tương thích OpenAI để định tuyến linh hoạt
Dùng /v1/chat/completions khi ứng dụng của bạn đã sử dụng SDK tương thích OpenAI hoặc khi bạn muốn so sánh Claude Opus 5 với GPT, Gemini, DeepSeek, Kimi, Qwen và các mô hình khác sau một lớp định tuyến.
Trong sản xuất, hãy thử cả hai endpoint với prompt thực, ghi log token đầu vào, token đầu ra, hành vi cache, mức effort, độ trễ, hành vi từ chối và tỉ lệ nhiệm vụ thành công cuối cùng. Dùng tài liệu chính thức của Anthropic làm nguồn uy tín cho tham số đặc thù Claude và tài liệu CometAPI để biết cách chuyển tiếp hình dạng yêu cầu đó.
Có thể làm gì với Claude Opus 5
Claude Opus 5 phù hợp nhất cho ứng dụng nơi tính đúng đắn và hoàn tất quan trọng hơn một câu trả lời rẻ, một lần. Nhà phát triển có thể xây dựng tác nhân lập trình quy mô kho, trợ lý di trú, công cụ điều tra lỗi, hệ thống review mã, trợ lý nghiên cứu ngữ cảnh dài, bộ phân tích tài liệu pháp lý và tài chính, quy trình tài liệu khoa học, bot leo thang hỗ trợ kỹ thuật, công cụ tạo bảng tính và slide, và trợ lý vận hành tự động.
Nó cũng hữu ích như một mô hình leo thang trong kiến trúc đa mô hình. Sản phẩm có thể định tuyến lưu lượng hỗ trợ thường hoặc trích xuất sang Claude Sonnet 5 hoặc mô hình chi phí thấp hơn, rồi leo thang các lượt mơ hồ, rủi ro hoặc giá trị cao lên Claude Opus 5. Mẫu này giúp mô hình cao cấp tập trung vào công việc nơi lập luận sâu có thể thay đổi kết quả.
Dùng Claude Opus 5 API cho tác nhân lập trình khó, gỡ lỗi nguyên nhân gốc, tái cấu trúc đa tệp, review mã, phân tích tài liệu doanh nghiệp, mô hình tài chính, rà soát pháp lý, lập luận khoa học, nghiên cứu ngữ cảnh dài, tạo báo cáo chuyên nghiệp và tự động hóa vận hành. Trên CometAPI, mẫu triển khai mạnh nhất là leo thang có chọn lọc: thử Claude Opus 5 so với Claude Sonnet 5, Claude Fable 5 và các lựa chọn ngoài Claude, rồi định tuyến mỗi khối công việc theo chi phí mỗi kết quả được chấp nhận thay vì theo danh tiếng mô hình.
Vì sao dùng CometAPI cho Claude Opus 5?
CometAPI hữu ích cho Claude Opus 5 khi nhóm muốn một khóa API, thanh toán hợp nhất, so sánh mô hình và di trú dễ hơn giữa các nhà cung cấp. CometAPI tài liệu hóa cả endpoint Messages gốc Anthropic và endpoint Chat Completions tương thích OpenAI, vì vậy các nhóm có thể chọn điều khiển chuẩn Claude cho quy trình nâng cao hoặc giữ hình dạng tích hợp linh hoạt cho định tuyến đa mô hình.
Hạn chế
Claude Opus 5 là mô hình lập luận cao cấp, không phải lựa chọn mặc định cho mọi yêu cầu. Ở mức effort cao hơn, nó có thể dùng nhiều token hơn và tạo độ trễ thời gian đến token đầu tiên cao hơn so với các mô hình nhẹ. Artificial Analysis báo cáo 68.04 giây đến token trả lời đầu tiên cho phép đo effort tối đa của họ, điều này khiến định tuyến và lựa chọn effort trở nên quan trọng cho ứng dụng đối mặt người dùng.
Nhà phát triển cũng tránh giả định hành vi không được hỗ trợ. Anthropic chưa công bố số tham số của mô hình, và trọng số mô hình là sở hữu độc quyền. Fast mode đang ở giai đoạn nghiên cứu thử nghiệm trên Claude API, không phải mọi nền tảng đám mây đều có. Fallback phía máy chủ và thay đổi công cụ giữa cuộc hội thoại là các tính năng beta. Với quy trình bảo mật, Anthropic nêu rằng Opus 5 có thể hỗ trợ các trường hợp sử dụng phát hiện lỗ hổng có lợi nhưng áp dụng biện pháp bảo vệ cho các tác vụ rủi ro cao hơn như quét lỗ hổng dựa trên nhị phân, kiểm thử xâm nhập và tạo khai thác.