Claude Opus 4.5 là gì
Claude Opus 4.5 là mô hình ngôn ngữ lớn (LLM) dòng “Opus” mới nhất của Anthropic trong gia đình Claude 4.5, được xây dựng cho mục đích suy luận phức tạp, kỹ sư phần mềm chuyên nghiệp và các luồng công việc tác tử chạy dài. Anthropic định vị Opus 4.5 là lựa chọn hàng đầu cân bằng giữa năng lực tối đa với hiệu năng thực tế và mức giá dễ tiếp cận hơn so với các bản Opus trước. Bản phát hành này hoàn thiện gia đình Claude 4.5 bên cạnh Sonnet 4.5 và Haiku 4.5.
Model family / identifier: Claude Opus 4.5 (tên API do Anthropic ghi là claude-opus-4-5-20251101).
Các tính năng cốt lõi của Claude Opus 4.5
- Mục đích / thế mạnh chính: Kỹ sư phần mềm chuyên nghiệp, tác tử nâng cao, mô hình bảng tính/tài chính, luồng hội thoại nhiều lượt kéo dài, và “sử dụng máy tính” (tương tác với GUI, bảng tính, trình duyệt).
- Tham số Effort: Tham số yêu cầu mới (low / medium / high) đánh đổi compute/token để lấy độ sâu suy luận. Hữu ích để tinh chỉnh độ trễ/chi phí so với mức độ chi tiết của câu trả lời.
- Khả năng sử dụng máy tính & thị giác được tăng cường: Hành động thu phóng mới và cải thiện khả năng quan sát màn hình/UI để mô hình có thể đọc các phần tử UI nhỏ và hình ảnh chi tiết trước khi hành động.
- Tính liên tục trong suy luận: “Bảo toàn khối suy luận” — Opus 4.5 giữ lại các khối suy luận trước đó để duy trì tính liên tục xuyên suốt các phiên làm việc dài.
Chi tiết kỹ thuật của Claude Opus 4.5
Model identifier: claude-opus-4-5-20251101 (thường dùng trong các cuộc gọi API).
Context window & giới hạn token: đầu vào 200,000 tokens / đầu ra 64,000 tokens
Modalities: hỗ trợ đầu vào văn bản, mã, hình ảnh và tài liệu; đầu ra là văn bản (có cấu trúc và không có cấu trúc). Tích hợp đối tác bổ sung các tính năng (dự đoán theo lô, gọi hàm, bộ nhớ đệm prompt).
Hiệu năng benchmark & kết quả thực nghiệm
Anthropic và nhiều nguồn độc lập đã công bố/báo cáo các kết quả benchmark và hành vi kiểm thử cho Opus 4.5. Dưới đây là các tuyên bố và con số đáng chú ý:
- SWE-bench (bộ benchmark kỹ thuật phần mềm) — SWE-bench ≈ 80.9% theo đánh giá do Anthropic báo cáo. Opus 4.5 dẫn đầu ở 7/8 ngôn ngữ lập trình trong các bài kiểm thử SWE-bench Multilingual của Anthropic.
- Độ bền tác tử trong thế giới thực — cải thiện vận hành tác tử liên tục và xử lý tốt hơn các luồng công việc nhiều bước cùng điều phối công cụ.
- Aider Polyglot: +10.6% cải thiện so với Sonnet 4.5 trên các tác vụ mã hóa phức tạp. Anthropic
- Terminal Bench: +15% so với Sonnet 4.5 trong các luồng công việc terminal/mã nhiều bước.
- Vending-Bench (lập kế hoạch tầm xa): cải thiện 29% so với Sonnet 4.5 trên các nhiệm vụ tác tử tầm xa.
- Lập trình tự động: Anthropic báo cáo hiệu năng ổn định trong các phiên lập trình tự động 30 phút (so với các mô hình trước suy giảm sớm hơn).
Các trường hợp sử dụng điển hình và ưu tiên
- Kỹ thuật phần mềm phức tạp & script dài — sinh mã, gỡ lỗi, tái cấu trúc nhiều tệp, và tác tử lập trình tự động.
- Tác tử tự động và điều phối công cụ — xâu chuỗi lời gọi API, duyệt web, tự động hóa bảng tính, và các luồng công việc nhiều bước dài nơi trạng thái phải được duy trì qua nhiều lượt.
- Tổng hợp tài liệu lớn & nghiên cứu — bản tóm lược pháp lý, báo cáo dài, viết nhiều chương, và tóm tắt trên tập liệu rất lớn nhờ ngữ cảnh mở rộng và nén.
- Tự động hóa doanh nghiệp — công cụ nội bộ, trích xuất dữ liệu từ tệp/bảng tính, và tác tử vận hành quy trình nghiệp vụ liên tục.
So sánh Claude Opus 4.5 vs Gemini 3.0 Pro vs GPT 5.1
| Khía cạnh | Claude Opus 4.5 (Anthropic) | Gemini 3.0 Pro (Google) | GPT 5.1 (OpenAI) |
|---|---|---|---|
| Tên mô hình | claude-opus-4-5-20251101-thinking;claude-opus-4-5-20251101 | gemini-3-pro-preview-thinking;gemini-3-pro-preview | gpt-5.1-chat-latest;gpt-5.1 |
| Thế mạnh chính | Độ tin cậy tác tử tầm xa, hiệu quả sử dụng token, mã hóa & điều phối đa tác tử, tập trung an toàn. | Suy luận tiên phong, hiệu năng đa phương thức, điểm số dẫn đầu bảng xếp hạng (LMArena, GPQA, MathArena); tích hợp Google rộng. | Suy luận thích ứng, trải nghiệm cho nhà phát triển, bộ nhớ đệm prompt mở rộng (24h), tương tác nhanh và công cụ mã hóa. |
| Giá tham khảo (đầu vào/đầu ra trên mỗi 1M token) | $5 / $25 (Anthropic nêu cho Opus 4.5). — giá bản xem trước cho doanh nghiệp. | Các bậc xem trước được báo cáo ≈ $2 / $12 hoặc cao hơn (phụ thuộc khu vực / gói). | $1.25 / $10 (giá API GPT-5.1 do OpenAI công bố). |
| Ngữ cảnh / cửa sổ & bộ nhớ | Tập trung vào nén ngữ cảnh, tính năng bộ nhớ và các phiên dài hiệu quả; tối ưu cho chạy đa tác tử. | Cửa sổ ngữ cảnh rất lớn được báo cáo (1M token ở bản xem trước) và đầu vào đa phương thức (văn bản, hình ảnh, âm thanh, video). | Bộ nhớ đệm prompt mở rộng và suy luận thích ứng hiệu quả; caching nhằm giảm chi phí & độ trễ cho lượt theo sau. |
| Phù hợp nhất cho | Tác tử doanh nghiệp, luồng lập trình tự động dài, chạy dài nhạy chi phí, môi trường tuân thủ với kiểm soát an toàn. | Nghiên cứu/benchmark, suy luận đa phương thức, các tính năng tích hợp trong hệ sinh thái Google (Search/Ads/Apps). | Sản phẩm dành cho nhà phát triển cần tương tác nhanh, hỗ trợ mã hóa độ trễ thấp, quy trình lặp lại hưởng lợi từ prompt caching. |
Cách truy cập API Claude opus 4.5
Bước 1: Đăng ký khóa API
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Lấy khóa truy cập API. Nhấp “Add Token” tại phần API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu tới API Claude opus 4.5
Chọn endpoint “claude-opus-4-5-20251101-thinking;claude-opus-4-5-20251101” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức yêu cầu và nội dung yêu cầu được lấy từ tài liệu API trên trang web của chúng tôi. Trang web cũng cung cấp kiểm thử Apifox để bạn thuận tiện sử dụng. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế từ tài khoản của bạn. base URL theo định dạng Anthropic Messages và Chat.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đây là nội dung mà mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để lấy câu trả lời được tạo. Sau khi xử lý, API phản hồi trạng thái tác vụ và dữ liệu đầu ra.
See also Gemini 3 Pro Preview API