Claude Opus 5.2 đã lặng lẽ bước vào giai đoạn thử nghiệm xám trong Claude Code. Kể từ ngày 14 tháng 9 năm 2026, người dùng báo cáo rằng nó hoạt động tốt hơn đáng kể so với Opus 5 trên web, với phản hồi nhanh hơn, đầu ra sạch hơn và khả năng kiên trì mạnh hơn trong các tác vụ lập trình dài.
Bằng chứng công khai vẫn còn sớm: phần lớn thảo luận truy về cùng một loạt thử nghiệm ban đầu và một tập nhỏ so sánh đặt cạnh nhau. Hành vi thử nghiệm xám có thể quan sát được, nhưng Anthropic vẫn chưa công bố endpoint ổn định và tài liệu kỹ thuật mà nhà phát triển cần cho mục đích sản xuất.
Status:
Thử nghiệm xám trong Claude Code
Official API availability:
Chưa công bố
Public API model ID:
Chưa được công bố
Public pricing and specifications:
Chưa được công bố
Last checked:
15 tháng 9, 2026
Claude Opus 5.2 là gì?
Claude Opus 5.2 là checkpoint Opus tiếp theo của Anthropic hiện đang xuất hiện thông qua định tuyến chọn lọc trong Claude Code. Một số yêu cầu gửi tới “Opus 5” trong Claude Code đang đi đến tuyến 5.2 mới, trong khi Claude trên web và một số môi trường bên thứ ba vẫn phục vụ mô hình Opus 5 hiện có. Điều đó giải thích vì sao giao diện có thể hiển thị cùng tên mô hình nhưng kết quả trông rất khác.
Do thử nghiệm xám thay đổi lưu lượng một cách chọn lọc, không phải mọi tài khoản hoặc phiên đều nhận cùng mô hình. Khác biệt cũng có thể bị khuếch đại bởi system prompt, cấu hình công cụ và cài đặt mức độ nỗ lực lập luận. Vì vậy, những tín hiệu hữu ích nhất là sự kết hợp giữa thông tin tuyến và các thay đổi hành vi có thể lặp lại:
- tạo sinh nhanh hơn dưới tuyến Claude Code;
- đầu ra sạch hơn, đầy đủ hơn ngay ở lần triển khai đầu tiên;
- làm việc tự chủ lâu hơn mà không cần nhắc “tiếp tục” nhiều lần; và
- lặp đi lặp lại chu trình sửa đổi và kiểm thử trong các tác vụ lập trình.
The 5.2 slug and routing signal
Một số người thử nghiệm báo cáo rằng nhãn hiển thị của Claude Code vẫn là “Opus 5” trong khi chế độ xem trạng thái hoặc slug yêu cầu trỏ tới 5.2.
Điều này sẽ là bằng chứng mạnh hơn nếu một phản hồi thô, bản ghi yêu cầu hoặc đầu ra /status có thể lặp lại cho thấy định danh và có thể được xác minh độc lập. Hiện tại, các bài đăng công khai chủ yếu lặp lại tuyên bố; hiện vật nền tảng vẫn chưa được xác thực.
Các tính năng chính quan sát được trong thử nghiệm xám của Claude Opus 5.2
Những người thử nghiệm sớm nhất quán tập trung vào hành vi hơn là đặc tả chính thức.
Phản hồi nhanh hơn
Mô hình được định tuyến nhanh hơn rõ rệt so với trải nghiệm Opus 5 đã được ghi nhận trong các thử nghiệm người dùng sớm. Độ trễ cuối cùng vẫn cần đo đạc sau khi có quyền truy cập API công khai vì cài đặt nỗ lực, tải hệ thống và hạ tầng định tuyến cũng ảnh hưởng đến tốc độ.
Đầu ra sạch và đầy đủ hơn
So sánh từ cộng đồng cho rằng tuyến mới tạo ra các SVG trau chuốt hơn và các triển khai đầy đủ hơn chỉ từ một prompt. Trong các thử nghiệm lập trình mang tính giai thoại, được cho là cần ít qua lại hơn để đạt kết quả sử dụng được.
Ít hành vi “lười” hơn
Một số người thử nghiệm nói rằng mô hình ít có xu hướng chỉ trả về khung sườn, yêu cầu người dùng tiếp tục hoặc dừng trước khi hoàn thành một tác vụ phức tạp. Thay vào đó, nó được cho là làm việc qua các chuỗi dài hơn và thực hiện thêm các lượt rà soát trên chính đầu ra của mình.
Vòng lặp lập trình tự chủ dài hơn
Một quan sát được lặp lại rộng rãi là mô hình khởi động một “gauntlet loop”: nó tiếp tục kiểm thử, sửa đổi và cải thiện mã mà không cần hướng dẫn lặp lại. Nếu có thể tái hiện, điều này đặc biệt liên quan tới các tác vụ tác tử cấp kho mã và các nhiệm vụ phần mềm tầm xa.
Kiến thức gần đây hơn
Người dùng đề xuất “bài kiểm tra Tibo”: khi tắt tìm kiếm web, hỏi mô hình liệu nó có biết “Tibo, the reset guy” không. Tài liệu Opus 5 hiện có đưa ra mốc kiến thức đáng tin cậy là tháng 5 năm 2026, vì vậy việc biết một tham chiếu trực tuyến muộn hơn có thể gợi ý một checkpoint mới hơn.
Bài kiểm tra này không thể tự xác định phiên bản mô hình. Một câu trả lời đúng cũng có thể đến từ truy hồi ẩn, bộ nhớ hội thoại, system prompt hoặc nguồn ngữ cảnh khác. Đây là một phép thăm dò kiến thức — không phải bằng chứng về tên “Opus 5.2”.
Hiệu năng benchmark của Claude Opus 5.2
Chưa có kết quả benchmark Claude Opus 5.2 được xác minh, vì Anthropic chưa công bố system card hoặc bảng đánh giá.
Điểm 62,8% được báo cáo trên CoBench v2 thuộc về một mô hình nội bộ riêng của Anthropic được biết đến là “Model 2”, mô hình này được cho là vượt Mythos 5 12,5 điểm và được sử dụng rộng rãi cho lập trình nội bộ. Một hệ thống RSI mạnh hơn cũng đã được thảo luận.
Claude Opus 5.2 so với Claude Opus 5 và Claude Fable 5.1
Ba mô hình hướng tới các nhu cầu liền kề nhưng khác nhau. Opus 5 là lựa chọn chi phí thấp hơn mặc định của Anthropic cho lập trình phức tạp và công việc doanh nghiệp. Fable 5.1 là lựa chọn cao cấp đã được xác lập cho các tác vụ lập luận khó nhất và tác tử tầm xa. Opus 5.2 là tuyến thử nghiệm xám mới, dường như đưa Opus tiến gần — hoặc có thể vượt — ranh giới đó, đồng thời cải thiện tốc độ và khả năng kiên trì mà người dùng trải nghiệm trong Claude Code.
| Category | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| Current status | Thử nghiệm xám trong Claude Code | Công khai | Công khai |
| Cometapi ID | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| Best fit | Lập trình tác tử thế hệ tiếp theo, lặp tự chủ, đầu ra one-shot trau chuốt | Lập trình phức tạp tổng quát và tác vụ doanh nghiệp với chi phí cân bằng | Lập luận khó nhất, nghiên cứu và công việc tác tử tầm xa |
| Observed behavior | Nhanh hơn, sạch hơn, sẵn sàng lặp và hoàn tất tác vụ dài | Có năng lực và kinh tế, nhưng người dùng báo cáo chậm hơn hoặc ít kiên trì hơn ở một số tác vụ dài | Kết quả Claude đã công bố mạnh nhất trên các benchmark nghiên cứu và tác tử yêu cầu cao; có thể dài dòng |
| Context window | Chưa được công bố | 1M tokens | 1M tokens |
| Maximum output | Chưa được công bố | 128K tokens | 128K tokens |
| Reliable knowledge cutoff | Kiến thức mới hơn quan sát trong thử nghiệm; chưa công bố ngày | Tháng 5 năm 2026 | Tháng 6 năm 2026 |
| Official input/output price | Chưa được công bố | $5 / $25 per MTok | $10 / $50 per MTok |
| Independent AA Intelligence Index | Chưa được kiểm thử | 51 | 53 |
| Independent observed output speed | Chưa được kiểm thử | 51,7 tokens/s | 65,1 tokens/s |
Các con số độc lập ở trên đến từ Artificial Analysis tại các biến thể lý luận thích ứng đã thử nghiệm. Chúng cho thấy Fable 5.1 dẫn trước Opus 5 hai điểm trên Intelligence Index và tạo đầu ra nhanh hơn khoảng 26% trong cấu hình đo lường, nhưng giá niêm yết của nó cao gấp đôi. Những kết quả này chưa bao gồm Opus 5.2 vì tuyến thử nghiệm xám chưa lộ endpoint công khai ổn định để benchmark độc lập.
Opus 5.2 thay đổi sự so sánh thực tế. Các phiên Claude Code sớm gợi ý một mô hình phản hồi nhanh hơn Opus 5, cung cấp thiết kế hoàn chỉnh hơn từ cùng một prompt, và tiếp tục kiểm thử, tinh chỉnh mã mà không cần bị thúc đẩy. Khi API công khai của nó sẵn sàng, câu hỏi quan trọng nhất sẽ là liệu những cải thiện đó cũng vượt Fable 5.1 trên các benchmark tác tử được kiểm soát — và với mức giá nào.
Claude Opus 5.2 phù hợp nhất cho điều gì
Dựa trên hành vi đã thấy trong thử nghiệm xám, Claude Opus 5.2 đặc biệt hứa hẹn cho:
- lập trình quy mô kho và hiện đại hóa codebase;
- tác tử chạy dài lên kế hoạch, thực thi, kiểm thử và sửa đổi qua nhiều bước;
- gỡ lỗi phức tạp và vòng lặp QA tự chủ;
- tạo sinh giao diện, SVG và tạo tác có cấu trúc chất lượng cao;
- nghiên cứu và phân tích đòi hỏi sự tập trung bền bỉ trên ngữ cảnh lớn; và
- quy trình doanh nghiệp nơi chất lượng hoàn thành quan trọng hơn chi phí tối thiểu.
Đối với triển khai sản xuất hôm nay, các nhóm nên tiếp tục sử dụng endpoint công khai ổn định và giữ lớp mô hình có thể thay thế cho đến khi quyền truy cập API và điều khoản dịch vụ của Opus 5.2 được công bố.
CometAPI cung cấp quyền truy cập API Claude Opus 5.2 như thế nào?
Khi Claude Opus 5.2 chính thức khả dụng thông qua CometAPI, nhà phát triển sẽ có thể sử dụng cùng quy trình API hợp nhất đã dùng cho các mô hình Anthropic khác được hỗ trợ:
- Tạo tài khoản CometAPI và tạo khóa API.
- Nạp tiền vào tài khoản hoặc chọn tùy chọn thanh toán phù hợp.
- Kiểm tra danh mục mô hình CometAPI để biết chính xác model ID và giá đã công bố.
- Gửi yêu cầu thông qua Anthropic Messages được hỗ trợ hoặc endpoint chat tương thích.
- Xác thực chất lượng đầu ra, độ trễ và chi phí với một khối lượng thử nhỏ trước khi triển khai sản xuất.
Trong lúc chờ đợi, CometAPI đã hỗ trợ mô hình Fable 5.1 mới nhất của Claude. Nhà phát triển có thể truy cập các mô hình Claude bằng định dạng yêu cầu Claude API gốc, giúp việc thử nghiệm các mô hình hiện tại và chuyển sang Opus 5.2 sau khi phát hành trở nên dễ dàng.
Vì sao chọn CometAPI cho Claude Opus 5.2?
Khi mô hình được hỗ trợ chính thức, CometAPI có thể giảm công việc vận hành cần thiết để thêm nó vào một ngăn xếp AI hiện có. Một tài khoản và lớp API hợp nhất cho phép các nhóm đánh giá nhiều nhà cung cấp mô hình mà không phải duy trì tích hợp và quy trình thanh toán riêng cho từng mô hình.
Các lợi thế tiềm năng bao gồm:
- một khóa API và quy trình thanh toán cho danh mục mô hình rộng;
- thử nghiệm nhanh đặt cạnh các mô hình lập trình và lập luận thay thế;
- mẫu tích hợp nhất quán khi phiên bản mô hình thay đổi;
- quyền truy cập theo mức sử dụng mà không cần thiết kế lại ứng dụng quanh một nhà cung cấp; và
- tài liệu tập trung và khám phá mô hình.
Thông tin về giá, khả dụng, thông lượng và chiết khấu thực tế của Opus 5.2 chỉ nên được nêu sau khi mô hình xuất hiện trong danh mục trực tiếp của CometAPI.