Thông số kỹ thuật — Claude Sonnet 4.6
| Mục | Claude Sonnet 4.6 (tóm tắt công khai) |
|---|---|
| Nhà cung cấp | Anthropic |
| Họ mô hình | Sonnet (họ Claude v4.x) — biến thể Sonnet 4.6 |
| ID mô hình (chuẩn) | claude-sonnet-4-6 |
| Loại đầu vào | Văn bản (chính). Hỗ trợ hạn chế/thứ cấp cho I/O công cụ có cấu trúc/JSON. Không được định vị là mô hình tạo hình ảnh chính. |
| Loại đầu ra | Văn bản (ngôn ngữ tự nhiên, JSON có cấu trúc, mã và payload gọi công cụ) |
| Cửa sổ ngữ cảnh | ~200,000 token (xấp xỉ) — được thiết kế cho tính mạch lạc đa tài liệu và phiên làm việc dài |
| Gọi hàm / sử dụng công cụ | Có — hỗ trợ gọi công cụ có cấu trúc, đầu ra ràng buộc JSON, điều phối kiểu agent |
| Đa phương thức | Hạn chế — Sonnet tập trung vào văn bản và tích hợp công cụ có cấu trúc; không tối ưu cho tạo hình ảnh. |
| Điểm nổi bật ghi chú phát hành | Tính ổn định/cải thiện trong suy luận ngữ cảnh dài, biến thể Sonnet độ trễ thấp tối ưu cân bằng tốc độ–độ chính xác, cải thiện tuân thủ hướng dẫn. |
Claude Sonnet 4.6 là gì
Claude Sonnet 4.6 là bước tiến mới nhất của dòng mô hình của Anthropic — Sonnet, được thiết kế để mang lại hiệu năng gần mức Opus với mức giá dễ tiếp cận hơn. Nó nâng cấp Sonnet từ bản 4.5 trước đó, mang đến khả năng tuân thủ hướng dẫn mạnh mẽ hơn, hỗ trợ ngữ cảnh mở rộng vượt bậc, kỹ năng lập trình và sử dụng máy tính cải thiện, cùng năng lực suy luận đa bước rộng hơn — đồng thời vẫn giữ mức giá ngang với Sonnet 4.5.
Không giống các mô hình Opus, vốn là flagship và tối ưu cho khối lượng tác vụ agent nặng, Sonnet 4.6 nhắm tới nhà phát triển và công việc tri thức nói chung, nơi năng lực rộng và hiệu quả chi phí là quan trọng.
Tính năng chính của Claude Sonnet 4.6
- Cửa sổ ngữ cảnh 1M token (Beta): Sonnet 4.6 hỗ trợ tới một triệu token ngữ cảnh ở giai đoạn beta — đủ để nạp toàn bộ codebase, nhiều hợp đồng pháp lý, hoặc nhiều bài báo học thuật trong một yêu cầu.
- Cải thiện hiệu suất lập trình: So với Sonnet 4.5, Sonnet 4.6 cho thấy mức tăng đáng kể trong các tác vụ nhà phát triển thực tế và các benchmark như SWE-Bench Verified (~79.6% điểm được báo cáo), phù hợp cho nhiệm vụ mã hóa phức tạp.
- Tăng cường sử dụng máy tính: Năng lực mới trong các tác vụ vận hành phần mềm (bảng tính, quy trình biểu mẫu web nhiều bước, v.v.) tiến gần mức hiệu quả của con người trên các bài kiểm tra OSWorld-Verified.
- Tư duy thích ứng: Mô hình áp dụng các chiến lược suy luận nâng cao và có thể phân bổ linh hoạt tính toán nội bộ để giải quyết vấn đề tuần tự từng bước.
- Tuân thủ hướng dẫn mạnh hơn: Người dùng ghi nhận tính nhất quán và độ chính xác cao hơn khi làm theo yêu cầu chi tiết, ít bịa đặt hơn và hoàn thành tác vụ tốt hơn.
- An toàn & Kháng tấn công tiêm prompt: Anthropic đã cải thiện độ vững trước các tấn công tiêm prompt và lỗ hổng tương tự so với Sonnet 4.5.
Hiệu năng benchmark của Claude Sonnet 4.6
| Đánh giá | Claude Sonnet 4.6 (xấp xỉ) | Ghi chú |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Hiệu suất mã hóa mạnh mẽ, gần lớp Opus. |
| OSWorld-Verified (Computer Use) | ~72.5% | Hiệu suất tác vụ gần mức con người; mạnh cho quy trình làm việc. |
| ARC-AGI-2 | ~60.4% | Phản ánh sức mạnh suy luận rộng. |
Là mô hình tầm trung, Sonnet 4.6 thu hẹp đáng kể khoảng cách với các mô hình Opus, phù hợp cho nhiều tác vụ trước đây thường dành cho phân khúc flagship.
Claude Sonnet 4.6 so với các mô hình Claude khác
| Mô hình | Phù hợp nhất cho | Khác biệt chính |
|---|---|---|
| Claude Sonnet 4.6 | Cân bằng mã hóa, suy luận, ngữ cảnh lớn | Cửa sổ ngữ cảnh khổng lồ (beta), hiệu quả chi phí, mạnh cho tác vụ quy trình. |
| Claude Sonnet 4.5 | Tác vụ tổng quát tầm trung | Benchmark thấp hơn, cửa sổ ngữ cảnh nhỏ hơn trước 4.6. |
| Claude Opus 4.6 | Suy luận sâu & mã hóa mang tính tác tử | Suy luận thô và năng lực agent mạnh hơn; giá cao hơn. |
So với Sonnet 4.5, bản 4.6 tăng cường hiểu ngữ cảnh và hiệu năng trong các tác vụ văn phòng; so với dòng Opus, Sonnet kém một chút về sức mạnh suy luận flagship nhưng thường tiến rất gần ở benchmark mã hóa và tác vụ tổng quát.
Hạn chế của Claude Sonnet 4.6
- Cửa sổ ngữ cảnh Beta: Cửa sổ 1M token hiện đang ở giai đoạn beta — mức độ chấp nhận và ổn định có thể khác nhau tùy cách dùng API và gói dịch vụ.
- Độ trễ & Chi phí: Xử lý ngữ cảnh rất lớn làm tăng chi phí tính toán và có thể dẫn tới độ trễ cao hơn so với ngữ cảnh nhỏ.
- Độ chi tiết benchmark: Dù mạnh trên các bài kiểm tra đã công bố, Sonnet có thể kém Opus đôi chút ở những benchmark suy luận rất phức tạp hoặc đa ngành.
Trường hợp sử dụng tiêu biểu của Claude Sonnet 4.6
- Hỗ trợ codebase lớn: Lý tưởng để nạp và suy luận về toàn bộ hệ thống phần mềm, tái cấu trúc, hoặc phụ thuộc xuyên tệp.
- Tổng hợp tài liệu & nghiên cứu: Hữu ích cho phân tích tài liệu dài khi ngữ cảnh vượt quá giới hạn thông thường.
- Tự động hóa quy trình: Giải các tác vụ máy tính nhiều bước như bảng tính và tự động điền biểu mẫu.
- Công việc tri thức nói chung: Phù hợp cho người dùng cần tuân thủ hướng dẫn tin cậy và suy luận chắc chắn mà không phải trả chi phí flagship.
Cách truy cập và sử dụng API Claude Sonnet 4.6
Bước 1: Đăng ký API Key
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng, vui lòng đăng ký trước. Đăng nhập vào Bảng điều khiển CometAPI. Lấy khóa truy cập API key của giao diện. Nhấp “Add Token” tại mục API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu tới API claude-sonnet-4-6
Chọn endpoint “claude-opus-4-6” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức và nội dung yêu cầu lấy từ tài liệu API trên website của chúng tôi. Website cũng cung cấp bài kiểm thử Apifox để bạn tiện sử dụng. Thay thế <YOUR_API_KEY> bằng CometAPI key thực tế trong tài khoản của bạn. Gọi ở đâu: định dạng Anthropic Messages và định dạng Chat.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đây là nội dung mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để lấy câu trả lời được tạo. Sau khi xử lý, API sẽ phản hồi trạng thái tác vụ và dữ liệu đầu ra.