Claude Haiku 4.5 là một mô hình ngôn ngữ hạng nhỏ được tối ưu theo mục đích từ Anthropic, ra mắt vào giữa tháng 10 năm 2025. Sản phẩm được định vị như một lựa chọn nhanh, chi phí thấp trong dòng Claude, vẫn giữ năng lực mạnh ở các tác vụ như lập trình, điều phối agent và quy trình “sử dụng máy tính” tương tác, đồng thời cho phép thông lượng cao hơn nhiều và chi phí đơn vị thấp hơn cho triển khai doanh nghiệp.
Tính năng chính
- Tốc độ & hiệu quả chi phí: Haiku 4.5 được mô tả là nhanh hơn hơn 2 lần so với Sonnet 4 và chi phí khoảng bằng một phần ba của Sonnet 4 (và rẻ hơn nhiều so với Opus), khiến nó hấp dẫn cho việc sử dụng ở quy mô lớn.
- Tư duy mở rộng: Mẫu Haiku đầu tiên hỗ trợ tư duy mở rộng (suy nghĩ được tóm tắt/đan xen, ngân sách suy nghĩ có thể cấu hình) để tăng cường lập luận nhiều bước trong khi cân bằng độ trễ.
- Công cụ & sử dụng máy tính: Hỗ trợ đầy đủ Claude tools (bash, thực thi mã, trình soạn thảo văn bản, tìm kiếm web và tự động hóa sử dụng máy tính). Thiết kế cho quy trình làm việc theo hướng agent và kiến trúc sub-agent.
- Cửa sổ ngữ cảnh lớn: Cửa sổ ngữ cảnh 200k token (với tùy chọn ngữ cảnh 1M khả dụng trên các mô hình lớn hơn ở giai đoạn beta cho các lớp mô hình khác).
Thông tin kỹ thuật
- Dữ liệu huấn luyện & mốc cắt: Haiku 4.5 được huấn luyện trên hỗn hợp độc quyền gồm dữ liệu công khai và được cấp phép với mốc cắt huấn luyện khoảng tháng 2 năm 2025.
- Tư duy mở rộng (một chế độ suy luận lai) được hỗ trợ để mô hình có thể đánh đổi độ trễ lấy lập luận sâu hơn khi được yêu cầu.
- Cửa sổ ngữ cảnh khi phát hành là 200.000 token, và mô hình nhận biết ngữ cảnh (theo dõi mức sử dụng cửa sổ).
- Hiệu năng / thông lượng: Các báo cáo cộng đồng sớm và thử nghiệm của Anthropic ghi nhận OTPS rất cao (token đầu ra/giây) và tốc độ mang tính giai thoại khoảng ~200+ token/giây trong một số thử nghiệm nội bộ/sớm — nhanh hơn nhiều so với nhiều mô hình tầm trung tương đương.
Hiệu năng benchmark
SWE-Bench (lập trình): Haiku 4.5 đạt ~73,3% trên SWE-Bench Verified — một kết quả Anthropic nhấn mạnh là đưa Haiku 4.5 vào nhóm các mô hình lập trình tốt nhất thế giới trong phân khúc của nó.
Terminal / dòng lệnh / kiểm thử công cụ: Anthropic báo cáo ~41% trên Terminal-Bench (tập trung vào dòng lệnh) và kết quả tương đương Sonnet 4 cùng nhiều mô hình tầm trung cạnh tranh khác trên nhiều benchmark sử dụng công cụ.
Tuân thủ hướng dẫn & văn bản slide: ví dụ nội bộ của Anthropic cho thấy Haiku 4.5 vượt trội các mô hình trước đây ở một số tác vụ tuân thủ hướng dẫn (ví dụ, tạo nội dung slide: 65% so với 44% đối với một mô hình cao cấp trước đó trong benchmark của họ).
Tự động hóa thực tế / tác vụ agent: các đánh giá bên thứ ba và người dùng sớm báo cáo tỷ lệ thành công cạnh tranh trên các tác vụ UI/agent tự động (ví dụ, phong cách OSWorld hoặc các benchmark agent báo cáo ≈50% thành công trên tự động hóa phức tạp trong một số thử nghiệm), cho thấy tính hữu dụng cho quy mô lớn dù vẫn có các chế độ lỗi không hề đơn giản.
Hạn chế & lưu ý an toàn
- Không phải mô hình tiên phong: Anthropic nêu rõ Haiku 4.5 không mang tính đột phá biên; mô hình được tối ưu cho hiệu quả thay vì đẩy mạnh mức tiên tiến tuyệt đối. (Anthropic)
- Hành vi đôi khi ở chủ đề nhạy cảm: trong một số lời nhắc liên quan khoa học/anh ninh sinh học, Haiku 4.5 đôi khi trả về thông tin mức khái quát kèm điều kiện ràng buộc thay vì từ chối nghiêm ngặt; Anthropic xem đây là khu vực đang tiếp tục cải thiện.
- Tư duy mở rộng có thể thay đổi hành vi (đôi khi làm tăng tính bất đối xứng trong phản hồi).
Trường hợp sử dụng khuyến nghị
- Lập trình theo hướng agent & điều phối đa agent: sub-agent nhanh, chỉnh sửa mã lặp, autotest và tạo bản vá. (Phù hợp.)
- Quy trình khách hàng thời gian thực, khối lượng lớn: trợ lý chat, tự động hóa nội bộ nơi chi phí mỗi yêu cầu quan trọng. (Phù hợp.)
- Quy trình dùng công cụ & điều khiển máy tính: tự động hóa tác vụ GUI/CLI, quy trình tài liệu và chuỗi công cụ nơi độ trễ thấp có lợi. (Phù hợp.)
- Không khuyến nghị (khi thiếu kiểm soát): vai trò độc lập đòi hỏi thiết kế chuỗi khoa học mức tiên phong hoặc tác vụ an ninh sinh học độ đảm bảo cao. (Cần thận trọng.)
Cách truy cập API Claude Haiku 4.5
Bước 1: Đăng ký khóa API
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng của chúng tôi, vui lòng đăng ký trước. Đăng nhập vào Bảng điều khiển CometAPI. Lấy khóa API làm thông tin xác thực truy cập của giao diện. Nhấp “Add Token” tại mục API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu tới API Claude Haiku 4.5
Chọn endpoint “claude-haiku-4-5-20251001” để gửi yêu cầu API và đặt request body. Phương thức yêu cầu và request body được lấy từ tài liệu API trên trang web của chúng tôi. Trang web của chúng tôi cũng cung cấp Apifox để bạn thuận tiện thử nghiệm. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế trong tài khoản của bạn. base url là Anthropic Messages và Chat.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content — đây là nội dung mô hình sẽ phản hồi. Xử lý phản hồi API để nhận câu trả lời được tạo.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để nhận dữ liệu kết quả và trạng thái tác vụ. Sau khi xử lý, API sẽ phản hồi trạng thái tác vụ và dữ liệu đầu ra.