Anthropic đã ra mắt Fable 5.1 vào ngày 1 tháng 9 năm 2026 như model mạnh nhất sẵn sàng phổ cập cho lập trình và công việc tri thức. Model nhắm tới các công việc dài hạn: lập trình nhiều giờ, nghiên cứu nhiều bước, công việc chuyên môn nặng tài liệu, và các tác tử lặp lại việc gọi công cụ trong khi giữ lượng lớn ngữ cảnh.
Claude Fable 5.1 kết hợp cửa sổ ngữ cảnh 1M token, tối đa 128K token đầu ra, đầu vào văn bản và hình ảnh, cùng tư duy thích ứng luôn bật. Giá nền giữ nguyên 10 USD cho đầu vào và 50 USD cho đầu ra trên mỗi MTok; thay đổi chi phí quan trọng là 0,25 USD mỗi MTok cho lần đọc bộ nhớ đệm.
Thông số Claude Fable 5.1 trong nháy mắt
Các thông số dưới đây đến từ tài liệu model của Anthropic. Giá là giá niêm yết của Anthropic và nên tách biệt với bất kỳ giá CometAPI nào.
| Thông số chính thức | Claude Fable 5.1 |
|---|---|
| Ngày phát hành và ID model | ngày 1 tháng 9 năm 2026 — claude-fable-5-1 |
| Vai trò chính | Lý luận yêu cầu cao và công việc tác tử dài hạn |
| Ngữ cảnh và đầu ra tối đa | Ngữ cảnh 1M token — đầu ra đến 128K |
| Đầu vào → đầu ra | Văn bản và hình ảnh → văn bản |
| Tư duy và nỗ lực API mặc định | Tư duy thích ứng, luôn bật — Nỗ lực Cao |
| Mốc cắt kiến thức đáng tin cậy | tháng 6 năm 2026 |
| Giá niêm yết | 10 USD đầu vào — 50 USD đầu ra — 0,25 USD đọc bộ nhớ đệm mỗi MTok |
Có hai chi tiết quan trọng ngoài các con số thô. Cửa sổ ngữ cảnh 1M có sẵn theo mặc định thay vì một tầng ngữ cảnh dài riêng. Tư duy thích ứng luôn bật, trong khi “effort” kiểm soát mức công việc model thực hiện; Anthropic cho biết mặc định là Cao trong Claude Code và Trung bình trong Claude Cowork và Claude.ai.
Claude Fable 5.1 là gì
Claude Fable 5.1 là model frontier của Anthropic cho các tác vụ mà hệ thống phải tiếp tục lý luận, sử dụng công cụ và duy trì ngữ cảnh qua nhiều bước. Thay vì nhắm tới các trao đổi hỏi-đáp ngắn, nó được thiết kế cho thực thi bền bỉ: khám phá codebase, chạy quy trình terminal, tổng hợp bộ tài liệu lớn và hoàn thành các nhiệm vụ chuyên môn có thể kéo dài hàng giờ.
Gói năng lực định nghĩa của model là cửa sổ ngữ cảnh 1M token với đầu ra tới 128K, đầu vào văn bản và hình ảnh, cùng tư duy thích ứng luôn được bật trong suốt một yêu cầu. Điều này cho phép một tác tử giữ hướng dẫn dài, nguồn tài liệu, kết quả công cụ và các quyết định trung gian trong một ngữ cảnh làm việc, đồng thời điều chỉnh nỗ lực lý luận theo độ khó của từng bước.
Phù hợp nhất là các quy trình công việc giá trị cao trong đó thất bại, làm lại hay mất ngữ cảnh có chi phí cao hơn giá token premium. Ví dụ gồm kỹ thuật ở quy mô kho mã, nghiên cứu nhiều giai đoạn, tác tử sử dụng máy tính, phân tích tài liệu nặng tuân thủ, và tự động hóa kinh doanh với các lần gọi công cụ lặp lại. Đối với phân loại thường quy, trích xuất khối lượng lớn, hoặc chat nhạy độ trễ, một tầng Claude chi phí thấp hơn có thể vẫn là điểm khởi đầu tốt hơn.
Việc dùng Fable mặc định yêu cầu lưu giữ dữ liệu 30 ngày cho giám sát an toàn. Khách hàng doanh nghiệp đủ điều kiện có thể dùng chế độ không lưu dữ liệu trong khi Enterprise Frontier Safeguards được triển khai; Anthropic cho biết kiến trúc dự kiến sẽ lưu dữ liệu giám sát trong hạ tầng đám mây do khách hàng kiểm soát. Các đội ngũ trong lĩnh vực chịu quản lý nên xác minh điều khoản theo tài khoản trước khi triển khai.
Claude Fable 5.1 so với Fable 5: Có gì thay đổi?
Bản phát hành 5.1 không phải là một bước nhảy năng lực đồng đều. Thay đổi rõ nhất là giảm chi phí đọc ngữ cảnh lặp lại và thực thi mạnh hơn nhiều cho nghiên cứu theo tác tử, lập trình qua terminal và quy trình kinh doanh, trong khi lý luận tổng quát có hỗ trợ công cụ chỉ nhích nhẹ.
| Chiều so sánh | Claude Fable 5 | Claude Fable 5.1 | Thay đổi |
|---|---|---|---|
| Giá nền đầu vào/đầu ra | 10 USD / 50 USD/MTok | 10 USD / 50 USD/MTok | Không đổi |
| Đọc bộ nhớ đệm | 1,00 USD/MTok | 0,25 USD/MTok | Giảm 75% |
| Terminal-Bench-Science 0.1 | 24,7% | 52,6% | +27,9 điểm |
| Terminal-Bench 4.0 | 42,0% | 55,8% | +13,8 điểm |
| AutomationBench | 17,1% | 31,4% | +14,3 điểm |
| HLE with tools | 63,8% | 65,0% | +1,2 điểm |
Đọc bộ nhớ đệm rẻ hơn 75% trong khi giá nền giữ nguyên
Đầu vào vẫn 10 USD mỗi MTok và đầu ra vẫn 50 USD mỗi MTok, nên mức giá tiêu đề không giảm. Thay đổi đáng kể là giá đọc bộ nhớ đệm giảm từ 1,00 USD xuống 0,25 USD mỗi MTok. Điều này quan trọng nhất với các tác tử thường xuyên nạp lại một tiền tố dài chứa kho mã, chính sách, tài liệu, định nghĩa công cụ và trạng thái trước đó. Chi phí mỗi quy trình hoàn tất của họ có thể giảm ngay cả khi mức giá cho đầu vào mới và đầu ra không đổi.
Nghiên cứu khoa học theo tác tử tăng mạnh nhất
Terminal-Bench-Science 0.1 tăng từ 24,7% lên 52,6%, tăng 27,9 điểm phần trăm và hơn gấp đôi điểm số trước. Đây là bằng chứng mạnh nhất rằng Fable 5.1 cải thiện thực thi dài hạn: lập kế hoạch điều tra, vận hành công cụ, diễn giải kết quả và phục hồi sau lỗi trung gian.
Lập trình qua terminal và tự động hóa kinh doanh cải thiện đáng kể
Terminal-Bench 4.0 tăng từ 42,0% lên 55,8%, trong khi AutomationBench tăng từ 17,1% lên 31,4%. Những kết quả này chỉ ra khả năng hoàn thành nhiệm vụ đầu-cuối tốt hơn, không chỉ là tạo mã tốt hơn. Các đội nên kỳ vọng lợi ích lớn nhất ở quy trình đòi hỏi model kiểm tra môi trường, chọn hành động, dùng công cụ và xác minh kết quả qua nhiều bước.
Lý luận tổng quát cải thiện ít hơn so với thực thi
Humanity’s Last Exam with tools tăng từ 63,8% lên 65,0%, chỉ 1,2 điểm, và CursorBench tăng 2,9 điểm. Do đó, so sánh này không ủng hộ tuyên bố bao quát rằng mọi năng lực đều cải thiện như nhau. Fable 5.1 nên được hiểu như một nâng cấp tập trung vào thực thi, với mức tăng mạnh nhất xuất hiện khi lý luận phải được duy trì thông qua công cụ và các chuỗi nhiệm vụ dài.
Kết quả so sánh: Người dùng Fable 5 hiện tại chạy các tác tử dài, nặng công cụ có lý do rõ ràng để nâng cấp: đọc bộ nhớ đệm rẻ hơn đáng kể và ít lỗi hơn trên các điểm chuẩn hướng thực thi. Các đội dùng prompt ngắn hoặc nhiệm vụ kiến thức chung nên xác thực mức tăng nhỏ hơn so với độ trễ và tổng chi phí trước khi di chuyển.
Hiệu năng điểm chuẩn của Claude Fable 5.1
Bảng điểm chuẩn chính thức của Anthropic so sánh model mới với tiền nhiệm của nó, Claude Opus 5, và GPT-5.6 Sol. Các dòng được chọn dưới đây bao phủ nghiên cứu, lập trình, công việc tri thức, sử dụng máy tính và tự động hóa.
| Điểm chuẩn chính thức | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Terminal-Bench 4.0 | 55,8% | 42,0% | 52,3% | 37,3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77,9% | 72,9% | 75,4% | — |
| OSWorld 2.0 strict | 41,7% | 36,1% | 39,6% | — |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
Hình trên là ảnh điểm chuẩn chính thức của Anthropic được sao chép từ tài liệu nguồn, không phải biểu đồ vẽ lại cục bộ. Anthropic lưu ý sai số chuẩn ±3,5–4,5 điểm cho Terminal-Bench-Science và cho biết các biện pháp an toàn sản xuất được bật trong quá trình đánh giá. Do đó cần thận trọng với các khác biệt nhỏ.

Nguồn: Đồ họa điểm chuẩn Anthropic Fable 5.1 chính thức
Cách đọc kết quả điểm chuẩn
Những điểm số này không nên được hiểu là thước đo phổ quát về chất lượng model. Anthropic đánh giá Claude Fable 5.1 với các biện pháp an toàn sản xuất được bật, và một số tác vụ điểm chuẩn có thể bị ảnh hưởng bởi can thiệp của các biện pháp an toàn. Terminal-Bench-Science cũng báo cáo sai số chuẩn xấp xỉ ±3,5–4,5 điểm phần trăm cho mỗi model.
Kết quả OSWorld 2.0 sử dụng bản phát hành tác vụ tháng 8 năm 2026 của tác giả điểm chuẩn, vì vậy không nên so sánh trực tiếp với điểm số từ các bản phát hành tác vụ trước đó.
Giá của Claude Fable 5.1
Giá đầu vào và đầu ra
Anthropic niêm yết Claude Fable 5.1 ở mức 10 USD mỗi MTok đầu vào và 50 USD mỗi MTok đầu ra. Claude Fable 5.1 trên CometAPI ở mức 8 USD mỗi MTok đầu vào và 40 USD mỗi MTok đầu ra, giảm 20% so với giá niêm yết chính thức. Đây là mức tính theo sử dụng; hãy kiểm tra trang model trực tiếp trước khi lên sản xuất vì giá nền tảng và quy tắc tính phí có thể thay đổi.
Giá bộ nhớ đệm prompt
Anthropic định giá ghi bộ nhớ đệm 5 phút là 12,50 USD mỗi MTok, ghi 1 giờ là 20 USD mỗi MTok, và đọc bộ nhớ đệm là 0,25 USD mỗi MTok. Mức đọc thấp hơn 75% so với 1 USD mỗi MTok của Fable 5, nên các tác tử chạy lâu tái sử dụng kho mã, chính sách, định nghĩa công cụ hay trạng thái trước đó hưởng lợi nhiều hơn các prompt ngắn, chạy một lần.
Ví dụ chi phí quy trình tác tử
Một tác tử đọc 150K token đã được lưu đệm ở mỗi 1.000 bước sẽ tiêu thụ 150 MTok cho đọc bộ nhớ đệm. Ở mức 0,25 USD của Fable 5.1, phần này tốn 37,50 USD; ở mức 1 USD của Fable 5, sẽ tốn 150 USD — tiết kiệm 112,50 USD. Đầu vào mới, đầu ra, ghi bộ nhớ đệm và phí nền tảng vẫn là bổ sung, vì vậy các đội nên so sánh tổng chi phí mỗi quy trình thành công thay vì chỉ chi phí bộ nhớ đệm.
Vì sao giá bộ nhớ đệm thay đổi kinh tế của tác tử
Một yêu cầu thông thường có thể chi phần lớn hóa đơn cho đầu vào mới và đầu ra. Một tác tử thì khác: mỗi bước gọi công cụ có thể đọc lại một tiền tố lớn đã lưu đệm chứa chính sách, mã, tài liệu, định nghĩa công cụ và trạng thái trước đó. Giảm 75% chi phí đọc bộ nhớ đệm của Anthropic mang lại lợi ích vượt trội cho các vòng lặp dài.
Ví dụ, một tác tử đọc lại 150K token đã lưu đệm qua 1.000 bước sẽ tiêu thụ 150 triệu token đọc bộ nhớ đệm. Ở mức 1 USD mỗi MTok, phần này tốn 150 USD; ở mức 0,25 USD mỗi MTok, chỉ tốn 37,50 USD. Ví dụ này không bao gồm đầu vào mới, đầu ra, ghi bộ nhớ đệm và phí nền tảng, nhưng cho thấy vì sao giá nền không đổi vẫn có thể tạo ra chi phí thấp hơn mỗi tác vụ hoàn tất.
Anthropic ước tính giảm khoảng 25% chi phí cho khối lượng công việc tính theo token điển hình và lên đến khoảng 45% cho khối lượng công việc mang tính tác tử cao. Đây là ước tính theo cơ cấu khối lượng công việc, không phải mức giảm phổ quát trên mọi token.
Claude Fable 5.1 vs Opus 5 vs Sonnet 5
Model frontier là trần năng lực, nhưng Anthropic khuyến nghị tầng Opus làm điểm khởi đầu cho hầu hết khối lượng công việc. Tầng Sonnet vẫn là lựa chọn nhanh hơn, chi phí thấp hơn khi thông lượng và độ trễ quan trọng hơn độ tin cậy dài hạn tối đa. Để có phân tích sâu hai model, xem so sánh Fable vs Sonnet của CometAPI.
| Chiều so sánh | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| Cửa sổ ngữ cảnh | 1M | 1M | 1M |
| Đầu ra tối đa | 128K | 128K | 128K |
| Giá niêm yết đầu vào/đầu ra | 10 USD / 50 USD | 5 USD / 25 USD | 2 USD / 10 USD |
| Độ trễ tương đối | Chậm hơn | Vừa phải | Nhanh |
| Phù hợp nhất | Tác vụ khó, dài hạn và lý luận sâu | Điểm khởi đầu premium mặc định | Khối lượng lớn ưu tiên tốc độ và chi phí |
Kết luận chọn lựa: Hãy bắt đầu với tầng chi phí thấp hơn đáp ứng được tác vụ. Chỉ nâng cấp khi đánh giá sản xuất cho thấy model frontier nâng tỷ lệ kết quả chấp nhận, giảm số lần thử lại hoặc hạ tổng chi phí cho mỗi quy trình thành công.
Những thay đổi khi di trú mà nhà phát triển phải kiểm thử
Model mới phần lớn là hậu duệ “drop-in”, nhưng Anthropic ghi nhận ba thay đổi gây phá vỡ ảnh hưởng đến framework tác tử và các cuộc hội thoại dài.
| Thay đổi khi di trú | Điều xảy ra | Hành động yêu cầu của nhà phát triển |
|---|---|---|
| Ép buộc chọn công cụ | tool_choice = any hoặc công cụ được đặt tên trả về HTTP 400 | Dùng auto, hướng dẫn model, và áp dụng schema nghiêm ngặt khi cần |
| Khối tư duy qua chuyển model | Model cũ không thể đọc các khối tư duy mới | Kiểm thử bộ định tuyến và kỳ vọng các khối lý luận bị bỏ khi định tuyến ngược |
| Sửa các lượt trước đó | Lịch sử thay đổi có thể làm mất hiệu lực khối tư duy | Giữ lịch sử chỉ-nối-thêm hoặc dùng mẫu thu gọn được hỗ trợ |
Ngoài ra, hãy kiểm thử mức nỗ lực theo từng tin nhắn, thông điệp hệ thống theo phạm vi lượt, cập nhật tiến độ giữa các lần gọi công cụ, hành vi bộ nhớ đệm và nguồn gốc nội dung trước khi chuyển lưu lượng sản xuất. Hướng dẫn API Fable hiện có vẫn là nơi tốt hơn cho thiết lập SDK tổng quát và ví dụ yêu cầu.
Ai nên dùng Claude Fable 5.1?
Claude Fable 5.1 phù hợp nhất cho khối lượng công việc trong đó lý luận bền bỉ và hoàn thành thành công quan trọng hơn độ trễ tối thiểu hoặc giá token. Chọn model này khi tác vụ kéo dài nhiều bước, dùng công cụ lặp lại, hoặc có giá trị kinh doanh đủ lớn để tránh chạy lỗi và làm lại có thể bù đắp chi phí model premium.
- Kỹ thuật ở quy mô kho mã: gỡ lỗi, di trú, tái cấu trúc đa tệp, chạy kiểm thử và tác tử lập trình không giám sát.
- Nghiên cứu nhiều bước: tìm kiếm, đánh giá bằng chứng, chạy phân tích và tạo báo cáo cuối cùng có căn cứ.
- Tài liệu lớn và công việc chuyên môn: hợp đồng, tài liệu kỹ thuật, tài liệu tài chính, bảng tính và quy trình thuyết trình.
- Sử dụng máy tính và tự động hóa: tác vụ đòi hỏi gọi công cụ lặp lại, điều hướng giao diện, xác minh và phục hồi sau lỗi trung gian.
Đối với phân loại thường quy, trích xuất khối lượng lớn hoặc chat nhạy độ trễ, hãy bắt đầu với Claude Opus 5 hoặc Claude Sonnet 5
Khả dụng qua CometAPI
Tính đến ngày 4 tháng 9 năm 2026, trang model CometAPI liệt kê Claude Fable 5.1 đang hoạt động. ID model là claude-fable-5-1.
- Tạo hoặc đăng nhập tài khoản CometAPI và tạo khóa API trong bảng điều khiển.
- Chọn Claude Fable 5.1 và truyền
claude-fable-5-1làm ID model. - Gửi yêu cầu qua endpoint tương thích Anthropic
/v1/messageshoặc endpoint tương thích OpenAI/v1/chat/completions. - Chạy đánh giá theo phong cách sản xuất để xác nhận độ trễ, xử lý ngữ cảnh, hành vi công cụ và tính phí trước khi di chuyển lưu lượng.
Nhà phát triển cũng có thể truy cập model trực tiếp qua Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform on AWS.
Kết luận
Claude Fable 5.1 nên được hiểu là một bản nâng cấp về thực thi. Bằng chứng thuyết phục nhất không phải là cửa sổ ngữ cảnh 1M không đổi hay mức giá premium 10/50 USD; đó là cải thiện lớn ở nghiên cứu theo tác tử, lập trình qua terminal và tự động hóa, kết hợp với chi phí đọc bộ nhớ đệm rẻ hơn đáng kể.
Hãy dùng model này khi tác vụ khó, kéo dài và đủ giá trị để việc giảm số lần chạy lỗi có thể biện minh cho giá premium. Với công việc thường quy, khối lượng lớn hoặc nhạy độ trễ, hãy bắt đầu với tầng chi phí thấp hơn và chỉ nâng cấp khi đánh giá của chính bạn cho thấy cải thiện đo lường được ở kết quả hoàn tất.
Câu hỏi thường gặp
Claude Fable 5.1 có khả dụng qua API không?
Có. Anthropic liệt kê Claude Fable 5.1 hoạt động từ ngày 1 tháng 9 năm 2026. Model có sẵn qua Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform on AWS.
Chi phí API Claude Fable 5.1 là bao nhiêu?
Giá niêm yết chính thức của Anthropic là 10 USD mỗi MTok đầu vào và 50 USD mỗi MTok đầu ra. CometAPI hiện liệt kê 8 USD đầu vào và 40 USD đầu ra mỗi MTok. Hãy kiểm tra giá tuyến trực tiếp trước khi triển khai.
Cửa sổ ngữ cảnh của Claude Fable 5.1 lớn cỡ nào?
Model hỗ trợ cửa sổ ngữ cảnh 1M token và đầu ra đến 128K token. Dung lượng lớn không loại bỏ nhu cầu kiểm thử chất lượng truy xuất, độ trễ và chi phí với tài liệu sản xuất.
Có gì thay đổi từ Claude Fable 5 lên 5.1?
Những thay đổi thực tiễn lớn nhất là nghiên cứu theo tác tử và thực thi qua terminal mạnh hơn, giá đọc bộ nhớ đệm giảm từ 1 USD xuống 0,25 USD mỗi MTok, kiểm soát nỗ lực theo từng tin nhắn, cập nhật tiến độ và nguồn gốc nội dung. Di trú cũng yêu cầu kiểm thử ép buộc chọn công cụ, khối tư duy qua chuyển model và lịch sử hội thoại bị chỉnh sửa.
Claude Fable 5.1 có tốt hơn Claude Opus 5 không?
Không phải cho mọi khối lượng công việc. Fable 5.1 là lựa chọn năng lực cao hơn cho công việc dài hạn đòi hỏi cao, nhưng chậm hơn và đắt hơn. Anthropic khuyến nghị bắt đầu hầu hết công việc với Claude Opus 5 và chỉ nâng cấp khi đánh giá mức nỗ lực cao vẫn chưa đạt.
Tôi có thể dùng Claude Fable 5.1 qua CometAPI không?
Có. CometAPI hiện liệt kê Claude Fable 5.1 đang hoạt động dưới ID model claude-fable-5-1, với endpoint tương thích Anthropic và OpenAI.
Claude Fable 5.1 có hỗ trợ ép buộc dùng công cụ không?
Không. Anthropic ghi nhận rằng đặt tool_choice là any hoặc một công cụ được đặt tên sẽ trả về HTTP 400. Hãy dùng auto hoặc none, sau đó hướng dẫn chọn công cụ bằng chỉ dẫn và schema đầu vào nghiêm ngặt khi cần.
