GPT-6 Astra is now live on CometAPI →
ai-model/Nghiên cứu CometAPI

Claude Fable 5.1 là gì?

Khám phá tổng quan nhanh về thông số kỹ thuật, điểm chuẩn chính thức, bảng giá bộ nhớ đệm, các thay đổi khi chuyển đổi, các cơ chế bảo vệ và so sánh với Opus 5 và Sonnet 5.

CometAPI
Mia MarenĐội ngũ nghiên cứu mô hình AI và API
Đã cập nhật Sep 4, 2026 17 phút đọc
Claude Fable 5.1 là gì?
Sử dụng mẫu này

Thực hiện API call đầu tiên.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Anthropic đã ra mắt Fable 5.1 vào ngày 1 tháng 9 năm 2026 như model mạnh nhất sẵn sàng phổ cập cho lập trình và công việc tri thức. Model nhắm tới các công việc dài hạn: lập trình nhiều giờ, nghiên cứu nhiều bước, công việc chuyên môn nặng tài liệu, và các tác tử lặp lại việc gọi công cụ trong khi giữ lượng lớn ngữ cảnh.

Claude Fable 5.1 kết hợp cửa sổ ngữ cảnh 1M token, tối đa 128K token đầu ra, đầu vào văn bản và hình ảnh, cùng tư duy thích ứng luôn bật. Giá nền giữ nguyên 10 USD cho đầu vào và 50 USD cho đầu ra trên mỗi MTok; thay đổi chi phí quan trọng là 0,25 USD mỗi MTok cho lần đọc bộ nhớ đệm.

Thông số Claude Fable 5.1 trong nháy mắt

Các thông số dưới đây đến từ tài liệu model của Anthropic. Giá là giá niêm yết của Anthropic và nên tách biệt với bất kỳ giá CometAPI nào.

Thông số chính thứcClaude Fable 5.1
Ngày phát hành và ID modelngày 1 tháng 9 năm 2026 — claude-fable-5-1
Vai trò chínhLý luận yêu cầu cao và công việc tác tử dài hạn
Ngữ cảnh và đầu ra tối đaNgữ cảnh 1M token — đầu ra đến 128K
Đầu vào → đầu raVăn bản và hình ảnh → văn bản
Tư duy và nỗ lực API mặc địnhTư duy thích ứng, luôn bật — Nỗ lực Cao
Mốc cắt kiến thức đáng tin cậytháng 6 năm 2026
Giá niêm yết10 USD đầu vào — 50 USD đầu ra — 0,25 USD đọc bộ nhớ đệm mỗi MTok

Có hai chi tiết quan trọng ngoài các con số thô. Cửa sổ ngữ cảnh 1M có sẵn theo mặc định thay vì một tầng ngữ cảnh dài riêng. Tư duy thích ứng luôn bật, trong khi “effort” kiểm soát mức công việc model thực hiện; Anthropic cho biết mặc định là Cao trong Claude Code và Trung bình trong Claude Cowork và Claude.ai.

Claude Fable 5.1 là gì

Claude Fable 5.1 là model frontier của Anthropic cho các tác vụ mà hệ thống phải tiếp tục lý luận, sử dụng công cụ và duy trì ngữ cảnh qua nhiều bước. Thay vì nhắm tới các trao đổi hỏi-đáp ngắn, nó được thiết kế cho thực thi bền bỉ: khám phá codebase, chạy quy trình terminal, tổng hợp bộ tài liệu lớn và hoàn thành các nhiệm vụ chuyên môn có thể kéo dài hàng giờ.

Gói năng lực định nghĩa của model là cửa sổ ngữ cảnh 1M token với đầu ra tới 128K, đầu vào văn bản và hình ảnh, cùng tư duy thích ứng luôn được bật trong suốt một yêu cầu. Điều này cho phép một tác tử giữ hướng dẫn dài, nguồn tài liệu, kết quả công cụ và các quyết định trung gian trong một ngữ cảnh làm việc, đồng thời điều chỉnh nỗ lực lý luận theo độ khó của từng bước.

Phù hợp nhất là các quy trình công việc giá trị cao trong đó thất bại, làm lại hay mất ngữ cảnh có chi phí cao hơn giá token premium. Ví dụ gồm kỹ thuật ở quy mô kho mã, nghiên cứu nhiều giai đoạn, tác tử sử dụng máy tính, phân tích tài liệu nặng tuân thủ, và tự động hóa kinh doanh với các lần gọi công cụ lặp lại. Đối với phân loại thường quy, trích xuất khối lượng lớn, hoặc chat nhạy độ trễ, một tầng Claude chi phí thấp hơn có thể vẫn là điểm khởi đầu tốt hơn.

Việc dùng Fable mặc định yêu cầu lưu giữ dữ liệu 30 ngày cho giám sát an toàn. Khách hàng doanh nghiệp đủ điều kiện có thể dùng chế độ không lưu dữ liệu trong khi Enterprise Frontier Safeguards được triển khai; Anthropic cho biết kiến trúc dự kiến sẽ lưu dữ liệu giám sát trong hạ tầng đám mây do khách hàng kiểm soát. Các đội ngũ trong lĩnh vực chịu quản lý nên xác minh điều khoản theo tài khoản trước khi triển khai.

Claude Fable 5.1 so với Fable 5: Có gì thay đổi?

Bản phát hành 5.1 không phải là một bước nhảy năng lực đồng đều. Thay đổi rõ nhất là giảm chi phí đọc ngữ cảnh lặp lại và thực thi mạnh hơn nhiều cho nghiên cứu theo tác tử, lập trình qua terminal và quy trình kinh doanh, trong khi lý luận tổng quát có hỗ trợ công cụ chỉ nhích nhẹ.

Chiều so sánhClaude Fable 5Claude Fable 5.1Thay đổi
Giá nền đầu vào/đầu ra10 USD / 50 USD/MTok10 USD / 50 USD/MTokKhông đổi
Đọc bộ nhớ đệm1,00 USD/MTok0,25 USD/MTokGiảm 75%
Terminal-Bench-Science 0.124,7%52,6%+27,9 điểm
Terminal-Bench 4.042,0%55,8%+13,8 điểm
AutomationBench17,1%31,4%+14,3 điểm
HLE with tools63,8%65,0%+1,2 điểm

Đọc bộ nhớ đệm rẻ hơn 75% trong khi giá nền giữ nguyên

Đầu vào vẫn 10 USD mỗi MTok và đầu ra vẫn 50 USD mỗi MTok, nên mức giá tiêu đề không giảm. Thay đổi đáng kể là giá đọc bộ nhớ đệm giảm từ 1,00 USD xuống 0,25 USD mỗi MTok. Điều này quan trọng nhất với các tác tử thường xuyên nạp lại một tiền tố dài chứa kho mã, chính sách, tài liệu, định nghĩa công cụ và trạng thái trước đó. Chi phí mỗi quy trình hoàn tất của họ có thể giảm ngay cả khi mức giá cho đầu vào mới và đầu ra không đổi.

Nghiên cứu khoa học theo tác tử tăng mạnh nhất

Terminal-Bench-Science 0.1 tăng từ 24,7% lên 52,6%, tăng 27,9 điểm phần trăm và hơn gấp đôi điểm số trước. Đây là bằng chứng mạnh nhất rằng Fable 5.1 cải thiện thực thi dài hạn: lập kế hoạch điều tra, vận hành công cụ, diễn giải kết quả và phục hồi sau lỗi trung gian.

Lập trình qua terminal và tự động hóa kinh doanh cải thiện đáng kể

Terminal-Bench 4.0 tăng từ 42,0% lên 55,8%, trong khi AutomationBench tăng từ 17,1% lên 31,4%. Những kết quả này chỉ ra khả năng hoàn thành nhiệm vụ đầu-cuối tốt hơn, không chỉ là tạo mã tốt hơn. Các đội nên kỳ vọng lợi ích lớn nhất ở quy trình đòi hỏi model kiểm tra môi trường, chọn hành động, dùng công cụ và xác minh kết quả qua nhiều bước.

Lý luận tổng quát cải thiện ít hơn so với thực thi

Humanity’s Last Exam with tools tăng từ 63,8% lên 65,0%, chỉ 1,2 điểm, và CursorBench tăng 2,9 điểm. Do đó, so sánh này không ủng hộ tuyên bố bao quát rằng mọi năng lực đều cải thiện như nhau. Fable 5.1 nên được hiểu như một nâng cấp tập trung vào thực thi, với mức tăng mạnh nhất xuất hiện khi lý luận phải được duy trì thông qua công cụ và các chuỗi nhiệm vụ dài.

Kết quả so sánh: Người dùng Fable 5 hiện tại chạy các tác tử dài, nặng công cụ có lý do rõ ràng để nâng cấp: đọc bộ nhớ đệm rẻ hơn đáng kể và ít lỗi hơn trên các điểm chuẩn hướng thực thi. Các đội dùng prompt ngắn hoặc nhiệm vụ kiến thức chung nên xác thực mức tăng nhỏ hơn so với độ trễ và tổng chi phí trước khi di chuyển.

Hiệu năng điểm chuẩn của Claude Fable 5.1

Bảng điểm chuẩn chính thức của Anthropic so sánh model mới với tiền nhiệm của nó, Claude Opus 5, và GPT-5.6 Sol. Các dòng được chọn dưới đây bao phủ nghiên cứu, lập trình, công việc tri thức, sử dụng máy tính và tự động hóa.

Điểm chuẩn chính thứcClaude Fable 5.1Claude Fable 5Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152,6%24,7%29,0%22,4%
Terminal-Bench 4.055,8%42,0%52,3%37,3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77,9%72,9%75,4%
OSWorld 2.0 strict41,7%36,1%39,6%
AutomationBench31,4%17,1%26,9%19,6%
CursorBench 3.2.073,4%70,5%70,0%67,2%

Hình trên là ảnh điểm chuẩn chính thức của Anthropic được sao chép từ tài liệu nguồn, không phải biểu đồ vẽ lại cục bộ. Anthropic lưu ý sai số chuẩn ±3,5–4,5 điểm cho Terminal-Bench-Science và cho biết các biện pháp an toàn sản xuất được bật trong quá trình đánh giá. Do đó cần thận trọng với các khác biệt nhỏ.

Claude Fable 5.1 là gì?

Nguồn: Đồ họa điểm chuẩn Anthropic Fable 5.1 chính thức

Cách đọc kết quả điểm chuẩn

Những điểm số này không nên được hiểu là thước đo phổ quát về chất lượng model. Anthropic đánh giá Claude Fable 5.1 với các biện pháp an toàn sản xuất được bật, và một số tác vụ điểm chuẩn có thể bị ảnh hưởng bởi can thiệp của các biện pháp an toàn. Terminal-Bench-Science cũng báo cáo sai số chuẩn xấp xỉ ±3,5–4,5 điểm phần trăm cho mỗi model.

Kết quả OSWorld 2.0 sử dụng bản phát hành tác vụ tháng 8 năm 2026 của tác giả điểm chuẩn, vì vậy không nên so sánh trực tiếp với điểm số từ các bản phát hành tác vụ trước đó.

Giá của Claude Fable 5.1

Giá đầu vào và đầu ra

Anthropic niêm yết Claude Fable 5.1 ở mức 10 USD mỗi MTok đầu vào và 50 USD mỗi MTok đầu ra. Claude Fable 5.1 trên CometAPI ở mức 8 USD mỗi MTok đầu vào và 40 USD mỗi MTok đầu ra, giảm 20% so với giá niêm yết chính thức. Đây là mức tính theo sử dụng; hãy kiểm tra trang model trực tiếp trước khi lên sản xuất vì giá nền tảng và quy tắc tính phí có thể thay đổi.

Giá bộ nhớ đệm prompt

Anthropic định giá ghi bộ nhớ đệm 5 phút là 12,50 USD mỗi MTok, ghi 1 giờ là 20 USD mỗi MTok, và đọc bộ nhớ đệm là 0,25 USD mỗi MTok. Mức đọc thấp hơn 75% so với 1 USD mỗi MTok của Fable 5, nên các tác tử chạy lâu tái sử dụng kho mã, chính sách, định nghĩa công cụ hay trạng thái trước đó hưởng lợi nhiều hơn các prompt ngắn, chạy một lần.

Ví dụ chi phí quy trình tác tử

Một tác tử đọc 150K token đã được lưu đệm ở mỗi 1.000 bước sẽ tiêu thụ 150 MTok cho đọc bộ nhớ đệm. Ở mức 0,25 USD của Fable 5.1, phần này tốn 37,50 USD; ở mức 1 USD của Fable 5, sẽ tốn 150 USD — tiết kiệm 112,50 USD. Đầu vào mới, đầu ra, ghi bộ nhớ đệm và phí nền tảng vẫn là bổ sung, vì vậy các đội nên so sánh tổng chi phí mỗi quy trình thành công thay vì chỉ chi phí bộ nhớ đệm.

Vì sao giá bộ nhớ đệm thay đổi kinh tế của tác tử

Một yêu cầu thông thường có thể chi phần lớn hóa đơn cho đầu vào mới và đầu ra. Một tác tử thì khác: mỗi bước gọi công cụ có thể đọc lại một tiền tố lớn đã lưu đệm chứa chính sách, mã, tài liệu, định nghĩa công cụ và trạng thái trước đó. Giảm 75% chi phí đọc bộ nhớ đệm của Anthropic mang lại lợi ích vượt trội cho các vòng lặp dài.

Ví dụ, một tác tử đọc lại 150K token đã lưu đệm qua 1.000 bước sẽ tiêu thụ 150 triệu token đọc bộ nhớ đệm. Ở mức 1 USD mỗi MTok, phần này tốn 150 USD; ở mức 0,25 USD mỗi MTok, chỉ tốn 37,50 USD. Ví dụ này không bao gồm đầu vào mới, đầu ra, ghi bộ nhớ đệm và phí nền tảng, nhưng cho thấy vì sao giá nền không đổi vẫn có thể tạo ra chi phí thấp hơn mỗi tác vụ hoàn tất.

Anthropic ước tính giảm khoảng 25% chi phí cho khối lượng công việc tính theo token điển hình và lên đến khoảng 45% cho khối lượng công việc mang tính tác tử cao. Đây là ước tính theo cơ cấu khối lượng công việc, không phải mức giảm phổ quát trên mọi token.

Claude Fable 5.1 vs Opus 5 vs Sonnet 5

Model frontier là trần năng lực, nhưng Anthropic khuyến nghị tầng Opus làm điểm khởi đầu cho hầu hết khối lượng công việc. Tầng Sonnet vẫn là lựa chọn nhanh hơn, chi phí thấp hơn khi thông lượng và độ trễ quan trọng hơn độ tin cậy dài hạn tối đa. Để có phân tích sâu hai model, xem so sánh Fable vs Sonnet của CometAPI.

Chiều so sánhClaude Fable 5.1Claude Opus 5Claude Sonnet 5
Cửa sổ ngữ cảnh1M1M1M
Đầu ra tối đa128K128K128K
Giá niêm yết đầu vào/đầu ra10 USD / 50 USD5 USD / 25 USD2 USD / 10 USD
Độ trễ tương đốiChậm hơnVừa phảiNhanh
Phù hợp nhấtTác vụ khó, dài hạn và lý luận sâuĐiểm khởi đầu premium mặc địnhKhối lượng lớn ưu tiên tốc độ và chi phí

Kết luận chọn lựa: Hãy bắt đầu với tầng chi phí thấp hơn đáp ứng được tác vụ. Chỉ nâng cấp khi đánh giá sản xuất cho thấy model frontier nâng tỷ lệ kết quả chấp nhận, giảm số lần thử lại hoặc hạ tổng chi phí cho mỗi quy trình thành công.

Những thay đổi khi di trú mà nhà phát triển phải kiểm thử

Model mới phần lớn là hậu duệ “drop-in”, nhưng Anthropic ghi nhận ba thay đổi gây phá vỡ ảnh hưởng đến framework tác tử và các cuộc hội thoại dài.

Thay đổi khi di trúĐiều xảy raHành động yêu cầu của nhà phát triển
Ép buộc chọn công cụtool_choice = any hoặc công cụ được đặt tên trả về HTTP 400Dùng auto, hướng dẫn model, và áp dụng schema nghiêm ngặt khi cần
Khối tư duy qua chuyển modelModel cũ không thể đọc các khối tư duy mớiKiểm thử bộ định tuyến và kỳ vọng các khối lý luận bị bỏ khi định tuyến ngược
Sửa các lượt trước đóLịch sử thay đổi có thể làm mất hiệu lực khối tư duyGiữ lịch sử chỉ-nối-thêm hoặc dùng mẫu thu gọn được hỗ trợ

Ngoài ra, hãy kiểm thử mức nỗ lực theo từng tin nhắn, thông điệp hệ thống theo phạm vi lượt, cập nhật tiến độ giữa các lần gọi công cụ, hành vi bộ nhớ đệm và nguồn gốc nội dung trước khi chuyển lưu lượng sản xuất. Hướng dẫn API Fable hiện có vẫn là nơi tốt hơn cho thiết lập SDK tổng quát và ví dụ yêu cầu.

Ai nên dùng Claude Fable 5.1?

Claude Fable 5.1 phù hợp nhất cho khối lượng công việc trong đó lý luận bền bỉ và hoàn thành thành công quan trọng hơn độ trễ tối thiểu hoặc giá token. Chọn model này khi tác vụ kéo dài nhiều bước, dùng công cụ lặp lại, hoặc có giá trị kinh doanh đủ lớn để tránh chạy lỗi và làm lại có thể bù đắp chi phí model premium.

  • Kỹ thuật ở quy mô kho mã: gỡ lỗi, di trú, tái cấu trúc đa tệp, chạy kiểm thử và tác tử lập trình không giám sát.
  • Nghiên cứu nhiều bước: tìm kiếm, đánh giá bằng chứng, chạy phân tích và tạo báo cáo cuối cùng có căn cứ.
  • Tài liệu lớn và công việc chuyên môn: hợp đồng, tài liệu kỹ thuật, tài liệu tài chính, bảng tính và quy trình thuyết trình.
  • Sử dụng máy tính và tự động hóa: tác vụ đòi hỏi gọi công cụ lặp lại, điều hướng giao diện, xác minh và phục hồi sau lỗi trung gian.

Đối với phân loại thường quy, trích xuất khối lượng lớn hoặc chat nhạy độ trễ, hãy bắt đầu với Claude Opus 5 hoặc Claude Sonnet 5

Khả dụng qua CometAPI

Tính đến ngày 4 tháng 9 năm 2026, trang model CometAPI liệt kê Claude Fable 5.1 đang hoạt động. ID model là claude-fable-5-1.

  1. Tạo hoặc đăng nhập tài khoản CometAPI và tạo khóa API trong bảng điều khiển.
  2. Chọn Claude Fable 5.1 và truyền claude-fable-5-1 làm ID model.
  3. Gửi yêu cầu qua endpoint tương thích Anthropic /v1/messages hoặc endpoint tương thích OpenAI /v1/chat/completions.
  4. Chạy đánh giá theo phong cách sản xuất để xác nhận độ trễ, xử lý ngữ cảnh, hành vi công cụ và tính phí trước khi di chuyển lưu lượng.

Nhà phát triển cũng có thể truy cập model trực tiếp qua Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform on AWS.

Kết luận

Claude Fable 5.1 nên được hiểu là một bản nâng cấp về thực thi. Bằng chứng thuyết phục nhất không phải là cửa sổ ngữ cảnh 1M không đổi hay mức giá premium 10/50 USD; đó là cải thiện lớn ở nghiên cứu theo tác tử, lập trình qua terminal và tự động hóa, kết hợp với chi phí đọc bộ nhớ đệm rẻ hơn đáng kể.

Hãy dùng model này khi tác vụ khó, kéo dài và đủ giá trị để việc giảm số lần chạy lỗi có thể biện minh cho giá premium. Với công việc thường quy, khối lượng lớn hoặc nhạy độ trễ, hãy bắt đầu với tầng chi phí thấp hơn và chỉ nâng cấp khi đánh giá của chính bạn cho thấy cải thiện đo lường được ở kết quả hoàn tất.

Câu hỏi thường gặp

Claude Fable 5.1 có khả dụng qua API không?

Có. Anthropic liệt kê Claude Fable 5.1 hoạt động từ ngày 1 tháng 9 năm 2026. Model có sẵn qua Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform on AWS.

Chi phí API Claude Fable 5.1 là bao nhiêu?

Giá niêm yết chính thức của Anthropic là 10 USD mỗi MTok đầu vào và 50 USD mỗi MTok đầu ra. CometAPI hiện liệt kê 8 USD đầu vào và 40 USD đầu ra mỗi MTok. Hãy kiểm tra giá tuyến trực tiếp trước khi triển khai.

Cửa sổ ngữ cảnh của Claude Fable 5.1 lớn cỡ nào?

Model hỗ trợ cửa sổ ngữ cảnh 1M token và đầu ra đến 128K token. Dung lượng lớn không loại bỏ nhu cầu kiểm thử chất lượng truy xuất, độ trễ và chi phí với tài liệu sản xuất.

Có gì thay đổi từ Claude Fable 5 lên 5.1?

Những thay đổi thực tiễn lớn nhất là nghiên cứu theo tác tử và thực thi qua terminal mạnh hơn, giá đọc bộ nhớ đệm giảm từ 1 USD xuống 0,25 USD mỗi MTok, kiểm soát nỗ lực theo từng tin nhắn, cập nhật tiến độ và nguồn gốc nội dung. Di trú cũng yêu cầu kiểm thử ép buộc chọn công cụ, khối tư duy qua chuyển model và lịch sử hội thoại bị chỉnh sửa.

Claude Fable 5.1 có tốt hơn Claude Opus 5 không?

Không phải cho mọi khối lượng công việc. Fable 5.1 là lựa chọn năng lực cao hơn cho công việc dài hạn đòi hỏi cao, nhưng chậm hơn và đắt hơn. Anthropic khuyến nghị bắt đầu hầu hết công việc với Claude Opus 5 và chỉ nâng cấp khi đánh giá mức nỗ lực cao vẫn chưa đạt.

Tôi có thể dùng Claude Fable 5.1 qua CometAPI không?

Có. CometAPI hiện liệt kê Claude Fable 5.1 đang hoạt động dưới ID model claude-fable-5-1, với endpoint tương thích Anthropic và OpenAI.

Claude Fable 5.1 có hỗ trợ ép buộc dùng công cụ không?

Không. Anthropic ghi nhận rằng đặt tool_choice là any hoặc một công cụ được đặt tên sẽ trả về HTTP 400. Hãy dùng auto hoặc none, sau đó hướng dẫn chọn công cụ bằng chỉ dẫn và schema đầu vào nghiêm ngặt khi cần.

Tiếp tục học

Kết nối bài viết này với quyết định tiếp theo.

Xem tất cả chủ đề
Được xuất bản Sep 4, 2026
Cập nhật lần cuối Sep 4, 2026
0 lượt xem
Đã được xem xét về độ rõ ràng, ghi nguồn và thuật ngữ API hiện tại.

Sẵn sàng giảm 20% chi phí phát triển AI?

Bắt đầu miễn phí trong vài phút. Bao gồm tín dụng dùng thử miễn phí. Không cần thẻ tín dụng.

Đọc thêm