สรุปแบบรวดเร็ว: เพื่อใช้งาน Claude Fable 5.1 API บน CometAPI ให้เตรียมคีย์ API กำหนดรหัสโมเดลเป็น claude-fable-5-1 และตรวจสอบคำขอขนาดเล็กให้ผ่านก่อนสร้างเวิร์กโฟลว์ที่ยาวขึ้น คู่มือนี้ครอบคลุมการเข้าถึง ระดับความพยายาม การสตรีม เครื่องมือ แคช การย้ายเวอร์ชัน และการตรวจสอบก่อนขึ้นผลิตจริง ปฏิบัติต่อการดีพลอยเป็นมากกว่าการเปลี่ยนสตริงโมเดล: ยืนยันความเข้ากันได้ของเส้นทาง ตรวจสอบผลลัพธ์ และวัดคุณภาพงานที่รับได้ เวลาแฝง และต้นทุน ก่อนขยายการใช้งาน
ประเด็นสำคัญ
- เริ่มจากให้คำขอเดียวทำงานได้ก่อน: ยืนยันข้อมูลยืนยันตัวตน การเข้าถึงโมเดล เอ็นด์พอยต์ที่เลือก และการตอบกลับที่ใช้งานได้ด้วยข้อมูลทดสอบที่ไม่อ่อนไหว
- เลือกระดับความพยายามอย่างมีเจตนา: เริ่มที่สูง แล้วเทียบการตั้งค่าอื่นกับงานตัวแทน แทนที่จะใช้ความพยายามสูงสุดกับทุกคำขอ Claude Code ตั้งค่าเริ่มต้นเป็น High ส่วน Claude Cowork / Claude.ai ตั้งค่าเริ่มต้นเป็น Medium
- ทบทวนพฤติกรรมการย้ายเวอร์ชัน: การบังคับเลือกเครื่องมือถูกปฏิเสธ; รักษาขั้นตอนเวิร์กโฟลว์ที่จำเป็นและการตรวจสอบอาร์กิวเมนต์ของเครื่องมือไว้ในโค้ดแอปพลิเคชัน
- วัดเวิร์กโฟลว์ครบถ้วน: ติดตามการใช้แคช ต้นทุนโทเคน เวลาแฝง การปฏิเสธ พฤติกรรม fallback และผลลัพธ์สุดท้ายผ่านการตรวจรับของคุณหรือไม่
สำหรับข้อมูลพื้นฐาน โปรดดู ตัวติดตาม Fable 5.1 ก่อนหน้านี้ของ CometAPI และ บทเรียน Fable 5 API บทความนี้มุ่งเน้นเวิร์กโฟลว์การผสานระบบปัจจุบัน
Claude Fable 5.1 คืออะไร?
Claude Fable 5.1 เป็นโมเดลที่มีความสามารถสูงสุดแบบ GA ของ Anthropic สำหรับงานโค้ดที่ทะเยอทะยาน งานวิจัยหลายขั้นตอน การใช้งานคอมพิวเตอร์ และเวิร์กโฟลว์มืออาชีพที่มีเอกสารจำนวนมาก Anthropic แนะนำให้เริ่มงานส่วนใหญ่ด้วย Claude Opus 5 และเลื่อนไปใช้ Fable 5.1 เมื่อการประเมินแบบ high-effort ของ Opus ยังไม่เพียงพอ
ความแตกต่างเป็นเชิงปฏิบัติการ: Fable 5.1 ถูกออกแบบให้ทำงานต่อเนื่องข้ามขั้นตอนที่พึ่งพากัน ฟื้นตัวหลังการเรียกเครื่องมือที่ล้มเหลว ตรวจสอบผลลัพธ์ และรายงานความคืบหน้าระหว่างการรันยาว สิ่งนั้นช่วยเพิ่มอัตราการเสร็จสิ้น แต่ก็ทำให้ต้นทุน เวลาแฝง และการสังเกตการณ์เป็นหัวใจของการดีพลอย
ข้อกำหนดสเปกของ Claude Fable 5.1 API
| ข้อกำหนดอย่างเป็นทางการ | Claude Fable 5.1 |
|---|---|
| ผู้ให้บริการ | Anthropic |
| รหัสโมเดล | claude-fable-5-1 |
| วันที่เปิดตัว | September 1, 2026 |
| หน้าต่างคอนเท็กซ์ | 1,000,000 tokens |
| เอาต์พุตสูงสุด | 128,000 tokens |
| อินพุตและเอาต์พุต | ข้อความและภาพเป็นข้อความ |
| การคิด | Adaptive, always on |
| ระดับความพยายามเริ่มต้น | API เป็น High, Claude Code เริ่มต้น High, Claude Cowork / Claude.ai เริ่มต้น Medium |
| ระดับความพยายาม | low, medium, high, xhigh, max |
| เส้นตัดความรู้ | June 2026 |
| ราคาทางการ | $10 อินพุต / $50 เอาต์พุต ต่อหนึ่งล้านโทเคน |
| ราคาอ่านแคช | $0.25 ต่อหนึ่งล้านโทเคน |
ภาพรวมทางการยืนยัน หน้าต่างคอนเท็กซ์ 1M และเอาต์พุตสูงสุด 128K การคิดแบบ adaptive เปิดตลอดเวลา; ความลึกของการให้เหตุผลควบคุมด้วย effort แทนงบประมาณโทเคนการคิดแบบดั้งเดิม
ผลลัพธ์เบนช์มาร์กอย่างเป็นทางการของ Claude Fable 5.1 API
สรุปเบนช์มาร์กมีจงใจให้กระชับเพราะวัตถุประสงค์หลักของบทความคือการลงมือทำ ผลลัพธ์ด้านล่างระบุว่าพรีเมียมของ API มีแนวโน้มจะสำคัญในจุดใด
| เบนช์มาร์กของ Anthropic | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1,853 Elo | 1,723 | 1,824 | 1,711 |
| OSWorld 2.0, partial | 77.9% | 72.9% | 75.4% | — |
| Humanity's Last Exam, no tools | 60.9% | 57.8% | 56.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |

การเปรียบเทียบเบนช์มาร์กอย่างเป็นทางการของ Anthropic สำหรับ Claude Fable 5.1
การเพิ่มขึ้นรุ่นต่อรุ่นที่ใหญ่สุดในชุดนี้คือ Terminal-Bench-Science: 52.6% ต่อ 24.7% AutomationBench เพิ่มจาก 17.1% เป็น 31.4% ขณะที่ Terminal-Bench 4.0 ปรับดีขึ้นเป็น 55.8% ผลลัพธ์นี้เป็นเหตุผลที่ดีในการทดสอบ Fable 5.1 บนเอเยนต์วิจัย งานโค้ดยาว และระบบอัตโนมัติธุรกิจ ไม่ใช่เพื่อส่งคำขอสั้นทุกคำไปยังโมเดลที่แพงที่สุด
มีอะไรเปลี่ยนจาก Claude Fable 5 API?
| มิติ | Claude Fable 5.1 | Claude Fable 5 | ผลกระทบการย้าย |
|---|---|---|---|
| บทบาทหลัก | เอเยนต์รันยาวและงานวิจัยที่แข็งแกร่งกว่า | โมเดลสาธารณะชั้น Mythos ดั้งเดิม | ประเมินเวิร์กโฟลว์ที่ยากสุดใหม่ |
| การบังคับเลือกเครื่องมือ | ส่งกลับข้อผิดพลาด | รองรับก่อนหน้านี้ | ลบการบังคับทั้งหมดและแบบระบุชื่อ |
| ประวัติการคิด | กฎความเข้ากันได้ที่เข้มงวดขึ้น | พฤติกรรมเดิม | รักษาประวัติเป็น append-only |
| อัปเดตความคืบหน้า | อัปเดตอ่านได้ระหว่างการเรียกเครื่องมือ | ไม่มีในรูปแบบนี้ | เปิดเผยสถานะการรันยาว |
| effort ต่อข้อความ | มีให้แบบเบต้า | ไม่มีในรูปแบบนี้ | ปรับความลึกในบทสนทนา |
| ราคาอ่านแคช | $0.25 / MTok | $1.00 / MTok | คำนวณเศรษฐศาสตร์คอนเท็กซ์ยาวใหม่ |
| ราคาอินพุต/เอาต์พุต | $10 / $50 per MTok | $10 / $50 per MTok | ไม่มีการเปลี่ยนแปลงรายการราคา |
การเปลี่ยนแปลงที่ทำให้แตกหักสามข้อ
ไม่รองรับการบังคับใช้เครื่องมืออีกต่อไป
Claude Fable 5.1 ปฏิเสธค่า tool_choice ที่บังคับเครื่องมือใดๆ หรือเครื่องมือที่ระบุชื่อ โดยคืนค่า 400 invalid-request ใช้การเลือกอัตโนมัติ กำหนดสคีมาเข้มงวดหรือเอาต์พุตแบบมีโครงสร้างเพื่อการตรวจสอบ และบังคับขั้นตอนเวิร์กโฟลว์ที่จำเป็นในออร์เคสตราชันของแอป ไม่ใช่ด้วยการบังคับให้โมเดลเรียกเครื่องมือ
โมเดลก่อนหน้าไม่สามารถอ่านบล็อกการคิดของ Fable 5.1
ความเข้ากันได้ของการคิดเป็นทางเดียว: Fable 5.1 สามารถอ่านบล็อกการคิดของโมเดล Claude ก่อนหน้าที่เข้ากันได้ แต่โมเดลก่อนหน้าไม่สามารถอ่านบล็อกที่ Fable 5.1 สร้างได้ เราเตอร์หรือ fallback ที่สลับไปโมเดลก่อนหน้าอาจทิ้งบล็อกเหล่านั้นก่อนอินเฟอเรนซ์ ดังนั้นอินทิเกรชันควรบันทึกการสลับโมเดลและทดสอบพฤติกรรม fallback โดยเฉพาะ
การแก้ไขเทิร์นก่อนหน้าทำให้การคิดที่เก็บรักษาไว้เป็นโมฆะ
การคิดที่เก็บรักษาถูกผูกเข้ากับสถานะบทสนทนาที่นำหน้าแบบเข้ม การเปลี่ยน system prompt, คำอธิบายเครื่องมือ, ข้อความ, หรือไบต์ไฟล์อ้างอิงก่อนหน้า อาจทำให้บล็อกการคิดภายหลังไม่ถูกต้อง ให้ถือว่าพรีฟิกซ์บทสนทนาเป็นแบบ append-only ใช้คำสั่งกลางบทสนทนาแทนการเขียนประวัติใหม่ และติดตามการแปลง prefix-mismatch ระหว่างการย้าย
ความสามารถ API ที่เพิ่มเข้ามาห้าข้อ
Effort ต่อข้อความ
แอปพลิเคชันสามารถเปลี่ยนความพยายามระหว่างบทสนทนา โดยไม่ทำให้แคชพรอมป์ต์เป็นโมฆะ ความสามารถแบบเบต้านี้ช่วยให้เวิร์กโฟลว์ลดความพยายามสำหรับงานติดตามผลตามปกติ และเพิ่มสำหรับการวางแผน แก้บั๊ก หรือการตรวจสอบที่ยาก
System message ที่จำกัดขอบเขตต่อหนึ่งเทิร์น
System message แบบเบต้าสามารถมีผลกับหนึ่งเทิร์นและหยุด render หลังข้อความผู้ใช้ถัดไป ขณะยังคงไม่เปลี่ยนในประวัติ เหมาะสำหรับคำสั่งชั่วคราวในลูปเครื่องมือ เพราะคงไว้ซึ่งการจับคู่แคชพรอมป์ต์และความถูกต้องของบล็อกการคิดภายหลัง
อัปเดตความคืบหน้าแบบอ่านได้ระหว่างการเรียกเครื่องมือ
ด้วยตัวเลือกแสดงความคืบหน้าแบบเบต้า บล็อกการคิดบางส่วนสามารถพกพาสถานะสั้นๆ ที่แอปพลิเคชันแสดงให้ผู้ใช้ระหว่าง reasoning ได้ ขณะที่เหตุผลส่วนตัวยังคงซ่อนอยู่ เอเยนต์รันยาวควรถือว่าอัปเดตเหล่านี้เป็นสถานะการทำงาน ไม่ใช่คำตอบสุดท้าย
ราคาการอ่านแคชที่ต่ำลง
การอ่านแคชมีค่าใช้จ่าย $0.25 ต่อหนึ่งล้านโทเคน ซึ่งเป็นหนึ่งในสี่ของ Fable 5 ขณะที่ราคาอินพุตและเอาต์พุตพื้นฐานไม่เปลี่ยน สิ่งนี้ลดต้นทุนของเซสชันยาวที่ใช้พรีฟิกซ์แคชคงที่ซ้ำๆ ได้อย่างมีนัยสำคัญ
แหล่งที่มาของเนื้อหา
ข้อความที่สร้างมี watermarks ทางสถิติของ Anthropic ขณะที่สื่อที่รองรับผ่าน Files API สามารถรวม C2PA Content Credentials ที่ลงนาม กลไกเหล่านี้ไม่เพิ่มโทเคนพรอมป์ต์หรือจำเป็นต้องเปลี่ยนรูปแบบคำขอ
ต้องมีอะไรบ้างก่อนใช้งาน Claude Fable 5.1 API?
- บัญชีและคีย์ API: ลงชื่อเข้าใช้ CometAPI และสร้างคีย์ใน คอนโซลคีย์ API ตรวจสอบการเข้าถึงโมเดลและสถานะเรียกเก็บเงินตามการใช้งานก่อนส่งคำขอทดสอบ
- รันไทม์โลคัล: ใช้เทอร์มินัลกับ curl สำหรับตัวอย่าง HTTP แรก สำหรับตัวอย่าง Python เตรียม Python และ pip ในสภาพแวดล้อมแยก แล้วติดตั้ง SDK ของตัวอย่างที่เลือก
- เส้นทางที่เลือก: Claude Fable 5.1 API ใน CometAPI มีรูปแบบ Messages และ Chat Completions ใช้ URL ฐานและรูปแบบคำขอให้ตรงกัน; อย่าผสม payload ของทั้งสอง
- การตั้งค่าที่ปลอดภัย: ตั้ง
COMETAPI_KEYนอกไฟล์ซอร์สที่คอมมิต ใช้claude-fable-5-1เป็นรหัสโมเดล และตรวจให้แน่ใจว่าเครือข่ายเข้าถึงhttps://api.cometapi.com. - การทดสอบที่ปลอดภัยและการตรวจรับ: เริ่มด้วยพรอมป์ต์สั้นที่ไม่อ่อนไหว ยืนยันว่าการตอบกลับมีเนื้อหาที่ใช้งานได้ ตรวจสอบการใช้งานและสถานะการสำเร็จ และตรวจข้อกำหนดการจัดการข้อมูลขององค์กรก่อนส่งเอกสารหรือบันทึกจริง
วิธีเข้าถึง Claude Fable 5.1 ผ่าน CometAPI
CometAPI เปิดให้ใช้ Claude Fable 5.1 ผ่านเส้นทาง Messages ที่เข้ากันได้กับ Anthropic และเส้นทาง Chat Completions ที่เข้ากันได้กับ OpenAI ใช้ Messages เมื่อคุณต้องการ effort แบบเนทีฟ การคิด การแคช และเซแมนติกของเครื่องมือ Claude ใช้ Chat Completions เมื่อแอปของคุณมาตรฐานบน OpenAI SDK อยู่แล้ว
ขั้นตอนที่ 1: จัดเก็บคีย์ API
export COMETAPI_KEY="your-cometapi-key"
$env:COMETAPI_KEY="your-cometapi-key"
ขั้นตอนที่ 2: ส่งคำขอ Messages ครั้งแรก
curl https://api.cometapi.com/v1/messages \
--header "Authorization: Bearer $COMETAPI_KEY" \
--header "content-type: application/json" \
--data '{
"model": "claude-fable-5-1",
"max_tokens": 2048,
"messages": [{
"role": "user",
"content": "Review this deployment architecture and list the three highest-risk failure modes."
}]
}'
ขั้นตอนที่ 3: ใช้ Anthropic Python SDK
pip install anthropic
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com",
)
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
messages=[{
"role": "user",
"content": "Find the root cause of this test failure and propose a verified patch.",
}],
)
print(response.content[0].text)
ขั้นตอนที่ 4: ใช้ OpenAI Python SDK
pip install openai
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-fable-5-1",
messages=[{
"role": "user",
"content": "Design a migration plan for this service.",
}],
)
print(response.choices[0].message.content)
กลไกการใช้เหตุผลของ Claude Fable 5.1 API ทำงานอย่างไร?
โมเดลก่อนหน้าไม่สามารถอ่านบล็อกการคิดของ Claude Fable 5.1
บล็อกการคิดที่สร้างโดย Fable 5.1 ไม่เข้ากันย้อนหลังกับโมเดล Claude ก่อนหน้า หากเวิร์กโฟลว์เปลี่ยนโมเดลกลางบทสนทนา ให้ลบบล็อกการคิดที่ไม่เข้ากัน หรือเริ่มแขนงใหม่โดยเก็บเฉพาะข้อความที่ผู้มองเห็นได้และผลเครื่องมือที่จำเป็นสำหรับคำขอถัดไป
การแก้ไขเทิร์นก่อนหน้าทำให้การคิดที่เก็บรักษาเป็นโมฆะ
บล็อกการคิดที่เก็บรักษาถูกผูกแบบเข้ารหัสกับสถานะบทสนทนาที่นำหน้า การแก้ไข system prompt คำจำกัดความเครื่องมือ ข้อความ หรือผลเครื่องมือก่อนหน้า อาจทำลายการผูกนั้นและก่อให้เกิดข้อผิดพลาด thinking-history รักษาพรีฟิกซ์ที่เล่นซ้ำให้คงเดิมแบบไบต์ต่อไบต์ และผนวกเทิร์นใหม่แทนการเขียนเทิร์นเก่า
การคิดที่เก็บรักษาข้ามหลายเทิร์น
เมื่อพรีฟิกซ์บทสนทนาไม่เปลี่ยน การคิดที่เก็บรักษาสามารถพกสถานะเหตุผลที่เป็นประโยชน์ไปยังเทิร์นถัดไป จัดเก็บบล็อกการคิดตามลำดับข้อความดั้งเดิม เล่นซ้ำเฉพาะกับโมเดลที่เข้ากันได้ และถือว่าการแก้ไขประวัติเป็นแขนงบทสนทนาใหม่แทนการเปลี่ยนทรานสคริปต์เดิม
ควบคุมการใช้เหตุผลด้วยระดับความพยายาม
เริ่มงานผลิตจริงที่ยากด้วยความพยายามสูง แล้วทดสอบการตั้งค่าที่ต่ำกว่าสำหรับเทิร์นตามปกติ และตั้งค่าที่สูงกว่าเฉพาะเมื่อคุณภาพงานที่ยอมรับได้ดีขึ้นเพียงพอที่จะคุ้มกับเวลาแฝงและโทเคนเพิ่มเติม เนื่องจาก effort เปลี่ยนได้ระหว่างเทิร์น บทสนทนาเดียวไม่จำเป็นต้องมีระดับเหตุผลเดียวตลอด
Fable 5.1 ใช้ adaptive thinking เป็นโหมดเดียวของการคิด เริ่มที่ความพยายามสูง จากนั้นวัดการตั้งค่าที่ต่ำกว่าสำหรับงานประจำ และ xhigh หรือ max เฉพาะเมื่อความสามารถเพิ่มเติมคุ้มต้นทุนและเวลาแฝง
| Effort | บทบาทที่แนะนำ | ข้อแลกเปลี่ยน |
|---|---|---|
| low | งานประจำที่กำหนดชัดเจน | เร็วและประหยัดที่สุด |
| medium | ทราฟฟิกผลิตจริงแบบสมดุล | ความลึกปานกลาง |
| high | งานยากค่าเริ่มต้น | จุดเริ่มต้นที่ดีที่สุด |
| xhigh | งานโค้ดยาวและเอเยนต์ | เวลาแฝงและโทเคนมากขึ้น |
| max | งานมูลค่าสูงที่ยากที่สุด | ต้นทุนและเวลาแฝงเป็นรอง |
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=8192,
output_config={"effort": "high"},
messages=[{
"role": "user",
"content": "Audit this repository migration plan.",
}],
)
Claude Fable 5.1 API: สตรีมคำตอบยาว ใช้เครื่องมือ และใช้แคชพรอมป์ต์
กำหนดค่าการควบคุมต่อไปนี้ร่วมกัน: ระดับความพยายามในการใช้เหตุผล การสตรีม การเรียกเครื่องมือ การแคชพรอมป์ต์ และการจัดการมาตรการคุ้มครองและข้อมูลที่เก็บรักษา แต่ละอย่างมีผลต่อการสังเกต ตรวจสอบความถูกต้อง และการปฏิบัติการของคำขอรันยาว
สตรีมคำตอบยาว
การสตรีมเป็นค่าตั้งต้นที่ปลอดภัยกว่าสำหรับงานยาวแบบ high-effort เพราะหลีกเลี่ยงการรอคำตอบขนาดใหญ่เสร็จก่อนที่แอปจะได้รับเอาต์พุตใดๆ
with client.messages.stream(
model="claude-fable-5-1",
max_tokens=8192,
output_config={"effort": "high"},
messages=[{
"role": "user",
"content": "Analyze these logs and produce a remediation plan.",
}],
) as stream:
for text in stream.text_stream:
print(text, end="", flush=True)
ใช้เครื่องมือโดยไม่บังคับเลือกเครื่องมือ
Fable 5.1 ปฏิเสธการบังคับเลือกเครื่องมือ ด้วย tool_choice แบบ any หรือแบบระบุชื่อ ใช้การเลือกอัตโนมัติ กำหนดสคีมาเข้มงวด ตรวจสอบอาร์กิวเมนต์เครื่องมือในโค้ดแอป และควบคุมลำดับขั้นตอนที่จำเป็นนอกโมเดล หากเวิร์กโฟลว์ต้องเรียกเครื่องมือเฉพาะ อย่าพึ่ง tool_choice เพื่อบังคับ ให้แอปเรียกเครื่องมือนั้นเอง หรือทำขั้นตอนที่จำเป็นในออร์เคสตราชัน
tools = [{
"name": "search_incidents",
"description": "Search recent production incidents",
"input_schema": {
"type": "object",
"properties": {
"service": {"type": "string"},
"days": {"type": "integer"},
},
"required": ["service", "days"],
},
}]
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
tools=tools,
tool_choice={"type": "auto"},
messages=[{
"role": "user",
"content": "Review checkout incidents from the last 30 days.",
}],
)
ใช้แคชพรอมป์ต์สำหรับคอนเท็กซ์ยาว
Anthropic ระบุ ราคาอ่านแคช $0.25 ต่อหนึ่งล้านโทเคน ซึ่งเป็นหนึ่งในสี่ของอัตรา Fable 5 วาง system instruction ที่คงที่ สคีมาเครื่องมือ และเอกสารอ้างอิงขนาดใหญ่ไว้ก่อนคอนเทนต์ผู้ใช้แบบไดนามิก จากนั้นยืนยันแคชฮิตในเมตะดาตาการใช้งาน
messages = [{
"role": "user",
"content": [
{
"type": "text",
"text": large_reference_document,
"cache_control": {"type": "ephemeral"},
},
{
"type": "text",
"text": "Identify obligations that changed in this revision.",
},
],
}]
จัดการมาตรการคุ้มครองและการเก็บข้อมูล
Anthropic ระบุว่าคำขอเกี่ยวกับไซเบอร์ซีเคียวริตี้และชีววิทยาที่ถูกตั้งธงจำนวนมาก จะถูกส่งไปยังโมเดลที่มีความสามารถน้อยกว่า ให้ถือว่าการปฏิเสธหรือ fallback เป็นสถานะของแอป: บันทึก stop reason แสดงข้อความผู้ใช้ที่เหมาะสม และส่งต่อไปยังทางเลือกที่อนุมัติเมื่อเป็นไปตามนโยบาย
Fable ยังต้องการ การเก็บข้อมูล 30 วันโดยค่าเริ่มต้น เพื่อการตรวจความปลอดภัย ยืนยันคุณสมบัติองค์กรและการตั้งค่าการเก็บ ก่อนดีบักคำขอที่ไวยากรณ์ถูกต้องราวกับเป็นปัญหาเฉพาะรูปแบบ API
Fable 5.1 เทียบกับ Opus 5 และ Sonnet 5
| มิติตัดสินใจ | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| คอนเท็กซ์ / เอาต์พุตสูงสุด | 1M / 128K | 1M / 128K | 1M / 128K |
| ราคาอินพุต/เอาต์พุตทางการ | $10 / $50 | $5 / $25 | $2 / $10 |
| เวลาแฝงโดยสัมพัทธ์ | ช้ากว่า | ปานกลาง | เร็ว |
| ความพยายามเริ่มต้น | high | high | high |
| จุดแข็งหลัก | ความสามารถระยะยาวสูงสุด | เหตุผลทั่วไประดับพรีเมียม | สมดุลความเร็ว/ต้นทุน |
| บทบาทผลิตจริงที่เหมาะสุด | การยกระดับความสามารถ | งานซับซ้อนค่าเริ่มต้น | ปริมาณสูงพื้นฐาน |
ผลการเลือก: เริ่มทราฟฟิกประจำบน Sonnet 5 ใช้ Opus 5 สำหรับทราฟฟิกทั่วไปที่ซับซ้อน และเลื่อนเฉพาะงานที่ยากที่สุดหรือที่ล้มเหลวซ้ำไปยัง Fable 5.1 ตามแนวทางของ Anthropic และหลีกเลี่ยงไม่ให้การให้เหตุผลพรีเมียมกลายเป็นต้นทุนค่าเริ่มต้นของทุกคำขอ
การกำหนดราคาใน CometAPI
| เส้นทาง | อินพุต / MTok | เอาต์พุต / MTok | อ่านแคช / MTok |
|---|---|---|---|
| ราคาประกาศของ Anthropic | $10 | $50 | $0.25 |
| ราคาที่แสดงของ CometAPI | $8 | $40 | ตรวจสอบเส้นทางสด |
| ส่วนต่างอินพุต/เอาต์พุตโดยนัย | ต่ำกว่า 20% | ต่ำกว่า 20% | แตกต่างตามเส้นทาง |
หน้ารุ่นโมเดลสดของ CometAPI คือแหล่งความจริงสำหรับความพร้อมใช้งานและราคาปัจจุบัน สำหรับคำขอที่มีอินพุต 100,000 โทเคนที่ไม่แคชและเอาต์พุต 10,000 โทเคน การประมาณง่ายของ CometAPI คือ $1.20; ต้นทุนจริงอาจเปลี่ยนตามการแคช การให้เหตุผล พฤติกรรมแบตช์ และการรูท ราคาอาจเปลี่ยนแปลง; ตรวจหน้ารุ่นสดก่อนวางงบประมาณผลิตจริง
เช็กลิสต์การย้ายจาก Fable 5
- เปลี่ยนรหัสโมเดลจาก claude-fable-5 เป็น claude-fable-5-1
- ลบการบังคับ
tool_choiceแบบ any และแบบระบุชื่อ; ใช้ auto - แทนสมมติฐานงบประมาณการคิดแบบเก่าด้วย
output_config.effort - เริ่มประเมินที่ความพยายามสูง แล้วปรับตามงานจริง
- รักษาประวัติเป็นแบบ append-only เมื่อมีบล็อกการคิดที่เก็บรักษา
- เพิ่ม
max_tokensสำหรับการรันแบบ high-effort ที่ยาว - ยืนยันแคชฮิตจากเมตะดาตาการใช้งาน
- จัดการการปฏิเสธและ fallback เป็นสถานะชัดเจน
- เล่นซ้ำทรซของผลิตจริงและเทียบอัตรางานที่ยอมรับได้ เวลาแฝง และต้นทุน
กลยุทธ์การย้ายที่ปลอดภัยที่สุด: รักษาประวัติเป็นแบบ append-only Fable 5.1 สามารถเก็บรักษาบล็อกการคิดข้ามเทิร์นได้ แต่บล็อกที่เล่นซ้ำถูกผูกกับสถานะบทสนทนาที่นำหน้า; การเปลี่ยน system prompt เครื่องมือ หรือข้อความก่อนหน้า สามารถทำให้การผูกนั้นเป็นโมฆะ
ข้อผิดพลาด API ที่พบบ่อย
400 error หลังเปลี่ยนการเรียกเครื่องมือ
สาเหตุที่เป็นไปได้: การบังคับ tool_choice แบบ any หรือแบบระบุชื่อ ใช้ auto และบังคับลำดับที่จำเป็นในตรรกะแอป
claude-fable-5.1 ใช้งานไม่ได้
ID แบบ canonical ใช้ขีดกลาง: claude-fable-5-1
เอาต์พุตสิ้นสุดเร็วกว่าที่คาด
effort controls how much reasoning the model performs, while max_tokens limits the response token budget. Higher effort can require more output budget, so production applications should tune both independently. Raise max_tokens where justified and stream long responses.
แคชพรอมป์ต์ไม่เคยฮิต
รักษาพรีฟิกซ์ที่แคชไว้ให้คงเดิมแบบไบต์ต่อไบต์; การแทรกเวลา การจัดเรียงเครื่องมือใหม่ และการเปลี่ยน system message จะป้องกันการนำกลับมาใช้
การตอบ HTTP สำเร็จแต่ไม่มีคำตอบปกติ
ตรวจสอบ stop_reason และเมตะดาตา fallback แทนที่จะถือว่าการปฏิเสธทุกครั้งเป็นข้อผิดพลาดการขนส่ง
เล่นซ้ำประวัติแล้วเกิดข้อผิดพลาดการคิด
อย่าแก้ไขเทิร์นก่อนหน้าก่อนบล็อกการคิดของ Fable 5.1 ที่เก็บรักษาไว้ ใช้ประวัติแบบ append-only หรือการควบคุมการย้ายปัจจุบัน
ควรใช้ Claude Fable 5.1 API ในผลิตจริงอย่างไร?
แยกการรูทคำขอ การรันโมเดล การรันเครื่องมือ การตรวจสอบความถูกต้อง และการประเมิน ออกเป็นส่วนๆ บันทึก model ID, effort, เวลาแฝง, การใช้โทเคน, การใช้แคช, stop reason, พฤติกรรม fallback และความสำเร็จของงานสุดท้าย
ใช้ Fable 5.1 สำหรับการย้ายรีโพขนาดใหญ่ การดีบักที่ยาก เอเยนต์รันยาว งานวิจัยลึก การสังเคราะห์เอกสารขนาดใหญ่ และงานมูลค่าสูงที่โมเดลราคาถูกล้มเหลวซ้ำ หลีกเลี่ยงการใช้เป็นค่าเริ่มต้นสำหรับสรุป การจัดประเภท การดึงข้อมูล และการตอบลูกค้าสั้น
ตัวอย่าง: สืบสวนเหตุการณ์ Checkout
ทีมสามารถให้ข้อผิดพลาด checkout ที่ผ่านการทำให้ปลอดภัย ดิฟการดีพลอยล่าสุด และรันบุ๊คที่เกี่ยวข้อง แอปชี้ข้อมูลเหตุการณ์ที่ตรง จากนั้นขอให้โมเดลจัดอันดับสาเหตุที่เป็นไปได้และเชื่อมโยงสมมติฐานแต่ละข้อกับหลักฐาน วิศวกรทบทวนขั้นวินิจฉัยที่เสนอและอนุมัติการทดสอบในแซนด์บ็อกซ์ด้วยทรานแซกชันสังเคราะห์ เกณฑ์การยอมรับคือพฤติกรรมที่ทำซ้ำได้ หลักฐานที่ตรวจสอบย้อนกลับ และการผ่านการทดสอบถดถอย; การแก้ไขผลิตจริงใดๆ ต้องได้รับการอนุมัติโดยมนุษย์แยกต่างหาก
ตัวอย่าง: วิเคราะห์การเปลี่ยนแปลงข้อกำหนดการปฏิบัติงาน
ทีมสามารถจัดหาเอกสารคู่มือปฏิบัติที่อนุมัติแล้ว นโยบายสนับสนุน และร่างที่แก้ไข เก็บเนื้อหาอ้างอิงที่ไม่เปลี่ยนเป็นคอนเท็กซ์คงที่ จากนั้นขอให้โมเดลเปรียบเทียบภาระผูกพันที่เปลี่ยน ทีมรับผิดชอบ เส้นเวลา และข้อยกเว้น แต่ละข้อค้นพบควรอ้างอิงข้อความที่เกี่ยวข้องในทั้งสองเวอร์ชัน และแยกความต่างระหว่างการเปลี่ยนแปลงที่ชัดเจนและการตีความที่ยังไม่แน่ชัด เกณฑ์การยอมรับคือผู้ตรวจทานยืนยันทุกการเปลี่ยนตามหลักฐานอ้างอิงก่อนอัปเดตขั้นตอนหรือแจ้งทีมที่เกี่ยวข้อง
บทสรุป
Claude Fable 5.1 ไม่ใช่การอัปเดตสตริงโมเดลแบบเสียบแล้วใช้ พฤติกรรมเครื่องมือแบบบังคับ กฎประวัติการคิด การควบคุม effort เศรษฐศาสตร์แคช และคุณสมบัติความคืบหน้าแบบรันยาว ต้องการการย้ายอย่างมีแบบแผน
การดีพลอยที่มีประสิทธิผลที่สุดคือใช้ Claude Sonnet 5 สำหรับปริมาณงานประจำ Claude Opus 5 สำหรับทราฟฟิกทั่วไปที่ซับซ้อน และ Claude Fable 5.1 เป็นการยกระดับความสามารถอย่างพิจารณา โปรโมตเฉพาะเมื่ออัตราการสำเร็จงานที่ยอมรับได้ดีขึ้นพอที่จะคุ้มกับต้นทุนรวมและเวลาแฝง
