สรุปสั้นๆ
Claude Haiku 5.5 เป็นโมเดลขนาดเล็กที่เร็วที่สุดของ Anthropic ในโหมดความเร็วมาตรฐาน เหมาะกับงานปริมาณมากที่ไวต่อความหน่วง โดยผสานหน้าต่างบริบท 1 ล้านโทเค็น ขีดจำกัดเอาต์พุตมาตรฐาน 128K การให้เหตุผลแบบปรับได้ และราคาเริ่มต้นที่ $0.10 ต่อหนึ่งล้านโทเค็นอินพุต และ $0.50 ต่อหนึ่งล้านโทเค็นเอาต์พุต อัตราจะเพิ่มขึ้นเมื่อพรอมต์เกิน 100,000 โทเค็น สำหรับโค้ดที่ซับซ้อนและงานเอเจนต์ระยะยาว Sonnet 5.5 และ Opus 5.5 ยังเหมาะสมกว่า ราคา CometAPI Standard ต่ำกว่าราคาอย่างเป็นทางการ 20% เริ่มที่ $0.08 ต่อหนึ่งล้านโทเค็นอินพุต และ $0.40 ต่อหนึ่งล้านโทเค็นเอาต์พุต หน้าโมเดลของ CometAPI เปิดใช้งานแล้วและรายงานการเข้าถึง API ระดับผลิตจริง
ประเด็นสำคัญ
- เปิดตัวอย่างเป็นทางการ: 7 ตุลาคม 2026; Claude API model ID: claude-haiku-5-5
- อัตรา API เริ่มต้น: $0.10 อินพุต และ $0.50 เอาต์พุต ต่อหนึ่งล้านโทเค็นสำหรับพรอมต์ไม่เกิน 100K โทเค็น CometAPI: $0.08 อินพุต และ $0.40 เอาต์พุต ต่อหนึ่งล้านโทเค็น ที่ 80% ของราคา Standard อย่างเป็นทางการ
- บริบทและเอาต์พุต: บริบท 1M โทเค็น และเอาต์พุตมาตรฐาน 128K โทเค็น
- โฟกัส: การจำแนก การดึงข้อมูลจากเอกสาร การจัดเส้นทาง การสนับสนุน และงานเอเจนต์ที่มอบหมาย
- ตัวแบ่งโทเค็นแบบใหม่อาจนับโทเค็นมากขึ้นประมาณ 30% สำหรับข้อความเดียวกัน; ควรประเมินต้นทุนต่อภารกิจที่ยอมรับ มากกว่าดูแค่ราคา/โทเค็น
Claude Haiku 5.5 คืออะไร?
Claude Haiku 5.5 คือสมาชิกสายเบาของตระกูล Claude ปัจจุบันของ Anthropic พัฒนาเพื่อรองรับคำขอปริมาณมากที่ให้ความสำคัญกับความตอบสนองและต้นทุนการดำเนินงาน ใช้หลักสำหรับการประมวลผลเอกสาร การสนับสนุนเชิงสนทนา การดึงข้อมูล และงานซับเอเจนต์ขนาดกะทัดรัด เอกสารภาพรวมของโมเดลของ Anthropic ยืนยันวันเปิดตัว ความสามารถ และตัวระบุแพลตฟอร์ม
Claude Haiku 5.5 เป็น Haiku รุ่นแรกที่รองรับระดับความพยายามที่กำหนดค่าได้ ทำให้นักพัฒนาสามารถแลกเปลี่ยนความลึกของการให้เหตุผล ความหน่วง และการใช้โทเค็นได้ภายในโมเดลเดียวกัน
คุณสมบัติเด่นของ Claude Haiku 5.5 มีอะไรบ้าง?
การคิดแบบปรับตัวและปรับระดับความพยายามได้
Haiku 5.5 สามารถตัดสินใจได้ว่าเมื่อใดและควรใช้เหตุผลมากน้อยเพียงใด ขณะที่พารามิเตอร์ effort เปิดทางให้นักพัฒนาสมดุลคุณภาพคำตอบ ความหน่วง และการใช้โทเค็น ค่าเริ่มต้นของ effort คือระดับกลาง สำหรับงานจำแนกง่ายๆ อาจเหมาะกับระดับต่ำ; สำหรับการดึงข้อมูลที่คลุมเครือหรือขั้นวางแผนการใช้เครื่องมือ อาจสมเหตุสมผลในการตั้งค่าสูงกว่า
การประมวลผลบริบทขนาดใหญ่
หน้าต่างบริบท 1M โทเค็นช่วยให้เอกสารยาวและประวัติการสนทนาจำนวนมากพอดีภายในคำขอเดียว อย่างไรก็ดี นักพัฒนาควรใช้การดึงคืน การตัดทอน และการแคชตามความเหมาะสม: บริบทที่ยาวอาจก่อให้เกิดต้นทุนและการแลกคุณภาพที่ไม่จำเป็น โดยเฉพาะเมื่อเกินเกณฑ์ราคา 100K
ต้นทุนต่ำ รองรับปริมาณสูง
อัตราเริ่มต้นใหม่ $0.10/$0.50 ทำให้คำขอสั้นๆ ซ้ำๆ มีต้นทุนต่อโทเค็นต่ำกว่ารุ่น Haiku ก่อนหน้าอย่างมีนัยสำคัญ อย่างไรก็ตาม Anthropic ระบุว่าตัวแบ่งโทเค็นมีการเปลี่ยนแปลง: ข้อความเดียวกันอาจถูกนับเป็นโทเค็นมากขึ้นประมาณ 30% เมื่อเทียบกับ Haiku 4.5 ดังนั้นการประหยัดจริงในระดับภารกิจอาจน้อยกว่าการลดราคาพาดหัว
การใช้คอมพิวเตอร์และงานเอเจนต์ที่มอบหมาย
การประเมินที่เผยแพร่บ่งชี้ว่าประสิทธิภาพบนงานปฏิสัมพันธ์กับคอมพิวเตอร์และงานที่ใช้เครื่องมือดีขึ้นเมื่อเทียบกับ Haiku รุ่นก่อน ทำให้ Haiku 5.5 เหมาะกับขั้นตอนเอเจนต์แบบมีขอบเขต แต่การทำให้อัตโนมัติสำเร็จยังขึ้นกับสิทธิ์ของเครื่องมือที่ดี การกู้คืนข้อผิดพลาด และการอนุมัติจากมนุษย์สำหรับการกระทำที่มีความเสี่ยง
ประสิทธิภาพของ Claude Haiku 5.5 บนเกณฑ์มาตรฐานเป็นอย่างไร?
Anthropic รายงานการพัฒนาที่ชัดเจนในงานความรู้มืออาชีพ การใช้คอมพิวเตอร์ การเขียนโค้ด และการให้เหตุผล ผลลัพธ์ด้านล่างใช้การตั้งค่าการประเมินที่รายงานไว้; คะแนนจากเกณฑ์มาตรฐานต่างๆ ไม่ควรถูกรวมเป็น “คะแนนสติปัญญา” เดียว
| Benchmark | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1,620 | 1,840 |
| AA-Briefcase v1.1 (Elo) | 614 | 1,578 | 1,824 |
| OSWorld 2.1, offline subset, partial credit | 15.7% | 72.4% | 83.9% |
| Humanity's Last Exam, no tools | 10.2% | 45.9% | 56.9% |
| Humanity's Last Exam, with tools | 18.7% | 57.4% | 64.5% |
| Terminal-Bench 4.0 | 0.0% | 39.2% | 70.6% |
| Chartography, no tools | 6.4% | 46.4% | 61.6% |
การกำหนดค่ามาตรฐานของการประเมิน Haiku 5.5 ใน system card ใช้การคิดแบบปรับตัวที่ระดับความพยายามสูงสุด การสุ่มแบบเริ่มต้น และทำซ้ำห้าครั้ง เว้นแต่จะระบุไว้เป็นอย่างอื่น; ค่าเริ่มต้นของผลิตภัณฑ์คือระดับกลาง ดังนั้นคะแนนพาดหัวไม่ใช่การรับประกันการตั้งค่าเริ่มต้น OSWorld ใช้งานออฟไลน์ 82 งาน ไม่มีการเข้าถึงอินเทอร์เน็ต ความละเอียด 1080p และจำกัด 500 การกระทำ คะแนน 72.4% เป็นคะแนนแบบให้เครดิตบางส่วน; อัตราผ่านแบบเข้มงวดคือ 37.1% GDPval-AA และ AA-Briefcase เป็นผลที่ Anthropic รายงานจากการประเมินของ Artificial Analysis ที่รันโดยอิสระ
Terminal-Bench 4.0 ใช้ Claude Code ในโหมด --bare โดยเปิดใช้งานมาตรการป้องกัน Haiku 5.5 ใช้ความพยายามสูงสุด ไม่มีโมเดลสำรอง และไม่ออกอินเทอร์เน็ต พร้อมทำซ้ำ 10 ครั้งต่อภารกิจ; Sonnet 5.5 ทำซ้ำห้าครั้งและมีสำรองสำหรับคำขอบางประเภท Haiku 4.5 ใช้งบประมาณการคิดคงที่ 63,999 โทเค็น ความแตกต่างในการกำหนดค่าเหล่านี้มีผลต่อการตีความ 39.2% เทียบกับ 70.6%
ผลเกณฑ์มาตรฐานที่เผยแพร่ของ Anthropic จัดหาคะแนนด้านบน OSWorld ใช้ชุดออฟไลน์; Humanity's Last Exam แยกการรันที่มีเครื่องมือและไม่มีเครื่องมือ และ Chartography ไม่มีเครื่องมือ นี่คือผลที่ผู้จำหน่ายรายงาน ไม่ใช่การวัดอิสระภายใต้การกำหนดค่ามาตรฐานเดียว Anthropic ให้รายละเอียดการประเมินในระบบการ์ดของ Haiku 5.5; ทำซ้ำการตั้งค่าที่เกี่ยวข้อง (effort เครื่องมือ สคาฟโฟลด์ และงบประมาณ) ก่อนเปรียบเทียบผลของคุณเอง สรุปการเปิดตัวไม่ได้ระบุสภาพแวดล้อมทดสอบร่วมที่ครบถ้วนสำหรับทุกรายการ

กราฟิกการประเมินอย่างเป็นทางการของ Anthropic ด้านบนถูกทำซ้ำจาก system card ไม่ใช่เกณฑ์มาตรฐานใหม่สำหรับบทความนี้
การตีความเกณฑ์มาตรฐาน
การพัฒนาบน OSWorld ชี้ว่า Haiku 5.5 มีประโยชน์เพิ่มขึ้นอย่างมากสำหรับงานกราฟิกเชิงโครงสร้าง อย่างไรก็ตาม 70.6% ของ Sonnet 5.5 เทียบกับ 39.2% ของ Haiku 5.5 บน Terminal-Bench แสดงความได้เปรียบอย่างต่อเนื่องของโมเดลขนาดใหญ่ในงานเอเจนต์ด้านโค้ด เลือกโมเดลให้เหมาะกับต้นทุนของความล้มเหลวและความยากของเวิร์กโฟลว์จริง
Claude Haiku 5.5 เทียบกับ Haiku 4.5 เทียบกับ Sonnet 5.5
| มิติ | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| บริบท | 200K | 1M | 1M |
| เอาต์พุตมาตรฐานสูงสุด | 64K | 128K | 128K |
| อินพุตมาตรฐาน / MTok | $1 | $0.10 จนถึง 100K; $0.50 เกิน | $2 |
| เอาต์พุตมาตรฐาน / MTok | $5 | $0.50 จนถึง 100K; $2.50 เกิน | $10 |
| การให้เหตุผล | การคิดแบบขยายด้วยงบโทเค็นคงที่ | ปรับได้; ค่าเริ่มต้นระดับกลาง | ปรับได้; ค่าเริ่มต้นระดับสูง |
| ความหน่วงสัมพัทธ์ | เร็ว | เร็วที่สุดในโหมดมาตรฐาน | เร็ว |
| ความลึกด้านโค้ด | งานมีขอบเขต | ซับเอเจนต์ที่แข็งแรงกว่า | โค้ดที่ซับซ้อนยิ่งกว่า |
| การใช้งานทั่วไป | การปรับใช้โมเดลเล็กรุ่นเก่า | เวิร์กโฟลว์ปริมาณสูง | เวิร์กโฟลว์ผลิตจริงที่ซับซ้อน |
สเปคที่ใช้ร่วมกัน: ทั้งสามโมเดลรับอินพุตข้อความและภาพ และให้เอาต์พุตเป็นข้อความ เข้าถึงได้ผ่าน Claude API และแพลตฟอร์มพาร์ทเนอร์ที่รองรับ; ตัวระบุโมเดลและการเข้าถึงบัญชีขึ้นกับผู้ให้บริการ เอกสารผลิตภัณฑ์ที่อ้างอิงไม่ได้ระบุจำนวนพารามิเตอร์หรือสถาปัตยกรรมละเอียด
Haiku 5.5 เป็นตัวเลือกแรกที่สมเหตุสมผลสำหรับงานที่ตรวจสอบได้และทำซ้ำได้ Sonnet 5.5 น่าสนใจกว่าเมื่อการตัดสินที่แม่นยำกว่าช่วยลดการเรียกที่ล้มเหลว การลองเครื่องมือซ้ำ หรือการแก้ไขโดยมนุษย์ Opus 5.5 เป็นตัวเลือกสำหรับงานหลายขั้นที่ต้องการมากเป็นพิเศษ
ป้ายความหน่วงเปรียบเทียบอ้างถึงโหมดความเร็วมาตรฐาน การรับรองความเร็วของ Anthropic ไม่รวม Opus Fast Mode จากการอ้างว่าเป็นโมเดลเร็วที่สุด รายละเอียดสถาปัตยกรรม เช่น จำนวนพารามิเตอร์ ไม่ได้ถูกระบุโดยระดับผลิตภัณฑ์เหล่านี้ อินพุตแบบข้อความและภาพพร้อมเอาต์พุตข้อความแตกต่างจากการสร้างภาพ
การเปรียบเทียบความสามารถอ้างตามสเปคของโมเดลของ Anthropic การเข้าถึงแพลตฟอร์มขึ้นกับผู้ให้บริการและบัญชีที่เลือก; ไม่มีระดับโมเดลใดบ่งชี้จำนวนพารามิเตอร์ที่เผยแพร่แล้ว
การเลือกเวิร์กโหลด
| เวิร์กโหลด | ค่าเริ่มต้นที่ปฏิบัติได้ | เหตุผล |
|---|---|---|
| การจำแนกอีเมล | Haiku 5.5 | การตัดสินสั้นๆ ซ้ำๆ ตรวจสอบได้ |
| การดึงฟิลด์จากเอกสาร | Haiku 5.5 | การประมวลผลเชิงโครงสร้างที่คุ้มต้นทุน |
| การคัดแยกงานซัพพอร์ต | Haiku 5.5 | ตอบสนองเร็วและส่งต่อได้ |
| ซับเอเจนต์ด้านโค้ด | Haiku 5.5 | ค้นหาไฟล์ต้นทุนต่ำและแก้ไขแบบมีขอบเขต |
| ดีบักที่ซับซ้อน | Sonnet 5.5 | ผลลัพธ์เกณฑ์มาตรฐานด้านโค้ดที่ดีกว่า |
| การให้เหตุผลหลายขั้นความเสี่ยงสูง | Opus 5.5 | โมเดลระดับบนที่มีความสามารถสูงกว่า |
| เวิร์กโหลดผสม | Haiku + Sonnet | จัดเส้นทางตามความซับซ้อนและความเชื่อมั่น |
Claude Haiku 5.5 มีค่าใช้จ่ายเท่าไร?
เหตุใด Haiku 5.5 จึงโฆษณาว่า “ถูกลงราว 75%” ทั้งที่ราคาโทเค็นลดลง 90%?
ตัวเลข 90% อธิบายการลดอัตรา Standard ของอินพุตและเอาต์พุตสำหรับพรอมต์ไม่เกิน 100,000 โทเค็น; พรอมต์ที่ยาวกว่านั้นจะได้ลด 50% Anthropic รายงานว่า Haiku 5.5 มีต้นทุนการรันเฉลี่ยลดลงประมาณ 75% โดยคำนึงถึงสัดส่วนความยาวคำขอของรุ่นก่อนและการเปลี่ยนแปลงปริมาณโทเค็นต่อภารกิจ ตัวแบ่งโทเค็นเป็นหนึ่งในปัจจัย: ข้อความเดียวกันอาจถูกนับโทเค็นมากขึ้นประมาณ 30% ดังนั้นควรใช้นับโทเค็นของโมเดลใหม่เมื่อตีราคาต้นทุน
ราคาอย่างเป็นทางการของ Anthropic มีสองช่วงความยาวพรอมต์ ตารางแรกเป็นราคา USD ต่อหนึ่งล้านโทเค็นอย่างเป็นทางการ; การเปรียบเทียบ CometAPI ด้านล่างใช้ส่วนลด 20% กับอัตรา Standard อย่างเป็นทางการของอินพุตและเอาต์พุต
| หมวดอัตรา | พรอมต์ไม่เกิน 100K | พรอมต์เกิน 100K |
|---|---|---|
| อินพุต | $0.10 | $0.50 |
| เอาต์พุต | $0.50 | $2.50 |
| การเขียนแคช 5 นาที | $0.125 | $0.625 |
| การเขียนแคช 1 ชั่วโมง | $0.20 | $1.00 |
| การอ่านแคช | $0.01 | $0.05 |
| อินพุตแบบแบตช์ (ลด 50%) | $0.05 | $0.25 |
| เอาต์พุตแบบแบตช์ (ลด 50%) | $0.25 | $1.25 |
อัตรา Standard อย่างเป็นทางการ แคช และแบตช์ แสดงด้านบน ตรวจสอบล่าสุดวันที่ 8 ตุลาคม 2026 ความยาวพรอมต์เป็นตัวเลือกช่วงราคา; ช่วงที่สูงกว่าจะใช้กับคำขอนั้นทั้งหมด ไม่ใช่เฉพาะโทเค็นที่เกิน 100K อัตรา CometAPI Standard ด้านล่างเท่ากับอัตรา Standard อย่างเป็นทางการที่สอดคลูณด้วย 0.8 การเปรียบเทียบนี้ไม่ถือว่าส่วนลดผ่านเกตเวย์จะซ้อนกับส่วนลดแบตช์หรือแคช
| ความยาวพรอมต์ | ประเภทโทเค็น | มาตรฐานทางการ / MTok | CometAPI / MTok |
|---|---|---|---|
| ไม่เกิน 100K โทเค็น | อินพุต | $0.10 | $0.08 |
| ไม่เกิน 100K โทเค็น | เอาต์พุต | $0.50 | $0.40 |
| เกิน 100K โทเค็น | อินพุต | $0.50 | $0.40 |
| เกิน 100K โทเค็น | เอาต์พุต | $2.50 | $2.00 |
ตัวอย่าง: 100,000 คำขอต่อเดือน
สมมติคำขอแต่ละรายการใช้ 2,000 โทเค็นอินพุต และ 500 โทเค็นเอาต์พุต; แต่ละคำขออยู่ต่ำกว่าเกณฑ์ 100K เพิกเฉยการแคชพรอมต์ เครื่องมือ และการลองซ้ำ และสมมติว่าจำนวนโทเค็นเหมือนกันข้ามโมเดลเพื่อการอธิบาย
| โมเดล / ผู้ให้บริการ | อินพุต/เดือน | เอาต์พุต/เดือน | รวม/เดือน |
|---|---|---|---|
| Haiku 4.5 — Standard ทางการ | $200 | $250 | $450 |
| Haiku 5.5 — Standard ทางการ | $20 | $25 | $45 |
| Sonnet 5.5 — Standard ทางการ | $400 | $500 | $900 |
| Haiku 5.5 — CometAPI | $16 | $20 | $36 |
ในตัวอย่างนี้ 100,000 คำขอใช้ 200 ล้านโทเค็นอินพุต และ 50 ล้านโทเค็นเอาต์พุต ต้นทุนอินพุต CometAPI คือ 200 × $0.08 = $16 และเอาต์พุตคือ 50 × $0.40 = $20 รวม $36 ต่อเดือน เทียบกับ $45 อย่างเป็นทางการ: ประหยัด $9 หรือ 20% สถานการณ์นี้ไม่รวมแคช เครื่องมือ และการลองซ้ำ และใช้จำนวนโทเค็นคงที่; วัดต้นทุนต่อภารกิจที่ยอมรับบนอินพุตตัวแทน เพราะตัวแบ่งโทเค็นรุ่นใหม่เปลี่ยนจำนวนโทเค็น
การเปรียบเทียบ $450 เป็น $45 เป็นตัวอย่างแบบจำนวนโทเค็นคงที่ของการลดอัตรา 90% ไม่ใช่คำสัญญาว่าจะประหยัด 90% สำหรับเวิร์กโหลดจริงที่เทียบเท่า ในประกาศเปิดตัว Anthropic รายงานต้นทุนการรันเฉลี่ยลดลงราว 75% หลังคิดความยาวคำขอและการเปลี่ยนแปลงการใช้โทเค็นแล้ว นับโทเค็นบนอินพุตตัวแทนใหม่และวัดต้นทุนภารกิจที่เสร็จสิ้นก่อนคาดการณ์การประหยัดของคุณ
เข้าถึง Claude Haiku 5.5 ได้ที่ไหน?
การเข้าถึงอย่างเป็นทางการและผ่านคลาวด์
Haiku 5.5 ใช้ได้ผ่าน Claude API และแพลตฟอร์มที่รองรับบน Amazon Web Services, Google Cloud และ Microsoft Azure ตามประกาศความพร้อมใช้งานของ Anthropic ตัวระบุโมเดลของ Claude API โดยตรงคือ claude-haiku-5-5; Amazon Bedrock ใช้ anthropic.claude-haiku-5-5 ใช้ข้อมูลยืนยันตัวตนจากผู้ให้บริการที่คุณเลือกและตรวจสอบเงื่อนไขการเข้าถึงบัญชีล่าสุด
การเข้าถึงผ่านบุคคลที่สามด้วย CometAPI
หน้ารายการโมเดลของ CometAPI แสดงว่า claude-haiku-5-5 พร้อมใช้งาน โดยมีอัตรา Standard เริ่มที่ $0.08 ต่อหนึ่งล้านโทเค็นอินพุต และ $0.40 ต่อหนึ่งล้านโทเค็นเอาต์พุตสำหรับพรอมต์ไม่เกิน 100K ต่ำกว่าอัตราทางการที่สอดคล้องกัน 20% ใช้คีย์ที่ออกโดย CometAPI กับเอ็นด์พอยต์และรูปแบบคำขอของ CometAPI; เส้นทางนี้แยกจากการเข้าถึง Claude API โดยตรง ตรวจสอบหน้าไลฟ์สำหรับความพร้อมใช้งาน ช่วงราคา และรายละเอียดการผสานรวม
เมื่อสลับผู้ให้บริการหรืออัปเกรดจาก Haiku 4.5 ให้ยืนยันตัวระบุโมเดล นับโทเค็นใหม่ และทดสอบขีดจำกัดเอาต์พุตและการจัดการสนทนา สำหรับรายละเอียดการใช้งานและการเปลี่ยนแปลงที่กระทบ ให้ดูคู่มือการย้ายของ Anthropic
การตรวจสอบการย้าย
- อัปเดตตัวระบุโมเดลและตรวจสอบช่องคำขอเฉพาะเอ็นด์พอยต์
- นับโทเค็นใหม่ด้วยตัวแบ่งโทเค็นที่อัปเดต รวมทั้งคำนำถาวรและคำจำกัดความเครื่องมือ
- ทดสอบการตั้งค่าการคิดแบบปรับตัว การกระจายความหน่วง และการแยกบล็อกคำตอบ
- ตรวจสอบการเรียกเครื่องมือ การกู้คืนข้อผิดพลาด และข้อจำกัดบัญชีเกี่ยวกับบล็อกการคิดที่จัดเก็บไว้
- เปรียบเทียบความหน่วง p50/p95 อัตรางานที่ยอมรับ และจำนวนโทเค็นที่ถูกคิดเงินทั้งหมด
- ใช้การเปิดตัวแบบขั้นบันไดและเส้นทางย้อนกลับสำหรับเวิร์กโฟลว์ที่สำคัญต่อธุรกิจ
- ห้ามใช้ Assistant prefill
คู่มือการย้ายของ Haiku 5.5 อธิบายพฤติกรรมของตัวแบ่งโทเค็น ตัวระบุ และความเข้ากันได้ของคำขอ ละเว้น temperature, top_p และ top_k หากระบุอย่างชัดเจน temperature ต้องเป็น 1 และ top_p ต้องเป็น 0.99; ค่าของ top_k ใดๆ หรือการระบุทั้ง temperature และ top_p จะส่งผลเป็นข้อผิดพลาด 400
ข้อจำกัดของ Claude Haiku 5.5 มีอะไรบ้าง?
Haiku 5.5 ไม่ใช่ตัวแทนแทนที่โมเดลขนาดใหญ่สำหรับทุกกรณี การเขียนโค้ดที่ซับซ้อนและการให้เหตุผลระยะยาวยังคงเป็นความแตกต่างที่มีนัยสำคัญของ Sonnet และ Opus พรอมต์ที่ยาวกว่าก็มีค่าใช้จ่ายสูงขึ้น ดังนั้นหน้าต่าง 1M โทเค็นควรใช้ตามความเหมาะสม การให้เหตุผลแบบปรับได้สร้างความแปรปรวนของจำนวนโทเค็นที่สร้างและความหน่วง; เกณฑ์มาตรฐานไม่ใช่การรับประกันสำหรับเวิร์กโฟลว์ธุรกิจเฉพาะ
ระบบอัตโนมัติที่มีความเสี่ยงควรตรวจสอบเอาต์พุตเชิงโครงสร้าง จำกัดสิทธิ์เครื่องมือภายนอก เก็บบันทึกการตรวจสอบ และต้องการการทบทวนก่อนการกระทำที่มีนัยสำคัญ จัดเส้นทางงานที่ไม่แน่ใจไปยังโมเดลที่แข็งแรงกว่า แทนการพึ่งพาเพียงราคาโทเค็นฐานที่ต่ำของ Haiku
บทสรุป
สำหรับการประมวลผลปริมาณมากที่มีเกณฑ์การยอมรับที่วัดผลได้ Claude Haiku 5.5 เป็นการอัปเกรดที่น่าสนใจ: ราคาเริ่มต้นต่ำ หน้าต่างบริบทใหญ่ การให้เหตุผลแบบปรับได้ และผลการประเมินที่แข็งแรงกว่า สำหรับการเขียนโปรแกรมที่ซับซ้อนและการตัดสินที่คลุมเครือ Sonnet 5.5 หรือ Opus 5.5 อาจให้ความคุ้มค่ารวมที่ดีกว่าโดยลดการลองซ้ำและการแก้ไข กลยุทธ์ที่ชนะคือทดสอบกับเวิร์กโฟลว์จริงแบบครบวงจรและจัดเส้นทางตามระดับความยาก
คำถามที่พบบ่อย
เกณฑ์ราคา 100K ของ Haiku 5.5 มีผลอย่างไรกับเวิร์กโฟลว์ที่ใช้แคช?
ความยาวพรอมต์เป็นตัวกำหนดช่วงราคา; อย่าประเมินค่าบริการจากข้อความใหม่เพียงอย่างเดียวหรือคิดว่าเฉพาะโทเค็นส่วนเกินจะใช้อัตราที่สูงกว่า ให้นับคำขอสำหรับโมเดลที่เลือก รวมประวัติและคำจำกัดความเครื่องมือ แล้วกระทบยอดการใช้อินพุต การเขียนแคช การอ่านแคช และเอาต์พุตกับช่วงที่เกี่ยวข้อง เปรียบเทียบใบแจ้งหนี้บนคำขอที่มีการแคชตัวแทนก่อนกำหนดงบประมาณผลิตจริง
บล็อกการคิดของ Haiku 5.5 สามารถนำไปรันซ้ำข้ามบัญชีได้หรือไม่?
ใช้งานได้เฉพาะในบัญชีที่สร้างขึ้นหรือบัญชีที่เชื่อมโยงกับบัญชีนั้น หากบัญชีที่ไม่เกี่ยวข้องส่งบล็อกการคิดที่จัดเก็บไว้ API จะทิ้งก่อนที่โมเดลจะเห็น; คำขอยังอาจสำเร็จได้โดยไม่มีการให้เหตุผลนั้น ดูคู่มือการย้ายอย่างเป็นทางการ เก็บบล็อกการสนทนาและใช้บัญชีต้นทางหรือที่เชื่อมโยงเมื่อดำเนินเวิร์กโฟลว์เครื่องมือต่อ การเปลี่ยนเกตเวย์หรือบัญชีควรทดสอบอย่างชัดเจน; การตรงกันของชื่อโมเดลไม่รับประกันว่าบล็อกการคิดที่เก็บไว้ยังใช้งานได้
ทำไม Haiku 5.5 ถึงตัดทอนคำตอบที่ Haiku 4.5 เคยตอบครบ?
ตัวแบ่งโทเค็นรุ่นใหม่อาจนับโทเค็นมากขึ้นสำหรับข้อความเดียวกัน ดังนั้นขีดจำกัด max_tokens ที่ไม่เปลี่ยนแปลงอาจบรรจุเอาต์พุตเทียบเท่าได้น้อยลง การคิดแบบปรับได้ก็อาจกินงบเอาต์พุต ตรวจสอบ stop_reason และ usage นับพรอมต์ใหม่ด้วยโมเดลใหม่ และปรับงบเอาต์พุตบนงานจริง แทนการคัดลอกขีดจำกัดจากรุ่นเดิม
ควรตั้งเกณฑ์การจัดเส้นทางของ Haiku 5.5 อย่างไร?
ใช้ตัวอย่างที่มีป้ายกำกับจากเวิร์กโหลดจริงเพื่อวัดอัตรางานที่ยอมรับ ต้นทุนการแก้ไข และความหน่วง จัดเส้นทางคำขอที่ไม่ผ่านการตรวจสอบแบบชัดแจ้งหรือเกินขอบเขตงานที่ทดสอบแล้วไปยังโมเดลที่แข็งแรงกว่า ปรับเกณฑ์กับต้นทุนเวิร์กโฟลว์รวม รวมทั้งการลองซ้ำและการยกระดับ และติดตามหลังการเปลี่ยนแปลงพรอมต์ เครื่องมือ หรือ effort
