Claude Opus 5.2 ได้เข้าสู่การทดสอบแบบ Gray ใน Claude Code อย่างเงียบ ๆ ตั้งแต่วันที่ 14 กันยายน 2026 ผู้ใช้รายงานว่ามันทำงานได้ดีกว่า Opus 5 บนเว็บอย่างมีนัยสำคัญ โดยให้การตอบสนองที่เร็วขึ้น เอาต์พุตที่สะอาดขึ้น และความต่อเนื่องที่แข็งแกร่งขึ้นในงานโค้ดระยะยาว
หลักฐานสาธารณะยังอยู่ในช่วงต้น: การสนทนาส่วนใหญ่ย้อนกลับไปยังการทดสอบเริ่มต้นชุดเดียวกันและการเปรียบเทียบแบบเคียงข้างกันในจำนวนจำกัด พฤติกรรมในช่วงทดสอบ Gray มองเห็นได้ แต่ Anthropic ยังไม่เผยแพร่ปลายทางที่เสถียรและเอกสารทางเทคนิคที่นักพัฒนาต้องใช้สำหรับการใช้งานจริง
สถานะ:
การทดสอบแบบ Gray ใน Claude Code
ความพร้อมใช้งานของ API อย่างเป็นทางการ:
ยังไม่ประกาศ
Public API model ID:
ยังไม่ได้เผยแพร่
Public pricing and specifications:
ยังไม่ได้เผยแพร่
ตรวจสอบล่าสุด:
15 กันยายน 2026
Claude Opus 5.2 คืออะไร?
Claude Opus 5.2 คือเช็คพอยต์ Opus รุ่นถัดไปของ Anthropic ที่กำลังปรากฏผ่านการกำหนดเส้นทางแบบเลือกสรรใน Claude Code คำขอบางส่วนที่ส่งไปยัง “Opus 5” ใน Claude Code ถูกส่งไปยังเส้นทาง 5.2 ใหม่ ขณะที่ Claude บนเว็บและสภาพแวดล้อมของบุคคลที่สามบางแห่งยังให้บริการโมเดล Opus 5 ที่มีอยู่ นั่นอธิบายได้ว่าทำไม UI จึงอาจแสดงชื่อโมเดลเดียวกัน ขณะที่ผลลัพธ์ดูแตกต่างอย่างมาก
เนื่องจากการทดสอบ Gray เปลี่ยนเส้นทางทราฟฟิกแบบเลือกสรร ไม่ใช่ทุกบัญชีหรือเซสชันที่จะได้รับโมเดลเดียวกัน ความแตกต่างยังสามารถถูกขยายโดยพรอมต์ระบบ การกำหนดค่าทูล และการตั้งค่าความพยายามในการให้เหตุผล ดังนั้นสัญญาณที่มีประโยชน์ที่สุดจึงเป็นการผสมผสานของข้อมูลเส้นทางและการเปลี่ยนแปลงพฤติกรรมที่ทำซ้ำได้:
- การสร้างผลลัพธ์เร็วขึ้นภายใต้เส้นทาง Claude Code;
- การใช้งานครั้งแรกที่สะอาดและสมบูรณ์ยิ่งขึ้น;
- ทำงานอัตโนมัติได้นานขึ้นโดยไม่ต้องมีพรอมต์ “continue” ซ้ำ ๆ; และ
- วนรอบการแก้ไขและทดสอบซ้ำในการทำงานด้านโค้ด
สลัก (slug) 5.2 และสัญญาณการกำหนดเส้นทาง
ผู้ทดสอบบางรายรายงานว่าป้ายที่มองเห็นได้ของ Claude Code ยังคงเป็น “Opus 5” ขณะที่มุมมองสถานะหรือสลักของคำขอชี้ไปที่ 5.2
นี่จะเป็นหลักฐานที่แข็งแกร่งกว่ามาก หากการตอบกลับดิบ บันทึกคำขอ หรือเอาต์พุต /status ที่ทำซ้ำได้แสดงตัวระบุและสามารถตรวจสอบได้อย่างอิสระ ปัจจุบันโพสต์สาธารณะส่วนใหญ่เพียงทำซ้ำคำกล่าวอ้างนั้น สิ่งประดิษฐ์ต้นทางยังไม่ได้รับการตรวจสอบความถูกต้อง
คุณสมบัติหลักที่เห็นในช่วงทดสอบ Gray ของ Claude Opus 5.2
ผู้ทดสอบช่วงแรกมุ่งเน้นที่พฤติกรรมมากกว่าสเปกอย่างเป็นทางการอย่างสม่ำเสมอ
ตอบสนองเร็วขึ้น
โมเดลตามเส้นทางนี้เร็วกว่าประสบการณ์ Opus 5 ที่มีเอกสารระบุไว้ตามการทดสอบของผู้ใช้ช่วงแรก ค่าหน่วงท้ายสุดยังจำเป็นต้องวัดเมื่อมีการเข้าถึง API สาธารณะ เพราะการตั้งค่าความพยายาม ภาระระบบ และโครงสร้างพื้นฐานการกำหนดเส้นทางก็ส่งผลต่อความเร็วเช่นกัน
เอาต์พุตสะอาดและสมบูรณ์ยิ่งขึ้น
การเปรียบเทียบจากชุมชนระบุว่าเส้นทางใหม่ผลิต SVG ที่ขัดเกลามากขึ้นและการใช้งานที่สมบูรณ์ขึ้นจากพรอมต์เดียว ในการทดสอบโค้ดแบบเล่าต่อกัน รายงานว่าต้องการการถามตอบน้อยลงเพื่อให้ได้ผลลัพธ์ที่ใช้งานได้
พฤติกรรมที่ “ขี้เกียจ” น้อยลง
ผู้ทดสอบหลายคนระบุว่าโมเดลมีแนวโน้มลดลงที่จะส่งเพียงโครงร่าง ขอให้ผู้ใช้ดำเนินการต่อ หรือหยุดก่อนจบงานที่ซับซ้อน แทนที่จะเป็นเช่นนั้น มีรายงานว่ามันทำงานผ่านลำดับที่ยาวขึ้นและทำรอบเพิ่มบนเอาต์พุตของตัวเอง
วนลูปการเขียนโค้ดแบบอัตโนมัติที่ยาวขึ้น
ข้อสังเกตที่ถูกกล่าวถึงอย่างแพร่หลายอย่างหนึ่งคือโมเดลเริ่ม “gauntlet loop”: มันทดสอบ แก้ไข และปรับปรุงโค้ดต่อเนื่องโดยไม่ต้องการคำสั่งซ้ำ หากทำซ้ำได้ สิ่งนี้จะเกี่ยวข้องอย่างยิ่งกับเอเยนต์การเขียนโค้ดระดับรีโพซิทอรีและงานซอฟต์แวร์ระยะยาว
ความรู้ใหม่ล่าสุดมากขึ้น
ผู้ใช้บางคนเสนอ “การทดสอบ Tibo”: โดยปิดการค้นเว็บ ถามโมเดลว่ารู้จัก “Tibo, the reset guy” หรือไม่ เอกสาร Opus 5 ที่มีอยู่ระบุขอบเขตความรู้ที่เชื่อถือได้ ณ พฤษภาคม 2026 ดังนั้นความรู้เกี่ยวกับการอ้างอิงออนไลน์ที่เกิดขึ้นภายหลังอาจบ่งชี้เช็คพอยต์ที่ใหม่กว่า
การทดสอบนี้ไม่สามารถระบุรุ่นของโมเดลได้ด้วยตัวเอง คำตอบที่ถูกต้องอาจมาจากการค้นคืนที่ซ่อนอยู่ หน่วยความจำการสนทนา พรอมต์ระบบ หรือแหล่งบริบทอื่น เป็นการหยั่งความรู้—ไม่ใช่หลักฐานชื่อ “Opus 5.2”
ผลการทดสอบมาตรฐานของ Claude Opus 5.2
ยังไม่มีผลทดสอบมาตรฐานของ Claude Opus 5.2 ที่ได้รับการยืนยัน เนื่องจาก Anthropic ยังไม่เผยแพร่ system card หรือ ตารางการประเมิน
คะแนน 62.8% บน CoBench v2 ที่ถูกรายงานนั้นเป็นของโมเดลภายในของ Anthropic แยกต่างหากที่รู้จักกันในชื่อ “Model 2” ซึ่งมีรายงานว่าทำคะแนนเหนือ Mythos 5 อยู่ 12.5 คะแนน และถูกใช้อย่างแพร่หลายสำหรับการเขียนโค้ดภายใน ยังมีการพูดคุยเกี่ยวกับระบบ RSI ที่มีความสามารถมากยิ่งขึ้น
Claude Opus 5.2 เทียบกับ Claude Opus 5 เทียบกับ Claude Fable 5.1
ทั้งสามโมเดลมุ่งเป้าต่อความต้องการที่ใกล้เคียงกันแต่แตกต่างกัน Opus 5 เป็นค่าเริ่มต้นต้นทุนต่ำของ Anthropic สำหรับการเขียนโค้ดที่ซับซ้อนและงานระดับองค์กร Fable 5.1 เป็นตัวเลือกระดับไฮเอนด์ที่เป็นที่ยอมรับสำหรับงานให้เหตุผลที่ยากที่สุดและเอเยนต์ระยะยาว Opus 5.2 เป็นเส้นทางทดสอบ Gray ใหม่ที่ดูเหมือนจะผลัก Opus เข้าใกล้—หรืออาจไกลเกิน—แนวหน้าเหล่านั้น พร้อมทั้งปรับปรุงความเร็วและความต่อเนื่องที่ผู้ใช้สัมผัสใน Claude Code
| หมวดหมู่ | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| สถานะปัจจุบัน | การทดสอบแบบ Gray ใน Claude Code | เปิดให้ใช้งานสาธารณะ | เปิดให้ใช้งานสาธารณะ |
| Cometapi ID | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| เหมาะที่สุดสำหรับ | การโค้ดแบบเอเยนต์ยุคถัดไป การวนทำอัตโนมัติ เอาต์พุตแบบ one-shot ที่ขัดเกลา | งานโค้ดซับซ้อนทั่วไปและภาระงานระดับองค์กรด้วยต้นทุนที่สมดุล | การให้เหตุผลที่ยากที่สุด งานวิจัย และงานเอเยนต์ระยะยาว |
| พฤติกรรมที่สังเกตได้ | เร็วกว่า สะอาดกว่า ตั้งใจวนทำและจบงานยาวได้มากขึ้น | มีความสามารถและประหยัด แต่ผู้ใช้รายงานว่าช้ากว่าหรือไม่คงเส้นคงวาบางงานยาว | ผลลัพธ์ที่เผยแพร่ของ Claude แข็งแกร่งที่สุดบนเบนช์มาร์กวิจัย/เอเยนต์ที่ต้องการสูง; อาจยืดยาว |
| หน้าต่างบริบท | ยังไม่ได้เผยแพร่ | 1M โทเคน | 1M โทเคน |
| เอาต์พุตสูงสุด | ยังไม่ได้เผยแพร่ | 128K โทเคน | 128K โทเคน |
| ขอบเขตความรู้ที่เชื่อถือได้ | สังเกตเห็นความรู้ที่ใหม่กว่าในการทดสอบ; ยังไม่เผยแพร่วันที่ | พฤษภาคม 2026 | มิถุนายน 2026 |
| ราคาทางการสำหรับอินพุต/เอาต์พุต | ยังไม่ได้เผยแพร่ | $5 / $25 ต่อ MTok | $10 / $50 ต่อ MTok |
| ดัชนีความฉลาดของ AA โดยอิสระ | ยังไม่ได้ทดสอบ | 51 | 53 |
| ความเร็วเอาต์พุตที่สังเกตโดยอิสระ | ยังไม่ได้ทดสอบ | 51.7 โทเคน/วินาที | 65.1 โทเคน/วินาที |
ตัวเลขอิสระข้างต้นมาจาก Artificial Analysis ที่ตัวแปร adaptive-reasoning ที่ทดสอบไว้ พวกมันแสดงว่า Fable 5.1 นำ Opus 5 อยู่สองคะแนนบน Intelligence Index และสร้างเอาต์พุตได้เร็วกว่าประมาณ 26% ในการกำหนดค่าที่วัด แต่ราคาป้ายสูงเป็นสองเท่า ผลเหล่านี้ยังไม่รวม Opus 5.2 เนื่องจากเส้นทางทดสอบ Gray ยังไม่เปิดปลายทางสาธารณะที่เสถียรสำหรับการทดสอบอิสระ
Opus 5.2 เปลี่ยนการเปรียบเทียบเชิงปฏิบัติ เซสชัน Claude Code ช่วงแรกบ่งชี้ว่าโมเดลตอบสนองเร็วกว่า Opus 5 ให้การออกแบบที่สมบูรณ์ยิ่งขึ้นจากพรอมต์เดียวกัน และทดสอบปรับแต่งโค้ดต่อโดยไม่ต้องเร่ง เมื่อมี API สาธารณะ สิ่งสำคัญที่สุดคือดูว่าการปรับปรุงเหล่านั้นเอาชนะ Fable 5.1 บนเบนช์มาร์กเอเยนต์แบบควบคุมได้หรือไม่—และในราคาเท่าใด
Claude Opus 5.2 เหมาะกับอะไรที่สุด
จากพฤติกรรมที่เห็นแล้วในช่วงทดสอบ Gray Claude Opus 5.2 มีแนวโน้มที่โดดเด่นสำหรับ:
- การเขียนโค้ดระดับรีโพซิทอรีและการปรับปรุงโค้ดเบส
- เอเยนต์ระยะยาวที่วางแผน ดำเนินการ ทดสอบ และแก้ไขหลายขั้นตอน
- การดีบักที่ซับซ้อนและวงจร QA อัตโนมัติ
- การสร้างอินเทอร์เฟซ SVG และอาร์ติแฟกต์เชิงโครงสร้างคุณภาพสูง
- การวิจัยและวิเคราะห์ที่ต้องใช้สมาธิอย่างต่อเนื่องในบริบทขนาดใหญ่
- เวิร์กโฟลว์ระดับองค์กรที่คุณภาพการทำเสร็จงานสำคัญกว่าต้นทุนขั้นต่ำ
สำหรับการนำไปใช้จริงในวันนี้ ทีมงานควรใช้ปลายทางสาธารณะที่เสถียรต่อไปและทำให้เลเยอร์โมเดลสามารถสลับได้ จนกว่า API และข้อกำหนดการให้บริการของ Opus 5.2 จะถูกเผยแพร่
CometAPI ให้การเข้าถึง API ของ Claude Opus 5.2 อย่างไร?
เมื่อ Claude Opus 5.2 พร้อมใช้อย่างเป็นทางการผ่าน CometAPI นักพัฒนาจะสามารถใช้เวิร์กโฟลว์ API แบบรวมเดียวกันที่ใช้กับโมเดล Anthropic อื่น ๆ ที่รองรับ:
- สร้างบัญชี CometAPI และสร้างคีย์ API
- เติมเครดิตในบัญชีหรือเลือกตัวเลือกการเรียกเก็บเงินที่เหมาะสม
- ตรวจสอบแค็ตตาล็อกโมเดลของ CometAPI เพื่อดู Model ID และราคาอย่างเป็นทางการ
- ส่งคำขอผ่าน Anthropic Messages ที่รองรับหรือปลายทางแชทที่เข้ากันได้
- ตรวจสอบคุณภาพเอาต์พุต ความหน่วง และต้นทุนด้วยภาระงานทดสอบขนาดเล็กก่อนใช้งานจริง
ในระหว่างนี้ CometAPI รองรับโมเดล Fable 5.1 รุ่นล่าสุดของ Claude แล้ว นักพัฒนาสามารถเข้าถึงโมเดลของ Claude โดยใช้รูปแบบคำขอ API ดั้งเดิมของ Claude ทำให้ทดสอบโมเดลปัจจุบันและย้ายไปยัง Opus 5.2 หลังเปิดตัวได้ง่าย
ทำไมจึงเลือก CometAPI สำหรับ Claude Opus 5.2?
เมื่อโมเดลได้รับการสนับสนุนอย่างเป็นทางการ CometAPI สามารถลดงานปฏิบัติการที่ต้องใช้ในการเพิ่มโมเดลนี้ลงในสแต็ก AI ที่มีอยู่ บัญชีและเลเยอร์ API แบบรวมช่วยให้ทีมประเมินผู้ให้บริการโมเดลหลายรายได้ โดยไม่ต้องดูแลการผสานรวมและความสัมพันธ์การเรียกเก็บเงินแยกต่างหากสำหรับทุกโมเดล
ข้อดีที่อาจเกิดขึ้น ได้แก่:
- คีย์ API เดียวและเวิร์กโฟลว์การเรียกเก็บเงินสำหรับแค็ตตาล็อกโมเดลกว้าง
- การทดสอบแบบเคียงข้างกันเร็วขึ้นกับโมเดลการโค้ดและการให้เหตุผลทางเลือก
- รูปแบบการผสานรวมสม่ำเสมอเมื่อเวอร์ชันโมเดลเปลี่ยน
- การเข้าถึงแบบคิดตามการใช้งานโดยไม่ต้องออกแบบแอปพลิเคชันใหม่รอบผู้ให้บริการรายเดียว
- เอกสารรวมศูนย์และการค้นพบโมเดล
ข้อมูลราคา ความพร้อมใช้งาน อัตราการประมวลผล และส่วนลดของ Opus 5.2 ที่แท้จริงควรระบุหลังจากโมเดลปรากฏในแค็ตตาล็อกสดของ CometAPI เท่านั้น