ข้อกำหนดทางเทคนิคของ Grok 4.6
| รายการ | Grok 4.6 |
|---|---|
| ผู้ให้บริการ | xAI |
| รหัสโมเดล | grok-4.6 |
| ประเภทโมเดล | โมเดลแนวหน้าสำหรับการให้เหตุผลแบบมัลติโหมดและเชิงตัวแทน |
| จุดเด่นหลัก | เอเจนต์ที่ทำงานต่อเนื่องยาวนาน, การเขียนโค้ด, งานเชิงความรู้, การสร้างแอปเชิงโต้ตอบ/เชิงภาพ |
| รูปแบบอินพุต | ข้อความและรูปภาพ |
| รูปแบบเอาต์พุต | ข้อความ |
| หน้าต่างบริบท | 500,000 โทเค็น |
| ขอบเขตความรู้ | 1 กุมภาพันธ์ 2026 |
| ขีดจำกัดเอาต์พุต | xAI ไม่ได้เผยแพร่ขีดจำกัดเอาต์พุตข้อความ |
| การให้เหตุผล | low, medium, high (ค่าเริ่มต้น), xhigh |
| API | Responses API, Chat Completions |
| เครื่องมือ | การเรียกใช้ฟังก์ชัน, การค้นหาเว็บ, X search, การรันโค้ด |
| ราคา API | $2 / 1M โทเค็นอินพุต; $6 / 1M โทเค็นเอาต์พุต |
| รุ่นแบบเร็ว | มีให้ใช้ในราคา 2× ของราคามาตรฐาน |
| เปิดตัว | 12 สิงหาคม 2026 |
Grok 4.6 คืออะไร?
Grok 4.6 เป็นโมเดลแนวหน้ารุ่นใหม่ล่าสุดของ xAI ที่มุ่งเน้นไปที่ปัญญาเชิงตัวแทน (agentic intelligence)
ความแตกต่างจากแชตบอทแบบดั้งเดิมนั้นสำคัญ
xAI เน้นย้ำความสามารถของโมเดลในการอยู่กับโครงการที่ซับซ้อนได้ยาวนานขึ้น ทำงานข้ามฐานโค้ด ค้นคว้าหัวข้อที่ไม่คุ้นเคย สร้างแอปพลิเคชัน และตรวจสอบงานของตนเอง
สิ่งนี้ทำให้ Grok 4.6 เกี่ยวข้องเป็นพิเศษกับตลาดเอเจนต์การเขียนโค้ดด้วย AI และเอเจนต์อัตโนมัติที่กำลังเติบโตอย่างรวดเร็ว
คุณสมบัติหลักของ Grok 4.6
- การทำงานของเอเจนต์แบบยาวต่อเนื่อง: Grok 4.6 ผ่านการฝึกให้คงไว้ซึ่งงานที่ซับซ้อนหลายขั้นตอน แทนที่จะปรับให้เหมาะสมเฉพาะคำตอบแบบครั้งเดียว
- การเขียนโค้ดเชิงตัวแทน: มุ่งเป้าไปที่วิศวกรรมซอฟต์แวร์ระดับรีโพซิทอรี การสร้างโค้ด การดีบัก การทดสอบแบบวนซ้ำ และสภาพแวดล้อมการเขียนโค้ดเฉพาะโดเมน
- การวิจัยงานเชิงความรู้: โมเดลสามารถค้นคว้าโดเมนที่ไม่คุ้นเคย จัดระเบียบข้อมูล ใช้เหตุผลผ่านข้อกำหนดที่ซับซ้อน และเปลี่ยนผลการค้นพบให้เป็นชิ้นงานที่เป็นรูปธรรม
- การสร้างแอปเชิงภาพและโต้ตอบ: xAI รายงานผลครั้งแรกที่แข็งแรงขึ้นสำหรับโครงการเชิงภาพและเชิงโต้ตอบ รวมถึงการเปลี่ยนไอเดียผลิตภัณฑ์ให้เป็นแอปที่ใช้งานได้ และปรับแต่งผ่านวงรอบข้อเสนอแนะ
- การทดสอบและการตรวจสอบด้วยตนเอง: ในเส้นทางการทำงานที่ยาวขึ้น xAI สังเกตพฤติกรรมที่โมเดลตรวจงานของตนเองก่อนทำต่อมากขึ้น
- การใช้เครื่องมือแบบเนทีฟ: Grok 4.6 รองรับการเรียกใช้ฟังก์ชัน การค้นหาเว็บ X search และการรันโค้ดผ่าน API
- การให้เหตุผลที่ปรับตั้งได้: นักพัฒนาสามารถเลือกความพยายามในการให้เหตุผลแบบ
lowmediumhighหรือxhighทำให้โมเดลปรับให้เข้ากับภาระงานที่ไวต่อเวลาแฝงและงานที่ต้องการการให้เหตุผลเชิงลึก
ประสิทธิภาพบนเบนช์มาร์กของ Grok 4.6
xAI รายงานว่า Grok 4.6 เทียบเท่า GPT-5.6 Sol บน Artificial Analysis Intelligence Index ซึ่งเป็นองค์รวมของเก้าเบนช์มาร์ก ผลลัพธ์ที่เด่นที่สุดที่เผยแพร่รวมถึง:
| เบนช์มาร์ก | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
ตัวเลขเหล่านี้มาจากประกาศเปิดตัวของ xAI เมื่อวันที่ 12 สิงหาคม โดย xAI ระบุว่าตัวเลขจากบุคคลที่สามนำมาจาก system card ของนักพัฒนาหรือกระดานจัดอันดับเบนช์มาร์กสาธารณะ ดังนั้นผลการเปรียบเทียบข้ามโมเดลจึงควรตีความโดยคำนึงถึงระเบียบวิธีการประเมินและการตั้งค่าโมเดล
Grok 4.6 เทียบกับ Grok 4.5 เทียบกับ GPT-5.6 Sol เทียบกับ Claude Fable 5
| โมเดล | การวางตำแหน่งหลัก | บริบท | AA Intelligence | โปรไฟล์การเขียนโค้ด/เอเจนต์ |
|---|---|---|---|---|
| Grok 4.6 | เอเจนต์แบบทำงานยาวต่อเนื่อง, การเขียนโค้ด, งานเชิงความรู้ | 500K | 61 | โดดเด่นด้านการเขียนโค้ดเชิงตัวแทนและเวิร์กโฟลว์โครงการแบบโต้ตอบ |
| Grok 4.5 | โมเดลแนวหน้าทั่วไปที่รวดเร็วและเน้นการเขียนโค้ด | 500K | 56 | เป็นฐานมาตรฐานที่แข็งแรงสำหรับงานเขียนโค้ดและเวิร์กโฟลว์ของเอเจนต์ |
| GPT-5.6 Sol | การให้เหตุผลทั่วไปแนวหน้าและงานเชิงตัวแทน | บริบทของคู่แข่งที่เผยแพร่แตกต่างกันไปตามการปรับใช้ | 61 | ผลลัพธ์ DeepSWE และ Terminal-Bench แข็งแกร่ง |
| Claude Fable 5 | งานเชิงความรู้แนวหน้าและการเขียนโค้ด | บริบทของคู่แข่งที่เผยแพร่แตกต่างกันไปตามการปรับใช้ | 62 | CursorBench, FrontierCode, APEX-SWE แข็งแกร่งมาก |
Grok 4.6 น่าสนใจที่สุดเมื่อภาระงานต้องการการทำงานต่อเนื่องยาวนาน แทนการตอบครั้งเดียวที่มีคุณภาพสูง โดยเฉพาะอย่างยิ่งสำหรับนักพัฒนาที่สร้างเอเจนต์ซึ่งทำการค้นคว้าซ้ำๆ เรียกใช้เครื่องมือ แก้ไขโค้ด ทดสอบผลลัพธ์ และทำต่อจากบริบทที่สะสมไว้ Claude Fable 5 ยังคงได้เปรียบในเบนช์มาร์กการเขียนโค้ดและเอเจนต์หลายรายการที่เผยแพร่ ขณะที่ GPT-5.6 Sol นำหน้า Grok 4.6 บน DeepSWE และ Terminal-Bench ตามการเปรียบเทียบของ xAI
ข้อจำกัดและข้อพิจารณา
- ผลลัพธ์เบนช์มาร์กขึ้นอยู่กับงาน: Grok 4.6 ไม่ใช่โมเดลที่ทำคะแนนสูงที่สุดอย่างสม่ำเสมอ ผลลัพธ์ที่เผยแพร่แสดงจุดแข็งและจุดอ่อนที่ชัดเจนในแต่ละการประเมินเชิงเอเจนต์
- ภาระงานระยะยาวอาจใช้โทเค็นจำนวนมาก: หน้าต่างบริบทขนาดใหญ่และการใช้เครื่องมือแบบวนซ้ำสามารถเพิ่มการใช้โทเค็นทั้งหมดได้ แม้ว่าราคาต่อโทเค็นจะแข่งขันได้
- การตั้งค่าเครื่องมือมีความสำคัญ: การค้นหาเว็บ, X search, การรันโค้ด และการเรียกใช้ฟังก์ชัน ต้องการสถาปัตยกรรมแอปพลิเคชันที่จัดการสิทธิ์เครื่องมือและข้อมูลที่ส่งกลับได้อย่างปลอดภัย
- ขอบเขตความรู้: ขอบเขตความรู้ล่าสุดที่บันทึกไว้คือ 1 กุมภาพันธ์ 2026 สำหรับข้อมูลใหม่กว่านี้ นักพัฒนาควรใช้เครื่องมือค้นคืนข้อมูลหรือค้นเว็บที่เหมาะสม แทนที่จะพึ่งพาความรู้คงที่ของโมเดล
- การแคชต้องมีการตั้งค่าอย่างเจตนา: xAI แนะนำ
prompt_cache_keyสำหรับ Responses API และx-grok-conv-idสำหรับ Chat Completions เพื่อปรับปรุงความน่าเชื่อถือของการถูกแคช
กรณีการใช้งานของ Grok 4.6
- เอเจนต์การเขียนโค้ดแบบอัตโนมัติ — การวิเคราะห์รีโพซิทอรี การนำไปใช้ การดีบัก การทดสอบ และการแก้ไขแบบวนรอบ
- การสร้างต้นแบบผลิตภัณฑ์ — เปลี่ยนข้อกำหนดผลิตภัณฑ์ภาพรวมให้เป็นแอปเชิงโต้ตอบที่ใช้งานได้จริง
- เอเจนต์วิจัยเชิงเทคนิค — ค้นคว้าโดเมนเทคนิคที่ไม่คุ้นเคยและผลิตชิ้นงานที่มีโครงสร้าง
- ผู้ช่วยนักพัฒนา — การสร้างโค้ด การรีวิว การดีบัก และเวิร์กโฟลว์การพัฒนาหลายขั้นตอน
- ระบบอัตโนมัติสำหรับงานเชิงความรู้ — การวิเคราะห์เอกสาร สังเคราะห์ข้อมูล การวางแผน และการสร้างเอาต์พุตแบบมีโครงสร้าง
- ผู้ช่วยที่ใช้เครื่องมือ — แอปที่ผสานการให้เหตุผลของโมเดลกับการค้นหาเว็บ, X search, การรันโค้ด และการเรียกใช้ฟังก์ชันแบบกำหนดเอง
วิธีเข้าถึง API ของ Grok 4.6
สำหรับแอปพลิเคชันที่ใช้งานเลเยอร์ API แบบรวมของ CometAPI อยู่แล้ว ให้ใช้รหัสโมเดล Grok 4.6 ที่เผยผ่าน CometAPI และปฏิบัติตามเอนด์พอยต์/สคีมาปัจจุบันในเอกสาร CometAPI วิธีนี้ช่วยลดงานบูรณาการเฉพาะผู้ให้บริการเมื่อแอปต้องสลับระหว่าง LLM แนวหน้า
เวิร์กโฟลว์ทั่วไปมีดังนี้:
- สร้างหรือลงชื่อเข้าใช้บัญชี CometAPI
- สร้างโทเค็น API ในคอนโซลของ CometAPI
- เลือกเอนด์พอยต์โมเดล
grok-4.6 - ส่งคำขอผ่านเอนด์พอยต์ของ CometAPI โดยใช้สคีมาคำขอตามที่เอกสารของโมเดลระบุ
- ประมวลผลข้อความที่ส่งกลับ การเรียกใช้เครื่องมือ หรือเอาต์พุตแบบมีโครงสร้างในแอปพลิเคชันของคุณ