ข้อมูลจำเพาะทางเทคนิคของ Grok 4.6
| รายการ | Grok 4.6 |
|---|---|
| ผู้ให้บริการ | xAI |
| รหัสโมเดล | grok-4.6 |
| ประเภทโมเดล | โมเดลให้เหตุผลแบบหลายโมดัลระดับแนวหน้าและเชิงเอเจนต์ |
| จุดเด่นหลัก | เอเจนต์ทำงานยาวนาน, การเขียนโค้ด, งานด้านความรู้, การสร้างแอปแบบโต้ตอบ/เชิงภาพ |
| รูปแบบอินพุต | ข้อความและรูปภาพ |
| รูปแบบเอาต์พุต | ข้อความ |
| หน้าต่างบริบท | 500,000 โทเคน |
| วันตัดความรู้ | 1 กุมภาพันธ์ 2026 |
| ขีดจำกัดเอาต์พุต | ไม่มีขีดจำกัดเอาต์พุตข้อความที่ xAI เผยแพร่ |
| การให้เหตุผล | ต่ำ, กลาง, สูง (ค่าเริ่มต้น), xhigh |
| API | Responses API, Chat Completions |
| เครื่องมือ | การเรียกใช้ฟังก์ชัน, การค้นหาเว็บ, X search, การรันโค้ด |
| ราคา API | $2 / 1M โทเคนอินพุต; $6 / 1M โทเคนเอาต์พุต |
| รุ่นเร็ว | ใช้ได้ในราคา 2× ของแบบมาตรฐาน |
| เปิดตัว | 12 สิงหาคม 2026 |
Grok 4.6 คืออะไร?
Grok 4.6 เป็นโมเดลแนวหน้ารุ่นใหม่ล่าสุดของ xAI ที่มุ่งเน้นด้าน ปัญญาเชิงเอเจนต์.
ความแตกต่างจากแชตบอทแบบดั้งเดิมนั้นสำคัญ
xAI เน้นย้ำความสามารถของโมเดลในการอยู่กับโครงการที่ซับซ้อนได้ยาวนาน ทำงานข้ามโค้ดเบส วิจัยหัวข้อที่ไม่คุ้นเคย สร้างแอปพลิเคชัน และตรวจสอบงานของตนเอง
สิ่งนี้ทำให้ Grok 4.6 เหมาะอย่างยิ่งกับตลาด AI coding-agent และ autonomous-agent ที่ขยายตัวอย่างรวดเร็ว
คุณสมบัติหลักของ Grok 4.6
- การรันเอเจนต์ระยะยาว: Grok 4.6 ได้รับการฝึกให้คงงานที่ซับซ้อนผ่านหลายขั้นตอน แทนที่จะปรับให้เหมาะกับคำตอบแบบครั้งเดียว
- การเขียนโค้ดเชิงเอเจนต์: มุ่งเป้าไปที่วิศวกรรมซอฟต์แวร์ระดับรีโพซิทอรี การสร้างโค้ด การดีบัก การทดสอบแบบวนรอบ และสภาพแวดล้อมการเขียนโค้ดเฉพาะโดเมน
- การวิจัยงานด้านความรู้: โมเดลสามารถวิจัยโดเมนที่ไม่คุ้นเคย จัดระเบียบข้อมูล ให้เหตุผลตามข้อกำหนดที่ซับซ้อน และแปลงผลลัพธ์เป็นชิ้นงานที่จับต้องได้
- การสร้างแอปเชิงภาพและแบบโต้ตอบ: xAI รายงานว่าผลลัพธ์ครั้งแรกดีขึ้นสำหรับโปรเจกต์เชิงภาพและแบบโต้ตอบ รวมถึงการเปลี่ยนไอเดียผลิตภัณฑ์ให้เป็นแอปที่ใช้งานได้ และปรับแต่งผ่านวงจรข้อเสนอแนะ
- การทดสอบและการตรวจสอบตนเอง: ในเส้นทางงานที่ยาวขึ้น xAI สังเกตเห็นพฤติกรรมมากขึ้นที่โมเดลตรวจเช็คงานของตนเองก่อนดำเนินการต่อ
- การใช้เครื่องมือแบบเนทีฟ: Grok 4.6 รองรับการเรียกใช้ฟังก์ชัน การค้นหาเว็บ X search และการรันโค้ดผ่าน API
- การให้เหตุผลที่ปรับได้: นักพัฒนาสามารถเลือกความพยายามในการให้เหตุผลแบบ
low,medium,highหรือxhighทำให้โมเดลปรับเข้ากับงานที่ไวต่อความหน่วงและการให้เหตุผลเชิงลึกได้
ผลการทดสอบมาตรฐานของ Grok 4.6
xAI รายงานว่า Grok 4.6 ทำได้เทียบเท่า GPT-5.6 Sol บนดัชนี Artificial Analysis Intelligence ซึ่งเป็นการรวบรวมเก้ามาตรฐาน ผลลัพธ์ที่โดดเด่นที่สุดที่เผยแพร่รวมถึง:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
ตัวเลขเหล่านี้มาจากประกาศเปิดตัวของ xAI เมื่อวันที่ 12 สิงหาคม xAI ระบุว่าตัวเลขจากบุคคลที่สามนำมาจากการ์ดระบบของนักพัฒนาหรือกระดานจัดอันดับเกณฑ์มาตรฐานสาธารณะ ดังนั้นผลลัพธ์ข้ามโมเดลควรถูกตีความโดยคำนึงถึงระเบียบวิธีการประเมินและการตั้งค่าโมเดล
Grok 4.6 เทียบกับ Grok 4.5 เทียบกับ GPT-5.6 Sol เทียบกับ Claude Fable 5
| โมเดล | การวางตำแหน่งหลัก | บริบท | AA Intelligence | โปรไฟล์การเขียนโค้ด/เชิงเอเจนต์ |
|---|---|---|---|---|
| Grok 4.6 | เอเจนต์ทำงานยาวนาน การเขียนโค้ด งานความรู้ | 500K | 61 | การเขียนโค้ดเชิงเอเจนต์และเวิร์กโฟลว์โปรเจกต์แบบโต้ตอบที่แข็งแกร่ง |
| Grok 4.5 | โมเดลแนวหน้าทั่วไปและการเขียนโค้ดที่รวดเร็ว | 500K | 56 | ฐานที่แข็งแรงสำหรับเวิร์กโฟลว์การเขียนโค้ดและเอเจนต์ |
| GPT-5.6 Sol | การให้เหตุผลทั่วไประดับแนวหน้าและงานเชิงเอเจนต์ | บริบทของคู่แข่งที่เผยแพร่แตกต่างกันไปตามการปรับใช้ | 61 | ผลลัพธ์ DeepSWE และ Terminal-Bench ที่แข็งแกร่ง |
| Claude Fable 5 | งานความรู้และการเขียนโค้ดระดับแนวหน้า | บริบทของคู่แข่งที่เผยแพร่แตกต่างกันไปตามการปรับใช้ | 62 | CursorBench, FrontierCode, APEX-SWE แข็งแกร่งมาก |
Grok 4.6 น่าดึงดูดที่สุดเมื่อภาระงานต้องการการดำเนินการอย่างต่อเนื่องมากกว่าคำตอบคุณภาพสูงเพียงครั้งเดียว โดยเฉพาะอย่างยิ่งเหมาะสำหรับนักพัฒนาที่สร้างเอเจนต์ซึ่งวิจัยซ้ำๆ เรียกใช้เครื่องมือ แก้ไขโค้ด ทดสอบผลลัพธ์ และดำเนินการต่อจากบริบทที่สะสมไว้ Claude Fable 5 ยังได้เปรียบในเกณฑ์มาตรฐานด้านการเขียนโค้ดและเอเจนต์หลายรายการที่เผยแพร่ ขณะที่ GPT-5.6 Sol นำหน้า Grok 4.6 บน DeepSWE และ Terminal-Bench ตามการเปรียบเทียบของ xAI
ข้อจำกัดและข้อพิจารณา
- ผลลัพธ์เกณฑ์มาตรฐานขึ้นอยู่กับงาน: Grok 4.6 ไม่ใช่โมเดลที่ได้คะแนนสูงสุดอย่างสม่ำเสมอ ผลลัพธ์ที่เผยแพร่แสดงให้เห็นจุดแข็งและจุดอ่อนที่ชัดเจนในแบบทดสอบเชิงเอเจนต์ต่างๆ
- งานที่รันยาวอาจใช้โทเคนจำนวนมาก: หน้าต่างบริบทขนาดใหญ่และการใช้เครื่องมือแบบวนรอบสามารถเพิ่มการใช้ทรัพยากรการอนุมานรวม แม้ว่าราคาแบบต่อโทเคนจะสามารถแข่งขันได้
- การกำหนดค่าเครื่องมือมีความสำคัญ: การค้นหาเว็บ, X search, การรันโค้ด และการเรียกใช้ฟังก์ชัน ต้องการสถาปัตยกรรมแอปที่สามารถจัดการสิทธิ์ของเครื่องมือและข้อมูลที่ส่งคืนได้อย่างปลอดภัย
- วันตัดความรู้: วันที่ที่บันทึกไว้คือ 1 กุมภาพันธ์ 2026 สำหรับข้อมูลใหม่ นักพัฒนาควรใช้เครื่องมือดึงข้อมูลหรือการค้นเว็บที่เหมาะสมแทนการพึ่งพาความรู้แบบคงที่ของโมเดล
- การแคชต้องการการกำหนดค่าอย่างจงใจ: xAI แนะนำให้ใช้
prompt_cache_keyสำหรับ Responses API และx-grok-conv-idสำหรับ Chat Completions เพื่อปรับปรุงความน่าเชื่อถือของการโดนแคช
กรณีการใช้งานของ Grok 4.6
- เอเจนต์เขียนโค้ดแบบอัตโนมัติ — การวิเคราะห์รีโพซิทอรี การนำไปใช้ การดีบัก การทดสอบ และการแก้ไขแบบวนรอบ
- การสร้างต้นแบบผลิตภัณฑ์ — เปลี่ยนข้อกำหนดผลิตภัณฑ์เชิงกว้างให้เป็นแอปแบบโต้ตอบที่ใช้งานได้จริง
- เอเจนต์วิจัยด้านเทคนิค — วิจัยโดเมนเทคนิคที่ไม่คุ้นเคยและผลิตผลลัพธ์ที่มีโครงสร้าง
- ผู้ช่วยนักพัฒนา — การสร้างโค้ด การรีวิว การดีบัก และเวิร์กโฟลว์การพัฒนาหลายขั้นตอน
- ระบบอัตโนมัติงานด้านความรู้ — การวิเคราะห์เอกสาร การสังเคราะห์ข้อมูล การวางแผน และการสร้างเอาต์พุตแบบมีโครงสร้าง
- ผู้ช่วยที่ใช้เครื่องมือ — แอปที่ผสานการให้เหตุผลของโมเดลเข้ากับการค้นหาเว็บ, X search, การรันโค้ด และการเรียกใช้ฟังก์ชันแบบกำหนดเอง
วิธีเข้าถึง Grok 4.6 API
สำหรับแอปพลิเคชันที่ใช้งานเลเยอร์ API แบบรวมของ CometAPI อยู่แล้ว ให้ใช้รหัสโมเดล Grok 4.6 ที่ CometAPI เปิดเผยและปฏิบัติตามเอนด์พอยต์/สคีมาปัจจุบันในเอกสาร API ของ CometAPI สิ่งนี้สามารถลดงานผสานการทำงานเฉพาะผู้ให้บริการเมื่อแอปพลิเคชันต้องการสลับระหว่าง LLM ระดับแนวหน้า
เวิร์กโฟลว์ทั่วไปคือ:
- สร้างหรือลงชื่อเข้าใช้บัญชี CometAPI.
- สร้างโทเค็น API ในคอนโซลของ CometAPI.
- เลือกเอนด์พอยต์โมเดล
grok-4.6. - ส่งคำขอผ่านเอนด์พอยต์ของ CometAPI โดยใช้สคีมาคำขอตามที่มีเอกสารสำหรับโมเดลนั้น
- ประมวลผลข้อความที่ส่งกลับ การเรียกใช้เครื่องมือ หรือเอาต์พุตแบบมีโครงสร้างในแอปพลิเคชันของคุณ