TL;DR
Grok Build 0.1 คือโมเดลของ xAI ที่เชี่ยวชาญด้านการเขียนโค้ด ออกแบบมาสำหรับวิศวกรรมซอฟต์แวร์เชิงเอเจนต์ ไม่ใช่การสนทนาแบบแชตบอตทั่วไป เปิดให้ใช้งานแบบ public beta บน xAI API เมื่อ 29 พฤษภาคม 2026 โดยเน้นการพัฒนาเว็บ ดีบัก การเรียกใช้เครื่องมือ เวิร์กโฟลว์แบบ MCP และเอเจนต์เขียนโค้ดแบบอัตโนมัติ
โมเดลมีหน้าต่างบริบท 256,000 โทเค็น รับอินพุตได้ทั้งข้อความและรูปภาพ รองรับการให้เหตุผล เอาต์พุตแบบมีโครงสร้าง และการเรียกใช้ฟังก์ชัน คิดราคา $1 ต่อหนึ่งล้านโทเค็นอินพุต และ $2 ต่อหนึ่งล้านโทเค็นเอาต์พุตที่อัตรามาตรฐาน จุดแข็งที่สุดไม่ใช่การเติมโค้ดครั้งเดียว แต่คือเวิร์กโฟลว์หลายขั้นตอนที่เอเจนต์ตรวจสอบรีโพซิทอรี แก้ไขไฟล์ เรียกใช้เครื่องมือ รันทดสอบ และวนซ้ำไปสู่ผลลัพธ์ที่ยืนยันแล้ว
ความแตกต่างหลักมีง่ายๆ: Grok Build คือผลิตภัณฑ์เอเจนต์โค้ดดิ้ง ส่วน grok-build-0.1 คือโมเดลที่เข้าถึงผ่าน API ซึ่งสามารถทำงานภายในเฟรมเวิร์กเอเจนต์โค้ดดิ้งอื่นๆ ได้ Grok Build 0.1 API ใน CometAPI ก็เปิดให้ใช้งานแล้ว โดยมอบหมายโมเดลเดียวกันผ่านเกตเวย์ที่เข้ากันได้กับ OpenAI
ประเด็นสำคัญ
- Grok Build 0.1 ถูกปรับให้เหมาะกับการโค้ดดิ้งเชิงเอเจนต์ งานรีโพซิทอรี ดีบัก และวิศวกรรมซอฟต์แวร์ที่ขับเคลื่อนด้วยเครื่องมือ
- รหัสโมเดลใน API คือ
grok-build-0.1พร้อมหน้าต่างบริบท 256K และอินพุตข้อความ-ภาพ - ราคา xAI สำหรับบริบทสั้นคือ $1/M อินพุต, $0.20/M อินพุตที่แคชแล้ว, และ $2/M เอาต์พุต ส่วนAPI บน CometAPI ของ Grok Build 0.1 ถูกกว่าประมาณ 20% ที่ $0.80/M อินพุต, $0.16/M อินพุตที่แคชแล้ว, และ $1.60/M เอาต์พุต; คำขอที่ถึงหรือเกินเกณฑ์ 200K จะใช้อัตราบริบทยาวที่สูงกว่า
- รองรับการให้เหตุผล การเรียกใช้ฟังก์ชัน และเอาต์พุตแบบมีโครงสร้าง แต่ไม่รองรับ Batch API
- ประเมินจากต้นทุนและเวลาต่อหนึ่งงานวิศวกรรมที่เสร็จสมบูรณ์ ไม่ใช่จากราคาโทเค็นดิบหรือ benchmark เดี่ยว
Grok Build 0.1 คืออะไร?
Grok Build 0.1 คือโมเดลภาษาของ xAI ที่เชี่ยวชาญเป็นพิเศษ ออกแบบรอบเวิร์กโฟลว์วิศวกรรมซอฟต์แวร์เชิงเอเจนต์ ตามข้อมูลของ xAI โมเดลนี้ได้รับการฝึกเพื่อทำงานอย่างการพัฒนาเว็บ ดีบัก และเอเจนต์โค้ดดิ้งที่ใช้ MCP และเป็นพลังให้กับสภาพแวดล้อมการเขียนโค้ด Grok Build ดั้งเดิม
การวางตำแหน่งดังกล่าวแยกมันออกจากผู้ช่วยอเนกประสงค์แบบทั่วไป เอเจนต์โค้ดดิ้งต้องตรวจสอบรีโพซิทอรีซ้ำๆ ระบุไฟล์ที่เกี่ยวข้อง เรียกใช้เครื่องมือ แก้ไขโค้ด รันทดสอบ อ่านความล้มเหลว และปรับปรุงการติดตั้ง โดยไม่สูญเสียสถานะงาน
ด้วยเหตุนี้ หน่วยประเมินผลที่มีความหมายคือหนึ่งงานวิศวกรรมแบบครบวงจร: การนำทางรีโพซิทอรี → วางแผน → แก้ไข → รันเครื่องมือ → ฟื้นตัวจากความล้มเหลว → ตรวจยืนยัน
Grok Build 0.1 เหมือนกับ Grok Build ไหม?
ไม่เหมือน Grok Build คือเอเจนต์โค้ดดิ้งแบบเทอร์มินัลของ xAI ส่วน Grok Build 0.1 คือโมเดลพื้นฐานที่นักพัฒนาสามารถเรียกผ่าน API ได้
Grok Build มีการทบทวนแผน, diff โค้ด, รองรับ AGENTS.md, ปลั๊กอิน, ฮุค, สกิล, เซิร์ฟเวอร์ MCP, ซับเอเจนต์แบบขนาน, การผสานกับ worktree และโหมด headless สำหรับระบบอัตโนมัติ ตัวโมเดลเองก็สามารถใช้ภายนอกผลิตภัณฑ์เทอร์มินัลนั้นได้ในเฟรมเวิร์กเอเจนต์และเกตเวย์ที่เข้ากันได้
สเปกของ Grok Build 0.1 คืออะไร?
| สเปก | Grok Build 0.1 |
|---|---|
| ผู้พัฒนา | xAI / SpaceXAI |
| รหัสโมเดล | grok-build-0.1 |
| โฟกัสหลัก | การโค้ดดิ้งเชิงเอเจนต์และวิศวกรรมซอฟต์แวร์ |
| อินพุต / เอาต์พุต | อินพุตข้อความและภาพ; เอาต์พุตข้อความ |
| หน้าต่างบริบท | 256,000 โทเค็น |
| ความสามารถ | การให้เหตุผล การเรียกใช้ฟังก์ชัน เอาต์พุตแบบมีโครงสร้าง |
| ราคาโทเค็นมาตรฐาน | $1.00/M อินพุต; $0.20/M อินพุตที่แคชแล้ว; $2.00/M เอาต์พุต |
| เกณฑ์บริบทยาว | 200K โทเค็นพรอมต์ |
| ราคาในบริบทยาว | $2.00/M อินพุต; $0.40/M อินพุตที่แคชแล้ว; $4.00/M เอาต์พุต |
| Batch API | ไม่รองรับ |
| ขีดจำกัดที่มีเอกสารกำกับ | 37 คำขอ/วินาที; 10,000,000 โทเค็น/นาที |
| ภูมิภาค | us-east-1, us-west-2 |
สเปกเหล่านี้มีบันทึกอยู่ในหน้ารายการโมเดลทางการของ xAI หน้าต่างบริบท 256K สามารถจุข้อมูลรีโพซิทอรีได้มาก ในขณะที่อินพุตภาพช่วยให้เอเจนต์ตีความภาพหน้าจอ ม็อกอัป ไดอะแกรมสถาปัตยกรรม และรายงานบั๊กเชิงภาพควบคู่กับซอร์สโค้ดได้
เมื่อพรอมต์ถึงเกณฑ์บริบทยาว จะใช้อัตราที่สูงขึ้นกับทุกโทเค็นในคำขอนั้น ดังนั้นเอเจนต์ที่ทำงานกับรีโพซิทอรีจำนวนมากควรย่อหรือดึงข้อมูลบริบทอย่างเลือกสรรแทนการต่อท้ายไฟล์และผลลัพธ์เครื่องมืออย่างต่อเนื่อง
อะไรทำให้ Grok Build 0.1 แตกต่าง?
การโค้ดดิ้งเชิงเอเจนต์เป็นเป้าหมายการปรับแต่งหลัก
Grok Build 0.1 ไม่ได้เป็นเพียงโมเดลที่เขียน Python หรือ JavaScript ได้ ความเชี่ยวชาญของมันคือปฏิสัมพันธ์ระหว่างการให้เหตุผล การสร้างโค้ด และเครื่องมือ เอเจนต์โค้ดดิ้งที่เป็นประโยชน์ต้องวางแผน ตรวจสอบ แก้ไข รัน ดึงตัวจากความล้มเหลว และเดินหน้าต่อโดยไม่สูญเสียสถานะงาน
เวิร์กโฟลว์เครื่องมือที่มุ่งไปที่ MCP
เวิร์กโฟลว์แบบ MCP สามารถเชื่อมเอเจนต์โค้ดดิ้งเข้ากับฐานข้อมูล ระบบดีพลอย เอกสาร ตัวติดตามปัญหา ระบบ observability และเครื่องมือพัฒนาภายใน ผ่านอินเทอร์เฟซมาตรฐาน
ระบบอัตโนมัติแบบมีโครงสร้าง
เอาต์พุตแบบมีโครงสร้างมีประโยชน์เมื่อเอเจนต์ต้องคืนออบเจ็กต์ที่คาดเดาได้แทนข้อความร้อยแก้ว เช่น แผนเปลี่ยนไฟล์ พารามิเตอร์เครื่องมือ ผลทดสอบ ผลการรีวิว หรือการตัดสินใจดีพลอย ลดการพาร์สที่เปราะบางระหว่างโมเดลกับเลเยอร์ orchestration
บริบทเชิงภาพสำหรับงานเว็บและ UI
เพราะโมเดลรับอินพุตภาพได้ เอเจนต์จึงสามารถทำงานกับภาพหน้าจอ หน้าเว็บที่เรนเดอร์แล้ว เอกสารอ้างอิงอินเทอร์เฟซ กล่องโต้ตอบข้อผิดพลาด และไดอะแกรมสถาปัตยกรรมควบคู่กับซอร์สโค้ด
Grok Build 0.1 เร็วแค่ไหน?
xAI อธิบายว่า Grok Build 0.1 เป็นโมเดลโค้ดดิ้งที่เร็วที่สุดของตนในช่วงเปิดตัว และโปรโมตมากกว่า 100 โทเค็นเอาต์พุตต่อวินาที นั่นเป็นคำกล่าวอ้างอย่างเป็นทางการของบริการ ไม่ใช่การรับประกันสำหรับทุกพรอมต์หรือทุกเอนด์พอยต์
การวัดอิสระควรถูกมองว่าเป็นการสังเกต ณ เวลา Artificial Analysis รายงานความเร็วประมาณ 69.6 โทเค็นเอาต์พุต/วินาที และเวลา 0.54 วินาทีถึงโทเค็นแรกบน SpaceXAI API โครงสร้างพื้นฐานของผู้ให้บริการ ความยาวพรอมต์ พฤติกรรมการให้เหตุผล การใช้เครื่องมือ และภาระโหลดของเซิร์ฟเวอร์ สามารถทำให้ผลลัพธ์เปลี่ยนแปลงได้
ควรตีความ benchmark อย่างไร?
| ตัวชี้วัดอิสระ | ค่าที่รายงานปัจจุบัน | การตีความ |
|---|---|---|
| Artificial Analysis Intelligence Index | 27, ประมาณการ | ประมาณการแบบผสม; การประเมินอิสระยังระบุว่าอยู่ระหว่างดำเนินการ |
| ความเร็วเอาต์พุต | 69.6 โทเค็น/วินาที | วัดบน SpaceXAI API ฝั่งผู้ให้บริการโดยตรง หลังชิ้นส่วนการตอบกลับแรก |
| เวลาไปยังโทเค็นแรก | 0.54 วินาที | การวัดความหน่วงที่ปลายทาง; ไม่ใช่เวลารวมในการทำงานเสร็จ |
ตัวเลขเหล่านี้ถูกตรวจสอบกับ Artificial Analysis เมื่อ 22 กันยายน 2026 เนื่องจากหน้าเว็บอัปเดตแบบไดนามิก ควรตรวจสอบค่าซ้ำในอนาคตและเก็บวันที่ยืนยันไว้
สำหรับระบบโค้ดดิ้งอัตโนมัติ คะแนน benchmark เป็นเพียงส่วนหนึ่งของการประเมิน การนำทางรีโพซิทอรี ความแม่นยำในการแก้ไข การเลือกเครื่องมือ พฤติกรรมการฟื้นตัว ระเบียบวินัยด้านการทดสอบ ความหน่วง และจำนวนโทเค็นทั้งหมด อาจมีความสำคัญต่อประสิทธิภาพนักพัฒนามากกว่า
Grok Build 0.1 มีค่าใช้จ่ายเท่าไร?
Grok Build 0.1 ใช้อัตราสำหรับบริบทสั้นและยาวแยกกัน ชั้นราคาบริบทสั้นใช้เมื่อความยาวพรอมต์ต่ำกว่า 200,000 โทเค็น; เมื่อคำขอถึงเกณฑ์ดังกล่าว จะใช้อัตราบริบทยาวที่สูงขึ้นกับคำขอนั้น
| ระดับราคา | CometAPI | xAI ทางการ |
|---|---|---|
| อินพุตบริบทสั้น | $0.80/M | $1.00/M |
| อินพุตที่แคชแล้วบริบทสั้น | $0.16/M | $0.20/M |
| เอาต์พุตบริบทสั้น | $1.60/M | $2.00/M |
| อินพุตบริบทยาว | $1.60/M | $2.00/M |
| อินพุตที่แคชแล้วบริบทยาว | $0.32/M | $0.40/M |
| เอาต์พุตบริบทยาว | $3.20/M | $4.00/M |
ที่อัตราบริบทสั้น อินพุตหนึ่งล้านโทเค็นบวกเอาต์พุตหนึ่งล้านโทเค็นมีค่าใช้จ่าย $2.40 ผ่าน CometAPI เทียบกับ $3.00 ผ่าน xAI ทางการ ที่อัตราบริบทยาว ชุดโทเค็นเดียวกันมีค่า $4.80 ผ่าน CometAPI เทียบกับ $6.00 ผ่าน xAI ตัวเลขเหล่านี้ครอบคลุมเฉพาะโทเค็นของโมเดล; งบประมาณ production ควรรวมการเรียกใช้เครื่องมือ การลองใหม่ การรันทดสอบ และค่า orchestration ด้วย
เปรียบเทียบ Grok Build 0.1 กับ Grok 4.7 กับ Grok Code Fast 1
| มิติ | Grok Build 0.1 | Grok 4.7 | Grok Code Fast 1 |
|---|---|---|---|
| วงจรชีวิต | โมเดลที่เชี่ยวชาญการโค้ดดิ้งในปัจจุบัน | โมเดลแนวหน้าในปัจจุบัน | โมเดลโค้ดดิ้งรุ่นก่อน; ปลดระวางเมื่อ 15 พ.ค. 2026 |
| การวางตำแหน่งหลัก | โมเดลโค้ดดิ้งเชิงเอเจนต์แบบเฉพาะทาง | การโค้ดดิ้งแนวหน้า งานเชิงเอเจนต์ และงานความรู้ | โมเดลโค้ดดิ้งที่รวดเร็ว และเป็นรุ่นก่อนในไลน์โมเดลโค้ดดิ้งของ xAI |
| หน้าต่างบริบท | 256K | 500K | สเปกแบบเดิม; ไม่ควรใช้เป็นฐานสำหรับการปรับใช้ใหม่ |
| การให้เหตุผลและเครื่องมือ | การให้เหตุผล การเรียกใช้ฟังก์ชัน เอาต์พุตแบบมีโครงสร้าง | การให้เหตุผลแบบปรับแต่งได้; การเรียกใช้ฟังก์ชัน การค้นเว็บ การค้นหา X และการรันโค้ด | เวิร์กโฟลว์โค้ดดิ้งแบบเดิม; ควรย้ายแทนที่จะขยายการใช้งาน production ใหม่ |
| อัตราทางการสำหรับบริบทสั้น อินพุต/เอาต์พุต | $1.00 / $2.00 ต่อ M โทเค็น | $2.00 / $6.00 ต่อ M โทเค็น | ปลดระวาง; ไม่ควรสมมติอัตรา production ปัจจุบัน |
| อัตรา CometAPI สำหรับบริบทสั้น อินพุต/เอาต์พุต | $0.80 / $1.60 ต่อ M โทเค็น | $1.60 / $4.80 ต่อ M โทเค็น | ใช้แคตตาล็อกปัจจุบันและโมเดลทดแทน ไม่ใช่ slug ที่ปลดระวาง |
| อัตราทางการสำหรับบริบทยาว อินพุต/เอาต์พุต | $2.00 / $4.00 ต่อ M โทเค็น | $4.00 / $12.00 ต่อ M โทเค็น | ไม่เกี่ยวข้องในฐานะอัตราเลือกโมเดลปัจจุบัน |
| ความเหมาะสมโดยทั่วไป | ลูปรีโพซิทอรีปริมาณสูง ดีบัก และเอเจนต์โค้ดดิ้งที่อ่อนไหวต่อค่าใช้จ่าย | งานโค้ดดิ้งที่ยากและยาวขึ้น รวมถึงเวิร์กโฟลว์มืออาชีพที่ต้องการเหตุผลแนวหน้าที่แข็งแรงกว่าและบริบทมากขึ้น | อ้างอิงสำหรับการย้าย; ปักหมุด grok-build-0.1 สำหรับงานโค้ดดิ้งปัจจุบัน |
Grok Build 0.1 เป็นผู้เชี่ยวชาญที่คุ้มค่ากว่าเมื่อภาระงานส่วนใหญ่คือการตรวจรีโพซิทอรี การแก้ไข และการทดสอบซ้ำๆ Grok 4.7 ให้บริบทเกือบสองเท่าและโปรไฟล์ความสามารถแนวหน้าที่กว้างกว่า แต่ราคาเอาต์พุตโทเค็นสูงกว่าอย่างมีนัยสำคัญ การตัดสินใจเชิงปฏิบัติควรอิงต้นทุนต่อหนึ่งงานที่เสร็จสมบูรณ์ รวมถึงการลองใหม่ การเรียกใช้เครื่องมือ และเวลาที่มนุษย์แก้ไข
ทั้งสองโมเดลมีใน CometAPI ช่วยให้ทีมรันงานโค้ดดิ้งเดียวกันผ่านเกตเวย์เดียวและเปรียบเทียบอัตราความสำเร็จ ความหน่วง การใช้บริบท และต้นทุนรวมภายใต้ฮาร์เนสที่สอดคล้องกัน
Grok Build 0.1 เกี่ยวข้องกับ Grok Code Fast 1 อย่างไร?
ตัวระบุ grok-code-fast-1 ถูกประกาศปลดระวางในชุดโมเดลของ xAI วันที่ 15 พฤษภาคม 2026 ไกด์สำหรับการย้ายระบุโดยกว้างๆ ว่า slug ที่ปลดระวางจะรีไดเรกต์ไป grok-4.3 ขณะที่ตารางทดแทนเฉพาะโมเดลและส่วน “Code workloads” แนะนำ grok-build-0.1 และระบุว่า slug โค้ดถูกส่งไปยังโมเดลนั้น
เพราะไกด์ทางการเดียวกันอธิบายการรีไดเรกต์สองระดับ ผู้ใช้ production ไม่ควรมองว่า slug ที่ปลดระวางเป็นตัวระบุโมเดลที่เสถียร ปักหมุด grok-build-0.1 อย่างชัดเจนสำหรับงานโค้ดดิ้ง และตรวจสอบการรูตติ้งปัจจุบันก่อนดีพลอย
API ของ Grok Build 0.1 บน CometAPI ให้การเข้าถึงโดยตรงภายใต้รหัสโมเดลปัจจุบัน หลีกเลี่ยงการพึ่งพาชื่อแฝงที่ปลดระวาง
ใช้ Grok Build 0.1 ได้ที่ไหน?
นั่นหมายความว่าโมเดลไม่ผูกกับ IDE เดียวหรือเอนด์พอยต์ผู้ให้บริการรายเดียว ผ่าน CometAPI ทีมสามารถใช้รหัส grok-build-0.1 เดียวกันในเวิร์กโฟลว์ที่เข้ากันได้กับ OpenAI และเปรียบเทียบกับโมเดลโค้ดดิ้งอื่นๆ โดยไม่ต้องสร้างคอนโทรลเลอร์เอเจนต์รอบๆ ใหม่
Grok Build 0.1 สามารถเรียกผ่าน xAI หรือผ่าน CometAPI สำหรับ CometAPI ให้ส่งคำขอ POST ที่ยืนยันตัวตนไปยัง api.cometapi.com/v1/chat/completions พร้อม model: "grok-build-0.1" และอาร์เรย์ messages แบบมาตรฐาน
curl "https://api.cometapi.com/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "grok-build-0.1",
"messages": [
{
"role": "user",
"content": "Find the bug in this repository and propose a minimal fix."
}
]
}'
ควรใช้ Grok Build 0.1 เมื่อใด?
เอเจนต์โค้ดดิ้งใน IDE
การผสมผสานระหว่างความเชี่ยวชาญด้านโค้ดดิ้งและราคาโทเค็นต่ำ เหมาะกับเวิร์กโฟลว์เชิงโต้ตอบที่เอเจนต์อ่าน แก้ไข และตรวจยืนยันโค้ดซ้ำๆ
การดีบักแบบอัตโนมัติ
เอเจนต์สามารถตรวจข้อผิดพลาด ค้นหาไฟล์ที่เกี่ยวข้อง สร้างแพตช์ รันทดสอบ และปรับแต่งการแก้ไข
การพัฒนาเว็บและ UI
อินพุตภาพเปิดทางสำหรับเวิร์กโฟลว์ที่ขับเคลื่อนด้วยภาพหน้าจอและเอกสารอ้างอิงดีไซน์ควบคู่กับซอร์สโค้ด
เอเจนต์ซอฟต์แวร์ที่ใช้ MCP
การเรียกใช้ฟังก์ชันและเวิร์กโฟลว์แบบ MCP เหมาะกับผู้ช่วยที่ต้องเข้าถึงระบบพัฒนาภายนอกอย่างมีการควบคุม
CI และระบบอัตโนมัติด้านวิศวกรรม
เวิร์กโฟลว์แบบ headless รองรับการคัดกรองบั๊ก การซ่อมแซมอัตโนมัติ การสร้างเทสต์ รีแฟกเตอร์ มิเกรชัน และการเตรียม pull request
Grok Build 0.1 ยังมีความสำคัญในปี 2026 หรือไม่?
ยังมี แต่บทบาทเป็นแบบเฉพาะทาง ไม่ใช่ “โมเดลใหม่ล่าสุดของ xAI” คุณค่าของมันอยู่ที่การผสมผสานระหว่างความเชี่ยวชาญด้านโค้ดดิ้ง หน้าต่างบริบท 256K การให้เหตุผล การเรียกใช้เครื่องมือ เอาต์พุตแบบมีโครงสร้าง อินพุตภาพ และราคาโทเค็นมาตรฐานที่ค่อนข้างต่ำ
มันโดดเด่นเมื่อทีมต้องการโมเดลที่ตอบสนองรวดเร็วสำหรับลูปเอเจนต์ซอฟต์แวร์ซ้ำๆ และสามารถประเมินกับรีโพซิทอรี เทสต์ เป้าหมายความหน่วง และต้นทุนความล้มเหลวของตนเอง
สรุป
Grok Build 0.1 เป็นโมเดลที่โฟกัสกับเอเจนต์โค้ดดิ้ง ไม่ใช่โมเดลแนวหน้าสารพัดประโยชน์ สเปกและราคาทางการทำให้น่าสนใจสำหรับงานรีโพซิทอรีปริมาณสูง แต่การออกแบบเอเจนต์รอบๆ ต่างหากเป็นตัวกำหนดว่าข้อได้เปรียบจะคงอยู่ใน production หรือไม่
ก่อนนำไปใช้ ควรรันการประเมินที่เป็นตัวแทนจริง วัดอัตราสำเร็จของงาน เวลาแก้ไขโดยมนุษย์ จำนวนการเรียกใช้เครื่องมือ การใช้โทเค็น อัตราการผ่านเทสต์ และการสัมผัสบริบทยาว เลือกใช้เมื่อเวิร์กโฟลว์ทั้งหมด—ไม่ใช่แค่ benchmark หรือราคาโทเค็น—ทำได้ดีกว่าทางเลือกอื่น
