TLDR เมื่อวันที่ 27 กันยายน 2026 MiniMax เปิดตัว M3.1-Flash-Preview ภายใน MiniMax Code อย่างเงียบแต่เป็นทางการ (และผ่าน Token Plan) เป็นโมเดลโค้ดแบบมัลติโหมดแนวหน้าที่มีหน้าต่างบริบทแบบเต็มขนาด 1-million-token รองรับอินพุตข้อความ/ภาพ/วิดีโอโดยกำเนิด และมีตัวควบคุมระดับความพยายามในการให้เหตุผลแบบใหม่ 5 ระดับ (low → max) วางตำแหน่งชัดเจนเพื่อเวิร์กโฟลว์การพัฒนาในชีวิตประจำวัน—ตั้งแต่การแก้บั๊ก การลงมือทำ การทดสอบ ไปจนถึงการส่งมอบ—โดยให้ความสำคัญกับความเร็วและความคุ้มค่า พร้อมคงโหมดคิดตลอดเวลา
ขณะนี้การใช้งานจำกัดเฉพาะ Token Plan + MiniMax Code (รองรับ API ผ่าน Subscription Key) ยังไม่มีการเผยแพร่ราคาแบบสาธารณะเต็มรูปแบบและน้ำหนักโมเดลแบบเปิด CometAPI ได้แสดงโมเดลนี้ (minimax-m3.1-flash-preview) พร้อมราคาแข่งขัน ทำให้การเข้าถึงแบบรวมเป็นเรื่องตรงไปตรงมา
ประเด็นสำคัญ
- บริบท 1M-token + มัลติโมดแบบเนทีฟ — จัดการได้ทั้งฐานโค้ดขนาดใหญ่ เซสชันเอเจนต์ยาว เอกสาร ภาพ และวิดีโอในหน้าต่างเดียว
- ระดับความพยายามในการให้เหตุผล 5 ระดับ (low / medium / high / xhigh / max, ค่าเริ่มต้นเป็น max) — แลกความหน่วงและการใช้โทเคนกับการพิจารณาที่ลึกขึ้นตามต้องการ โหมดคิดไม่สามารถปิดได้
- โฟกัสการโค้ดประจำวัน — ปรับเหมาะ explicitly สำหรับลูปปิด Bug localization → Implementation → Testing → Delivery ภายใน MiniMax Code
- ข้อจำกัดเวอร์ชันพรีวิว — ยืนยันได้ใน MiniMax Code และ Token Plan; การเรียก API ต้องใช้ Subscription Key ยังไม่ประกาศ model card อิสระ ชุดเบนช์มาร์กสาธารณะ น้ำหนักแบบเปิด หรือราคาแบบชำระตามการใช้งานแยกเดี่ยว
- คำแนะนำ CometAPI — เข้าถึงผ่าน endpoint ที่เข้ากันได้กับ OpenAI เพียงจุดเดียว (รหัสโมเดล: minimax-m3.1-flash-preview) พร้อมส่วนลดราคา เหมาะสำหรับทีมที่ใช้งานแคตตาล็อกกว่า 500+ โมเดลของ CometAPI อยู่แล้ว
MiniMax M3.1-Flash-Preview คืออะไร?
MiniMax M3.1-Flash-Preview คือสมาชิกใหม่ล่าสุดในตระกูลโมเดลภาษาขนาดใหญ่ซีรีส์ M ของ MiniMax เอกสารอย่างเป็นทางการอธิบายไว้ว่า เป็น “โมเดลโค้ดแบบมัลติโหมดแนวหน้าพร้อมหน้าต่างบริบท 1M และความลึกของการคิดที่ปรับได้” นักพัฒนาเห็นครั้งแรกในตัวเลือกโมเดลของ MiniMax Code และได้รับการยืนยันอย่างเป็นทางการโดย บัญชี @MiniMaxAgent อย่างเป็นทางการบน X เมื่อวันที่ 27 กันยายน 2026:
“MiniMax’s latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it’s fast, reliable, and ready for real work, from quick bug fixes to full features.”
ต่างจากโมเดลแชตทั่วไป โมเดลนี้ถูกสร้างมาเพื่อวิศวกรรมซอฟต์แวร์และเวิร์กโฟลว์แบบเอเจนต์โดยเฉพาะ ข้อความทางการตลาดของ MiniMax เน้นงานของนักพัฒนาจริง: แก้บั๊กด่วน ทำฟีเจอร์ จัดการกรณีขอบ การทดสอบรีเกรสชัน และการยืนยันการเปลี่ยนแปลง ชื่อ “Flash” สื่อถึงการเน้นความเร็วและความเป็นงานประจำเมื่อเทียบกับ MiniMax-M3 รุ่นใหญ่ แต่ยังคงสืบทอดบริบทขนาดใหญ่และจุดแข็งด้านการโค้ดของตระกูล M3
โมเดลรองรับ:
- หน้าต่างบริบทสูงสุด 1,000,000 โทเคน — เหมาะกับฐานโค้ดทั้งคลัง เอกสารยาว และเซสชันเอเจนต์หลายขั้นตอน
- อินพุตมัลติโหมดแบบเนทีฟ (ข้อความ ภาพ และวิดีโอ)
- การให้เหตุผลแบบเอเจนต์ การเรียกใช้เครื่องมือ และการทำงานตามโครงสร้าง
- โหมดคิดเชิงลึกแบบ always-on ที่ปรับได้ผ่านสไลเดอร์ความพยายาม 5 ระดับ
เนื้อหาการคิดจะถูกส่งกลับมาแยกต่างหาก (เป็น reasoning_content ในโหมดที่เข้ากันได้กับ OpenAI หรือเป็น thinking blocks ในโหมดที่เข้ากันได้กับ Anthropic) ทำให้คำตอบสุดท้ายสะอาดสำหรับการแสดงผลหรือใช้งานต่อ
บริบท 1M-Token + การปรับให้เหมาะกับงานโค้ด
สเปกทางเทคนิคที่โดดเด่น คือ หน้าต่างบริบท 1,000,000 โทเคน ซึ่งเทียบเท่า MiniMax-M3 และใหญ่กว่ามากเมื่อเทียบกับโมเดลโค้ดคู่แข่งส่วนใหญ่ เอกสารทางการเน้นความเหมาะสมสำหรับ:
- คลังโค้ดทั้งระบบ
- เซสชันเอเจนต์หลายขั้นตอนที่ยาว
- เอกสารและคลังความรู้ขนาดใหญ่
- อินพุตหลายโหมด (ข้อความ + ภาพ + วิดีโอ) ในบริบทเดียวกัน
ความสามารถบริบทยาวนี้ผสานกับมัลติโมดแบบเนทีฟ ช่วยให้เวิร์กโฟลว์ที่ก่อนหน้านี้ต้องจัดการบริบทหนักหรือพึ่งระบบเรียกค้นภายนอกง่ายขึ้น นักพัฒนาสามารถคงฐานโค้ดขนาดใหญ่ ม็อกอัปดีไซน์ ภาพหน้าจอข้อผิดพลาด และเอกสารที่เกี่ยวข้องไว้ในบทสนทนาเดียว
โมเดลถูกปรับให้เหมาะกับสถานการณ์เอเจนต์และงานโค้ดอย่างชัดเจน: การเรียกใช้เครื่องมือ เอาต์พุตแบบมีโครงสร้าง และงานวิศวกรรมหลายเทิร์น ตัวเลขความเร็วเอาต์พุตของโมเดลที่เกี่ยวข้อง (M3 ≈ 100+ TPS, M2.7-highspeed ≈ 100 TPS) บ่งชี้ว่า Flash ตั้งเป้าช่วงปลายบนของสเปกด้านความหน่วง/ปริมาณงาน แม้ยังไม่เผยตัวเลข TPS ของ M3.1-Flash-Preview เอง
ระดับความพยายามในการให้เหตุผลแบบ 5 ระดับ
หนึ่งในคุณสมบัติใหม่ที่ใช้จริงได้มากคือ ความลึกของการคิดที่ปรับได้ ควบคุมผ่านพารามิเตอร์ effort (ที่เข้ากันได้กับ Anthropic) หรือ reasoning_effort (ที่เข้ากันได้กับ OpenAI) โดยมี 5 ระดับดังนี้:
| ระดับ | กรณีใช้งานทั่วไป | สิ่งที่ต้องแลก |
|---|---|---|
| low | แก้ไวยากรณ์เล็กน้อย ค้นหาข้อมูลรวดเร็ว | ความหน่วงและการใช้โทเคนต่ำสุด |
| medium | รีแฟกเตอร์ตามปกติ ฟีเจอร์ขนาดเล็ก | สมดุล |
| high | ลอจิกซับซ้อน เปลี่ยนหลายไฟล์ | การวิเคราะห์ลึกขึ้น |
| xhigh | ดีบักยาก ตัดสินใจเชิงสถาปัตยกรรม | คอมพิวต์และความหน่วงสูงขึ้น |
| max | ปัญหาสุ่มเสี่ยงสูงหรือไม่ชัดเจน (ค่าเริ่มต้น) | การไตร่ตรองสูงสุด |
โหมดคิดเป็นแบบ always-on สำหรับ M3.1-Flash-Preview การพยายามปิดจะได้ 400 error ระดับที่สูงขึ้นจะสร้างโทเคนเหตุผลภายในมากขึ้นและเพิ่มความหน่วง ทำให้นักพัฒนาควบคุมได้ละเอียดขึ้น ซึ่งก่อนหน้านี้ในซีรีส์ M ยังไม่ละเอียดขนาดนี้
ใน MiniMax Code การควบคุมจะแสดงเป็นสไลเดอร์/ตัวเลือกง่ายๆ; ผ่าน API ให้ส่งค่าใน request body การออกแบบนี้สะท้อนแนวโน้มอุตสาหกรรมในการเปิด “งบประมาณการให้เหตุผล” เพื่อให้ผู้ใช้ปรับพฤติกรรมโมเดลตามความยากของงานและข้อจำกัดด้านต้นทุน
เวิร์กโฟลว์การพัฒนาในชีวิตประจำวัน
MiniMax วางตำแหน่ง M3.1-Flash-Preview ไว้ใจกลางวงจรงานประจำวันของนักพัฒนา มากกว่าจะเป็นโมเดลวิจัยหรือเอเจนต์ระยะยาวล้วนๆ ข้อความทางการและการจัดวางผลิตภัณฑ์ เน้นประสบการณ์ลูปปิดภายใน MiniMax Code ตั้งแต่ Bug Fixing → Implementation → Testing → Delivery:
- Bug localization — วางสแต็กเทรซ ภาพหน้าจอข้อผิดพลาด หรือส่วนโค้ดที่เกี่ยวข้อง; โมเดลใช้บริบทขนาดใหญ่เพื่อระบุรากสาเหตุ
- Implementation — สร้างหรือแก้ไขโค้ดข้ามหลายไฟล์โดยรักษาบริบททั้งโปรเจ็กต์
- Testing & verification — เสนอหรือเขียนเทสต์ รันรีเกรสชัน และวิเคราะห์ผลกระทบ
- Delivery — สร้าง diff ที่สะอาด ข้อความคอมมิต หรือเอกสารพร้อมรีวิว
การผสานหน้าต่างบริบท 1M อินพุตมัลติโหมด (เช่น ภาพหน้าจอ UI ที่ล้มเหลว) และระดับความพยายามที่ปรับได้ ทำให้โมเดลมีประสิทธิภาพเป็นพิเศษสำหรับงานที่เกิดบ่อยและไวต่อความหน่วงซึ่งครองวันทำงานของวิศวกร โปรโมชันช่วงเปิดตัว (เพิ่มแต้มเช็กอินรายวันเป็นสองเท้า 28 กันยายน–7 ตุลาคม UTC+8 และรีเซ็ตโควตา Token Plan) ช่วยกระตุ้นการทดสอบใช้งานจริง
ความพร้อมใช้งานปัจจุบันและข้อจำกัดของเวอร์ชันพรีวิว
ยืนยันแล้ว ณ ปลายเดือนกันยายน 2026:
- เลือกได้ภายใน MiniMax Code (ตัวเลือกโมเดลเคียงกับ M3, M2.7 ฯลฯ)
- ใช้งานได้ผ่าน Token Plan / Subscription Key
- ปรากฏในหน้าอ้างอิง API อย่างเป็นทางการของ MiniMax พร้อมตัวอย่างที่เข้ากันได้กับ OpenAI และ Anthropic
- ควบคุมความลึกของการคิดได้ผ่าน
reasoning_effortหรือฟิลด์ที่เทียบเท่า - กิจกรรมโปรโมชัน: รีเซ็ตโควตา Token Plan และแต้มเช็กอินสองเท่า (28 กันยายน – 7 ตุลาคม) ใช้ได้กับโมเดลใหม่
เส้นทาง API ที่ยืนยันแล้ว: เอกสารทางการระบุชื่อโมเดล MiniMax-M3.1-Flash-Preview และให้ทั้ง endpoint ที่เข้ากันได้กับ Anthropic (https://api.minimax.io/anthropic) และที่เข้ากันได้กับ OpenAI (https://api.minimax.io/v1) ต้องใช้ Subscription Key (Token Plan) พารามิเตอร์ตัวอย่างรวมถึง output_config.effort หรือ reasoning_effort เนื้อหาการคิดถูกส่งกลับแยก (thinking blocks หรือ reasoning_content)
ยังมีข้อจำกัดหรือยังไม่ยืนยัน:
- ชุดเบนช์มาร์กสาธารณะอิสระและ model card พร้อมจำนวนพารามิเตอร์
- หน้าแสดงราคาแบบชำระตามการใช้งานแยกเดี่ยวที่โปร่งใสเทียบเท่า MiniMax-M3
- น้ำหนักแบบเปิด (ยังไม่ประกาศสำหรับเวอร์ชันพรีวิวนี้)
สถานะพรีวิวหมายความว่าฟีเจอร์ โควตา และราคาอาจเปลี่ยนแปลงได้ นักพัฒนาควรมองสมรรถนะปัจจุบันเป็นตัวบ่งชี้มากกว่าฉบับสุดท้าย
วิธีเข้าถึง MiniMax M3.1-Flash-Preview
1. ภายใน MiniMax Code (ง่ายที่สุดสำหรับการใช้งานแบบอินเทอร์แอคทีฟ)
ดาวน์โหลดหรือเปิด MiniMax Code (มีเดสก์ท็อปแอปสำหรับ macOS และ Windows) เลือก M3.1-Flash-Preview จากตัวเลือกโมเดลและปรับระดับ reasoning โปรโมชันเช็กอินรายวันช่วยเพิ่มเครดิตฟรีเป็นสองเท่าถึงต้นตุลาคม 2026
2. MiniMax API อย่างเป็นทางการ (Token Plan)
- ขอ Subscription Key จากคอนโซลของ MiniMax
- ใช้ SDK ของ Anthropic หรือ OpenAI โดยเปลี่ยน
base_urlและตั้งค่าmodel="MiniMax-M3.1-Flash-Preview" - ส่งระดับความพยายามที่ต้องการ
3. ผ่าน CometAPI (แนะนำสำหรับทีมที่ใช้หลายโมเดล)
CometAPI มีรายการ minimax-m3.1-flash-preview อยู่ในแคตตาล็อกแล้ว (มีส่วนลด 20% ณ เวลาที่เขียน) เนื่องจาก CometAPI เปิดเผย endpoint ที่เข้ากันได้กับ OpenAI (https://api.cometapi.com/v1) โค้ดเบสที่มีอยู่จึงต้องเปลี่ยนเพียง base_url และ API key เท่านั้น เหมาะอย่างยิ่งสำหรับทีมที่ส่งผ่าน GPT, Claude, Gemini, MiniMax-M3 และโมเดลอื่นๆ ด้วยคีย์เดียว และต้องการความสังเกตการณ์ การเรียกเก็บเงิน และกลไกสำรองที่สอดคล้องกัน
ตัวอย่าง (Python / OpenAI SDK ผ่าน CometAPI):
from openai import OpenAI
client = OpenAI(
api_key="YOUR_COMETAPI_KEY",
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="minimax-m3.1-flash-preview",
messages=[{"role": "user", "content": "Refactor this function for clarity..."}],
# reasoning_effort or equivalent may be supported depending on gateway mapping
)
แคตตาล็อกรวมของ CometAPI ยังมี MiniMax-M3 ซีรีส์ M2.7 และโมเดลวิดีโอ H3 รุ่นใหม่ ช่วยให้สลับระหว่างการสร้างข้อความและมัลติโหมดได้อย่างราบรื่นภายใต้ความสัมพันธ์การเรียกเก็บเงินเดียว
