GPT-6.1 Sol are now live on CometAPI →
ai-model/งานวิจัย CometAPI

MiMo-V2.5 คืออะไร? สเปก, เบนช์มาร์ก, ฟีเจอร์, ราคา และการเข้าถึง API

สำรวจข้อมูลจำเพาะของ Xiaomi MiMo-V2.5, สถาปัตยกรรม, เกณฑ์มาตรฐานอย่างเป็นทางการ, ราคา, การเปรียบเทียบกับ MiMo-V2.5-Pro, กรณีการใช้งาน, ข้อจำกัด และการเข้าถึง CometAPI.

CometAPI
Deon Goodwinทีมวิจัยโมเดล AI และ API
อัปเดตแล้ว Oct 5, 2026 6 นาทีในการอ่าน
MiMo-V2.5 คืออะไร? สเปก, เบนช์มาร์ก, ฟีเจอร์, ราคา และการเข้าถึง API
ใช้รูปแบบนี้

เรียกใช้ API ครั้งแรก

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

รุ่นมาตรฐาน V2.5 ของ Xiaomi ผสานความเข้าใจข้อความ ภาพ วิดีโอ และเสียงแบบเนทีฟเข้ากับหน้าต่างบริบทขนาด 1 ล้านโทเค็น การใช้เครื่องมือ และประสิทธิภาพจาก MoE แบบสปาร์ส เหมาะกว่าเมื่ออินพุตเป็นมัลติโหมดและต้นทุนต่อภารกิจที่เสร็จสิ้นสำคัญ รุ่น Pro มีขนาดใหญ่กว่าและแข็งแกร่งกว่าในงานโค้ดที่ยากและเอเจนต์ระยะยาว แต่มุ่งเน้นอินพุตข้อความและมีต้นทุนต่อโทเค็นประมาณสามเท่าตามอัตราที่ Xiaomi เผยแพร่

การตัดสินใจเชิงปฏิบัติง่ายมาก: เลือกรุ่นมาตรฐานสำหรับเอเจนต์มัลติโหมด การวิเคราะห์เอกสารและสื่อ และระบบอัตโนมัติปริมาณสูง; เลือก Pro เมื่อคอขวดคือวิศวกรรมซอฟต์แวร์ที่ยากหรือการดำเนินการแบบอัตโนมัติยาวต่อเนื่อง

Key Takeaways

  • รุ่นมาตรฐานใช้พารามิเตอร์รวม 310B โดยเปิดใช้งาน 15B ต่อโทเค็น
  • รองรับอินพุตข้อความ ภาพ วิดีโอ และเสียง และส่งออกเป็นข้อความ
  • API รองรับบริบท 1M เอาต์พุตสูงสุด 128K การเรียกใช้เครื่องมือ การค้นเว็บ สตรีมมิง เอาต์พุตแบบมีโครงสร้าง และการแคชบริบท
  • ผลลัพธ์ที่ผู้เผยแพร่รายงาน ได้แก่ 65.8 บน Terminal-Bench 2.0 และ 56.1 บน SWE-Bench Pro
  • บัตรข้อมูลรุ่น MiMo-V2.5-Pro ปัจจุบันของ Xiaomi ระบุพารามิเตอร์รวม 1.02T และพารามิเตอร์ที่ใช้งาน 42B คะแนน SWE-Bench Pro ที่ผู้เผยแพร่ระบุคือ 56.1 สำหรับ MiMo-V2.5 และ 57.2 สำหรับ Pro; นี่เป็นการเปรียบเทียบที่ลงวันที่และรายงานโดยผู้เผยแพร่ ไม่ใช่การรับประกันสำหรับเวิร์กโฟลว์โค้ดเฉพาะ
  • ที่อัตราปัจจุบันของ Xiaomi ต้นทุนอินพุต/เอาต์พุตของรุ่นมาตรฐานคือ $0.14/$0.28 ต่อหนึ่งล้านโทเค็น; Pro คือ $0.435/$0.87
  • ทั้งสอง API ใน CometAPI มีราคาต่ำกว่าอัตราแบบไม่แคชอย่างเป็นทางการ 20%
    ข้อมูลตรวจสอบแล้ว: 28 กันยายน 2026 ราคา เกณฑ์มาตรฐาน ขีดจำกัด ความพร้อมใช้งาน และรูปแบบคำขออาจเปลี่ยนแปลงได้ Xiaomi ได้ประกาศว่าโมเดลเนม API อย่างเป็นทางการ mimo-v2.5 และ mimo-v2.5-pro จะถูกยกเลิกเวลา 10:00 ตามเวลา ปักกิ่ง ในวันที่ 21 ตุลาคม 2026 โดยไม่มีการแทนที่อัตโนมัติ วางแผนการย้ายและยืนยันเส้นทางที่ใช้งานจริงก่อนการปรับใช้

บันทึกวงจรชีวิต API: แพลตฟอร์ม Xiaomi อย่างเป็นทางการมีแผนจะยุติทั้งสองรหัสรุ่น V2.5 ในวันที่ 21 ตุลาคม 2026 หมายเหตุนี้เกี่ยวข้องกับแพลตฟอร์ม API ของ Xiaomi; โปรดตรวจสอบเกตเวย์ของบุคคลที่สามแยกต่างหาก ประกาศเลิกใช้โมเดลของ Xiaomi

What the Standard Model Is

MiMo-V2.5 คือโมเดลฐานของ Xiaomi MiMo ที่เน้นประสิทธิภาพสำหรับการรับรู้มัลติโหมดและงานแบบเอเจนต์ รองรับอินพุตข้อความ ภาพ วิดีโอ และเสียงแบบเนทีฟภายในสถาปัตยกรรมเดียว และผลิตเอาต์พุตเป็นข้อความ

บันทึกการเปิดตัวโมเดลของ Xiaomi ระบุว่า MiMo-V2.5 ซีรีส์เปิดเบต้าสาธารณะเมื่อ 23 เมษายน 2026 และต่อมาได้เปิดเผย weights ภายใต้ไลเซนส์ MIT MiMo-V2.5 มีพารามิเตอร์รวม 310B แต่เปิดใช้งานประมาณ 15B ต่อโทเค็น; ใช้พูลผู้เชี่ยวชาญขนาดใหญ่โดยไม่รันทั้งหมดพร้อมกัน

MiMo-V2.5-Pro มุ่งเป้าไปที่เวิร์กโหลดที่ต่างออกไป เป็นโมเดลระดับล้านล้านพารามิเตอร์ที่รับอินพุตข้อความ ออกแบบมาสำหรับงานโค้ดที่ยากที่สุด เทอร์มินัล และเอเจนต์ที่ทำงานยาว รุ่นทั้งสองแชร์บริบทสูงสุด 1M แต่แตกต่างกันมากในด้านโมดาลิตี คอมพิวต์ที่ใช้งาน และราคา

MiMo-V2.5 Specifications and Features

รายละเอียดสถาปัตยกรรมอย่างเป็นทางการค่าเหตุผลที่สำคัญ
สถาปัตยกรรมMoE แบบสปาร์สความจุผู้เชี่ยวชาญจำนวนมากพร้อมการเปิดใช้งานแบบเลือกสรร
พารามิเตอร์รวม / ที่ใช้งาน310B / 15Bคอมพิวต์ที่ใช้งานต่ำกว่าความจุรวมมาก
เลเยอร์ทรานส์ฟอร์เมอร์48: 1 dense + 47 MoEส่วนใหญ่เป็นเลเยอร์ที่ใช้ผู้เชี่ยวชาญแบบมีการกำหนดเส้นทาง
ผู้เชี่ยวชาญที่กำหนดเส้นทาง256; ใช้งาน 8 ต่อโทเค็นความเชี่ยวชาญเฉพาะทางโดยไม่ต้องรัน 310B แบบ dense
ความสนใจ (Attention)39 SWA + 9 globalสมดุลประสิทธิภาพเฉพาะท้องถิ่นกับการไหลข้อมูลระยะไกล
หน้าต่าง SWA128 โทเค็นลดแรงกดดันแคชบริบทสำหรับบริบทยาว
บริบท / เอาต์พุตสูงสุด1M / 128K โทเค็นรองรับเอกสารยาวและทรซี่ยาว
อินพุต / เอาต์พุตข้อความ ภาพ วิดีโอ เสียง / ข้อความการรับรู้แบบเนทีฟครอบคลุม 4 ประเภทอินพุต
ตัวเข้ารหัสภาพViT 729M; 28 เลเยอร์ความเข้าใจภาพและวิดีโอ
ตัวเข้ารหัสเสียงทรานส์ฟอร์เมอร์ 261M; 24 เลเยอร์ความเข้าใจเสียงแบบเนทีฟ
การคาดคะเนหลายโทเค็น3 โมดูล; ประมาณ 329M พารามิเตอร์สนับสนุนประสิทธิภาพการถอดรหัสแบบคาดเดา
สเกลการฝึกประมาณ 48T โทเค็นไปป์ไลน์การฝึกข้อความและมัลติโหมดที่กว้าง
ความสามารถของ APIเครื่องมือ เว็บ สตรีมมิง เอาต์พุตแบบมีโครงสร้าง การแคชพื้นฐานเอเจนต์ที่พร้อมใช้งานจริง
ไลเซนส์MITอนุญาตการใช้งานเชิงพาณิชย์และการดัดแปลง

ขอบเขตการทำงานรวมถึงบริบท 1M และเอาต์พุต 128K พร้อมขีดจำกัดที่เผยแพร่ไว้ 100 คำขอต่อนาที และ 10 ล้านโทเค็นต่อนาที ขีดจำกัดในระดับผู้ให้บริการอาจแตกต่างตามบัญชีและเส้นทางการผสานรวม

MiMo-V2.5 คืออะไร? สเปก, เบนช์มาร์ก, ฟีเจอร์, ราคา และการเข้าถึง API

ไดอะแกรมสถาปัตยกรรมอย่างเป็นทางการของ Xiaomi MiMo ทรัพย์สินสถาปัตยกรรมอย่างเป็นทางการ.

How MiMo-V2.5 Architecture Works

ผู้เชี่ยวชาญแบบสปาร์ส: ความจุรวมไม่เท่ากับคอมพิวต์ที่ใช้งาน

ข้อเท็จจริงด้านประสิทธิภาพหลักคือการออกแบบ 310B รวม 15B ที่ใช้งาน ตัวกำหนดเส้นทาง (router) เลือก 8 จาก 256 ผู้เชี่ยวชาญสำหรับแต่ละโทเค็น ทำให้โมเดลเข้าถึงพูลพารามิเตอร์ที่ใหญ่กว่าโมเดล dense 15B ทั่วไปมาก โดยไม่ต้องรันพารามิเตอร์ 310B ทั้งหมดทุกครั้ง

สิ่งนี้ไม่ได้ทำให้การโฮสต์ด้วยตนเองเป็นเรื่องง่าย น้ำหนักทั้งหมดยังต้องถูกเก็บและกระจาย ดังนั้นความจุหน่วยความจำ แบนด์วิดท์การเชื่อมต่อ การกำหนดเส้นทางผู้เชี่ยวชาญ และซอฟต์แวร์ให้บริการยังคงเป็นข้อจำกัดที่สำคัญ

ความสนใจแบบไฮบริดสำหรับบริบทยาว

แบ็กโบนสลับเลเยอร์ความสนใจแบบหน้าต่างเลื่อน (SWA) และแบบ global ด้วยอัตราส่วน SWA:global 5:1 เลเยอร์เฉพาะท้องถิ่น 39 ชั้นควบคุมการเติบโตของแคช ในขณะที่เลเยอร์ global 9 ชั้นรักษาการไหลข้อมูลระยะไกล Xiaomi รายงานว่าลดแคช KV ได้เกือบหกเท่าเมื่อเทียบกับการออกแบบแบบ global ทั้งหมด

บริบทสูงสุด 1M โทเค็นเป็นความจุ ไม่ใช่ความแม่นยำที่รับประกัน คุณภาพการเรียกคืน เวลาแฝง การเติบโตของสถานะเครื่องมือ และความสนใจต่อหลักฐานที่ห่างไกลยังต้องประเมินเฉพาะเวิร์กโหลด

ตัวเข้ารหัสแบบเนทีฟและคุณสมบัติเอเจนต์

วิชวลทรานส์ฟอร์เมอร์ 729M จัดการอินพุตภาพและวิดีโอ; ทรานส์ฟอร์เมอร์เสียง 261M จัดการอินพุตเสียง โปรเจ็กเตอร์แม็ปทั้งสองสตรีมเข้าสู่แบ็กโบนภาษา ช่วยให้เอเจนต์ตัวเดียวผสานสกรีนช็อต ส่วนวิดีโอ แทร็กเสียง คำสั่งข้อความ และผลลัพธ์เครื่องมือเข้าด้วยกัน

โมดูลการคาดคะเนหลายโทเค็น 3 โมดูลสนับสนุนการถอดรหัสแบบคาดเดาและประสิทธิภาพจากการเรียนรู้เสริม โมเดลได้รับการฝึกบนประมาณ 48T โทเค็น โดยขยายบริบทอย่างต่อเนื่องไปถึง 1M ระหว่างโพสต์เทรน

น้ำหนักที่เปิดเผยใช้ ไลเซนส์ MIT อนุญาตการปรับใช้เชิงพาณิชย์ แต่ต้นทุนโครงสร้างพื้นฐานและการพึ่งพาบุคคลที่สามยังต้องพิจารณาแยกต่างหาก

MiMo-V2.5 Benchmarks: Coding, Agents, and Multimodal Results

หมายเหตุเกณฑ์มาตรฐาน:

ตัวเลขด้านล่างรายงานโดยผู้เผยแพร่ เป็นหลักฐานเชิงทิศทาง ไม่ใช่การรับประกันสำหรับรีโพซิทอรี รูปแบบสื่อ สแตกเครื่องมือ เป้าหมายเวลาแฝง หรือโปลิซีด้านความปลอดภัยเฉพาะ

ผลลัพธ์ด้านโค้ดและเอเจนต์

MiMo-V2.5 คืออะไร? สเปก, เบนช์มาร์ก, ฟีเจอร์, ราคา และการเข้าถึง API

ชาร์ตเกณฑ์มาตรฐานโค้ดและเอเจนต์ของ Xiaomi MiMo อย่างเป็นทางการ

เกณฑ์มาตรฐานโค้ดอย่างเป็นทางการคะแนนที่รายงานสัญญาณสำหรับการตัดสินใจ
MiMo Coding Bench71.8ความสามารถเอเจนต์ด้านโค้ดโดยรวม
Claw-Eval Text62.3การทำงานสำเร็จของเอเจนต์ข้อความทั่วไป
Terminal-Bench 2.065.8การดำเนินการเทอร์มินัลเชิงโต้ตอบ
SWE-Bench Pro56.1วิศวกรรมซอฟต์แวร์ในโลกจริง
Claw-Eval Multi-Turn63.2งานเอเจนต์หลายขั้นตอนยาวขึ้น
ResearchClawBench16.91เวิร์กโฟลว์การวิจัยอัตโนมัติ

ผลลัพธ์: จุดแข็งที่สุดคือการใช้เครื่องมือจริงมากกว่าการเติมโค้ดแบบโดดเดี่ยว คะแนน 65.8 บน Terminal-Bench สนับสนุนเอเจนต์ที่เน้นเทอร์มินัล ขณะที่ 56.1 บน SWE-Bench Pro บ่งชี้ความสามารถระดับรีโพซิทอรีที่ใช้งานได้ คะแนนการวิจัยที่ต่ำมากเตือนให้ทดสอบการรวบรวมหลักฐานและพฤติกรรมการอ้างอิงแยกต่างหาก

ผลลัพธ์มัลติโหมด

MiMo-V2.5 คืออะไร? สเปก, เบนช์มาร์ก, ฟีเจอร์, ราคา และการเข้าถึง API

ชาร์ตเกณฑ์มาตรฐานภาพ วิดีโอ และเอเจนต์มัลติโหมดของ Xiaomi MiMo อย่างเป็นทางการ

เกณฑ์มาตรฐานมัลติโหมดอย่างเป็นทางการคะแนนที่รายงานความสามารถที่ทดสอบ
CharXiv RQ81.0การให้เหตุผลกับกราฟและเอกสาร
MMMU-Pro77.9การให้เหตุผลมัลติโหมดระดับผู้เชี่ยวชาญ
HR-Bench 4K88.5ความเข้าใจภาพความละเอียดสูง
OmniDocBench87.2ความเข้าใจเอกสาร
Claw-Eval Multimodal23.8การทำงานสำเร็จของเอเจนต์มัลติโหมด
Video-MME87.7ความเข้าใจวิดีโอ
DailyOmni83.5การให้เหตุผลด้านภาพและเสียงในชีวิตประจำวัน
VideoHolmes64.0การให้เหตุผลเชิงเวลาในวิดีโอ

ผลลัพธ์: การทำความเข้าใจเอกสาร ภาพความละเอียดสูง และวิดีโอ เป็นจุดแข็งที่ชัดเจนที่สุด คะแนนเอเจนต์มัลติโหมด 23.8 ต่ำกว่าคะแนนการรับรู้มาก ดังนั้นระบบที่ต้องทั้งเข้าใจสื่อและใช้งานเครื่องมือได้อย่างน่าเชื่อถือควรถูกประเมินแบบ end-to-end

MiMo-V2.5 vs MiMo-V2.5-Pro: Multi-Dimensional Comparison

การเปรียบเทียบสถาปัตยกรรมอย่างเป็นทางการMiMo-V2.5MiMo-V2.5-Pro
Official Pro specifications
Official Pro benchmarks
นัยเชิงปฏิบัติ
พารามิเตอร์รวม310B1.02TPro มีความจุรวมมากกว่า 3 เท่า
พารามิเตอร์ที่ใช้งาน15B42BPro ใช้พารามิเตอร์ที่ใช้งานมากกว่าประมาณ 2.8 เท่า
เลเยอร์ / ผู้เชี่ยวชาญที่กำหนดเส้นทาง48 / 25670 / 384Pro เป็นเป้าหมายการให้บริการที่ใหญ่กว่า
เพดานบริบทตามบัตรโมเดล1M1Mทั้งสองระบุได้ถึง 1M โทเค็น; ทดสอบการเรียกคืนและเวลาแฝงตามขนาดเวิร์กโหลดของคุณ
เอาต์พุตสูงสุดของ API อย่างเป็นทางการ128K128Kเพจโมเดล API ปัจจุบันของ Xiaomi ทั้งสองระบุ 128K; ขีดจำกัดเฉพาะผู้ให้บริการอาจแตกต่าง
อินพุตแบบเนทีฟข้อความ ภาพ วิดีโอ เสียงข้อความMiMo-V2.5 เป็นตัวเลือกมัลติโหมดตามเอกสาร; ตรวจสอบเอ็นด์พอยต์ Pro ที่แน่นอนก่อนส่งสื่อ
SWE-Bench Pro56.157.2Pro นำหน้า 1.1 คะแนน
Terminal-Bench 2.065.868.4Pro นำหน้า 2.6 คะแนน
ความเหมาะสมหลักเอเจนต์มัลติโหมดประสิทธิภาพสูงโค้ดที่ซับซ้อนและเอเจนต์ระยะยาวเลือกตามเวิร์กโหลดที่ทดสอบ; ส่วนต่างระดับโมเดลไม่ได้พิสูจน์ความเหนือกว่าทั่วไป

ผลการเปรียบเทียบ: ความได้เปรียบของ Pro บนสองการทดสอบเอเจนต์โค้ดที่ใช้ร่วมกันมีเพียงเล็กน้อย ในขณะที่รุ่นมาตรฐานเพิ่มการรองรับอินพุตภาพ วิดีโอ และเสียงแบบเนทีฟ และใช้พารามิเตอร์ที่ใช้งานน้อยกว่ามาก Pro มีเหตุผลเมื่อผลกำไรเล็กน้อยในงานที่ยากมีคุณค่ามากกว่าการรองรับมัลติโหมดและราคาต่อหน่วยที่ต่ำกว่า

How Much Do MiMo-V2.5 and MiMo-V2.5-Pro Cost?

ฐานราคา: 27 พฤษภาคม 2026API มาตรฐานอย่างเป็นทางการAPI Pro อย่างเป็นทางการMiMo-V2.5 API ใน CometAPIMiMo-V2.5-Pro API ใน CometAPI
อินพุต, cache miss / MTok$0.14$0.435$0.112$0.348
เอาต์พุต / MTok$0.28$0.87$0.224$0.696
อินพุต, cache hit / MTok$0.0028$0.0036ตรวจสอบการเรียกเก็บจริงตรวจสอบการเรียกเก็บจริง
ส่วนลดเทียบกับอัตราแบบไม่แคชอย่างเป็นทางการจุดอ้างอิงจุดอ้างอิง20%20%

ที่อัตราอย่างเป็นทางการ Pro มีราคาประมาณ 3.1× ของรุ่นมาตรฐานสำหรับทั้งอินพุตและเอาต์พุตแบบไม่แคช ราคาผู้ให้บริการที่แสดงด้านบนลดแต่ละคู่แบบไม่แคชลง 20% แต่ช่องว่างสัมพัทธ์ระหว่างรุ่นยังคงแทบไม่เปลี่ยน

ราคาต่อโทเค็นไม่ใช่ต้นทุนรวม การลองใหม่ของเครื่องมือ ขนาดบริบท ความยาวเอาต์พุต เวลาแฝง การกู้คืนงานที่ล้มเหลว และการตรวจทานโดยมนุษย์ กำหนดต้นทุนต่อภารกิจที่เสร็จสมบูรณ์ รันตัวอย่างเวิร์กโหลดที่เป็นตัวแทนก่อนเลือกโมเดลการผลิตเริ่มต้น

What Is MiMo-V2.5 Best For?

  • เอเจนต์มัลติโหมด: ผสานสกรีนช็อต เอกสาร วิดีโอ เสียง คำสั่ง และเครื่องมือในเวิร์กโฟลว์เดียว
  • การวิเคราะห์เอกสารยาว: ประมวลผลรีโพซิทอรี สัญญา คลังงานวิจัย ล็อก และประวัติการสนับสนุน
  • ความเข้าใจสื่อ: สรุปวิดีโอ ดึงเหตุการณ์ ตีความกราฟ และตอบคำถามภาพและเสียง
  • เอเจนต์โค้ดและเทอร์มินัล: ตรวจไฟล์ รันคำสั่ง แก้ไขโค้ด และวนซ้ำตามผลการทดสอบ
  • ระบบอัตโนมัติปริมาณสูง: ใช้การเปิดใช้งานแบบสปาร์สและราคาต่อโทเค็นต่ำสำหรับงานผลิตซ้ำ

Limitations and Risks

  • มีเพียง 15B พารามิเตอร์ที่ใช้งานต่อโทเค็น แต่การโฮสต์ด้วยตนเองยังต้องระบบน้ำหนัก 310B เต็ม
  • เอาต์พุตมัลติโหมดเป็นข้อความ; การสร้างภาพ เสียงพูด และวิดีโอต้องใช้โมเดลอื่น
  • เพดานบริบท 1M ไม่รับประกันความแม่นยำการเรียกคืนที่สม่ำเสมอทั่วทั้งหน้าต่าง
  • เกณฑ์มาตรฐานของผู้เผยแพร่อาจไม่ถ่ายโอนไปยังเครื่องมือ รีโพซิทอรี พรอมป์ต์ หรือข้อจำกัดความปลอดภัยแบบกำหนดเอง
  • การเปิดเผยโมดาลิตีในระดับผู้ให้บริการอาจแตกต่างจากความสามารถเต็มของโมเดล open-weight พื้นฐาน

ประตูสู่การผลิต:

ตรวจสอบความแม่นยำ การทำงานสำเร็จของการเรียกเครื่องมือ เวลาแฝง การใช้โทเค็น การจัดการโมดาลิตี และพฤติกรรม fallback บนงานตัวแทนก่อนส่งทราฟฟิกจริง

API Example

ตัวอย่าง Python ต่อไปนี้ใช้เอ็นด์พอยต์ CometAPI ที่เข้ากันได้กับ OpenAI และ ID โมเดลมาตรฐาน โปรดยืนยันเอ็นด์พอยต์ปัจจุบันและสคีมาคำขอที่รองรับก่อนปรับใช้

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
    max_retries=0,
)

response = client.chat.completions.create(
    model="mimo-v2.5",
    max_tokens=256,
    messages=[
        {
            "role": "user",
            "content": "Summarize the main findings in this technical report.",
        }
    ],
)

print(response.choices[0].message.content)

Decision Guide

สัญญาณเวิร์กโหลดเริ่มด้วยสลับเมื่อ
ภาพ วิดีโอ หรือเสียง เป็นอินพุตหลักมาตรฐานอย่าสลับเว้นแต่การพรีโปรเซสมัลติโหมดจะยอมรับได้
เอกสารขนาดใหญ่หรือสื่อแบบผสมจำนวนมากมาตรฐานPro เฉพาะเมื่อความล้มเหลวด้านเหตุผลครองต้นทุน
วิศวกรรมรีโพซิทอรีที่ยากทดสอบทั้งคู่เลือก Pro หากการเพิ่มอัตราสำเร็จชดเชยต้นทุน 3.1× ได้
ทราซีเทอร์มินัลอัตโนมัติยาวProกลับสู่มาตรฐานหากไม่วัดผลได้ว่ามีการพัฒนา
ระบบอัตโนมัติประจำปริมาณสูงมาตรฐานยกระดับเฉพาะงานที่ล้มเหลวหรือมูลค่าสูง

การกำหนดเส้นทางที่แนะนำ:

ใช้มาตรฐานเป็นค่าเริ่มต้นสำหรับงานมัลติโหมดและงานปริมาณสูง จากนั้นกำหนดเส้นทางเฉพาะงานโค้ดข้อความที่ยากหรือภารกิจระยะยาวไปยัง Pro วิธีนี้รักษาความสามารถพร้อมควบคุมต้นทุนรวม

Conclusion

รุ่นมาตรฐานไม่ใช่เพียง Pro ที่เล็กกว่า แต่เป็นจุดเหมาะทางการเพิ่มประสิทธิภาพ: อินพุตมัลติโหมดแบบเนทีฟ บริบท 1M เกณฑ์มาตรฐานที่แข็งแกร่งด้านการใช้เครื่องมือ และพารามิเตอร์ที่ใช้งาน 15B ด้วยราคาต่อโทเค็นที่ต่ำกว่ามาก

Pro เป็นตัวเลือกเฉพาะทางสำหรับวิศวกรรมซอฟต์แวร์ที่ยากและการดำเนินการอัตโนมัติยืดเยื้อ ความจุเพิ่มเติมให้ผลดีที่วัดได้แต่ไม่ครอบคลุมทุกกรณี ดังนั้นรูปแบบการปรับใช้ที่แข็งแกร่งที่สุดคือการกำหนดเส้นทางตามเวิร์กโหลดแทนการเลือกหนึ่งรุ่นสำหรับทุกคำขอ

FAQ

รุ่นมาตรฐานเป็นโอเพนซอร์สไหม?

น้ำหนักถูกเปิดเผยภายใต้ไลเซนส์ MIT อนุญาตการใช้งานเชิงพาณิชย์ การดัดแปลง การปรับจูน และการแจกจ่ายตามเงื่อนไขใบอนุญาต

ใช้พารามิเตอร์เท่าไร?

MoE แบบสปาร์สมีพารามิเตอร์รวม 310B และเปิดใช้งาน 15B ต่อโทเค็น พารามิเตอร์ที่ใช้งานอธิบายคอมพิวต์ต่อโทเค็น ไม่ใช่ขนาดการจัดเก็บของโมเดลทั้งหมด

รองรับภาพ วิดีโอ และเสียงหรือไม่?

รองรับ รุ่นมาตรฐานรับอินพุตข้อความ ภาพ วิดีโอ และเสียง และส่งออกเป็นข้อความ รุ่น Pro ระบุสเปกอินพุตข้อความ

หน้าต่างบริบทสูงสุดเท่าไร?

บัตรโมเดลทั้งสองระบุหน้าต่างบริบทสูงสุด 1M โทเค็น เพจ API ปัจจุบันของ Xiaomi ระบุเอาต์พุตสูงสุด 128K สำหรับ MiMo-V2.5 และ MiMo-V2.5-Pro ขีดจำกัดที่ใช้งานได้จริงอาจแตกต่างตามเอ็นด์พอยต์ ผู้ให้บริการ บัญชี และรูปแบบคำขอ; ยืนยันเส้นทางที่ปรับใช้ก่อนพึ่งพาเพดานเหล่านั้น

เพจ API Pro อย่างเป็นทางการปัจจุบันยืนยันบริบท 1M และเอาต์พุตสูงสุด 128K แยกต่างหาก: MiMo-V2.5-Pro API specifications

รุ่นใดดีกว่าสำหรับเอเจนต์โค้ด?

Pro รายงานผลลัพธ์ที่สูงกว่าในเกณฑ์มาตรฐานโค้ดและเทอร์มินัลที่ใช้ร่วมกัน แต่ส่วนต่างเล็กน้อย ทดสอบทั้งสองบนรีโพซิทอรีเป้าหมายและเลือกตามการเสร็จสิ้นงาน เวลาแฝง และต้นทุนรวม

รุ่นใดดีกว่าสำหรับเอเจนต์มัลติโหมด?

รุ่นมาตรฐานเป็นตัวเลือกธรรมชาติ เพราะรองรับอินพุตภาพ วิดีโอ และเสียงแบบเนทีฟ Pro มุ่งเน้นอินพุตข้อความ

ทีมผลิตควรเลือกอย่างไร?

เริ่มจากรุ่นมาตรฐาน วัดความล้มเหลว แล้วกำหนดเส้นทางเฉพาะงานข้อความที่ยากซึ่งได้ประโยชน์จาก Pro เปรียบเทียบต้นทุนต่อภารกิจที่เสร็จสมบูรณ์ มากกว่าราคาเฉพาะต่อโทเค็นเท่านั้น

เรียนรู้ต่อ

เชื่อมโยงบทความนี้กับการตัดสินใจถัดไป

ดูทุกหัวข้อ
เผยแพร่เมื่อ Oct 5, 2026
อัปเดตล่าสุด Oct 5, 2026
0 ครั้งที่ดู
ตรวจสอบความชัดเจน การอ้างอิงแหล่งที่มา และคำศัพท์ API ปัจจุบันแล้ว

อ่านเพิ่มเติม