المواصفات التقنية لـ MiMo-V2.5-Pro
| المواصفة | MiMo-V2.5-Pro |
|---|---|
| معرّف النموذج | mimo-v2.5-pro |
| المزوّد | Xiaomi MiMo |
| نوع النموذج | نموذج لغة كبير ذي قدرات وكيليّة |
| البنية | مزيج خبراء متناثر |
| إجمالي المعاملات | 1.02T |
| المعاملات المفعّلة | 42B |
| نافذة السياق | 1M tokens |
| المخرجات | Text |
| بنية الانتباه | انتباه هجين (SWA + انتباه عالمي) |
| رموز التدريب | 27T |
| الحد الأقصى لسياق النموذج الأساسي | 256K |
| الحد الأقصى لسياق Pro | 1M |
| الترخيص | MIT |
التمييز بين 1.02T من إجمالي المعاملات و42B من المعاملات المفعّلة مهم. MiMo-V2.5-Pro هو نموذج MoE: كل رمز يفعّل فقط مجموعة فرعية من المعاملات المتاحة. هذا يغيّر بشكل كبير ملف حوسبته أثناء الاستدلال مقارنةً بنموذج كثيف يحتوي على 1T من المعاملات، رغم أن النموذج الكامل لا يزال يتطلب ذاكرة ونشرًا هائلين.
ما هي الميزات الرئيسية لـ MiMo-V2.5-Pro؟
1. بنية MoE متناثرة بمقياس تريليون
يتضمن MiMo-V2.5-Pro 1.02T من إجمالي المعاملات و42B من المعاملات المفعّلة.
تتضمن بنيته 384 خبيرًا موجّهًا، مع تفعيل ثمانية خبراء لكل رمز. يحتوي النموذج على 70 طبقة محوّلة، تتكون من طبقة كثيفة واحدة و69 طبقة MoE.
هذا يوفر قدرة تمثيلية أكبر بكثير من MiMo-V2.5 القياسي مع تجنب تكلفة الحوسبة لتفعيل جميع معاملات 1.02T لكل رمز.
الخلاصة العملية هي:
MiMo-V2.5-Pro هو نموذج بسعة كلية تبلغ تريليون معلمة، لكن حوسبته لكل رمز تُحكم بمسار معلماته المفعّلة البالغ 42B.
2. سياق من 1 مليون رمز
يدعم النموذج حتى 1M من الرموز في السياق.
هذه إحدى أهم القدرات للوكلاء المستقلين لأن سير العمل الطويل قد يراكم:
- مخرجات الأدوات
- الشيفرة المصدرية
- نتائج البحث
- التوثيق
- حالات الاستدلال الوسيطة
- تعليمات المستخدم
- سجلات التنفيذ
بدلاً من التلخيص المتكرر وإسقاط السياق القديم، يمكن للوكيل الاحتفاظ بتاريخ عمل أكبر بكثير.
يقوم تقييم السياق الطويل من Xiaomi باختبار النموذج تحديدًا من 32K حتى 1M من رموز الإدخال.
3. انتباه هجين بالنافذة المنزلقة والانتباه العالمي
يستخدم MiMo-V2.5-Pro نسبة 6:1 بين Sliding Window Attention (SWA) والانتباه العالمي، مع نافذة SWA من 128 رمزًا.
تتضمن البنية:
- 60 طبقة SWA
- 10 طبقات انتباه عالمي
- نافذة SWA من 128 رمزًا
تفيد تقارير Xiaomi بأن هذا التصميم يقلل تخزين ذاكرة KV بنحو 7× مع الحفاظ على أداء السياق الطويل عبر انحياز مصبّ الانتباه القابل للتعلّم.
هذا أحد أكثر الأجزاء التقنية أهمية في النموذج.
نافذة سياق 1M مكلفة إذا نفذت كل طبقة انتباهًا كاملاً على التسلسل بأكمله. يقلل الانتباه الهجين مقدار المعلومات التي تحتاج كل طبقة إلى الانتباه لها عالميًا مع الحفاظ على طبقات انتباه عالمي مخصصة للعلاقات بعيدة المدى.
4. تنبؤ متعدّد الرموز
يتضمن MiMo-V2.5-Pro ثلاث وحدات MTP خفيفة الوزن.
يسمح التنبؤ متعدد الرموز للنموذج بتنبؤ عدة رموز مستقبلية بطريقة يمكن استخدامها لفك ترميز بأسلوب تخميني وتسريع الاستدلال.
تفيد تقارير Xiaomi بأن بنية MTP الخاصة به يمكن أن تُثلّث سرعة الإخراج أثناء الاستدلال ضمن تكوين النشر الموصوف.
هذا مهم بشكل خاص للوكلاء لأن الوكيل قد يولد كميات كبيرة من المخرجات الوسيطة على مسار طويل. يمكن أن يؤثر تحسين سرعة توليد الرموز تأثيرًا ملموسًا على زمن المهمة الكلي.
5. تعلم التعزيز الوكيلي
يشمل مسار ما بعد التدريب لـ MiMo-V2.5-Pro:
- ضبطًا دقيقًا تحت الإشراف
- تعلم تعزيز وكيلّي واسع النطاق
- تقطيرًا على السياسة متعدد المعلمين (MOPD)
الهدف التدريبي موجّه صراحةً نحو سلوك الوكلاء المعقد بدلاً من مجرد الإجابة على أسئلة معايير ثابتة.
لهذا تتركز أقوى تقييمات النموذج حول الترميز، والتعامل مع الطرفية، والاستدلال في سياق طويل، ومعايير الوكلاء.
6. تهيئة مسبقة بـ 27T رمز
تم تهيئة MiMo-V2.5-Pro مسبقًا على نحو 27 تريليون رمز، باستخدام دقة مختلطة FP8 وطول تسلسل أصلي 32K قبل دعم نافذة السياق الممتدة إلى 1M.
يضع مقياس التهيئة المسبقة، جنبًا إلى جنب مع بنية MoE بمقياس التريليون، MiMo-V2.5-Pro بثبات ضمن فئة النماذج الحدّية الحالية.
كيف يؤدي MiMo-V2.5-Pro في المعايير؟
النتائج المنشورة مفيدة بشكل خاص لأنها تتضمن كلًا من معايير الاستدلال العامة وتقييمات الترميز/الوكلاء العملية.
| المعيار | نتيجة MiMo-V2.5-Pro | نوع التقييم |
|---|---|---|
| SWE-Bench Verified | 78.9 | هندسة البرمجيات |
| SWE-Bench Pro | 57.2 | هندسة البرمجيات |
| Terminal-Bench 2.0 | 68.4 | وكيل الطرفية |
| GSM8K | 99.6 | استدلال رياضي |
| GPQA Diamond | 66.7 | استدلال بمستوى الدراسات العليا |
| MMLU-Pro | 68.5 | استدلال عام |
| MMLU | 89.4 | معرفة/استدلال عام |
| MMLU-Redux | 92.8 | معرفة/استدلال عام |
| HumanEval+ | 75.6 | توليد الشيفرة |
| MBPP+ | 74.1 | برمجة بايثون |
| LiveCodeBench v6 | 39.6 | برمجة تنافسية |
| ARC-Challenge | 97.2 | استدلال |
| AIME 2024/2025 | 37.3 | رياضيات المسابقات |
تُظهر النتائج ملفًا قويًا بشكل خاص في هندسة البرمجيات والاستدلال الرياضي. يعد 78.9 على SWE-Bench Verified و68.4 على Terminal-Bench 2.0 ذا صلة خاصة بالمطورين الذين يبنون أنظمة ترميز مستقلة.
أداء السياق الطويل
نتائج السياق الطويل قد تكون أكثر إثارة للاهتمام من المعايير القياسية.
على تقييم GraphWalks، يحافظ MiMo-V2.5-Pro على أداء قابل للقياس عند أطوال سياق متطرفة:
| السياق | BFS | Parents |
|---|---|---|
| 512K | 0.56 | 0.92 |
| 1M | 0.37 | 0.62 |
تفيد Xiaomi بأن MiMo-V2-Pro السابق يتدهور بسرعة بعد 128K ويصل إلى 0.00 عند 1M في كل من المهمتين الفرعيتين، بينما يحتفظ V2.5-Pro بأداء غير صفري عند نافذة 1M الكاملة.
هذا فارق ذو معنى: نافذة 1M في MiMo-V2.5-Pro ليست مجرد حد أقصى نظري؛ إذ يُظهر تقييم السياق الطويل المنشور أداءً مفيدًا عميقًا داخل هذه النافذة.
أمثلة وكلاء في العالم الحقيقي
| المهمة | النتيجة المبلغ عنها |
|---|---|
| PKU SysY Compiler | 4.3 ساعات |
| Tool calls during compiler task | 672 |
| Compiler test cases passed | 233/233 |
| Full-stack video editor | 11.5 ساعات |
| Code generated for video editor | 8,192 lines |
| Human intervention | لم يُبلّغ عن شيء |
| Long-horizon tool calls | قرابة 1,000 |
هذه عروض توضيحية من Xiaomi وليست درجات معايير موحّدة.
MiMo-V2.5-Pro مقابل MiMo-V2.5
يشترك النموذجان في نفس الجيل لكنهما يستهدفان أعباء عمل مختلفة.
| المواصفة | MiMo-V2.5 | MiMo-V2.5-Pro |
|---|---|---|
| إجمالي المعاملات | 310B | 1.02T |
| المعاملات المفعّلة | 15B | 42B |
| السياق | 1M | 1M |
| الطبقات | 48 | 70 |
| الخبراء الموجّهون | 256 | 384 |
| خبراء لكل رمز | 8 | 8 |
| طبقات الانتباه الكامل | 9 | 10 |
| طبقات SWA | 39 | 60 |
| التركيز الرئيسي | وكلاء متعددة الوسائط | وكلاء معقدون/الترميز |
| فهم الفيديو/الصوت/الصورة | نعم | يركز أساساً على اللغة/الوكلاء |
| أداء الوكلاء بعيدة الأفق | قوي | رائد |
لذا فالاختيار ليس ببساطة "Pro أفضل".
إذا كانت الحاجة هي فهمًا أصليًا للصور والفيديو والصوت، فإن MiMo-V2.5 هو الاختيار الأنسب. أما إذا تمحور عبء العمل حول الاستدلال المعقد، وهندسة البرمجيات، والتعامل مع الطرفية، والوكلاء طويلو الأمد، فإن MiMo-V2.5-Pro هو الأنسب.
قيود MiMo-V2.5-Pro
1. إدخال النموذج نصي فقط
على عكس mimo-v2.5، تذكر مواصفة Pro رسميًا "Text" كنوع الإدخال. لا ينبغي تسويقه كنموذج متعدد الوسائط ضمن عائلة V2.5.
2. متطلبات حوسبة مرتفعة للاستضافة الذاتية
يمتلك النموذج تقريبًا 1T من إجمالي المعاملات / 42B من المعاملات المفعّلة، مما يجعل النشر المحلي أكثر تطلبًا بكثير من النماذج المفتوحة الصغيرة التقليدية.
3. يعتمد أداء الوكيل على الإطار
ترتبط مطالبة Xiaomi بما يقرب من 1,000 استدعاء أداة صراحةً باستخدام إطار وكيل مناسب. النموذج وحده لا يضمن أن تحقق التطبيقات نفس أداء الأفق الطويل.
4. التعامل مع محتوى الاستدلال
تحتاج تطبيقات الوكلاء متعددة الأدوار التي تستخدم وضع التفكير واستدعاءات الأدوات إلى الحفاظ على reasoning_content بشكل صحيح. قد يؤدي التعامل غير الصحيح إلى أخطاء API.
أفضل حالات الاستخدام
هندسة البرمجيات على نطاق واسع
- ترحيل المستودعات
- إعادة الهيكلة
- التنقيح
- توليد الاختبارات
- تطوير المترجمات
- تطوير تطبيقات شاملة الطبقات
وكلاء ترميز مستقلون
يُناسب MiMo-V2.5-Pro الوكلاء الذين يحتاجون إلى تكرار:
فحص → تعديل → تنفيذ → اختبار → تشخيص → تعديل
الاستدلال على مستندات طويلة
تجعل نافذة 1M منه مفيدًا لـ:
- العقود القانونية
- المواصفات التقنية
- مجموعات بحثية كبيرة
- وثائق المؤسسات
وكلاء أعمال معقدون
يمكن أن يدعم استدعاء الأدوات + البحث على الويب + المخرجات المهيكلة:
- وكلاء البحث
- وكلاء معالجة البيانات
- أتمتة سير عمل المؤسسات
- أنظمة اتخاذ القرار متعددة الخطوات
كيفية استخدام واجهة MiMo-V2.5-Pro على CometAPI
معرّف نموذج CometAPI ذي الصلة هو:
mimo-v2.5-pro
بالنسبة للمطورين، تكون طبقة تجميع واجهات API مفيدة بشكل خاص لاختبار MiMo-V2.5-Pro مقابل نماذج الاستدلال والوكلاء الراقية الأخرى دون صيانة تكاملات مزوّدين مستقلة.
الخطوة 1: الحصول على مفتاح CometAPI
أنشئ حساب CometAPI أو سجّل الدخول واحصل على مفتاح API من وحدة التحكم.
عيّنه كمتغير بيئي:
export COMETAPI_KEY="YOUR_COMETAPI_KEY"
الخطوة 2: تهيئة عميل الواجهة
توفر Xiaomi واجهة API متوافقة مع بروتوكولي OpenAI وAnthropic، مما يجعل الانتقال سلسًا نسبيًا. للتكامل الإنتاجي، استخدم نقطة النهاية/المخطط الحاليين لـ CometAPI لـ mimo-v2.5-pro، خصوصًا إذا كنت تحتاج ميزات متقدمة مثل استدعاء الأدوات، البث، المخرجات المهيكلة، أو طلبات السياق الطويل.
الخطوة 3: ربط MiMo-V2.5-Pro بالأدوات
يصبح النموذج أكثر فائدة بكثير عند ربطه بأدوات خارجية.
على سبيل المثال:
┌── Web Search
│
User → MiMo-V2.5-Pro ├── GitHub
│
├── Terminal
│
├── Database
│
└── Internal APIs
↓
Tool Results
↓
MiMo-V2.5-Pro
↓
Final Result
هذا المعمار يتماشى بشكل أوثق بكثير مع الاستخدام المقصود للنموذج مقارنةً بدمجه كبرنامج دردشة بسيط.