Kimi K3 is now live on CometAPI →

ما هو Kimi K3: الاختبارات المعيارية، القدرات، ودليل الوصول في عام 2026

CometAPI
AnnaJul 20, 2026
ما هو Kimi K3: الاختبارات المعيارية، القدرات، ودليل الوصول في عام 2026

TLDR: أطلقت Moonshot AI Kimi K3 في 16 يوليو 2026 – نموذجاً مفتوح الأوزان ثورياً بعدد 2.8 تريليون مُعامِل (الأول في فئة 3T) مع تعددية نمطية أصلية، وسياق من مليون رمز، وأداء على مستوى الحدود يتفوق أو يضاهي النماذج المغلقة الرائدة مثل Claude Fable 5 وGPT-5.6 Sol في البرمجة، والمهام الوكيلية، وتطوير الواجهات الأمامية، وأعمال المعرفة.

أهم الخلاصات

  • الحجم والابتكار: 2.8T مُعامِل، MoE مع 16/896 خبيراً نشطاً، Kimi Delta Attention (KDA)، Attention Residuals – ~2.5x كفاءة تحجيم مقارنةً بـ K2، Kimi K3 - Kimi API Platform
  • الأداء: Artificial Analysis Intelligence Index ~57 (ضمن أفضل 4، متقدماً على Claude Opus 4.8)، يتصدر Frontend Code Arena، قوي في Terminal-Bench (88.3%)، وBrowseComp (91.2%)، وGPQA-Diamond (93.5%). يتأخر إجمالاً عن Fable 5/Sol لكنه يتفوق على معظم الآخرين؛ المركز 1 على Arena.ai Frontend Code Arena (1,679 Elo، متفوقاً على Fable 5)، منشور Arena على X وتغطية Tom's Hardware.
  • القدرات: رؤية/فيديو أصليان، سياق 1M للمستودعات/قواعد الشيفرة الضخمة، برمجة وكيلية، استدلال ثلاثي الأبعاد، تحرير فيديو، لوحات معلومات للبحث.
  • الوصول: فوري عبر kimi.com، وواجهة برمجة التطبيقات (نموذج kimi-k3، دليل الوصول)؛ الأوزان المفتوحة قريباً. أوقفت Moonshot مؤقتاً اشتراكات Kimi K3 الجديدة بعد طفرة الطلب. تكامل سهل عبر CometAPI.
  • القيمة: تكلفة أقل لكل مهمة (~$0.94 في بعض التقييمات)، رفضات أقل، مثالي لتدفقات عمل البرمجة/الرؤية.

مدونة Kimi K3 التقنية تصف Kimi K3 بأنه "ذكاء حدودي مفتوح، إذ يمثّل Kimi K3 لحظة محورية في ديمقراطية الذكاء الاصطناعي. ومع دفع مختبرات الذكاء الاصطناعي الصينية مثل Moonshot للحدود رغم قيود الحوسبة، يتحدى هذا النموذج المفتوح هيمنة النماذج الأميركية المغلقة ويمكّن المطورين حول العالم."

ما هو Kimi K3؟ نموذج مفتوح من فئة 3T من Moonshot AI

أطلقت Moonshot AI، وهي شركة ناشئة مقرّها بكين، Kimi K3 في 16 يوليو 2026 كنموذجها الرائد. وهو مُحدَّد صراحةً كأول نموذج مفتوح في فئة نحو 3 تريليونات مُعامِل، بعدد إجمالي 2.8 تريليون مُعامِل ضمن بنية Mixture-of-Experts (MoE) متناثرة. لا يتفعّل سوى 16 من أصل 896 خبيراً لكل رمز، ما يوازن بين الحجم الهائل والكفاءة.

يبني هذا على سلسلة Kimi K2 (K2.5، K2.6، إلخ) التي اكتسبت زخماً بالفعل في البرمجة وتعدد الوسائط. يقدّم K3 ابتكارات معمارية: Kimi Delta Attention (KDA) وAttention Residuals (AttnRes)، إضافةً إلى Stable LatentMoE والتدريب الواعي بالتكميم (MXFP4 للأوزان، وMXFP8 للتنشيطات اعتباراً من مرحلة SFT). تؤدي هذه إلى ~2.5x كفاءة تحجيم أفضل وحتى 6.3x تسريع في فك التشفير مقارنةً بالسابقين.

المواصفات الرئيسية (Kimi K3 Technical Specifications):

  • المُعاملات: 2.8T إجمالي (MoE متناثر).
  • نافذة السياق: 1,048,576 رمزاً (~1M).
  • الأشكال النمطية: فهم نص + صورة + فيديو أصلي؛ مخرجات نصية.
  • الإخراج الأقصى: افتراضياً 131k رمزاً، حتى حد السياق.
  • الاستدلال: جهد أقصى افتراضياً عند الإطلاق؛ أوضاع أقل/أعلى قادمة.
  • الأوزان المفتوحة: مُوعَد بها بحلول 27 يوليو 2026 (ترخيص مُعدَّل على نمط MIT، وفقاً لسابقة K2).

يستهدف K3 المهام طويلة الأمد — ليس الإجابات السريعة فقط، بل إنجاز مهام هندسية وبحثية أو تدفقات عمل وكيلية مع تغذية راجعة مرئية ("الرؤية ضمن الحلقة"). تشمل العروض مُصرّف GPU ذاتي البناء (ينافس Triton)، وتصميم رقائق على عملية 45nm، وبحوث فيزياء فلكية سريعة.

الطلب ضغط السعة بالفعل

كان استقبال النموذج مبكراً قوياً بما يكفي لخلق ضغط على السعة. نشرت Moonshot على X أن الطلب خلال الـ 48 ساعة السابقة دفعها إلى الاقتراب من حدود وحدات GPU الحالية، وأن الاشتراكات الجديدة ستتوقف مؤقتاً بينما تضيف الشركة سعة إضافية. ذكرت Business Insider التوقف المؤقت نفسه وأشارت إلى أن المشتركين الحاليين لم يتأثروا.

يهم هذا في تخطيط الإنتاج. قد يكون النموذج ممتازاً ومع ذلك يواجه قيود توفر إذا تجاوز الطلب القدرة الحاسوبية. على الفرق التي تقيّم Kimi K3 تجنّب الاعتماد على مزوّد واحد، ومراقبة زمن الاستجابة ومعدلات الأخطاء، واستخدام التوجيه الاحتياطي عبر مزوّد موحّد مثل CometAPI حيثما أمكن.

معايير البرمجة: حيث يبدو Kimi K3 الأقوى

ملف Kimi K3 في البرمجة هو السبب الأساسي لاهتمام المطورين. يكاد يتعادل مع GPT-5.6 Sol على Terminal-Bench 2.1، ويتفوّق بشكل طفيف على GPT-5.6 Sol وClaude Fable 5 على Program Bench، ويتقدّم على GPT-5.6 Sol بهامش ملحوظ على FrontierSWE. كما يتفوّق على النماذج المقارنة في SWE Marathon ضمن جدول OpenLM.

تضيف نتيجة الواجهة الأمامية على Arena إشارة عملية أخرى. سجّل Kimi K3 عدد 1679 نقطة على Frontend Code Arena، متقدماً على Claude Fable 5. يهم هذا المعيار لأن عمل الواجهة الأمامية يُحكم عليه غالباً بتفضيل بشري، وليس بالاختبارات الوحدوية فقط. مُساعد برمجة قادر على إنتاج واجهات مستخدم نظيفة ومتناسقة بصرياً من مُدخل نصي هو قيمة كبيرة لفرق المنتجات والوكالات وبناة SaaS والأدوات الداخلية.

جداول الترتيب العامة

  • Artificial Analysis AI Leaderboard: ظهوره الأول في المركز #3. تضعه درجات Intelligence Index ضمن منافسة قوية (مثلاً ~57.1 في بعض التقييمات).
  • تقييم خاص لأعمال المعرفة طويلة الأمد: Elo بمقدار 1547 (+732 عن K2.6)، خلف Fable 5 فقط.

معايير البرمجة والوكالة (مُبلغ عنها ذاتياً ومستقلة)

يبرز K3 هنا، مستفيداً من حجمه وبنيته لأداء وكيل مستدام.

  • Frontend Code Arena (Arena.ai): المركز #1 مع 1,679 نقطة، متفوقاً على Fable 5 وGPT-5.6 Sol. يتألق في تفضيل المطورين الأعمى لمهام تطوير الويب.
  • DeepSWE: 67.3–67.5 (قوي، باستخدام KimiCode harness).
  • Program Bench: المركز #1 عند 77.8.
  • SWE Marathon: المركز #1 عند 42.0 (في بعض الحِزَم).
  • Terminal-Bench 2.1: تنافسي، قريب من GPT-5.6 Sol.

الرؤية وتعدد الوسائط

التدريب الأصلي (غير المُضاف لاحقاً) يُنتج نتائج متينة:

  • MMMU-Pro: ‏81.6%
  • MathVision: تنافسي/تسعينيات مرتفعة في بعض التقارير.
  • OmniDocBench: ‏91.1% (يتصدر).

يدعم لقطات الشاشة والمخططات والفيديو لمهام الحلقة المغلقة مثل تحسين واجهات المستخدم أو تطوير الألعاب.

جدول المقارنة: Kimi K3 مقابل النماذج الرائدة (تقريبي/مجمّع من التقارير؛ Max Effort حيث ذُكر)

BenchmarkKimi K3Claude Fable 5GPT-5.6 SolNotes/Source
Frontend Code Arena1,679 (#1)LowerLowerArena.ai
DeepSWE67.3–67.5Competitive-Moonshot/KimiCode
Program Bench77.8 (#1)-CloseVals.ai
Intelligence Index (AA)~57.1~59.9~58.9Artificial Analysis
Long-Horizon Elo1547Higher-Internal Moonshot
Cost per Task (Evals)~$0.94HigherHigherIndependent

المصدر: المدونة التقنية لـ Moonshot، وجداول مستقلة وتحليلات. قد تختلف النتائج بحسب الحِزَم/الجهد؛ تحقّق دائماً من الأحدث.

يُظهر K3 رفضات أقل في المواضيع الحساسة واتساقاً قوياً في التدفقات الوكيلية. تؤكد الاختبارات المستقلة (مثل تقييمات YouTube وVals AI) أنه من أقوى النماذج المفتوحة للبرمجة الواقعية.

ماذا يمكن لـ Kimi K3 أن يفعل؟ قدرات في البرمجة والرؤية وما وراءهما

البرمجة والهندسة الوكيلية

يحافظ K3 على جلسات طويلة بأقل إشراف: يتنقّل عبر مستودعات ضخمة، يستخدم الأدوات، يزيل الأخطاء عبر لقطات الشاشة ("الرؤية ضمن الحلقة").

أمثلة:

  • تحسين النواة وتطوير المُصرّفات: بنى MiniTriton (مُصرّف شبيه بـ Triton) من الصفر، ينافس الأُطر المُحسّنة. حسّن نوى GPU بمستوى تنافسي مع Fable 5.
  • تطوير الألعاب: يحوّل المفاهيم/الصور/الفيديو إلى تجارب ثلاثية الأبعاد/متعددة اللاعبين قابلة للعب مع تحسين تكراري.
  • تصميم الرقائق: تشغيل ذاتي لمدة 48 ساعة لتصميم نموذج رقاقة.
  • الواجهة الأمامية: يتصدر جداول مهام تطبيقات الويب والمهام الكاملة.

الرؤية وتعدد الوسائط

الفهم الأصلي للصور/الفيديو يمكّن من:

  • تحرير الفيديو: حرّر مقطعه التشويقي من 56 مقطعاً (اختيار، قص، مزامنة، مراجعات) — ساعات من العمل في دقائق.
  • استدلال ثلاثي الأبعاد، رسوم متحركة، لوحات تفاعلية.
  • "الرؤية ضمن الحلقة" لتكرار الشيفرة عبر لقطات الشاشة.

تُظهر مستندات Kimi API إدخال الصور عبر روابط بيانات base64 وإدخال الفيديو عبر ملفات مُحمّلة يُشار إليها بـ ms://. كما تُحذّر من أن روابط الصور العامة غير مدعومة في إدخال الرؤية، لذا ينبغي للمطورين إرسال base64 أو مراجع الملفات المُحمّلة وجعل محتوى الرسالة مصفوفة من الكائنات. هذه نقطة تنفيذ مهمة: لا تُسلسل رسالة مختلطة صورة ونص في سلسلة نصية عادية واحدة.

أعمال المعرفة والبحث

بالنسبة للأعمال، قد يكون هذا أكثر قيمة من روبوت دردشة عادي. صُمّم النموذج لأعمال "وكيلية" حيث يمكنه الحفاظ على خطة، استدعاء أدوات، معالجة النتائج الوسيطة، وإنتاج مُخرَج نهائي. تشمل الأمثلة تقارير أبحاث السوق، ومساعدي تنظيف البيانات، والملخصات الامتثالية، وصيانة قواعد معرفة دعم العملاء، ومساعدي البرمجة الداخليين.

  • يُنتج تقارير بمستوى استشاري، وتصويرات تفاعلية، ولوحات معلومات (مثلاً تحليل صناعة ASIC على مدى 42 عاماً من آلاف المصادر).
  • مسارات علمية: أعاد إنتاج علاقات فيزياء فلكية، وحلّل موجات الجاذبية مع وكلاء فرعيين.
  • عناصر واجهة/لوحات في Kimi Work لعرض دائم قائم على البيانات.

يجسر K3 الفجوة بين الأدبيات والشيفرة القابلة للتنفيذ، منتجاً مخرجات بمستوى النشر بكفاءة.

Kimi K3 مقابل نماذج الحدود الأخرى: مقارنة عملية

ModelBest fitStrengthsWatch-outsCometAPI recommendation
Kimi K3سياق طويل للبرمجة، وأعمال المعرفة، والوكلاء، والاستدلال البصريحجم 2.8T بنية MoE، سياق 1M، معايير قوية في البرمجة والوكالة، خارطة طريق للأوزان المفتوحةضغط سعة في أسبوع الإطلاق، حساسية لتاريخ التفكير، دعم الرؤية قد يختلف بحسب مسار التكاملاختبره كنموذج رائد للبرمجة والسياق الطويل
GPT-5.6 Solالاستدلال الصعب، البرمجة، البحث، مهام الإنتاج الواسعةملف معايير قوي جداً وأدوات ناضجةسعر أعلى في مسارات عديدةاستخدمه للمقارنة والتصعيد
Claude Fable 5الكتابة، البرمجة، التدفقات الوكيلية، مهام تفضيل بشريتجربة مستخدم قوية وأداء حدودي واسعتكلفة أعلى واحتمال سياسات ارتجاع في بعض المهامقارن للاستخدمات المواجهة للمستخدم والكتابة المكثفة
Claude Opus 4.8استدلال عميق وعمل احترافي موثوقسلوك مساعد مستقر رفيع المستوىأقدم من الإصدارات الرائدة الأحدثاحتفظ به كرجوع أو خط أساس
GLM-5.2تقييم نموذج مفتوح منخفض التكلفةبديل تنافسي من النماذج المفتوحةأضعف في عدة مقارنات مع K3 المذكورةضمّنه في اختبارات التوجيه حسب التكلفة/الأداء

كيفية الوصول إلى Kimi K3: دليل خطوة بخطوة

  1. الويب/التطبيق: زر kimi.com أو حمّل تطبيق Kimi (iOS/Android). اختر K3 (K3 Max أو Swarm Max).
  2. Kimi Code: موجّه للمطورين عبر الطرفية/بيئات التطوير. رائع للوكلاء البرمجيين.
  3. وصول API:
    • Base URL: https://api.moonshot.ai/v1
    • Model: kimi-k3
    • احصل على مفتاح API عبر platform.moonshot.ai/console.
    • مثال SDK متوافق مع OpenAI (Python):

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.moonshot.ai/v1")
response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "نص طلبك"}]
)

يدعم الأدوات، ووضع JSON، وتخزين السياق المؤقت. التسعير: $3 إدخال، $15 إخراج لكل M من الرموز (التخزين المؤقت $0.30).

  1. المجمّعات: استخدم CometAPI (cometapi.com) للوصول الموحّد إلى Kimi K3 + أكثر من 500 نموذج بمفتاح واحد، وتكاليف أقل (توفير 20-40%)، وسهولة التبديل. مثالي للإنتاج — متوافق مع OpenAI مباشرةً، وزمن استجابة منخفض.
  2. الاستضافة الذاتية: بعد 27 يوليو إصدار الأوزان على Hugging Face. توقّع متطلبات عتاد ثقيلة (supernodes، موصًى بـ 64+ مُسرِّع). ستتبع أدوات المجتمع مثل vLLM.

توصية CometAPI: دمج Kimi K3 عبر CometAPI لتجنّب تعدد المفاتيح/الفوترة. اختبره جنباً إلى جنب مع Claude/GPT لاختبارات A/B، حسّن التكاليف، وتوسّع بثبات. تتتبّع منصتهم الاستخدام عبر النماذج — مثالية لمراقبة تجارب K3. سجّل في cometapi.com للحصول على أرصدة مجانية ووصول موحّد.

الخلاصة النهائية

Kimi K3 واحد من أهم إطلاقات النماذج في 2026 حتى الآن. يجمع بين حجم هائل، واستراتيجية جادة للأوزان المفتوحة، ونافذة سياق بمليون رمز، وفهم بصري أصلي، ونتائج معايير تضعه قرب قمة أنظمة الذكاء الاصطناعي للبرمجة والوكالة حالياً. لا يُلغي الحاجة إلى GPT أو Claude أو Gemini أو DeepSeek أو Qwen أو غيرها، لكنه يمنح المطورين خياراً موثوقاً للمهام الأصعب ذات السياق الطويل.

ابدأ اليوم على kimi.com أو عبر CometAPI لدمج سلس. جرّب قوته في البرمجة والرؤية — النتائج تتحدث عن نفسها.

هل أنت مستعد لخفض تكاليف تطوير الذكاء الاصطناعي بنسبة 20%؟

ابدأ مجاناً في دقائق. رصيد تجريبي مجاني مدرج. لا حاجة لبطاقة ائتمانية.

اقرأ المزيد