خلاصة سريعة: شهد يوليو 2026 إطلاق ستة نماذج رئيسية خلال نحو ثلاثة أسابيع: عائلة GPT-5.6 ثلاثية المستويات من OpenAI (Sol/Terra/Luna)، وGemini 3.6 Flash من Google، وGrok 4.5 من xAI، وKimi K3 من Moonshot AI، وClaude Opus 5 من Anthropic، وGLM-5.2 من Zhipu. لا يوجد خيار أفضل شامل للجميع. القرار العملي يعتمد على عمق الاستدلال، وأداء البرمجة، وتكلفة كل رمز، ومتطلبات السياق، وما إذا كان نشر الأوزان المفتوحة مهمًا. يستند هذا القياس إلى معلومات المزودين الرسميين وقوائم CometAPI، مع وسم ادعاءات الاختبارات القياسية بحسب المصدر بدلًا من التعامل معها كتصنيف موحّد.
أهم النقاط:
- GPT-5.6 ليس نموذجًا واحدًا — بل ثلاثة (Sol وTerra وLuna) بثلاث نقاط سعر مختلفة، واختيار المستوى الخاطئ قد يكون خطأً ماليًا أكبر من اختيار عائلة النماذج الخاطئة بالكامل.
- كل من Gemini 3.6 Flash وGLM-5.2 ينشر نافذة سياق من 1,000,000 رمز؛ وKimi K3 يطابق هذا الرقم أيضًا — لقد توقفت سعة السياق عن كونها عامل تمييز بين نماذج هذا الجيل الرائد.
- يدعم كل من GLM-5.2 وKimi K3 نشر الأوزان المفتوحة، لكنهما لا يستخدمان الترخيص نفسه. أُطلق GLM-5.2 تحت ترخيص MIT؛ بينما يستخدم Kimi K3 ترخيص Kimi K3 المنفصل، الذي ينبغي مراجعة شروطه التجارية قبل الاستضافة الذاتية أو تقديم خدمة النموذج كخدمة.
- تم إصدار Claude Opus 5 رسميًا. أعلنت Anthropic عنه في 24 يوليو 2026 مع نافذة سياق 1M رمز، ومخرجات متزامنة حتى 128K، وتسعير رسمي 5 دولارات لكل مليون رموز إدخال و25 دولارًا لكل مليون رموز مخرجات؛ يسجّل CometAPI حاليًا 4/20 دولارات.
ما الذي شُحن فعليًا هذا الشهر
كان يوليو 2026 شهرًا كثيفًا على نحو غير معتاد لإصدارات النماذج الحدّية والقريبة من الحدّية. في نحو ثلاثة أسابيع، شحنت OpenAI عائلة GPT-5.6 (9 يوليو)، وأصدرت xAI نموذج Grok 4.5 (8 يوليو)، وأطلقت Moonshot AI نموذج Kimi K3 (16 يوليو)، وأصدرت Google نموذج Gemini 3.6 Flash (21 يوليو)، وأطلقت Anthropic رسميًا Claude Opus 5 (24 يوليو). وصل GLM-5.2 من Zhipu في يونيو قبل ذلك بقليل، لكن نافذة السياق 1M وترخيص MIT المفتوح يجعلان منه ذا صلة بقرار الشراء والنشر نفسه.
السؤال العملي لأي شخص يبني على هذه النماذج ليس أيها الأفضل بالمطلق، بل أي خيار مؤكّد يناسب مهمة محددة. تختلف النماذج الستة بوضوح في التكلفة، والسياق، وسلوك البرمجة، والترخيص، ومرونة النشر.
التسعير والمواصفات، جنبًا إلى جنب
جميع الأسعار أدناه لكل مليون رمز. حيثما كان للنموذج عدة مستويات، يُذكر كل منها على حدة.
| النموذج | الإدخال | المخرجات | نافذة السياق | الترخيص | تاريخ الإصدار |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | غير مُحدَّد علنًا | ملكي | 9 يوليو 2026 |
| GPT-5.6 Terra | $2.50 | $15.00 | غير مُحدَّد علنًا | ملكي | 9 يوليو 2026 |
| GPT-5.6 Luna | $1.00 | $6.00 | غير مُحدَّد علنًا | ملكي | 9 يوليو 2026 |
| Grok 4.5 | $2.00 | $4.00 | غير مُحدَّد علنًا | ملكي | 8 يوليو 2026 |
| Kimi K3 | $3.00 | $15.00 | 1,048,576 رمز (65,536 مخرجات) | أوزان مفتوحة (ترخيص Kimi K3) | 16 يوليو 2026 |
| Gemini 3.6 Flash | $1.50 | $7.50 | 1,048,576 رمز (65,536 مخرجات) | ملكي | 21 يوليو 2026 |
| GLM-5.2 | $1.40 | $4.41 | 1,000,000 رمز | مفتوح (ترخيص MIT) | 13 يونيو 2026 |
| Claude Opus 5 | $5.00 | $25.00 | 1,000,000 رمز (128K مخرجات) | ملكي | 24 يوليو 2026 |
*الأسعار أعلاه هي أسعار المزوّدين الرسمية؛ سيؤدي تطبيق خصم موحّد عبر واجهة برمجة تطبيقات موحّدة إلى خفض كل هذه الأسعار بشكل متناسب — المغزى من الجدول هو الفجوة النسبية بين النماذج، وليس سعر الدفع لدى بائع معيّن.
تبرز عدة أمور من جدول التسعير والمواصفات. Sol، أعلى مستويات GPT-5.6، مُسعّر للاستدلال الحدّي والعمل الوكيلي البرمجي والمهام التقنية بعيدة الأمد أكثر منه للاستخدام اليومي، بينما سعر مخرجات Grok 4.5 منخفض نسبيًا قياسًا بتموضعه. لدى GLM-5.2 أدنى سعر للمخرجات ضمن هذه المجموعة ويستخدم ترخيص MIT المتساهل. يوفّر Kimi K3 أيضًا أوزانًا قابلة للتنزيل ونافذة سياق 1M، لكن تحت ترخيص Kimi K3 بدل MIT. تنشر نماذج Gemini 3.6 Flash وKimi K3 وGLM-5.2 وClaude Opus 5 نوافذ سياق تقارب 1M، لذا لم يعد حجم السياق وحده كافيًا للاختيار بينها. تكون أسعار CometAPI المدرجة عمومًا أقل من أسعار مزوّدي الخدمة، لكن تظل المقارنة على مستوى عبء العمل أكثر فائدة من مقارنة أسعار الرموز بمعزل.
ما الذي يُضبط كل واحد عليه فعليًا
GPT-5.6 Sol مُتموضع للاستدلال الحدّي، والبرمجة الوكيلية، والعمل التقني بعيد الأمد — يدعم نمط "Max Reasoning Effort" و"Ultra Mode" الذي ينشر وكلاء فرعيين بالتوازي. هذا هو المستوى المناسب للمشكلات الصعبة متعددة الخطوات، وليس للمهام الروتينية، بالنظر إلى فجوة السعر مقارنة بـTerra وLuna.
GPT-5.6 Terra هو المستوى المتوسط المتوازن — الإنتاجية اليومية، والتوثيق، ودعم البرمجة، وأتمتة الأعمال. بالنسبة لمعظم الواجهات الخلفية للتطبيقات التي لا تحتاج تحديدًا إلى عمق استدلال Sol، يُعد Terra هو الافتراضي الأكثر قابلية للدفاع.
GPT-5.6 Luna يستهدف الاستخدامات الخفيفة وعالية الحجم: التصنيف، وتدفقات دعم العملاء، والإعداد، وتوليد المحتوى المتكرر. بسعر $1.00/$6.00 لكل مليون رمز (قبل أي خصم من البوابة)، فهو مُسعّر تمامًا لهذا النوع من أعباء العمل عالية الاستدعاء ومنخفضة التعقيد — ويدعم أيضًا تسعير الإدخال المُخزَّن مؤقتًا بخصم 90% عن سعر الإدخال القياسي، وهو ما يهم هنا أكثر من المستويين الأعلى نظرًا لمدى تكرارية أعباء العمل عالية الحجم.
Grok 4.5 لا ينشر تخصيصًا معلنًا كما تفعل مستويات GPT-5.6، لكن تسعيره يضعه بين خيارٍ منخفض الميزانية ومتوسط — يستحق مقارنةً مباشرةً بالاختبارات ضد Terra أو Kimi K3 لعبء عمل محدد بدل افتراض التموضع من السعر وحده.
Kimi K3 هو نموذج Mixture-of-Experts بعدد 2.8 تريليون معلمة بُني للبرمجة بعيدة الأمد، والعمل المعرفي متعدد الوسائط، والتحليل المكثّف للوثائق أو المستودعات ضمن سياق 1M رمز. أصدرت Moonshot AI الأوزان كاملة، لذا الاستضافة الذاتية ممكنة، لكن الإصدار يستخدم ترخيص Kimi K3، الذي يتضمن شروطًا تجارية تختلف عن إصدار MIT القياسي.
Gemini 3.6 Flash هو إصدار Google المُركّز على الكفاءة: مُقدَّم صراحةً كمتابعة تراكمية محسّنة للتكلفة والزمن لـ3.5 Flash بدل أن يكون نموذجًا حدّيًا جديدًا، مع مكاسب فعلية في اختبارات البرمجة والوكالة إلى جانب سعر مخرجات أقل لكل رمز من سلفه. إنه الخيار لأعباء العمل الوكيلية حيث تهم كفاءة الرموز وتكلفة كل مهمة مكتملة بقدر أهمية القدرة الخام.
GLM-5.2 هو الخيار المفتوح الأكثر تسامحًا في هذا القياس. أطلقته Z.ai تحت ترخيص MIT مع سياق 1M وتركيز صريح على البرمجة بعيدة الأمد، واستخدام الأدوات، وجهد التفكير القابل للضبط. يمكن للفرق الوصول إليه عبر واجهة برمجة تطبيقات أو تشغيل الأوزان المنشورة محليًا، رهناً بمتطلبات البنية التحتية والتقييم الخاصة بها.
مقارنة قدرات البرمجة
تستهدف الإصدارات الستة أنماطًا هندسية مختلفة، لذا يُفهم الأداء البرمجي على أنه ملاءمة لعبء العمل لا ترتيبًا واحدًا.
- يعد Claude Opus 5 الأنسب هنا للتصحيح الصعب، وتحليل السبب الجذري، وإعادة الهيكلة واسعة النطاق، والوكلاء البرمجيين طويلة التشغيل؛ تسلط Anthropic الضوء على سلوك تحقق وتكرار أقوى.
- توفر GPT-5.6 Sol وTerra وLuna مسارًا متدرجًا من البرمجة والاستدلال المعقدين إلى العمل التطويري المتوازن ومساعدة البرمجة عالية الحجم.
- تم ضبط Gemini 3.6 Flash لحلقات البرمجة الوكيلية السريعة حيث تهم الكُمون وتكلفة كل تكرار.
- صُمم Kimi K3 للبرمجة بعيدة الأمد على مستودعات كبيرة جدًا، مع سياق 1M وأوزان قابلة للتنزيل.
- يجمع GLM-5.2 بين البرمجة بعيدة الأمد، واستخدام الأدوات، وجهد التفكير القابل للضبط، ونشرًا محليًا بترخيص MIT.
- يُفضَّل التعامل مع Grok 4.5 كمرشح لتقييم مباشر مقابل الآخرين لأن تموضعه الرسمي لا يقدّم تفكيك تخصيص البرمجة ذاته كعائلة GPT المتدرجة.
مفاضلة المقارنة (والتبديل بين) النماذج بهذا التواتر
لا يُعد أيٌ من هذا حُجّة لملاحقة كل إصدار جديد. إن نقل أعباء العمل الإنتاجية إلى نموذج جديد في كل مرة يُشحن فيها له تكاليف فعلية: إعادة اختبار الموجهات، وإعادة التحقق من جودة المخرجات، وإعادة فحص تكلفة كل مهمة وفق حركتك الفعلية، لا وفق اختبار قياسي اصطناعي. لا تزيل واجهة برمجة تطبيقات موحّدة ذلك العمل التقييمي، لكنها تزيل عبء الحسابات المنفصلة والفوترة المنفصلة لتشغيل المقارنة فعليًا — فالقدرة على استدعاء GPT-5.6 Terra وGemini 3.6 Flash وKimi K3 وGLM-5.2 عبر نفس شكل الطلب وفاتورة واحدة تجعل اختبار أكثر من مرشح قبل الالتزام أمرًا واقعيًا، بدل الافتراض بأن المزوّد الذي لديك مفتاحه مسبقًا هو الافتراضي.
هذا ميزة حقيقية، وليس حلاً كاملاً — لا يغني عن قراءة وثائق كل نموذج بالفعل، ولا يجعل اختيار النموذج خاليًا من تكاليف الانتقال الموضحة أعلاه. ما يفعله هو خفض تكلفة معرفة أي نموذج مناسب فعليًا لعبء عمل معين، وهو ادعاء مختلف (وأصدق) من "هذا النموذج هو الأفضل".
الأسئلة الشائعة
ما أفضل نموذج ذكاء اصطناعي طُرح في يوليو 2026؟ لا توجد إجابة واحدة. يستهدف GPT-5.6 Sol وClaude Opus 5 أعمال الاستدلال والبرمجة الصعبة؛ يركز Gemini 3.6 Flash على الحلقات الوكيلية الكفؤة؛ يجمع Kimi K3 بين سياق طويل وأوزان مفتوحة؛ ويجمع GLM-5.2 بين قدرات بعيدة الأمد وترخيص MIT. يعتمد الخيار الصحيح على عبء العمل وقيود النشر.
هل GPT-5.6 نموذج واحد أم عدة؟ ثلاثة: Sol (الرائد، استدلال حدّي)، وTerra (متوازن، استخدام يومي)، وLuna (سريع ومنخفض التكلفة، مهام عالية الحجم) — لكل منها تسعير منفصل، من $0.80/$4.80 لكل مليون رمز لـLuna وصولًا إلى $4.00/$24.00 لـSol.
هل تم إصدار Claude Opus 5 رسميًا؟ نعم. أعلنت Anthropic عن Claude Opus 5 في 24 يوليو 2026. يصف الإصدار الرسمي نافذة سياق 1M ويركّز النموذج على البرمجة الوكيلية المعقدة والعمل المعرفي؛ التسعير الرسمي لواجهة البرمجة هو 5 دولارات لكل مليون رموز إدخال و25 دولارًا لكل مليون رموز مخرجات.
أيٌ من هذه النماذج هو الأرخص تشغيلًا على نطاق واسع؟ وفق أسعار المخرجات المدرجة من المزوّدين في الجدول، يُعد GLM-5.2 الخيار الأقل تكلفة ومتاحًا تحت ترخيص MIT. لدى Kimi K3 أيضًا أوزان مفتوحة، لكن ترخيص Kimi K3 المنفصل وبصمة النموذج الأكبر بكثير يغيّران اقتصاديات الاستضافة الذاتية. يعد GPT-5.6 Luna أقل الخيارات تكلفة بين النماذج الملكية المتاحة عبر واجهة برمجة تطبيقات فقط المذكورة هنا.
هل أحتاج لاختيار نموذج واحد والالتزام به، أم يمكنني اختبار عدة نماذج؟ غالبًا ما يستحق اختبار أكثر من نموذج مقابل موجهاتك وحركتك الفعلية تكلفة الإعداد قبل توجيه حركة الإنتاج — تجعل واجهة برمجة تطبيقات موحّدة (منها CometAPI) ذلك أرخص تحديدًا، لأنها تزيل عبء الحسابات المنفصلة لتشغيل المقارنة، لكنها لا تغني عن قراءة وثائق كل نموذج بحد ذاته.
الخلاصة
لم تُنتج موجة إصدارات يوليو 2026 فائزًا واضحًا واحدًا. لقد أنتجت ستة خيارات مؤكدة تتفاضل بشكل مختلف في عمق الاستدلال، وأداء البرمجة، وتكلفة الرموز، والسياق، والترخيص. يستهدف GPT-5.6 Sol وClaude Opus 5 أصعب أعمال الاستدلال والهندسة البرمجية؛ ويركّز Gemini 3.6 Flash وGPT-5.6 Luna على الكفاءة؛ ويقدّم Kimi K3 أوزانًا مفتوحة وسياقًا متعدد الوسائط بسعة 1M تحت ترخيصه الخاص؛ ويقدّم GLM-5.2 بديلًا بسياق 1M وترخيص MIT. كلها متاحة عبر CometAPI بمفتاح واحد، ما يجعل الاختبار المضبوط أسهل، لكن يجب أن يظل اختيار النموذج مبنيًا على الموجهات، والأدوات، وأهداف الكُمون، ومعايير النجاح لعبء العمل الفعلي.
