دخل Claude Opus 5.2 بهدوء مرحلة الاختبار الرمادي في Claude Code. منذ 14 سبتمبر 2026، أفاد المستخدمون بأنه يقدم أداءً أفضل بكثير من Opus 5 على الويب، مع استجابات أسرع، ومخرجات أنظف، وثبات أقوى في مهام البرمجة الطويلة.
لا تزال الأدلة العامة مبكرة: يعود كثير من النقاش إلى نفس الاختبارات الأولية ومجموعة صغيرة من المقارنات جنبًا إلى جنب. سلوك الاختبار الرمادي مرئي، لكن Anthropic لم تنشر بعد نقطة النهاية المستقرة والوثائق التقنية التي يحتاجها المطورون للاستخدام الإنتاجي.
الحالة:
اختبار رمادي في Claude Code
التوفر الرسمي عبر API:
لم يُعلن بعد
معرّف نموذج API العام:
لم يُنشر بعد
التسعير والمواصفات العامة:
لم تُنشر بعد
آخر تحقق:
15 سبتمبر 2026
ما هو Claude Opus 5.2؟
Claude Opus 5.2 هو نقطة التحقق التالية من Anthropic لسلسلة Opus التي بدأت بالظهور عبر توجيه انتقائي في Claude Code. بعض الطلبات المرسلة إلى "Opus 5" في Claude Code تصل إلى مسار 5.2 الجديد بينما يواصل Claude على الويب وبعض البيئات الطرفية الأخرى تقديم نموذج Opus 5 الحالي. هذا يفسر لماذا يمكن لواجهة المستخدم إظهار نفس اسم النموذج بينما تبدو النتائج مختلفة بشكل كبير.
نظرًا لأن الاختبار الرمادي يغيّر حركة المرور بشكل انتقائي، فلن يتلقى كل حساب أو جلسة النموذج نفسه. يمكن أيضًا أن تت放م الفروقات بفعل مطالبات النظام، وتكوين الأدوات، وإعدادات جهد الاستدلال. لذلك فإن أكثر الإشارات فائدة هي مزيج من معلومات المسار والتغيرات السلوكية القابلة للتكرار:
- توليد أسرع تحت مسار Claude Code؛
- تطبيقات أولية أنظف وأكثر اكتمالًا؛
- عمل ذاتي أطول دون مطالبات "المتابعة" المتكررة؛ و
- حلقات متكررة من المراجعة والاختبار في مهام البرمجة.
الـ 5.2 slug وإشارة التوجيه
أفاد بعض المختبرين أن التسمية الظاهرة في Claude Code تبقى "Opus 5" بينما يشير عرض الحالة أو slug الطلب إلى 5.2.
سيكون هذا دليلًا أقوى بكثير إذا أظهر رد خام أو سجل طلب أو مخرج /status قابل للتكرار ذلك المعرّف ويمكن التحقق منه بشكل مستقل. في الوقت الحالي، تعيد المنشورات العامة بشكل أساسي تكرار الادعاء؛ ولم يتم توثيق الأثر الأساسي والتحقق منه.
الميزات الرئيسية المرصودة في الاختبار الرمادي لـ Claude Opus 5.2
يركز المختبرون الأوائل باستمرار على السلوك بدلاً من المواصفات الرسمية.
استجابات أسرع
النموذج الموجّه أسرع بشكل ملحوظ من تجربة Opus 5 الموثقة في اختبارات المستخدمين المبكرة. لا يزال يلزم قياس زمن الاستجابة النهائي بعد وصول الوصول العام إلى API لأن إعدادات الجهد، وحمل النظام، وبنية التوجيه تؤثر أيضًا على السرعة.
مخرجات أنظف وأكثر اكتمالًا
تزعم مقارنات المجتمع أن المسار الجديد ينتج ملفات SVG مصقولة أكثر وتطبيقات أكثر اكتمالًا من مطالبة واحدة. في اختبارات برمجة قصصية، ورد أنه يتطلب تفاعلًا أقل للوصول إلى نتيجة قابلة للاستخدام.
سلوك أقل "كسلًا"
يقول عدة مختبرين إن النموذج أقل ميلًا لإرجاع مجرد هيكل عظمي، أو طلب من المستخدم المتابعة، أو التوقف قبل إكمال مهمة معقدة. بدلًا من ذلك، يُقال إنه يعمل عبر تسلسلات أطول ويقوم بتمريرات إضافية على مخرجاته الخاصة.
حلقات ترميز ذاتية أطول
ملاحظة شائعة التكرار هي أن النموذج أطلق "gauntlet loop": واصل الاختبار والتنقيح وتحسين الكود دون الحاجة إلى تعليمات متكررة. إذا كان ذلك قابلاً للتكرار، فسيكون ذا صلة خاصة بوكلاء البرمجة على مستوى المستودعات ومهام البرمجيات بعيدة الأفق.
معرفة أحدث
اقترح المستخدمون "اختبار Tibo": مع تعطيل البحث على الويب، اسأل النموذج ما إذا كان يعرف "Tibo, the reset guy". توثق وثائق Opus 5 الحالية تاريخ قطع معرفة موثوق عند مايو 2026، لذا فإن معرفة مرجع لاحق على الإنترنت قد توحي بنقطة تحقق أحدث.
لا يمكن للاختبار تحديد إصدار النموذج بمفرده. قد يأتي رد صحيح أيضًا من استرجاع مخفي، أو ذاكرة المحادثة، أو مطالبة نظام، أو مصدر سياقي آخر. إنه اختبار معرفة—وليس دليلًا على اسم "Opus 5.2".
أداء المعايير القياسية لـ Claude Opus 5.2
لا توجد نتائج معيارية موثوقة لـ Claude Opus 5.2، إذ لم تنشر Anthropic بطاقة نظام أو جدول تقييم.
النتيجة المبلغ عنها 62.8% على CoBench v2 تعود إلى نموذج داخلي منفصل من Anthropic يُعرف باسم "Model 2" والذي يُقال إنه تفوق على Mythos 5 بمقدار 12.5 نقطة ويُستخدم على نطاق واسع داخليًا لأعمال البرمجة. كما نوقش نظام RSI أكثر قدرة.
Claude Opus 5.2 مقابل Claude Opus 5 مقابل Claude Fable 5.1
تستهدف النماذج الثلاثة احتياجات متجاورة لكنها مختلفة. Opus 5 هو الخيار الافتراضي الأقل تكلفة من Anthropic للبرمجة المعقدة والعمل المؤسسي. Fable 5.1 هو الخيار الراسخ عالي المستوى لأصعب مهام الاستدلال ووكلاء بعيدة الأفق. Opus 5.2 هو مسار الاختبار الرمادي الجديد الذي يبدو أنه يقرّب Opus—أو ربما يدفعه إلى ما بعد—ذلك الحد الأمامي مع تحسين السرعة والمثابرة التي يختبرها المستخدمون في Claude Code.
| الفئة | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| الحالة الحالية | اختبار رمادي في Claude Code | متاح علنًا | متاح علنًا |
| مُعرّف Cometapi | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| أفضل ملاءمة | برمجة وكيليّة من الجيل التالي، تكرار ذاتي، مخرجات مصقولة من لقطة واحدة | برمجة معقدة عامة وأعباء عمل مؤسسية بتكلفة متوازنة | أصعب الاستدلال، البحث، وعمل الوكلاء بعيد الأفق |
| السلوك الملحوظ | أسرع، وأنظف، وأكثر استعدادًا للتكرار وإتمام المهام الطويلة | قادر واقتصادي، لكن المستخدمين يبلغون عن سلوك أبطأ أو أقل مثابرة في بعض المهام الطويلة | أقوى نتائج Claude المنشورة في اختبارات البحث والوكلاء الم demanding؛ قد يكون مسهبًا |
| نافذة السياق | لم تُنشر بعد | 1M tokens | 1M tokens |
| الحد الأقصى للمخرجات | لم تُنشر بعد | 128K tokens | 128K tokens |
| تاريخ قطع المعرفة الموثوق | لوحظت معرفة أحدث في الاختبار؛ التاريخ غير منشور | مايو 2026 | يونيو 2026 |
| سعر الإدخال/الإخراج الرسمي | لم يُنشر بعد | $5 / $25 per MTok | $10 / $50 per MTok |
| AA Intelligence Index المستقل | لم يُختبر بعد | 51 | 53 |
| سرعة المخرجات المرصودة مستقلًا | لم تُختبر بعد | 51.7 tokens/s | 65.1 tokens/s |
تأتي الأرقام المستقلة أعلاه من Artificial Analysis عند المتغيرات ذات الاستدلال التكيفي المختبرة. تُظهر أن Fable 5.1 يتفوق على Opus 5 بنقطتين في Intelligence Index ويولد مخرجات أسرع بنحو 26% في التكوين المقاس، لكن سعره المُعلن أعلى بمرتين. لا تشمل هذه النتائج Opus 5.2 بعد لأن مسار الاختبار الرمادي لا يعرّض نقطة نهاية عامة مستقرة للاختبارات المستقلة.
يُغيّر Opus 5.2 المقارنة العملية. تشير جلسات Claude Code المبكرة إلى نموذج يستجيب أسرع من Opus 5، ويقدم تصاميم أكثر اكتمالًا من نفس المطالبة، ويواصل اختبار الكود وصقله دون دفع. بمجرد توفر API العامة له، سيكون السؤال الأهم هو ما إذا كانت تلك التحسينات تتفوق أيضًا على Fable 5.1 في معايير الوكلاء المضبوطة—وبأي سعر.
أفضل ما يُستخدم له Claude Opus 5.2
استنادًا إلى السلوك المرئي بالفعل في الاختبار الرمادي، يبدو Claude Opus 5.2 واعدًا بشكل خاص لـ:
- برمجة على مستوى المستودعات وتحديث القواعد البرمجية؛
- وكلاء طويلة التشغيل تخطط وتنفذ وتختبر وتراجع عبر العديد من الخطوات؛
- تصحيح أخطاء معقد وحلقات ضمان جودة ذاتية؛
- توليد واجهات عالية الجودة، وSVG، ومخطوطات مُنظمة؛
- البحث والتحليل الذي يتطلب تركيزًا مستدامًا عبر سياقات كبيرة؛ و
- أعباء عمل مؤسسية حيث تهم جودة الإتمام أكثر من الحد الأدنى للتكلفة.
بالنسبة للنشر الإنتاجي اليوم، ينبغي للفرق الاستمرار في استخدام نقطة نهاية عامة مستقرة والاحتفاظ بطبقة النموذج قابلة للاستبدال حتى يتم نشر الوصول إلى API وشروط الخدمة الخاصة بـ Opus 5.2.
كيف توفر CometAPI الوصول إلى Claude Opus 5.2 عبر API؟
عندما يصبح Claude Opus 5.2 متاحًا رسميًا عبر CometAPI، سيتمكن المطورون من استخدام سير العمل الموحد نفسه المستخدم للنماذج الأخرى المدعومة من Anthropic:
- أنشئ حساب CometAPI وقم بإنشاء مفتاح API.
- أضف رصيدًا إلى الحساب أو اختر خيار الفوترة المناسب.
- تحقق من كتالوج نماذج CometAPI للعثور على معرّف النموذج المنشور وسعره بالضبط.
- أرسل الطلبات عبر واجهة Anthropic Messages المدعومة أو نقطة دردشة متوافقة.
- تحقق من جودة المخرجات، وزمن الاستجابة، والتكلفة باستخدام عبء اختبار صغير قبل طرح الإنتاج.
في الأثناء، تدعم CometAPI بالفعل نموذج Fable 5.1 الأحدث من Claude. يمكن للمطورين الوصول إلى نماذج Claude باستخدام صيغة طلب Claude API الأصلية، مما يجعل من السهل اختبار النماذج الحالية والانتقال إلى Opus 5.2 بعد إصداره.
لماذا تختار CometAPI لـ Claude Opus 5.2؟
بمجرد دعم النموذج رسميًا، يمكن أن تقلل CometAPI من العمل التشغيلي المطلوب لإضافته إلى حزمة الذكاء الاصطناعي الحالية. يتيح حساب وطبقة API موحدان للفرق تقييم مزودين متعددين للنماذج دون الحفاظ على تكامل منفصل وعلاقة فوترة لكل نموذج.
تشمل المزايا المحتملة:
- مفتاح API واحد وسير فوترة واحد لمجموعة نماذج واسعة؛
- اختبارات أسرع جنبًا إلى جنب مقابل نماذج برمجة واستدلال بديلة؛
- نمط تكامل متسق مع تغيّر إصدارات النماذج؛
- وصول يعتمد على الاستخدام دون إعادة تصميم التطبيق حول مزوّد واحد؛ و
- توثيق مركزي واكتشاف للنماذج.
ينبغي ذكر معلومات التسعير، والتوفر، ومعدلات النقل، والخصومات الخاصة بـ Opus 5.2 فقط بعد ظهور النموذج في كتالوج CometAPI المباشر.