TL;DR: صدر Claude Opus 5 من Anthropic في 24 يوليو 2026، ويقدم قفزة نوعية مقارنة بـ Opus 4.8 في الاستدلال العميق، والبرمجة القائمة على الوكلاء، والمهام بعيدة الأفق، وحل المشكلات الجديدة. يوازي أو يتفوق على Fable 5 الأعلى تكلفة في معايير أساسية (بما في ذلك 43.3% على Frontier-Bench v0.1 ورقم قياسي 30.2% على ARC-AGI-3) مع بقاء السعر مماثلاً لـ Opus 4.8—$5 لكل مليون رموز إدخال و$25 لكل مليون رموز إخراج. يوفر نافذة سياقية بحجم 1M رمز، والتفكير مفعل افتراضياً، وتحقيق ذاتي قوي، ومواءمة محسنة (أدنى درجة سلوك غير مواءم بين إصدارات Claude الأخيرة). يبرع في البرمجة المعقدة، واستخدام الحاسوب، وأعمال المعرفة، وتدفقات العمل متعددة الوكلاء. غالباً ما يحقق الجهد Medium أعلى كفاءة.
أبرز النقاط
- يمثل Opus 5 ترقية جيلية حقيقية على Opus 4.8 وليست تدريجية—خاصة في المثابرة الوكيلية، وتوسيع الحوسبة أثناء الاختبار، والذكاء السائل (قفزة ARC-AGI-3 من ~1.5% إلى 30.2%) من مدونة Claude.
- يتفوق أو يضاهي Fable 5 في معايير البرمجة/الوكالة الرئيسية بنحو نصف السعر.
- بقي التسعير ثابتاً عند $5/$25 لكل مليون رمز؛ تأتي مكاسب الكفاءة من أداء أفضل لكل رمز ونتائج قوية حتى عند الجهد Medium/Low.
- ملف الأمان هو الأفضل لدى Anthropic حتى الآن لسلسلة Opus، مع حدود مقصودة على القدرات السيبرانية الهجومية وتقليل مرات تفعيل المصنفات.
- تغييرات في التلقين: إزالة تعليمات التحقق القديمة، تحديد النطاق صراحة، التحكم في الإطالة واستخدام الوكلاء الفرعيين، والاستفادة من معامل effort من وثائق Claude.
- الأفضل للوكلاء طويلة التشغيل، والبرمجة متعددة الملفات، وأعمال المعرفة، والمهام المدعومة بالرؤية؛ تقارير العالم الحقيقي تشير إلى نقاط قوة في العروض/البناءات المعقدة إلى جانب احتكاكات عرضية في اتباع التعليمات ضمن قواعد شفرة كبيرة.
- تسهل منصات مثل CometAPI توجيه الحركة عبر نماذج Claude (والمنافسين) مع فواتير موحدة وآليات بديلة.
يصل Claude Opus 5 كأحدث نموذج متاح عموماً ضمن طبقة Opus من Anthropic. يتموضع أدنى من فئة Mythos/Fable الأكثر تقييداً في بعض المجالات المتخصصة لكنه تنافسي أو متفوق في العديد من التقييمات العامة. يستهدف البرمجة الوكيلية المعقدة، وأعمال المعرفة للمؤسسات، والمهام بعيدة الأفق. صدر بعد شهرين فقط من Opus 4.8، ويمثل قفزة نوعية لا مجرد تكرار صغير.
ما هو Claude Opus 5؟
Claude Opus 5 (معرّف نموذج API: claude-opus-5) هو أحدث نماذج فئة Opus من Anthropic، مُحسّن للبرمجة الوكيلية المعقدة وأعباء عمل المؤسسات. يوفر نافذة سياقية بحجم 1 مليون رمز (افتراضي وأقصى)، حتى 128k كحد أقصى لرموز الإخراج، والتفكير مفعل افتراضياً. يقرر النموذج متى وكم يفكر؛ يتحكم المطورون بالعمق عبر معامل effort (low, medium, high, xhigh, max).
قدرات وسلوكيات جديدة أساسية مقارنة بالأجيال السابقة تشمل:
- مثابرة وكيلية أقوى—يواصل حتى نجاح المهمة بدلاً من التوقف عند إجابات معقولة.
- تحسين التحقق الذاتي وتصحيح الأسباب الجذرية للأخطاء.
- تنسيق أفضل بين الوكلاء وتفويض للوكلاء الفرعيين.
- رؤية أقوى للمخططات والوثائق والرسوم والنسخ الأمامي/الواجهات (خاصة مع استخدام الأدوات تكرارياً).
- تعزيز أعمال المكتب/المستندات (جداول بيانات متعددة الأوراق معقدة، عروض شرائح منظمة).
- تغييرات أدوات أثناء المحادثة (بيتا)، خفض الحد الأدنى لذاكرة التخزين المؤقت للمطالبة (512 رمزاً)، ووضع بدائل افتراضي.
- وضع Fast (معاينة بحثية) متاح عبر واجهة Claude بمعدلات أعلى.
تصفه Anthropic بأنه يقدم ذكاءً على مستوى الحدود الأمامية بنصف تكلفة Fable 5 بينما يشغّل وكلاء طويلة التشغيل مع تحسينات في البرمجة والعمل المهني.
Claude Opus 5 مقابل Opus 4.8
يُؤطَّر Opus 5 بوضوح كقفزة نوعية على Opus 4.8. تظهر أكبر المكاسب في الاستدلال العميق عبر سلاسل مشكلات طويلة، والبرمجة الوكيلية وحلقات استخدام الأدوات بعيدة الأفق (إكمال ميزات متعددة الملفات والعمل الشامل دون ترك TODOs)، وتوسيع الحوسبة أثناء الاختبار، والكفاءة عند مستويات الجهد المنخفضة، ودقة مراجعة/اكتشاف أخطاء الشيفرة، والرؤية، والثبات في السياقات الطويلة، وأعمال المكتب، والتنسيق متعدد الوكلاء.
سلوكياً، تصبح الردود الافتراضية والمخرجات المكتوبة أطول. يسرد النموذج التقدم أكثر في الجلسات الوكيلية، ويفوض للوكلاء الفرعيين بسهولة أكبر، ويتحقق من عمله دون مطالبة. تعليمات الإرث مثل "تضمين خطوة تحقق نهائية" باتت تؤدي إلى فرط تحقق وهدر رموز—احذفها.
التفكير مفعل افتراضياً (كان التفعيل تكيفياً/يتطلب ضبطاً صريحاً في 4.8). تعطيل التفكير مسموح فقط عند الجهد high أو أدنى؛ الجهود الأعلى ترفض تعطيل التفكير. يبقى التسعير نفسه: $5 إدخال / $25 إخراج لكل مليون رمز.
باختصار، على الفرق عند الترحيل تحديث معرّف النموذج، وإعادة تقييم افتراضات effort على اختباراتهم، وتنظيف قوالب التحقق من المطالبات، وتوقع مخرجات أطول لكن أعلى جودة مع استقلالية أقوى.
معايير الأداء: ماذا تقول البيانات؟
يحقق Opus 5 نتائج مميزة، خصوصاً في التقييمات الجديدة والوكيلية. الأرقام أدناه مأخوذة من بطاقة النظام/مواد الإصدار من Anthropic وتجميعات مستقلة حتى أواخر يوليو 2026؛ تُذكر أن درجات المختبر تعتمد على أدوات المزود والتلقين.
نتائج البرمجة والوكالة الرئيسية
- Frontier-Bench v0.1 (برمجة طرفية وكيلية): Opus 5 43.3% مقابل Fable 5 33.7% مقابل Opus 4.8 18.7%.
- SWE-bench Verified: 96.0% (مقابل Fable 5 95.0%، Opus 4.8 88.6%).
- SWE-bench Pro: 79.2% (مقابل Fable 5 80.3%، Opus 4.8 69.2%).
- DeepSWE v1.1: 68.8% (تنافسي؛ بعض إصدارات GPT-5.6 أعلى).
- FrontierCode 1.1 (ذروة عند الجهد Medium): ~53.4% الرئيسي / 63.6% الموسع—أكثر تكوين كفؤ حوسبياً في أحد التحليلات.
- CursorBench 3.2 (الجهد Max): ضمن ~0.5% من ذروة Fable 5 وبنحو نصف تكلفة المهمة. أداء قوي مقابل التكلفة عبر الجهود high/xhigh/max.
الاستدلال الابتكاري والذكاء السائل
- ARC-AGI-3: 30.2% (الحدود السابقة ~7.8% لـ GPT-5.6 Sol عند جهد عالٍ؛ Opus 4.8 ~1.5%). هذه أكبر قفزة مسجلة؛ أظهر النموذج نمذجة جبرية داخلية لديناميكيات الألعاب وكفاءة عينات بمستوى بشري على بيئات لم تُحل سابقاً. نحو 3× أفضل من أقرب نموذج—حل ابتكاري قوي للمشكلات.
- GDPval-AA v2: ريادي في أعمال المعرفة المهنية.
- Zapier AutomationBench: ~1.5× النموذج التالي بأعلى معدلات نجاح للأتمتة الشاملة للأعمال.
- OSWorld 2.0 (استخدام الحاسوب): يتجاوز أفضل نتائج Fable 5 المُعلنة بنحو ثلث التكلفة.
- ريادي أو من الأفضل في HLE (Humanity’s Last Exam) ومهام البحث العميق على نمط DeepSearchQA.
استخدام الحاسوب وأعمال المعرفة واستخدام الأدوات
- OSWorld 2.0: 70.6%—يتفوق على الأقران عند نقاط التكلفة المعطاة.
- BrowseComp: ~90–90.8% (تنافسي أو أدنى قليلاً من أفضل تشكيلات GPT-5.6).
- GDPval-AA v2 (Elo): 1861 (يتصدر Fable 5 والأجيال السابقة).
- AutomationBench: معدلات نجاح قوية؛ ~1.5× النموذج التالي بسعر مماثل في بعض التحليلات.
يقدم Opus 5 مكاسب غير تدريجية، خصوصاً في تقييمات البرمجة والوكالة وأعمال المعرفة. تسلط تقارير Anthropic والمستقلين الضوء على:
العلوم والمجالات المتخصصة
مكاسب ملموسة على Opus 4.8 عبر تقييمات علوم الحياة، منها:
- الكيمياء العضوية (استدلال البنية الجزيئية من التحليل الطيفي): +10.2 نقطة مئوية.
- التنبؤ بوظائف البروتين: +7.7 نقطة مئوية.
- تحسينات متسقة في الأحياء الهيكلية والمعلوماتية الحيوية.
وبما أن لدى Fable 5 ضوابط أكثر تقييداً في علم الأحياء، فإن Opus 5 هو حالياً أقوى نموذج متاح عموماً من Anthropic للعديد من تدفقات العمل البحثية العلمية.

المصدر: claude
تضع التركيبات العامة للمتصدرين Opus 5 بالقرب من القمة (مثلاً، ~82.8/100 والترتيب #2 من 215 في BenchLM)، مع نسب مئوية مرتفعة بشكل خاص في المعرفة، والوكالة، والبرمجة، والفئات متعددة الوسائط.
تعليقات المطورين في العالم الحقيقي متباينة: بناء ألعاب من محاولة واحدة، إكمال ميزات معقدة، وتصحيح ذاتي مثير للإعجاب يقابلها تقارير عن تجاهل عرضي للتعليمات، وهلوسة على قواعد شفرة كبيرة، أو تعقيد زائد. تعكس المعايير ذروة القدرة في ظروف مضبوطة؛ وتعتمد نتائج الإنتاج بشكل كبير على التلقين وتصميم الأدوات وإعدادات effort.
لمحة عن المعايير

المصدر: claude
الكفاءة والتكلفة
بقي التسعير كما في Opus 4.8: $5 لكل مليون رموز إدخال / $25 لكل مليون رموز إخراج. الإدخال المُخزَّن أرخص بكثير (~$0.50). يعمل وضع Fast بمعدلات تقارب 2× ($10/$50). هذا يقارب نصف أسعار Fable 5 ($10/$50). تأتي تحسينات الكفاءة من:
- نافذة السياق 1M التي تمكن تدفقات عمل كامل قاعدة الشفرة أو المستندات الطويلة بدون تقطيع عدواني.
- أداء قوي حتى عند الجهد Low/Medium (رموز أقل لجودة مماثلة في العديد من المهام).
- التحقق الذاتي والتهيؤ المدمجان يقللان من الجولات الفاشلة وحلقات التصحيح البشري.
- تغييرات الأدوات أثناء المحادثة (بيتا) التي تحافظ على ذاكرة التخزين المؤقت للمطالبة.
قصة الكفاءة الحقيقية هي الأداء مقابل الدولار والرمز. يحول Opus 5 الجهد الإضافي إلى نتائج أفضل بشكل أكثر موثوقية مقارنة بنماذج Opus السابقة. غالباً ما يقدم الجهد Medium درجات ذروة أو قريبة من الذروة على معايير البرمجة بتكلفة رموز ~1.5× مقارنة بالجهد Low، بينما قد تظهر الجهود High/XHigh/Max عوائد متناقصة أو مسطحة في بعض المجموعات.
على منحنيات التكلفة مقابل الأداء المنشورة حول الإطلاق، يتموضع Opus 5 بشكل مفضل مقابل Fable 5 وOpus 4.8 ونماذج الحدود الأخرى—درجات أعلى بتكلفة فعالة أقل لكل مهمة مكتملة. قد يكون استهلاك الرموز لكل مراجعة أو حلقة وكيلية أعلى بالمعنى المطلق بسبب التفكير الأطول والتحقق الذاتي، لكن الجودة ومعدل الإتمام يتحسنان بما يكفي لخفض التكلفة الإجمالية للنتائج الناجحة في كثير من الأحيان.

المصدر: claude
لفرق الإنتاج، التوصية العملية هي البدء بالجهد الافتراضي high، ثم إجراء مسح على low/medium ضمن تقييماتك الداخلية. استخدم التخزين المؤقت للمطالبة بقوة (أصبح ممكناً الآن عند أطوال أقصر)، وتغييرات الأدوات أثناء المحادثة للحفاظ على ذاكرة التخزين المؤقت، وآليات بديلة على مستوى المنصة. يمكن لبوابات API الموحدة مثل CometAPI تحسين الأمر أكثر عبر توجيه المهام البسيطة إلى نماذج أرخص (طبقات Sonnet/Haiku) مع حجز Opus 5 للعمل الوكيلي المعقد، مع تحليلات استخدام مركزية وضوابط إنفاق.
السلامة والمواءمة
تصف Anthropic Claude Opus 5 بأنه "أكثر نماذجنا مواءمة حتى الآن" و"أكثرها أماناً" في عدة تقارير. نقاط رئيسية من بطاقة النظام والإعلانات:
- مخاطر مواءمة منخفضة جداً عموماً؛ لا خصائص مثيرة للقلق مقارنة بالنماذج السابقة.
- أدنى معدلات للسلوك المخادع مقاسة لدى Anthropic.
- معدلات استجابة غير ضارة مرتفعة للطلبات الضارة مع أدنى معدلات رفض زائد للطلبات البريئة.
- مقاومة محسنة لبعض نواقل سوء الاستخدام؛ حواجز سيبرانية مُعايرة أقرب إلى مستويات Fable 5 نظراً للقدرات الأقوى، لكن المصنفات تتدخل بوتيرة أقل (~85% أقل من Fable 5 في بعض التقديرات).
- لا يتجاوز عتبات سياسة التوسع المسؤول لدى Anthropic لبدائل البحث والتطوير الآلي للذكاء الاصطناعي أو فئات مخاطر كيميائية/بيولوجية أعلى (يُعامل بشكل مشابه لنماذج Opus الحديثة مع حماية نمط ASL-3 حيثما ينطبق).
لا يزال لديه وعي تقييم مرتفع في الاختبار (شائع في نماذج الحدود). أظهر رصد النشر في العالم الحقيقي معدلات منخفضة جداً من السلوكيات المثيرة للقلق. كما هو الحال في نماذج الحدود، ينبغي للمنظمات تطبيق ضوابط على مستوى التطبيق، خاصة للاستخدامات عالية المخاطر أو الوكلاء المستقلين.
كيف تلقّن Claude Opus 5 للحصول على أفضل النتائج
نشرت Anthropic إرشادات تلقين خاصة بالنموذج لأن Opus 5 يتصرف بشكل مختلف عن إصدارات Opus السابقة. أكبر التحولات: يتحقق ذاتياً، يُكمل المهام كاملة، يمكنه توسيع النطاق، وينتج ردوداً أطول افتراضياً.
المبادئ الأساسية لـ Opus 5
- قدم المهمة كاملة منذ البداية — وفر المواصفات والسياق والقيود والنتيجة المطلوبة في مطالبة واحدة. يقدم أفضل أداء عند تركه يعمل بدلاً من تغذيته خطوات على دفعات. يُكمل الميزات شاملة بدلاً من ترك TODOs.
- أزل تعليمات التحقق — عبارات مثل "تحقق مرتين"، "تحقق من عملك"، أو "استخدم وكيلاً فرعياً للتحقق" تؤدي إلى فرط تحقق وهدر رموز. Opus 5 يتحقق ويكرر داخلياً بالفعل. احذف هذه الأسطر من مطالبات النظام وملفات CLAUDE.md.
- تحكم في النطاق صراحة — يمكنه توسيع المهام بحكمه. أضف حدوداً واضحة: "قدّم بالضبط ما طُلب ضمن النطاق المقصود. اتخذ قرارات روتينية بنفسك. لا تطلب التأكيد إلا إذا كانت التفسيرات المختلفة ستقود إلى عمل مختلف مادياً. إذا بدا الطلب خاطئاً، اذكر ذلك بجملة واحدة وواصل المهمة كما طُلبت."
- أدِر الإطالة — الردود الافتراضية أطول. للحصول على مخرجات موجزة أضف: "اجعل الاستجابة مركزة ومختصرة ومقتضبة. أعطِ الأولوية للإجابة الأساسية؛ اجعل التحفظات قصيرة."
- استخدم effort بحكمة — ابدأ بـ high (الافتراضي). استخدم low/medium بكثرة للتصنيف، والتحريرات البسيطة، أو الأعمال ذات الحجم الكبير حيث تبقى الجودة. احتفظ بـ xhigh/max لأصعب مسائل البرمجة والوكالة. أعد تقييم إعدادات effort الموروثة من Opus 4.8.
- ضبط الوكلاء الفرعيين — يُفوِّض بسهولة أكبر. وجّه: "فوّض إلى وكيل فرعي فقط للمهام الكبيرة المستقلة حقاً والقابلة للتوازي. لا تستخدم الوكلاء الفرعيين للتحقق أو العمل الذي يمكنك إنهاؤه في بضع مكالمات أدوات."
- المراجعات والتدقيق — اطلب النتائج كاملة مع تسميات للثقة/الحدة، ثم صفِّ أنت. "أبلغ فقط عن المشكلات عالية الشدة" يُتبع حرفياً وقد يفوّت مشكلات.
مثال هيكل مطالبة برمجية عند جهد عالٍ
text
[Set effort to max or xhigh]
Complete the following end-to-end: [full feature description, acceptance criteria, constraints, existing file structure, style guidelines].
Deliver production-quality code. Adapt strategy as needed. Do not leave stubs or TODOs. Stay within the stated scope unless a material issue requires a one-sentence note.
Output the final artifacts and a brief summary of decisions.
مثال تصنيف عند جهد منخفض
text
[Set effort to low]
Classify the input into exactly one of: [categories]. Return only the category name.
عند الترحيل من Opus 4.8: أعد اختبار المطالبات، أزل قوالب التحقق، أضف ضوابط صريحة للطول/النطاق، واجرِ مسحاً لمستويات effort على تقييماتك الداخلية. تشير Anthropic إلى أن العديد من مجموعات التعليمات القديمة يمكن تبسيطها الآن.
جدول مقارنة: Claude Opus 5 مقابل البدائل الرئيسية (تقريبي، يوليو 2026)
| النموذج | الإدخال/الإخراج ($/MTok) | Frontier-Bench | SWE-Verified | ARC-AGI-3 | السياق | الملاحظات |
|---|---|---|---|---|---|---|
| Claude Opus 5 | $5 / $25 | 43.3% | 96.0% | 30.2% | 1M | أفضل سعر/أداء للاستخدام اليومي عالي القدرات |
| Claude Opus 4.8 | $5 / $25 | ~19–21% | 88.6% | منخفض | 1M | إصدار Opus السابق |
| Claude Fable 5 | $10 / $50 | ~33.7% | ~95% | أدنى | 1M | فئة أعلى، مزيد من القيود في بعض الحالات |
| GPT-5.6 Sol (approx.) | تنافسي | أدنى | مرتفع | أدنى | متفاوت | بديل قوي |
| Claude Sonnet 5 | أدنى (~$3/$15 أو عرض) | أدنى | قوي | أدنى | 1M | سائق يومي أسرع/أرخص |
الأرقام مأخوذة من إعلانات Anthropic وتقارير التجميع؛ تحقّق دائماً من أحدث التقييمات المستقلة.
توصية CometAPI: توفر CometAPI وصولاً موحداً إلى Claude Opus 5 (و500+ نموذجاً آخر) عبر واجهة متوافقة مع OpenAI (https://api.cometapi.com/v1) ودعم Anthropic Messages API. التسعير المدرج تنافسي (مثلاً، نحو $4/$20 لكل MTok لـ Opus 5 وقت الكتابة)، مع مفتاح API واحد، فواتير مبسطة، وسهولة تبديل النماذج. هذا مفيد بشكل خاص للفرق التي تريد قدرات Claude دون إدارة حسابات مزودين متعددة أو حصص معدلات متفرقة. تحقق من قوائم النماذج والتسعير الحالي في CometAPI لأحدث الأسعار وعروض الرموز المجانية.
الخلاصة
يرفع Claude Opus 5 السقف لطبقة Opus: أداء وكيل واستدلال على مستوى الحدود بسعر الجيل السابق، مع تقدم ملموس في حل المشكلات الموجه ذاتياً (يتضح من نتيجة ARC-AGI-3) وأفضل أرقام مواءمة نشرتها Anthropic لهذه الفئة. ليس مثالياً—تذكّرنا التراجعات الخاصة بالمجال وتقارير اتباع التعليمات في الواقع بأن المعايير ليست كل القصة—لكن للوكالات البرمجية، وتدفقات العمل بعيدة الأفق، وأعمال المعرفة، وتطبيقات استخدام الحاسوب، فهو حالياً من أقوى الخيارات المتاحة عموماً.
اقرن انضباط التلقين مع ضبط effort، واستفد من نافذة السياق 1M، ووجّه الحركة بذكاء (عبر الواجهات الرسمية أو منصات مثل CometAPI) لتعظيم القيمة. وكأي نموذج حدودي، يبقى التقييم المستمر على بياناتك أساسياً. توحي وتيرة التكرار السريعة لدى Anthropic بمزيد من التحسينات قريباً؛ يقدم Opus 5 بالفعل قفزة كبيرة فعّالة التكلفة تستحق الاعتماد اليوم.
المصادر وقراءات إضافية:
- Anthropic: What’s new in Claude Opus 5 — https://platform.claude.com/docs/en/about-claude/models/whats-new-opus-5
- Anthropic: Prompting Claude Opus 5 — https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5
- إشعارات وإحالات أخبار Anthropic وبطاقة النظام (يوليو 2026)
- DataCamp: Claude Opus 5 Explained — https://www.datacamp.com/blog/claude-opus-5
- MindStudio / Vellum / BenchLM ملخصات المعايير (يوليو 2026)
- ARC Prize Foundation verified scores
