DeepSeek V4 Pro 0813 is now live on CometAPI →

Grok 4.6 وصل: نتائج الاختبارات المعيارية بمستوى GPT-5.6 وأداء البرمجة

CometAPI
AnnaAug 13, 2026
Grok 4.6 وصل: نتائج الاختبارات المعيارية بمستوى GPT-5.6 وأداء البرمجة

TL; DR أطلقت xAI رسميًا Grok 4.6 في 12 أغسطس 2026 وأتاحته عبر xAI API وCursor وGrok Build. يتمتع بنافذة سياق من 500,000 رمز، ويقبل النصوص والصور، ويوفر أربعة مستويات لجهد الاستدلال، ولديه حد معرفة بتاريخ 1 فبراير 2026. وفقًا لـ إعلان xAI الرسمي عن Grok 4.6، فإنه يطابق GPT-5.6 Sol على Artificial Analysis Intelligence Index، وهو مركّب من تسعة تقييمات.

تبدأ أسعار الـ API من $2 لكل مليون رمز مدخل، $0.50 لكل مليون رمز مدخل مخزّن مؤقتًا و$6 لكل مليون رمز مخرجات للمحفّزات التي تقل عن 200,000 رمز. عند وصول المحفّز إلى 200,000 رمز، تُحتسب الطلبية كاملة بأسعار السياق الطويل: $4 للمدخل، $1 للمدخل المخزّن مؤقتًا و$12 للمخرجات لكل مليون رمز. للمطوّرين الذين يبحثون عن وصول مرن متعدد النماذج، تجعل منصات مثل CometAPI دمج Grok 4.6 إلى جانب نماذج الحدّ الأمامي الأخرى أمرًا سهلاً، وسعر الـ API هو 80% من سعر xAI.

الخلاصات الأساسية

  • أُطلق Grok 4.6 رسميًا في 12 أغسطس 2026؛ تقارير نافذة الإصدار السابقة باتت الآن غير صالحة.
  • معرّف نموذج الـ API هو ، كما أن النموذج متاح أيضًا في Cursor وGrok Build.grok-4.6
  • نافذة السياق هي 500K رموز، بمدخلات نصية وصورية ومخرجات نصية فقط.
  • التسعير القياسي لما دون 200K من رموز المحفّز هو $2/M للمدخل، $0.50/M للمدخل المخزّن مؤقتًا، و$6/M للمخرجات.
  • الوصول إلى محفّز بحجم 200K رمز أو أكثر يُفعّل أسعارًا أعلى لـ كل الرموز في تلك الطلبية، وليس فقط ما يتجاوز العتبة.
  • يمكن ضبط جهد الاستدلال على low، medium، high، أو xhigh؛ هو الإعداد الافتراضي الموثّق.
  • يطابق Grok 4.6 نموذج GPT-5.6 Sol على Artificial Analysis Intelligence Index (درجة 61) ويُظهر مكاسب كبيرة مقارنة بـ Grok 4.5 عبر ترميز الوكلاء، والعمل المعرفي، والمهام طويلة الأفق.
  • Grok Imagine Image 2.0 هو واجهة برمجة تطبيقات منفصلة لتوليد الصور. يستطيع Grok 4.6 فهم الصور لكنه لا يُرجع صورًا مُولّدة بذاته.

مواصفات Grok 4.6 والسعر في لمحة

المواصفات التالية مؤكدة في توثيق نماذج xAI وملاحظات إصدار 12 أغسطس.

SpecificationGrok 4.6
Official release date12 أغسطس 2026
API model IDgrok-4.6
Positioningنموذج رائد للترميز والوكلاء وأعباء العمل العامة
Context window500,000 رموز
Inputsنصوص وصور
Outputنص
Documented text-output limitلا يوجد حد مذكور لمخرجات النص من xAI
Reasoning controlsLow, medium, high و xhigh
Default reasoning effortHigh
Knowledge cutoff1 فبراير 2026
Native API accessمتاح
Coding-tool accessCursor وGrok Build
Current-events accessيتطلب أدوات Web Search أو X Search

تسعير xAI الرسمي لواجهة الـ API

جدول التسعير الحالي لواجهة xAI يفصل بين الطلبات قصيرة السياق وطويلة السياق.

Prompt sizeInput per 1M tokensCached input per 1M tokensOutput per 1M tokens
Below 200,000 tokens$2.00$0.50$6.00
200,000 tokens or more$4.00$1.00$12.00

تُعد العتبة مهمة بشكل خاص لوكلاء قواعد الشيفرة. عندما يصل محفّز الطلب إلى 200,000 رمز، تفرض xAI سعر السياق الطويل على كل الرموز في تلك الطلبية، وليس فقط الجزء الذي يتجاوز العتبة. لذلك قد تكون تكلفة طلب يحتوي على 199,000 رمز في المحفّز أقل ماديًا من طلب يحتوي على 200,000، حتى لو كانت أحجامهما متقاربة للغاية.

لا يوجد خصم دفع جماعي مدرج لـ Grok 4.6 في توثيق التسعير الحالي لـ xAI. يجب ألا تفترض الفرق أن المهام غير المتصلة تحصل على الخصومات المتاحة لبعض نماذج xAI الأخرى.

ما هو Grok 4.6؟

Grok 4.6 هو أحدث نموذج لغوي ضخم رائد من SpaceXAI، أُطلق في 12 أغسطس 2026. يبني مباشرة على Grok 4.5 عبر تطبيق تشغيل تدريب إضافي أطول يركز على بيانات مُولّدة من النموذج ومنسّقة للاستدلال المتقدم والمفاهيم التقنية، ومجموعات بيانات هندسية عالية الجودة، ومحسّن مُحسّن، وتعزيز التعلم التقوي المُوسّع لسيناريوهات الترميز والعمل المعرفي.

يحافظ النموذج على نفس الأساس ذي 1.5-تريليون معلمة كما سلفه؛ تأتي المكاسب أساسًا من التدريب اللاحق وليس من زيادة مقياس المعلمات. صُمم خصيصًا ليبقى فعالًا عبر العديد من الخطوات—سواء في بحث موضوع، تحليل كميات كبيرة من المعلومات، التنقل وتحرير قاعدة شيفرة غير مألوفة، أو تحويل فكرة عالية المستوى إلى تطبيق مصقول أو مُخرَج عمل. تؤكد SpaceXAI سلوك التحقق الذاتي المُحسّن في المشاريع طويلة الأفق وأداء أقوى في العمل التفاعلي والبصري.

الفرق عن روبوتات الدردشة التقليدية مهم.

سير العمل التقليدي لنموذج لغوي ضخم يبدو كالتالي:

Prompt → Generate answer

صُمم Grok 4.6 لسير عمل أقرب إلى:

Goal → Plan → Research → Use tools → Modify code → Test → Evaluate → Continue

التموضع الحالي لـ xAI يؤكد قدرة النموذج على البقاء في مشاريع معقدة لفترة أطول، والعمل عبر قواعد الشيفرة، وبحث مواضيع غير مألوفة، وبناء تطبيقات، والتحقق من عمله.

هذا يجعل Grok 4.6 وثيق الصلة بشكل خاص بسوق وكلاء الترميز بالذكاء الاصطناعي والوكلاء الذاتيين الذي يتوسع بسرعة.

ما الميزات الرئيسية في Grok 4.6؟

قدرة الوكيل على التشغيل طويل الأمد

أهم تحسين في Grok 4.6 هو تركيزه على المهام طويلة التشغيل.

بدلًا من تحسين الاستجابة ذات اللقطة الواحدة فقط، صُمم النموذج للحفاظ على التقدم عبر عدة مراحل من المشروع.

أمثلة نموذجية تشمل:

  • بناء تطبيق
  • تصحيح مستودع كبير
  • البحث في موضوع غير مألوف
  • تعديل عدة مكوّنات
  • تشغيل الاختبارات
  • التحقيق في الإخفاقات
  • مراجعة التنفيذ
  • التحقق من النتيجة النهائية

هذا هدف مختلف جوهريًا عن معايير اتباع التعليمات التقليدية.

أداء ترميز متقدم

الترميز أحد أوضح مجالات التحسن في Grok 4.6.

يُظهر تقرير المعايير الحالي:

  • 65.9% على DeepSWE 1.1
  • 69.9% على CursorBench 3.2
  • 61.3% على FrontierCode 1.1 Extended

تُعد هذه التقييمات ذات صلة بشكل خاص لأنها تستهدف سلوك وكيل الترميز بدلًا من مجرد إكمال الشيفرة.

التحسن من Grok 4.5 إلى Grok 4.6 على DeepSWE 1.1 لافت بشكل خاص، إذ ارتفع من حوالي 54% إلى 65.9% في المقارنة المبلغ عنها.

مدخلات متعددة الوسائط

يدعم Grok 4.6 مدخلات نصية وصورية، مما يسمح للمطورين بدمج المعلومات البصرية مع الاستدلال.

التطبيقات المحتملة تشمل:

  • تصحيح الأخطاء من لقطات الشاشة
  • تحليل واجهة المستخدم
  • تفسير المخططات
  • فهم المستندات
  • البحث البصري
  • مهام الترميز المعتمدة على الصور

هذا يجعل Grok 4.6 أكثر مرونة من نموذج ترميز يعتمد على النص فقط.

بحث ويب وX

الوصول إلى البحث جزء مهم من منظومة Grok.

تدعم الـ API:

  • Web search
  • X search
  • Function calling
  • Code execution

توثيق واجهة Grok 4.5 الحالي من xAI يؤكد قدرات هذه الأدوات في بيئة Grok API.

بالنسبة لوكلاء البحث، هذا يعني أن النموذج يمكنه الانتقال من المعرفة المُسبقة الثابتة نحو استرجاع المعلومات الحالية بالإضافة إلى الاستدلال.

استدلال قابل للضبط

تكشف واجهة Grok عن جهد استدلال قابل للضبط.

هذا يسمح للمطورين بالمفاضلة بين:

السرعة / التكلفة ↔ عمق الاستدلال

بالنسبة للمهام البسيطة، يمكن أن يقلل الاستدلال المنخفض من الحساب غير الضروري.

بالنسبة لمهام الترميز أو البحث المعقدة، يمكن للاستدلال الأعلى أن يوفر حلًا أكثر ترويًا.

أداء حدّي تنافسي من حيث التكلفة

يمكن القول إن تسعير Grok 4.6 أحد أقوى مزاياه التجارية.

السعر القياسي المعلن لواجهة الـ API هو:

  • $2 / 1M رموز مدخل
  • $6 / 1M رموز مخرجات

وهو نفس التسعير المبلغ عنه لـ Grok 4.5، رغم التحسينات الكبيرة في القدرات.

هذا يخلق عرض تكلفة/أداء عدواني بشكل غير معتاد لنموذج حدّي.


كيف يؤدي Grok 4.6 على المعايير؟

أكثر بيانات المعايير فائدة حاليًا تتركز حول الذكاء الوكيلي والترميز.

BenchmarkGrok 4.6What It Measures
Artificial Analysis Intelligence Index61ذكاء نماذج الحدّ الأمامي بشكل عام
CursorBench 3.269.9%أداء وكيل الترميز
DeepSWE 1.165.9%وكلاء هندسة البرمجيات
FrontierCode 1.1 Extended61.3%ترميز متقدم
GDPVal-AA v21,753 Eloأداء مهام العمل المعرفي

تضع درجة 61 على Artificial Analysis Intelligence Index حسب التقارير Grok 4.6 على نفس مستوى GPT-5.6 Sol على ذلك المؤشر.

كما أن درجة 1,753 Elo على GDPVal-AA v2 مهمة لأنها تقيم مهام العمل المعرفي المهني بدلًا من مجرد أسئلة أكاديمية.

خلاصة مهمة من المعايير

الدليل الأقوى لـ Grok 4.6 ليس درجة واحدة على غرار MMLU.

يشير ملفه على المعايير نحو:

الترميز + الوكلاء + العمل المعرفي + التنفيذ طويل الأمد

وهذا بالضبط حيث تتجه تطويرات الذكاء الاصطناعي الحديثة.

بالنسبة لموقع مثل CometAPI، هذا تمييز مهم يجب الحفاظ عليه: ينبغي تسويق Grok 4.6 أساسًا كنموذج حدّي وكيلي، وليس كنموذج دردشة عام آخر.

كيف يقارن Grok 4.6 بسابقه ومنافسيه؟

Grok 4.6 مقابل Grok 4.5

FeatureGrok 4.5Grok 4.6
Primary focusالاستدلال العام + الوكلاءالوكلاء طويلو الأمد + الترميز
Contextنشر بفئة 500K500K
Inputنص + صورةنص + صورة
Web searchنعمنعم
X searchنعمنعم
Code executionنعمنعم
Function callingنعمنعم
Input price$2/M$2/M
Output price$6/M$6/M
DeepSWE 1.1~54%65.9%
Intelligence Index~5661

النقطة المهمة هي أن Grok 4.6 لا يبدو مجرد استبدال بفئة سعرية لـ Grok 4.5. إنه ترقية قدرات تستهدف بشكل أثقل سير عمل الوكلاء طويل الأفق.

توثيق Grok 4.5 الحالي من xAI يسرد النموذج بسعر $2/$6 لكل مليون رمز، مع استدلال قابل للضبط ودعم الأدوات.

جدول مقارنة: Grok 4.6 مقابل المنافسين الرئيسيين

AspectGrok 4.6GPT-5.6 SolClaude Fable 5 / Opus 5Notes
AA Intelligence Index616162 / 63درجة مركّبة
Input / Output $/1M$2 / $6~$5 / $30~$5 / $25Grok أرخص بكثير للمخرجات
Context Window500Kحتى 1M+غالبًا 1M
Strengthsالوكلاء، كفاءة الترميز، التكلفةالاستدلال العام، الترميزطويل الأفق، السلامة
Cursor Integrationأصلي، قويمتاحمتاحGrok مُحسّن لـ Cursor
Turn Efficiencyعالٍ (خطوات أقل)تنافسيمعدلات خطوات أعلى مُبلغ عنهامهم للوكلاء
AvailabilityAPI + Cursor + شركاءرسمي + شركاءرسمي + شركاءCometAPI يوحد الوصول

بيانات مُستمدة من إعلان SpaceXAI وArtificial Analysis وبطاقات النماذج العامة حتى 13 أغسطس 2026.

المقارنة الحالية من Artificial Analysis مثيرة للاهتمام بشكل خاص.

وفقًا للتقارير، يسجّل Grok 4.6 61 على Intelligence Index، مما يطابق GPT-5.6 Sol. لكن الاقتصاديات مختلفة جدًا.

يجب التحقق من التسعير الدقيق لنسخ GPT المنافسة مقابل تسعير مزوّديها الحالي قبل النشر، لكن الملاحظة السوقية الأساسية واضحة: Grok 4.6 ينافس على أداء حدّي في المعايير مع الحفاظ على سعر رمز عدواني نسبيًا.

هذا يجعل Grok 4.6 جذابًا بشكل خاص للتطبيقات حيث يجعل التنفيذ عالي الحجم للوكلاء استخدام نماذج حدّية متميزة مكلفًا.

ما هي قيود Grok 4.6؟

سياق 500K أصغر من بعض المنافسين بسياق 1M

سياق Grok 4.6 المعلن 500K كبير، لكنه ليس أكبر نافذة سياق متاحة في سوق النماذج الحدّية.

بالنسبة للمستودعات الكبيرة جدًا أو مجموعات المستندات الضخمة، قد يكون لنموذج بسياق 1M ميزة.

نموذج احتكاري

على عكس MiMo-V2.5-Pro، فإن Grok 4.6 ليس نموذجًا بأوزان مفتوحة.

لا يمكن للمطورين تنزيل النموذج ونشره بشكل مستقل.

مقارنات المعايير تحتاج إلى عناية

تستخدم معايير الترميز المختلفة أُطرًا ومحفّزات وأدوات وإجراءات تقييم مختلفة.

على سبيل المثال، صُمم SWE-Bench Pro تحديدًا حول مشاكل هندسة برمجيات واقعية وطويلة الأفق، ويمكن أن تختلف نتائج المعايير بشكل كبير حسب هيكل الوكيل.

لذلك، لا ينبغي تفسير 69.9% على CursorBench على أنه "Grok 4.6 أفضل بنسبة 69.9% من نموذج آخر."

التفسير الصحيح هو أنه حقق تلك الدرجة ضمن إعداد التقييم الخاص بالمعيار.

تكلفة الوكيل قد تكون أعلى مما يوحي تسعير الرموز

سعر $2/$6 جذاب، لكن الوكيل المستقل يمكن أن يستهلك أعدادًا هائلة من الرموز عبر:

  • استدعاءات الأدوات
  • عمليات بحث متكررة
  • تنفيذ الشيفرة
  • محاولات فاشلة
  • سياقات طويلة
  • التحقق الذاتي

لذلك تعتمد اقتصاديات الوحدة الحقيقية على التكلفة لكل مهمة مكتملة بنجاح، وليس ببساطة التكلفة لكل مليون رمز.

السعر والوصول

التسعير الرسمي (الفئة القياسية، أقل من ~200K رمز محفّز):

  • المدخل: $2.00 لكل 1M رمز
  • المدخل المخزّن مؤقتًا: حوالي $0.50 لكل 1M رمز
  • المخرجات: $6.00 لكل 1M رمز

سُعّر إصدار أسرع بضعف هذه المعدلات. قد تتضاعف المعدلات للسياقات الطويلة جدًا (≥200K). يُوصى بشدة بتخزين المحفّز مؤقتًا لحلقات الوكيل للحفاظ على انخفاض التكلفة.

التوافر:

  • Cursor وGrok Build (استخدام مُدرج 2× للأسبوع الأول)
  • SpaceXAI API (grok-4.6)
  • شركاء: OpenRouter وVercel وCloudflare وغيرهم
  • SuperGrok chat/apps (عبر مُحدّد النموذج)

توصية CometAPI: بالنسبة للمطورين الذين يستخدمون بالفعل (أو يخططون لاستخدام) عدة نماذج حدّية، توفر CometAPI وصولًا سلسًا إلى Grok 4.6 عبر نقطة نهاية متوافقة مع OpenAI واحدة (https://api.cometapi.com/v1). ستحصل على فواتير موحّدة، وتحليلات استخدام، ومعدلات فعّالة تنافسية عبر 500+ نموذج (بما في ذلك GPT وClaude وGemini وDeepSeek ونسخ Grok)، وإمكانية تبديل النماذج عبر تغيير سطر واحد. هذا ذو قيمة خاصة عند اختبار A/B لـ Grok 4.6 مقابل نماذج الترميز أو الوكلاء الأخرى أو عند بناء أنظمة إنتاج تستفيد من توجيه النماذج والتراجع. سجّل في cometapi.com للحصول على مفتاح API مجاني واستكشاف كتالوج النماذج المباشر.

هل ينبغي أن تنتقل إلى Grok 4.6؟

نعم، إذا:

  • تعمل بكثافة في Cursor أو تبني وكلاء ترميز/معرفة طويلة الأمد وتريد موثوقية متعددة الخطوات قوية بتكلفة تنافسية.
  • اقتصاديات الرموز مهمة—يقدم Grok 4.6 ذكاءً قريبًا من GPT-5.6 Sol بسعر رمز مخرجات يقارب خُمس أغلى خيارات الحدّ الأمامي.
  • تُقدّر كفاءة الدور (خطوات ورموز أقل لإكمال المهام المعقدة).
  • تريد وصولًا فوريًا إلى نموذج تم تدريبه صراحةً لسير العمل التفاعلي والبصري والوكيلي الشائع في التطوير الحديث.

فكّر في البقاء مع نماذج أخرى أو مزجها إذا:

  • عبء عملك الأساسي هو البرمجة التنافسية البحتة أو نقاط قوة نماذج مغلقة محددة (مثل بعض سيناريوهات Claude طويلة السياق أو المضبوطة على السلامة).
  • تحتاج إلى أعلى الدرجات المطلقة على كل معيار هندسة برمجيات فردي بغض النظر عن التكلفة.
  • تحتاج إلى نوافذ سياق أكبر من 500K لأحمال استدعاء واحدة (يقدم بعض المنافسين 1M+).

ستستفيد معظم الفرق من تقييم Grok 4.6 جنبًا إلى جنب مع مجموعتهم الحالية. وبما أنه متاح عبر مُجمِّعات مثل CometAPI، فإن تكلفة التحويل منخفضة—ما عليك سوى تغيير اسم النموذج وقياس معدلات إكمال المهام الواقعية، والزمن، والتكلفة على أعباء عملك الخاصة.

الخلاصة

يمثل Grok 4.6 خطوة مهمة إلى الأمام لـ SpaceXAI: ذكاء بمستوى الحدّ الأمامي على معايير مركّبة ووكيلي رئيسية، وتحسينات ملموسة في الأداء طويل الأمد للترميز والعمل المعرفي، واستمرار تسعير هجومي يتفوق على العديد من المنافسين المغلقين المصدر. يضيف توفره الأصلي في Cursor، إلى جانب موثوقية متعددة الخطوات قوية، جاذبية خاصة للمطورين الذين يبنون وكلاء برمجيات وتطبيقات تفاعلية في العالم الحقيقي.

سواء وصلت إليه مباشرة، عبر Cursor/Grok Build، أو من خلال بوابة موحّدة مثل CometAPI، فإن Grok 4.6 جاهز لتقييم الإنتاج اليوم. زر الإعلان الرسمي على x.ai/news/grok-4-6 للاطلاع على التفاصيل الكاملة وبطاقة النموذج، واستكشف الكتالوج المباشر على cometapi.com لمقارنته جنبًا إلى جنب مع نماذج رائدة أخرى، وابدأ البناء بقدراته الجديدة فورًا.

المصادر الأساسية

تحقق دائمًا من أحدث التسعير وحدود المعدّل وأرقام المعايير على الصفحات الرسمية، إذ يتطور مشهد الذكاء الاصطناعي بسرعة.

0 مشاهدات
تمت المراجعة للوضوح ودقة المصدر ومصطلحات API الحالية.

هل أنت مستعد لخفض تكاليف تطوير الذكاء الاصطناعي بنسبة 20%؟

ابدأ مجاناً في دقائق. رصيد تجريبي مجاني مدرج. لا حاجة لبطاقة ائتمانية.

اقرأ المزيد