GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
technology/أبحاث CometAPI

Grok 4.7: الاختبارات المعيارية، التسعير، الميزات والوصول إلى واجهة برمجة التطبيقات

تعرّف على ماهية Grok 4.7، بما في ذلك نافذة السياق 500K، الاختبارات المعيارية، التسعير، أوضاع الاستدلال، قدرات الوكيل، المقارنة مع Grok 4.6، وإمكانية الوصول.

CometAPI
Deon Goodwinفريق أبحاث نماذج AI وAPI
تم التحديث Sep 22, 2026 11 دقائق للقراءة
Grok 4.7: الاختبارات المعيارية، التسعير، الميزات والوصول إلى واجهة برمجة التطبيقات
استخدم هذا النمط

أجرِ أول استدعاء لـ API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Grok 4.7 هو نموذج SpaceXAI الحدّي المخصص للبرمجة، وسير عمل الوكلاء، والعمل المعرفي المهني، صدر في 21 سبتمبر 2026. يجمع بين نافذة سياق بسعة 500,000 رمز، وإدخال نصوص وصور، واستدلال قابل للضبط، واستدعاء الدوال، وبحث الويب وX، وتنفيذ الشيفرة.

للمهام دون 200,000 رمز في الموجه، يسرد xAI API الرسمي 2 دولار لكل مليون رمز إدخال، و0.50 دولار لكل مليون رمز إدخال مخزَّن مؤقتاً، و6 دولارات لكل مليون رمز إخراج. تسرد CometAPI حالياً Grok 4.7 بسعر 1.60 دولار للإدخال، و0.40 دولار للإدخال المخزَّن مؤقتاً، و4.80 دولارات للإخراج لكل مليون رمز لنفس الفئة—أي خفض بنسبة 20% مقارنة بالأسعار الرسمية المعروضة على صفحة النموذج.

القيمة العملية ليست قيادة شاملة لمعايير الاختبار. يصبح Grok 4.7 أكثر إقناعاً عندما يجمع عبء العمل بين مهام هندسية، وحلقات وكيل طويلة، واستخدام أدوات، وسياقات عمل كبيرة، وحساسية تجاه تكلفة رموز الإخراج. ينبغي للفرق التحقق منه على مستودعاتها وسير عملها قبل توجيهه للإنتاج.

النقاط الرئيسية

  • يستخدم Grok 4.7 نموذجاً أساسياً أكبر من Grok 4.6، وتعزيزاً أطول للتعلم على مهام أصعب تستغرق ساعات، وتحقيقاً ذاتياً أقوى.
  • يدعم API نافذة سياق بسعة 500,000 رمز، وإدخال نصوص وصور، ومخرجات نصية، وأربع درجات استدلال، ومخرجات منظمة، واستدعاء الدوال، وبحث الويب وX، وتنفيذ الشيفرة.
  • تبلغ SpaceXAI 46.3% على CursorBench 4.0، و71.0% على DeepSWE v1.1، و38.0% على Terminal-Bench 4.0. هذه نتائج منشورة من البائع وليست دليلاً على التفوق الشامل.
  • تسرد CometAPI نموذج Grok 4.7 على أنه متاح، مع نقطة نهاية متوافقة مع OpenAI وأسعار أقل بـ20% من أسعار xAI الرسمية المعروضة حالياً في كتالوجها.
  • اختر Grok 4.7 للوكلاء الهندسيين الحساسين للسعر والاستخدام المستمر للأدوات؛ واختر بدائل عندما يكون السياق شديد الطول أو مجال معياري بالغ الأهمية أهم من سعر الوحدة.

ما هو Grok 4.7؟

Grok 4.7 هو أحدث نموذج لغوي كبير من SpaceXAI موجه لـالبرمجة، ومهام الوكلاء المستقلة، والعمل المعرفي المهني. يركز الإصدار على المهام التي تتطلب تفاعلاً مستداماً، واستخدام أدوات، والتحقق، والمراجعة بدلاً من الاكتفاء بإجابات أحادية.

تقول SpaceXAI إن Grok 4.7 تم تدريبه عبر تشغيل تعزيز تعلم أطول على مزيج أصعب من المهام، مع وزن أكبر للمشكلات التي قد تستغرق ساعات لحلها. يجعل هذا التوجه التدريبي النموذج مناسباً بشكل خاص لهندسة البرمجيات على مستوى المستودعات، وتصحيح الأخطاء، والبحث، وإنشاء الوثائق، والتحليل الهندسي، والأتمتة متعددة الخطوات.

ما الذي يميز Grok 4.7 عن Grok 4.6—وكيف هو أفضل؟

نموذج أساسي أكبر

ينتقل Grok 4.7 إلى نموذج أساسي أكبر من Grok 4.6. لم تفصح SpaceXAI عن عدد معلمات نهائي علني، والخلاصة المنطقية هي زيادة سعة النموذج الأساسي—وليس تقديراً محدداً للمعلمات.

تعزيز تعلم أطول على مهام أصعب

تم تمديد مرحلة تعزيز التعلم وتحويلها نحو مشكلات أصعب وأطول أفقاً. تؤكد SpaceXAI على المهام التي قد تتطلب ساعات من العمل، ما ينسجم مع البرمجة الذاتية، والبحث، وسير عمل الوكلاء المهنيين.

تحقق ذاتي أقوى

تم تدريب Grok 4.7 على فحص عمله بمزيد من العناية. يهم ذلك في هندسة البرمجيات لأن الوكيل الموثوق يجب أن يفحص ويعدل ويختبر ويشخّص الإخفاقات ويعيد ويتحقق—لا أن يكتفي بإجابة أولية.

تحسينات مقيسة على Grok 4.6

البُعدGrok 4.6Grok 4.7التغيير
CursorBench 4.040.4%46.3%+5.9 نقاط
DeepSWE v1.165.2%71.0%+5.8 نقاط
EEBench53.0%64.0%+11.0 نقاط
AA Briefcase v1.11,5461,657+111
Terminal-Bench 4.020.3%38.0%+17.7 نقاط
Harvey Legal Agent Benchmark15.8%19.6%+3.8 نقاط
HealthBench Professional48.5%56.7%+8.2 نقاط

عبر مجموعة الإطلاق المنشورة، يتحسن Grok 4.7 مقارنة بـ Grok 4.6 في كل نتيجة مدرجة. أكبر مكسب مطلق على Terminal-Bench 4.0، بما ينسجم مع تركيز الإصدار على سير العمل طويلة الأمد عبر سطر الأوامر واستخدام الأدوات. تبقى هذه الأرقام منشورة من البائع ويجب اختبارها على مهام واقعية قبل قرار الترحيل.

ما مدى جودة Grok 4.7 على المعايير؟

يغطي تقييم الإطلاق من SpaceXAI هندسة البرمجيات، والعمل على الطرفية، والمهام المكتبية المهنية، والعمل القانوني، والاستدلال السريري، والهندسة الكهربائية. هذه نتائج منشورة من البائع ويجب التحقق منها مقابل أعباء العمل الإنتاجية قبل قرارات الشراء أو التوجيه.

معيارGrok 4.7 xHighGrok 4.6 HighGPT-5.6 Sol MaxFable 5.1 Max
CursorBench 4.046.3%40.4%41.7%51.8%
DeepSWE v1.171.0%*65.2%72.7%70.0%
EEBench64.0%53.0%39.4%56.4%
AA Briefcase v1.11,6571,5461,4871,678
Terminal-Bench 4.038.0%20.3%37.3%57.9%
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%
HealthBench Professional56.7%48.5%60.5%62.1%

في نتائج إطلاق Grok 4.7، تشير SpaceXAI إلى أن نتيجة 71.0% على DeepSWE v1.1 تمت بجهد استدلال عالٍ.

لا يفصح إعلان الإطلاق عن كل أدوات القياس لكل معيار، أو إعدادات الأدوات، أو عدد التشغيلات، أو بيئة التقييم. عامل هذه القيم على أنها نتائج منشورة من البائع، وتحقق من النموذج على مستودعاتك، وأدواتك، وأهداف زمن الاستجابة، ومعايير الإخفاق قبل توجيه الأعمال الإنتاجية.

ماذا تُظهر بصمة Grok 4.7 على المعايير؟

هندسة البرمجيات

ترتفع CursorBench 4.0 من 40.4% على Grok 4.6 إلى 46.3% على Grok 4.7، بينما ترتفع DeepSWE v1.1 من 65.2% إلى 71.0%. يدعم ذلك تموضع Grok 4.7 كنموذج لوكلاء البرمجة وليس مجرد مساعد برمجي حواري.

العمل طويل الأمد على الطرفية

Terminal-Bench 4.0 تُظهر أحد أكبر التغييرات الجيلية: 20.3% لـ Grok 4.6 مقابل 38.0% لـ Grok 4.7. المكسب المطلق البالغ 17.7 نقطة يتسق مع تركيز SpaceXAI على تعزيز التعلم أطول أفقاً والتحقق الذاتي.

الهندسة الكهربائية

على EEBench، يصل Grok 4.7 إلى 64.0% مقارنة بـ 53.0% لـ Grok 4.6. من بين المقارنات المنشورة، يعد هذا أحد أقوى نتائج Grok 4.7 النسبية.

العمل المعرفي المهني

ترتفع AA Briefcase v1.1 من 1,546 إلى 1,657. تم تصميم هذه المهام لتعكس أعمالاً مهنية تمتد لساعات، تشمل قطع عمل مثل المستندات والعروض والتحليلات ومخرجات منظمة أخرى.

Grok 4.7 مقابل GPT-5.6 Sol مقابل Fable 5.1: كيف يقارنون؟

عمليات التحقق من الأسعار لدى مزودي الخدمات: تسرد OpenAI نموذج GPT-5.6 Sol بسعر 4 دولارات لكل مليون رمز إدخال و20 دولاراً لكل مليون رمز إخراج، بينما تسرد Anthropic Claude Fable 5.1 بسعر 10 دولارات لكل مليون رمز إدخال و50 دولاراً لكل مليون رمز إخراج.

البُعدGrok 4.7GPT-5.6 SolClaude Fable 5.1
التموضع الأساسيالبرمجة، مهام الوكلاء، العمل المعرفياستدلال مهني معقد وبرمجةوكلاء طويلة الأمد، برمجة، وعمل معرفي
نافذة السياق500,000 رمز1,050,000 رمز1,000,000 رمز
الأنماطإدخال نصوص وصور؛ مخرجات نصيةإدخال نصوص وصور؛ مخرجات نصيةإدخال نصوص وصور؛ مخرجات نصية
التحكم في الاستدلالمنخفض، متوسط، عالٍ، xhighلا يوجد حتى maxتفكير تكيفي بجهد قابل للضبط
حالة مزود الـ APIمتاح عبر xAI API العاممتاح عبر OpenAI Chat Completions وResponsesمتاح عبر Claude API والأسواق السحابية المدعومة
سعر الإدخال / 1M رمز$2$4$10
سعر الإخراج / 1M رمز$6$20$50
CursorBench 4.046.3%41.7%51.8%
DeepSWE v1.171.0%72.7%70.0%
أنسب استخداموكلاء هندسيون حساسو السعر واستخدام أدوات مستداماستدلال مهني واسع مع سياق طويل جداًأقصى أداء لوكلاء طويلة الأمد والعمل المعرفي مقابل سعر أعلى

أي نموذج ينبغي اختيارُه؟

  • اختر Grok 4.7 عندما تكون أعباء العمل الهندسية، والاستخدام المستمر للأدوات، والاستدلال القابل للضبط، وانخفاض تكلفة رموز الإخراج هي الأولوية. إنه جذاب بشكل خاص لوكلاء المستودعات، وسير عمل الطرفية، والبحث بسياقات كبيرة تبقى دون عتبة تسعير 200 ألف.
  • اختر GPT-5.6 Sol عندما تتطلب المهمة استدلالاً مهنياً أوسع، أو نافذة سياق تتجاوز مليون رمز، أو عندما يتم التحقق من نتيجته الأقوى على تقييم بالغ الأهمية مثل DeepSWE أو الاستدلال السريري ضمن أدواتك.
  • اختر Claude Fable 5.1 عندما يبرر الأداء الأقصى للوكلاء طويلة الأمد، وجودة البرمجة، وتنفيذ الطرفية، أو الاستدلال السريري سعر الرموز الأعلى.
  • استخدم توجيه النماذج عندما تتنوع أعباء العمل. وجّه الخطوات الروتينية والهندسية عالية الحجم إلى النموذج الأكثر كفاءة من حيث التكلفة، واحتفظ بالنموذج الأغلى للمهام التي تبرر فيها معدلات النجاح المقاسة هذا التفوق.

الاختيار الصحيح يعتمد على نجاح المهمة من طرف إلى طرف، وزمن الاستجابة، وإعادات المحاولة، ودقة استدعاء الأدوات، وإعادة العمل اليدوي—وليس على معيار واحد أو سعر رموز عنواني.

كم يكلف Grok 4.7 API؟

تقارن الجدول أدناه بين أسعار xAI الرسمية والأسعار المعروضة على صفحة نموذج Grok 4.7 في CometAPI بتاريخ 22 سبتمبر 2026. تفيد CometAPI بخصم 20%؛ تحقّق من الأسعار المباشرة قبل الإنتاج لأن أسعار البوابات والشروط الترويجية يمكن أن تتغير.

فئة الموجهنوع السعرxAI الرسميCometAPIالفرق
دون 200K رمز موجهالإدخال / 1M$2.00$1.60أقل 20%
الإدخال المخزَّن مؤقتاً / 1M$0.50$0.40أقل 20%
الإخراج / 1M$6.00$4.80أقل 20%
فوق 200K رمز موجهالإدخال / 1M$4.00$3.20أقل 20%
الإدخال المخزَّن مؤقتاً / 1M$1.00$0.80أقل 20%
الإخراج / 1M$12.00$9.60أقل 20%

تسعير السياق القياسي لِموجهات حتى 200,000 رمز

للطلبات التي لا يتجاوز موجهها 200,000 رمز، يكلف Grok 4.7 $2 لكل مليون رمز إدخال، و**$0.50 لكل مليون رمز إدخال مخزَّن مؤقتاً**، و**$6 لكل مليون رمز إخراج**. الإدخال المخزَّن مؤقتاً هو الأقل تكلفة، لذا يمكن للتطبيقات ذات تعليمات نظام متكررة أو سياق قابل لإعادة الاستخدام تقليل التكلفة عندما تكون تلك الرموز مؤهلة للتخزين المؤقت.

على سبيل المثال البسيط، طلب يستخدم 100,000 رمز إدخال غير مخزَّن مؤقتاً وينتج 10,000 رمز إخراج سيكلف تقريباً $0.26 قبل أي رسوم منصة أخرى: $0.20 للإدخال و$0.06 للإخراج.

تسعير السياق الطويل فوق 200,000 رمز في الموجه

عندما يتجاوز الموجه 200,000 رمز، تتضاعف الأسعار إلى $4 لكل مليون رمز إدخال، و**$1 لكل مليون رمز إدخال مخزَّن مؤقتاً**، و**$12 لكل مليون رمز إخراج**. تُطبق الفئة الأعلى بسبب طول الموجه، لذا ينبغي للفرق مراقبة تاريخ المحادثة المتراكم، وآثار الأدوات، والمستندات المجلوبة، وسياق المستودعات قبل إرسال كل طلب.

لذا فإن قرار التكلفة العملي ليس فقط عدد الرموز التي يستخدمها العمل، بل ما إذا كان الموجه يتجاوز حد 200,000 رمز. يمكن أن يحافظ تلخيص العمل المكتمل، وإزالة مخرجات الأدوات غير اللازمة، وجلب الملفات الأكثر صلة فقط على أعباء العمل المناسبة ضمن الفئة القياسية دون التضحية بالسياق الضروري.

توثق ملاحظات إصدار SpaceXAI هذا الحد. يجب أن تأخذ ميزانيات الإنتاج في الحسبان أيضاً إعادات المحاولة، وحلقات الوكيل، واستدعاءات الأدوات الفاشلة، وطول الإخراج بدلاً من مقارنة المزوّدين فقط بسعر رموز الإدخال العنواني.

ما الذي يجعل Grok 4.7 مفيداً للوكلاء الذكائيين؟

  • نافذة سياق 500K: تحتفظ بقدر كبير من الشيفرة المصدرية، والمواصفات، ومخرجات الأدوات، والسجلات، وتاريخ المحادثة ضمن سياق عمل واحد. هذا مفيد لبرمجة على مستوى المستودع وتحليل متعدد المستندات، مع الحاجة دوماً لتشذيب السياق.
  • استدلال قابل للضبط: يمكن للتطبيقات اختيار جهد منخفض، متوسط، عالٍ، أو xhigh، للموازنة بين زمن الاستجابة والحوسبة مقابل استدلال أعمق بحسب صعوبة المهمة.
  • استدعاء الدوال ومخرجات منظمة: يمكن للوكلاء استعلام قواعد البيانات، وتشغيل الاختبارات، ومعاينة المستندات، واستدعاء واجهات داخلية، وإرجاع نتائج قابلة للقراءة آلياً.
  • بحث الويب وX: يمكن لأدوات البحث جلب معلومات حديثة عندما تكون بيانات تدريب النموذج غير كافية. ينبغي دوماً التعامل مع المحتوى المجلوب على أنه غير موثوق والتحقق منه.
  • تنفيذ الشيفرة: يمكن للنموذج التحقق من الحسابات، وتحويل البيانات، واختبار الحلول المُولدة بدلاً من الاعتماد فقط على استدلال النموذج اللغوي.
  • تركيز على سير عمل طويلة الأفق: يؤكد التدريب على مهام تمتد لساعات، وإدارة السياق، والتحقق الذاتي لاستهداف حلقات الوكيل التي تراكم آثار الأدوات وتتطلب تعافياً بعد الإخفاق.

كيف يحسّن Grok 4.7 الأمان؟

تقول SpaceXAI إن Grok 4.7 يقدم بنية حماية جديدة بالكامل وتبلغ عن مقاومة أقوى للاختراق وسلامة أفضل للاستخدام المزدوج. في إعلان الإطلاق، تبلغ الشركة 62.4% على معيار السلامة الحيوية من LatchBio وتقول إن 3.3% فقط من الموجهات ثنائية الاستخدام الخطرة سُمح لها بالمرور على HackerBench v0.3.

هذه أرقام تقييم منشورة من البائع. هي مفيدة لفهم ادعاءات الإصدار لكنها ليست مقياساً عاماً لأداء الأمان في الواقع.

كيف يمكن للمطورين استخدام Grok 4.7 API؟

Grok 4.7 متاح حالياً عبر CometAPI تحت معرّف النموذج grok-4.7. توفر CometAPI نقطة نهاية متوافقة مع OpenAI، ومفتاح API واحداً وتدفق فواتير عبر مزودي نماذج متعددين، وسهولة اختبار وتوجيه النماذج جنباً إلى جنب، وأسعار رموز مُعلنة حالياً أقل بـ20% من أسعار xAI الرسمية. قبل الاستخدام الإنتاجي، أكد صفحة النموذج المباشرة، وصحة نقطة النهاية، والمعلمات المدعومة، والأسعار، ومتطلبات التعامل مع البيانات.

مثال طلب CometAPI:

curl "https://api.cometapi.com/v1/responses" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  -d '{
    "model": "grok-4.7",
    "input": "Explain how a distributed task queue handles worker failure."
  }'

هل يستحق Grok 4.7 الانتقال إليه؟

بالنسبة لمستخدمي Grok 4.6 الحاليين الذين يعتمدون على وكلاء البرمجة أو سير العمل المهني طويلة الأمد، يُعد Grok 4.7 ترقية ذات مغزى لأن مجموعة معايير الإطلاق تتحسن عبر كل بُعد مُعلن بينما تبقى أسعار الرموز القياسية دون عتبة السياق الطويل عند نفس مستوى $2/$6.

بالنسبة لمستخدمي نماذج حدّية أخرى، يعتمد القرار على عبء العمل. يُعد Grok 4.7 مثيراً للاهتمام عندما تكون تكلفة رموز الإخراج، والأعباء الهندسية، والسياقات الكبيرة، واستخدام الأدوات المستمر عوامل مهمة. حيث يكون نموذج آخر أقوى في مجال بالغ الأهمية، قد يكون توجيه النماذج أكثر منطقية من استبدال كل نموذج بمزوّد واحد.

الخلاصة

Grok 4.7 أكثر من تحديث رقمي روتيني لـ Grok 4.6. الإصدار موجَّه صراحةً نحو العمل طويل الأمد المنفذ عبر أدوات، مع تحقق متكرر، وسياقات كبيرة، وخطوات تنفيذ متعددة.

تظهر أقوى المكاسب الجيلية حيث ينبغي لهذا التوجه التدريبي أن يؤثر: ترتفع Terminal-Bench 4.0 من 20.3% إلى 38.0%، وEEBench من 53.0% إلى 64.0%، وCursorBench 4.0 من 40.4% إلى 46.3%، بينما تبقى الأسعار القياسية دون عتبة 200 ألف رمز عند $2/مليون للإدخال و$6/مليون للإخراج.

القيمة العملية ليست “Grok 4.7 يفوز بكل معيار.” بل إنه يضيّق الفجوة بين قدرات الوكلاء الحدّية وتكلفة استدلال أقل، ما يجعله ذا صلة خاصة بوكلاء البرمجة، وأنظمة البحث، وسير العمل المهني التي تحتاج إلى العمل عبر خطوات عديدة بدلاً من إجابة واحدة.

تابع التعلّم

اربط هذه المقالة بالقرار التالي.

عرض جميع الموضوعات
نُشر في Sep 22, 2026
آخر تحديث Sep 22, 2026
19 مشاهدات
تمت المراجعة للوضوح ودقة المصدر ومصطلحات API الحالية.

هل أنت مستعد لخفض تكاليف تطوير الذكاء الاصطناعي بنسبة 20%؟

ابدأ مجاناً في دقائق. رصيد تجريبي مجاني مدرج. لا حاجة لبطاقة ائتمانية.

اقرأ المزيد