TL;DR
Grok 4.7 هو نموذج SpaceXAI الحدّي المخصص للبرمجة، وسير عمل الوكلاء، والعمل المعرفي المهني، صدر في 21 سبتمبر 2026. يجمع بين نافذة سياق بسعة 500,000 رمز، وإدخال نصوص وصور، واستدلال قابل للضبط، واستدعاء الدوال، وبحث الويب وX، وتنفيذ الشيفرة.
للمهام دون 200,000 رمز في الموجه، يسرد xAI API الرسمي 2 دولار لكل مليون رمز إدخال، و0.50 دولار لكل مليون رمز إدخال مخزَّن مؤقتاً، و6 دولارات لكل مليون رمز إخراج. تسرد CometAPI حالياً Grok 4.7 بسعر 1.60 دولار للإدخال، و0.40 دولار للإدخال المخزَّن مؤقتاً، و4.80 دولارات للإخراج لكل مليون رمز لنفس الفئة—أي خفض بنسبة 20% مقارنة بالأسعار الرسمية المعروضة على صفحة النموذج.
القيمة العملية ليست قيادة شاملة لمعايير الاختبار. يصبح Grok 4.7 أكثر إقناعاً عندما يجمع عبء العمل بين مهام هندسية، وحلقات وكيل طويلة، واستخدام أدوات، وسياقات عمل كبيرة، وحساسية تجاه تكلفة رموز الإخراج. ينبغي للفرق التحقق منه على مستودعاتها وسير عملها قبل توجيهه للإنتاج.
النقاط الرئيسية
- يستخدم Grok 4.7 نموذجاً أساسياً أكبر من Grok 4.6، وتعزيزاً أطول للتعلم على مهام أصعب تستغرق ساعات، وتحقيقاً ذاتياً أقوى.
- يدعم API نافذة سياق بسعة 500,000 رمز، وإدخال نصوص وصور، ومخرجات نصية، وأربع درجات استدلال، ومخرجات منظمة، واستدعاء الدوال، وبحث الويب وX، وتنفيذ الشيفرة.
- تبلغ SpaceXAI 46.3% على CursorBench 4.0، و71.0% على DeepSWE v1.1، و38.0% على Terminal-Bench 4.0. هذه نتائج منشورة من البائع وليست دليلاً على التفوق الشامل.
- تسرد CometAPI نموذج Grok 4.7 على أنه متاح، مع نقطة نهاية متوافقة مع OpenAI وأسعار أقل بـ20% من أسعار xAI الرسمية المعروضة حالياً في كتالوجها.
- اختر Grok 4.7 للوكلاء الهندسيين الحساسين للسعر والاستخدام المستمر للأدوات؛ واختر بدائل عندما يكون السياق شديد الطول أو مجال معياري بالغ الأهمية أهم من سعر الوحدة.
ما هو Grok 4.7؟
Grok 4.7 هو أحدث نموذج لغوي كبير من SpaceXAI موجه لـالبرمجة، ومهام الوكلاء المستقلة، والعمل المعرفي المهني. يركز الإصدار على المهام التي تتطلب تفاعلاً مستداماً، واستخدام أدوات، والتحقق، والمراجعة بدلاً من الاكتفاء بإجابات أحادية.
تقول SpaceXAI إن Grok 4.7 تم تدريبه عبر تشغيل تعزيز تعلم أطول على مزيج أصعب من المهام، مع وزن أكبر للمشكلات التي قد تستغرق ساعات لحلها. يجعل هذا التوجه التدريبي النموذج مناسباً بشكل خاص لهندسة البرمجيات على مستوى المستودعات، وتصحيح الأخطاء، والبحث، وإنشاء الوثائق، والتحليل الهندسي، والأتمتة متعددة الخطوات.
ما الذي يميز Grok 4.7 عن Grok 4.6—وكيف هو أفضل؟
نموذج أساسي أكبر
ينتقل Grok 4.7 إلى نموذج أساسي أكبر من Grok 4.6. لم تفصح SpaceXAI عن عدد معلمات نهائي علني، والخلاصة المنطقية هي زيادة سعة النموذج الأساسي—وليس تقديراً محدداً للمعلمات.
تعزيز تعلم أطول على مهام أصعب
تم تمديد مرحلة تعزيز التعلم وتحويلها نحو مشكلات أصعب وأطول أفقاً. تؤكد SpaceXAI على المهام التي قد تتطلب ساعات من العمل، ما ينسجم مع البرمجة الذاتية، والبحث، وسير عمل الوكلاء المهنيين.
تحقق ذاتي أقوى
تم تدريب Grok 4.7 على فحص عمله بمزيد من العناية. يهم ذلك في هندسة البرمجيات لأن الوكيل الموثوق يجب أن يفحص ويعدل ويختبر ويشخّص الإخفاقات ويعيد ويتحقق—لا أن يكتفي بإجابة أولية.
تحسينات مقيسة على Grok 4.6
| البُعد | Grok 4.6 | Grok 4.7 | التغيير |
|---|---|---|---|
| CursorBench 4.0 | 40.4% | 46.3% | +5.9 نقاط |
| DeepSWE v1.1 | 65.2% | 71.0% | +5.8 نقاط |
| EEBench | 53.0% | 64.0% | +11.0 نقاط |
| AA Briefcase v1.1 | 1,546 | 1,657 | +111 |
| Terminal-Bench 4.0 | 20.3% | 38.0% | +17.7 نقاط |
| Harvey Legal Agent Benchmark | 15.8% | 19.6% | +3.8 نقاط |
| HealthBench Professional | 48.5% | 56.7% | +8.2 نقاط |
عبر مجموعة الإطلاق المنشورة، يتحسن Grok 4.7 مقارنة بـ Grok 4.6 في كل نتيجة مدرجة. أكبر مكسب مطلق على Terminal-Bench 4.0، بما ينسجم مع تركيز الإصدار على سير العمل طويلة الأمد عبر سطر الأوامر واستخدام الأدوات. تبقى هذه الأرقام منشورة من البائع ويجب اختبارها على مهام واقعية قبل قرار الترحيل.
ما مدى جودة Grok 4.7 على المعايير؟
يغطي تقييم الإطلاق من SpaceXAI هندسة البرمجيات، والعمل على الطرفية، والمهام المكتبية المهنية، والعمل القانوني، والاستدلال السريري، والهندسة الكهربائية. هذه نتائج منشورة من البائع ويجب التحقق منها مقابل أعباء العمل الإنتاجية قبل قرارات الشراء أو التوجيه.
| معيار | Grok 4.7 xHigh | Grok 4.6 High | GPT-5.6 Sol Max | Fable 5.1 Max |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
في نتائج إطلاق Grok 4.7، تشير SpaceXAI إلى أن نتيجة 71.0% على DeepSWE v1.1 تمت بجهد استدلال عالٍ.
لا يفصح إعلان الإطلاق عن كل أدوات القياس لكل معيار، أو إعدادات الأدوات، أو عدد التشغيلات، أو بيئة التقييم. عامل هذه القيم على أنها نتائج منشورة من البائع، وتحقق من النموذج على مستودعاتك، وأدواتك، وأهداف زمن الاستجابة، ومعايير الإخفاق قبل توجيه الأعمال الإنتاجية.
ماذا تُظهر بصمة Grok 4.7 على المعايير؟
هندسة البرمجيات
ترتفع CursorBench 4.0 من 40.4% على Grok 4.6 إلى 46.3% على Grok 4.7، بينما ترتفع DeepSWE v1.1 من 65.2% إلى 71.0%. يدعم ذلك تموضع Grok 4.7 كنموذج لوكلاء البرمجة وليس مجرد مساعد برمجي حواري.
العمل طويل الأمد على الطرفية
Terminal-Bench 4.0 تُظهر أحد أكبر التغييرات الجيلية: 20.3% لـ Grok 4.6 مقابل 38.0% لـ Grok 4.7. المكسب المطلق البالغ 17.7 نقطة يتسق مع تركيز SpaceXAI على تعزيز التعلم أطول أفقاً والتحقق الذاتي.
الهندسة الكهربائية
على EEBench، يصل Grok 4.7 إلى 64.0% مقارنة بـ 53.0% لـ Grok 4.6. من بين المقارنات المنشورة، يعد هذا أحد أقوى نتائج Grok 4.7 النسبية.
العمل المعرفي المهني
ترتفع AA Briefcase v1.1 من 1,546 إلى 1,657. تم تصميم هذه المهام لتعكس أعمالاً مهنية تمتد لساعات، تشمل قطع عمل مثل المستندات والعروض والتحليلات ومخرجات منظمة أخرى.
Grok 4.7 مقابل GPT-5.6 Sol مقابل Fable 5.1: كيف يقارنون؟
عمليات التحقق من الأسعار لدى مزودي الخدمات: تسرد OpenAI نموذج GPT-5.6 Sol بسعر 4 دولارات لكل مليون رمز إدخال و20 دولاراً لكل مليون رمز إخراج، بينما تسرد Anthropic Claude Fable 5.1 بسعر 10 دولارات لكل مليون رمز إدخال و50 دولاراً لكل مليون رمز إخراج.
| البُعد | Grok 4.7 | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
| التموضع الأساسي | البرمجة، مهام الوكلاء، العمل المعرفي | استدلال مهني معقد وبرمجة | وكلاء طويلة الأمد، برمجة، وعمل معرفي |
| نافذة السياق | 500,000 رمز | 1,050,000 رمز | 1,000,000 رمز |
| الأنماط | إدخال نصوص وصور؛ مخرجات نصية | إدخال نصوص وصور؛ مخرجات نصية | إدخال نصوص وصور؛ مخرجات نصية |
| التحكم في الاستدلال | منخفض، متوسط، عالٍ، xhigh | لا يوجد حتى max | تفكير تكيفي بجهد قابل للضبط |
| حالة مزود الـ API | متاح عبر xAI API العام | متاح عبر OpenAI Chat Completions وResponses | متاح عبر Claude API والأسواق السحابية المدعومة |
| سعر الإدخال / 1M رمز | $2 | $4 | $10 |
| سعر الإخراج / 1M رمز | $6 | $20 | $50 |
| CursorBench 4.0 | 46.3% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0% | 72.7% | 70.0% |
| أنسب استخدام | وكلاء هندسيون حساسو السعر واستخدام أدوات مستدام | استدلال مهني واسع مع سياق طويل جداً | أقصى أداء لوكلاء طويلة الأمد والعمل المعرفي مقابل سعر أعلى |
أي نموذج ينبغي اختيارُه؟
- اختر Grok 4.7 عندما تكون أعباء العمل الهندسية، والاستخدام المستمر للأدوات، والاستدلال القابل للضبط، وانخفاض تكلفة رموز الإخراج هي الأولوية. إنه جذاب بشكل خاص لوكلاء المستودعات، وسير عمل الطرفية، والبحث بسياقات كبيرة تبقى دون عتبة تسعير 200 ألف.
- اختر GPT-5.6 Sol عندما تتطلب المهمة استدلالاً مهنياً أوسع، أو نافذة سياق تتجاوز مليون رمز، أو عندما يتم التحقق من نتيجته الأقوى على تقييم بالغ الأهمية مثل DeepSWE أو الاستدلال السريري ضمن أدواتك.
- اختر Claude Fable 5.1 عندما يبرر الأداء الأقصى للوكلاء طويلة الأمد، وجودة البرمجة، وتنفيذ الطرفية، أو الاستدلال السريري سعر الرموز الأعلى.
- استخدم توجيه النماذج عندما تتنوع أعباء العمل. وجّه الخطوات الروتينية والهندسية عالية الحجم إلى النموذج الأكثر كفاءة من حيث التكلفة، واحتفظ بالنموذج الأغلى للمهام التي تبرر فيها معدلات النجاح المقاسة هذا التفوق.
الاختيار الصحيح يعتمد على نجاح المهمة من طرف إلى طرف، وزمن الاستجابة، وإعادات المحاولة، ودقة استدعاء الأدوات، وإعادة العمل اليدوي—وليس على معيار واحد أو سعر رموز عنواني.
كم يكلف Grok 4.7 API؟
تقارن الجدول أدناه بين أسعار xAI الرسمية والأسعار المعروضة على صفحة نموذج Grok 4.7 في CometAPI بتاريخ 22 سبتمبر 2026. تفيد CometAPI بخصم 20%؛ تحقّق من الأسعار المباشرة قبل الإنتاج لأن أسعار البوابات والشروط الترويجية يمكن أن تتغير.
| فئة الموجه | نوع السعر | xAI الرسمي | CometAPI | الفرق |
|---|---|---|---|---|
| دون 200K رمز موجه | الإدخال / 1M | $2.00 | $1.60 | أقل 20% |
| الإدخال المخزَّن مؤقتاً / 1M | $0.50 | $0.40 | أقل 20% | |
| الإخراج / 1M | $6.00 | $4.80 | أقل 20% | |
| فوق 200K رمز موجه | الإدخال / 1M | $4.00 | $3.20 | أقل 20% |
| الإدخال المخزَّن مؤقتاً / 1M | $1.00 | $0.80 | أقل 20% | |
| الإخراج / 1M | $12.00 | $9.60 | أقل 20% |
تسعير السياق القياسي لِموجهات حتى 200,000 رمز
للطلبات التي لا يتجاوز موجهها 200,000 رمز، يكلف Grok 4.7 $2 لكل مليون رمز إدخال، و**$0.50 لكل مليون رمز إدخال مخزَّن مؤقتاً**، و**$6 لكل مليون رمز إخراج**. الإدخال المخزَّن مؤقتاً هو الأقل تكلفة، لذا يمكن للتطبيقات ذات تعليمات نظام متكررة أو سياق قابل لإعادة الاستخدام تقليل التكلفة عندما تكون تلك الرموز مؤهلة للتخزين المؤقت.
على سبيل المثال البسيط، طلب يستخدم 100,000 رمز إدخال غير مخزَّن مؤقتاً وينتج 10,000 رمز إخراج سيكلف تقريباً $0.26 قبل أي رسوم منصة أخرى: $0.20 للإدخال و$0.06 للإخراج.
تسعير السياق الطويل فوق 200,000 رمز في الموجه
عندما يتجاوز الموجه 200,000 رمز، تتضاعف الأسعار إلى $4 لكل مليون رمز إدخال، و**$1 لكل مليون رمز إدخال مخزَّن مؤقتاً**، و**$12 لكل مليون رمز إخراج**. تُطبق الفئة الأعلى بسبب طول الموجه، لذا ينبغي للفرق مراقبة تاريخ المحادثة المتراكم، وآثار الأدوات، والمستندات المجلوبة، وسياق المستودعات قبل إرسال كل طلب.
لذا فإن قرار التكلفة العملي ليس فقط عدد الرموز التي يستخدمها العمل، بل ما إذا كان الموجه يتجاوز حد 200,000 رمز. يمكن أن يحافظ تلخيص العمل المكتمل، وإزالة مخرجات الأدوات غير اللازمة، وجلب الملفات الأكثر صلة فقط على أعباء العمل المناسبة ضمن الفئة القياسية دون التضحية بالسياق الضروري.
توثق ملاحظات إصدار SpaceXAI هذا الحد. يجب أن تأخذ ميزانيات الإنتاج في الحسبان أيضاً إعادات المحاولة، وحلقات الوكيل، واستدعاءات الأدوات الفاشلة، وطول الإخراج بدلاً من مقارنة المزوّدين فقط بسعر رموز الإدخال العنواني.
ما الذي يجعل Grok 4.7 مفيداً للوكلاء الذكائيين؟
- نافذة سياق 500K: تحتفظ بقدر كبير من الشيفرة المصدرية، والمواصفات، ومخرجات الأدوات، والسجلات، وتاريخ المحادثة ضمن سياق عمل واحد. هذا مفيد لبرمجة على مستوى المستودع وتحليل متعدد المستندات، مع الحاجة دوماً لتشذيب السياق.
- استدلال قابل للضبط: يمكن للتطبيقات اختيار جهد منخفض، متوسط، عالٍ، أو xhigh، للموازنة بين زمن الاستجابة والحوسبة مقابل استدلال أعمق بحسب صعوبة المهمة.
- استدعاء الدوال ومخرجات منظمة: يمكن للوكلاء استعلام قواعد البيانات، وتشغيل الاختبارات، ومعاينة المستندات، واستدعاء واجهات داخلية، وإرجاع نتائج قابلة للقراءة آلياً.
- بحث الويب وX: يمكن لأدوات البحث جلب معلومات حديثة عندما تكون بيانات تدريب النموذج غير كافية. ينبغي دوماً التعامل مع المحتوى المجلوب على أنه غير موثوق والتحقق منه.
- تنفيذ الشيفرة: يمكن للنموذج التحقق من الحسابات، وتحويل البيانات، واختبار الحلول المُولدة بدلاً من الاعتماد فقط على استدلال النموذج اللغوي.
- تركيز على سير عمل طويلة الأفق: يؤكد التدريب على مهام تمتد لساعات، وإدارة السياق، والتحقق الذاتي لاستهداف حلقات الوكيل التي تراكم آثار الأدوات وتتطلب تعافياً بعد الإخفاق.
كيف يحسّن Grok 4.7 الأمان؟
تقول SpaceXAI إن Grok 4.7 يقدم بنية حماية جديدة بالكامل وتبلغ عن مقاومة أقوى للاختراق وسلامة أفضل للاستخدام المزدوج. في إعلان الإطلاق، تبلغ الشركة 62.4% على معيار السلامة الحيوية من LatchBio وتقول إن 3.3% فقط من الموجهات ثنائية الاستخدام الخطرة سُمح لها بالمرور على HackerBench v0.3.
هذه أرقام تقييم منشورة من البائع. هي مفيدة لفهم ادعاءات الإصدار لكنها ليست مقياساً عاماً لأداء الأمان في الواقع.
كيف يمكن للمطورين استخدام Grok 4.7 API؟
Grok 4.7 متاح حالياً عبر CometAPI تحت معرّف النموذج grok-4.7. توفر CometAPI نقطة نهاية متوافقة مع OpenAI، ومفتاح API واحداً وتدفق فواتير عبر مزودي نماذج متعددين، وسهولة اختبار وتوجيه النماذج جنباً إلى جنب، وأسعار رموز مُعلنة حالياً أقل بـ20% من أسعار xAI الرسمية. قبل الاستخدام الإنتاجي، أكد صفحة النموذج المباشرة، وصحة نقطة النهاية، والمعلمات المدعومة، والأسعار، ومتطلبات التعامل مع البيانات.
مثال طلب CometAPI:
curl "https://api.cometapi.com/v1/responses" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "grok-4.7",
"input": "Explain how a distributed task queue handles worker failure."
}'
هل يستحق Grok 4.7 الانتقال إليه؟
بالنسبة لمستخدمي Grok 4.6 الحاليين الذين يعتمدون على وكلاء البرمجة أو سير العمل المهني طويلة الأمد، يُعد Grok 4.7 ترقية ذات مغزى لأن مجموعة معايير الإطلاق تتحسن عبر كل بُعد مُعلن بينما تبقى أسعار الرموز القياسية دون عتبة السياق الطويل عند نفس مستوى $2/$6.
بالنسبة لمستخدمي نماذج حدّية أخرى، يعتمد القرار على عبء العمل. يُعد Grok 4.7 مثيراً للاهتمام عندما تكون تكلفة رموز الإخراج، والأعباء الهندسية، والسياقات الكبيرة، واستخدام الأدوات المستمر عوامل مهمة. حيث يكون نموذج آخر أقوى في مجال بالغ الأهمية، قد يكون توجيه النماذج أكثر منطقية من استبدال كل نموذج بمزوّد واحد.
الخلاصة
Grok 4.7 أكثر من تحديث رقمي روتيني لـ Grok 4.6. الإصدار موجَّه صراحةً نحو العمل طويل الأمد المنفذ عبر أدوات، مع تحقق متكرر، وسياقات كبيرة، وخطوات تنفيذ متعددة.
تظهر أقوى المكاسب الجيلية حيث ينبغي لهذا التوجه التدريبي أن يؤثر: ترتفع Terminal-Bench 4.0 من 20.3% إلى 38.0%، وEEBench من 53.0% إلى 64.0%، وCursorBench 4.0 من 40.4% إلى 46.3%، بينما تبقى الأسعار القياسية دون عتبة 200 ألف رمز عند $2/مليون للإدخال و$6/مليون للإخراج.
القيمة العملية ليست “Grok 4.7 يفوز بكل معيار.” بل إنه يضيّق الفجوة بين قدرات الوكلاء الحدّية وتكلفة استدلال أقل، ما يجعله ذا صلة خاصة بوكلاء البرمجة، وأنظمة البحث، وسير العمل المهني التي تحتاج إلى العمل عبر خطوات عديدة بدلاً من إجابة واحدة.
