تصف xAI Grok 4.7 بأنه نموذجها المتقدم للأكواد، والمهام الوكيلية، وأعمال المعرفة، مع نافذة سياق تضم 500K رمز. وفقًا لـصفحة التسعير الحالية من xAI، فإن أسعار واجهة البرمجة المباشرة (API) لما دون 200,000 رمز في الموجه هي 2.00$ لكل مليون رمز إدخال، و0.50$ لكل مليون رمز مُخزَّن مؤقتًا، و6.00$ لكل مليون رمز إخراج. وعندما يصل الموجه إلى 200,000 رمز أو أكثر، تُدرج xAI الأسعار 4.00$ و1.00$ و12.00$ على التوالي. هذه هي أسعار xAI المباشرة، وليست سعرًا موحدًا عبر منصات الأطراف الثالثة.
الإنفاق الفعلي يعتمد على أكثر من معدل إدخال العناوين الرئيسية. الإدخال الجديد، والإدخال المُخزَّن مؤقتًا، والإخراج، وإعادة المحاولة، واستدعاءات الأدوات، وعدد استدعاءات النموذج في سير عمل الوكيل، كلها يمكن أن تغيّر الفاتورة. عتبة 200K في الموجه مهمة بشكل خاص لأن كلًا من xAI وCometAPI ينشران أسعارًا أعلى للسياق الطويل بمجرد الوصول إلى هذا الحد.
يؤسس هذا الدليل أولًا أساس تسعير xAI، ثم يقارن بـقائمة CometAPI الحالية لـGrok 4.7. اعتبارًا من 28 سبتمبر 2026، تُدرج CometAPI أسعار 1.60$ / 0.40$ / 4.80$ لكل مليون من رموز الإدخال الجديد/الإدخال المُخزَّن مؤقتًا/الإخراج في الفئة القياسية، و3.20$ / 0.80$ / 9.60$ في فئة السياق الطويل—أقل بنسبة 20% من أسعار xAI المباشرة المقابلة. تشرح الأقسام التالية كيفية احتساب تكلفة العمل، وتقليل الهدر، والوصول إلى النموذج عبر CometAPI. جميع الأسعار لقطات بتاريخ معين ويجب إعادة التحقق منها قبل الاستخدام الإنتاجي.
xAI Direct vs. CometAPI Grok 4.7 Pricing
أسعار xAI المباشرة (بالدولار الأمريكي لكل 1M رمز)
| فئة الرموز | أقل من 200K رموز الموجه | سياق طويل (≥200K) |
|---|---|---|
| إدخال جديد | 2.00$ | 4.00$ |
| إدخال مُخزَّن | 0.50$ | 1.00$ |
| إخراج | 6.00$ | 12.00$ |
أسعار CometAPI (بالدولار الأمريكي لكل 1M رمز)
| فئة الرموز | CometAPI: أقل من 200K رموز الموجه | CometAPI: فئة السياق الطويل |
|---|---|---|
| إدخال جديد | 1.60$ لكل 1M رمز | 3.20$ لكل 1M رمز |
| إدخال مُخزَّن | 0.40$ لكل 1M رمز | 0.80$ لكل 1M رمز |
| إخراج | 4.80$ لكل 1M رمز | 9.60$ لكل 1M رمز |
تُعد عتبة 200K في الموجه مهمة لأن كلتا المنصتين تُدرجان حاليًا أسعار السياق الطويل عند ضعف أسعار الفئة القياسية لـGrok 4.7. هذا حكم تسعيري تضعه كل منصة API، وليس تغييرًا في قدرة النموذج. يصبح الطلب أكثر تكلفة عندما يرسل التطبيق مرارًا موجهات كبيرة أو يسمح لتاريخ الوكيل بالنمو دون ضبط—وليس لمجرد أن Grok 4.7 يدعم نافذة سياق 500K.
لأغراض إعداد الميزانية، تعامل مع أي طلب متوقع أن يصل إلى العتبة باعتباره سياقًا طويلًا حتى يتم التحقق من سلوك الفوترة الفعلي. يمكن أن تتغير توافرية النموذج والأسعار، لذا يجب على حاسبات الإنتاج إعادة التحقق من كلٍ من تسعير xAI المباشر وصفحة نموذج CometAPI الحالية بدلًا من تثبيت قيم دائمة في الشفرة.
The Formula for Estimating Grok 4.7 Cost
قدّر طلبًا واحدًا بتسعير كل فئة رموز على حدة:
request cost = (fresh input tokens × input rate + cached input tokens × cached rate + output tokens × output rate) ÷ 1,000,000
ثم حوِّل تقدير الطلب إلى تقدير عبء عمل:
monthly cost = request cost × requests per user × active users × days in billing period
استخدم قيمة مئوية واقعية بدلًا من متوسط واحد. يصف p50 طلبًا عاديًا، لكن أطوال الإدخال والإخراج عند p95 تكشف الذيل المكلف الذي غالبًا ما يقود الفاتورة. بالنسبة لسير عمل الوكلاء، اضرب في عدد استدعاءات النموذج المتوقع لكل مهمة مكتملة. سير عمل من خمس خطوات يعني خمس استدعاءات قابلة للفوترة، وليس واحدة.
Worked Example 1: A Support Copilot
افترض أن طلب دعم واحد يرسل 6,000 رمز إدخال جديد ويُولد 800 رمز إخراج. يظل دون عتبة 200K ولا يحصل على خصم التخزين المؤقت.
- الإدخال: 6,000 × 1.60$ ÷ 1,000,000 = 0.00960$
- الإخراج: 800 × 4.80$ ÷ 1,000,000 = 0.00384$
- الإجمالي: 0.01344$ لكل طلب
عند 100,000 طلب في الشهر، تكون تكلفة الرموز المقدَّرة 1,344$. إذا أظهرت التقييمات أن إجابة من 400 رمز تؤدي بنفس جودة إجابة من 800 رمز، ينخفض التقدير إلى 0.01152$ لكل طلب، أو 1,152$ شهريًا. هذا الحد الوحيد للإخراج يوفر حوالي 192$ شهريًا، أو 14.3%، دون تغيير النموذج.
لهذا السبب يستحق التحكم في الإخراج الاهتمام. وفق السعر المُدرج في CometAPI، تكلف رموز الإخراج ثلاثة أضعاف رموز الإدخال الجديدة في نفس الفئة.
Worked Example 2: Reusing a Stable 20K-Token Prefix
افترض أن كل طلب يحتوي على دليل منتج من 20,000 رمز، و2,000 رمز سياق محادثة جديد، واستجابة من 600 رمز.
بدون إصابة تخزين مؤقت، يكون التقدير:
- 22,000 رمز إدخال جديد: 0.03520$
- 600 رمز إخراج: 0.00288$
- الإجمالي: 0.03808$ لكل طلب
إذا تم احتساب بادئة 20,000 رمز المستقرة كإدخال مُخزَّن مؤقتًا بينما تبقى 2,000 رمز حديثة فقط، يصبح التقدير:
- 20,000 رمز إدخال مُخزَّن مؤقتًا: 0.00800$
- 2,000 رمز إدخال جديد: 0.00320$
- 600 رمز إخراج: 0.00288$
- الإجمالي: 0.01408$ لكل طلب
عند 100,000 طلب، يكون ذلك 1,408$ بدلًا من 3,808$—توفير مُقدَّر قدره 2,400$، أو 63.0%. هذا التوفير ليس تلقائيًا: الطلب الأول، أو تغيير البادئة، أو مسار لا ينتج إصابة تخزين مؤقت، قد يُفوتر بسعر الإدخال الجديد. أكد عدد الرموز المُخزَّنة مؤقتًا في بيانات الاستخدام الفعلية قبل اعتبار التقدير توفيرًا محققًا.
Worked Example 3: The Cost of Crossing 200K
فكِّر في طلب وكيل طويل التشغيل يحتوي على 210,000 رمز موجه و2,000 رمز إخراج. باستخدام أسعار فئة السياق الطويل المُدرجة:
- 210,000 رمز إدخال جديد: 0.67200$
- 2,000 رمز إخراج: 0.01920$
- الإجمالي: 0.69120$ لكل تشغيل
إذا أدت عمليات ضغط السياق، وتصفية الاسترجاع، ونقاط تحقق التلخيص إلى تقليل الموجه إلى 180,000 رمز مع الحفاظ على نفس إخراج 2,000 رمز، فإن تقدير الفئة القياسية هو:
- 180,000 رمز إدخال جديد: 0.28800$
- 2,000 رمز إخراج: 0.00960$
- الإجمالي: 0.29760$ لكل تشغيل
الفرق هو 0.39360$ لكل تشغيل، أي حوالي 56.9%. عبر 10,000 تشغيل، يكون التوفير المُقدَّر 3,936$. الدرس ليس حذف السياق المفيد، بل الاحتفاظ بالسياق الذي يغيّر الإجابة فقط، وتلخيص أو استرجاع الباقي قبل أن يتجاوز الطلب حد السعر.
A Python Calculator for Pre-Call Estimates
تستخدم الدالة التالية الأسعار الحالية المُدرجة لدى CometAPI لـGrok 4.7. وتطبق فئة السياق الطويل بشكل محافظ عندما يصل إجمالي الموجه إلى 200,000 رمز.
from dataclasses import dataclass
@dataclass(frozen=True)
class Rates:
input_per_million: float
cached_input_per_million: float
output_per_million: float
SHORT = Rates(1.60, 0.40, 4.80)
LONG = Rates(3.20, 0.80, 9.60)
def estimate_grok_47_cost(
fresh_input_tokens: int,
cached_input_tokens: int,
max_output_tokens: int,
) -> float:
prompt_tokens = fresh_input_tokens + cached_input_tokens
rates = LONG if prompt_tokens >= 200_000 else SHORT
return (
fresh_input_tokens * rates.input_per_million
+ cached_input_tokens * rates.cached_input_per_million
+ max_output_tokens * rates.output_per_million
) / 1_000_000
estimate = estimate_grok_47_cost(
fresh_input_tokens=2_000,
cached_input_tokens=20_000,
max_output_tokens=600,
)
print(f"Estimated upper bound: ${estimate:.5f}")
هذا حارس تخطيطي، وليس فاتورة. تعتمد التكلفة النهائية على الإدخال الفعلي، والإدخال المُخزَّن مؤقتًا، والإخراج، وإعادة المحاولة، واستدعاءات الأدوات، والسعر الفعّال وقت التنفيذ. بعد كل استجابة، خزن استخدام الرموز المُعاد، ومعرّف النموذج، وحالة الطلب، ونتيجة المهمة. ووافق تلك القيم مع سجلات فوترة المزود.
Five Grok 4.7 Cost Controls, Ranked by Likely Impact
1. حافظ على السياق المتكرر ثابتًا بما يكفي ليُخزن مؤقتًا
ضع التعليمات الثابتة، ووثائق المنتج، والمخططات، والأمثلة القابلة لإعادة الاستخدام قبل المحتوى الخاص بالطلب. تجنب تغيير الطوابع الزمنية، أو المعرفات، أو الفراغات، أو الترتيب داخل بادئة مشتركة كبيرة إلا إذا كان التغيير مطلوبًا. توصي إرشادات Grok 4.7 من xAI بمعرّفات توجيه تخزين مؤقت مستقرة للمحادثات؛ وعند استخدام مسار وسيط، تحقق من عناصر التحكم في التخزين المؤقت وحقول الاستخدام المدعومة قبل الاعتماد عليها.
قم بقياس رموز إصابة التخزين المؤقت ومعدل إصابة التخزين المؤقت بحسب عبء العمل. لا قيمة لخصم تخزين مؤقت نظري إذا كان التطبيق يغيّر البادئة باستمرار.
2. عامل 200K كميزانية هندسية، وليس هدفًا
احتفظ بهامش أقل من العتبة لتعليمات النظام، والمقاطع المُسترجعة، ونتائج الأدوات، والدورة التالية للمستخدم. بالنسبة لوكيل، اضغط الدورات القديمة في ملخص مُتحقق منه واحتفظ بالنص الخام خارج سياق النموذج. بالنسبة للاسترجاع، قم بترتيب المقاطع وإزالة التكرار قبل إدراجها بدلًا من إرسال كل التطابقات.
تتبع توزيعات طول الموجه ونبّه قبل أن يقترب p95 من العتبة. وفق جدول xAI الرسمي، بمجرد أن يصل الموجه إلى 200K رمز، تُطبق أسعار السياق الطويل على جميع الرموز في ذلك الطلب. وبالمثل، تُدرج CometAPI فئة سياق طويل منفصلة وأعلى سعرًا لـGrok 4.7. هذه شروط تسعير منصة، وليست قدرات نموذج.
3. حدِّد الإخراج واضبط جهد الاستدلال مقابل مجموعة تقييم
ضبط حد إخراج على مستوى التطبيق يتطابق مع المنتج. قد يحتاج ناتج التصنيف إلى عشرات الرموز؛ وقد يحتاج جواب الدعم إلى بضع مئات؛ وقد يحتاج تقرير بحثي إلى أكثر. هذا الحد هو أداة ضبط ميزانية وتجربة مستخدم، وليس حدًا ثابتًا لنصوص Grok 4.7. تنص ملاحظات إصدار 21 سبتمبر من xAI على أن Grok 4.7 لا يملك حدًا لنص الإخراج؛ وهذا لا يمنع تطبيقًا أو مسار API محددًا من فرض حدٍّ خاصٍ به. أكد أي حد طلب مفروض من نقطة النهاية أو SDK التي تستخدمها فعليًا.
يدعم Grok 4.7 مستويات متعددة من جهد الاستدلال. استخدم أدنى مستوى يجتاز مجموعة تقييم ممثِّلة، واحتفظ بجهد أعلى للمهام التي يُحدث فيها تحسنًا قابلًا للقياس. قد يؤدي تقليل الاستدلال أو الإخراج بدون فحوص جودة إلى إعادة المحاولات وإزالة التوفير.
4. ارفض أو أعد تشكيل الطلبات المكلفة قبل استدعاء API
قدِّر حدًا أعلى من حجم الإدخال وحد الإخراج المُكوَّن. إذا تجاوز الطلب ميزانية المنتج، يمكن للتطبيق أن يطلب من المستخدم تضييق المهمة، أو تلخيص المواد المرفوعة، أو تقليل السياق المُسترجع، أو نقل المهمة إلى سير عمل غير متزامن معتمد. هذا أكثر قابلية للتنبؤ من اكتشاف التكلفة بعد التوليد.
يمكن أن يكون تقريب الأحرف إلى الرموز مفيدًا كحارس مبكر، لكنه لا ينبغي أن يحل محل المُجزِّئ (tokenizer) أو بيانات الاستخدام الفعلية. اللغات، والأكواد، وJSON، والتنسيقات يمكن أن تنتج كثافات رموز مختلفة جدًا.
5. حسِّن التكلفة لكل مهمة ناجحة، وليس التكلفة لكل استدعاء
قد تكون الاستدعاءات الأرخص التي تفشل في التحقق مرتين أكثر تكلفة من استدعاء واحد ناجح. تتبع:
- التكلفة لكل إجابة مقبولة؛
- التكلفة لكل مهمة وكيل مكتملة؛
- تكلفة إعادة المحاولة والمسارات البديلة؛
- معدل إصابة التخزين المؤقت وحصة الرموز المُخزَّنة مؤقتًا؛
- رموز الموجه والإخراج عند p50 وp95؛
- درجة الجودة، والكمون، ومعدل التصعيد البشري.
إذا لم تتطلب حركة المرور الروتينية جودة أو سعة سياق Grok 4.7، يمكن أن يجعل كتالوج النماذج الموحد لدى CometAPI التبديل المُدار من قبل التطبيق أسهل. اجعل قاعدة التوجيه صريحة، وقيِّم كل نموذج على نفس مجموعة المهام، وأرسل فقط الطلبات التي تستفيد من Grok 4.7 إلى هذا المسار.
A Practical Monthly Cost Review
مرة واحدة في الأسبوع، جمّع الحركة حسب الميزة وقارن التكلفة المُقدَّرة مع الاستخدام الفعلي. ابدأ بالميزات المسؤولة عن معظم رموز الإخراج، وأكبر الموجهات، وأدنى معدل إصابة تخزين مؤقت. ثم راجع الحالات الشاذة المكلفة بدلًا من تحسين الطلب الوسيط بشكل أعمى.
| الإشارة | المشكلة المحتملة | الإجراء الأول |
|---|---|---|
| حصة رموز مُخزَّنة مؤقتًا منخفضة | البادئة المشتركة تتغيّر كثيرًا | ثبّت ونسّخ السياق القابل لإعادة الاستخدام |
| الموجهات تتجمع قرب 200K | التاريخ أو الاسترجاع غير محدود | اضغط، رتِّب، واحتفظ بهامش |
| الإخراج يهيمن على الإنفاق | الاستجابات أطول مما يحتاجه المنتج | خفّض الحد واختبر جودة الإجابة |
| تكلفة إعادة محاولات عالية | التحقق، أو انتهاء المهلة، أو الموجهات غير مستقرة | أصلح وضع فشل الاستدعاء الأول |
| تكلفة منخفضة لكن إكمال المهام ضعيف | التحسين قلّل جودة مفيدة | قِس التكلفة لكل نتيجة مقبولة |
Where CometAPI Fits in the Grok 4.7 Cost Model
يكمن دور CometAPI في هذا سير العمل على مستوى منصة API: فهي توفر الوصول إلى Grok 4.7، وتنشر أسعار الرموز الخاصة بها، وتوثق نقطة دخول متوافقة مع OpenAI. لا تغيّر قدرات النموذج الأساسية لـGrok 4.7. قد تتمكن الفرق التي تستخدم عميلًا بأسلوب OpenAI بالفعل من الاحتفاظ بنمط العميل نفسه مع تغيير مفتاح API، وعنوان الأساس، ومعرّف النموذج، رهناً بالتوافق مع نقطة النهاية.
اعتبارًا من 28 سبتمبر 2026، تُعد أسعار Grok 4.7 المُدرجة لدى CometAPI أقل بنسبة 20% من أسعار xAI المباشرة المقابلة في كلٍ من الفئة القياسية وفئة السياق الطويل. هذه مقارنة أسعار منصة، وليست ادعاءً عن جودة النموذج. قبل الإطلاق الإنتاجي، يجب على الفرق أيضًا التحقق من معرّف النموذج الفعال، ومعاملات نقطة النهاية، وسلوك التخزين المؤقت، وحدود المعدل، والموثوقية، والدعم، وشروط الفوترة.
لاختبار النموذج، راجع التسعير الحالي وتفاصيل الوصول على صفحة نموذج Grok 4.7 لدى CometAPI. احتفظ بجدول الأسعار في الإعدادات، وسجِّل الاستخدام الفعلي بعد كل استدعاء، وأعد تشغيل تقديرات عبء العمل كلما تغيّر النموذج أو سلوك المنتج.
FAQ
ما سعر الرمز لـGrok 4.7 على CometAPI؟
بالنسبة للموجهات دون 200K رمز، تُدرج CometAPI حاليًا 1.60$ لكل مليون رموز إدخال جديدة، و0.40$ لكل مليون رموز إدخال مُخزَّنة مؤقتًا، و4.80$ لكل مليون رموز إخراج. أسعار فئة السياق الطويل المُدرجة هي 3.20$ و0.80$ و9.60$ لكل مليون رمز على التوالي.
كم تكلفة طلب API واحد لـGrok 4.7؟
يعتمد ذلك على الإدخال الجديد، والإدخال المُخزَّن مؤقتًا، والإخراج، وفئة السياق الفعالة. اضرب كل عدد رموز في سعره لكل مليون، واجمع النتائج، ثم اقسم على مليون. تضمّن أيضًا إعادة المحاولات وكل استدعاء نموذج في سير عمل متعدد الخطوات.
ما أسهل طريقة لتقليل تكلفة API لـGrok 4.7؟
ابدأ بأكبر مُحرِّك تكلفة مُقاس. التعليمات الطويلة المتكررة تستفيد عادةً من التخزين المؤقت؛ وتواريخ الوكلاء المتنامية تستفيد من الضغط؛ والإجابات المطوّلة تستفيد من حد إخراج أقل. تأكد من بقاء الجودة مقبولة بعد كل تغيير.
هل تعني نافذة سياق 500K أنه يجب أن أرسل 500K رمزًا؟
لا. نافذة السياق هي حد سعة، وليست توصية. يستخدم كلٌ من تسعير xAI المباشر وقائمة CometAPI الحالية أسعار سياق طويل أعلى عند عتبة 200K للموجه، لذا يجب أن ترسل التطبيقات فقط السياق اللازم للمهمة.
هل يمكنني تقدير التكلفة قبل استدعاء Grok 4.7؟
نعم. قدِّر رموز الإدخال، واختر فئة السياق الصحيحة، وأضف حد إخراج واقعيًا، واحتسب الحد الأعلى. بعد الاستدعاء، استبدل التقدير ببيانات الاستخدام الفعلية لأغراض التقارير والتحسين.