تسعير واجهة برمجة تطبيقات Qwen 3.8 Max: $2 للإدخال، $6 للإخراج، سياق 1M
الخلاصة
تكلفة Qwen 3.8 Max هي $2 لكل 1 مليون رمز إدخال و$6 لكل 1 مليون رمز إخراج على QwenCloud. أسعار الذاكرة المؤقتة الخاصة بالنموذج هي $0.25/مقابل 1M للإدخال المخزَّن ضمنيًا، و$2.50/مقابل 1M لإنشاء ذاكرة مؤقتة صريحة، و$0.17/مقابل 1M لقراءات الذاكرة المؤقتة الصريحة.
تنطبق نفس أسعار الرموز القياسية عبر نافذة السياق المدعومة التي تبلغ 1M رمزًا للنموذج. التمهيدات الأكبر تكلف أكثر لأنها تحتوي على رموز أكثر، وليس لأنها تدخل ضمن فئة تسعير سياق طويل أعلى.
بسعر القائمة، Qwen 3.8 Max أرخص بنسبة 20% من Qwen 3.7 Max. ومع ذلك، يظل Qwen 3.7 Max أرخص طالما استمر عرضه الترويجي الحالي البالغ 50%. يعتمد الخيار الأفضل في الإنتاج على تكلفة كل مهمة مقبولة، بما في ذلك التفكير، وضربات الذاكرة المؤقتة، والأدوات، وإعادة المحاولة، والزمن، والمراجعة البشرية.
تسعير Qwen 3.8 Max عبر واجهة API بنظرة سريعة
| البند | القيمة الرسمية الحالية |
|---|---|
| معرّف نموذج الإنتاج | qwen3.8-max |
| تاريخ الإصدار الرسمي | 3 أغسطس 2026 |
| البنية | 2.4T إجمالي المعلمات؛ 95B معلمات فعّالة |
| سعر الإدخال القياسي | $2 / لكل 1M رمز |
| سعر الإخراج القياسي | $6 / لكل 1M رمز |
| الإدخال المخزَّن ضمنيًا | $0.25 / لكل 1M رمز |
| إنشاء ذاكرة مؤقتة صريحة | $2.50 / لكل 1M رمز |
| قراءة ذاكرة مؤقتة صريحة | $0.17 / لكل 1M رمز |
| نافذة السياق | 1M رموز |
| الحد الأقصى للإدخال | 991K من دون التفكير؛ 983K مع التفكير |
| الحد الأقصى للإخراج | 131K |
| الحد الأقصى للتفكير | 262K |
| أنماط الإدخال | نص، صورة، وفيديو |
| نمط الإخراج | نص |
| حدود QwenCloud المرجعية | 2M TPM و 15K RPM |
تعد صفحة نموذج QwenCloud (https://www.qwencloud.com/models/qwen3.8-max) المصدر الأكثر مباشرة للحصول على معرّف النموذج الحالي، والتسعير، وأسعار الذاكرة المؤقتة، وحدود السياق، وأنماط الإدخال/الإخراج. قد تختلف الحصص لكل حساب ومنطقة، لذا استخدم الحدود المعروضة في وحدتك للتحكم عند ضبط التزامن في بيئة الإنتاج.
يحل إصدار الإنتاج أيضًا محل معرّف المعاينة بـ qwen3.8-max ويضيف بطاقة أسعار خاصة بالنموذج مكتملة. تصف مواد إطلاق Qwen إعدادات جهد التفكير low وmedium وxhigh، ولكن يجب التحقق من سلوك الإنتاج مقابل نقطة النهاية ومرجع API اللذين تستخدمهما فعليًا.
ملاحظة حسّاسة للوقت: أعلنت Qwen أن الأوزان المفتوحة ستعقب إصدار واجهة API. اعتبارًا من 4 أغسطس 2026، لا تصف Qwen 3.8 Max كنموذج قابل للتنزيل أو للاستضافة الذاتية حتى يتم نشر نقطة تحقق وترخيص رسميين.
كيفية عمل تسعير Qwen 3.8 Max
تدرج QwenCloud حاليًا سعرًا قياسيًا ثابتًا يبلغ $2 لكل 1M رمز إدخال و$6 لكل 1M رمز إخراج عبر نافذة السياق المدعومة التي تبلغ 1M رمزًا في Qwen 3.8 Max. تم التقاط لقطة التسعير الرسمية أدناه في 4 أغسطس 2026؛ تحقّق دائمًا من صفحة النموذج المباشرة قبل اتخاذ قرارات ميزانية الإنتاج.

المصدر***:*** QwenCloud، "Qwen3.8-Max" الرسمي
| عنصر الفوترة | السعر لكل 1M رمز | متى ينطبق |
|---|---|---|
| الإدخال القياسي | $2.00 | محتوى التمهيد الجديد، وتعريفات الأدوات، والسياق غير المخزَّن |
| الإخراج القياسي | $6.00 | الإخراج المُولّد واستخدام التفكير المفوتر |
| ضربة ذاكرة مؤقتة ضمنية | $0.25 | إعادة استخدام تلقائية لمقدمات التمهيد؛ الضربات غير مضمونة |
| إنشاء ذاكرة مؤقتة صريحة | $2.50 | إنشاء مقدمة تمهيد قابلة لإعادة الاستخدام معلمة |
| قراءة ذاكرة مؤقتة صريحة | $0.17 | إعادة استخدام كتلة ذاكرة مؤقتة صريحة صالحة |
لذلك، تكلف طلبية من 900K رمز أكثر من طلبية من 100K رمز لأنها تعالج عددًا أكبر بتسع مرات من رموز الإدخال—وليس لأنها تتجاوز فئة سعرية أعلى.
يمكن للتفكير أن يزيد تكلفة الإخراج
الإجابة القصيرة المرئية ليست دائمًا إجابة منخفضة التكلفة. قد تولّد الاستدعاءات المُمكّن فيها التفكير رموز تفكير إضافية، لذا يجب أن تستخدم تقديرات الإنتاج حقول الاستخدام التي تُعيدها واجهة API بدلًا من طول الاستجابة المرئي.
حيثما يدعم منفذك عناصر تحكم التفكير لـ qwen3.8-max، قارن الإعدادات المتاحة على نفس مجموعة التقييم. لا تفترض أن القيم الافتراضية للمعاينة تنتقل كما هي إلى نموذج GA.
تعتمد وفورات الذاكرة المؤقتة على استقرار التمهيد
تنشر صفحة نموذج Qwen 3.8 Max أسعار الذاكرة المؤقتة الخاصة بالنموذج. استخدم هذه الأسعار—وليس نسب ذاكرة مؤقتة عامة—عند تقدير الإنفاق.
إدخالات الذاكرة المؤقتة الصريحة لها فترة صلاحية مدتها خمس دقائق، وتؤدي الضربة الناجحة إلى إعادة ضبط تلك الفترة. التخزين المؤقت ضمني تلقائيًا، لكن لا توجد ضمانة للضربة. يكون التخزين المؤقت أكثر فائدة عندما تظل تمهيدات النظام، وتعريفات الأدوات، وسياق المستودعات، أو المستندات الكبيرة ثابتة عبر الاستدعاءات المتكررة.
تنشئ الأدوات المدمجة رسومًا منفصلة
تدرج QwenCloud حاليًا الرسوم التالية للأدوات بالإضافة إلى استخدام الرموز:
| الأداة المدمجة | الرسوم الحالية |
|---|---|
| Web Search | $10 / لكل 1K مكالمة |
| Image Search | $8 / لكل 1K مكالمة |
| Web Extractor | مجاني لفترة محدودة |
| Code Interpreter | مجاني لفترة محدودة |
لا تحتوي Function calling وMCP على رسوم أدوات منفصلة، لكن أوصاف الأدوات لا تزال تُحتسب ضمن رموز الإدخال. قد تتغيّر عروض الأدوات المجانية، لذا تحقّق من دليل تسعير QwenCloud (https://docs.qwencloud.com/developer-guides/getting-started/pricing) قبل إقرار ميزانية الإنتاج.
على سبيل المثال، تكلفة طلبية بها 20K رمز إدخال و2K رمز إخراج ومكالمتا Web Search تقارب:
Input: 20,000 / 1,000,000 × $2 = $0.040
Output: 2,000 / 1,000,000 × $6 = $0.012
Web Search: 2 / 1,000 × $10 = $0.020
Total: $0.072
في هذا المثال، تمثل مكالمتا البحث نحو 27.8% من إجمالي تكلفة الطلبية.
أمثلة تكلفة Qwen 3.8 Max في العالم الحقيقي
تستخدم هذه الأمثلة أسعار QwenCloud الحالية الخاصة بالنموذج. وهي تستثني الضرائب، وإعادة المحاولات، وعمليات الرجوع، وأي زيادات خاصة بالمزوّد.
المثال 1: طلب وكيل متوسط
Assume 50K input tokens and 5K output tokens:
Input: 50,000 / 1,000,000 × $2 = $0.10
Output: 5,000 / 1,000,000 × $6 = $0.03
Total: $0.13
تكلفة المحاولة الأولى الناجحة نحو $0.13. تؤدي إعادة محاولة كاملة واحدة إلى رفع تكلفة النموذج إلى نحو $0.26.
المثال 2: تحليل مستند طويل
Assume 800K input tokens and 20K output tokens:
Input: 800,000 / 1,000,000 × $2 = $1.60
Output: 20,000 / 1,000,000 × $6 = $0.12
Total: $1.72
لا يطبق النموذج رسمًا منفصلًا للسياق الطويل في بطاقة أسعاره الحالية، لكن التمهيدات الكبيرة تظل تولّد تكلفة مطلقة كبيرة.
المثال 3: جلسة وكيل مع ذاكرة مؤقتة
افترض مقدمة تمهيد قابلة لإعادة الاستخدام من 100K رمز، و10K رموز إدخال جديدة، و5K رموز إخراج، و50 استدعاء خلال فترة بقاء الذاكرة المؤقتة الصريحة صالحة:
First call:
100K cache creation × $2.50/M = $0.250
10K new input × $2/M = $0.020
5K output × $6/M = $0.030
First-call total = $0.300
Each of the next 49 calls:
100K cache read × $0.17/M = $0.017
10K new input × $2/M = $0.020
5K output × $6/M = $0.030
Per-call total = $0.067
Cached session total = $3.583
Same 50 calls without cache = $12.500
التوفير المُقدّر = $8.917، أو 71.3%
يعتمد التوفير المُقدّر على ضربات ذاكرة مؤقتة ناجحة ومقدمة ثابتة. ستقلل الفجوات الطويلة أو التغييرات المتكررة في تمهيدات النظام ومخططات الأدوات من الفائدة.
Qwen 3.8 Max مقابل Qwen 3.7 Max: مقارنة التسعير
Qwen 3.8 Max أرخص بنسبة 20% من Qwen 3.7 Max بسعر القائمة، لكن Qwen 3.7 Max أرخص بنسبة 37.5% خلال عرضه الترويجي الحالي.
| النموذج وحالة التسعير | الإدخال / لكل 1M | الإخراج / لكل 1M | السياق |
|---|---|---|---|
| qwen3.8-max بسعر قياسي | $2.00 | $6.00 | 1M |
| qwen3.7-max بسعر القائمة | $2.50 | $7.50 | 1M |
| qwen3.7-max عرض ترويجي حالي | $1.25 | $3.75 | 1M |
احتفظ بصفحة نموذج CometAPI Qwen3.7 Max (https://www.cometapi.com/models/aliyun/qwen3-7-max/) متاحة كحل رجوعي أثناء اختبار النموذج الجديد.
سعر الرمز الواحد ليس سوى جزء من القرار. قد يظل Qwen 3.8 Max أكثر اقتصادية إذا حسّن النجاح من المحاولة الأولى، أو استخدم الأدوات بشكل أكثر موثوقية، أو قلّل من عمليات إعادة المحاولة، أو احتاج إلى تصحيح بشري أقل.
استخدم مقياس الإنتاج هذا:
تكلفة كل مهمة مقبولة =
(رموز النموذج + مكالمات الأدوات + إعادة المحاولات + إنفاق الرجوع + تكلفة المراجعة)
÷ المخرجات المقبولة
تمثل مكاسب المعايير المبلّغ عنها من البائع سببًا لإعادة اختبار مهام الترميز المُجهدة وسير العمل المهنية، وليست دليلًا على أن كل أحمال Qwen 3.7 يجب أن تنتقل.
كيفية الترحيل إلى Qwen 3.8 Max
تغيير سلسلة النموذج ضروري، لكنه ليس ترحيل إنتاج كاملًا.
1. اختبر معرّف نموذج الإنتاج
استبدل معرّف المعاينة بـ qwen3.8-max في بيئة اختبار. لا تفترض أن الأسماء المستعارة للمعاينة أو القيم الافتراضية أو الكمون أو سلوك الاستجابة ستظل دون تغيير.
يمكن أن يبدو طلب متوافق بالحد الأدنى مع OpenAI على النحو التالي:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DASHSCOPE_API_KEY"],
base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[
{
"role": "user",
"content": "Review this migration plan and identify production risks.",
}
],
)
print(response.choices[0].message.content)
ابدأ بأقل طلب موثّق. أضف عناصر تحكم التفكير فقط عندما يدعمها مرجع API الحالي لنقطة النهاية التي تستخدمها صراحةً.
2. إعادة معايرة قياسات التكلفة والأداء
سجّل على الأقل:
- رموز الإدخال والإخراج والتفكير
- ضربات الذاكرة المؤقتة ورموز إنشاء الذاكرة المؤقتة
- زمن الوصول لأول رمز وإجمالي الكمون
- مكالمات الأدوات، وإعادة المحاولات، وعمليات الرجوع
- المخرجات المقبولة مقابل المرفوضة
- وقت التصحيح البشري
3. أعد اختبار الواجهة التي يستخدمها تطبيقك
تحقق من أحداث البث، والحمولات متعددة الوسائط، ومخططات الأدوات، والمخرجات المهيكلة، وأسباب الإنهاء، وحقول الاستخدام، والتعامل مع الأخطاء، والسلوك متعدد الأدوار. توثّق صفحة النموذج في الإنتاج الوصول عبر DashScope والمتوافق مع OpenAI؛ تحقّق من أي طبقة توافق إضافية قبل الاعتماد عليها.
4. احترم حدود السياق العملية
نافذة سياق 1M ليست مساوية لتمهيد مستخدم من 1M رمز. تسرد QwenCloud حدًا أقصى للإدخال يبلغ 991K من دون التفكير و983K مع التفكير. أضف هامش أمان ليظل هناك حيّز للإخراج والتفكير.
5. شغّل Qwen 3.7 وQwen 3.8 بالتوازي
استخدم تمهيدات وأدوات ومحقّقات وقواعد إعادة المحاولة ومجموعات بيانات متطابقة. قارن تكلفة كل مهمة مقبولة والكمون بدلًا من الحكم على استجابات معزولة بصريًا.
كيفية تقييم Qwen 3.8 Max وتوجيهه
استخدم أحمال عمل واقعية بدلًا من متوسطات المعايير العامة.
| عبء العمل | المهام المقترحة | إشارة القبول الأساسية |
|---|---|---|
| ترميز المستودعات | 4 | اجتياز الاختبارات دون ترقيع بشري |
| تحليل مستندات طويلة | 3 | الادعاءات مدعومة بالأدلة المزوّدة |
| تحليل متعدد الوسائط | 2 | استخدام التفاصيل ذات الصلة من الصور/الفيديو بشكل صحيح |
| وكلاء يستخدمون الأدوات | 3 | اختيار أدوات صحيح ومعاملات صالحة |
A practical routing policy is:
Simple, latency-sensitive task
→ Lower-cost Plus model
Existing workload that already meets quality targets
→ Qwen 3.7 Max while its promotion remains attractive
Hard coding, multimodal, or long-horizon task
→ Qwen 3.8 Max
Failed validation
→ One controlled retry, then a tested fallback
استخدم Qwen 3.8 Max لأعمال المستودعات الصعبة، والوكلاء ذوي الأفق الطويل، والتحليل متعدد الوسائط، وسير العمل حيث يفشل Qwen 3.7 في اختبارات القبول. واحتفظ بـ Qwen 3.7 Max عندما يؤدي العرض الترويجي إلى خفض التكلفة ماديًا وكان النموذج الحالي يلبّي بالفعل هدف الجود.
تحقق من صفحة تسعير CometAPI (https://www.cometapi.com/pricing/) ومعلومات التوجيه المباشرة قبل تثبيت العتبات لأن توفر المزوّد والتسعير الموجّه يمكن أن يتغيّرا بشكل مستقل عن الأسعار المباشرة لـ QwenCloud. يمكن أن يساعد CometAPI Cookbook (https://github.com/cometapi-dev/cometapi-cookbook) في إنشاء طلبات قابلة للتكرار وأداة تقييم متسقة.
الأسئلة الشائعة
كم تكلفة واجهة برمجة تطبيقات Qwen 3.8 Max؟
تدرج QwenCloud حاليًا Qwen 3.8 Max بسعر $2 لكل 1 مليون رمز إدخال و$6 لكل 1 مليون رمز إخراج. لاستخدام الذاكرة المؤقتة والأدوات المدمجة أسعار منفصلة.
هل يكلف Qwen 3.8 Max أكثر فوق 128K رمزًا؟
لا يظهر أي مستوى تسعير منفصل للسياق الطويل على بطاقة الأسعار الحالية الخاصة بالنموذج. تكلف الطلبات الطويلة أكثر لأنها تحتوي على رموز أكثر، وليس لأنها تتجاوز طبقة سعر وحدة أعلى.
هل تُفوتر رموز التفكير في Qwen 3.8 Max؟
يمكن للتفكير أن يزيد الاستخدام المُولّد والتكلفة الإجمالية. استخدم حقول رموز التفكير والإخراج التي يعيدها المنفذ بدلًا من التقدير من طول الإجابة المرئي.
هل Qwen 3.8 Max مفتوح المصدر؟
أعلنت Qwen أن الأوزان المفتوحة ستعقب إصدار واجهة API. لا تصف النموذج بأنه قابل للتنزيل أو للاستضافة الذاتية حتى تتوفر نقطة تحقق وترخيص رسميان.
هل يجب على مستخدمي Qwen 3.7 Max الترحيل فورًا؟
ليس تلقائيًا. لدى Qwen 3.8 Max سعر قائمة أقل، بينما Qwen 3.7 Max أرخص خلال عرضه الترويجي الحالي. ارحل عندما تدعم بياناتك الخاصة بالجودة والكمون وسلوك الذاكرة المؤقتة وتكلفة كل مهمة مقبولة هذا التغيير.
جرّب Qwen 3.8 Max عبر CometAPI
استخدم CometAPI Quickstart (https://www.cometapi.com/quickstart/) لإعداد عميل متوافق مع OpenAI. قبل إرسال حركة إنتاجية، تأكّد من أن qwen3.8-max فعّال في حسابك وتحقق من السعر الموجّه المعروض هناك.
قارنه بخط الأساس لـ Qwen 3.7 باستخدام تمهيدات ومحقّقات وسياسات إعادة المحاولة وقياسات موحّدة. هذا يُبقي التقييم مركزًا على النموذج بدلًا من تغييرات في منصة الاختبار.
