GPT-5.6 Luna price down 80%, Terra down 20% →

تسعير واجهة برمجة التطبيقات لـ Qwen 3.8 Max: $2 للإدخال، $6 للإخراج، سياق 1M

CometAPI
Mia MarenAug 4, 2026
تسعير واجهة برمجة التطبيقات لـ Qwen 3.8 Max: $2 للإدخال، $6 للإخراج، سياق 1M

تسعير واجهة برمجة تطبيقات Qwen 3.8 Max: ‏$2 للإدخال، ‏$6 للإخراج، سياق 1M

الخلاصة

تكلفة Qwen 3.8 Max هي ‏$2 لكل 1 مليون رمز إدخال و‏$6 لكل 1 مليون رمز إخراج على QwenCloud. أسعار الذاكرة المؤقتة الخاصة بالنموذج هي ‏$0.25/مقابل 1M للإدخال المخزَّن ضمنيًا، و‏$2.50/مقابل 1M لإنشاء ذاكرة مؤقتة صريحة، و‏$0.17/مقابل 1M لقراءات الذاكرة المؤقتة الصريحة.

تنطبق نفس أسعار الرموز القياسية عبر نافذة السياق المدعومة التي تبلغ 1M رمزًا للنموذج. التمهيدات الأكبر تكلف أكثر لأنها تحتوي على رموز أكثر، وليس لأنها تدخل ضمن فئة تسعير سياق طويل أعلى.

بسعر القائمة، Qwen 3.8 Max أرخص بنسبة 20% من Qwen 3.7 Max. ومع ذلك، يظل Qwen 3.7 Max أرخص طالما استمر عرضه الترويجي الحالي البالغ 50%. يعتمد الخيار الأفضل في الإنتاج على تكلفة كل مهمة مقبولة، بما في ذلك التفكير، وضربات الذاكرة المؤقتة، والأدوات، وإعادة المحاولة، والزمن، والمراجعة البشرية.

تسعير Qwen 3.8 Max عبر واجهة API بنظرة سريعة

البندالقيمة الرسمية الحالية
معرّف نموذج الإنتاجqwen3.8-max
تاريخ الإصدار الرسمي3 أغسطس 2026
البنية2.4T إجمالي المعلمات؛ 95B معلمات فعّالة
سعر الإدخال القياسي‏$2 / لكل 1M رمز
سعر الإخراج القياسي‏$6 / لكل 1M رمز
الإدخال المخزَّن ضمنيًا‏$0.25 / لكل 1M رمز
إنشاء ذاكرة مؤقتة صريحة‏$2.50 / لكل 1M رمز
قراءة ذاكرة مؤقتة صريحة‏$0.17 / لكل 1M رمز
نافذة السياق1M رموز
الحد الأقصى للإدخال991K من دون التفكير؛ 983K مع التفكير
الحد الأقصى للإخراج131K
الحد الأقصى للتفكير262K
أنماط الإدخالنص، صورة، وفيديو
نمط الإخراجنص
حدود QwenCloud المرجعية2M TPM و 15K RPM

تعد صفحة نموذج QwenCloud (https://www.qwencloud.com/models/qwen3.8-max) المصدر الأكثر مباشرة للحصول على معرّف النموذج الحالي، والتسعير، وأسعار الذاكرة المؤقتة، وحدود السياق، وأنماط الإدخال/الإخراج. قد تختلف الحصص لكل حساب ومنطقة، لذا استخدم الحدود المعروضة في وحدتك للتحكم عند ضبط التزامن في بيئة الإنتاج.

يحل إصدار الإنتاج أيضًا محل معرّف المعاينة بـ qwen3.8-max ويضيف بطاقة أسعار خاصة بالنموذج مكتملة. تصف مواد إطلاق Qwen إعدادات جهد التفكير low وmedium وxhigh، ولكن يجب التحقق من سلوك الإنتاج مقابل نقطة النهاية ومرجع API اللذين تستخدمهما فعليًا.

ملاحظة حسّاسة للوقت: أعلنت Qwen أن الأوزان المفتوحة ستعقب إصدار واجهة API. اعتبارًا من 4 أغسطس 2026، لا تصف Qwen 3.8 Max كنموذج قابل للتنزيل أو للاستضافة الذاتية حتى يتم نشر نقطة تحقق وترخيص رسميين.

كيفية عمل تسعير Qwen 3.8 Max

تدرج QwenCloud حاليًا سعرًا قياسيًا ثابتًا يبلغ ‏$2 لكل 1M رمز إدخال و‏$6 لكل 1M رمز إخراج عبر نافذة السياق المدعومة التي تبلغ 1M رمزًا في Qwen 3.8 Max. تم التقاط لقطة التسعير الرسمية أدناه في 4 أغسطس 2026؛ تحقّق دائمًا من صفحة النموذج المباشرة قبل اتخاذ قرارات ميزانية الإنتاج.

تسعير واجهة برمجة التطبيقات لـ Qwen 3.8 Max: $2 للإدخال، $6 للإخراج، سياق 1M

المصدر***:*** QwenCloud، "Qwen3.8-Max" الرسمي

عنصر الفوترةالسعر لكل 1M رمزمتى ينطبق
الإدخال القياسي‏$2.00محتوى التمهيد الجديد، وتعريفات الأدوات، والسياق غير المخزَّن
الإخراج القياسي‏$6.00الإخراج المُولّد واستخدام التفكير المفوتر
ضربة ذاكرة مؤقتة ضمنية‏$0.25إعادة استخدام تلقائية لمقدمات التمهيد؛ الضربات غير مضمونة
إنشاء ذاكرة مؤقتة صريحة‏$2.50إنشاء مقدمة تمهيد قابلة لإعادة الاستخدام معلمة
قراءة ذاكرة مؤقتة صريحة‏$0.17إعادة استخدام كتلة ذاكرة مؤقتة صريحة صالحة

لذلك، تكلف طلبية من 900K رمز أكثر من طلبية من 100K رمز لأنها تعالج عددًا أكبر بتسع مرات من رموز الإدخال—وليس لأنها تتجاوز فئة سعرية أعلى.

يمكن للتفكير أن يزيد تكلفة الإخراج

الإجابة القصيرة المرئية ليست دائمًا إجابة منخفضة التكلفة. قد تولّد الاستدعاءات المُمكّن فيها التفكير رموز تفكير إضافية، لذا يجب أن تستخدم تقديرات الإنتاج حقول الاستخدام التي تُعيدها واجهة API بدلًا من طول الاستجابة المرئي.

حيثما يدعم منفذك عناصر تحكم التفكير لـ qwen3.8-max، قارن الإعدادات المتاحة على نفس مجموعة التقييم. لا تفترض أن القيم الافتراضية للمعاينة تنتقل كما هي إلى نموذج GA.

تعتمد وفورات الذاكرة المؤقتة على استقرار التمهيد

تنشر صفحة نموذج Qwen 3.8 Max أسعار الذاكرة المؤقتة الخاصة بالنموذج. استخدم هذه الأسعار—وليس نسب ذاكرة مؤقتة عامة—عند تقدير الإنفاق.

إدخالات الذاكرة المؤقتة الصريحة لها فترة صلاحية مدتها خمس دقائق، وتؤدي الضربة الناجحة إلى إعادة ضبط تلك الفترة. التخزين المؤقت ضمني تلقائيًا، لكن لا توجد ضمانة للضربة. يكون التخزين المؤقت أكثر فائدة عندما تظل تمهيدات النظام، وتعريفات الأدوات، وسياق المستودعات، أو المستندات الكبيرة ثابتة عبر الاستدعاءات المتكررة.

تنشئ الأدوات المدمجة رسومًا منفصلة

تدرج QwenCloud حاليًا الرسوم التالية للأدوات بالإضافة إلى استخدام الرموز:

الأداة المدمجةالرسوم الحالية
Web Search‏$10 / لكل 1K مكالمة
Image Search‏$8 / لكل 1K مكالمة
Web Extractorمجاني لفترة محدودة
Code Interpreterمجاني لفترة محدودة

لا تحتوي Function calling وMCP على رسوم أدوات منفصلة، لكن أوصاف الأدوات لا تزال تُحتسب ضمن رموز الإدخال. قد تتغيّر عروض الأدوات المجانية، لذا تحقّق من دليل تسعير QwenCloud (https://docs.qwencloud.com/developer-guides/getting-started/pricing) قبل إقرار ميزانية الإنتاج.

على سبيل المثال، تكلفة طلبية بها 20K رمز إدخال و2K رمز إخراج ومكالمتا Web Search تقارب:

Input:      20,000 / 1,000,000 × $2  = $0.040
Output:      2,000 / 1,000,000 × $6  = $0.012
Web Search:  2 / 1,000 × $10          = $0.020
Total:                                      $0.072

في هذا المثال، تمثل مكالمتا البحث نحو 27.8% من إجمالي تكلفة الطلبية.

أمثلة تكلفة Qwen 3.8 Max في العالم الحقيقي

تستخدم هذه الأمثلة أسعار QwenCloud الحالية الخاصة بالنموذج. وهي تستثني الضرائب، وإعادة المحاولات، وعمليات الرجوع، وأي زيادات خاصة بالمزوّد.

المثال 1: طلب وكيل متوسط

Assume 50K input tokens and 5K output tokens:
Input:  50,000 / 1,000,000 × $2 = $0.10
Output:  5,000 / 1,000,000 × $6 = $0.03
Total:                                $0.13

تكلفة المحاولة الأولى الناجحة نحو ‏$0.13. تؤدي إعادة محاولة كاملة واحدة إلى رفع تكلفة النموذج إلى نحو ‏$0.26.

المثال 2: تحليل مستند طويل

Assume 800K input tokens and 20K output tokens:
Input:  800,000 / 1,000,000 × $2 = $1.60
Output:  20,000 / 1,000,000 × $6 = $0.12
Total:                                  $1.72

لا يطبق النموذج رسمًا منفصلًا للسياق الطويل في بطاقة أسعاره الحالية، لكن التمهيدات الكبيرة تظل تولّد تكلفة مطلقة كبيرة.

المثال 3: جلسة وكيل مع ذاكرة مؤقتة

افترض مقدمة تمهيد قابلة لإعادة الاستخدام من 100K رمز، و10K رموز إدخال جديدة، و5K رموز إخراج، و50 استدعاء خلال فترة بقاء الذاكرة المؤقتة الصريحة صالحة:

First call:
100K cache creation × $2.50/M = $0.250
10K new input × $2/M          = $0.020
5K output × $6/M              = $0.030
First-call total              = $0.300
Each of the next 49 calls:
100K cache read × $0.17/M     = $0.017
10K new input × $2/M          = $0.020
5K output × $6/M              = $0.030
Per-call total                = $0.067
Cached session total          = $3.583
Same 50 calls without cache   = $12.500

التوفير المُقدّر = ‏$8.917، أو 71.3%

يعتمد التوفير المُقدّر على ضربات ذاكرة مؤقتة ناجحة ومقدمة ثابتة. ستقلل الفجوات الطويلة أو التغييرات المتكررة في تمهيدات النظام ومخططات الأدوات من الفائدة.

Qwen 3.8 Max مقابل Qwen 3.7 Max: مقارنة التسعير

‏Qwen 3.8 Max أرخص بنسبة 20% من Qwen 3.7 Max بسعر القائمة، لكن Qwen 3.7 Max أرخص بنسبة 37.5% خلال عرضه الترويجي الحالي.

النموذج وحالة التسعيرالإدخال / لكل 1Mالإخراج / لكل 1Mالسياق
qwen3.8-max بسعر قياسي‏$2.00‏$6.001M
qwen3.7-max بسعر القائمة‏$2.50‏$7.501M
qwen3.7-max عرض ترويجي حالي‏$1.25‏$3.751M

احتفظ بصفحة نموذج CometAPI Qwen3.7 Max (https://www.cometapi.com/models/aliyun/qwen3-7-max/) متاحة كحل رجوعي أثناء اختبار النموذج الجديد.

سعر الرمز الواحد ليس سوى جزء من القرار. قد يظل Qwen 3.8 Max أكثر اقتصادية إذا حسّن النجاح من المحاولة الأولى، أو استخدم الأدوات بشكل أكثر موثوقية، أو قلّل من عمليات إعادة المحاولة، أو احتاج إلى تصحيح بشري أقل.

استخدم مقياس الإنتاج هذا:

تكلفة كل مهمة مقبولة =

(رموز النموذج + مكالمات الأدوات + إعادة المحاولات + إنفاق الرجوع + تكلفة المراجعة)

÷ المخرجات المقبولة

تمثل مكاسب المعايير المبلّغ عنها من البائع سببًا لإعادة اختبار مهام الترميز المُجهدة وسير العمل المهنية، وليست دليلًا على أن كل أحمال Qwen 3.7 يجب أن تنتقل.

كيفية الترحيل إلى Qwen 3.8 Max

تغيير سلسلة النموذج ضروري، لكنه ليس ترحيل إنتاج كاملًا.

1. اختبر معرّف نموذج الإنتاج

استبدل معرّف المعاينة بـ qwen3.8-max في بيئة اختبار. لا تفترض أن الأسماء المستعارة للمعاينة أو القيم الافتراضية أو الكمون أو سلوك الاستجابة ستظل دون تغيير.

يمكن أن يبدو طلب متوافق بالحد الأدنى مع OpenAI على النحو التالي:

import os
from openai import OpenAI
client = OpenAI(
    api_key=os.environ["DASHSCOPE_API_KEY"],
    base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
response = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[
        {
            "role": "user",
            "content": "Review this migration plan and identify production risks.",
        }
    ],
)

print(response.choices[0].message.content)

ابدأ بأقل طلب موثّق. أضف عناصر تحكم التفكير فقط عندما يدعمها مرجع API الحالي لنقطة النهاية التي تستخدمها صراحةً.

2. إعادة معايرة قياسات التكلفة والأداء

سجّل على الأقل:

  • رموز الإدخال والإخراج والتفكير
  • ضربات الذاكرة المؤقتة ورموز إنشاء الذاكرة المؤقتة
  • زمن الوصول لأول رمز وإجمالي الكمون
  • مكالمات الأدوات، وإعادة المحاولات، وعمليات الرجوع
  • المخرجات المقبولة مقابل المرفوضة
  • وقت التصحيح البشري

3. أعد اختبار الواجهة التي يستخدمها تطبيقك

تحقق من أحداث البث، والحمولات متعددة الوسائط، ومخططات الأدوات، والمخرجات المهيكلة، وأسباب الإنهاء، وحقول الاستخدام، والتعامل مع الأخطاء، والسلوك متعدد الأدوار. توثّق صفحة النموذج في الإنتاج الوصول عبر DashScope والمتوافق مع OpenAI؛ تحقّق من أي طبقة توافق إضافية قبل الاعتماد عليها.

4. احترم حدود السياق العملية

نافذة سياق 1M ليست مساوية لتمهيد مستخدم من 1M رمز. تسرد QwenCloud حدًا أقصى للإدخال يبلغ 991K من دون التفكير و983K مع التفكير. أضف هامش أمان ليظل هناك حيّز للإخراج والتفكير.

5. شغّل Qwen 3.7 وQwen 3.8 بالتوازي

استخدم تمهيدات وأدوات ومحقّقات وقواعد إعادة المحاولة ومجموعات بيانات متطابقة. قارن تكلفة كل مهمة مقبولة والكمون بدلًا من الحكم على استجابات معزولة بصريًا.

كيفية تقييم Qwen 3.8 Max وتوجيهه

استخدم أحمال عمل واقعية بدلًا من متوسطات المعايير العامة.

عبء العملالمهام المقترحةإشارة القبول الأساسية
ترميز المستودعات4اجتياز الاختبارات دون ترقيع بشري
تحليل مستندات طويلة3الادعاءات مدعومة بالأدلة المزوّدة
تحليل متعدد الوسائط2استخدام التفاصيل ذات الصلة من الصور/الفيديو بشكل صحيح
وكلاء يستخدمون الأدوات3اختيار أدوات صحيح ومعاملات صالحة
A practical routing policy is:
Simple, latency-sensitive task
→ Lower-cost Plus model
Existing workload that already meets quality targets
→ Qwen 3.7 Max while its promotion remains attractive
Hard coding, multimodal, or long-horizon task
→ Qwen 3.8 Max
Failed validation
→ One controlled retry, then a tested fallback

استخدم Qwen 3.8 Max لأعمال المستودعات الصعبة، والوكلاء ذوي الأفق الطويل، والتحليل متعدد الوسائط، وسير العمل حيث يفشل Qwen 3.7 في اختبارات القبول. واحتفظ بـ Qwen 3.7 Max عندما يؤدي العرض الترويجي إلى خفض التكلفة ماديًا وكان النموذج الحالي يلبّي بالفعل هدف الجود.

تحقق من صفحة تسعير CometAPI (https://www.cometapi.com/pricing/) ومعلومات التوجيه المباشرة قبل تثبيت العتبات لأن توفر المزوّد والتسعير الموجّه يمكن أن يتغيّرا بشكل مستقل عن الأسعار المباشرة لـ QwenCloud. يمكن أن يساعد CometAPI Cookbook (https://github.com/cometapi-dev/cometapi-cookbook) في إنشاء طلبات قابلة للتكرار وأداة تقييم متسقة.

الأسئلة الشائعة

كم تكلفة واجهة برمجة تطبيقات Qwen 3.8 Max؟

تدرج QwenCloud حاليًا Qwen 3.8 Max بسعر ‏$2 لكل 1 مليون رمز إدخال و‏$6 لكل 1 مليون رمز إخراج. لاستخدام الذاكرة المؤقتة والأدوات المدمجة أسعار منفصلة.

هل يكلف Qwen 3.8 Max أكثر فوق 128K رمزًا؟

لا يظهر أي مستوى تسعير منفصل للسياق الطويل على بطاقة الأسعار الحالية الخاصة بالنموذج. تكلف الطلبات الطويلة أكثر لأنها تحتوي على رموز أكثر، وليس لأنها تتجاوز طبقة سعر وحدة أعلى.

هل تُفوتر رموز التفكير في Qwen 3.8 Max؟

يمكن للتفكير أن يزيد الاستخدام المُولّد والتكلفة الإجمالية. استخدم حقول رموز التفكير والإخراج التي يعيدها المنفذ بدلًا من التقدير من طول الإجابة المرئي.

هل Qwen 3.8 Max مفتوح المصدر؟

أعلنت Qwen أن الأوزان المفتوحة ستعقب إصدار واجهة API. لا تصف النموذج بأنه قابل للتنزيل أو للاستضافة الذاتية حتى تتوفر نقطة تحقق وترخيص رسميان.

هل يجب على مستخدمي Qwen 3.7 Max الترحيل فورًا؟

ليس تلقائيًا. لدى Qwen 3.8 Max سعر قائمة أقل، بينما Qwen 3.7 Max أرخص خلال عرضه الترويجي الحالي. ارحل عندما تدعم بياناتك الخاصة بالجودة والكمون وسلوك الذاكرة المؤقتة وتكلفة كل مهمة مقبولة هذا التغيير.

جرّب Qwen 3.8 Max عبر CometAPI

استخدم CometAPI Quickstart (https://www.cometapi.com/quickstart/) لإعداد عميل متوافق مع OpenAI. قبل إرسال حركة إنتاجية، تأكّد من أن qwen3.8-max فعّال في حسابك وتحقق من السعر الموجّه المعروض هناك.

قارنه بخط الأساس لـ Qwen 3.7 باستخدام تمهيدات ومحقّقات وسياسات إعادة المحاولة وقياسات موحّدة. هذا يُبقي التقييم مركزًا على النموذج بدلًا من تغييرات في منصة الاختبار.

هل أنت مستعد لخفض تكاليف تطوير الذكاء الاصطناعي بنسبة 20%؟

ابدأ مجاناً في دقائق. رصيد تجريبي مجاني مدرج. لا حاجة لبطاقة ائتمانية.

اقرأ المزيد