Wan3.0, GLM-5.3 Flash, and Qwen3.8 Flash are now live on CometAPI →
guide/أبحاث CometAPI

كيفية استخدام Wan 3: دليل واجهة برمجة التطبيقات+ المطالبات

اكتشف Wan 3.0 مع الصوت من النصوص والصور والمستندات (PDF/PPT) وصفحات الويب. المواصفات، التسعير، الموجه وكيفية استخدامه عبر API.

CometAPI
Annaفريق أبحاث نماذج AI وAPI
تم التحديث Aug 29, 2026 7 دقائق للقراءة
كيفية استخدام Wan 3: دليل واجهة برمجة التطبيقات+ المطالبات
استخدم هذا النمط

أجرِ أول استدعاء لـ API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

الخلاصة Wan 3.0 (وتُكتب أيضًا Wan3.0)، أحدث نموذج فيديو شامل من Alibaba Tongyi Lab، يُولّد لقطات أصلية متواصلة لمدة 30 ثانية بدقة تصل إلى 1080p مع صوت متزامن في مرور واحد. يدعم التحويل من النص إلى فيديو، ومن الصورة إلى فيديو، وضبط الإطارين الأول والأخير، وسير عمل Omni-Reference قوية تقبل الصور، والفيديو، والصوت، والمستندات (PDF، PPT، XLS، DOC، MD، إلخ)، وصفحات الويب.

البيتا العامة افتُتحت في 6 أغسطس 2026؛ وتبِعها وصول أوسع تقريبًا في 24 أغسطس 2026. التسعير تقريبيًا $0.05/ثانية (480p)، و$0.10/ثانية (720p)، و$0.20/ثانية (1080p). للمطوّرين والفرق الباحثين عن واجهة API موحّدة متوافقة مع OpenAI للوصول إلى نماذج عائلة Wan وأكثر من 500 نموذج آخر بتكامل بسيط، توفّر CometAPI مسارًا فعّالًا—وتضم حاليًا Wan 2.7 وكاتالوغ فيديو في نمو عبر ‎/v1/videos.

أهم النقاط

  • توليد لقطة أصلية لمدة 30 ثانية بلقطة واحدة (ضعف حد Wan 2.7/2.5 السابق البالغ ~15s) مع مواءمة ذكية للمدة.
  • Omni-Reference: حتى ~10–20 أصلًا مختلطًا (صور، وفيديوهات ≤15s إجمالًا، وصوتيات، ومستند واحد/صفحة ويب) لثبات قوي في الموضوع/المنتج/الأسلوب.
  • التحويل من المستندات وصفحات الويب إلى فيديو ميزة لافتة: أرسل PDF أو عرضًا تقديميًا أو جدول بيانات أو عنوان URL عام لتحصل على فيديو منظّم.
  • توليد صوت أصلي في نفس المرور؛ درجات وضوح 480p/720p/1080p؛ وأبعاد متعددة.
  • دقة أعلى في الوجوه/التعابير الدقيقة، وثبات أفضل للمراجع، ونصوص على الشاشة أنظف من الأجيال السابقة.
  • الوصول عبر Alibaba Cloud Model Studio / Qwen Cloud (الموديل wan3.0-video)، ومنصة wan.video، ومنصات طرف ثالث. لتبسيط التطوير متعدد النماذج، استخدم نقطة النهاية الموحّدة للفيديو من CometAPI.
  • اكتب المطالبة كملخص لقطة (الموضوع + الفعل + الكاميرا + التوقيت + القيود) ووسّم المراجع بوضوح (@Image1، إلخ).

ما هو Wan 3.0؟

Wan 3.0 هو الأحدث في عائلة توليد الفيديو Tongyi Wanxiang (Wan) من Alibaba، مطوّر بواسطة Tongyi Lab. يبني على سلالة الانتشار-المحوّل لإصدارات Wan السابقة المفتوحة والمغلقة (بما فيها سلسلة Wan المفتوحة التي دُرست على نطاق واسع منذ 2025).

أبرز الترقيات مقارنة بـ Wan 2.7 / 2.5 تشمل:

  • مضاعفة الحد الأقصى لمدة التوليد الأصلي إلى 30 ثانية في توليد متواصل واحد (وليس لقطات ملصّقة).
  • توسيع المدخلات متعددة الوسائط إلى ما يتجاوز النص/الصورة/الفيديو/الصوت لتشمل مستندات أوفيس وصفحات ويب عامة.
  • تحسينات “بجودة الواقع” في الوجوه والتعابير الدقيقة وتفاصيل المنتجات واتساق المحتوى الرقمي/واجهات المستخدم.
  • نموذج موحّد شامل يغطي التحويل من نص إلى فيديو (T2V)، ومن صورة إلى فيديو (I2V)، والإطارين الأول والأخير، والمرجع إلى فيديو، وقدرات التحرير/التمديد ذات الصلة.

تضعه Alibaba لاستخدامات مثل فيديوهات التسويق، والدراما القصيرة، ومحتوى الشبكات الاجتماعية، وعروض المنتجات، ولقطات التدريب/المحاكاة (مثل الروبوتات أو القيادة الذاتية)، وفيديوهات الشرح المؤسسية. يظل بوزن مُغلق/عبر API فقط (الإصدارات المفتوحة تتوقف عند Wan 2.x الأسبق).

البيانات والمصادر الداعمة: أمثلة تسعير (دولي): 480p بسعر $0.05/ث، 720p بسعر $0.10/ث، 1080p بسعر $0.20/ث (مقطع 30 ثانية بدقة 1080p ≈ $6 في الفئة القياسية). بعض المنصات تقدم فئات Standard مقابل Prime الأسرع أو خصومات مؤقتة.

كيف تستخدم واجهة Wan 3.0 البرمجية

توفّر Alibaba Cloud الوصول إلى Wan 3.0 عبر واجهة توليد الفيديو في Model Studio. معرّف النموذج الحالي هو:

wan3.0-video

تستخدم الواجهة توليد فيديو غير متزامن. طلب نموذجي:

curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
  -H 'X-DashScope-Async: enable' \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "wan3.0-video",
    "input": {
      "prompt": "A cinematic product commercial showing a premium coffee machine in a modern kitchen."
    },
    "parameters": {
      "resolution": "720P",
      "ratio": "16:9",
      "duration": 10,
      "enable_thinking": false
    }
  }'

تشير وثائق واجهة Alibaba إلى أن النموذج ونقطة النهاية ومفتاح API يجب أن تنتمي إلى نفس المنطقة. الواجهة غير متزامنة، لذا ينبغي للتطبيقات إرسال المهمة ثم استرجاع النتيجة بعد المعالجة.

لأعمال التحويل من صورة إلى فيديو وسير العمل المعتمد على المراجع، يمكن أن يتضمن كائن input وسائط مرجعية. يوضّح مثال Alibaba الحالي مزيجًا من فيديو مرجعي وصور مرجعية في نفس الطلب.

كيف تستخدم Wan 3.0 عبر CometAPI (موصى به للمطورين)

تقدّم CometAPI واجهة موحّدة متوافقة مع OpenAI لأكثر من 500 نموذج، بما في ذلك نماذج فيديو عائلة Alibaba Wan (حاليًا Wan 2.7 مدرَج بتسعير تنافسي لكل ثانية؛ تحقّق من الكاتالوغ المباشر لمعرفة توفر Wan 3.0 مع توسّع التوافر). يستخدم توليد الفيديو نقطة النهاية ‎/v1/videos‎ مع نموذج بيانات متعدد الأجزاء—مثالي لخطوط الإنتاج، وأتمتة n8n/Make، أو التبديل بين Wan وSeedance وKling وVeo وMiniMax وغيرها باستخدام مفتاح واحد.

خطوات CometAPI:

  1. سجّل/سجّل الدخول في cometapi.com وأنشئ مفتاح API (sk-…).
  2. راجع وثائق واجهة الفيديو (apidoc.cometapi.com) وقائمة النماذج لمعرفة معرّف Wan الدقيق (مثل نمط wan2.7؛ أكّد الأحدث).
  3. أرسل طلب POST إلى https://api.cometapi.com/v1/videos مع حقول نموذج:
  4. استلم مُعرّف مهمة/ID؛ وتتبع حالة المهمة أو استخدم Webhooks حتى الاكتمال.
  5. نزّل محتوى الفيديو الناتج.
  6. راقب الاستخدام والتكاليف في لوحة تحكم CometAPI (الدفع حسب الاستخدام، بلا حد أدنى شهري).

كيفية كتابة مطالبات فعّالة لـ Wan 3.0

عامِل المطالبات كملخصات لقطات، لا كتعليقات عابرة. بنية مجرّبة (مستقاة من المجتمع وأدلة المنصات):

صيغة SPACE أو قائمة اللقطات:

  • الموضوع: وصف محدد لما/من هو محور اللقطة.
  • الأداء/الفعل: حركة وتغيرات مرئية مرتبة زمنيًا.
  • الأجواء/المشهد: المكان، الوقت، الإضاءة، الطقس.
  • الكاميرا: حجم اللقطة + حركة واحدة واضحة (دَفْع بطيء، دوران، تتبّع، ثابتة).
  • إضافات: الأسلوب، إشارات صوتية، الإيقاع، القيود ("إبقاء الملصق مقروءًا"، "الحفاظ على هوية الوجه").

للمقاطع متعددة الإيقاعات بطول 30 ثانية، رقّم اللقطات مع نطاقات زمنية:

Overall: A premium product reveal of a ceramic perfume bottle on wet black stone at dusk.
Shot 1 [0-8s]: Wide establishing, slow three-quarter orbit, warm rim light, gentle rain.
Shot 2 [8-18s]: Closer product focus, bottle rotates slowly, label and gold cap remain sharp.
Shot 3 [18-30s]: Final push-in to detail, soft ambient score, hold on the logo.
Keep bottle shape, label position, and gold cap consistent. Cinematic, calm pacing, no text overlays.

ربط المراجع (أساسي لـ Omni-Reference):

@Image1 is the female character (face and yellow jacket).
@Image2 is the rainy alley background.
@Audio1 provides the voice timbre.
The character from @Image1 walks through the alley from @Image2 and says “…” using the voice of @Audio1.

نصائح إضافية:

  • كن محددًا بشأن الأفعال المرصودة والعلاقات المكانية.
  • استخدم المطالبات السلبية لتفادي الإخفاقات الشائعة (تشويه الأيدي، نص غير مرغوب، انجراف الأسلوب).
  • للمستندات: "أنشئ فيديو شرحًا يتبع بنية ملف PDF المرفق، مع التأكيد على المقاييس الثلاثة الرئيسية في الصفحة 2 وتوصيات الخلاصة."
  • كرّر التجارب: أنشئ إصدارات قصيرة أولًا، ثم وسّع اللقطات الناجحة.
  • لغة الكاميرا وأوصاف الإضاءة تحسّن الحس السينمائي.

لماذا تستخدم Wan 3.0؟

يكون Wan 3.0 مقنعًا بشكل خاص عندما تحتاج التطبيقات إلى تحويل أنواع متعددة من المواد المصدر إلى فيديو متماسك، بدلًا من مجرد تحويل مطالبة نصية إلى مقطع قصير.

أبرز مزاياه:

  • توليد فيديو أصلي لمدة 30 ثانية
  • من النص إلى فيديو ومن الصورة إلى فيديو
  • توليد فيديو متعدد المراجع
  • مدخلات نصوص وصور وفيديو وصوت ومستندات
  • سير عمل من المستند وصفحة الويب إلى فيديو
  • توليد صوتي-مرئي أصلي
  • خرج 1080P
  • تحرير فيديو قائم على التعليمات
  • ثبات قوي للمراجع
  • تسعير بالثانية
  • نموذج واحد لعدة سيناريوهات إبداعية

بالنسبة للمطورين الذين يبنون أدوات أفلام بالذكاء الاصطناعي، وأنظمة إعلانات، ومولّدات فيديو للمنتجات، ومنصات محتوى تعليمي، أو وكلاء إبداع متعدد الوسائط، يمكن لهذه القدرات أن تقلّل بشكل كبير عدد النماذج المنفصلة وخطوات المعالجة المسبقة المطلوبة.

الخلاصة والتوصية

يمثل Wan 3.0 خطوة ملموسة نحو فيديو ذكاء اصطناعي عملي موجه للإنتاج: لقطات أطول متواصلة، تحويل حقيقي من المستند إلى فيديو، وتحكم متعدد الوسائط أقوى. مع صياغة مطالبات مدروسة وانضباط في إدارة المراجع، يمكنه ضغط أيام من الإنتاج التقليدي إلى دقائق لكثير من حالات التسويق والشرح والمحتوى القصير.

للمطورين والفرق التي تبني تطبيقات أو أدوات داخلية، ابدأ بقنوات Alibaba الرسمية للحصول على التجربة الأنقى لـ Wan 3.0، وفكّر في استخدام CometAPI (cometapi.com) كبوابة عالية الإنتاجية. واجهة الفيديو الموحّدة لديها، وتغطيتها العريضة للنماذج (بما في ذلك Wan 2.7 حاليًا وكاتالوغ يتوسّع)، وتوافقها مع OpenAI، ونموذج الدفع حسب الاستخدام الشفّاف تجعل التجربة والتوسّع والجمع بين توليد فئة Wan مع نماذج LLM والصورة والصوت المكمّلة أمرًا مباشرًا تحت تكامل واحد.

اطّلع على أحدث قائمة النماذج والوثائق في CometAPI وAlibaba Cloud Model Studio، جرّب مقاطع قصيرة، حسّن مطالبات قائمة اللقطات لديك، وتوسّع إلى إنتاجات كاملة لمدة 30 ثانية. مزيج المدة الأصلية الأطول وOmni-Reference يفتح مسارات إبداعية وتجارية كانت سابقًا مرهقة أو مكلفة.

تابع التعلّم

اربط هذه المقالة بالقرار التالي.

عرض جميع الموضوعات
نُشر في Aug 27, 2026
آخر تحديث Aug 29, 2026
6 مشاهدات
تمت المراجعة للوضوح ودقة المصدر ومصطلحات API الحالية.

هل أنت مستعد لخفض تكاليف تطوير الذكاء الاصطناعي بنسبة 20%؟

ابدأ مجاناً في دقائق. رصيد تجريبي مجاني مدرج. لا حاجة لبطاقة ائتمانية.

اقرأ المزيد