Wan3.0, GLM-5.3 Flash, and Qwen3.8 Flash are now live on CometAPI →
guide/Riset CometAPI

Cara Menggunakan Wan 3: Panduan API+ Prompt

Temukan Wan 3.0 dengan audio dari teks, gambar, dokumen (PDF/PPT), dan halaman web. Spesifikasi, harga, prompt, dan cara menggunakannya melalui API.

CometAPI
AnnaTim riset model AI dan API
Diperbarui Aug 29, 2026 7 menit baca
Cara Menggunakan Wan 3: Panduan API+ Prompt
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR Wan 3.0 (juga ditulis Wan3.0), model video all-in-one terbaru dari Alibaba Tongyi Lab, menghasilkan klip kontinu berdurasi 30 detik secara native hingga 1080p dengan audio tersinkron dalam satu proses. Model ini mendukung text-to-video, image-to-video, pengkondisian bingkai pertama dan terakhir, serta alur kerja Omni-Reference yang kuat yang menerima gambar, video, audio, dokumen (PDF, PPT, XLS, DOC, MD, dll.), dan halaman web.

Beta publik dibuka 6 Agustus 2026; akses lebih luas menyusul sekitar 24 Agustus 2026. Harga kira-kira $0.05/dtk (480p), $0.10/dtk (720p), dan $0.20/dtk (1080p). Bagi pengembang dan tim yang mencari API terpadu yang kompatibel dengan OpenAI untuk mengakses model keluarga Wan dan 500+ model lainnya dengan integrasi sederhana, CometAPI menyediakan jalur yang efisien—saat ini menampilkan Wan 2.7 dan katalog video yang terus bertambah melalui /v1/videos.

Pokok-Pokok Utama

  • Pengambilan tunggal 30 detik native—pembuatan sekali pengambilan (dua kali batas Wan 2.7/2.5 sebelumnya ~15 detik) dengan pencocokan durasi cerdas.
  • Omni-Reference: hingga ~10–20 aset campuran (gambar, video ≤15 detik total, audio, satu dokumen/halaman web) untuk konsistensi subjek, produk, dan gaya yang kuat.
  • Dokumen- dan halaman web-ke-video adalah fitur unggulan: masukkan PDF, deck, spreadsheet, atau URL publik dan terima video terstruktur.
  • Generasi audio native dalam proses yang sama; resolusi 480p/720p/1080p; berbagai rasio aspek.
  • Fidelitas wajah/mikro-ekspresi lebih baik, referensi lebih stabil, dan teks di layar lebih bersih dibanding generasi sebelumnya.
  • Akses melalui Alibaba Cloud Model Studio / Qwen Cloud (model wan3.0-video), wan.video, dan platform pihak ketiga. Untuk pengembangan multi-model yang lebih ringkas, gunakan endpoint video terpadu CometAPI.
  • Buat prompt seperti brief pengambilan gambar (subjek + aksi + kamera + timing + batasan) dan beri label referensi secara eksplisit (@Image1, dll.).

Apa itu Wan 3.0?

Wan 3.0 adalah flagship terbaru dalam keluarga generasi video Tongyi Wanxiang (Wan) milik Alibaba, dikembangkan oleh Tongyi Lab. Model ini dibangun di atas garis keturunan diffusion–transformer dari rilis Wan sebelumnya yang terbuka dan tertutup (termasuk seri Wan terbuka yang banyak dipelajari sejak 2025).

Peningkatan utama dibanding Wan 2.7/2.5 mencakup:

  • Durasi native maksimum digandakan menjadi 30 detik dalam satu generasi kontinu (bukan klip yang disambung).
  • Input multimodal diperluas dari sekadar teks/gambar/video/audio hingga mencakup dokumen perkantoran dan halaman web publik.
  • Peningkatan rendering “kelas realitas” untuk wajah, mikro-ekspresi, detail produk, dan konsistensi konten digital/UI.
  • Model all-in-one terpadu yang mencakup text-to-video (T2V), image-to-video (I2V), bingkai pertama-dan-terakhir, reference-to-video, serta kemampuan pengeditan/perluasan terkait.

Alibaba memposisikannya untuk video pemasaran, drama pendek, konten sosial, demo produk, cuplikan pelatihan/simulasi (misalnya robotika atau AV), dan video penjelas korporat. Model ini tetap closed-weights / hanya melalui API (bobot terbuka berhenti pada rilis Wan 2.x sebelumnya).

Data pendukung & sumber: Contoh harga daftar (internasional): 480p $0.05/s, 720p $0.10/s, 1080p $0.20/s (klip 1080p 30 detik ≈ $6 standar). Beberapa platform menawarkan tingkatan Standard vs Prime yang lebih cepat atau diskon sementara.

Cara Menggunakan API Wan 3.0

Pengenal model saat ini adalah:

wan3.0-video

API ini menggunakan generasi video asinkron. Contoh permintaan:

curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
  -H 'X-DashScope-Async: enable' \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "wan3.0-video",
    "input": {
      "prompt": "A cinematic product commercial showing a premium coffee machine in a modern kitchen."
    },
    "parameters": {
      "resolution": "720P",
      "ratio": "16:9",
      "duration": 10,
      "enable_thinking": false
    }
  }'

Referensi API Alibaba mencatat bahwa model, endpoint, dan kunci API harus berada di wilayah yang sama. API ini bersifat asinkron, jadi aplikasi harus mengirimkan tugas lalu mengambil hasil yang dihasilkan setelah pemrosesan.

Untuk alur kerja image-to-video dan berbasis referensi, objek input dapat menyertakan media referensi. Contoh Alibaba saat ini menunjukkan kombinasi video referensi dan gambar referensi dalam permintaan yang sama.

Cara Menggunakan Wan 3.0 melalui CometAPI (Direkomendasikan untuk Pengembang)

CometAPI menawarkan antarmuka terpadu yang kompatibel dengan OpenAI ke 500+ model, termasuk model video keluarga Wan dari Alibaba (Wan 2.7 saat ini terdaftar dengan harga per detik yang kompetitif; periksa katalog live untuk Wan 3.0 seiring ketersediaan meluas). Pembuatan video menggunakan endpoint /v1/videos dengan multipart form data—ideal untuk pipeline produksi, otomasi n8n/Make, atau beralih antara Wan, Seedance, Kling, Veo, MiniMax, dll., dengan satu kunci.

Langkah CometAPI:

  1. Daftar / masuk di cometapi.com dan buat kunci API (sk-…).
  2. Tinjau dokumentasi API video (apidoc.cometapi.com) dan daftar model untuk ID Wan yang tepat (mis. pola wan2.7; konfirmasi yang terbaru).
  3. Kirim via POST https://api.cometapi.com/v1/videos dengan field formulir:
  4. Terima task/ID; lakukan polling ke endpoint status atau gunakan webhook hingga selesai.
  5. Unduh konten video hasilnya.
  6. Pantau penggunaan dan biaya di dasbor CometAPI (bayar sesuai pemakaian, tanpa minimum bulanan).

Cara Memberi Prompt Wan 3.0 Secara Efektif

Perlakukan prompt sebagai brief pengambilan gambar, bukan keterangan santai. Struktur yang terbukti (diadaptasi dari panduan komunitas dan platform):

Gaya SPACE atau formula daftar shot:

  • Subjek: deskripsi konkret tentang siapa/apa.
  • Performa/Aksi: gerakan yang terlihat dan perubahan keadaan dalam urutan waktu.
  • Suasana/Latar: lokasi, waktu, pencahayaan, cuaca.
  • Kamera: ukuran shot + satu gerakan yang jelas (dorong masuk lambat, orbit, tracking, statis).
  • Tambahan: gaya, isyarat audio, tempo, batasan (“jaga label tetap terbaca”, “pertahankan identitas wajah”).

Untuk klip 30 detik dengan beberapa beat, beri nomor shot dengan rentang waktu:

Overall: A premium product reveal of a ceramic perfume bottle on wet black stone at dusk.
Shot 1 [0-8s]: Wide establishing, slow three-quarter orbit, warm rim light, gentle rain.
Shot 2 [8-18s]: Closer product focus, bottle rotates slowly, label and gold cap remain sharp.
Shot 3 [18-30s]: Final push-in to detail, soft ambient score, hold on the logo.
Keep bottle shape, label position, and gold cap consistent. Cinematic, calm pacing, no text overlays.

Pengikatan referensi (krusial untuk Omni-Reference):

@Image1 is the female character (face and yellow jacket).
@Image2 is the rainy alley background.
@Audio1 provides the voice timbre.
The character from @Image1 walks through the alley from @Image2 and says “…” using the voice of @Audio1.

Tips tambahan:

  • Spesifiklah tentang aksi yang dapat diamati dan hubungan spasial.
  • Gunakan negative prompt untuk mode kegagalan umum (tangan terdistorsi, teks yang tidak diinginkan, pergeseran gaya).
  • Untuk dokumen: “Buat video penjelas yang mengikuti struktur PDF terlampir, menekankan tiga metrik kunci pada halaman 2 dan rekomendasi kesimpulan.”
  • Iterasi: hasilkan versi pendek terlebih dahulu, lalu perluas beat yang berhasil.
  • Bahasa kamera dan deskriptor pencahayaan meningkatkan kualitas sinematik.

Mengapa Menggunakan Wan 3.0?

Wan 3.0 paling menarik ketika aplikasi perlu mengubah berbagai jenis materi sumber menjadi video yang koheren, bukan sekadar mengubah prompt teks menjadi klip pendek.

Keunggulan terkuatnya adalah:

  • Pembuatan video native 30 detik
  • Text-to-video dan image-to-video
  • Pembuatan video multi-referensi
  • Input teks, gambar, video, audio, dan dokumen
  • Alur kerja dokumen dan halaman web ke video
  • Pembuatan audiovisual native
  • Output 1080P
  • Pengeditan video berbasis instruksi
  • Konsistensi referensi yang kuat
  • Harga per detik
  • Satu model untuk berbagai alur kerja kreatif

Kesimpulan dan Rekomendasi

Wan 3.0 mewakili langkah berarti menuju AI video yang praktis dan berorientasi produksi: pengambilan kontinu lebih panjang, dokumen-ke-video yang sesungguhnya, dan kontrol multimodal yang lebih kuat. Dikombinasikan dengan prompt yang matang dan disiplin referensi, model ini dapat memampatkan pekerjaan produksi tradisional berhari-hari menjadi hitungan menit untuk banyak kasus penggunaan pemasaran, penjelasan, dan format pendek.

Bagi pengembang dan tim yang membangun aplikasi atau alat internal, mulailah dengan kanal resmi Alibaba untuk pengalaman Wan 3.0 paling murni, dan pertimbangkan CometAPI (cometapi.com) sebagai gerbang berproduktifitas tinggi. API video terpadu, cakupan model luas (termasuk Wan 2.7 saat ini dan katalog yang terus berkembang), antarmuka yang kompatibel dengan OpenAI, serta model bayar sesuai pemakaian yang transparan memudahkan eksperimen, penskalaan, dan penggabungan generasi kelas Wan dengan LLM, model gambar, dan audio pelengkap di bawah satu integrasi.

Periksa daftar model dan dokumentasi terbaru di CometAPI dan Alibaba Cloud Model Studio, bereksperimenlah dengan klip pendek, sempurnakan prompt daftar shot Anda, dan skala ke produksi penuh 30 detik. Kombinasi durasi native yang lebih panjang dan Omni-Reference membuka alur kerja kreatif dan bisnis baru yang sebelumnya merepotkan atau mahal.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Aug 27, 2026
Terakhir diperbarui Aug 29, 2026
5 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya