Wan3.0, GLM-5.3 Flash, and Qwen3.8 Flash are now live on CometAPI →
guide/CometAPI Research

So verwenden Sie Vidu Q3, um Videos zu erstellen

Erfahren Sie, wie Sie Vidu Q3 für die Erstellung von Text-zu-Video- und Bild-zu-Video-Inhalten verwenden, mit praktischen Prompts, Kamerasteuerung, nativer Audioausgabe, API-Code und Workflow-Tipps.

CometAPI
Mia MarenForschungsteam für KI-Modelle und API
Aktualisiert Aug 28, 2026 21 Min. Lesezeit
So verwenden Sie Vidu Q3, um Videos zu erstellen
Dieses Muster verwenden

Den ersten API-Aufruf ausführen.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Zuerst die Antwort Vidu Q3 kann aus Text-Prompts oder Referenzbildern kurze erzählerische Videos erstellen und dabei in einem einzigen Workflow synchronisierte Dialoge, Soundeffekte, Ambience und Bild generieren. Unterstützt werden Clips bis zu 16 Sekunden in 540p, 720p oder 1080p. Creators arbeiten im Vidu-Webprodukt, während Entwickler das Modell über die CometAPI mit der Modell-ID viduq3 ansprechen können.

Dieses Handbuch konzentriert sich auf den kreativen Prozess: eine Einstellung planen, Text-zu-Video oder Bild-zu-Video wählen, Kamera und Audio dirigieren, Variationen generieren, Fehlschläge prüfen und wiederholbare Web- oder API-Workflows aufbauen.

Was ist Vidu Q3?

Vidu Q3 ist ein Videomodell der dritten Generation von ShengShu Technology und Vidu. Es ist für Story-getriebene Videoerstellung konzipiert statt für einfache Bewegungsloops. Das Modell kann die Bildsequenz und nativen Ton gemeinsam generieren, sodass Dialog, Umgebungsgeräusche, Effekte und Musikeinsätze dem Timing der Szene folgen.

Das Modell ist besonders relevant für Kurzdramen, Comic- und Manga-Adaptionen, narrative Werbung, Film-Previsualisierung, Produkt-Storytelling und Social Video. Vidu hebt Audio-Video-Synchronisation, mehrsprachige Ausgabe, Szenen mit mehreren Sprechern sowie detaillierte Kamera- und Taktkontrolle als zentrale Q3-Fähigkeiten hervor.

Vidu Q3 ist inzwischen eine Modellfamilie statt einer einzelnen Generationskonfiguration. Dieses Handbuch konzentriert sich primär auf die Q3-Pro-Route, die über CometAPI als viduq3 verfügbar ist.

Vidu Q3 – Kurzspezifikationen

Quellenhinweis: Die Spezifikationen kombinieren die Vidu-API-Dokumentation und die CometAPI-Modelseite**.

SpezifikationVidu Q3 DetailPraktische Bedeutung
EntwicklerShengShu Technology / ViduKommerzielles, geschlossenes Videomodell
Offizielle API-Modell-IDviduq3-proWird in Vidus direkten Text-, Bild- und Frame-Workflows genutzt
CometAPI-Modell-IDviduq3Wird mit der vereinheitlichten Videos-API von CometAPI genutzt
EingabemodiText, Bild, Start-/End-Frames, ReferenzenExakte Modi hängen von der API-Oberfläche ab
Aktuelle CometAPI-EingabenText oder ein ReferenzbildMultipart-Form-Upload für Bild-zu-Video
AusgabeMP4-Video mit nativer, synchronisierter AudioDialog und Soundeffekte können zusammen erzeugt werden
Dauer1–16 Sekunden für Text, Bild und Start/Ende; 3–16 Sekunden für Reference-to-VideoStandard ist allgemein 5 Sekunden
Auflösung540p, 720p, 1080pCometAPI nutzt exakte BxH-Werte
Bildrate24 FPSAuf der CometAPI-Modelseite gelistet
AusgabesprachenEnglisch, Japanisch, ChinesischNützlich für lokalisierte Dialoge
Primärer FokusNarrative und charaktergetriebene VideosKurzdrama, Ads, filmische Sequenzen

Kurzer Leistungskontext

Öffentliche Benchmarks sind nur ein Ausgangspunkt, da die Videoqualität stark vom Prompt, dem Referenzbild, dem Einstellungsdesign und dem Bewertungsmaßstab abhängt. Auf SuperCLUE-R2V erzielt Vidu Q3 70.89 gegenüber 64.01 für Vidu Q2. Das Ergebnis stützt Q3s Verbesserungen bei Referenzerhalt und Motivkontinuität, doch Creators sollten das Modell mit ihren eigenen Figuren, Produkten, ihrer Kamerasprache und ihren Audiobedürfnissen bewerten.

Kreation wiegt mehr als eine Rangliste Für die Praxis: Verfolge den Prozentsatz der Clips, die Identität bewahren, die beabsichtigte Aktion ausführen, akzeptable Kamerabewegung nutzen, Dialog synchronisieren und die Prüfung bestehen. Der beste Workflow ist der, der die meisten brauchbaren Einstellungen liefert – nicht der mit der höchsten isolierten Punktzahl.

Zentrale Funktionen von Vidu Q3

Native Audio-Video-Generierung

Vidu Q3 erzeugt Bild und Ton in einem Durchlauf. Ein Prompt kann gesprochene Dialoge, Voiceover, Umgebungsatmosphäre, Schritte, Einschläge oder andere Soundeffekte gemeinsam mit der visuellen Aktion anfordern. Das reduziert die Notwendigkeit, für jeden Entwurf eine separate Tonspur zu bauen, und erleichtert die Timing-Bewertung in der kreativen Review.

Es gibt eine wichtige API-Nuance. Vidus direkte Dokumentation stellt eine audio-Steuerung für Q3 bereit, aber der separate bgm-Schalter ist für Q3 nicht wirksam. Wenn Musik wichtig ist, beschreibe das musikalische Cue und das Timing im Prompt. CometAPIs aktuelle vereinheitlichte Vidu-Anfrage stellt Prompt, Dauer, Größe und ein optionales Referenzbild bereit, daher sollte die Audioregie ebenfalls in den Prompt geschrieben werden.

Bis zu 16 Sekunden in einem Durchlauf

Eine Obergrenze von 16 Sekunden ist lang genug für einen vollständigen kurzen narrativen Beat: eine Establishing-Einstellung, eine primäre Aktion, eine Dialogzeile, eine Kamerabewegung und eine abschließende Reaktion. Es ist dennoch keine Langformerzeugung. Werbespots, Episoden oder Musikvideos erfordern einen Shot-Plan, mehrere Tasks und den Schnitt.

Mehrsprecher- und mehrsprachige Dialoge

Das Produkt ist für Gespräche mit mehreren Figuren ausgelegt und unterstützt Ausgabe in Englisch, Japanisch und Chinesisch. Das ist nützlich für lokalisierte Kurzdramen und Social-Kampagnen. Behandle Sprachunterstützung als Fähigkeit, nicht als Garantie für perfekte Aussprache, Emotion oder Lippensynchronität in jeder Generation; prüfe jede Ausgabe vor der Veröffentlichung.

Kamera- und Taktkontrolle

Q3 reagiert am besten, wenn ein Prompt filmische Intention beschreibt statt nur Objekte aufzulisten. Lege Einstellungsgröße, Objektiv-Anmutung, Kamerapfad, Licht, Aktionsreihenfolge, Taktung, Dialog und Sound-Cues fest. Eine einzige, stimmige Kameraanweisung erzielt meist eine höhere Trefferquote als mehrere konkurrierende Bewegungen in derselben Einstellung.

Referenzbasierte Konsistenz

Vidus direkter Reference-to-Video-Workflow akzeptiert bis zu sieben Bild- oder Text-Subjekte. Referenzen können eine Figur, ein Produkt, ein Requisit oder einen visuellen Stil über Kamerapositionen hinweg verankern.

  • Text-zu-Video: generiert Szene, Bewegung, Komposition und Ton aus einem geschriebenen Prompt.
  • Bild-zu-Video: animiert ein einzelnes Eingabebild; der Prompt sollte sich auf Bewegung, Kameraverhalten und Audio konzentrieren.
  • Start-/End-Frame-Generierung: erzeugt eine Übergangssequenz zwischen zwei visuellen Ankern in der direkten Vidu-API.
  • Reference-to-Video: hält Subjekte oder Stil über eine generierte Sequenz hinweg konsistent.

So erstellst du ein Video mit Vidu Q3 im Web

Der Web-Workflow ist der schnellste Weg von der Idee zum geprüften Clip. Interface-Bezeichnungen können sich ändern, aber die kreative Logik bleibt: den richtigen Eingabemodus wählen, den visuellen Anker vorbereiten, eine dirigierbare Einstellung schreiben, Variationen generieren und nur die fehlgeschlagene Dimension verfeinern.

Schritt 1: Das Deliverable definieren

Lege fest, wo das Video genutzt wird, sein Seitenverhältnis, Zieldauer, visuellen Stil, gesprochene Sprache und ob die Ausgabe an eine andere Einstellung anschließen muss. Ein Social Hook, ein Produktdetailshot, ein Kurzdrama-Beat und eine Film-Previsualisierung benötigen unterschiedliche Taktung.

Schritt 2: Den Erstellungsmodus wählen

Wähle Text zu Video, wenn die Komposition aus dem Prompt erfunden werden kann. Wähle Bild zu Video, wenn du bereits die gewünschte Figur, das Produkt, Artwork oder Framing hast. Nutze Reference to Video auf der direkten Vidu-Oberfläche, wenn Identität oder Stil durch mehrere Subjekte verankert werden müssen.

Modusentscheidung Nutze Text-zu-Video zur Exploration. Nutze Bild-zu-Video, wenn der erste Frame bereits das Design enthält, das du schützen willst. Nutze referenzgetriebene Workflows, wenn Konsistenz wichtiger ist als visuelle Überraschung.

Schritt 3: Das Referenzbild vorbereiten

Für Bild-zu-Video beginne mit einem scharfen Bild, das bereits die korrekten Subjektproportionen, das Framing, die Lichtrichtung und den Hintergrund hat. Lasse visuellen Raum in jene Richtung, in die sich Subjekt oder Kamera bewegen sollen. Vermeide winzige Gesichter, verdeckte Hände, unlesbare Produktlabels, widersprüchliche Spiegelungen und Crops ohne Bewegungsraum.

Schritt 4: Vidu Q3 wählen

Wähle Q3 für in die engere Wahl gekommene Einstellungen, bei denen narrative Qualität, Figurenkontinuität, Dialog und synchronisierter Ton zählen. Nutze Q3 Turbo für kostengünstigere Exploration und überführe dann den stärksten Prompt und das Referenzbild zu Q3 für das finale Rendern.

Schritt 5: Einen strukturierten Einstellungs-Prompt schreiben

Schreibe den Prompt in der Reihenfolge, in der das Publikum die Einstellung erlebt: Subjekt und Setting, Aktion, Kamera, Look, Dialog, Ton, Taktung der Beats und Constraints. Gib dem Modell eine dominante Kamerabewegung und eine primäre Aktion.

Wiederverwendbare Prompt-Struktur

Subjekt + Umgebung + Primäraktion + Einstellungsart + Kamerabewegung + Beleuchtung + visueller Stil + Dialog + Soundeffekte + Timing + Constraints

Schritt 6: Dialog und Ton dirigieren

Setze gesprochene Zeilen in Anführungszeichen, identifiziere den Sprecher, beschreibe die Darbietung und halte den Dialog kurz genug für den Clip. Trenne Ambience von getakteten Soundeffekten. Beispiel: Audio: leiser Raumklang durchgehend; ein keramisches Klicken, wenn die Tasse bei Sekunde vier den Tisch berührt; keine Musik.

Schritt 7: Dauer und Auflösung festlegen

Starte mit fünf Sekunden in 720p. Bestätige Komposition, Identität, Bewegung und Audio, bevor du mehr für eine längere oder höher aufgelöste Version ausgibst. Erhöhe die Dauer nur, wenn die Einstellung mehr Zeit benötigt, um ihre Beats zu vollenden; zusätzliche Sekunden verbessern die Bewegung nicht automatisch.

Schritt 8: Variationen generieren

Erzeuge mehrere Kandidaten aus demselben Kernprompt, bevor du alles umschreibst. Variationen zeigen, ob ein Problem zufällig oder strukturell ist. Scheitern alle Ausgaben auf dieselbe Weise, ändere Prompt oder Referenz. Scheitert nur eine, behalte den Prompt und wähle einen anderen Kandidaten.

Schritt 9: Eine Dimension prüfen und überarbeiten

Prüfe den Clip in Durchgängen. Zuerst Identität und Objektintegrität, dann Aktion und Kamerabewegung, dann Dialog und Audiotiming, schließlich den Endframe. Ändere nur die fehlgeschlagene Dimension, damit eine gute Komposition nicht verloren geht, wenn ein Sound-Cue korrigiert wird.

  • Identitätsfehler: Formuliere Erhaltungsregeln stärker oder nutze ein saubereres Referenzbild.
  • Schwache Aktion: Ersetze abstrakte Verben durch eine sichtbare Bewegung mit klarer Richtung.
  • Chaotische Kamera: Entferne konkurrierende Bewegungen und gib einen Pfad mit Geschwindigkeit an.
  • Schwache Lippensynchronität: Kürze den Dialog, reduziere gleichzeitige Aktionen und nenne Sprecher und Darbietung.
  • Instabiler Hintergrund: Vereinfache die Szene und erhalte Layout und Licht explizit.

Schritt 10: Gewinnerclip herunterladen und archivieren

Lade erst herunter, wenn die Ausgabe den Veröffentlichungs- oder Kundenprüfungsstandard erfüllt. Speichere den finalen Clip zusammen mit Prompt, Eingabebild, Modellvariante, Dauer, Auflösung und Generierungsnotizen, damit das kreative Rezept wiederverwendet werden kann.

Warum Vidu Q3 über CometAPI nutzen?

CometAPI ist besonders nützlich, wenn ein Produkt Zugriff auf mehrere KI-Anbieter benötigt, ohne für jeden eine separate Authentifizierung und Aufgabenverwaltung zu pflegen. Die aktuelle Vidu-Route folgt einem vereinheitlichten asynchronen Workflow: Task erstellen, ID erhalten, Job pollen und das fertige MP4 herunterladen.

  • Ein API-Schlüssel für Vidu und andere Modellfamilien.
  • Ein Muster für Videoaufgaben für Einreichung, Statusabruf und Download.
  • Einfacheres A/B-Testing, wenn dieselbe Anwendung Vidu-, Kling-, Veo-, Seedance- oder Wan-Routen vergleicht.
  • Zentralisiertes Nutzungsmanagement für Abrechnung, Monitoring und Betriebsreview.
  • Weniger anbieterspezifischer Code, wenn sich Modellverfügbarkeit oder Preis ändern.

Preishinweis CometAPI ist nicht automatisch günstiger als Vidus direkte API für jede Q3-Konfiguration. Das Wertversprechen ist operative Konsistenz und Modellauswahl. Vergleiche vor dem Einsatz die exakte Route, Auflösung, Dauer, Queue-Modus und Abrechnungsrichtlinie.

So nutzt du Vidu Q3 mit CometAPI

CometAPIs Vidu-Implementierung verwendet POST /v1/videos mit multipart/form-data. Die Beispiele unten sind serverseitig. Leake niemals einen Produktionsschlüssel in Browser-JavaScript, mobilen Apps, öffentlichen Repos, Screenshots oder Client-seitigen Logs.

Schritt 1: Deinen CometAPI-Schlüssel erstellen und speichern

Erstelle oder melde dich bei deinem CometAPI-Konto an und generiere einen API-Schlüssel. Speichere ihn als Umgebungsvariable.

macOS oder Linux

export COMETAPI_KEY="your_cometapi_key"

Windows PowerShell

$env:COMETAPI_KEY="your_cometapi_key"

Schritt 2: Eine Text-zu-Video-Task erstellen

Die minimal sinnvolle Anfrage benötigt eine Modell-ID und einen Prompt. Füge Dauer und Größe explizit hinzu, damit die Anfrage reproduzierbar ist.

cURL-Text-zu-Video-Anfrage

curl https://api.cometapi.com/v1/videos \  -H "Authorization: Bearer $COMETAPI_KEY" \  -F model=viduq3 \  -F 'prompt=Eine filmische Halbnahaufnahme einer jungen Astronautin, die durch blassblauen Nebel geht. Langsame Dollyfahrt nach vorn. Leise Schritte und ferne mechanische Ambience.' \  -F seconds=5 \  -F size=1280x720

Der Endpunkt antwortet sofort mit einem Task-Objekt. Er wartet nicht, bis das Rendering abgeschlossen ist. Speichere die zurückgegebene id oder task_id.

Schritt 3: Eine Bild-zu-Video-Task erstellen

Für Bild-zu-Video lade ein lokales Bild über das input_reference-Multipart-Feld hoch. Beschreibe, wie sich das Bild bewegen soll, statt jedes sichtbare Detail zu wiederholen.

cURL-Bild-zu-Video-Anfrage

curl https://api.cometapi.com/v1/videos \  -H "Authorization: Bearer $COMETAPI_KEY" \  -F model=viduq3 \  -F 'prompt=Die Figur dreht sich langsam zum Fenster, während Regen über die Scheibe zieht. Sanfte Handkamera, leiser Raumklang, ferner Donner.' \  -F seconds=6 \  -F size=1280x720 \  -F input_reference=@reference.png

Schritt 4: Die Task-Antwort lesen

Beispiel für eine angenommene Task-Antwort

{  "id": "task_example",  "object": "video",  "model": "viduq3",  "status": "queued",  "progress": 0 }

Behandle die Task-ID als opaken String. Normalisiere id und das Kompatibilitätsalias task_id einmal und speichere dann den resultierenden Wert zusammen mit Modell, Prompt, Dauer, Größe, Anfragezeitstempel und dem Benutzer- oder Job-Datensatz, der das Rendern ausgelöst hat.

Schritt 5: Den Task-Status pollen

Rufe GET /v1/videos/{task_id} auf, bis der Status zu completed, failed oder error wird. CometAPIs Retrieve-Dokumentation umfasst dasselbe Endzustandsmuster.

Python-Polling-Loop mit Timeout

import os import time import requests​ task_id = "<TASK_ID>" headers = {"Authorization": f"Bearer {os.environ['COMETAPI_KEY']}"} terminal = {"completed", "failed", "error"} deadline = time.time() + 20 * 60​ while time.time() < deadline:    response = requests.get(        f"https://api.cometapi.com/v1/videos/{task_id}",        headers=headers,        timeout=60,   )    response.raise_for_status()    task = response.json()    print(task["status"], task.get("progress"))​    if task["status"] in terminal:        if task["status"] != "completed":            raise RuntimeError(task.get("error", task["status"]))        break    time.sleep(10) else:    raise TimeoutError("Video generation did not finish in time")

Schritt 6: Das fertige Video herunterladen

Wenn die Task abgeschlossen ist, lade das MP4 über den Content-Endpunkt herunter. Speichere das Asset dauerhaft, wenn die Anwendung eine Langzeitaufbewahrung benötigt.

MP4 herunterladen

curl "https://api.cometapi.com/v1/videos/$TASK_ID/content" \  -H "Authorization: Bearer $COMETAPI_KEY" \  -o vidu-q3-output.mp4

Schritt 7: Den vollständigen Workflow in JavaScript ausführen

Ende-zu-Ende-Beispiel in Node.js

import fs from "node:fs";​ const form = new FormData(); form.append("model", "viduq3"); form.append("prompt", "Ein ruhiges Produkt-Reveal mit einer langsamen Orbit-Kamerafahrt und sanftem mechanischem Sounddesign."); form.append("seconds", "5"); form.append("size", "1280x720");​ const auth = { Authorization: `Bearer ${process.env.COMETAPI_KEY}` }; const created = await fetch("https://api.cometapi.com/v1/videos", {  method: "POST", headers: auth, body: form, }).then((r) => r.json());​ let task; do {  await new Promise((resolve) => setTimeout(resolve, 10_000));  task = await fetch(`https://api.cometapi.com/v1/videos/${created.id}`, {    headers: auth,  }).then((r) => r.json()); } while (!["completed", "failed", "error"].includes(task.status));​ if (task.status !== "completed") throw new Error(JSON.stringify(task.error)); const video = await fetch(  `https://api.cometapi.com/v1/videos/${created.id}/content`,  { headers: auth }, ); fs.writeFileSync("vidu-q3-output.mp4", Buffer.from(await video.arrayBuffer()));

Vidu Q3 API-Parameter

Quellenhinweis: Die aktuellen Feldnamen und Limits folgen dem CometAPI-Vidu-Endpunkt**.

ParameterTypErforderlichEmpfohlenZweck
modelStringJaviduq3Wählt Vidu Q3 aus
promptStringJaStrukturierter Szenen-PromptBeschreibt Visuals, Bewegung, Dialog und Ton
secondsIntegerNeinStarte mit 5Akzeptiert 1 bis 16
sizeStringNein1280x720Nutzt unterstützte BxH-Werte
input_referenceFileBildmodusPNG/JPEG/WebPSteuert die Bild-zu-Video-Generierung

Unterstützte Größenwerte auf der dokumentierten Vidu-Route sind:

  • 960x528 — 540p-Tier, 16:9.
  • 1280x720 — 720p-Tier, 16:9.
  • 1920x1080 — 1080p-Tier, 16:9.

Kompatibilitätsregel Verwende nur Parameter, die für die von dir aufgerufene Route dokumentiert sind. Anbieter-native Felder wie audio, callback_url, mehrere Subjekte oder Off-Peak-Modus sollten auf CometAPIs vereinheitlichtem Endpunkt nicht als funktionsfähig angenommen werden, sofern die CometAPI-Dokumentation sie nicht ausdrücklich aufführt.

Wie schreibt man bessere Vidu Q3 Prompts?

Schreibe jeden Prompt als kompaktes Einstellungsbriefing. Halte die Felder in der folgenden Reihenfolge, damit Vidu Q3 zuerst das visuelle Fundament erhält, dann Bewegung, Kameraregisse, Beleuchtung, Sprache, Ton und Erhaltungsvorgaben.

Subjekt → Umgebung → Aktion → Kamera → Beleuchtung → Dialog → Audio → Constraints

Nutze ein klares Subjekt, eine primäre Aktion und einen Kamerapfad. Halte den Dialog kurz, trenne Ambience von Ereignissounds und nutze Constraints, um festzulegen, was unverändert bleiben muss. Für Bild-zu-Video gilt: Behandle das Eingabebild als visuelle Quelle der Wahrheit und fokussiere den Prompt auf Bewegung, Kameraverhalten, Audio und Erhaltung.

Cinematic-Prompt-Beispiel

Subjekt: Eine müde Detektivin im dunklen Trenchcoat.
Umgebung: Eine regennasse Gasse unter einer flackernden Straßenlaterne bei Nacht.
Aktion: Sie bleibt stehen, hört näher kommende Schritte und blickt langsam über ihre Schulter.
Kamera: Halbnahe mit sanfter dreisekündiger Dollyfahrt nach vorn und 35mm-Objektiv-Anmutung.
Beleuchtung: Blau-magenta Reflexe, weiches Backlight, geringe Schärfentiefe und dezentes Filmkorn.
Dialog: In verhaltener Flüsterstimme: "Du hättest nicht zurückkommen sollen."
Audio: Gleichmäßige Regen-Atmosphäre, eine ferne Sirene und Schritte, die nach der Zeile stoppen.
Constraints: Ihr Gesicht, den Mantel und das Gassenlayout erhalten; keine Untertitel, Logos, zusätzlichen Personen oder Kamerawackler.

Produkt-Prompt-Beispiel

Subjekt: Eine Premium-Edelstahl-Smartwatch mit sauberem blauem Display.
Umgebung: Die Uhr liegt auf schwarzem Stein, während ein dünnes Wasserband den Sockel umkreist.
Aktion: Bei Sekunde drei schaltet sich das Display ein und zeigt einen einzelnen blauen Puls.
Kamera: Langsamer Orbit von links nach rechts, endend in einer zentrierten Makroansicht des Zifferblatts.
Beleuchtung: Präzise Kantenreflexe, kontrollierte Highlights und ein dunkler Luxury-Color-Grade.
Dialog: Keiner.
Audio: Sanfte Wasserbewegung, ein präziser elektronischer Chime und ein zurückhaltendes tiefes Bass-Schwellen.
Constraints: Geometrie der Uhr, Materialien, Display-Layout und Logo-Position erhalten; keine Hände, kein zusätzlicher Text, keine Deformation.

Anime-Prompt-Beispiel

Subjekt: Ein Teenager-Mädchen mit rotem Regenschirm im handgezeichneten Anime-Stil.
Umgebung: Ein stiller ländlicher Bahnsteig bei Sonnenuntergang, mit hohem Gras im warmen Wind.
Aktion: Sie blickt den leeren Gleisen entlang, als in der Ferne ein Zuglicht erscheint, dann lächelt sie leicht.
Kamera: Bewege dich langsam seitlich mit ihr und halte in einer Halbnahen, wenn das Zuglicht erscheint.
Beleuchtung: Warmes Sonnenuntergangslicht, weiche Schatten, stabiles Lineart und konsistente Charakterfarben.
Dialog: Sie flüstert auf Japanisch: "Yatto kaette kita."
Audio: Sommerliche Insekten, sanfter Wind und nach dem Dialog eine ferne Bahnglocke.
Constraints: Charakterdesign, Gesichtszüge, Schirmfarbe und Anime-Stil erhalten; kein On-Screen-Text oder zusätzliche Figuren.

Bild-zu-Video-Prompt-Beispiel

Subjekt: Erhalte Gesicht, Frisur, Kleidung, Pose und Framing der Figur aus dem Referenzbild.
Umgebung: Behalte denselben Raum, die Möbelanordnung, das Hintergrundlayout und die Fensterposition bei.
Aktion: Die Figur hebt den Blick vom Buch, lächelt leicht und dreht sich zum Fenster, während der Vorhang in einer leichten Brise weht.
Kamera: Nutze einen langsamen, stabilisierten Push-in mit subtiler natürlicher Bewegung.
Beleuchtung: Erhalte die ursprüngliche Lichtrichtung, Belichtung, Hautton und Raumfarben.
Dialog: Keiner.
Audio: Leiser Raumton, sanftes Blättern, leichtes Vorhangrascheln und ferne Vögel.
Constraints: Keine Identitätsänderungen, hinzugefügte Accessoires, Handverzerrungen, plötzliche Kamerabewegungen, Hintergrundaustausch oder neue Objekte.

Eine Multi-Shot-Video-Sequenz mit Vidu Q3 erstellen

Ein kompletter Werbespot, ein Kurzdrama, ein Trailer oder eine Musiksequenz benötigt in der Regel mehrere generierte Clips. Behandle Vidu Q3 als Einstellungs-Generator und nutze eine einfache Shot-Liste, um die Kontinuität über die Sequenz zu bewahren.

ShotZweckKontinuitätsanker
1. EstablishWeite Einstellung führt Ort und Subjekt einUmgebung, Kostüm, Tageszeit
2. ApproachHalbtotale/Nahe beginnt die HauptaktionBlickrichtung, Requisitenposition, Beleuchtung
3. EmphasisClose-up liefert Dialog oder ProduktdetailGesicht oder Produktgeometrie, Audioidentität
4. ResolveReaktion oder sauberer Endframe schließt den Beat abSchluss-Pose, Color Grade, Übergangsrichtung

Einen Kontinuitäts-Header wiederverwenden

Beginne jeden Einstellungs-Prompt mit demselben knappen Identitätsblock: Figurenerscheinung, Kostüm, Produktdesign, Ort, Tageszeit und visueller Stil. Ändere dann nur die shot-spezifische Aktion, das Framing, die Kamera und das Audio.

Wiederverwendbares Multi-Shot-Prompt-Muster

Kontinuität: dieselbe Frau Anfang 30, kurzes schwarzes Haar, dunkelgrüner Mantel, silbernes Medaillon; regnerische Neon-Gasse bei Nacht; blau-magenta Reflexe; zurückhaltender filmischer Realismus. Shot 3: Halbnahe. Sie bleibt unter der Straßenlaterne stehen und blickt über ihre Schulter. Langsame Dollyfahrt nach vorn. Sie flüstert: "Ich habe dich gehört." Regen-Atmosphäre setzt sich fort; ferne Schritte stoppen bei Sekunde vier.

Das Ende einer Einstellung an den Anfang der nächsten anpassen

  • Halte die Blickrichtung konsistent, sofern der Schnitt sie nicht absichtlich umkehrt.
  • Führe dieselbe Requisite in derselben Hand oder Position weiter.
  • Stimme Kostüm, Wetter, Lichtrichtung und dominierende Farbe ab.
  • Beende auf einer stabilen Pose oder Komposition, die zum nächsten Referenzbild werden kann.
  • Nutze konsistente Ambience über benachbarte Einstellungen und füge Ereignissounds nur dort hinzu, wo Aktionen stattfinden.

Außerhalb des Generators zusammenbauen und finalisieren

Kürze schwache Anfangs- oder Schlussframes, ordne die Einstellungen, normalisiere Audiopegel, füge Titel oder Untertitel im Editor hinzu und wende nach der Generierung das finale Color- und Sound-Finishing an. KI-generierter On-Screen-Text ist weniger verlässlich als exakte Typografie in der Postproduktion.

Wann solltest du Vidu Q3 wählen?

Modellvergleich sollte die kreative Entscheidung unterstützen, sie nicht dominieren. Die praktische Frage ist, welcher Workflow am besten zu der Einstellung passt, die du produzieren musst.

DimensionVidu Q3Vidu Q3 TurboSeedance 2.5Kling 3.0Veo 3.1
Dauer1–16 s; offizielle Reference-to-Video 3–16 s1–16 s; offizielle Reference-to-Video 3–16 s4–30 sBis zu 15 s, je nach Modus4 s, 6 s oder 8 s pro API-Generierung
AudioNative synchronisierte AudioNative synchronisierte AudioNative Audio-Video-GenerierungVerfügbar in Native-Audio-ModiNative Audio
ReferenzEin Bild auf CometAPI; reichere offizielle OberflächenEin Bild auf CometAPI; reichere offizielle OberflächenBis zu 50 multimodale ReferenzenBild-, Start/End- und Motion-Control-ModiBild- und First/Last-Frame-Guidance
APICometAPI POST /v1/videosCometAPI POST /v1/videosCometAPI POST /v1/videosKling-kompatible Text2Video-/Image2Video-RoutenCometAPI POST /v1/videos
ListenpreisAb $0.056/sAb $0.028/sAb $0.0824/s im Route-KalkulatorV3 720p: $0.336/5s ohne Audio$0.32/s bei 720p oder 1080p
Bester Use CaseFinale kurze Erzählshots mit Dialog und KontinuitätDrafting, Prompt-Iteration und höheres VolumenLängeres multimodales und referenzstarkes StorytellingKontrollierte Kamera, Bewegung und Multi-Shot-ProduktionPhotorealistische filmische Shots und realistische Physik

Quellenhinweis: Modelloberflächen und verfügbare Modi können sich ändern. Klings offizieller Leitfaden dokumentiert 720p/1080p- und Native-Audio-Modi; Google beschreibt Veo 3.1s native Audio-, Referenzkontroll- und Hochauflösungs-Workflows. Preise sind Route-Snapshots statt normalisierter Qualitätsvergleiche; Auflösung, Audiomodus und Qualitätsstufe unterscheiden sich – prüfe die verlinkten Modellseiten vor der Veröffentlichung.

Praktisches Auswahlresultat

Wähle Vidu Q3, wenn du einen kurzen narrativen Shot mit Figuren- oder Produktkontinuität, dirigierbarem Kamerarhythmus, Dialog, Ambience und Soundeffekten in einer Generation benötigst. Nutze Q3 Turbo zur Prompt-Exploration und überführe nur die stärkste kreative Richtung in die Premium-Route. Ziehe ein anderes Modell in Betracht, wenn Cliplänge, ein größerer Referenz-Stack, spezialisierte Multi-Shot-Kontrolle oder photorealistische Physik wichtiger sind als Q3s narrativer Workflow.

Wie viel kostet Vidu Q3?

Preisvergleiche müssen ehrlich Route für Route erfolgen. CometAPI rechnet seine Vidu-Q3-Route pro generierter Sekunde ab. Vidus direkte API bepreist ebenfalls nach Dauer und Auflösung und bietet eine günstigere Off-Peak-Warteschlange mit deutlich längerer Fertigstellungszeit.

AuflösungCometAPI Vidu Q3Vidu Offizielle APIOffiziell Off-Peak
540p$0.056/s$0.045/s$0.025/s
720p$0.1232/s$0.10/s$0.05/s
1080p$0.1232/s$0.12/s$0.06/s

Quellenhinweis: Aufgelistete Preise pro Sekunde von der CometAPI-Modelseite und der Vidu-Preisdokumentation**. Prüfe Live-Abrechnung vor kundenorientierter Veröffentlichung oder Einsatz.

Zu diesen gelisteten Sätzen ist CometAPI nicht in jeder Q3-Konfiguration günstiger. Sein Vorteil ist operativ: ein Schlüssel, ein konsistenter Video-Endpunkt, zentralisiertes Task-Handling und leichteres Umschalten zwischen Anbietern. Ein Team, das nur Vidu nutzt und auf Off-Peak-Verarbeitung warten kann, zahlt über die direkte Vidu-API womöglich weniger.

Beispielkosten für CometAPI-Läufe

Dauer540p720p1080p
5 Sekunden$0.28$0.616$0.616
10 Sekunden$0.56$1.232$1.232
16 Sekunden$0.896$1.9712$1.9712

Kosten pro brauchbarem Clip Ein niedriger Sekundenpreis kann trotzdem teuer sein, wenn die meisten Generationen verworfen werden. Verfolge die Gesamtausgaben geteilt durch die Ausgaben, die die kreative Prüfung bestehen – nicht nur den beworbenen Preis eines Renderlaufs.

Produktions-Best Practices

Bessere kreative Iterationsstrategie

  • Klein anfangen. Verwende eine Fünf-Sekunden-720p-Anfrage, um Komposition, Aktion und Kamerabewegung zu validieren.
  • Kontrollierte Variationen erzeugen. Halte den Kernprompt stabil und variiere jeweils nur eine kreative Entscheidung.
  • Die fehlgeschlagene Dimension diagnostizieren. Trenne Identitäts-, Bewegungs-, Kamera-, Audio- und Kontinuitätsprobleme, bevor du den Prompt bearbeitest.
  • Draft- und Final-Routen trennen. Nutze schnellere Varianten zur Exploration und Premiumvarianten nur für die engere Auswahl.
  • Das Gewinnerrezept speichern. Archiviere finalen Prompt, Referenz, Einstellungen, Ausgabe und Review-Notizen zur Wiederverwendung.

Vidu Q3 Video-Review-Checkliste

Alles auf einmal zu prüfen, erschwert die Prompt-Überarbeitung. Nutze getrennte Durchgänge, damit jede Ablehnung zu einer spezifischen Korrektur führt.

Review-PassAbnahmekriteriumWas zu überarbeiten ist, wenn es scheitert
SubjektGesicht, Körper, Kleidung, Produktgeometrie, Labels und Requisiten bleiben konsistentReferenz oder Erhaltungs-Prompt
AktionDie Primärbewegung ist vollständig, lesbar und korrekt getaktetAktionsverb, Richtung und Beat-Reihenfolge
KameraBewegung folgt einem Pfad ohne Sprünge, Drift oder unerwünschtes ReframingEinstellungsgröße, Pfad, Geschwindigkeit, Endpunkt
UmgebungHintergrundlayout, Licht, Wetter und Sekundärbewegung bleiben stabilSzenenkomplexität und Kontinuitätsvorgaben
AudioDialog, Aussprache, Lippensynchronität, Ambience und Sound-Cues passen zur AktionKürzere Zeile und klarere Audio-Timeline
EndframeDie finale Komposition ist sauber genug, um zu halten, zu schneiden oder die nächste Einstellung zu seed-enSchluss-Pose und Kamera-Endpunkt

Freigaberegel Gib einen Clip nicht nur frei, weil ein Frame beeindruckend aussieht. Schau ihn in Normalgeschwindigkeit, dann prüfe Anfang, Aktionshöhepunkt, Dialogmoment und Schlussframe. Ein brauchbares Video muss über die Zeit kohärent bleiben.

FAQs zu Vidu Q3

Kann Vidu Q3 Video und Audio zusammen generieren?

Ja. Q3 ist für direkte Audio-Video-Generierung ausgelegt, einschließlich Dialog und Soundeffekten. Beschreibe den gewünschten Ton und sein Timing im Prompt, wenn du CometAPIs vereinheitlichte Route nutzt.

Wie lautet die CometAPI-Modell-ID für Vidu Q3?

Nutze viduq3 mit der aktuellen CometAPI-Videos-API. Ersetze den anbieter-nativen Namen viduq3-pro nicht, außer die Dokumentation für die Route verlangt ihn ausdrücklich.

Wie lang kann ein Vidu Q3 Video sein?

Eine einzelne Q3-Generierung unterstützt 1–16 Sekunden. Längere Produktionen erfordern mehrere Einstellungen und Schnitt.

Unterstützt Vidu Q3 Bild-zu-Video?

Ja. Lade auf CometAPI ein Bild über input_reference hoch und nutze den Prompt, um Bewegung, Kameraverhalten, Ton und zu erhaltende Elemente zu beschreiben.

Kann Vidu Q3 Dialog in verschiedenen Sprachen generieren?

Vidu listet Ausgabe in Englisch, Japanisch und Chinesisch. Prüfe Aussprache, Stimmidentität, Emotion und Lippensynchronität, bevor du lokalisierte Inhalte auslieferst.

Sollte ich Vidu Q3 oder Vidu Q3 Turbo verwenden?

Nutze Q3, wenn finale visuelle Qualität, narrative Konsistenz und Figurenkontinuität wichtiger sind als Generationsgeschwindigkeit. Nutze Q3 Turbo für Entwürfe, Prompt-Iteration und Workflows mit höherem Volumen.

Ist CometAPI günstiger als die offizielle Vidu-API?

Nicht in jeder Konfiguration. Aktuelle öffentliche Sätze zeigen, dass Vidus direkte Normal- und Off-Peak-Modi günstiger sein können. Wähle CometAPI für vereinheitlichten Zugriff, eine Integration, zentrales Task-Handling und leichteres Umschalten zwischen Modellen – nicht aufgrund der unbelegten Behauptung, jede Route koste weniger.

Finale Empfehlung

Vidu Q3 ist eine starke Option für kurze, erzählerische Videos, bei denen Bild, Dialog, Ambience und Soundeffekte zusammen geliefert werden sollen. Seine nützlichsten Produktionsstärken sind 16-Sekunden-Generierung, referenzbasierte Konsistenz, Mehrsprecher-Erzählung, mehrsprachige Ausgabe und Prompt-basierte Kontrolle über Kamera und Rhythmus.

Für einen ersten Test nutze eine Fünf-Sekunden-720p-Anfrage mit einem Subjekt, einer Hauptaktion, einer Kamerabewegung und klaren Audiovorgaben. Iteriere den Prompt kostengünstig, erhöhe dann Auflösung oder Dauer erst, wenn die Komposition funktioniert. Nutze Q3 Turbo zur Entwurfsexploration und Standard-Q3 für final ausgewählte Render.

Für wiederholbare Produktion verwandle jedes freigegebene Ergebnis in ein wiederverwendbares kreatives Rezept: Bewahre finalen Prompt, Referenzbild, Modell-ID, Dauer, Auflösung, Task-Metadaten und Review-Notizen. Baue Multi-Shot-Videos aus stabilen Einzelclips auf und füge exakte Titel, Untertitel, Schnitt, Color und finales Sound-Finishing in der Postproduktion hinzu. CometAPI ist am wertvollsten, wenn dieser Workflow auch ein einheitliches Aufgabenmuster und einfaches Routing über mehrere Videomodelle benötigt.

Jetzt loslegen Öffne die Vidu-Q3-Modelseite, erstelle einen CometAPI-Schlüssel, reiche eine kleine Test-Task ein und validiere den vollständigen Workflow Erstellen → Pollen → Herunterladen.

Weiterlernen

Diesen Artikel mit der nächsten Entscheidung verknüpfen.

Alle Themen anzeigen
Veröffentlicht am Aug 27, 2026
Zuletzt aktualisiert Aug 28, 2026
1 Aufrufe
Auf Klarheit, Quellenangabe und aktuelle API-Terminologie geprüft.

Bereit, die KI-Entwicklungskosten um 20 % zu senken?

In wenigen Minuten kostenlos starten. Inklusive kostenlosem Testguthaben. Keine Kreditkarte erforderlich.

Mehr lesen