Spécifications techniques de Wan 2.7
| Élément | Wan 2.7 (Video Suite) |
|---|---|
| Fournisseur | Alibaba Tongyi Lab |
| Famille de modèles | Wan 2.7 Video Suite |
| Architecture | Mixture-of-Experts (MoE) de 27B paramètres |
| Types d'entrée | Texte, images, vidéos, références audio |
| Types de sortie | Clips vidéo générés/édités avec audio optionnel |
| Modes pris en charge | Texte-vers-vidéo (T2V), Image-vers-vidéo (I2V), Référence-vers-vidéo (R2V), Édition vidéo |
| Résolution | Sorties 720P et 1080P |
| Durée vidéo | 2–15 secondes |
| Prise en charge audio | Génération audio native, références vocales, workflows de synchronisation labiale |
| Capacité de référence | Images/vidéos multi-références, cohérence d'identité |
| Cohérence des personnages | Prend en charge plusieurs sujets de référence en fonction du workflow |
| Génération de version | Successeur majeur de Wan 2.6 |
Qu'est-ce que Wan 2.7 ?
Wan 2.7 est la suite phare d’Alibaba pour la génération vidéo multimodale, conçue pour des workflows de réalisation IA contrôlables plutôt que pour une simple création prompt-vers-vidéo. La famille de modèles combine génération, édition, prolongation et cohérence pilotée par références en un seul système, permettant aux créateurs de produire de courts clips cinématographiques avec une meilleure préservation du sujet et un contrôle accru des scènes.
Contrairement aux premiers générateurs vidéo centrés principalement sur la qualité du prompt, Wan 2.7 met l’accent sur la contrôlabilité grâce à l’ancrage d’images, aux entrées de référence, à la synchronisation audio et à des workflows structurés multi-plans.
Principales fonctionnalités de Wan 2.7
- Pipeline de planification Thinking Mode : Le modèle planifie la composition de scène et le mouvement avant le rendu, améliorant la conformité aux prompts et réduisant les défaillances de cohérence.
- Contrôle de la première et de la dernière image : Les utilisateurs peuvent définir les images d’ouverture et de fin afin que le système interpole le mouvement entre elles.
- Cohérence d’identité pilotée par les références : Maintient l’apparence des personnages, les vêtements, les objets et le style sur plusieurs plans.
- Workflows multimodaux natifs : Prend en charge texte, image, audio et références vidéo au sein d’un même workflow.
- Génération audio intégrée : Musique de fond, sons d’ambiance et synchronisation des voix peuvent être générés en parallèle des visuels.
- Prise en charge de l’édition et de l’extension : Les vidéos existantes peuvent être prolongées, transformées ou restylées sans repartir de zéro.
Performances de référence de Wan 2.7
La divulgation publique de benchmarks pour Wan 2.7 reste limitée par rapport aux LLM textuels, mais des évaluations tierces et des tests communautaires indiquent des améliorations notables de la stabilité des mouvements, de la conformité aux prompts et de la contrôlabilité par rapport à Wan 2.6.
Les observations rapportées dans l’écosystème incluent :
- Continuité du mouvement renforcée par rapport aux versions antérieures de Wan.
- Meilleur classement dans des évaluations tierces texte-vers-vidéo.
- Amélioration de la cohérence multi-sujets et de la préservation des références.
- Meilleure intégration audio que de nombreux modèles vidéo ouverts plus anciens.
La transparence formelle des benchmarks reste limitée ; les affirmations de performance doivent donc être interprétées avec prudence.
Wan 2.7 vs autres modèles vidéo
| Fonctionnalité | Wan 2.7 | Veo 3.1 | Seedance 2.0 |
|---|---|---|---|
| Workflows audio natifs | Fort | Fort | Modéré |
| Cohérence pilotée par références | Fort | Modéré | Modéré |
| Contrôle de la première + dernière image | Oui | Partiel | Limité |
| Workflows d’édition vidéo | Oui | Oui | Limité |
| Résolution maximale courante | 1080P | Sortie cinématographique haut de gamme | 1080P |
| Prise en charge multi-références | Accent fort | Modéré | Modéré |
Limitations de Wan 2.7
- Durée de clip courte par rapport aux outils de production long format.
- La sortie maximale 1080P limite les workflows en ultra-haute résolution.
- Les scènes à mouvements rapides peuvent encore produire des artefacts d’instabilité.
- Les workflows multi-références augmentent la complexité et les exigences d’ingénierie des prompts.
- La communication publique de benchmarks reste relativement peu fournie.
Cas d’usage représentatifs
- Courts métrages et storyboards avec cohérence des personnages.
- Clips marketing avec synchronisation audio.
- Génération de vidéos pour les réseaux sociaux.
- Visualisation de produits et bandes-annonces de concepts.
- Workflows de prolongation vidéo et d’interpolation de scènes.
- Animation d’avatars et de personnages basée sur des références.
Comment utiliser la WAN 2.7 Video API dans CometAPI
Étape 1 : Essayez la WAN 2.7 Video API dans le Kie Al Playground
Commencez par tester les fonctionnalités de WAN 2.7 via la WAN 2.7 Video API dans le CometAPI Playground. Téléversez des images, ajoutez des prompts ou utilisez des références pour prévisualiser la vidéo WAN générée avant d’intégrer la vidéo IA WAN 2.7 dans votre workflow de production.
Étape 2 : Obtenez la clé d’API WAN 2.7 et consultez la documentation de l’API
Obtenez la clé d’API WAN 2.7 depuis la console CometAPI et consultez la documentation. Comprenez les points de terminaison, l’authentification et les paramètres de la WAN 2.7 Video API afin de prendre en charge les workflows texte-vers-vidéo, image-vers-vidéo et vidéo WAN.
Étape 3 : Générez des vidéos IA WAN 2.7 et intégrez-les à votre workflow
Utilisez la WAN 2.7 Video API pour générer des vidéos IA WAN 2.7 à partir de prompts, d’images ou de références. Intégrez les sorties WAN 2.7 aux workflows produit, aux pipelines de contenu ou aux outils de vidéo IA afin de permettre une création vidéo à l’échelle.