Réponse en premier. Seedance 3 n’a pas encore été annoncé officiellement. Le répertoire public des modèles de ByteDance Seed identifie actuellement Seedance 2.5 comme le dernier modèle vidéo Seedance publié. La prochaine génération majeure doit donc être abordée comme une attente fondée sur la feuille de route : un modèle qui pourrait étendre la narration sur 30 secondes, le contrôle des références multimodales, l’audio synchronisé et le montage précis, tout en traitant les faiblesses restantes en physique complexe et en cohérence multi-sujets.
Qu’est-ce que Seedance 3 ?
Seedance est la famille de modèles vidéo génératifs de ByteDance Seed. Le répertoire officiel des modèles n’énumère actuellement aucun produit Seedance 3, fiche modèle, identifiant d’API, prix ni calendrier de sortie. Cette absence est importante : ce nom est une étiquette raisonnable pour une future génération majeure, mais ce n’est pas encore un modèle commercial confirmé.
Cet article distingue donc trois niveaux de preuve. Les faits confirmés décrivent les modèles Seedance publiés et les capacités des concurrents documentées. Les fonctionnalités attendues sont déduites de la trajectoire de développement visible de ByteDance. Les champs inconnus restent marqués TBD plutôt que d’être remplis par des chiffres rumeurs. Cette distinction maintient l’article utile avant le lancement et facile à mettre à jour lorsqu’une annonce officielle arrivera.
Pourquoi un modèle Seedance de nouvelle génération est plausible
Seedance 1.0 a établi la génération native multi-plans texte-vers-vidéo et image-vers-vidéo en 1080p. Seedance 1.5 Pro a ajouté la génération audio native et une narration orientée film. Seedance 2.0 est passé à une architecture audio-vidéo unifiée capable d’interpréter ensemble texte, images, clips vidéo et références audio. Seedance 2.5 a ensuite doublé la durée publiée d’une génération unique et élargi la capacité de références.
Le schéma est cohérent : chaque version élargit l’unité de création. La série est passée d’un clip visuellement cohérent, à un clip audio-visuel, à un système de mise en scène multimodal, puis à un flux créatif plus long et plus éditable. Un futur Seedance 3 aurait le plus de sens s’il améliorait la fiabilité de ce flux, plutôt que d’ajouter simplement un nouveau chiffre « vitrine ».
Comment la feuille de route Seedance a évolué
| Génération | Entrées | Durée publiée | Audio | Progression déterminante |
|---|---|---|---|---|
| Seedance 1.0 | Texte et image | 10 s multi-plans | Pas d’audio natif | Génération 1080p ; base d’inférence rapide |
| Seedance 1.5 Pro | Texte et image | Court format | Audio natif | Narration audio-visuelle de qualité cinématographique |
| Seedance 2.0 | Texte, image, vidéo, audio | 15 s | Audio natif | Références unifiées, continuation et montage |
| Seedance 2.5 | Texte, image, vidéo, audio | 30 s | Audio natif | 50 références et montage au niveau des timestamps |
| Seedance 3 | TBD | TBD | Attendu | Non annoncé officiellement |
Source : ByteDance Seed 1.0 technical overview* ;* Seedance 2.0 launch materials* ;* Seedance 2.5 launch materials. Les champs Seedance 3 ne sont pas divulgués.

Sources :* ByteDance Seed 1.0, Seedance 2.0 et Seedance 2.5 matériel officiel. Seedance 3 reste TBD.
Spécifications attendues de Seedance 3
La manière la plus sûre de discuter des spécifications avant une annonce est d’utiliser l’ensemble de fonctionnalités publié de Seedance 2.5 comme base. Le tableau ci-dessous ne prétend pas que Seedance 3 prend déjà en charge ces valeurs ; il identifie ce que la prochaine génération devrait préserver ou améliorer.
| Spécification | Base Seedance 2.5 | Attente Seedance 3 | Confiance |
|---|---|---|---|
| Statut officiel | Publié | Non annoncé officiellement | Confirmé |
| Architecture | Génération conjointe audio-vidéo unifiée | Génération multimodale unifiée plus capable | Élevée |
| Modalités d’entrée | Texte, image, vidéo, audio | Probablement les mêmes quatre modalités avec un raisonnement plus profond | Élevée |
| Durée par génération | Jusqu’à 30 secondes | Au moins préserver la base de 30 secondes ; une sortie plus longue n’est pas confirmée | Moyenne |
| Capacité de références | 30 images + 10 vidéos + 10 clips audio | Au moins préserver 50 éléments ou les gérer plus intelligemment | Moyenne |
| Sortie audio | Audio natif synchronisé | Amélioration des dialogues, de l’identité vocale et du son spatial | Élevée |
| Montage | Montage par timestamp, caméra, fond vert et références | Montage plus local, fiable et conversationnel | Élevée |
| Résolution et frame rate | Non spécifiés dans l’article de lancement officiel | TBD | Inconnue |
| ID de modèle API | seedance-2-5 sur CometAPI | TBD | Confirmé |
| Tarification et régions | Disponible selon les routes | TBD | Inconnue |
Source : Base confirmée à partir de la page produit officielle Seedance 2.5**. Les attentes sont des analyses, pas des spécifications annoncées.
Règle de publication. Ne pas affirmer que Seedance 3 prend en charge la 4K, une génération native de 60 secondes, un frame rate particulier ou un prix spécifique, sauf si ByteDance publie ces détails. Utiliser TBD pour chaque champ non divulgué.
Quelles fonctionnalités Seedance 3 pourrait-il introduire ?
Des histoires plus longues qui restent cohérentes
Seedance 2.5 peut produire des clips audio-vidéo de 30 secondes en un seul passage et les étendre sur plusieurs tours. Le prochain défi n’est pas seulement la durée. Une vidéo longue devient utile seulement lorsque l’identité des personnages, les costumes, la disposition spatiale, l’éclairage, la voix et la causalité narrative restent stables à travers les coupes et les prolongements.
Seedance 3 pourrait donc se concentrer sur un état de scène persistant : se souvenir de quel personnage tient un objet, où se trouve une porte, comment un costume change et comment un événement antérieur doit affecter un plan ultérieur. Cela réduirait le travail correctif que les créateurs effectuent actuellement après avoir généré une séquence impressionnante visuellement mais incohérente en interne.
Physique renforcée et interactions complexes
Le contact humain-objet, les collisions, les tissus, les liquides, les foules et les mouvements rapides de caméra restent difficiles pour les systèmes de vidéo générative. Le résumé de Seedance 2.5 par ByteDance identifie lui-même la physique des mouvements complexes et la stabilité des interactions multi-sujets comme des axes perfectibles. Un saut générationnel significatif rendrait ces scènes plus fiables plutôt que simplement plus détaillées.
La métrique pratique est le taux d’utilisabilité. Un clip sportif n’est pas réussi parce qu’une image semble réaliste ; il l’est lorsque les mains, l’équipement, l’élan, le contact, le son et le mouvement de caméra restent plausibles tout au long du plan. Seedance 3 doit être évalué sur des séquences complètes et des générations répétées, pas sur des images vitrines sélectionnées.
Personnages, produits et voix persistants
Le contrôle par références devient l’interface de production pour la vidéo IA. Les créateurs ont besoin que le même acteur, produit, accessoire, lieu et voix restent reconnaissables à travers plusieurs scènes. Seedance 2.5 accepte déjà jusqu’à 30 images, 10 vidéos et 10 clips audio, mais l’étape suivante n’est pas nécessairement une limite d’envoi plus élevée. Une meilleure sélection des références, la résolution des conflits, la pondération d’identité et des personnages réutilisables peuvent apporter plus de valeur qu’une simple augmentation brute de capacité.
Pour la publicité, cela signifie qu’un packaging, un logo, un système de couleurs et un porte-parole peuvent survivre aux changements de caméra sans dériver. Pour la production narrative, cela signifie qu’un personnage récurrent peut conserver une apparence et une voix cohérentes sans reconstruire l’ensemble de références pour chaque clip.
Un montage vidéo plus précis et localisé
La génération n’est que la première moitié d’un flux de production. Les monteurs doivent changer un objet, une expression, une réplique, un mouvement de caméra ou un intervalle de temps tout en laissant intact le contenu approuvé. Seedance 2.5 prend en charge le montage basé sur les timestamps, les changements de perspective caméra, les workflows sur fond vert et la révision guidée par références. Seedance 3 pourrait rendre ces opérations plus locales et déterministes.
- Changements au niveau des régions qui préservent les pixels et le mouvement hors de la zone demandée.
- Révision audio seule ou mouvement seul sans régénérer toute la séquence.
- Historique de montage conversationnel pour qu’un créateur affine un résultat sur plusieurs tours.
- Références stables entre versions qui maintiennent l’identité d’un personnage ou d’un produit approuvé à travers les modifications.
Contrôle professionnel de la caméra et de la scène
Seedance 2.5 peut utiliser des instructions par timestamp et des références en rendu « clay » pour contrôler le blocking, les mouvements de caméra, la géométrie de scène, la direction de la lumière et le rythme. Un futur modèle pourrait resserrer cette relation entre la prévisualisation et le rendu final. Des panneaux de storyboard, des mises en page 3D approximatives, des listes de plans, des trajectoires de mouvement et des repères audio pourraient devenir les éléments d’un seul brief de mise en scène.
C’est là que Seedance peut se différencier des modèles optimisés principalement pour un beau clip court. Les équipes de production valorisent la répétabilité : la capacité à demander un rendu avec une sensation d’objectif particulière, une durée de plan, une marque de position d’acteur, une configuration d’éclairage ou un angle produit, et à obtenir un résultat qui peut être révisé sans tout recommencer.
Performances de référence : ce qui est confirmé et ce qui ne l’est pas ?
Aucun score Seedance 3 n’existe. Il n’y a pas de résultats officiels de benchmarks Seedance 3. Tout graphique attribuant au modèle un score Elo, un taux de victoire, une vitesse de génération ou un score de qualité avant une évaluation officielle doit être considéré comme non vérifié.
Référence de performance de Seedance 2.5
ByteDance n’a pas publié de score standardisé pour Seedance 2.5 ni de protocole de benchmark tiers. Ses matériels de lancement officiels définissent plutôt la performance via des capacités orientées production et des démonstrations sélectionnées. Cela fait de Seedance 2.5 la base confirmée pertinente, tout en empêchant que des résultats vitrines qualitatifs soient pris pour des scores croisés indépendants.
La base publiée comprend jusqu’à 30 secondes en une génération, jusqu’à deux tours d’extension et un maximum de 50 références : 30 images, 10 clips vidéo et 10 clips audio. ByteDance rapporte également des transitions plus fluides, une stabilité plus forte des sujets à travers les coupes, un audio et une vidéo synchronisés et un montage au niveau des timestamps. Ces affirmations décrivent la performance visée du modèle ; elles ne divulguent pas de jeu de tests, de protocole d’évaluation, de taux de victoire, de distribution de latence ou de coût par seconde acceptée.

Capacité maximale publiée des références Seedance 2.5. Source : description de lancement de ByteDance Seed. Il s’agit d’une métrique de capacité produit, pas d’un score de qualité standardisé.
Ce que montre la base Seedance 2.5
La force la plus clairement mesurable de Seedance 2.5 est l’échelle du workflow. Un clip natif de 30 secondes, une extension multi-tours et une entrée de 50 références peuvent réduire le nombre de générations séparées nécessaires pour une séquence riche en références. Ses outils de montage ciblent également le point où le coût de production augmente généralement : réviser un intervalle de temps, un mouvement de caméra, un sujet ou un arrière-plan sans reconstruire l’ensemble du concept.
Les questions de performance restantes sont des questions de fiabilité. Des tests indépendants devraient mesurer l’utilisabilité au premier essai, la cohérence d’identité et de voix sur toute la durée de 30 secondes, les taux d’erreurs en mouvement complexe, la synchronisation audio-vidéo en dialogue et la proportion de contenu approuvé qui change après une modification ciblée. Ces résultats seraient plus utiles à la décision qu’un score unique de préférence visuelle.
Benchmarks de Seedance 3.0 qui compteront au lancement
Une évaluation crédible de Seedance 3 devrait rapporter plus qu’un score global de préférence. L’analyse de sortie la plus utile testerait les dimensions suivantes avec des invites divulguées, plusieurs graines aléatoires et des sorties complètes non éditées.
- Cohérence d’identité sur la longue durée : stabilité du visage, du corps, des vêtements, du produit, de l’accessoire, du lieu et de la voix à travers les coupes et prolongements.
- Physique des mouvements complexes : contact humain-objet, élan, collisions, tissus, liquides, foules et sports.
- Suivi des instructions : actions horodatées, ordre des plans, mouvements de caméra, dialogues et contraintes négatives.
- Synchronisation audio-vidéo : parole, mouvement des lèvres, effets, ambiance, musique et synchronisation des événements.
- Préservation au montage : part de contenu approuvé qui change lors de la révision d’une région, d’un intervalle de temps ou d’un son.
- Efficacité de production : temps jusqu’à un résultat utilisable, taux de réessai, latence, coût par seconde acceptée et taux d’échec.
Faut-il attendre Seedance 3 ?
Attendre n’est pas automatiquement le choix le plus sûr, car Seedance 3 n’a pas de date de sortie, de spécifications, de prix ni d’identifiant API confirmés. La décision pratique est de savoir si Seedance 2.5 répond déjà aux critères d’acceptation du travail que vous devez livrer.
Attendez si...
Votre blocage actuel est une lacune de capacité connue. Si le projet dépend d’une physique complexe fiable, d’interactions denses multi-sujets, de modifications fortement localisées ou d’actifs de personnages réutilisables persistants, le modèle actuel peut encore nécessiter trop de réessais et de corrections manuelles.
Le projet n’a pas de délai de livraison fixé. Attendre peut être raisonnable lorsque le report a peu de coût et que l’équipe peut tolérer un calendrier de lancement, une région d’accès, un comportement de file d’attente et un prix inconnus.
La migration serait coûteuse. Si les invites, l’emballage des références, les critères de revue ou l’approbation conformité doivent être reconstruits autour d’un nouveau modèle, il peut être préférable d’évaluer l’interface officielle de Seedance 3 avant d’engager le workflow de production.
Utilisez Seedance 2.5 dès maintenant si
Vous avez besoin d’une base de production opérationnelle. Seedance 2.5 fournit déjà une génération de 30 secondes, des extensions, un audio natif synchronisé, de grands ensembles de références multimodales et un montage basé sur les timestamps. Ces capacités sont suffisamment concrètes pour être testées dès aujourd’hui sur un brief réel.
L’itération compte plus que le pic théorique de qualité. Un modèle actuel permet à l’équipe d’apprendre quelles invites, références, instructions de caméra, portes de revue et modifications de repli déterminent réellement la sortie utilisable.
Vous voulez des preuves avant de basculer. Une base Seedance 2.5 vous donne des mesures comparables pour l’acceptation au premier passage, les réessais, la latence, le coût par seconde acceptée, la dérive d’identité et la préservation au montage. Seedance 3 pourra ensuite être jugé sur le même jeu de tests une fois qu’il sera réel.
Seedance 3 vs Seedance 2.5 vs Vidu Q3, Kling 3.0 vs Veo 3.1
Étant donné que Seedance 3 n’a pas de spécifications publiées, la colonne ci-dessous le traite comme un seuil plutôt qu’une grille de scores. Elle montre ce que le prochain modèle devrait égaler ou dépasser face aux systèmes actuellement disponibles.
| Modèle | Statut | Durée native | Audio | Contrôle et montage | Positionnement actuel |
|---|---|---|---|---|---|
| Seedance 3 | Non annoncé | TBD | Audio natif attendu | Contrôle multimodal plus profond attendu | Doit améliorer la fiabilité longue durée |
| Seedance 2.5 | Disponible | Jusqu’à 30 s | Audio natif synchronisé | 50 références ; montage par timestamp et caméra | Narration longue, riche en références |
| Vidu Q3 | Disponible | 1–16 s | Sortie audio-vidéo native | Texte, image, premier/dernier cadre et modes de référence | Durée flexible et itération rapide |
| Kling 3.0 | Disponible | 3–15 s | Sortie audio-vidéo native | Contrôle par storyboard ; références image, vidéo et éléments | Contrôle multi-plans et identités réutilisables |
| Veo 3.1 | Disponible | Selon le mode | Audio natif | Extension, génération spécifique à l’image et guidage par image | Sortie cinématographique et workflows Google |
Pages des modèles : Seedance 2.5 | Vidu Q3 | Kling 3.0 | Veo 3.1
Ce que montre la comparaison
Seedance 2.5 a actuellement l’avantage le plus clair en longueur de clip natif publiée et en nombre maximal de références parmi les modèles présentés ici. Son workflow de 30 secondes est conçu autour d’une unité narrative complète plutôt que d’un court plan isolé.
Vidu Q3 offre une génération flexible d’une à seize secondes, jusqu’à 1080p via sa documentation API officielle, et des variantes qui privilégient soit la qualité de sortie, soit la vitesse. Il est attractif lorsque l’itération rapide, le contrôle des cadres de début/fin ou les workflows de référence-vers-vidéo comptent plus que la longueur native maximale.
Kling 3.0 prend en charge jusqu’à 15 secondes, une sortie audio-visuelle native, des storyboards multi-plans personnalisés et des éléments de personnage construits à partir de références image ou vidéo. Sa force concurrentielle est une mise en scène explicite au niveau du plan et des identités réutilisables.
Veo 3.1 met l’accent sur l’audio natif, l’extension vidéo, la génération spécifique à l’image et la direction basée sur l’image. Il reste une référence solide pour le rendu cinématographique et l’intégration dans la pile de médias génératifs de Google.
Pour que Seedance 3 représente une vraie évolution, il doit faire plus que gagner un test de préférence visuelle sélectionné. Il devrait transformer davantage d’invites en séquences utilisables et éditables du premier coup, notamment dans les scènes multi-personnages, les mouvements complexes et la continuation longue durée.
Quand Seedance 3 sera-t-il publié ?
Il n’y a pas de date de sortie officielle pour Seedance 3. ByteDance n’a publié ni page de projet, ni fiche modèle, ni identifiant d’API, ni grille tarifaire, ni région de disponibilité, ni séquence de déploiement pour ce nom. Une fenêtre de sortie ne doit pas être déduite mécaniquement de l’espacement entre les versions Seedance antérieures.
Les points de confirmation les plus fiables sont le répertoire des modèles ByteDance Seed, les articles de lancement ByteDance Seed, la documentation API de Volcano Engine ou BytePlus, et une page produit ou modèle en ligne. Tant que l’une de ces sources n’identifie pas Seedance 3, les affirmations de date de sortie doivent être présentées comme des rumeurs ou omises.
Comment accéder aux modèles Seedance en attendant
Les développeurs n’ont pas besoin d’attendre un modèle non confirmé pour tester le workflow actuel. Seedance 2.5 est disponible via CometAPI en utilisant un schéma asynchrone de génération vidéo. Les applications soumettent une tâche, stockent l’identifiant renvoyé, interrogent pour l’achèvement et récupèrent la vidéo résultante. La même couche d’intégration peut faciliter la comparaison de modèles vidéo sans reconstruire l’authentification et la gestion des jobs pour chaque fournisseur.
Bash (cURL)
curl --request POST 'https://api.cometapi.com/v1/videos' \ --header 'Authorization: Bearer YOUR_COMETAPI_KEY' \ --form-string 'model=seedance-2-5' \ --form-string 'prompt=Un plan séquence cinématographique suivant un dragon en papier volant au-dessus d’une rivière éclairée par des lanternes au crépuscule.' \ --form-string 'seconds=5'
L’exemple utilise l’ID de modèle publié seedance-2-5. Il ne doit pas être remplacé par seedance-3 tant que CometAPI n’aura pas publié une véritable page modèle et un identifiant pris en charge. Le comportement de l’endpoint et les paramètres de requête doivent être vérifiés par rapport à la documentation API actuelle avant un usage en production.
Pour les paramètres complets, la gestion du statut des tâches et les conseils de production, consultez la documentation API CometAPI.
Ce que nous ne savons toujours pas
- Si Seedance 3 sera le nom de produit officiel.
- La date de sortie et la séquence de déploiement.
- La durée native maximale, la résolution de sortie, le frame rate et les limites de format d’image.
- Le nombre maximal de références et si les références peuvent devenir des actifs réutilisables.
- Les détails d’architecture, l’échelle de paramètres, les divulgations sur les données d’entraînement et le matériel d’inférence.
- Les scores officiels de benchmark et le protocole d’évaluation qui les sous-tend.
- Les IDs de modèle API, le prix, les régions de disponibilité, les limites de taux et les conditions commerciales.
- Les mécanismes de provenance, de filigranage, de protection d’identité et de contrôle des droits d’auteur qui seront livrés avec le modèle.
Réflexions finales
Seedance 3 reste non confirmé, mais la direction de la famille Seedance se précise. La série a progressé de la génération visuelle multi-plans native à l’audio synchronisé, au contrôle des références multimodales unifiées, à la narration sur 30 secondes et au montage ciblé. La prochaine étape majeure devrait rendre ce flux plus fiable, pas simplement plus spectaculaire dans des démonstrations sélectionnées.
Les preuves les plus importantes seront des performances reproductibles : des personnages et des voix cohérents sur de longues séquences, des interactions physiques plausibles, une réponse précise aux directives horodatées et des modifications qui préservent le contenu approuvé. Ces qualités déterminent si un modèle peut passer de la génération de concepts à la production quotidienne.
En attendant des informations officielles sur Seedance 3, les développeurs peuvent évaluer l’actuelle API Seedance 2.5 et la comparer à d’autres modèles vidéo via CometAPI. Cet article ne doit être mis à jour que lorsque ByteDance ou une source API en ligne confirme le nom du modèle, ses spécifications, ses benchmarks et ses modalités d’accès.
