TL;DR
L’API FLUX 3 n’est pas encore disponible de manière générale comme API de production publique. Black Forest Labs a annoncé FLUX 3 et a ouvert l’Accès anticipé pour FLUX 3 Video, tandis que des identifiants de modèle stables, des spécifications complètes de l’API publique et un accès élargi restent à venir.
Les développeurs peuvent demander l’Accès anticipé dès maintenant ou continuer à évaluer les API vidéo disponibles tout en se préparant à évaluer FLUX 3 à mesure que l’accès s’élargit.
Qu’est-ce que FLUX 3 ?
FLUX 3 est le nouveau modèle de fondation multimodal de Black Forest Labs pour les tâches liées à l’image, à la vidéo, à l’audio et à l’action.
Contrairement à FLUX.2, qui se concentre principalement sur la génération et l’édition d’images, FLUX 3 est entraîné conjointement sur des images, des vidéos et de l’audio. Selon l’annonce officielle de FLUX 3 de Black Forest Labs (https://bfl.ai/blog/flux-3), l’objectif est de modéliser la structure visuelle, le mouvement, les interactions physiques et le son au sein d’une architecture partagée plutôt que de traiter chaque modalité comme un système séparé.
Pour les développeurs, la question la plus importante est de savoir si ces capacités sont déjà accessibles via une API prête pour la production.
L’API FLUX 3 est-elle disponible maintenant ?
Non, l’API FLUX 3 n’est pas encore disponible de manière générale comme API de production publique.
Au 24 juillet 2026, Black Forest Labs propose un programme d’Accès anticipé sur candidature, en commençant par FLUX 3 Video. Des identifiants de modèle stables pour la production, des spécifications complètes de l’API publique, des limites de débit et autres détails de production n’ont pas encore été publiés pour un usage général.
Les développeurs intéressés par des tests peuvent postuler via la page officielle du modèle FLUX 3.
Disponibilité de FLUX 3 en un coup d’œil
| Élément | Statut actuel |
|---|---|
| Annonce officielle | Publiée le 23 juillet 2026 |
| API FLUX 3 publique | Non disponible de manière générale |
| Identifiants de modèle stables en production | Non publiés |
| FLUX 3 Video | Accès anticipé |
| Longueur vidéo maximale annoncée | Jusqu’à 20 secondes par génération |
| Audio natif | Pris en charge |
| FLUX 3 Image | Accès anticipé prévu dans les semaines à venir |
| FLUX 3 Action | Partenaires de recherche et commerciaux sélectionnés |
| FLUX 3 Dev | Ossature multimodale à poids ouverts prévue |
Black Forest Labs indique que les différentes capacités de FLUX 3 seront déployées par phases au cours des semaines et mois suivants.
La distinction est importante : FLUX 3 a été annoncé et est disponible pour des utilisateurs en Accès anticipé sélectionnés, mais ce n’est pas encore un point de terminaison public que tout développeur peut intégrer en production.
Que peut faire FLUX 3 Video ?
FLUX 3 Video est la première capacité majeure de FLUX 3 à entrer en Accès anticipé.
Selon BFL, il peut générer des clips avec audio natif jusqu’à 20 secondes d’une seule traite. Il prend en charge la génération basée uniquement sur le prompt ainsi que des workflows utilisant des images, des vidéos ou des séquences audiovisuelles comme références.
Voir FLUX 3 en action
Cette prévisualisation offre un aperçu précoce des capacités multimodales de FLUX 3 couvrant la vidéo, l’audio, la génération d’images et la prédiction d’actions.
https://www.youtube.com/watch?v=PCPhl8qMF_Y
Les capacités annoncées incluent :
- génération texte-vers-vidéo ;
- génération image-vers-vidéo à partir d’une image initiale ou d’une référence visuelle ;
- transformation vidéo-vers-vidéo ;
- continuité vidéo et audio ;
- génération image-clé-vers-vidéo ;
- dialogue multilingue ;
- audio synchronisé avec les événements visuels ;
- rapports d’aspect multiples et styles visuels multiples ;
- enchaînement de clips en séquences plus longues multi-plans ;
- typographie et génération de design animé.
L’évaluation préliminaire de BFL a utilisé des clips texte-vers-vidéo de 10 secondes, en 720p, avec audio. Cependant, des spécifications de production complètes couvrant les résolutions prises en charge, les fréquences d’images, les codecs, le comportement de file d’attente, la latence et les formats de sortie n’ont pas encore été publiées.
Ces détails détermineront en fin de compte la praticité de FLUX 3 Video pour des charges de travail de production réelles.
Qu’est-ce que FLUX 3 Dev ?
FLUX 3 Dev est la version à poids ouverts prévue de l’ossature multimodale FLUX 3.
Black Forest Labs le décrit comme une ossature à poids ouverts destinée à prendre en charge des charges de travail d’image, de vidéo, d’audio, de création de contenu et de prédiction d’actions. L’entreprise n’a pas encore publié ses poids de modèle, tailles de paramètres, exigences matérielles, date de sortie ou termes de licence.
Pour les développeurs intéressés par le déploiement local, le fine-tuning, la recherche ou un contrôle accru de l’infrastructure d’inférence, FLUX 3 Dev est la version à surveiller.
Les équipes doivent éviter d’établir des plans d’infrastructure ou de licence tant que BFL n’a pas publié les spécifications techniques finales et les conditions d’utilisation.
Suivez la page officielle FLUX 3 pour les mises à jour de publication.
FLUX 3 vs FLUX.2 : Qu’est-ce qui a changé ?
FLUX 3 représente un changement plus large que l’ajout de la génération vidéo à FLUX.2.
| Fonctionnalité / Dimension | FLUX.2 | FLUX 3 |
|---|---|---|
| Focalisation principale | Génération et édition d’images | Génération et prédiction multimodales |
| Modalités principales | Image | Image, vidéo, audio et prédiction d’actions |
| Modélisation temporelle | Pas un axe principal | Capacité centrale |
| Audio natif en vidéo | Non | Oui |
| Génération vidéo | Non | Oui |
| Longueur vidéo maximale | N/A | Jusqu’à 20 secondes par génération |
| Prédiction d’actions | Pas une capacité principale | Prévue via FLUX 3 Action pour des partenaires sélectionnés |
| Version à poids ouverts | FLUX.2 Dev est disponible | FLUX 3 Dev est prévue ; spécifications en attente |
| Disponibilité actuelle | Famille de modèles publiée | Accès anticipé par phases |
FLUX.2 reste une famille de génération et d’édition d’images prête pour la production, avec des variantes API gérées et une version Dev à poids ouverts disponible. FLUX 3 étend l’architecture aux charges de travail temporelles, audiovisuelles et liées aux actions.
Pour les équipes axées aujourd’hui sur la génération d’images, FLUX.2 demeure l’option la plus pratique.
Voir la présentation de FLUX.2 par CometAPI ou le guide d’intégration de l’API FLUX.2 pour les workflows de génération d’images actuels.
FLUX 3 s’étend également à la prédiction d’actions.
Dans le rapport FLUX 3 x mimic, BFL décrit FLUX-mimic, un modèle d’action vidéo construit sur l’ossature FLUX 3 en collaboration avec mimic robotics. BFL indique que le système a été testé sur des tâches de production chez Audi.
L’idée sous-jacente est qu’un modèle capable d’apprendre comment les scènes physiques évoluent dans le temps peut aussi développer des représentations utiles pour prédire des actions de robots.
Ce travail doit être considéré séparément de la future API de génération de contenu. FLUX 3 Action est initialement destiné à des partenaires de recherche et commerciaux sélectionnés.
Que montrent les premiers benchmarks de FLUX 3 ?
Black Forest Labs a publié des évaluations de préférence préliminaires pour un candidat précoce de FLUX 3 Video en utilisant des clips texte-vers-vidéo de 10 secondes, 720p, avec audio.
Dans l’évaluation publiée, FLUX 3 a obtenu :
- 52 % face à Seedance 2.0 ;
- 52 % face à Gemini Omni Flash ;
- 57 % face à Happy Horse 1.1 ;
- 59 % face à Happy Horse v1 ;
- 60 % face à Kling v3 Pro ;
- jusqu’à 69 % face à Grok Imagine Video ;
- 77 % face à Runway Gen-4.5 ;
- 93 % face à Luma Ray 3.2.

Source*: Black Forest Labs,* FLUX 3: Real World Models**, 23 juillet 2026. Les résultats sont basés sur une évaluation préliminaire d’un candidat FLUX 3 précoce.
Ces résultats sont prometteurs, mais BFL précise que le modèle et son cadre d’évaluation sont encore en développement. Ils doivent donc être considérés comme des évaluations préliminaires réalisées par le fournisseur, plutôt que comme des benchmarks de production indépendants.
Les scores de préférence n’indiquent pas non plus comment le modèle se comporte en termes de latence de l’API, fiabilité, débit, défaillances techniques ou cohérence sur des générations répétées.
Lorsque l’accès à l’API FLUX 3 sera plus large, les équipes devraient exécuter les mêmes prompts sur FLUX 3 et leurs modèles existants dans des conditions de test cohérentes.
Comment les développeurs peuvent-ils accéder à FLUX 3 ?
Au 24 juillet 2026, FLUX 3 est disponible via un programme d’Accès anticipé sur candidature de Black Forest Labs, plutôt que via un accès API public général.
Les développeurs souhaitant tester le modèle peuvent postuler via la page officielle FLUX 3.
CometAPI prévoit de prendre en charge FLUX 3 après que sa disponibilité API et ses spécifications d’intégration auront été officiellement confirmées. Cela permettra aux développeurs d’accéder à FLUX 3 aux côtés d’autres modèles d’IA via la même infrastructure API, sans devoir construire une intégration séparée de zéro.
En attendant, les équipes peuvent continuer à construire avec les modèles déjà disponibles via CometAPI :
| Votre cas d’usage | Modèles et ressources recommandés |
|---|---|
| Génération vidéo IA | Commencez avec Veo 3 ou explorez Seedance, Kling, Sora, Runway et d’autres modèles via l’API de génération vidéo CometAPI. |
| Vidéo avec audio natif | Évaluez Veo 3 pour une génération vidéo avec dialogue synchronisé, effets sonores et ambiance. |
| Génération et édition d’images | Utilisez la famille FLUX.2 publiée via le guide d’intégration de l’API FLUX.2 ou testez FLUX.2 Pro. |
| Workflows à poids ouverts | Explorez FLUX.2 Dev en attendant les poids, la licence et les exigences matérielles de FLUX 3 Dev. |
| Comparaison future avec FLUX 3 | Construisez un benchmark réutilisable à l’aide du cadre d’évaluation ci-dessous, puis exécutez les mêmes tests lorsque l’accès à FLUX 3 s’élargira. |
Cette approche permet aux développeurs de continuer à livrer dès aujourd’hui avec des alternatives adaptées tout en restant prêts à évaluer ou intégrer FLUX 3 lorsque l’accès API sera plus large.
Comment évaluer l’API FLUX 3 après sa sortie
Les équipes intéressées par FLUX 3 peuvent préparer un benchmark avant l’arrivée de l’accès API public.
Un ensemble de tests représentatif doit couvrir les charges de travail qui comptent le plus pour le produit :
| Groupe de test | Ce qu’il faut mesurer |
|---|---|
| Conformité au prompt | Objets, actions, consignes de caméra et exclusions requis |
| Cohérence des personnages | Identité, vêtements, proportions et voix |
| Mouvement physique | Contact, poids, trajectoires et continuité |
| Audio natif | Synchronisation labiale, exactitude du dialogue, timing et ambiance |
| Édition et références | Références d’images, transformations vidéo, images-clés et continuité |
| Typographie et sortie multilingue | Orthographe, stabilité de mise en page, animation et exactitude linguistique |
Pour chaque requête, suivez :
- le prompt et les ressources de référence ;
- la version du modèle et du point de terminaison ;
- la résolution, la durée et le rapport d’aspect ;
- la latence de file d’attente, de génération et de livraison ;
- les défaillances techniques et rejets de sécurité ;
- le score d’acceptation humaine ;
- les schémas d’échec courants visuels, de mouvement, de texte et d’audio.
Exécuter plusieurs fois les prompts importants.
La vidéo générative est stochastique, et une sortie forte ne signifie pas nécessairement qu’un modèle est suffisamment fiable pour la production. Les tests répétés révèlent des schémas de cohérence et d’échec que des démos soignées peuvent masquer.
Lorsque FLUX 3 sera disponible publiquement, exécutez la même charge de travail contre vos modèles existants. Cela crée une comparaison plus utile que l’utilisation de prompts différents ou d’exemples choisis à la main pour chaque modèle.
Que doivent surveiller les développeurs ensuite ?
Avant de considérer FLUX 3 comme prêt pour la production, surveillez cinq développements clés :
- Points de terminaison API publics stables et identifiants de modèles de production.
- Résolutions, durées, fréquences d’images, codecs et contrôles d’audio natif pris en charge.
- Limites de débit, concurrence, comportement de file d’attente et latence de génération.
- Conditions d’usage commercial, de modération de contenu, de confidentialité et de conservation des données.
- Poids de FLUX 3 Dev, tailles de paramètres, exigences matérielles et détails de licence.
Ces détails détermineront si FLUX 3 devient non seulement une famille de modèles impressionnante, mais aussi une option pratique pour les applications de production.
FAQ
L’API FLUX 3 est-elle disponible ?
Au 24 juillet 2026, FLUX 3 n’est pas disponible de manière générale comme API publique. Elle est déployée via un programme d’Accès anticipé par phases, et les développeurs peuvent postuler via la page FLUX 3 de Black Forest Labs.
Comment puis-je accéder à FLUX 3 Video ?
Les développeurs et les entreprises peuvent postuler à l’Accès anticipé FLUX 3 Video via la page officielle du modèle FLUX 3.
FLUX 3 génère-t-il de la vidéo avec audio ?
Oui. FLUX 3 Video génère de l’audio natif aux côtés de la vidéo et prend en charge des capacités telles que le dialogue multilingue, la continuité audiovisuelle et des sons synchronisés avec les événements visuels. BFL indique qu’une seule génération peut durer jusqu’à 20 secondes.
Qu’est-ce que FLUX 3 Dev ?
FLUX 3 Dev est la version à poids ouverts prévue de l’ossature multimodale FLUX 3. BFL n’a pas encore publié ses poids de modèle, taille des paramètres, exigences matérielles, date de sortie ou conditions de licence.
Quelle est la différence entre FLUX 3 et FLUX.2 ?
FLUX.2 se concentre sur la génération et l’édition d’images en production. FLUX 3 étend l’architecture vers une approche multimodale couvrant l’image, la vidéo, l’audio natif et la prédiction d’actions.
Conclusion
FLUX 3 mérite l’attention, particulièrement pour les développeurs intéressés par la génération vidéo avec audio natif et des workflows multimodaux plus larges.
Pour l’instant, l’approche pratique consiste à continuer à construire et à établir des benchmarks avec les modèles disponibles tout en préparant un ensemble d’évaluation réutilisable. Lorsque l’accès à l’API FLUX 3 s’étendra, les équipes pourront exécuter les mêmes prompts sur les modèles et comparer la qualité de sortie, la cohérence, la latence, la fiabilité et les schémas d’échec courants.
Prêt à intégrer la génération vidéo dès aujourd’hui ? Explorez l’API de génération vidéo CometAPI pour travailler avec des modèles actuellement disponibles.
