GLM-5.3 FlashX and MiniMax H3 Max are now live on CometAPI →
new/Recherche CometAPI

FLUX 3 API : Disponibilité, Accès anticipé, Vidéo et Développement

L'API FLUX 3 est-elle disponible ? Découvrez Video Early Access, l'audio natif, FLUX 3 Dev, les premiers benchmarks et comment les développeurs peuvent se préparer à l'intégration.

CometAPI
Mia MarenÉquipe de recherche sur les modèles IA et API
Mis à jour Sep 3, 2026 12 min de lecture
FLUX 3 API : Disponibilité, Accès anticipé, Vidéo et Développement
Utiliser ce modèle

Passez le premier appel API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

L’API FLUX 3 n’est pas encore disponible de manière générale comme API de production publique. Black Forest Labs a annoncé FLUX 3 et a ouvert l’Accès anticipé pour FLUX 3 Video, tandis que des identifiants de modèle stables, des spécifications complètes de l’API publique et un accès élargi restent à venir.

Les développeurs peuvent demander l’Accès anticipé dès maintenant ou continuer à évaluer les API vidéo disponibles tout en se préparant à évaluer FLUX 3 à mesure que l’accès s’élargit.

Qu’est-ce que FLUX 3 ?

FLUX 3 est le nouveau modèle de fondation multimodal de Black Forest Labs pour les tâches liées à l’image, à la vidéo, à l’audio et à l’action.

Contrairement à FLUX.2, qui se concentre principalement sur la génération et l’édition d’images, FLUX 3 est entraîné conjointement sur des images, des vidéos et de l’audio. Selon l’annonce officielle de FLUX 3 de Black Forest Labs (https://bfl.ai/blog/flux-3), l’objectif est de modéliser la structure visuelle, le mouvement, les interactions physiques et le son au sein d’une architecture partagée plutôt que de traiter chaque modalité comme un système séparé.

Pour les développeurs, la question la plus importante est de savoir si ces capacités sont déjà accessibles via une API prête pour la production.

L’API FLUX 3 est-elle disponible maintenant ?

Non, l’API FLUX 3 n’est pas encore disponible de manière générale comme API de production publique.

Au 24 juillet 2026, Black Forest Labs propose un programme d’Accès anticipé sur candidature, en commençant par FLUX 3 Video. Des identifiants de modèle stables pour la production, des spécifications complètes de l’API publique, des limites de débit et autres détails de production n’ont pas encore été publiés pour un usage général.

Les développeurs intéressés par des tests peuvent postuler via la page officielle du modèle FLUX 3.

Disponibilité de FLUX 3 en un coup d’œil

ÉlémentStatut actuel
Annonce officiellePubliée le 23 juillet 2026
API FLUX 3 publiqueNon disponible de manière générale
Identifiants de modèle stables en productionNon publiés
FLUX 3 VideoAccès anticipé
Longueur vidéo maximale annoncéeJusqu’à 20 secondes par génération
Audio natifPris en charge
FLUX 3 ImageAccès anticipé prévu dans les semaines à venir
FLUX 3 ActionPartenaires de recherche et commerciaux sélectionnés
FLUX 3 DevOssature multimodale à poids ouverts prévue

Black Forest Labs indique que les différentes capacités de FLUX 3 seront déployées par phases au cours des semaines et mois suivants.

La distinction est importante : FLUX 3 a été annoncé et est disponible pour des utilisateurs en Accès anticipé sélectionnés, mais ce n’est pas encore un point de terminaison public que tout développeur peut intégrer en production.

Que peut faire FLUX 3 Video ?

FLUX 3 Video est la première capacité majeure de FLUX 3 à entrer en Accès anticipé.

Selon BFL, il peut générer des clips avec audio natif jusqu’à 20 secondes d’une seule traite. Il prend en charge la génération basée uniquement sur le prompt ainsi que des workflows utilisant des images, des vidéos ou des séquences audiovisuelles comme références.

Voir FLUX 3 en action

Cette prévisualisation offre un aperçu précoce des capacités multimodales de FLUX 3 couvrant la vidéo, l’audio, la génération d’images et la prédiction d’actions.

https://www.youtube.com/watch?v=PCPhl8qMF_Y

Les capacités annoncées incluent :

  • génération texte-vers-vidéo ;
  • génération image-vers-vidéo à partir d’une image initiale ou d’une référence visuelle ;
  • transformation vidéo-vers-vidéo ;
  • continuité vidéo et audio ;
  • génération image-clé-vers-vidéo ;
  • dialogue multilingue ;
  • audio synchronisé avec les événements visuels ;
  • rapports d’aspect multiples et styles visuels multiples ;
  • enchaînement de clips en séquences plus longues multi-plans ;
  • typographie et génération de design animé.

L’évaluation préliminaire de BFL a utilisé des clips texte-vers-vidéo de 10 secondes, en 720p, avec audio. Cependant, des spécifications de production complètes couvrant les résolutions prises en charge, les fréquences d’images, les codecs, le comportement de file d’attente, la latence et les formats de sortie n’ont pas encore été publiées.

Ces détails détermineront en fin de compte la praticité de FLUX 3 Video pour des charges de travail de production réelles.

Qu’est-ce que FLUX 3 Dev ?

FLUX 3 Dev est la version à poids ouverts prévue de l’ossature multimodale FLUX 3.

Black Forest Labs le décrit comme une ossature à poids ouverts destinée à prendre en charge des charges de travail d’image, de vidéo, d’audio, de création de contenu et de prédiction d’actions. L’entreprise n’a pas encore publié ses poids de modèle, tailles de paramètres, exigences matérielles, date de sortie ou termes de licence.

Pour les développeurs intéressés par le déploiement local, le fine-tuning, la recherche ou un contrôle accru de l’infrastructure d’inférence, FLUX 3 Dev est la version à surveiller.

Les équipes doivent éviter d’établir des plans d’infrastructure ou de licence tant que BFL n’a pas publié les spécifications techniques finales et les conditions d’utilisation.

Suivez la page officielle FLUX 3 pour les mises à jour de publication.

FLUX 3 vs FLUX.2 : Qu’est-ce qui a changé ?

FLUX 3 représente un changement plus large que l’ajout de la génération vidéo à FLUX.2.

Fonctionnalité / DimensionFLUX.2FLUX 3
Focalisation principaleGénération et édition d’imagesGénération et prédiction multimodales
Modalités principalesImageImage, vidéo, audio et prédiction d’actions
Modélisation temporellePas un axe principalCapacité centrale
Audio natif en vidéoNonOui
Génération vidéoNonOui
Longueur vidéo maximaleN/AJusqu’à 20 secondes par génération
Prédiction d’actionsPas une capacité principalePrévue via FLUX 3 Action pour des partenaires sélectionnés
Version à poids ouvertsFLUX.2 Dev est disponibleFLUX 3 Dev est prévue ; spécifications en attente
Disponibilité actuelleFamille de modèles publiéeAccès anticipé par phases

FLUX.2 reste une famille de génération et d’édition d’images prête pour la production, avec des variantes API gérées et une version Dev à poids ouverts disponible. FLUX 3 étend l’architecture aux charges de travail temporelles, audiovisuelles et liées aux actions.

Pour les équipes axées aujourd’hui sur la génération d’images, FLUX.2 demeure l’option la plus pratique.

Voir la présentation de FLUX.2 par CometAPI ou le guide d’intégration de l’API FLUX.2 pour les workflows de génération d’images actuels.

FLUX 3 s’étend également à la prédiction d’actions.

Dans le rapport FLUX 3 x mimic, BFL décrit FLUX-mimic, un modèle d’action vidéo construit sur l’ossature FLUX 3 en collaboration avec mimic robotics. BFL indique que le système a été testé sur des tâches de production chez Audi.

L’idée sous-jacente est qu’un modèle capable d’apprendre comment les scènes physiques évoluent dans le temps peut aussi développer des représentations utiles pour prédire des actions de robots.

Ce travail doit être considéré séparément de la future API de génération de contenu. FLUX 3 Action est initialement destiné à des partenaires de recherche et commerciaux sélectionnés.

Que montrent les premiers benchmarks de FLUX 3 ?

Black Forest Labs a publié des évaluations de préférence préliminaires pour un candidat précoce de FLUX 3 Video en utilisant des clips texte-vers-vidéo de 10 secondes, 720p, avec audio.

Dans l’évaluation publiée, FLUX 3 a obtenu :

  • 52 % face à Seedance 2.0 ;
  • 52 % face à Gemini Omni Flash ;
  • 57 % face à Happy Horse 1.1 ;
  • 59 % face à Happy Horse v1 ;
  • 60 % face à Kling v3 Pro ;
  • jusqu’à 69 % face à Grok Imagine Video ;
  • 77 % face à Runway Gen-4.5 ;
  • 93 % face à Luma Ray 3.2.

image

Source*: Black Forest Labs,* FLUX 3: Real World Models**, 23 juillet 2026. Les résultats sont basés sur une évaluation préliminaire d’un candidat FLUX 3 précoce.

Ces résultats sont prometteurs, mais BFL précise que le modèle et son cadre d’évaluation sont encore en développement. Ils doivent donc être considérés comme des évaluations préliminaires réalisées par le fournisseur, plutôt que comme des benchmarks de production indépendants.

Les scores de préférence n’indiquent pas non plus comment le modèle se comporte en termes de latence de l’API, fiabilité, débit, défaillances techniques ou cohérence sur des générations répétées.

Lorsque l’accès à l’API FLUX 3 sera plus large, les équipes devraient exécuter les mêmes prompts sur FLUX 3 et leurs modèles existants dans des conditions de test cohérentes.

Comment les développeurs peuvent-ils accéder à FLUX 3 ?

Au 24 juillet 2026, FLUX 3 est disponible via un programme d’Accès anticipé sur candidature de Black Forest Labs, plutôt que via un accès API public général.

Les développeurs souhaitant tester le modèle peuvent postuler via la page officielle FLUX 3.

CometAPI prévoit de prendre en charge FLUX 3 après que sa disponibilité API et ses spécifications d’intégration auront été officiellement confirmées. Cela permettra aux développeurs d’accéder à FLUX 3 aux côtés d’autres modèles d’IA via la même infrastructure API, sans devoir construire une intégration séparée de zéro.

En attendant, les équipes peuvent continuer à construire avec les modèles déjà disponibles via CometAPI :

Votre cas d’usageModèles et ressources recommandés
Génération vidéo IACommencez avec Veo 3 ou explorez Seedance, Kling, Sora, Runway et d’autres modèles via l’API de génération vidéo CometAPI.
Vidéo avec audio natifÉvaluez Veo 3 pour une génération vidéo avec dialogue synchronisé, effets sonores et ambiance.
Génération et édition d’imagesUtilisez la famille FLUX.2 publiée via le guide d’intégration de l’API FLUX.2 ou testez FLUX.2 Pro.
Workflows à poids ouvertsExplorez FLUX.2 Dev en attendant les poids, la licence et les exigences matérielles de FLUX 3 Dev.
Comparaison future avec FLUX 3Construisez un benchmark réutilisable à l’aide du cadre d’évaluation ci-dessous, puis exécutez les mêmes tests lorsque l’accès à FLUX 3 s’élargira.

Cette approche permet aux développeurs de continuer à livrer dès aujourd’hui avec des alternatives adaptées tout en restant prêts à évaluer ou intégrer FLUX 3 lorsque l’accès API sera plus large.

Comment évaluer l’API FLUX 3 après sa sortie

Les équipes intéressées par FLUX 3 peuvent préparer un benchmark avant l’arrivée de l’accès API public.

Un ensemble de tests représentatif doit couvrir les charges de travail qui comptent le plus pour le produit :

Groupe de testCe qu’il faut mesurer
Conformité au promptObjets, actions, consignes de caméra et exclusions requis
Cohérence des personnagesIdentité, vêtements, proportions et voix
Mouvement physiqueContact, poids, trajectoires et continuité
Audio natifSynchronisation labiale, exactitude du dialogue, timing et ambiance
Édition et référencesRéférences d’images, transformations vidéo, images-clés et continuité
Typographie et sortie multilingueOrthographe, stabilité de mise en page, animation et exactitude linguistique

Pour chaque requête, suivez :

  • le prompt et les ressources de référence ;
  • la version du modèle et du point de terminaison ;
  • la résolution, la durée et le rapport d’aspect ;
  • la latence de file d’attente, de génération et de livraison ;
  • les défaillances techniques et rejets de sécurité ;
  • le score d’acceptation humaine ;
  • les schémas d’échec courants visuels, de mouvement, de texte et d’audio.

Exécuter plusieurs fois les prompts importants.

La vidéo générative est stochastique, et une sortie forte ne signifie pas nécessairement qu’un modèle est suffisamment fiable pour la production. Les tests répétés révèlent des schémas de cohérence et d’échec que des démos soignées peuvent masquer.

Lorsque FLUX 3 sera disponible publiquement, exécutez la même charge de travail contre vos modèles existants. Cela crée une comparaison plus utile que l’utilisation de prompts différents ou d’exemples choisis à la main pour chaque modèle.

Que doivent surveiller les développeurs ensuite ?

Avant de considérer FLUX 3 comme prêt pour la production, surveillez cinq développements clés :

  1. Points de terminaison API publics stables et identifiants de modèles de production.
  2. Résolutions, durées, fréquences d’images, codecs et contrôles d’audio natif pris en charge.
  3. Limites de débit, concurrence, comportement de file d’attente et latence de génération.
  4. Conditions d’usage commercial, de modération de contenu, de confidentialité et de conservation des données.
  5. Poids de FLUX 3 Dev, tailles de paramètres, exigences matérielles et détails de licence.

Ces détails détermineront si FLUX 3 devient non seulement une famille de modèles impressionnante, mais aussi une option pratique pour les applications de production.

FAQ

L’API FLUX 3 est-elle disponible ?

Au 24 juillet 2026, FLUX 3 n’est pas disponible de manière générale comme API publique. Elle est déployée via un programme d’Accès anticipé par phases, et les développeurs peuvent postuler via la page FLUX 3 de Black Forest Labs.

Comment puis-je accéder à FLUX 3 Video ?

Les développeurs et les entreprises peuvent postuler à l’Accès anticipé FLUX 3 Video via la page officielle du modèle FLUX 3.

FLUX 3 génère-t-il de la vidéo avec audio ?

Oui. FLUX 3 Video génère de l’audio natif aux côtés de la vidéo et prend en charge des capacités telles que le dialogue multilingue, la continuité audiovisuelle et des sons synchronisés avec les événements visuels. BFL indique qu’une seule génération peut durer jusqu’à 20 secondes.

Qu’est-ce que FLUX 3 Dev ?

FLUX 3 Dev est la version à poids ouverts prévue de l’ossature multimodale FLUX 3. BFL n’a pas encore publié ses poids de modèle, taille des paramètres, exigences matérielles, date de sortie ou conditions de licence.

Quelle est la différence entre FLUX 3 et FLUX.2 ?

FLUX.2 se concentre sur la génération et l’édition d’images en production. FLUX 3 étend l’architecture vers une approche multimodale couvrant l’image, la vidéo, l’audio natif et la prédiction d’actions.

Conclusion

FLUX 3 mérite l’attention, particulièrement pour les développeurs intéressés par la génération vidéo avec audio natif et des workflows multimodaux plus larges.

Pour l’instant, l’approche pratique consiste à continuer à construire et à établir des benchmarks avec les modèles disponibles tout en préparant un ensemble d’évaluation réutilisable. Lorsque l’accès à l’API FLUX 3 s’étendra, les équipes pourront exécuter les mêmes prompts sur les modèles et comparer la qualité de sortie, la cohérence, la latence, la fiabilité et les schémas d’échec courants.

Prêt à intégrer la génération vidéo dès aujourd’hui ? Explorez l’API de génération vidéo CometAPI pour travailler avec des modèles actuellement disponibles.

Continuer à apprendre

Reliez cet article à la décision suivante.

Voir tous les sujets
Publié le Jul 24, 2026
Dernière mise à jour Sep 3, 2026
122 vues
Revu pour la clarté, l'attribution des sources et la terminologie API actuelle.

Prêt à réduire vos coûts de développement IA de 20 % ?

Démarrez gratuitement en quelques minutes. Crédits d'essai offerts. Aucune carte bancaire requise.

En savoir plus