GPT-6.1 Sol are now live on CometAPI →
ai-model/Recherche CometAPI

Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés

Explorez les spécifications de Gemini Omni 1.1 Flash, les données officielles de benchmarks, les contrôles vidéo, la tarification, et la façon dont il se compare aux autres workflows rapides de génération vidéo.

CometAPI
Deon GoodwinÉquipe de recherche sur les modèles IA et API
Mis à jour Oct 6, 2026 16 min de lecture
Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés
Utiliser ce modèle

Passez le premier appel API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Gemini Omni 1.1 Flash est disponible en disponibilité générale via l’API payante Gemini Developer sous l’identifiant gemini-omni-1.1-flash, tandis que Gemini Enterprise Agent Platform propose actuellement l’endpoint en préversion gemini-omni-1.1-flash-preview. Il ajoute davantage de contrôle sur les scènes, les images clés, les références et la résolution de sortie, ce qui est particulièrement utile lorsqu’un clip nécessite plusieurs itérations de direction.

  • Contrôle : prolonger une scène jusqu’à 40 secondes cumulées et guider un plan via ses première et dernière images.
  • Coût : créer des brouillons à environ 0,03 $ par seconde en 360p ; réserver les résolutions supérieures aux prises sélectionnées.
  • Qualité : les sorties 1080p et 4K utilisent la mise à l’échelle. Il ne s’agit pas d’une génération à résolution native.
  • Éléments de preuve : les évaluations officielles au niveau de la famille favorisent le montage et le suivi d’instructions, mais pas chaque métrique de mouvement ou de référence.
  • Accès : les identifiants de plateforme diffèrent : l’API Gemini Developer utilise gemini-omni-1.1-flash, tandis que Gemini Enterprise Agent Platform utilise actuellement gemini-omni-1.1-flash-preview. Confirmez la version exacte derrière tout parcours tiers.

Le projet Omni de Google traite la création vidéo comme une conversation multimodale. La question pratique est de savoir dans quelle mesure un créateur peut préserver une prise utile, modifier un détail indésirable et poursuivre la scène sans tout recommencer.

Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés

Qu’est-ce que Gemini Omni 1.1 Flash ?

Gemini Omni 1.1 Flash est le modèle multimodal de génération et d’édition vidéo de Google DeepMind. Google a rendu le modèle disponible en disponibilité générale le 27 août 2026 sous l’identifiant stable gemini-omni-1.1-flash.

Sa fiche modèle décrit la prise en charge native du texte, des images, de l’audio et de la vidéo ainsi qu’une sortie vidéo avec audio. Les opérations API individuelles prennent en charge différentes combinaisons d’entrées, donc la conception multimodale globale du modèle ne doit pas être interprétée comme une promesse que chaque endpoint accepte chaque modalité.

Le modèle peut créer un clip, réviser des images, travailler à partir de références, interpoler entre des images et prolonger une scène. Son flux de travail conversationnel permet à une application de conserver le contexte créatif au fil des itérations. Pour une démonstration produit ou un storyboard, cela signifie que la première génération acceptable peut devenir le point de départ d’un montage plus contrôlé.

Spécifications de Gemini Omni 1.1 Flash

SpécificationGemini Omni 1.1 Flash
DéveloppeurGoogle DeepMind
ID de modèle stablegemini-omni-1.1-flash
Statut de diffusion / dateDisponibilité générale ; 27 août 2026
Fenêtre de contexte1 048 576 tokens
Entrées pour la génération via APITexte, image, vidéo ; support selon l’opération
SortieVidéo avec audio
Durée du clip3–10 secondes par génération
Fréquence d’images24 FPS
Résolutions de sortie360p, 720p, 1080p, 4K
Résolution par défaut720p
1080p / 4KSortie mise à l’échelle
Extension de scèneIncréments de 10 secondes, jusqu’à 40 s cumulées
Contexte vidéo préalable pour l’extensionJusqu’à 10 secondes
Contrôle de la première et de la dernière imagePris en charge
Référence vidéo pour la génération de scèneJusqu’à 3 secondes dans les flux supportés
Flux principalGemini API / Interactions API
Niveau API gratuitNon disponible
Retrait de la préversion30 septembre 2026

La limite de trois secondes pour la référence vidéo et la limite de dix secondes pour le contexte préalable décrivent des opérations différentes. De même, un clip de dix secondes en sortie et une chaîne d’extensions de quarante secondes sont deux unités de travail différentes. Maintenir explicitement ces distinctions rend la planification de l’API et les comparaisons de prix plus utiles.

Quoi de neuf dans Gemini Omni 1.1 Flash ?

Poursuivre une scène plutôt que d’assembler des clips sans lien

La mise à jour examine jusqu’à dix secondes d’images préalables, contre la dernière seconde décrite pour les modèles précédents, et prend en charge des extensions de 10 secondes jusqu’à 40 secondes cumulées. Le contexte supplémentaire peut aider à préserver les personnages, le décor et l’orientation narrative au fil des continuations.

Il ne s’agit pas d’une requête unique de 40 secondes text-to-video. Chaque prolongation ajoute un autre segment à une séquence existante. Examinez les raccords, l’identité des personnages et le mouvement de la caméra après chaque extension avant d’approuver l’ensemble de la scène.

Définir les deux extrémités d’un plan

Les créateurs peuvent fournir à la fois la première et la dernière image et laisser le modèle générer la transition entre elles. C’est utile pour des révélations produit contrôlées, des séquences avant/après, des mouvements de caméra, et des plans qui doivent se connecter avec les images environnantes.

Utiliser le 360p pour des brouillons peu coûteux

Google rapporte jusqu’à 60 % de débit système en plus en 360p qu’en 720p, avec environ un tiers du coût de sortie vidéo. Il s’agit d’une comparaison de débit, pas d’une garantie d’amélioration de latence pour chaque requête.

Une boucle pratique consiste à tester la composition et le mouvement dans des brouillons basse résolution, à réviser le prompt ou les références, puis à approuver une prise avant de payer pour une livraison en plus haute résolution. Incluez les tentatives écartées lorsque vous comparez le coût d’un clip accepté.

Produire du 1080p et du 4K via mise à l’échelle

La version prend en charge une sortie par défaut en 720p et une livraison en résolutions supérieures, avec le 1080p et le 4K générés via mise à l’échelle. Des dimensions de pixels plus élevées n’établissent pas une génération native 4K, ni n’éliminent les erreurs de mouvement et de cohérence.

Utiliser une vidéo existante comme référence

Pour les flux de génération de scène supportés, jusqu’à trois secondes de référence vidéo peuvent apporter un timing, des mouvements et un contexte de personnage qu’une simple image fixe ne peut pas porter. Cette opération de référence est distincte du contexte plus long utilisé lors de l’extension d’un clip existant.

Quitter l’endpoint de préversion

Google a planifié le retrait de l’ancien endpoint de l’API Gemini gemini-omni-flash-preview au 30 septembre 2026 ; cela ne concerne pas l’endpoint de préversion gemini-omni-1.1-flash-preview actuellement exposé par Gemini Enterprise Agent Platform. Les développeurs doivent vérifier la nouvelle configuration de requête et les sorties avant de rediriger le trafic de production.

Que montrent les benchmarks officiels de Gemini Omni Flash ?

Portée du benchmark :

Les graphiques de performance officiels identifient Gemini Omni Flash, sans isoler un point de contrôle 1.1. Considérez-les comme des éléments de preuve au niveau de la famille, et non comme une amélioration mesurée de la préversion vers la version 1.1. Les valeurs Elo sont des évaluations relatives, pas des pourcentages ; les nombres d’échantillons décrivent la taille de l’évaluation.

ÉvaluationOrdre des métriquesÉchantillonsGemini Omni Flash — EloSeedance 2.0 — Elo
Montage vidéoGlobal / instruction5041087 / 1082946 / 960
MovieGenBench text-to-videoGlobal / instruction1 0031113 / 11081070 / 1051
Mouvement rapideQualité du mouvement rapide50010501112
VBench image-to-videoPréférence globale35510571003
Reference-to-videoGlobal / parole / référence4681004 / 1028 / 962996 / 972 / 1038

Dans ces évaluations, les meilleurs résultats de la famille concernent le montage et le suivi d’instructions. Le tableau change pour le mouvement rapide et l’adhérence aux références : Seedance 2.0 est en tête sur ces deux métriques. Un modèle peut donc être plus facile à diriger sans être le meilleur choix pour chaque scène d’action ou tâche fortement contrainte par référence.

Le graphique image-to-video indique 1057 pour Omni, 1054 pour Grok Imagine Video, et 1053 pour Kling v3 Pro. De si petits écarts de points ne doivent pas être traités comme un avantage de qualité décisif. Les graphiques publiés ne fournissent pas d’intervalles de confiance pour évaluer la signification statistique.

Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés

Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés

Graphiques officiels de Google pour le montage vidéo et le mouvement rapide : captures d’écran des graphiques interactifs d’évaluation originaux.

Pour un test de production, notez les sorties que votre équipe accepte réellement : respect du prompt, continuité des personnages, mouvement, audio, et nombre d’éditions correctives. Un leadership au benchmark est une preuve utile, mais le coût d’obtention d’une prise acceptable est la décision de déploiement.

Gemini Omni 1.1 Flash vs Gemini Omni Flash Preview

DimensionGemini Omni 1.1 FlashGemini Omni Flash Preview
Cycle de vieStable / disponibilité généralePréversion ; retrait programmé
ID du modèlegemini-omni-1.1-flashgemini-omni-flash-preview
Direction de productionRemplacement recommandéMigrer vers le modèle stable
Date d’arrêtAucun arrêt annoncé30 septembre 2026
Contexte préalable utilisé pour la continuationJusqu’à 10 secondesDernière seconde, selon la comparaison de lancement
Palier de brouillon 360pDisponibleNon inclus dans la tarification de lancement antérieure
Sortie 1080p / 4KDisponible via mise à l’échelleAbsente de la tarification de lancement antérieure
Interpolation première/dernière imageAjoutée avec 1.1Non établie par la comparaison de préversion citée
Chaîne d’extensionsJusqu’à 40 secondes cumuléesAucune limite cumulative correspondante citée
Gain de benchmark indépendantAucun score isolant la version établiRésultats au niveau famille, non quantifiants la mise à niveau

L’amélioration la plus claire concerne le contrôle et le cycle de vie de production. La version stable expose davantage de moyens de contraindre un plan et remplace un endpoint proche du retrait. Lorsque la documentation de préversion n’aborde pas une capacité, considérez-la comme non confirmée plutôt que de supposer qu’elle n’est pas supportée.

Tarification de Gemini Omni 1.1 Flash

Le modèle stable est disponible via le palier payant de l’API Google. Ses taux par jeton sont de 1,50 $ en entrée et de 17,50 $ par million de jetons pour la sortie vidéo ; la sortie texte est à 9 $ par million de jetons. Il s’agit des tarifs Google, distincts de tout parcours CometAPI.

En 720p, la facturation utilise 5 792 jetons de sortie vidéo par seconde. Multiplier 5 792 par 17,50 $ par million donne 0,10136 $ par seconde, ce qui explique la valeur arrondie à 0,10 $ utilisée dans la comparaison de lancement.

RésolutionGoogle : Omni 1.1 FlashGoogle : Veo 3.1 FastCometAPI : Veo 3.1 Fast
360p0,03 $Non disponibleNon disponible
720p0,10 $0,10 $0,08 $
1080p0,15 $0,12 $0,096 $
4K0,30 $0,30 $0,24 $

USD par seconde générée ; vérifié le 8 septembre 2026. La colonne Omni de Google utilise des estimations de lancement arrondies. Les deux colonnes de droite distinguent la tarification du fournisseur d’origine de la tarification CometAPI pour le même modèle de comparaison nommé.

Qu’est-ce que Gemini Omni 1.1 Flash ? Spécifications, benchmarks, prix et nouveautés

Comparaison de tarification officielle au lancement par Google, reproduite directement. Cette image montre la tarification Google, pas les frais CometAPI.

Estimer le coût d’une prise

RésolutionSortie de 3 secondesSortie de 10 secondes40 secondes de sortie générée
360p~0,09 $~0,30 $~1,20 $
720p~0,30 $~1,00 $~4,00 $
1080p~0,45 $~1,50 $~6,00 $
4K~0,90 $~3,00 $~12,00 $

Estimation des coûts :

Ces calculs multiplient le taux vidéo Google arrondi par la durée générée. Ils excluent les charges d’entrée, la sortie texte, les tentatives rejetées et toute activité facturable séparément. Une chaîne d’extensions de 40 secondes peut entraîner un traitement de contexte supplémentaire ; ce n’est pas un forfait à prix fixe.

Générer des brouillons expérimentaux en 4K coûte environ dix fois plus par seconde de sortie que de brouillonner en 360p selon ces estimations. Évaluez d’abord la composition et le mouvement, puis budgétez la livraison finale. Suivez la dépense totale sur toutes les tentatives divisée par les prises acceptées pour comparer équitablement les flux de travail.

Gemini Omni 1.1 Flash vs Veo 3.1 Fast

DimensionGemini Omni 1.1 FlashVeo 3.1 Fast
Objectif principalCréation et montage conversationnelsGénération vidéo directe rapide
Entrée texte / imagePris en chargePris en charge
Travail conditionné par vidéoRéférences, montages et extensionOpérations supportées selon le parcours
Sortie audioPris en chargePris en charge
Fréquence d’images24 FPS24 FPS
Brouillon en 360pDisponibleAucun palier documenté comparable
720pPris en chargePris en charge
1080p / 4KSortie mise à l’échellePris en charge ; exigence de génération de 8 s
Durée standard du clip3–10 secondes4, 6 ou 8 secondes
ExtensionJusqu’à 40 secondes cumuléesPris en charge en 720p
Première / dernière imageInterpolationContrôles d’interpolation
Accent du flux de travailDirection itérative et contexte créatifContrôles de génération et sortie directe

Google documente 720p, 1080p et 4K à 24 FPS pour le parcours de comparaison. Les résolutions supérieures exigent des générations de huit secondes, tandis que la sortie d’extension est limitée à 720p. Le support des fonctionnalités du point d’accès (gateway) doit être vérifié séparément des spécifications de capacité du fournisseur d’origine.

Aux tarifs publiés par Google, les modèles sont à égalité en 720p et 4K, tandis que l’alternative de génération directe coûte moins cher en 1080p. Les tarifs de CometAPI sont encore plus bas pour ce parcours, comme indiqué dans la section tarification. Le palier 360p supplémentaire d’Omni répond à un autre besoin : l’expérimentation à bas coût avant la livraison.

Choisissez Omni lorsque la direction répétée, la continuité de scène, les contraintes d’images clés et les révisions déterminent la réussite. Choisissez l’alternative lorsque une requête de génération directe et ses contrôles existants satisfont déjà l’exigence de production. Ni une note Elo au niveau de la famille ni la tarification au jeton ne déterminent à elles seules le coût le plus bas par prise acceptée.

Pourquoi Gemini Omni 1.1 Flash est important

Un flux de production se termine rarement après la première génération réussie. Un réalisateur peut aimer le mouvement de caméra mais pas la pose finale. Un marketeur peut vouloir la même composition produit avec une action d’arrière-plan différente. Un storyboarder peut vouloir que le plan suivant commence exactement où se termine le précédent.

Ces tâches exigent que le système préserve un état utile tout en changeant une contrainte spécifique. Les contrôles créatifs d’Omni répondent à ce flux : une référence aide à définir la scène, des images clés contraignent ses extrémités, et une extension la prolonge.

L’opportunité pratique est d’éviter des redémarrages complets. Mesurez la fréquence à laquelle une modification ciblée produit un résultat acceptable, le nombre de révisions nécessaires, et si la séquence finale préserve l’intention initiale. Cette évaluation est plus informative que le choix d’un modèle uniquement à partir d’une vitrine visuelle.

Limitations de Gemini Omni 1.1 Flash

Google identifie des limites persistantes en cohérence, mouvement complexe et rendu de texte. Des chaînes d’extensions plus longues créent davantage d’occasions de dérive d’identité, de géométrie, d’éclairage ou d’objets, même lorsque les clips individuels semblent convaincants.

Une sortie en plus haute résolution ne corrige pas chaque erreur de génération. Inspectez la scène elle-même avant de considérer un fichier 4K comme un asset finalisé. De même, la conception de modèle multimodale large n’établit pas des capacités identiques pour chaque opération API.

La comparaison Elo officielle plaide aussi pour une évaluation spécifique à la tâche. Qualité de montage, mouvement rapide et adhérence aux références mesurent des éléments différents ; un avantage global de préférence ne doit pas être généralisé aux trois.

Gemini Omni 1.1 Flash est-il disponible via CometAPI ?

Gemini Omni Fast API dans CometAPI fournit des parcours de la famille Omni tels que omni-fast et omni-fast-v2v. La documentation publique vérifiée pour cet article n’établit pas que ces identifiants correspondent au point de contrôle stable gemini-omni-1.1-flash de Google.

Vérification de version :

L’accès à la famille Omni et l’accès confirmé à la 1.1 sont des affirmations différentes. Avant de migrer, vérifiez la version exacte du modèle, le support des opérations et la facturation sur le parcours disponible pour votre compte. Un nom de produit similaire n’est pas une preuve suffisante d’un alias.

Pour d’autres flux vidéo Google, Veo 3.1 API dans CometAPI offre une voie d’intégration alternative. Comparez les opérations supportées et les prix spécifiques au fournisseur avant de sélectionner un parcours.

Gemini Omni 1.1 Flash vaut-il la peine d’être utilisé ?

Le modèle est particulièrement convaincant lorsqu’une prise exploitable nécessite plusieurs tours de direction. Des concepts publicitaires, des storyboards, de la visualisation produit et de courtes scènes narratives peuvent bénéficier de brouillons peu coûteux et d’un contrôle plus étroit de la continuité et des extrémités.

L’argument le plus fort est un flux dans lequel ces contrôles réduisent les prises écartées ou les réparations manuelles. Si votre modèle actuel produit déjà le clip voulu de manière fiable, évaluez le contrôle d’édition supplémentaire avant de basculer le trafic de production. Pour une action très dynamique ou une fidélité stricte aux références, testez des alternatives sur ces exigences spécifiques.

FAQ

La 1.1 est-elle identique à la préversion Omni Flash précédente ?

C’est la successeure stable avec des contrôles supplémentaires et un ID de modèle Google différent. L’ancien endpoint de l’API Gemini gemini-omni-flash-preview est programmé pour le retrait ; il est distinct de l’endpoint de préversion gemini-omni-1.1-flash-preview actuellement exposé par Gemini Enterprise Agent Platform.

Peut-elle générer une vidéo de quarante secondes ?

Elle peut construire une séquence jusqu’à quarante secondes via des extensions successives. Cette durée cumulative est différente d’une génération normale unique, qui produit un clip plus court.

Génère-t-elle du 4K natif ?

Non. Les options 1080p et 4K documentées utilisent la mise à l’échelle. Considérez-les comme des résolutions de livraison, pas comme une preuve de génération 4K native.

Combien cela coûte-t-il ?

Les estimations arrondies de sortie vidéo de Google vont de 0,03 $ par seconde en 360p à 0,30 $ en 4K. L’entrée, la sortie texte et les reprises peuvent ajouter des coûts. Utilisez le tableau de tarification libellé selon le fournisseur ci-dessus plutôt que d’appliquer le tarif d’une plateforme à une autre.

Existe-t-il un niveau API gratuit ?

Le modèle stable est disponible sur le palier payant de l’API Gemini. L’accès via un abonnement grand public est un produit et une facturation distincts.

Les scores de benchmark prouvent-ils que la 1.1 dépasse toutes les alternatives ?

Non. Les graphiques affichés identifient la famille Omni Flash, pas un point de contrôle 1.1 distinct. Les résultats diffèrent aussi selon la métrique : la famille performe bien en montage, tandis que d’autres modèles sont en tête sur le mouvement rapide ou l’adhérence aux références.

Conclusion

Gemini Omni 1.1 Flash rend la création vidéo conversationnelle plus pratique via l’extension de scène, les contraintes d’images clés, les références vidéo, des brouillons peu coûteux et une livraison en plus haute résolution. Sa valeur réside dans la possibilité de continuer à diriger une prise prometteuse au lieu de la jeter après chaque décalage.

Utilisez les benchmarks officiels au niveau de la famille comme indices, gardez distinctes les tarifications Google et CometAPI, et vérifiez la version exacte derrière le parcours choisi. La mesure décisive est la fiabilité avec laquelle le flux de travail produit un clip acceptable à un coût total soutenable.

Continuer à apprendre

Reliez cet article à la décision suivante.

Voir tous les sujets
Publié le Oct 6, 2026
Dernière mise à jour Oct 6, 2026
0 vues
Revu pour la clarté, l'attribution des sources et la terminologie API actuelle.

En savoir plus