GPT-6.1 Sol are now live on CometAPI →
ai-model/CometAPIリサーチ

Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能

Gemini Omni 1.1 Flash の仕様、公式ベンチマークデータ、動画コントロール、料金、および他の高速動画生成ワークフローとの比較を詳しく確認する

CometAPI
Deon GoodwinAIモデルとAPIの調査チーム
更新日 Oct 6, 2026 5 分読み
Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能
このパターンを使う

最初のAPI呼び出しを行う。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

要約

Gemini Omni 1.1 Flash は、有償の Gemini Developer API で gemini-omni-1.1-flash として一般提供中。一方、Gemini Enterprise Agent Platform は現在 gemini-omni-1.1-flash-preview というプレビューエンドポイントを提供。シーン、キーフレーム、リファレンス、出力解像度の制御が強化され、複数回のディレクションが必要なクリップに特に有用。

  • 制御: シーンを累計40秒まで延長し、ショットを最初と最後のフレームで誘導可能。
  • コスト: 360p ならドラフトは1秒あたり約$0.03。高解像度は選別したテイクに限定。
  • 品質: 1080p と 4K の出力はアップスケーリング。ネイティブ解像度生成ではない。
  • エビデンス: 公式のファミリー水準評価では編集と指示追従を優位とする一方、すべてのモーションやリファレンス指標ではない。
  • アクセス: プラットフォームIDが異なる。Gemini Developer API は gemini-omni-1.1-flash、Gemini Enterprise Agent Platform は現時点で gemini-omni-1.1-flash-preview。サードパーティ経路では実際のバージョンを必ず確認。

Google の Omni プロジェクトは、動画生成をマルチモーダルな対話として扱う。実務上の焦点は、有用なテイクを保持しつつ不要な細部を変更し、最初からやり直さずにシーンを継続できるかどうか。

Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能

Gemini Omni 1.1 Flash とは?

Gemini Omni 1.1 Flash は、Google DeepMind のマルチモーダル動画生成・編集モデル。Google は 2026年8月27日に安定識別子 gemini-omni-1.1-flash で一般提供を開始。

モデルカードでは、ネイティブなテキスト、画像、音声、動画の入力と音声付き動画の出力を説明。各 API オペレーションが対応する入力組み合わせは異なるため、モデルの広いマルチモーダル設計は「すべてのエンドポイントがすべてのモダリティを受け付ける」という約束ではない。

このモデルはクリップの生成、フッテージの修正、リファレンスの活用、画像間補間、シーンの延長に対応。会話型ワークフローにより、アプリケーションは反復を跨いでクリエイティブなコンテキストを保持できる。プロダクトデモや絵コンテでは、最初に許容可能な生成が、より制御された編集の出発点になり得る。

Gemini Omni 1.1 Flash の仕様

仕様Gemini Omni 1.1 Flash
開発元Google DeepMind
安定モデルIDgemini-omni-1.1-flash
リリース状況 / 日付一般提供; 2026年8月27日
コンテキストウィンドウ1,048,576 トークン
API 生成入力テキスト、画像、動画(対応は操作依存)
出力音声付き動画
クリップ長1回の生成あたり 3–10 秒
フレームレート24 FPS
出力解像度360p, 720p, 1080p, 4K
既定解像度720p
1080p / 4Kアップスケーリング出力
シーン延長10秒刻み、累計最大40秒
延長のための直前動画コンテキスト最大10秒
最初と最後のフレーム制御対応
シーン生成の動画リファレンス対応ワークフローで最大3秒
主なワークフローGemini API / Interactions API
無料 API ティアなし
プレビュー廃止2026年9月30日

3秒の動画リファレンス上限と10秒の直前コンテキスト上限は別の操作を指す。同様に、10秒の出力クリップと40秒の延長チェーンも異なる作業単位。これらの区別を明示することが、API 設計や価格比較を有益にする。

Gemini Omni 1.1 Flash の新機能

無関係なクリップの継ぎ合わせではなくシーンを継続

アップデートにより、以前のモデルで言及された「最後の1秒」と比較して最大10秒の直前フッテージを参照し、10秒単位の延長を累計40秒までサポート。追加のコンテキストは、継続全体でキャラクター、舞台、物語の方向性を維持する助けになる。

これは単一の40秒テキスト→動画リクエストではない。各継続は既存シーケンスに別のセグメントを追加する。各延長の後に結合部、キャラクターの同一性、カメラワークを確認してから、シーン全体を承認すること。

ショットの両端を定義

クリエイターは最初と最後のフレームを供給し、その間の遷移生成をモデルに委ねられる。コントロールされたプロダクトリビール、ビフォーアフター、カメラ移動、周辺フッテージとの接続が必須のショットに有用。

低コストのドラフトに 360p を使用

Google は 720p 比で 360p のシステムスループットが最大60%向上、動画出力コストは約3分の1と報告。これはスループット比較であり、すべてのリクエストにおけるレイテンシ改善の保証ではない。

実務的には、低解像度ドラフトで構図と動きを検証し、プロンプトやリファレンスを修正し、承認後に高解像度で納品するループが有効。採用されなかった試行も含めて、受け入れられたクリップのコスト比較を行う。

1080p と 4K はアップスケーリングで提供

本リリースは既定の 720p 出力と高解像度納品をサポートし、1080p と 4K はアップスケーリングで生成。ピクセル数の増大はネイティブ 4K シーン生成の証明でも、一貫性や動きの誤りの解消でもない。

既存動画をリファレンスとして使用

対応するシーン生成ワークフローでは、最大3秒の動画リファレンスが、静止画1枚では伝えきれないタイミング、動き、キャラクターのコンテキストを持ち込める。このリファレンス操作は、既存クリップ延長時に用いるより長い直前コンテキストとは別。

プレビューエンドポイントから移行

Google は旧 Gemini API エンドポイント gemini-omni-flash-preview を 2026年9月30日に廃止予定としているが、これは現在 Gemini Enterprise Agent Platform で公開中の gemini-omni-1.1-flash-preview とは別物。開発者は本番トラフィックの切替前に、新しいリクエスト設定と出力を検証すべき。

公式ベンチマークが示す Gemini Omni Flash の性能

ベンチマークの範囲:

公式の性能チャートは Gemini Omni Flash を特定するが、1.1 チェックポイントを個別には切り出していない。これはファミリー水準のエビデンスであり、プレビューから 1.1 への実測改善ではない。Elo は割合ではなく相対評価で、サンプル数は評価規模を示す。

評価指標順序サンプルGemini Omni Flash — EloSeedance 2.0 — Elo
動画編集総合 / 指示5041087 / 1082946 / 960
MovieGenBench テキスト→動画総合 / 指示1,0031113 / 11081070 / 1051
高速モーション高速モーションの品質50010501112
VBench 画像→動画総合嗜好35510571003
リファレンス→動画総合 / 音声 / リファレンス4681004 / 1028 / 962996 / 972 / 1038

これらの評価では、ファミリーとして最も強いのは編集と指示追従。高速モーションとリファレンス遵守では様相が変わり、Seedance 2.0 がその2指標で優位。つまり、ディレクションのしやすさはアクション全般やリファレンス重視タスクでの最適性を自動的に意味しない。

画像→動画のチャートでは Omni 1057、Grok Imagine Video 1054、Kling v3 Pro 1053。数ポイントの差を決定的優位とみなすべきではない。公表チャートは統計的有意性評価に必要な信頼区間を提供していない。

Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能

Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能

Google 公式の動画編集および高速モーションのグラフィックス:元のインタラクティブなベンチマークチャートのスクリーンショット。

本番テストでは、自社が実際に採用した出力を採点すべき:プロンプト遵守、キャラクター継続性、動き、音声、必要な修正回数。ベンチマーク首位は有益な根拠だが、受容可能なテイクに到達するコストこそがデプロイ判断である。

Gemini Omni 1.1 Flash と Gemini Omni Flash Preview の比較

次元Gemini Omni 1.1 FlashGemini Omni Flash Preview
ライフサイクル安定版 / 一般提供プレビュー / 廃止予定
モデルIDgemini-omni-1.1-flashgemini-omni-flash-preview
本番指針推奨置き換え安定モデルへ移行
終了日未発表2026年9月30日
継続に用いる直前コンテキスト最大10秒ローンチ比較では最後の1秒
360p ドラフトティアあり初期ローンチの価格表には未掲載
1080p / 4K 出力アップスケーリングで提供初期ローンチの価格表には未掲載
最初/最後フレーム補間1.1 で追加引用のプレビュー比較では未確立
延長チェーン累計最大40秒引用の比較に対応する累計上限はなし
独立したベンチマーク上の向上バージョン単独のスコアは未確立ファミリー水準の結果ではアップグレードを定量化不可

最も明確なアップグレードは制御とプロダクションライフサイクル。安定版はショット制約の方法を増やし、廃止間近のエンドポイントを置き換える。プレビューの文書に能力記載がなければ、非対応と決めつけず「未確認」と扱うべき。

Gemini Omni 1.1 Flash の料金

安定モデルは Google の有償 API ティアで利用可能。トークン単価は入力 $1.50/百万、動画出力 $17.50/百万、テキスト出力 $9/百万。これは Google の料金であり、CometAPI 経由の料金とは別。

720p では、課金は1秒あたり 5,792 の動画出力トークンを用いる。5,792 × $17.50/百万 = $0.10136/秒 となり、ローンチ比較で使われた概算 $0.10/秒 を説明できる。

解像度Google: Omni 1.1 FlashGoogle: Veo 3.1 FastCometAPI: Veo 3.1 Fast
360p$0.03利用不可利用不可
720p$0.10$0.10$0.08
1080p$0.15$0.12$0.096
4K$0.30$0.30$0.24

生成1秒あたりの USD; 2026年9月8日確認。Google の Omni 列はローンチ時の概算。右の2列は、元プロバイダの価格と、同名の比較モデルに対する CometAPI の価格を区別している。

Gemini Omni 1.1 Flash とは?スペック、ベンチマーク、価格、新機能

Google 公式のローンチ価格比較をそのまま再掲。この画像は Google の価格であり、CometAPI の料金ではない。

テイクの費用見積り

解像度3秒の出力10秒の出力生成出力40秒
360p~$0.09~$0.30~$1.20
720p~$0.30~$1.00~$4.00
1080p~$0.45~$1.50~$6.00
4K~$0.90~$3.00~$12.00

費用見積り:

これらは Google の動画出力の概算レートに生成時間を掛けた計算。入力、テキスト出力、破棄された試行、その他の課金対象活動は除外。40秒の延長チェーンは追加のコンテキスト処理を伴い得るため、定額パッケージではない。

4K での試行的ドラフト生成は、これらの概算では 360p の約10倍/秒のコスト。まず構図と動きを評価し、その後に最終納品を予算化する。全試行の総支出を、受け入れテイクの本数で割って、ワークフローを公正に比較する。

Gemini Omni 1.1 Flash と Veo 3.1 Fast の比較

次元Gemini Omni 1.1 FlashVeo 3.1 Fast
主目的会話型の生成と編集高速なダイレクト動画生成
テキスト / 画像入力対応対応
動画条件付きの作業リファレンス、編集、延長サポート内容は経路依存
音声出力対応対応
フレームレート24 FPS24 FPS
360p ドラフティングあり同等のドキュメント化されたティアなし
720p対応対応
1080p / 4Kアップスケーリング出力対応; 8秒生成要件
標準クリップ長3–10 秒4, 6, もしくは 8 秒
延長累計最大40秒720p で対応
最初 / 最後のフレーム補間補間コントロール
ワークフローの重心反復的ディレクションと創作コンテキスト生成コントロールとダイレクト出力

比較対象の経路における Google 文書では、720p, 1080p, 4K の 24 FPS を提示。高解像度は 8 秒生成が必須で、延長出力は 720p に限定。ゲートウェイの機能サポートは、元プロバイダの能力仕様とは切り分けて確認が必要。

Google 公開レートでは 720p と 4K は同額だが、1080p は直接生成の代替の方が安価。CometAPI のレートは同経路でさらに低いことを価格セクションが示す。Omni の追加 360p ティアは別目的に応える:納品前の低コスト実験。

繰り返しのディレクション、シーン継続、キーフレーム制約、リビジョンが成功を左右する場合は Omni を。既存の生成コントロールで要件を満たすなら代替を。ファミリー水準の Elo やトークン価格だけで、受容テイクあたりの低コストを断言することはできない。

Gemini Omni 1.1 Flash が重要な理由

プロダクションのワークフローは、最初の成功生成で終わることは稀。カメラワークは良いが終端のポーズが気に入らない、同じ構図で背景動作だけ変えたい、次のショットを前ショットの終わりから正確に始めたい、などが典型。

これらには、有用な状態を保持しつつ特定の制約を変更する能力が必要。Omni のクリエイティブコントロールはそのワークフローに応える:リファレンスがシーンを定義し、キーフレームが両端を拘束し、延長が先へ進める。

実利は「フルの作り直し」が減ること。ピンポイントの編集で許容結果に達する頻度、必要なリビジョン数、最終シーケンスが初期意図を維持できたかを測定すること。これはビジュアルショーケースだけでモデルを選ぶより有益。

Gemini Omni 1.1 Flash の制限

Google は一貫性、複雑な動き、文字描画に継続的な制限があると認めている。延長チェーンが長くなるほど、たとえ個々のクリップがもっともらしく見えても、アイデンティティ、幾何、ライティング、オブジェクトのドリフトが起こりやすい。

高解像度出力は、生成エラーをすべて修復するものではない。4K ファイルを完成資産と見なす前に、シーン自体を検査すべき。同様に、広いマルチモーダル設計は、あらゆる API 操作で同一能力を保証するものではない。

公式の Elo 比較も、タスク特異的評価の必要性を示唆。編集品質、高速モーション、リファレンス遵守は別物で、総合嗜好の優位をそのまますべてに一般化すべきではない。

CometAPI から Gemini Omni 1.1 Flash は利用可能か?

Gemini Omni Fast API in CometAPI は omni-fast や omni-fast-v2v など Omni ファミリーの経路を提供。この記事の公開ドキュメント確認時点では、これらの識別子が Google の安定版 gemini-omni-1.1-flash チェックポイントにマップされることは確証されていない。

バージョン確認:

Omni ファミリーへのアクセスと、1.1 への確定アクセスは別主張。移行前に、利用可能な経路の正確なモデルバージョン、操作サポート、課金を検証すること。類似の製品名だけではエイリアスの証拠にならない。

他の Google の動画ワークフローでは、Veo 3.1 API in CometAPI が代替の統合経路を提供。サポートされる操作とプロバイダ固有の価格を比較のうえで経路を選定すべき。

Gemini Omni 1.1 Flash は使う価値があるか?

最も魅力的なのは、有用なテイクに複数回のディレクションが必要な場面。広告コンセプト、絵コンテ、製品ビジュアライゼーション、短い物語シーンは、安価なドラフトと継続性・両端制御の強化から恩恵を受ける。

最強の根拠は、これらのコントロールが破棄テイクや手作業修復を減らすワークフローであること。既存モデルで望むクリップが安定して作れるなら、追加の編集コントロールをベンチマークしてから本番トラフィックを切り替えるべき。非常にダイナミックなアクションや厳密なリファレンス忠実度が求められる場合は、その要件に対する代替モデルの検証を。

FAQ

1.1 は以前の Omni Flash プレビューと同じか?

追加のコントロールを備え、Google のモデル ID も異なる安定版の後継。旧 Gemini API エンドポイント gemini-omni-flash-preview は廃止予定で、Gemini Enterprise Agent Platform の gemini-omni-1.1-flash-preview とは別。

40秒の動画を生成できるか?

連続した延長で最大40秒のシーケンスを構築可能。累計時間は通常の単発生成(より短いクリップ)とは異なる。

ネイティブ 4K を生成するか?

いいえ。ドキュメントされた 1080p と 4K はアップスケーリング。納品解像度と捉え、ネイティブ 4K 生成の証拠とはみなさないこと。

料金はいくらか?

Google の概算では、動画出力は 360p で 1秒あたり約 $0.03、4K で約 $0.30。入力、テキスト出力、リトライは追加費用になり得る。プラットフォーム間で料金を混在させず、上記のプロバイダ別の価格表を用いること。

無料 API ティアはあるか?

安定モデルは有償の Gemini API ティアで提供。コンシューマー向けサブスクリプション経由のアクセスは別製品・別課金。

ベンチマークは 1.1 がすべての代替より優れていると証明するか?

いいえ。表示されたチャートは Omni Flash ファミリーであり、1.1 チェックポイントを分離していない。指標ごとに結果も異なる:ファミリーは編集で強い一方、高速モーションやリファレンス遵守では他モデルが先行。

結論

Gemini Omni 1.1 Flash は、シーン延長、キーフレーム制約、動画リファレンス、安価なドラフト、高解像度納品により、会話型の動画制作をより実務的にする。価値は、不一致のたびに破棄するのではなく、有望なテイクにディレクションを重ねられる点にある。

公式のファミリー水準ベンチマークは指針として活用し、Google と CometAPI の価格は分離して把握し、選択した経路の背後にある正確なバージョンを検証すること。決定的な指標は、持続可能な総コストで、どれだけ確実に受容可能なクリップを生み出せるかだ。

学習を続ける

この記事を次の判断につなげる。

すべてのトピックを見る
公開日 Oct 6, 2026
最終更新 Oct 6, 2026
0 回視聴
明確性、出典の帰属、最新のAPI用語について確認済みです。

もっと読む