TL;DR
Gemini Omni 1.1 Flash 可透過付費的 Gemini Developer API 以 gemini-omni-1.1-flash 一般供應;Gemini Enterprise Agent Platform 目前提供預覽端點 gemini-omni-1.1-flash-preview。它新增對場景、關鍵幀、參考素材與輸出解析度的更精細控制,特別適合需要多輪導引的片段。
- Control: 將場景累計延伸至 40 秒,並以首幀與末幀引導鏡頭。
- Cost: 360p 草稿約 $0.03/秒;較高解析度留給選中的鏡次。
- Quality: 1080p 與 4K 透過升頻輸出,非原生解析度生成。
- Evidence: 官方家族層級評測強於剪輯與指令遵循,但非涵蓋所有動作或參考指標。
- Access: 平台 ID 不同:Gemini Developer API 用 gemini-omni-1.1-flash,Gemini Enterprise Agent Platform 目前用 gemini-omni-1.1-flash-preview。透過第三方路由時請確認實際版本。
Google 的 Omni 計畫將影片創作視為多模態對話。實務問題在於:創作者能否保留可用鏡次、修正不想要的細節,並在不重來的情況下延續場景。
What Is Gemini Omni 1.1 Flash?
Gemini Omni 1.1 Flash 是 Google DeepMind 的多模態影片生成與編輯模型。Google 已於 2026 年 8 月 27 日以穩定識別碼 gemini-omni-1.1-flash 提供一般供應。
其模型卡描述了原生文字、影像、音訊與影片輸入,以及附帶音訊的影片輸出。各個 API 操作支援的輸入組合不同,因此該模型的廣泛多模態設計不應被視為「每個端點皆接受所有模態」的保證。
該模型可建立片段、修訂素材、依據參考創作、在影像間插值,以及延伸場景。其對話式流程讓應用可在多次迭代間保留創意脈絡。對於產品示範或分鏡,這代表第一個可接受的生成能成為更可控編輯的起點。
Gemini Omni 1.1 Flash Specifications
| Specification | Gemini Omni 1.1 Flash |
|---|---|
| Developer | Google DeepMind |
| Stable model ID | gemini-omni-1.1-flash |
| Release status / date | Generally available; August 27, 2026 |
| Context window | 1,048,576 tokens |
| API generation inputs | 文字、影像、影片;支援取決於操作 |
| Output | 附帶音訊的影片 |
| Clip length | 每次生成 3–10 秒 |
| Frame rate | 24 FPS |
| Output resolutions | 360p, 720p, 1080p, 4K |
| Default resolution | 720p |
| 1080p / 4K | 升頻輸出 |
| Scene extension | 以 10 秒為增量,累計最長 40 秒 |
| Prior-video context for extension | 最長 10 秒 |
| First-and-last-frame control | 支援 |
| Video reference for scene generation | 在支援流程中最長 3 秒 |
| Main workflow | Gemini API / Interactions API |
| Free API tier | 不提供 |
| Preview retirement | September 30, 2026 |
三秒的影片參考上限與十秒的先前脈絡上限屬於不同操作。同樣地,十秒輸出片段與四十秒延伸鏈也是不同的工作單元。將這些差異明確區分有助於 API 規劃與價格比較。
What Is New in Gemini Omni 1.1 Flash?
延續場景,而非拼接不相關片段
此次更新可檢視最長十秒的先前素材,相較於前代模型描述的最後一秒,並支援每次 10 秒延伸、累計至 40 秒。更多脈絡有助於在連續段落中維持角色、場景與敘事方向。
這不是一次性的四十秒「文字轉影片」請求。每次延續會為既有序列新增一段。請在每次延伸後檢視銜接處、角色識別與鏡頭運動,再決定是否核准整段場景。
同時定義鏡頭的起點與終點
創作者可同時提供首幀與末幀,讓模型生成其間過渡。這對於受控的產品揭示、前後對照、鏡頭移動,以及必須與周邊素材銜接的鏡頭特別實用。
使用 360p 製作低成本草稿
Google 報告在 360p 的系統吞吐量較 720p 提升可達 60%,影片輸出成本約為後者的三分之一。這是吞吐量比較,並非保證每個請求的延遲都改善。
實務迴圈是先以低解析度草稿測試構圖與運動,調整提示或參考後,再核可鏡次,最後再支付較高解析度的交付費用。比較接受鏡次的成本時,請納入被丟棄的嘗試。
透過升頻提供 1080p 與 4K
本版本支援預設 720p 輸出與更高解析度交付,其中1080p 與 4K 透過升頻生成。更高像素維度並不代表原生 4K 場景生成,也無法移除所有動態與一致性誤差。
以既有影片作為參考素材
對於支援的場景生成流程,最長三秒的影片參考可攜帶單張靜態影像難以表達的時間節奏、動作與角色脈絡。此參考操作不同於延伸既有片段時使用的較長脈絡。
從預覽端點遷移
Google 已排程在 2026 年 9 月 30 日淘汰舊版 Gemini API 端點 gemini-omni-flash-preview;這不包括目前由 Gemini Enterprise Agent Platform 提供的 gemini-omni-1.1-flash-preview。開發者應在導入生產流量前,驗證新的請求設定與輸出。
What Do the Official Gemini Omni Flash Benchmarks Show?
Benchmark scope:
官方表格標示的是 Gemini Omni Flash,未隔離 1.1 檢查點。請將其視為家族層級證據,而非從預覽版到 1.1 的量測改進。Elo 是相對評分,非百分比;樣本數描述評估規模。
| Evaluation | Metric order | Samples | Gemini Omni Flash — Elo | Seedance 2.0 — Elo |
|---|---|---|---|---|
| Video editing | Overall / instruction | 504 | 1087 / 1082 | 946 / 960 |
| MovieGenBench text-to-video | Overall / instruction | 1,003 | 1113 / 1108 | 1070 / 1051 |
| Fast motion | Fast-motion quality | 500 | 1050 | 1112 |
| VBench image-to-video | Overall preference | 355 | 1057 | 1003 |
| Reference-to-video | Overall / speech / reference | 468 | 1004 / 1028 / 962 | 996 / 972 / 1038 |
在這些評估中,該家族最強項在剪輯與指令遵循。快速運動與參考遵循的情況不同:Seedance 2.0 在這兩項指標領先。因此,一個模型可能較易導引,卻不一定是每個動作場景或高度參考任務的最佳選擇。
影像轉影片圖表報告 Omni 為 1057、Grok Imagine Video 為 1054、Kling v3 Pro 為 1053。如此微小分差不應被視為決定性品質優勢。已發布圖表未提供置信區間,無法評估統計顯著性。


Google 官方的影片剪輯與快速運動圖表:原始互動式評測圖表之截圖。
在生產測試中,請以團隊實際接受的輸出評分:提示遵循、角色連貫、動作、音訊,以及所需修正次數。基準領先是有用證據,但達到可接受鏡次的總成本才是部署決策。
Gemini Omni 1.1 Flash vs Gemini Omni Flash Preview
| Dimension | Gemini Omni 1.1 Flash | Gemini Omni Flash Preview |
|---|---|---|
| Lifecycle | 穩定版/一般供應 | 預覽;已排程下線 |
| Model ID | gemini-omni-1.1-flash | gemini-omni-flash-preview |
| Production direction | 建議替換 | 遷移至穩定模型 |
| Shutdown date | 未公告下線 | September 30, 2026 |
| Prior context used for continuation | 最長 10 秒 | 依發表比較為最後 1 秒 |
| 360p draft tier | 提供 | 早期定價未包含 |
| 1080p / 4K output | 升頻交付 | 早期定價未包含 |
| First-and-last-frame interpolation | 1.1 新增 | 引用的預覽比較未建立 |
| Extension chain | 累計最長 40 秒 | 引用比較中無對應累計上限 |
| Independent benchmark gain | 無版本隔離分數 | 家族層級結果無法量化升級 |
最明顯的升級是控制能力與生產生命週期。穩定版提供更多限制鏡頭的方式,並取代即將下線的端點。當預覽文件未提及某功能時,請視為未確認,而非假設不支援。
Gemini Omni 1.1 Flash Pricing
穩定模型可透過 Google 的付費 API 層存取。其權重費率為:輸入 $1.50/百萬 tokens、影片輸出 $17.50/百萬 tokens;文字輸出為 $9/百萬 tokens。這些為 Google 費率,與任何 CometAPI 路由分開計價。
在 720p,計費採用每秒 5,792 個影片輸出 tokens。將 5,792 乘以每百萬 $17.50 得 $0.10136/秒,解釋了發佈比較中取整的 $0.10 數字。
| Resolution | Google: Omni 1.1 Flash | Google: Veo 3.1 Fast | CometAPI: Veo 3.1 Fast |
|---|---|---|---|
| 360p | $0.03 | Not available | Not available |
| 720p | $0.10 | $0.10 | $0.08 |
| 1080p | $0.15 | $0.12 | $0.096 |
| 4K | $0.30 | $0.30 | $0.24 |
每生成秒的美元計價;查核日期 2026 年 9 月 8 日。Google 的 Omni 欄為取整的發佈估算。右側兩欄區分原提供者的價格與 CometAPI 對同名比較模型的定價。

Google 官方發佈的定價比較圖,直接重製。此圖顯示的是 Google 定價,非 CometAPI 收費。
估算一次鏡次的成本
| Resolution | 3-second output | 10-second output | 40 seconds of generated output |
|---|---|---|---|
| 360p | ~$0.09 | ~$0.30 | ~$1.20 |
| 720p | ~$0.30 | ~$1.00 | ~$4.00 |
| 1080p | ~$0.45 | ~$1.50 | ~$6.00 |
| 4K | ~$0.90 | ~$3.00 | ~$12.00 |
Cost estimate:
上述計算以 Google 取整的影片輸出費率乘以生成時長。未包含輸入費、文字輸出、被丟棄的嘗試,以及任何另外計費的活動。四十秒延伸鏈可能產生額外的脈絡處理成本;這不是固定價格方案。
依此估算,在 4K 生成實驗性草稿的每秒成本約為 360p 的十倍。先評估構圖與運動,再編列最終交付預算。統計所有嘗試的總支出除以被接受鏡次,才能公平地比較不同流程。
Gemini Omni 1.1 Flash vs Veo 3.1 Fast
| Dimension | Gemini Omni 1.1 Flash | Veo 3.1 Fast |
|---|---|---|
| Main purpose | 對話式創作與編輯 | 快速直接影片生成 |
| Text / image input | 支援 | 支援 |
| Video-conditioned work | 參考、剪輯與延伸 | 支援情況依路由而定 |
| Audio output | 支援 | 支援 |
| Frame rate | 24 FPS | 24 FPS |
| 360p drafting | 提供 | 無可比擬的文件化等級 |
| 720p | 支援 | 支援 |
| 1080p / 4K | 升頻輸出 | 支援;需 8 秒生成 |
| Standard clip duration | 3–10 秒 | 4、6 或 8 秒 |
| Extension | 累計最長 40 秒 | 在 720p 支援 |
| First / last frame | 插值控制 | 插值控制 |
| Workflow emphasis | 迭代導引與創意脈絡 | 生成控制與直接輸出 |
Google 文件標示720p、1080p 與 4K(24 FPS) 的比較路由。較高解析度需要 8 秒生成,而延伸輸出僅限 720p。閘道的功能支援需與原提供者能力規格分別核對。
依 Google 公布費率,兩模型在 720p 與 4K 打平,而在 1080p 下,直接生成替代方案更便宜。CometAPI 對該路由的定價更低,如定價段落所示。Omni 的額外 360p 等級對應不同需求:在交付前以低成本試驗。
當成功取決於多次導引、場景連續性、關鍵幀約束與修訂時,選擇 Omni;當既有的直接生成請求與控制已滿足需求,選擇替代方案。無論家族層級 Elo 還是 token 定價,都無法單獨決定「每個被接受鏡次」的更低成本。
Why Gemini Omni 1.1 Flash Matters
生產流程很少在第一次成功生成後就結束。導演可能喜歡鏡頭移動,但不喜歡結尾姿勢。行銷可能需要相同產品構圖,但換不同背景動作。分鏡畫師可能需要下一鏡頭從前一鏡頭的結尾精準接上。
這些任務要求系統在保留可用狀態的同時,只改變特定約束。Omni 的創作控制正是對應此流程:參考定義場景、關鍵幀限制端點、延伸將其推進。
實務上的機會是減少完全重來的次數。衡量有針對性的編輯產生可接受結果的頻率、需要多少次修訂,以及最終序列是否保留原意。這種評估比僅從視覺展示選模型更具資訊量。
Limitations of Gemini Omni 1.1 Flash
Google 指出在一致性、複雜運動與文字渲染方面仍有局限。較長的延伸鏈即便單段看似可信,也更容易出現身份、幾何、光照或物件的漂移。
較高解析度輸出無法修補所有生成錯誤。在將 4K 檔視為完成素材前,請先檢視場景本身。同樣地,廣泛的多模態設計不代表每個 API 操作能力一致。
官方 Elo 比較也支持任務特定的評估。剪輯品質、快速運動與參考遵循衡量的是不同面向;整體偏好領先不應泛化至所有三者。
Is Gemini Omni 1.1 Flash Available Through CometAPI?
Gemini Omni Fast API in CometAPI 提供 Omni 家族路由,如 omni-fast 與 omni-fast-v2v。本文查核的公開文件未能證實這些識別符對應到 Google 的穩定 gemini-omni-1.1-flash 檢查點。
Version check:
Omni 家族存取與確認 1.1 存取是不同主張。遷移前,請在你帳戶可用的路由上驗證模型版本、操作支援與計費。類似的產品名稱不足以證成別名關係。
對於其他 Google 影片工作流程,Veo 3.1 API in CometAPI 提供替代整合路徑。選擇路由前,請比較支援的操作與各提供者的價格。
Is Gemini Omni 1.1 Flash Worth Using?
當可用鏡次需要多輪導引時,此模型最具吸引力。廣告概念、分鏡、產品可視化與短篇敘事場景可受益於低成本草稿,以及對連續性與端點更嚴謹的控制。
最佳情境是這些控制能減少被丟棄的鏡次或人工修補。如果現用模型已能穩定產生理想片段,請先基準比較新增的編輯控制,再切換生產流量。對於高度動態的動作或嚴格的參考遵循,請在這些具體需求上測試替代方案。
FAQ
1.1 是否等同於較早的 Omni Flash 預覽版?
它是穩定的後繼版本,具備更多控制,且使用不同的 Google 模型 ID。舊的 Gemini API 端點 gemini-omni-flash-preview 已排程下線;與目前由 Gemini Enterprise Agent Platform 暴露的預覽端點 gemini-omni-1.1-flash-preview 不同。
能生成四十秒的影片嗎?
可透過連續延伸建立最長四十秒的序列。此累計時長不同於一般單次生成,其輸出較短。
是否原生 4K 生成?
否。文件所述的 1080p 與 4K 透過升頻。請將它們視為交付解析度,而非原生 4K 生成的證據。
費用是多少?
Google 取整的影片輸出估計為:360p 每秒 $0.03 至 4K 每秒 $0.30。輸入、文字輸出與重試會增加成本。請使用文中帶有提供者標示的價目,而非將一個平台的費率套用到另一個平台。
是否有免費 API 等級?
穩定模型可在付費的 Gemini API 等級存取。透過消費者訂閱的存取是不同產品與計費安排。
基準分數是否證明 1.1 超越所有替代方案?
否。展示圖表標示的是 Omni Flash 家族,而非獨立的 1.1 檢查點。結果亦依指標而異:該家族在剪輯表現較佳,但其他模型在快速運動或參考遵循上領先。
Conclusion
Gemini Omni 1.1 Flash 透過場景延伸、關鍵幀約束、影片參考、低成本草稿與更高解析度交付,讓對話式影片創作更實用。其價值在於:當生成與預期不符時,能持續導引一個有前景的鏡次,而非每次都重頭來過。
請將官方家族層級基準作為方向性證據,分開看待 Google 與 CometAPI 的定價,並確認所選路由背後的精確版本。決策關鍵在於:工作流程能否以可承受的總成本,穩定產出可接受的片段。
