Grok Build 0.1 and Grok 4.7 are now live on CometAPI →
new/CometAPI 研究

Seedance 3 即將推出: 你可以期待什麼

Seedance 3 尚未正式發布。探索其預期功能、基準測試訊號、發布狀態,以及它可能如何與當今領先的 AI 影片模型比較。

CometAPI
Mia MarenAI 模型與 API 研究團隊
更新於 Sep 3, 2026 4 分鐘閱讀
Seedance 3 即將推出: 你可以期待什麼
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

先回答。 Seedance 3 尚未正式宣布。ByteDance Seed 的公開模型目錄目前標示 Seedance 2.5 為最新發佈的 Seedance 影片模型。因此,下一個主要世代最適合以路線圖型的預期來討論:在延展 30 秒敘事、多模態參考控制、同步音訊與精確剪輯的同時,解決複雜物理與多主體一致性等仍存弱點的模型。

什麼是 Seedance 3?

Seedance 是 ByteDance Seed 的生成式影片模型家族。官方模型目錄 目前沒有列出 Seedance 3 的產品、模型卡、API 識別符、價格或發佈時程。這個缺席很重要:該名稱是未來主要世代的合理標籤,但尚未成為確認的商業模型。

因此本文將證據分為三個層級。已確認事實描述已發佈的 Seedance 模型與已公開的競品能力。預期功能則根據 ByteDance 可見的開發軌跡而推論。未知領域維持以 TBD 標記,而非以傳聞數字填補。這樣的區分能在正式發佈前保持文章的實用性,並在官方公告出爐時便於更新。

為何下一代 Seedance 模型是合理的

Seedance 1.0 建立了原生多鏡頭的文字轉影片與圖像轉影片生成,解析度達 1080p。Seedance 1.5 Pro 新增原生音訊生成與面向電影的敘事能力。Seedance 2.0 轉向統一的影音架構,可同時解讀文字、圖像、影片片段與音訊參考。Seedance 2.5 隨後將公開的單次生成時長加倍,並擴充參考容量。

此模式一致:每次發佈都擴大創作的單位。該系列由視覺一致的片段,進展到影音片段,再到多模態導演系統,接著是更長且更可編輯的創作流程。未來的 Seedance 3 若要最有意義,應改善該流程的可靠性,而非僅增加另一個醒目的數字。

Seedance 路線圖如何演進

世代輸入公布時長音訊關鍵進展
Seedance 1.0文字與圖像10s 多鏡頭無原生音訊1080p 生成;快速推論基線
Seedance 1.5 Pro文字與圖像短時長原生音訊面向電影的影音敘事
Seedance 2.0文字、圖像、影片、音訊15s原生音訊統一參考、延續與剪輯
Seedance 2.5文字、圖像、影片、音訊30s原生音訊50 個參考與時間戳級剪輯
Seedance 3TBDTBD預期尚未正式宣布

來源: ByteDance Seed 1.0 technical overview Seedance 2.0 launch materials Seedance 2.5 launch materials。Seedance 3 欄位尚未披露。

Seedance 3 即將推出: 你可以期待什麼

來源:* ByteDance Seed 1.0、Seedance 2.0 與 Seedance 2.5 官方資料。Seedance 3 仍為 TBD。

預期的 Seedance 3 規格

在官方公告前,討論規格最安全的方式是以已發佈的 Seedance 2.5 功能集作為基線。下表並非宣稱 Seedance 3 已支援這些數值;而是指出下一代預期會保留或改進之處。

規格Seedance 2.5 基線Seedance 3 預期可信度
官方狀態已發佈尚未正式宣布已確認
架構統一的影音聯合生成更強大的統一多模態生成
輸入模態文字、圖像、影片、音訊可能維持相同四種模態,並具更深的聯合推理
單次生成時長最長 30 秒至少維持 30 秒基線;更長輸出未確認
參考容量30 張圖像 + 10 段影片 + 10 段音訊至少維持 50 個素材,或以更智慧的方式管理
音訊輸出原生同步音訊改進對話、聲紋與空間聲效
剪輯時間戳、鏡頭、綠幕與參考導向剪輯更局部、更可靠且更具對話性的剪輯
解析度與影格率官方發佈文章未明確TBD未知
API 模型 IDCometAPI 上的 seedance-2-5TBD已確認
價格與地區依通路提供TBD未知

來源:確認基線來自 官方 Seedance 2.5 產品頁。上述預期為分析,非已公告之規格。

發佈規則。除非 ByteDance 公開這些細節,否則不要宣稱 Seedance 3 支援 4K、60 秒原生生成、特定影格率或特定價格。所有未披露欄位使用 TBD。

Seedance 3 可能引入哪些功能?

更長且保持一致的故事

Seedance 2.5 可在一次生成中產生30 秒的影音片段,並可多輪延展。下一個挑戰不只在於時長。長影片只有在角色身份、造型、空間佈局、光線、聲音與敘事因果能在剪接與延展中保持穩定時才真正有用。

因此,Seedance 3 可能專注於持久的場景狀態:記住哪個角色拿了物件、門在何處、服裝如何變化,以及早先事件應如何影響後續鏡頭。這將減少創作者在生成視覺驚豔但內部不一致序列後的修正工作。

更強的物理與複雜互動

人與物的接觸、碰撞、布料、液體、人群,以及快速運鏡仍是生成式影片系統的難題。ByteDance 自身的 Seedance 2.5 摘要也指出,複雜動作的物理與多主體互動穩定性仍有進步空間。一次有意義的世代提升,應讓這類場景更可靠,而非僅更細緻。

實際的衡量是可用率。一支運動片段的成功不在於某一幀看起來真實;而在於整個鏡頭中的雙手、器材、動量、接觸、聲音與運鏡始終可信。Seedance 3 應以完整序列與重複生成來評估,而非擷取展示的單幀。

穩定持續的角色、產品與聲音

參考控制正成為 AI 影片的製作介面。創作者需要同一位演員、產品、道具、場景與聲音在多個場景中保持可辨識。Seedance 2.5 已接受最多 30 張圖像、10 段影片與 10 段音訊,但下一步不一定是更高的上傳上限。更好的參考選擇、衝突解決、身份權重,以及可重用的角色資產,可能比單純增加容量更有價值。

對廣告而言,這代表包裝、Logo、色彩系統與代言人能在運鏡變化中不易漂移。對敘事製作而言,這代表常駐角色的外觀與聲音可保持一致,而不必為每段片子重建參考集。

更精確、局部化的影片剪輯

生成只是製作流程的前半。剪輯者需要只改一個物件、表情、台詞、運鏡或時間區段,並保持已核可內容不變。Seedance 2.5 支援基於時間戳的剪輯、鏡頭視角改動、綠幕流程與參考導向的修訂。Seedance 3 可讓這些操作更局部且更具決定性。

  • 區域級變更,保留請求區域外的像素與運動
  • 僅音訊或僅運動的修訂,無需重生整段序列
  • 對話式剪輯歷史,便於多輪逐步精修
  • 版本穩定的參考,讓已核准的角色或產品身份在多次編修中維持一致

專業級鏡頭與場景掌控

Seedance 2.5 可用時間戳指令與 clay-render 參考來控制調度、運鏡、場景幾何、光向與節奏。未來模型可進一步緊密連結前視覺化與最終渲染。分鏡板、粗略 3D 佈局、分鏡清單、運動軌跡與音訊提示,都可成為單一導演提案的一部分。

這正是 Seedance 可與偏向「漂亮短片」的模型區隔之處。製作團隊看重可重複性:能夠要求特定鏡頭感、鏡頭時長、演員站位、燈光配置或產品角度,並獲得可在不重來的前提下進一步修訂的結果。

基準表現:哪些已確認、哪些尚未知?

沒有 Seedance 3 成績。沒有任何官方的 Seedance 3 基準結果。在官方評估出台前,任何替該模型標示 Elo、勝率、生成速度或品質分數的圖表都應視為未經證實。

Seedance 2.5 效能基線

ByteDance 尚未發佈標準化的 Seedance 2.5 榜單分數或第三方基準協議。其官方發佈資料 改以面向製作的能力與精選示例來定義表現。因此,Seedance 2.5 是相關且已確認的基線,但也避免將質感展示誤認為獨立的跨模型分數。

已公開的基線包括一次生成最長 30 秒、最多兩輪延展,以及最多 50 個參考素材:30 張圖像、10 段影片、10 段音訊。ByteDance 亦報告更順暢的轉場、跨剪穩定的主體、音訊與影像同步,以及時間戳級剪輯。這些陳述描述模型期望的製作表現;但未披露測試提示集、評審協議、勝率、延遲分佈或每個被接受秒數的成本。

Seedance 3 即將推出: 你可以期待什麼

Seedance 2.5 公布的參考素材上限。來源: ByteDance Seed 發佈說明。這是產品容量指標,非標準化品質分數。

Seedance 2.5 基線顯示了什麼

Seedance 2.5 最清楚且可量化的強項是工作流尺度。30 秒的原生片段、多輪延展與 50 參考輸入,能減少為參考繁重的段落所需的獨立生成次數。其剪輯工具也瞄準製作成本常攀升的點:在不重建整個概念的情況下,修訂某段時間、某次運鏡、某個主體或背景。

剩餘的表現問題多是可靠性問題。獨立測試應測量首通過可用率、整段 30 秒中的身份與聲音一致性、複雜動作錯誤率、對話情境下的影音同步,以及在針對性編修後有多少已核准內容被改動。這些結果將比單一視覺偏好分更有決策價值。

基準 (Seedance 3.0) 在發佈時重要的指標

可信的 Seedance 3 評估,應不僅報告整體偏好分。最有用的發佈分析,會以公開的提示、多個隨機種子與完整未裁剪輸出,測試以下面向:

  • 長篇身份一致性:臉部、身形、服裝、產品、道具與聲音在剪接與延展中的穩定
  • 複雜動作物理:人與物接觸、動量、碰撞、布料、液體、人群與運動場景
  • 指令遵循:帶時間碼的動作、鏡頭順序、運鏡、台詞與負向約束
  • 影音同步:對白、口型、音效、環境、音樂與事件時序
  • 編修保留:當只修一個區域、時間段或聲音時,已有核准內容的變動幅度
  • 製作效率:到可用結果的時間、重試率、延遲、每個被接受秒數的成本與失敗率

是否該等待 Seedance 3?

等待不必然更安全,因為 Seedance 3 並無確認的發佈日期、規格、價格或 API 識別符。實務上的決策是 Seedance 2.5 是否已滿足你需交付工作的驗收標準。

若該等待……

你的當前瓶頸是已知能力缺口。若專案依賴可靠的複雜物理、密集多主體互動、強局部性的編修,或可持久重用的角色資產,現有模型可能仍需過多重試與人工修正。

專案沒有固定交付期限。當延期成本不高,且團隊能承受未知的發佈時程、可用地區、佇列行為與價格時,等待是合理的。

遷移成本昂貴。若提示、參考打包、審核標準或合規核准都需圍繞新模型重建,或許先評估官方的 Seedance 3 介面再承諾導入更好。

若該現在就用 Seedance 2.5。

你需要可運作的製作基線。Seedance 2.5 已提供 30 秒生成、延展、原生同步音訊、大型多模態參考集與基於時間戳的剪輯。這些能力足以對照真實需求進行測試。

迭代比理論峰值更重要。使用當前模型可讓團隊學會哪些提示、參考、運鏡指令、審核關卡與備援編修,真正決定可用輸出。

你想先有證據再切換。Seedance 2.5 的基線可以提供首通過接受率、重試、延遲、每個被接受秒數的成本、身份漂移與編修保留等可比較數據。Seedance 3 一旦成真,即可用同一測集評估。

Seedance 3 vs Seedance 2.5 vs Vidu Q3、Kling 3.0 vs Veo 3.1

由於 Seedance 3 沒有公開規格,下表將其欄視為「門檻」而非成績單。它顯示下一代需要在現有系統之上至少達到或超越的水準。

模型狀態原生時長音訊控制與剪輯當前定位
Seedance 3未宣布TBD預期原生音訊預期更深入的多模態控制必須提升長篇可靠性
Seedance 2.5可用最長 30s原生同步音訊50 個參考;時間戳與鏡頭剪輯長篇、參考繁重的敘事
Vidu Q3可用1-16s原生影音輸出文字、圖像、首/尾幀與參考模式彈性時長與快速迭代
Kling 3.0可用3-15s原生影音輸出分鏡控制;圖像、影片與元素參考多鏡頭控制與可重用元素
Veo 3.1可用依模式而定原生音訊延展、逐幀生成與圖像引導影院級輸出與 Google 工作流

模型頁面: Seedance 2.5 | Vidu Q3 | Kling 3.0 | Veo 3.1

對比顯示了什麼

Seedance 2.5 目前在公開的原生片長與最大參考數方面擁有最明確優勢。其 30 秒工作流圍繞完整敘事單元設計,而非孤立的短鏡頭。

Vidu Q3 提供 1 至 16 秒的彈性生成,根據官方 API 文件可達 1080p,並有偏重輸出品質或速度的變體。當快速迭代、首/尾幀控制或參考轉影片工作流比最長原生時長更重要時,它很有吸引力。

Kling 3.0 支援最長 15 秒、原生影音輸出、自定多鏡頭分鏡,以及由圖像或影片參考建立的角色元素。其競爭力在於明確的鏡頭級導向與可重用的身份資產。

Veo 3.1 強調原生音訊、影片延展、逐幀生成,以及基於圖像的導向。它仍是影院級渲染與整合進 Google 生成媒體堆疊的強力基準。

若要稱得上真正的世代變革,Seedance 3 應不只是贏得特定的視覺偏好測試。它應能在首次嘗試中,將更多提示轉化為可用、可編修的序列,尤其在多角色場景、複雜運動與長篇延續上。

Seedance 3 何時發佈?

目前沒有官方的 Seedance 3 發佈日期。ByteDance 尚未以該名稱發佈專案頁、模型卡、API 識別符、價格表、可用地區或推出序列。不可僅依先前版本之間的間隔推斷發佈窗口。

最可靠的確認點包括 ByteDance Seed 模型目錄、ByteDance Seed 發佈文章、火山引擎或 BytePlus 的 API 文件,以及上線的產品或模型頁。在其中一個來源標示 Seedance 3 之前,發佈日期的聲稱應視為傳聞或直接略去。

等待期間如何存取 Seedance 模型

開發者不必等待未確認的模型即可測試現有工作流。Seedance 2.5 可透過 CometAPI 以非同步影片生成模式使用。應用會提交任務、保存返回的識別符、輪詢完成狀態,並取回生成的影片。相同的整合層也可讓你更容易比較多個影片模型,而無需為每個供應商重建驗證與任務處理。

Bash (cURL)

curl --request POST 'https://api.cometapi.com/v1/videos' \  --header 'Authorization: Bearer YOUR_COMETAPI_KEY' \  --form-string 'model=seedance-2-5' \  --form-string 'prompt=一個電影感的跟拍鏡頭:黃昏時,一條紙龍飛越燈籠點綴的河面上空。' \  --form-string 'seconds=5'

此範例使用已發佈的模型 ID seedance-2-5。在 CometAPI 公開真正的模型頁與支援的識別符之前,不得改為 seedance-3。上游端點行為與請求參數應以當前 API 文件為準,並在投入生產前再次確認。

如需完整參數、任務狀態處理與製作指南,請參考 CometAPI API documentation

我們仍未知的事項

  • Seedance 3 是否會是正式產品名稱
  • 發佈日期與推出序列
  • 最大原生時長、輸出解析度、影格率與長寬比限制
  • 最大參考數,以及參考是否可成為可重用資產
  • 架構細節、參數規模、訓練數據揭露與推論硬體
  • 官方基準分數與其背後的評估協議
  • API 模型 ID、價格、可用地區、速率限制與商業條款
  • 上線時將附帶的來源追溯、浮水印、身份保護與版權控制機制

最後的想法

Seedance 3 仍未確認,但 Seedance 系列的方向愈發清晰。此系列已從原生多鏡頭的視覺生成,進展到同步音訊、統一多模態參考控制、30 秒敘事與針對性剪輯。下一個主要步驟應是讓該工作流更可靠,而非僅在選擇性展示中更為炫目。

最重要的證據將是可重複的表現:在長序列中保持一致的角色與聲音、可信的物理互動、對帶時間碼指令的精準回應,以及能保留已核准內容的編修。這些特質決定了模型能否從概念生成走入日常製作。

在等待 Seedance 3 的官方資訊期間,開發者可以評估現有的 Seedance 2.5 API,並透過 CometAPI 比較其他影片模型。本文應僅在 ByteDance 或上線的 API 來源確認模型名稱、規格、基準與存取細節後再行更新。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Aug 31, 2026
最後更新 Sep 3, 2026
90 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多