先に回答。 Seedance 3 は正式には発表されていません。ByteDance Seed の公開モデルディレクトリでは、現在公開されている最新の Seedance ビデオモデルとして Seedance 2.5 が示されています。したがって、次のメジャー世代についてはロードマップに基づく期待として議論するのが適切です。すなわち、30 秒の物語生成、マルチモーダル参照制御、同期音声、精密編集を拡張しつつ、複雑な物理挙動や複数被写体の一貫性といった残る弱点への対処を目指すモデルです。
Seedance 3 とは?
Seedance は ByteDance Seed が提供する生成ビデオモデルのファミリーです。公式モデルディレクトリには、現時点で Seedance 3 の製品、モデルカード、API 識別子、価格、リリース予定は掲載されていません。この不在は重要です。名前としては将来のメジャー世代に合理的なラベルですが、まだ確認された商用モデルではありません。
本記事では、証拠レベルを 3 つに分けています。Confirmed facts(確認済みの事実)は、公開済みの Seedance モデルと公表された競合モデルの能力を指します。Expected features(期待される機能)は、ByteDance の可視化された開発軌跡から推論したものです。Unknown fields(不明な項目)は、噂の数値で埋めずに TBD と明記します。この区別により、正式発表前でも記事の有用性を保ち、公式アナウンスが出た時に容易に更新できるようにします。
次世代 Seedance モデルが妥当といえる理由
Seedance 1.0 は 1080p でのネイティブなマルチショットのテキスト→ビデオおよび画像→ビデオ生成を確立しました。Seedance 1.5 Pro はネイティブ音声生成と映画志向のストーリーテリングを追加しました。Seedance 2.0 はテキスト、画像、ビデオ、音声の参照を統合して解釈できる統一音声・映像アーキテクチャへ移行しました。Seedance 2.5 は公開された単回生成の長さを倍増し、参照容量を拡張しました。
一貫したパターンがあります。各リリースは創作の単位を拡張してきました。シリーズは、視覚的にまとまったクリップから、音声付きクリップ、マルチモーダルな演出系、そしてより長く編集しやすい制作ワークフローへと進化しています。将来の Seedance 3 が最も意義を持つのは、単なる目立つ数値の追加ではなく、そのワークフローの信頼性を改善できた場合です。
Seedance のロードマップはどう進化してきたか
| 世代 | 入力 | 公開された長さ | 音声 | 定義的な進展 |
|---|---|---|---|---|
| Seedance 1.0 | テキストと画像 | 10s マルチショット | ネイティブ音声なし | 1080p 生成;高速推論の基盤 |
| Seedance 1.5 Pro | テキストと画像 | ショートフォーム | ネイティブ音声 | 映画品質の音声・映像ストーリーテリング |
| Seedance 2.0 | テキスト、画像、ビデオ、音声 | 15s | ネイティブ音声 | 参照の統合、継続生成と編集 |
| Seedance 2.5 | テキスト、画像、ビデオ、音声 | 30s | ネイティブ音声 | 50 参照とタイムスタンプレベルの編集 |
| Seedance 3 | TBD | TBD | 期待 | 公式には未発表 |
出典: ByteDance Seed 1.0 技術概要、 Seedance 2.0 発表資料、 Seedance 2.5 発表資料。Seedance 3 の項目は未公開。

出典: ByteDance Seed 1.0、Seedance 2.0、および Seedance 2.5 の公式資料。Seedance 3 は TBD のままです。
期待される Seedance 3 の仕様
正式発表前に仕様を論じる最も安全な方法は、公開済みの Seedance 2.5 の機能セットをベースラインとすることです。以下の表は、Seedance 3 が既にこれらの値をサポートしていると主張するものではありません。次世代で維持または改善が期待される点を示します。
| 仕様 | Seedance 2.5 ベースライン | Seedance 3 の期待 | 信頼度 |
|---|---|---|---|
| 公式ステータス | リリース済み | 公式には未発表 | Confirmed |
| アーキテクチャ | 統一された音声・映像の共同生成 | さらに高機能な統一マルチモーダル生成 | High |
| 入力モダリティ | テキスト、画像、ビデオ、音声 | 同じ 4 モダリティに加え、より深い共同推論 | High |
| 単回生成の長さ | 最長 30 秒 | 少なくとも 30 秒の維持;それ以上は未確認 | Medium |
| 参照容量 | 30 枚の画像 + 10 本のビデオ + 10 本の音声 | 少なくとも 50 アセットを維持、もしくはより賢い管理 | Medium |
| 音声出力 | ネイティブな同期音声 | 台詞、声質の恒常性、空間音響の改善 | High |
| 編集 | タイムスタンプ、カメラ、グリーンスクリーン、参照編集 | より局所的で信頼性が高く、会話的な編集 | High |
| 解像度とフレームレート | 公式記事では未掲載 | TBD | Unknown |
| API モデル ID | CometAPI 上の seedance-2-5 | TBD | Confirmed |
| 価格と提供地域 | ルート別に提供 | TBD | Unknown |
出典: ベースラインは公式の Seedance 2.5 製品ページ**に基づく。期待値は分析であり、発表済み仕様ではない。
公開ルール。ByteDance が詳細を公表するまでは、Seedance 3 が 4K、60 秒のネイティブ生成、特定のフレームレート、または特定の価格をサポートすると述べてはなりません。未公開の項目にはすべて TBD を使用してください。
Seedance 3 はどんな機能を導入しうるか?
より長く、かつ整合性のある物語
Seedance 2.5 は単回で 30 秒の音声・映像クリップを生成し、それを複数ラウンドで拡張できます。次の課題は長さそのものではありません。長尺のビデオが有用になるのは、キャラクターの身元、衣装、空間レイアウト、照明、声、物語の因果関係がカットや拡張を跨いで安定しているときです。
したがって Seedance 3 は、永続的なシーン状態に注力する可能性があります。どのキャラクターがどの物体を持っているか、ドアがどこにあるか、衣装がどう変化するか、前の出来事が後のショットにどのように影響するべきかを記憶することです。これにより、見た目は印象的でも内部矛盾のあるシーケンスに対して、現在クリエイターが行っている修正作業が減るはずです。
物理挙動と複雑な相互作用を強化
人と物の接触、衝突、布や液体、群衆、急速なカメラ移動は、生成ビデオシステムにとって依然として難題です。ByteDance 自身の Seedance 2.5 の要約でも、複雑動作の物理挙動と複数被写体の相互作用の安定性は改善余地があるとしています。意味のある世代の飛躍とは、これらのシーンを単に詳細にするのではなく、より信頼できるものにすることです。
実用的な指標は有用率です。スポーツクリップの成功は、ある 1 フレームが写実的に見えることではありません。手と道具、運動量、接触、音、カメラの動きがショット全体を通してもっともらしく保たれているときに成功と言えます。Seedance 3 は、選び抜いたショーケースフレームではなく、完全なシーケンスと繰り返し生成の観点から評価されるべきです。
キャラクター、プロダクト、声の永続性
参照制御は AI ビデオの制作インターフェースになりつつあります。クリエイターは、同じ俳優、製品、小道具、ロケーション、声が複数シーンを通じて認識可能であることを求めます。Seedance 2.5 はすでに最大 30 枚の画像、10 本のビデオ、10 本の音声を受け付けますが、次のステップは必ずしもアップロード上限の引き上げではありません。より良い参照の選択、衝突解消、アイデンティティの重み付け、再利用可能なキャラクターアセットが、単なる生容量の増加より価値を生むかもしれません。
広告では、パッケージ、ロゴ、カラーシステム、スポークスパーソンが、カメラの変化においても漂流せずに維持されることを意味します。物語制作では、反復登場するキャラクターが、毎回参照セットを作り直さなくても、外見と声の一貫性を保てることを意味します。
より精密で局所化されたビデオ編集
生成は制作ワークフローの前半に過ぎません。編集者は、承認済みの内容に触れずに、ある物体、表情、台詞、カメラ動作、時間区間だけを変更する必要があります。Seedance 2.5 はタイムスタンプベースの編集、カメラ視点の変更、グリーンスクリーンのワークフロー、参照によるリビジョンをサポートしています。Seedance 3 は、これらの操作をより局所的かつ決定論的にできるかもしれません。
- リクエスト箇所以外のピクセルと動きを保持する領域レベルの変更
- シーケンス全体を再生成せずに行う音声のみ/動作のみの修正
- 複数ターンにわたって結果を洗練できる会話的編集履歴
- 編集を跨いでも承認済みのキャラクターや製品のアイデンティティを維持するバージョン安定参照
プロ仕様のカメラとシーン制御
Seedance 2.5 は、タイムスタンプ指示やクレイレンダー参照を使って、ブロッキング、カメラ動作、シーンの幾何、照明方向、テンポを制御できます。将来のモデルは、プリビズと最終レンダリングの関係をさらに強化できるでしょう。絵コンテ、ラフな 3D レイアウト、ショットリスト、モーションパス、音声キューが、単一の演出ブリーフの一部になり得ます。
これは、短い美麗クリップに最適化されたモデルとの差別化点です。制作チームが重視するのは反復再現性です。特定のレンズの質感、ショット時間、役者の立ち位置、照明セットアップ、製品の角度を指定すれば、やり直さずに改訂可能な結果が返ってくる能力です。
ベンチマーク性能:確認済みと未確認の境界
Seedance 3 のスコアは存在しません。公式な Seedance 3 のベンチマーク結果はありません。公式評価がない段階で、モデルに Elo スコア、勝率、生成速度、品質スコアを割り当てるチャートは未確認情報として扱うべきです。
Seedance 2.5 の性能ベースライン
ByteDance は標準化された Seedance 2.5 のリーダーボードスコアや第三者ベンチマーク手順を公表していません。公式発表資料では、代わりに制作志向の機能とキュレートされたデモンストレーションで性能を定義しています。これにより Seedance 2.5 は関連する確認済みベースラインであり続けますが、定性的なショーケース結果が独立したクロスモデルスコアと混同されないようにしています。
公開ベースラインには、単回最大 30 秒の生成、最大 2 回の延長、最大 50 の参照アセット(画像 30、ビデオ 10、音声 10)が含まれます。ByteDance はまた、より滑らかな遷移、カットを跨ぐ被写体の安定性向上、音声と映像の同期、タイムスタンプレベルの編集を報告しています。これらはモデルの意図された制作性能を記述するものであり、テストプロンプトセット、評価プロトコル、勝率、レイテンシー分布、受入れ秒数あたりのコストは開示していません。

Seedance 2.5 の公開された最大参照容量。出典: ByteDance Seed の発表説明。これは標準化された品質スコアではなく、製品の容量指標です。
Seedance 2.5 ベースラインが示すもの
Seedance 2.5 の最も明確な測定可能な強みはワークフロー規模です。30 秒のネイティブクリップ、複数ラウンドの延長、50 参照入力により、参照が多いシーケンスで必要な個別生成回数を減らせます。編集ツールもまた、制作コストが通常増大する地点、すなわち特定の時間区間、カメラ動作、被写体、背景だけを改訂する際に全体を作り直さずに済むよう狙っています。
残る性能課題は信頼性の課題です。独立評価では、初回の有用率、30 秒全体を通じた身元や声の一貫性、複雑動作のエラー率、台詞における音声・映像同期、対象編集後に承認済みコンテンツがどれだけ変わらないかを測定すべきです。これらは単一の視覚嗜好スコアより、意思決定に有用です。
リリース時に重要となる Seedance 3.0 のベンチマーク
信頼できる Seedance 3 の評価は、総合嗜好スコア以上の報告を行うべきです。最も有用なリリース分析は、開示されたプロンプト、複数のランダムシード、完全な未編集出力で以下の次元を検証することです。
- 長尺での身元一貫性:顔、体、衣服、製品、小道具、声がカットや延長を跨いで安定
- 複雑動作の物理挙動:人と物の接触、運動量、衝突、布、液体、群衆、スポーツ
- 命令追従:時間コード付きの動作、ショット順、カメラ動作、台詞、ネガティブ制約
- 音声・映像の同期:台詞、口の動き、効果音、環境音、音楽、イベントタイミング
- 編集の保全性:特定の領域、時間区間、音を改訂したとき、承認済み内容がどれだけ保持されるか
- 制作効率:有用結果までの時間、リトライ率、レイテンシー、受入れ秒数あたりのコスト、失敗率
Seedance 3 を待つべきか?
Seedance 3 には確定したリリース日、仕様、価格、API 識別子が存在しないため、待つことが自動的に安全とは限りません。実務的には、Seedance 2.5 がすでに必要な作業の受入基準を満たすかどうかです。
待つべきケース
現在の阻害要因が既知の能力ギャップである。信頼できる複雑物理、密な複数被写体の相互作用、強く局所化された編集、永続的で再利用可能なキャラクター資産が必要な場合、現行モデルではリトライや手作業修正が多すぎる可能性があります。
プロジェクトに固定の納期がない。延期のコストが小さく、未定のリリース時期、提供地域、キュー挙動、価格に耐えられるなら、待つ選択は合理的です。
移行コストが高い。プロンプト、参照パッケージング、レビュー基準、コンプライアンス承認を新モデルに合わせて再構築する必要がある場合、制作ワークフローを確約する前に正式な Seedance 3 のインターフェースを評価する方が良いかもしれません。
いま Seedance 2.5 を使うべきケース
実働の制作ベースラインが必要。Seedance 2.5 はすでに 30 秒生成、延長、ネイティブ同期音声、大規模なマルチモーダル参照セット、タイムスタンプベースの編集を提供します。これらは今日、実際のブリーフに対して検証可能な具体的機能です。
反復が理論上のピーク品質より重要。現行モデルを使えば、どのプロンプト、参照、カメラ指示、レビューゲート、フォールバック編集が実際に有用出力を左右するのかをチームが学べます。
切り替え前に証拠を持ちたい。Seedance 2.5 のベースラインを確立すれば、初回受入、リトライ、レイテンシー、受入れ秒数コスト、身元ドリフト、編集保全性を比較可能にできます。Seedance 3 は現実になってから同じテストセットで判断するのがよいでしょう。
Seedance 3 vs Seedance 2.5 vs Vidu Q3, Kling 3.0 vs Veo 3.1
Seedance 3 には公開仕様がないため、以下の比較ではその列をスコアカードではなく閾値として扱います。現在入手可能なシステムに対して、次のモデルが一致または上回る必要がある点を示します。
| モデル | ステータス | ネイティブ長 | 音声 | 制御と編集 | 現在のポジショニング |
|---|---|---|---|---|---|
| Seedance 3 | 未発表 | TBD | ネイティブ音声が期待 | さらなる深いマルチモーダル制御が期待 | 長尺の信頼性を改善する必要 |
| Seedance 2.5 | 提供中 | 最大 30s | ネイティブ同期音声 | 50 参照;タイムスタンプとカメラ編集 | 長尺で参照の多いストーリーテリング |
| Vidu Q3 | 提供中 | 1-16s | ネイティブの音声・映像出力 | テキスト、画像、最初/最後フレーム、参照モード | 柔軟な長さと高速な反復 |
| Kling 3.0 | 提供中 | 3-15s | ネイティブの音声・映像出力 | ストーリーボード制御;画像・ビデオ・要素参照 | マルチショット制御と再利用可能な要素 |
| Veo 3.1 | 提供中 | モード依存 | ネイティブ音声 | 延長、フレーム特定生成、画像ガイダンス | シネマティック出力と Google ワークフロー |
モデルページ: Seedance 2.5 | Vidu Q3 | Kling 3.0 | Veo 3.1
比較からわかること
Seedance 2.5 は、ここで挙げたモデルの中で、公開されたネイティブクリップ長と最大参照数において最も明確な優位性があります。その 30 秒ワークフローは、独立した短尺ショットではなく、完結した物語単位を前提に設計されています。
Vidu Q3 は 1~16 秒の柔軟な生成、公式 API ドキュメントによる最大 1080p、出力品質または速度を優先するバリアントを提供します。急速な反復、開始/終了フレーム制御、参照→ビデオのワークフローが重要な場合に魅力的です。
Kling 3.0 は最大 15 秒、ネイティブの音声・映像出力、カスタムのマルチショット・ストーリーボード、画像またはビデオ参照から構築したキャラクター要素をサポートします。明示的なショットレベルの演出と再利用可能なアイデンティティ資産が強みです。
Veo 3.1 はネイティブ音声、ビデオ延長、フレーム特定生成、画像ベースの指示を強調します。シネマティックな描画と Google の生成メディアスタックへの統合で有力なベンチマークであり続けます。
Seedance 3 が真の世代交代を意味するには、選び抜いた視覚嗜好テストで勝つ以上のことが必要です。特に複数キャラクターのシーン、複雑な動き、長尺の継続生成において、より多くのプロンプトを初回で有用かつ編集可能なシーケンスへと変換できるべきです。
Seedance 3 はいつリリースされるか?
Seedance 3 の公式リリース日は存在しません。ByteDance は、その名称に関するプロジェクトページ、モデルカード、API 識別子、価格表、提供地域、ロールアウト計画を公表していません。過去のバージョン間隔から機械的にリリース時期を推測すべきではありません。
最も信頼できる確認ポイントは、ByteDance Seed のモデルディレクトリ、ByteDance Seed のローンチ記事、Volcano Engine もしくは BytePlus の API ドキュメント、そしてライブの製品・モデルページです。これらのいずれかが Seedance 3 を明示するまでは、リリース日の主張は噂として扱うか、完全に省略すべきです。
待つ間に Seedance モデルへアクセスする方法
開発者は、未確認モデルを待たずに現行ワークフローをテストできます。 Seedance 2.5 は CometAPI を通じて非同期のビデオ生成パターンで利用可能です。アプリケーションはタスクを送信し、返された識別子を保存し、完了までポーリングし、結果のビデオを取得します。同じ統合レイヤーを使えば、各プロバイダごとに認証やジョブ処理を作り直すことなく、ビデオモデルの比較が容易になります。
Bash (cURL)
curl --request POST 'https://api.cometapi.com/v1/videos' \ --header 'Authorization: Bearer YOUR_COMETAPI_KEY' \ --form-string 'model=seedance-2-5' \ --form-string 'prompt=A cinematic tracking shot of a paper dragon flying above a lantern-lit river at dusk.' \ --form-string 'seconds=5'
この例は、公開済みのモデル ID seedance-2-5 を使用しています。CometAPI が実在のモデルページと対応する識別子を公開するまでは、これを seedance-3 に変更してはなりません。エンドポイントの挙動やリクエストパラメータは、本番利用前に最新の API ドキュメントで確認してください。
完全なパラメータ、タスクステータス処理、運用ガイダンスについては、CometAPI の API ドキュメントを参照してください。
まだ不明な点
- Seedance 3 が正式な製品名かどうか
- リリース日とロールアウト順序
- 最大ネイティブ長、出力解像度、フレームレート、アスペクト比制限
- 最大参照数と、参照が再利用可能な資産になりうるかどうか
- アーキテクチャの詳細、パラメータ規模、学習データの開示、推論ハードウェア
- 公式ベンチマークスコアと、その背後にある評価プロトコル
- API モデル ID、価格、提供地域、レート制限、商用条件
- モデルに同梱される真正性、透かし、身元保護、著作権管理の仕組み
まとめ
Seedance 3 は未確認のままですが、Seedance ファミリーの方向性はますます明確です。シリーズは、ネイティブなマルチショットの視覚生成から、同期音声、統一マルチモーダル参照制御、30 秒のストーリーテリング、ターゲット編集へと進歩してきました。次の大きな一歩は、選び抜いたデモでより壮観に見せることではなく、そのワークフローをより信頼できるものにすることです。
最も重要な証拠は再現可能な性能です。長尺シーケンスを跨ぐキャラクターと声の一貫性、もっともらしい物理的相互作用、時間コード付き指示への精密な追従、承認済み内容を保持する編集。これらこそが、モデルがコンセプト生成から日常の制作へ移行できるかを決定づけます。
公式な Seedance 3 情報を待つ間、開発者は現行の Seedance 2.5 API を評価し、CometAPI を通じて他のビデオモデルと比較できます。本記事は、ByteDance もしくはライブの API ソースがモデル名、仕様、ベンチマーク、アクセス詳細を確認したタイミングでのみ更新すべきです。
