TL;DR
FLUX 3 API は、まだ一般公開されたプロダクション API としては利用できません。Black Forest Labs は FLUX 3 を発表し、FLUX 3 Video の Early Access を開始しましたが、安定版のモデル ID、完全な公開 API 仕様、広範なアクセスは未定です。
開発者は現時点で Early Access に応募するか、アクセス拡大に備えてベンチマークを続けつつ FLUX 3 の評価準備を進めることができます。
What Is FLUX 3?
FLUX 3 は、画像・動画・音声・アクション関連タスクに対応する Black Forest Labs の新しいマルチモーダル基盤モデルです。
主に画像生成と編集に焦点を当てた FLUX.2 と異なり、FLUX 3 は画像・動画・音声を横断して共同学習されています。Black Forest Labs の公式 FLUX 3 発表によれば、各モダリティを別個のシステムとして扱うのではなく、共有アーキテクチャ内で視覚構造、動き、物理的相互作用、音をモデル化することが目標です。
開発者にとって最も重要なのは、これらの機能に今すぐプロダクション向け API を通してアクセスできるかどうかです。
Is the FLUX 3 API Available Now?
いいえ、FLUX 3 API は一般公開されたプロダクション API としてはまだ利用できません。
2026年7月24日現在、Black Forest Labs は FLUX 3 Video を皮切りに、応募制の Early Access プログラムを提供しています。安定運用向けのモデル ID、完全な公開 API 仕様、レート制限などのプロダクション詳細は、一般利用向けにはまだ公開されていません。
モデルのテストに関心がある開発者は、公式 FLUX 3 モデルページから応募できます。
FLUX 3 Availability at a Glance
| Item | Current Status |
|---|---|
| Official announcement | Released July 23, 2026 |
| Public FLUX 3 API | Not generally available |
| Stable production model IDs | Not published |
| FLUX 3 Video | Early Access |
| Maximum announced video length | Up to 20 seconds per generation |
| Native audio | Supported |
| FLUX 3 Image | Early Access planned in the following weeks |
| FLUX 3 Action | Selected research and commercial partners |
| FLUX 3 Dev | Open-weight multimodal backbone planned |
Black Forest Labs は、FLUX 3 の各機能を今後数週間から数か月にかけて段階的にロールアウトするとしています。
この区別は重要です。FLUX 3 は発表され、選定された Early Access ユーザーには提供されていますが、誰もが統合できる公開エンドポイントではまだありません。
What Can FLUX 3 Video Do?
FLUX 3 Video は、Early Access に入った最初の主要な FLUX 3 機能です。
BFL によれば、1回の生成で最大20秒のネイティブ音声付きクリップを生成できます。プロンプトのみの生成に加え、画像・動画・映像音声シーケンスを参照として使うワークフローにも対応しています。
Watch FLUX 3 in Action
このプレビューでは、動画・音声・画像生成・アクション予測にまたがる FLUX 3 のマルチモーダル機能の初期像が見られます。
https://www.youtube.com/watch?v=PCPhl8qMF_Y
発表済みの主な機能には以下が含まれます。
- テキストからの動画生成
- 初期フレームや視覚参照からの画像-to-動画生成
- 動画-to-動画変換
- 動画および音声の継続生成
- キーフレーム-to-動画生成
- 多言語の対話
- 視覚イベントと同期した音声
- 複数のアスペクト比とビジュアルスタイル
- クリップを連結した長尺のマルチショットシーケンス生成
- タイポグラフィとアニメーションデザインの生成
BFL の暫定評価では、音声付きの10秒・720pのテキスト-to-動画クリップを使用しました。ただし、対応解像度、フレームレート、コーデック、キュー動作、レイテンシ、出力フォーマットなどを網羅した完全なプロダクション仕様は、まだ公開されていません。
これらの詳細が、FLUX 3 Video が実際のプロダクションワークロードにどれほど実用的かを最終的に左右します。
What Is FLUX 3 Dev?
FLUX 3 Dev は、FLUX 3 のマルチモーダル基盤のオープンウェイト版として計画されています。
Black Forest Labs は、画像・動画・音声・コンテンツ生成・アクション予測のワークロードを支えるオープンウェイトの基盤として説明しています。モデル重み、パラメータ規模、ハードウェア要件、リリース日、ライセンス条件は、まだ公開されていません。
ローカル展開、ファインチューニング、研究、推論インフラの柔軟な制御に関心がある開発者にとって、注目すべきは FLUX 3 Dev のリリースです。
BFL が最終的な技術仕様と利用条件を公開するまでは、インフラやライセンスに関する計画は避けるべきです。
最新情報は公式 FLUX 3 ページをフォローしてください。
FLUX 3 vs FLUX.2: What Changed?
FLUX 3 は、単に FLUX.2 に動画生成を追加する以上の広範な変化を示します。
| Feature / Dimension | FLUX.2 | FLUX 3 |
|---|---|---|
| Primary focus | Image generation and editing | Multimodal generation and prediction |
| Main modalities | Image | Image, video, audio, and action prediction |
| Temporal modeling | Not a primary focus | Core capability |
| Native video audio | No | Yes |
| Video generation | No | Yes |
| Maximum video length | N/A | Up to 20 seconds per generation |
| Action prediction | Not a primary capability | Planned through FLUX 3 Action for selected partners |
| Open-weight version | FLUX.2 Dev is available | FLUX 3 Dev is planned; specifications are pending |
| Current availability | Released model family | Phased Early Access |
FLUX.2 は、マネージド API の各種バリアントおよび利用可能なオープンウェイト版 Dev を備えた、画像生成と編集のプロダクション向けモデルファミリーとして継続します。FLUX 3 は、時間的・視聴覚・アクション関連のワークロードへアーキテクチャを拡張します。
現時点で画像生成に注力するチームにとっては、FLUX.2 の方が実用的な選択肢です。
現行の画像生成ワークフローについては、CometAPI のFLUX.2 概要やFLUX.2 API 連携ガイドを参照してください。
FLUX 3 はアクション予測にも拡張されています。
FLUX 3 x mimic レポートでは、BFL が mimic robotics と協業し、FLUX 3 の基盤上に構築した動画アクションモデル FLUX-mimic を紹介しています。BFL は、このシステムが Audi のプロダクションタスクで検証済みであると述べています。
物理的なシーンが時間とともにどのように推移するかを学習できるモデルは、ロボットのアクション予測にも有用な表現を獲得し得る、という考え方です。
この取り組みは、将来のコンテンツ生成 API とは別に捉えるべきです。FLUX 3 Action は当初、選定された研究・商用パートナーを対象としています。
What Do the Early FLUX 3 Benchmarks Show?
Black Forest Labs は、音声付きの10秒・720pのテキスト-to-動画クリップを用いた初期 FLUX 3 Video 候補の暫定的な選好評価を公開しました。
公開された評価では、FLUX 3 は以下の選好を獲得しています。
- Seedance 2.0 に対して 52%
- Gemini Omni Flash に対して 52%
- Happy Horse 1.1 に対して 57%
- Happy Horse v1 に対して 59%
- Kling v3 Pro に対して 60%
- Grok Imagine Video に対して 最大 69%
- Runway Gen-4.5 に対して 77%
- Luma Ray 3.2 に対して 93%

Source*: Black Forest Labs,* FLUX 3: Real World Models**, 2026年7月23日。結果は、初期の FLUX 3 候補に対する予備評価に基づくものです。
これらの結果は有望ですが、BFL はモデルと評価ハーネスの双方が開発途上であることを注記しています。したがって、独立したプロダクションベンチマークではなく、暫定的なベンダー実施評価として扱うべきです。
選好スコアは、API のレイテンシ、信頼性、スループット、技術的な失敗、繰り返し生成時の一貫性などに対する性能を示すものではありません。
FLUX 3 API への広範なアクセスが可能になったら、同一のプロンプトを FLUX 3 と既存モデルに対して同一条件で実行すべきです。
How Can Developers Access FLUX 3?
2026年7月24日現在、FLUX 3 は一般公開 API ではなく、Black Forest Labs の応募制 Early Access プログラムを通じて提供されています。
モデルをテストしたい開発者や企業は、公式 FLUX 3 ページから応募できます。
CometAPI は、API の提供と連携仕様が正式に確定した後、FLUX 3 のサポートを予定しています。これにより、開発者は同一の API インフラ上で他の AI モデルと並行して FLUX 3 にアクセスでき、ゼロから別個の連携を構築する必要がなくなります。
それまでの間、チームは CometAPI で既に利用可能なモデルを使って開発を継続できます。
| Your Use Case | Recommended Models and Resources |
|---|---|
| AI video generation | Start with Veo 3 or explore Seedance, Kling, Sora, Runway, and other models through the CometAPI Video Generation API. |
| Video with native audio | Evaluate Veo 3 for video generation with synchronized dialogue, sound effects, and ambient audio. |
| Image generation and editing | Use the released FLUX.2 family through the FLUX.2 API integration guide or test FLUX.2 Pro. |
| Open-weight workflows | Explore FLUX.2 Dev while waiting for the FLUX 3 Dev weights, license, and hardware requirements. |
| Future FLUX 3 comparison | Build a reusable benchmark using the evaluation framework below, then run the same tests when FLUX 3 access expands. |
このアプローチにより、開発者は今日に適した代替モデルで出荷を続けつつ、FLUX 3 の広範な API アクセスが可能になった際の評価・統合準備を整えられます。
How to Evaluate the FLUX 3 API After Release
FLUX 3 に関心のあるチームは、公開 API アクセス前にベンチマークを用意できます。
代表的なテストセットは、製品にとって重要なワークロードを網羅すべきです。
| Test Group | What to Measure |
|---|---|
| Prompt adherence | Required objects, actions, camera instructions, and exclusions |
| Character consistency | Identity, clothing, proportions, and voice |
| Physical motion | Contact, weight, trajectories, and continuity |
| Native audio | Lip sync, dialogue accuracy, timing, and ambience |
| Editing and references | Image references, video transformations, keyframes, and continuation |
| Typography and multilingual output | Spelling, layout stability, animation, and language accuracy |
各リクエストでは以下を記録します。
- プロンプトと参照アセット
- モデルおよびエンドポイントのバージョン
- 解像度、長さ、アスペクト比
- キュー、生成、配信のレイテンシ
- 技術的な失敗とセーフティによる拒否
- 人手による受容スコア
- 視覚・動き・テキスト・音声の代表的な失敗パターン
重要なプロンプトは複数回実行します。
生成動画は確率的であり、単発の優れた出力がモデルのプロダクション信頼性を意味するとは限りません。繰り返しテストによって、洗練されたデモでは見えにくい一貫性や失敗パターンが明らかになります。
FLUX 3 が一般公開されたら、同一のワークロードを既存モデルに対しても実行してください。モデルごとに異なるプロンプトや選び抜かれた例を使うよりも、有用な比較になります。
What Should Developers Watch Next?
FLUX 3 をプロダクション対応と見なす前に、以下の5点を注視してください。
- 安定した公開 API エンドポイントとプロダクションモデル ID
- 対応解像度、長さ、フレームレート、コーデック、ネイティブ音声の制御
- レート制限、同時実行、キュー動作、生成レイテンシ
- 商用利用、コンテンツモデレーション、プライバシー、データ保持の条件
- FLUX 3 Dev のモデル重み、パラメータ規模、ハードウェア要件、ライセンス詳細
これらの詳細が、FLUX 3 が印象的なモデルファミリーに留まらず、プロダクション用途にとって実用的な選択肢となり得るかを決定づけます。
FAQ
Is the FLUX 3 API available?
2026年7月24日現在、FLUX 3 は一般公開 API としては利用できません。段階的な Early Access プログラムを通じて提供されており、開発者は公式のBlack Forest Labs FLUX 3 ページから応募できます。
How can I access FLUX 3 Video?
開発者や企業は、公式のFLUX 3 モデルページから FLUX 3 Video の Early Access に応募できます。
Does FLUX 3 generate video with audio?
はい。FLUX 3 Video は、動画と並行してネイティブ音声を生成し、多言語の対話、映像音声の継続、視覚イベントに同期した音などの機能に対応します。BFL によれば、1回の生成は最大20秒です。
What is FLUX 3 Dev?
FLUX 3 Dev は、FLUX 3 のマルチモーダル基盤のオープンウェイト版として計画されています。BFL は、モデル重み、パラメータ規模、ハードウェア要件、リリース日、ライセンス条件をまだ公開していません。
What is the difference between FLUX 3 and FLUX.2?
FLUX.2 は、画像生成と編集のプロダクション用途に焦点を当てています。FLUX 3 は、画像・動画・ネイティブ音声・アクション予測をカバーするマルチモーダルアーキテクチャへ拡張します。
Final Thoughts
FLUX 3 は、ネイティブ音声付きの動画生成や、より広範なマルチモーダルワークフローに関心のある開発者にとって注目に値します。
当面は、利用可能なモデルでの構築・ベンチマークを継続しつつ、再利用可能な評価セットを準備するのが実務的です。FLUX 3 API へのアクセスが拡大した際に、同一プロンプトを各モデルで実行し、出力品質、一貫性、レイテンシ、信頼性、一般的な失敗パターンを比較できます。
今日すぐ動画生成を統合する準備はできていますか?現在利用可能なモデルと連携できるCometAPI Video Generation APIを確認してください。
