TL;DR
API FLUX 3 belum tersedia secara umum sebagai API produksi awam. Black Forest Labs telah mengumumkan FLUX 3 dan membuka Akses Awal untuk FLUX 3 Video, sementara ID model produksi yang stabil, spesifikasi API awam lengkap, dan akses lebih luas masih belum tersedia.
Pembangun boleh memohon Akses Awal sekarang atau terus menanda aras API video yang tersedia sambil bersedia menilai FLUX 3 apabila akses diperluas.
What Is FLUX 3?
FLUX 3 ialah model asas multimodal baharu oleh Black Forest Labs untuk tugasan berkaitan imej, video, audio, dan tindakan.
Berbeza dengan FLUX.2 yang memberi tumpuan terutamanya pada penjanaan dan penyuntingan imej, FLUX 3 dilatih bersama merentas imej, video dan audio. Menurut pengumuman rasmi FLUX 3 oleh Black Forest Labs, matlamatnya ialah memodelkan struktur visual, gerakan, interaksi fizikal, dan bunyi dalam seni bina yang dikongsi, bukannya menganggap setiap modaliti sebagai sistem berasingan.
Bagi pembangun, soalan paling penting ialah sama ada keupayaan ini sudah boleh diakses melalui API sedia produksi.
Is the FLUX 3 API Available Now?
Tidak, API FLUX 3 belum tersedia secara umum sebagai API produksi awam.
Setakat 24 Julai 2026, Black Forest Labs menawarkan program Akses Awal berasaskan permohonan, bermula dengan FLUX 3 Video. ID model produksi yang stabil, spesifikasi API awam lengkap, had kadar, dan butiran produksi lain masih belum dikeluarkan untuk kegunaan umum.
Pembangun yang berminat untuk menguji model boleh memohon melalui halaman model FLUX 3 rasmi.
FLUX 3 Availability at a Glance
| Item | Current Status |
|---|---|
| Official announcement | Released July 23, 2026 |
| Public FLUX 3 API | Not generally available |
| Stable production model IDs | Not published |
| FLUX 3 Video | Early Access |
| Maximum announced video length | Up to 20 seconds per generation |
| Native audio | Supported |
| FLUX 3 Image | Early Access planned in the following weeks |
| FLUX 3 Action | Selected research and commercial partners |
| FLUX 3 Dev | Open-weight multimodal backbone planned |
Black Forest Labs menyatakan bahawa keupayaan berbeza FLUX 3 akan dilancarkan secara berperingkat dalam minggu dan bulan yang akan datang.
Perbezaan ini penting: FLUX 3 telah diumumkan dan tersedia kepada pengguna Akses Awal terpilih, tetapi ia belum menjadi titik akhir awam yang boleh diintegrasikan oleh mana-mana pembangun ke dalam produksi.
What Can FLUX 3 Video Do?
FLUX 3 Video ialah keupayaan utama pertama FLUX 3 yang memasuki Akses Awal.
Menurut BFL, ia boleh menjana klip dengan audio natif sehingga 20 saat dalam satu penjanaan. Ia menyokong penjanaan berasaskan prompt semata-mata dan aliran kerja yang menggunakan imej, video atau jujukan audiovisual sebagai rujukan.
Watch FLUX 3 in Action
Pratonton ini menawarkan pandangan awal tentang keupayaan multimodal FLUX 3 merentas video, audio, penjanaan imej, dan peramalan tindakan.
https://www.youtube.com/watch?v=PCPhl8qMF_Y
Keupayaan yang diumumkan termasuk:
- penjanaan teks-ke-video;
- penjanaan imej-ke-video daripada bingkai permulaan atau rujukan visual;
- transformasi video-ke-video;
- sambungan video dan audio;
- penjanaan video daripada bingkai kunci;
- dialog berbilang bahasa;
- audio yang disegerakkan dengan peristiwa visual;
- pelbagai nisbah bidang dan gaya visual;
- merantaikan klip menjadi jujukan berbilang babak yang lebih panjang;
- penjanaan tipografi dan reka bentuk animasi.
Penilaian awal BFL menggunakan klip teks-ke-video 10 saat, 720p dengan audio. Walau bagaimanapun, spesifikasi produksi lengkap yang meliputi resolusi disokong, kadar bingkai, kodek, tingkah laku baris giliran, kelewatan, dan format output masih belum diterbitkan.
Butiran tersebut akhirnya akan menentukan sejauh mana praktikal FLUX 3 Video untuk beban kerja produksi sebenar.
What Is FLUX 3 Dev?
FLUX 3 Dev ialah versi open-weight yang dirancang bagi tulang belakang multimodal FLUX 3.
Black Forest Labs menggambarkannya sebagai tulang belakang open-weight yang bertujuan menyokong beban kerja imej, video, audio, penciptaan kandungan, dan peramalan tindakan. Syarikat belum menerbitkan pemberat model, saiz parameter, keperluan perkakasan, tarikh keluaran, atau terma lesen.
Bagi pembangun yang berminat dengan penggunaan setempat, pelarasan (fine-tuning), penyelidikan, atau kawalan lebih besar ke atas infrastruktur inferens, FLUX 3 Dev ialah keluaran yang patut diperhatikan.
Pasukan harus mengelakkan daripada membuat perancangan infrastruktur atau pelesenan sehingga BFL menerbitkan spesifikasi teknikal muktamad dan syarat penggunaan.
Ikuti kemas kini keluaran melalui halaman FLUX 3 rasmi.
FLUX 3 vs FLUX.2: What Changed?
FLUX 3 mewakili perubahan yang lebih luas daripada sekadar menambah penjanaan video kepada FLUX.2.
| Feature / Dimension | FLUX.2 | FLUX 3 |
|---|---|---|
| Primary focus | Image generation and editing | Multimodal generation and prediction |
| Main modalities | Image | Image, video, audio, and action prediction |
| Temporal modeling | Not a primary focus | Core capability |
| Native video audio | No | Yes |
| Video generation | No | Yes |
| Maximum video length | N/A | Up to 20 seconds per generation |
| Action prediction | Not a primary capability | Planned through FLUX 3 Action for selected partners |
| Open-weight version | FLUX.2 Dev is available | FLUX 3 Dev is planned; specifications are pending |
| Current availability | Released model family | Phased Early Access |
FLUX.2 kekal sebagai keluarga penjanaan dan penyuntingan imej produksi dengan varian API terurus dan versi Dev open-weight yang tersedia. FLUX 3 memperluas seni bina kepada beban kerja temporal, audiovisual, dan berkaitan tindakan.
Bagi pasukan yang memfokuskan penjanaan imej hari ini, FLUX.2 masih merupakan pilihan yang lebih praktikal.
Lihat tinjauan FLUX.2 oleh CometAPI atau panduan integrasi API FLUX.2 untuk aliran kerja penjanaan imej terkini.
FLUX 3 juga meluas kepada peramalan tindakan.
Dalam laporan FLUX 3 x mimic, BFL menerangkan FLUX-mimic, model tindakan video yang dibina di atas tulang belakang FLUX 3 dengan kerjasama mimic robotics. BFL menyatakan sistem ini telah diuji pada tugasan produksi di Audi.
Idea asasnya ialah model yang mampu mempelajari cara adegan fizikal berkembang dari semasa ke semasa mungkin juga membangunkan representasi yang berguna untuk meramalkan tindakan robot.
Kerja ini harus dilihat secara berasingan daripada API penjanaan kandungan pada masa hadapan. FLUX 3 Action pada peringkat awal ditujukan kepada rakan penyelidikan dan komersial terpilih.
What Do the Early FLUX 3 Benchmarks Show?
Black Forest Labs telah menerbitkan penilaian keutamaan awal untuk calon FLUX 3 Video awal menggunakan klip teks-ke-video 10 saat, 720p dengan audio.
Dalam penilaian yang diterbitkan, FLUX 3 menerima:
- 52% keutamaan berbanding Seedance 2.0;
- 52% berbanding Gemini Omni Flash;
- 57% berbanding Happy Horse 1.1;
- 59% berbanding Happy Horse v1;
- 60% berbanding Kling v3 Pro;
- sehingga 69% berbanding Grok Imagine Video;
- 77% berbanding Runway Gen-4.5;
- 93% berbanding Luma Ray 3.2.

Sumber*: Black Forest Labs,* FLUX 3: Real World Models**, July 23, 2026. Keputusan adalah berdasarkan penilaian awal calon FLUX 3 awal.
Keputusan ini menggalakkan, tetapi BFL menyatakan bahawa model dan radas penilaian masih dalam pembangunan. Oleh itu, ia harus dianggap sebagai penilaian awal yang dijalankan vendor dan bukannya penanda aras produksi bebas.
Skor keutamaan juga tidak menunjukkan cara model berprestasi dari segi kelewatan API, kebolehpercayaan, throughput, kegagalan teknikal, atau konsistensi merentasi penjanaan berulang.
Apabila akses API FLUX 3 lebih luas tersedia, pasukan harus menjalankan prompt yang sama merentasi FLUX 3 dan model sedia ada mereka di bawah keadaan ujian yang konsisten.
How Can Developers Access FLUX 3?
Setakat 24 Julai 2026, FLUX 3 tersedia melalui program Akses Awal berasaskan permohonan oleh Black Forest Labs dan bukannya akses API awam umum.
Pembangun yang ingin menguji model boleh memohon melalui halaman FLUX 3 rasmi.
CometAPI merancang untuk menyokong FLUX 3 selepas ketersediaan API dan spesifikasi integrasinya disahkan secara rasmi. Ini akan membolehkan pembangun mengakses FLUX 3 bersama model AI lain melalui infrastruktur API yang sama tanpa membina integrasi berasingan dari awal.
Sementara itu, pasukan boleh terus membina dengan model yang sudah tersedia melalui CometAPI:
| Your Use Case | Recommended Models and Resources |
|---|---|
| AI video generation | Start with Veo 3 or explore Seedance, Kling, Sora, Runway, and other models through the CometAPI Video Generation API. |
| Video with native audio | Evaluate Veo 3 for video generation with synchronized dialogue, sound effects, and ambient audio. |
| Image generation and editing | Use the released FLUX.2 family through the FLUX.2 API integration guide or test FLUX.2 Pro. |
| Open-weight workflows | Explore FLUX.2 Dev while waiting for the FLUX 3 Dev weights, license, and hardware requirements. |
| Future FLUX 3 comparison | Build a reusable benchmark using the evaluation framework below, then run the same tests when FLUX 3 access expands. |
Pendekatan ini membolehkan pembangun terus menghantar produk hari ini dengan alternatif yang sesuai sambil kekal bersedia untuk menilai atau mengintegrasikan FLUX 3 apabila akses API lebih luas tersedia.
How to Evaluate the FLUX 3 API After Release
Pasukan yang berminat dengan FLUX 3 boleh menyediakan penanda aras sebelum akses API awam tersedia.
Set ujian yang mewakili harus meliputi beban kerja yang paling penting kepada produk:
| Test Group | What to Measure |
|---|---|
| Prompt adherence | Required objects, actions, camera instructions, and exclusions |
| Character consistency | Identity, clothing, proportions, and voice |
| Physical motion | Contact, weight, trajectories, and continuity |
| Native audio | Lip sync, dialogue accuracy, timing, and ambience |
| Editing and references | Image references, video transformations, keyframes, and continuation |
| Typography and multilingual output | Spelling, layout stability, animation, and language accuracy |
Untuk setiap permintaan, jejak:
- prompt dan aset rujukan;
- model dan versi titik akhir;
- resolusi, durasi, dan nisbah bidang;
- kelewatan giliran, penjanaan, dan penghantaran;
- kegagalan teknikal dan penolakan keselamatan;
- skor penerimaan manusia;
- corak kegagalan biasa pada visual, gerakan, teks, dan audio.
Jalankan prompt penting berulang kali.
Video generatif adalah stokastik, dan satu output yang kuat tidak semestinya bermakna model cukup boleh dipercayai untuk produksi. Ujian berulang mendedahkan konsistensi dan corak kegagalan yang mungkin tidak kelihatan dalam demo yang digilap.
Apabila FLUX 3 tersedia secara meluas, jalankan beban kerja yang sama terhadap model sedia ada anda. Ini mewujudkan perbandingan yang lebih berguna daripada menggunakan prompt berbeza atau contoh terpilih untuk setiap model.
What Should Developers Watch Next?
Sebelum menganggap FLUX 3 sedia produksi, perhatikan lima perkembangan utama:
- Titik akhir API awam yang stabil dan ID model produksi.
- Resolusi, durasi, kadar bingkai, kodek, dan kawalan audio natif yang disokong.
- Had kadar, kebersamaan, tingkah laku baris giliran, dan kelewatan penjanaan.
- Terma penggunaan komersial, penyederhanaan kandungan, privasi, dan pengekalan data.
- Pemberat FLUX 3 Dev, saiz parameter, keperluan perkakasan, dan butiran lesen.
Butiran ini akan menentukan sama ada FLUX 3 bukan sahaja menjadi keluarga model yang mengagumkan, tetapi juga pilihan yang praktikal untuk aplikasi produksi.
FAQ
Is the FLUX 3 API available?
Setakat 24 Julai 2026, FLUX 3 belum tersedia secara umum sebagai API awam. Ia sedang dilancarkan melalui program Akses Awal berperingkat, dan pembangun boleh memohon melalui halaman FLUX 3 rasmi Black Forest Labs.
How can I access FLUX 3 Video?
Pembangun dan syarikat boleh memohon Akses Awal FLUX 3 Video melalui halaman model FLUX 3 rasmi.
Does FLUX 3 generate video with audio?
Ya. FLUX 3 Video menjana audio natif bersama video dan menyokong keupayaan seperti dialog berbilang bahasa, sambungan audiovisual, dan bunyi yang disegerakkan dengan peristiwa visual. BFL menyatakan satu penjanaan boleh sehingga 20 saat.
What is FLUX 3 Dev?
FLUX 3 Dev ialah versi open-weight yang dirancang bagi tulang belakang multimodal FLUX 3. BFL belum menerbitkan pemberat model, saiz parameter, keperluan perkakasan, tarikh keluaran, atau terma lesen.
What is the difference between FLUX 3 and FLUX.2?
FLUX.2 memfokuskan pada penjanaan dan penyuntingan imej produksi. FLUX 3 meluaskan kepada seni bina multimodal yang merangkumi imej, video, audio natif, dan peramalan tindakan.
Final Thoughts
FLUX 3 wajar diberi perhatian, khususnya bagi pembangun yang berminat dengan penjanaan video bersama audio natif dan aliran kerja multimodal yang lebih luas.
Buat masa ini, pendekatan yang praktikal ialah terus membina dan menanda aras dengan model yang tersedia sambil menyediakan set penilaian boleh guna semula. Apabila akses API FLUX 3 diperluas, pasukan boleh menjalankan prompt yang sama merentas model dan membandingkan kualiti output, konsistensi, kelewatan, kebolehpercayaan, dan corak kegagalan biasa.
Sedia mengintegrasikan penjanaan video hari ini? Teroka CometAPI Video Generation API untuk bekerja dengan model yang kini tersedia.
