Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI โ†’

FLUX 3 API: Ketersediaan, Akses Awal, Video & Pengembang

CometAPI
Mia MarenJul 24, 2026
FLUX 3 API: Ketersediaan, Akses Awal, Video & Pengembang

TL;DR

API FLUX 3 belum tersedia secara umum sebagai API produksi publik. Black Forest Labs telah mengumumkan FLUX 3 dan membuka Early Access untuk FLUX 3 Video, sementara ID model yang stabil, spesifikasi API publik yang lengkap, dan akses yang lebih luas masih tertunda.

Pengembang dapat mendaftar Early Access sekarang atau terus melakukan benchmarking terhadap API video yang tersedia sambil bersiap mengevaluasi FLUX 3 saat akses diperluas.

What Is FLUX 3?

FLUX 3 adalah model fondasi multimodal terbaru dari Black Forest Labs untuk tugas terkait gambar, video, audio, dan aksi.

Berbeda dengan FLUX.2, yang berfokus terutama pada pembuatan dan pengeditan gambar, FLUX 3 dilatih secara bersama pada gambar, video, dan audio. Menurut pengumuman resmi FLUX 3 dari Black Forest Labs, tujuannya adalah memodelkan struktur visual, gerakan, interaksi fisik, dan suara dalam arsitektur bersama alih-alih memperlakukan setiap modalitas sebagai sistem terpisah.

Bagi pengembang, pertanyaan terpenting adalah apakah kapabilitas ini sudah dapat diakses melalui API yang siap produksi.

Is the FLUX 3 API Available Now?

Tidak, API FLUX 3 belum tersedia secara umum sebagai API produksi publik.

Per tanggal July 24, 2026, Black Forest Labs menawarkan program Early Access berbasis aplikasi, dimulai dengan FLUX 3 Video. ID model produksi yang stabil, spesifikasi API publik yang lengkap, batas laju, dan detail produksi lainnya belum dirilis untuk penggunaan umum.

Pengembang yang tertarik menguji model dapat mendaftar melalui halaman model FLUX 3 resmi.

FLUX 3 Availability at a Glance

ItemStatus Saat Ini
Pengumuman resmiDirilis July 23, 2026
API FLUX 3 publikBelum tersedia secara umum
ID model produksi stabilBelum dipublikasikan
FLUX 3 VideoEarly Access
Durasi video maksimum yang diumumkanHingga 20 detik per generasi
Audio nativeDidukung
FLUX 3 ImageEarly Access direncanakan dalam beberapa minggu berikutnya
FLUX 3 ActionMitra riset dan komersial terpilih
FLUX 3 DevBackbone multimodal open-weight direncanakan

Black Forest Labs menyatakan berbagai kapabilitas FLUX 3 akan diluncurkan bertahap dalam beberapa minggu dan bulan mendatang.

Perbedaannya penting: FLUX 3 telah diumumkan dan tersedia untuk pengguna Early Access terpilih, tetapi belum menjadi endpoint publik yang dapat diintegrasikan ke produksi oleh semua pengembang.

What Can FLUX 3 Video Do?

FLUX 3 Video adalah kapabilitas besar pertama FLUX 3 yang memasuki Early Access.

Menurut BFL, model ini dapat menghasilkan klip dengan audio native hingga 20 detik dalam satu generasi. Model ini mendukung pembuatan berbasis prompt saja dan alur kerja yang menggunakan gambar, video, atau urutan audiovisual sebagai referensi.

Watch FLUX 3 in Action

Pratinjau ini memberikan gambaran awal tentang kapabilitas multimodal FLUX 3 di video, audio, pembuatan gambar, dan prediksi aksi.

https://www.youtube.com/watch?v=PCPhl8qMF_Y

Kapabilitas yang diumumkan meliputi:

  • pembuatan teks-ke-video;
  • pembuatan gambar-ke-video dari frame awal atau referensi visual;
  • transformasi video-ke-video;
  • kelanjutan video dan audio;
  • pembuatan keyframe-ke-video;
  • dialog multibahasa;
  • audio yang tersinkron dengan peristiwa visual;
  • berbagai rasio aspek dan gaya visual;
  • merangkai klip menjadi urutan multi-shot yang lebih panjang;
  • pembuatan tipografi dan desain animasi.

Evaluasi awal BFL menggunakan klip teks-ke-video 10 detik, 720p, dengan audio. Namun, spesifikasi produksi lengkap yang mencakup resolusi yang didukung, frame rate, codec, perilaku antrean, latensi, dan format keluaran belum dipublikasikan.

Detail-detail tersebut pada akhirnya akan menentukan seberapa praktis FLUX 3 Video untuk beban kerja produksi nyata.

What Is FLUX 3 Dev?

FLUX 3 Dev adalah versi open-weight yang direncanakan dari backbone multimodal FLUX 3.

Black Forest Labs menggambarkannya sebagai backbone open-weight yang ditujukan untuk mendukung beban kerja gambar, video, audio, pembuatan konten, dan prediksi aksi. Perusahaan belum memublikasikan bobot model, ukuran parameter, persyaratan perangkat keras, tanggal rilis, atau ketentuan lisensinya.

Bagi pengembang yang tertarik pada penerapan lokal, fine-tuning, riset, atau kontrol yang lebih besar atas infrastruktur inferensi, FLUX 3 Dev adalah rilis yang perlu diperhatikan.

Tim sebaiknya menghindari membuat rencana infrastruktur atau lisensi hingga BFL memublikasikan spesifikasi teknis final dan ketentuan penggunaan.

Ikuti halaman resmi FLUX 3 untuk pembaruan rilis.

FLUX 3 vs FLUX.2: What Changed?

FLUX 3 merepresentasikan pergeseran yang lebih luas daripada sekadar menambahkan pembuatan video ke FLUX.2.

Fitur / DimensiFLUX.2FLUX 3
Fokus utamaPembuatan dan pengeditan gambarPembuatan dan prediksi multimodal
Modalitas utamaGambarGambar, video, audio, dan prediksi aksi
Pemodelan temporalBukan fokus utamaKapabilitas inti
Audio video nativeTidakYa
Pembuatan videoTidakYa
Durasi video maksimumN/AHingga 20 detik per generasi
Prediksi aksiBukan kapabilitas utamaDirencanakan melalui FLUX 3 Action untuk mitra terpilih
Versi open-weightFLUX.2 Dev tersediaFLUX 3 Dev direncanakan; spesifikasi masih menunggu
Ketersediaan saat iniKeluarga model yang dirilisEarly Access bertahap

FLUX.2 tetap menjadi keluarga pembuatan dan pengeditan gambar untuk produksi dengan varian API terkelola dan versi Dev open-weight yang tersedia. FLUX 3 memperluas arsitektur ke beban kerja temporal, audiovisual, dan terkait aksi.

Untuk tim yang berfokus pada pembuatan gambar saat ini, FLUX.2 tetap menjadi opsi yang lebih praktis.

Lihat ringkasan FLUX.2 dari CometAPI atau panduan integrasi API FLUX.2 untuk alur kerja pembuatan gambar saat ini.

FLUX 3 juga meluas ke prediksi aksi.

Dalam laporan FLUX 3 x mimic, BFL menjelaskan FLUX-mimic, model aksi-video yang dibangun di atas backbone FLUX 3 bekerja sama dengan mimic robotics. BFL menyebut sistem tersebut telah diuji pada tugas produksi di Audi.

Gagasannya adalah model yang mampu mempelajari bagaimana adegan fisik berevolusi dari waktu ke waktu dapat mengembangkan representasi yang berguna untuk memprediksi aksi robot.

Pekerjaan ini harus dipandang terpisah dari API pembuatan konten di masa depan. FLUX 3 Action awalnya ditujukan untuk mitra riset dan komersial terpilih.

What Do the Early FLUX 3 Benchmarks Show?

Black Forest Labs telah memublikasikan evaluasi preferensi awal untuk kandidat FLUX 3 Video awal menggunakan klip teks-ke-video 10 detik, 720p, dengan audio.

Dalam evaluasi yang dipublikasikan, FLUX 3 memperoleh:

  • 52% preferensi dibanding Seedance 2.0;
  • 52% dibanding Gemini Omni Flash;
  • 57% dibanding Happy Horse 1.1;
  • 59% dibanding Happy Horse v1;
  • 60% dibanding Kling v3 Pro;
  • hingga 69% dibanding Grok Imagine Video;
  • 77% dibanding Runway Gen-4.5;
  • 93% dibanding Luma Ray 3.2.

gambar

Sumber*: Black Forest Labs,* FLUX 3: Real World Models**, July 23, 2026. Hasil didasarkan pada evaluasi awal dari kandidat FLUX 3 awal.

Hasil ini menjanjikan, tetapi BFL mencatat bahwa model dan kerangka evaluasinya masih dalam pengembangan. Oleh karena itu, hasil tersebut harus diperlakukan sebagai evaluasi awal yang dijalankan vendor, bukan benchmark produksi independen.

Skor preferensi juga tidak menunjukkan bagaimana model berkinerja terkait latensi API, keandalan, throughput, kegagalan teknis, atau konsistensi di antara generasi berulang.

Begitu akses API FLUX 3 yang lebih luas tersedia, tim sebaiknya menjalankan prompt yang sama pada FLUX 3 dan model yang sudah ada di bawah kondisi uji yang konsisten.

How Can Developers Access FLUX 3?

Per tanggal July 24, 2026, FLUX 3 tersedia melalui program Early Access berbasis aplikasi dari Black Forest Labs, bukan akses API publik umum.

Pengembang yang ingin menguji model dapat mendaftar melalui halaman resmi FLUX 3.

CometAPI berencana mendukung FLUX 3 setelah ketersediaan API dan spesifikasi integrasinya dikonfirmasi secara resmi. Ini memungkinkan pengembang mengakses FLUX 3 bersama model AI lainnya melalui infrastruktur API yang sama tanpa harus membangun integrasi terpisah dari nol.

Sementara itu, tim dapat terus membangun menggunakan model yang sudah tersedia melalui CometAPI:

Kasus Penggunaan AndaModel dan Sumber Daya yang Direkomendasikan
Pembuatan video AIMulai dengan Veo 3 atau jelajahi Seedance, Kling, Sora, Runway, dan model lainnya melalui CometAPI Video Generation API.
Video dengan audio nativeEvaluasi Veo 3 untuk pembuatan video dengan dialog tersinkron, efek suara, dan audio ambient.
Pembuatan dan pengeditan gambarGunakan keluarga FLUX.2 yang dirilis melalui panduan integrasi API FLUX.2 atau uji FLUX.2 Pro.
Alur kerja open-weightJelajahi FLUX.2 Dev sambil menunggu bobot, lisensi, dan persyaratan perangkat keras FLUX 3 Dev.
Perbandingan FLUX 3 di masa depanBangun benchmark yang dapat digunakan ulang menggunakan kerangka evaluasi di bawah ini, lalu jalankan pengujian yang sama saat akses FLUX 3 diperluas.

Pendekatan ini memungkinkan pengembang terus mengirim fitur hari ini dengan alternatif yang sesuai sambil tetap siap mengevaluasi atau mengintegrasikan FLUX 3 saat akses API yang lebih luas tersedia.

How to Evaluate the FLUX 3 API After Release

Tim yang tertarik pada FLUX 3 dapat menyiapkan benchmark sebelum akses API publik tiba.

Sekumpulan uji yang representatif harus mencakup beban kerja yang paling penting bagi produk:

Kelompok UjiApa yang Diukur
Kepatuhan terhadap promptObjek yang diwajibkan, aksi, instruksi kamera, dan pengecualian
Konsistensi karakterIdentitas, pakaian, proporsi, dan suara
Gerakan fisikKontak, bobot, lintasan, dan kontinuitas
Audio nativeSinkron bibir, akurasi dialog, timing, dan ambience
Pengeditan dan referensiReferensi gambar, transformasi video, keyframe, dan kelanjutan
Tipografi dan keluaran multibahasaEjaan, stabilitas tata letak, animasi, dan akurasi bahasa

Untuk setiap permintaan, lacak:

  • prompt dan aset referensi;
  • versi model dan endpoint;
  • resolusi, durasi, dan rasio aspek;
  • latensi antrean, generasi, dan pengiriman;
  • kegagalan teknis dan penolakan safety;
  • skor penerimaan manusia;
  • pola kegagalan umum pada visual, gerakan, teks, dan audio.

Jalankan prompt penting beberapa kali.

Video generatif bersifat stokastik, dan satu keluaran yang kuat tidak serta merta berarti model cukup andal untuk produksi. Pengujian berulang mengungkap konsistensi dan pola kegagalan yang mungkin tersembunyi oleh demo yang dipoles.

Saat FLUX 3 tersedia secara publik, jalankan beban kerja yang sama terhadap model yang sudah Anda gunakan. Ini menciptakan perbandingan yang lebih berguna daripada menggunakan prompt berbeda atau contoh pilihan untuk setiap model.

What Should Developers Watch Next?

Sebelum memperlakukan FLUX 3 sebagai siap produksi, perhatikan lima perkembangan kunci:

  1. Endpoint API publik yang stabil dan ID model produksi.
  2. Resolusi, durasi, frame rate, codec, dan kontrol audio native yang didukung.
  3. Batas laju, konkurensi, perilaku antrean, dan latensi generasi.
  4. Ketentuan penggunaan komersial, moderasi konten, privasi, dan retensi data.
  5. Bobot FLUX 3 Dev, ukuran parameter, persyaratan perangkat keras, dan detail lisensi.

Detail-detail ini akan menentukan apakah FLUX 3 bukan hanya keluarga model yang mengesankan, tetapi juga opsi yang praktis untuk aplikasi produksi.

FAQ

Is the FLUX 3 API available?

Per tanggal July 24, 2026, FLUX 3 belum tersedia secara umum sebagai API publik. Model ini diluncurkan melalui program Early Access bertahap, dan pengembang dapat mendaftar melalui halaman FLUX 3 Black Forest Labs resmi.

How can I access FLUX 3 Video?

Pengembang dan perusahaan dapat mendaftar Early Access FLUX 3 Video melalui halaman model FLUX 3 resmi.

Does FLUX 3 generate video with audio?

Ya. FLUX 3 Video menghasilkan audio native bersamaan dengan video dan mendukung kapabilitas seperti dialog multibahasa, kelanjutan audiovisual, dan suara yang tersinkron dengan peristiwa visual. BFL menyebut satu generasi dapat mencapai 20 detik.

What is FLUX 3 Dev?

FLUX 3 Dev adalah versi open-weight yang direncanakan dari backbone multimodal FLUX 3. BFL belum memublikasikan bobot model, ukuran parameter, persyaratan perangkat keras, tanggal rilis, atau ketentuan lisensinya.

What is the difference between FLUX 3 and FLUX.2?

FLUX.2 berfokus pada pembuatan dan pengeditan gambar untuk produksi. FLUX 3 memperluas arsitektur menjadi multimodal yang mencakup gambar, video, audio native, dan prediksi aksi.

Final Thoughts

FLUX 3 layak untuk dipantau, khususnya bagi pengembang yang tertarik pada pembuatan video dengan audio native dan alur kerja multimodal yang lebih luas.

Untuk saat ini, pendekatan praktis adalah terus membangun dan melakukan benchmarking dengan model yang tersedia sambil menyiapkan set evaluasi yang dapat digunakan ulang. Saat akses API FLUX 3 diperluas, tim dapat menjalankan prompt yang sama di berbagai model dan membandingkan kualitas keluaran, konsistensi, latensi, keandalan, dan pola kegagalan umum.

Siap mengintegrasikan pembuatan video hari ini? Jelajahi CometAPI Video Generation API untuk bekerja dengan model yang saat ini tersedia.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya