Kluczowe funkcje (co robi Flux.2 Dev)
- Generowanie tekst→obraz z wysoką zgodnością z promptem oraz ulepszoną typografią / renderowaniem drobnych detali.
- Edycja wieloreferencyjna — łączenie wielu obrazów referencyjnych w jeden wynik przy zachowaniu spójności tożsamości/stylu.
- Jeden checkpoint do generowania + edycji (nie jest wymagany osobny model do edycji).
- Duży checkpoint open-weight (32B) umożliwiający lokalne badania, kwantyzację i adaptację przez społeczność.)
- Zoptymalizowane VAE dla lepszego kompromisu łatwość uczenia–jakość–kompresja (umożliwia edycję/wyjścia 4MP).
Szczegóły techniczne (architektura i inżynieria)
- Liczba parametrów: 32 miliardy parametrów dla checkpointu FLUX.2.
- Konstrukcja rdzeniowa: dopasowywanie przepływu w przestrzeni utajonej / transformer skorygowanego przepływu połączony z modelem wizyjno-językowym (BFL podaje, że łączą Mistral-3 24B VLM z kręgosłupem transformera dla semantycznego zakotwiczenia). VLM dostarcza wiedzy o świecie i zakotwiczenia tekstowego, podczas gdy transformer modeluje strukturę przestrzenną/kompozycyjną.
- VAE: nowe FLUX.2 VAE (wydane na licencji Apache-2.0) ponownie wytrenowane w celu poprawy wierności rekonstrukcji i „uczalności” przestrzeni utajonej, co umożliwia edycję w wysokiej rozdzielczości.
- Próbkowanie i destylacja: trenowany z wykorzystaniem technik destylacji z prowadzeniem w celu poprawy wydajności wnioskowania i wierności.
Wydajność w benchmarkach
Black Forest Labs opublikowało porównawcze ewaluacje i wykresy pokazujące wyniki FLUX.2 względem współczesnych modeli obrazowych open-weight i hostowanych. Kluczowe opublikowane liczby (BFL / podsumowania prasowe):
- Wskaźnik zwycięstw w zadaniu tekst→obraz: FLUX.2 ~66.6% (vs. Qwen-Image 51.3%, Hunyuan ~48.1% w zestawie head-to-head BFL).
- Wskaźnik zwycięstw w edycji z pojedynczą referencją: FLUX.2 ~59.8% (vs. Qwen-Image 49.3%, FLUX.1 Kontext ~41.2%).
- Wskaźnik zwycięstw w edycji wieloreferencyjnej: FLUX.2 ~63.6% (vs. Qwen-Image 36.4%). BFL raportuje także obsługę nawet 10 referencji w swoim zestawie ewaluacyjnym.
Typowe / zalecane zastosowania
- Warianty obrazów do reklam i marketingu tam, gdzie ten sam model/aktor/produkt musi pozostać spójny w wielu scenach lub tłach (spójność wieloreferencyjna).
- Fotografia produktowa i wirtualne przymierzanie (zachowanie detali produktu na różnych tłach).
- Sesje editorial/modowe wymagające tej samej tożsamości na wielu ujęciach.
- Szybkie prototypowanie i badania (checkpoint dev pozwala na eksperymenty, fine-tuning oraz przepływy pracy LoRA/adapterów).
Jak uzyskać dostęp do interfejsu API Flux.2 dev
Krok 1: Zarejestruj się po klucz API
Zaloguj się na cometapi.com. Jeśli nie jesteś jeszcze naszym użytkownikiem, najpierw się zarejestruj. Zaloguj się do swojej konsoli CometAPI. Uzyskaj poświadczenie dostępu — klucz API interfejsu. Kliknij „Add Token” w tokenie API w centrum osobistym, pobierz klucz tokenu: sk-xxxxx i wyślij.

Krok 2: Wyślij żądania do interfejsu API Flux.2 dev
Wybierz endpoint „black-forest-labs/flux-2-dev”, aby wysłać żądanie API i ustaw ciało żądania. Metoda żądania i ciało żądania są dostępne w dokumentacji API na naszej stronie. Nasza strona udostępnia również test w Apifox dla Twojej wygody. Zastąp <YOUR_API_KEY> swoim rzeczywistym kluczem CometAPI z konta.
Wstaw swoje pytanie lub prośbę do pola content — na to odpowie model. Przetwórz odpowiedź API, aby uzyskać wygenerowaną odpowiedź.
Krok 3: Odbierz i zweryfikuj wyniki
Przetwórz odpowiedź API, aby uzyskać wygenerowaną odpowiedź. Po przetworzeniu API odpowiada statusem zadania i danymi wyjściowymi.
CometAPI teraz obsługuje modele w formacie Replicate: 🔹 black-forest-labs/flux-2-pro 🔹 black-forest-labs/flux-2-dev 🔹 black-forest-labs/flux-2-flex
Promocja ograniczona czasowo: taniej niż oficjalne ceny Replicate!
👇 Zacznij budować już teraz Utwórz predykcje – dokumentacja API
⚡ Elastyczny wybór:
- Pro: Zaprojektowana do wysoce wydajnej produkcji i szybkiej realizacji.
- Flex: Maksymalizuje jakość obrazu z regulowanymi parametrami.
- Dev: Optymalizacja przyjazna deweloperom.