Funzionalità principali (cosa fa Flux.2 Dev)
- Generazione Testo→Immagine con elevata aderenza al prompt e resa tipografica/micro‑dettagli migliorata.
- Editing multi‑reference — combina più immagini di riferimento in un unico output, preservando la coerenza di identità/stile
- Un unico checkpoint per generazione + editing (non è richiesto un modello di editing separato).
- Ampio checkpoint open‑weight (32B) che consente ricerca locale, quantizzazione e adattamento da parte della community.)
- VAE ottimizzato per un migliore compromesso tra capacità di apprendimento, qualità e compressione (abilita editing/output a 4MP).
Dettagli tecnici (architettura e ingegneria)
- Conteggio dei parametri: 32 miliardi di parametri per il checkpoint FLUX.2.
- Progettazione di base: latent flow‑matching / rectified flow transformer combinato con un modello visione‑linguaggio (BFL afferma che accoppiano un VLM Mistral-3 24B con il backbone transformer per il grounding semantico). Il VLM apporta conoscenza del mondo e grounding testuale mentre il transformer modella la struttura spaziale/composizionale.
- VAE: nuovo VAE di FLUX.2 (rilasciato sotto Apache-2.0) riaddestrato per migliorare la fedeltà di ricostruzione e l’apprendibilità delle variabili latenti, abilitando l’editing ad alta risoluzione.
- Campionamento e distillazione: addestrato usando tecniche di distillazione guidata per migliorare efficienza e fedeltà in inferenza.
Prestazioni nei benchmark
Black Forest Labs ha pubblicato valutazioni comparative e grafici che mostrano le prestazioni di FLUX.2 rispetto a modelli di immagini open‑weight e hosted contemporanei. Dati principali pubblicati (BFL / sintesi stampa):
- Tasso di vittoria da testo a immagine: FLUX.2 ~66.6% (vs. Qwen-Image 51.3%, Hunyuan ~48.1% nel dataset head‑to‑head di BFL).
- Tasso di vittoria per editing a riferimento singolo: FLUX.2 ~59.8% (vs. Qwen-Image 49.3%, FLUX.1 Kontext ~41.2%).
- Tasso di vittoria per editing multi‑reference: FLUX.2 ~63.6% (vs. Qwen-Image 36.4%). BFL riporta inoltre capacità multi‑reference fino a 10 riferimenti nella loro suite di valutazione.
Casi d’uso tipici / raccomandati
- Varianti di immagini per advertising e marketing in cui lo stesso modello/attore/prodotto deve rimanere coerente su molte scene o sfondi (coerenza multi‑reference).
- Fotografia di prodotto e virtual try‑on (preservare i dettagli del prodotto tra diversi sfondi).
- Servizi editoriali/moda che richiedono la stessa identità in molti scatti.
- Prototipazione rapida e ricerca (il checkpoint dev consente sperimentazione, fine‑tuning e workflow con LoRA/adapter).
Come accedere all’API Flux.2 dev
Passaggio 1: Registrati per ottenere la chiave API
Accedi a cometapi.com. Se non sei ancora nostro utente, registrati prima. Accedi alla tua Console CometAPI. Ottieni la chiave API di accesso all’interfaccia. Fai clic su “Add Token” nella sezione API token del centro personale, ottieni la chiave token: sk-xxxxx e invia.

Passaggio 2: Invia richieste all’API Flux.2 dev
Seleziona l’endpoint “black-forest-labs/flux-2-dev ” per inviare la richiesta API e imposta il corpo della richiesta. Il metodo di richiesta e il corpo della richiesta sono reperibili nella documentazione API del nostro sito. Il nostro sito fornisce anche test su Apifox per tua comodità. Sostituisci <YOUR_API_KEY> con la tua chiave CometAPI effettiva del tuo account.
Inserisci la tua domanda o richiesta nel campo content — è a questo che il modello risponderà . Elabora la risposta dell’API per ottenere la risposta generata.
Passaggio 3: Recupera e verifica i risultati
Elabora la risposta dell’API per ottenere la risposta generata. Dopo l’elaborazione, l’API risponde con lo stato dell’attività e i dati di output.
CometAPI ora supporta i modelli in formato Replicate: 🔹 black-forest-labs/flux-2-pro 🔹 black-forest-labs/flux-2-dev 🔹 black-forest-labs/flux-2-flex
Promozione a tempo limitato: prezzi inferiori a quelli ufficiali di Replicate!
👇 Inizia a costruire ora Crea predizioni – Documentazione API
⚡ Selezione flessibile:
- Pro: Progettato per una produzione ad alta efficienza e consegne rapide.
- Flex: Massimizza la qualità dell’immagine con parametri regolabili.
- Dev: Ottimizzazione a misura di sviluppatore.