คุณสมบัติหลัก (สิ่งที่ Flux.2 Dev ทำ)
- การสร้าง ข้อความ→ภาพ ด้วยการยึดตามพรอมต์สูงและการจัดวางตัวอักษร/การเรนเดอร์รายละเอียดเล็กๆ ที่ดีขึ้น
- การแก้ไขแบบหลายเรเฟอเรนซ์ — ผสานภาพอ้างอิงหลายภาพเป็นผลลัพธ์เดียว โดยคงความสอดคล้องของอัตลักษณ์/สไตล์
- เช็คพอยต์เดียวสำหรับการสร้าง + การแก้ไข (ไม่ต้องใช้โมเดลแก้ไขแยกต่างหาก).
- เช็คพอยต์น้ำหนักแบบเปิดขนาดใหญ่ (32B) อนุญาตให้วิจัยภายในเครื่อง การควอนไทซ์ และการปรับใช้โดยชุมชน.)
- VAE ที่ปรับแต่งให้เหมาะสม เพื่อสมดุลการเรียนรู้–คุณภาพ–การบีบอัดที่ดีขึ้น (รองรับการแก้ไข/เอาต์พุต 4MP).
รายละเอียดทางเทคนิค (สถาปัตยกรรมและวิศวกรรม)
- จำนวนพารามิเตอร์: 32 พันล้านพารามิเตอร์สำหรับเช็คพอยต์ FLUX.2
- การออกแบบแกนหลัก: latent flow-matching / rectified flow transformer ผสานกับโมเดลวิชั่น-ภาษา (BFL ระบุว่าพวกเขาจับคู่ Mistral-3 24B VLM เข้ากับโครงหลักของทรานส์ฟอร์เมอร์เพื่อยึดโยงความหมาย) โดย VLM ช่วยเสริมความรู้เกี่ยวกับโลกและการยึดโยงเชิงข้อความ ขณะที่ทรานส์ฟอร์เมอร์จำลองโครงสร้างเชิงพื้นที่/องค์ประกอบ
- VAE: FLUX.2 VAE ใหม่ (เผยแพร่ภายใต้ Apache-2.0) ฝึกใหม่เพื่อเพิ่มความเที่ยงตรงในการสร้างกลับและความสามารถในการเรียนรู้ของ latent ช่วยให้แก้ไขความละเอียดสูงได้
- การสุ่มตัวอย่างและการกลั่น: ฝึกด้วยเทคนิค guidance-distillation เพื่อเพิ่มประสิทธิภาพการอนุมานและความเที่ยงตรง
ผลการทดสอบมาตรฐาน
Black Forest Labs เผยแพร่การประเมินเชิงเปรียบเทียบและกราฟแสดงประสิทธิภาพของ FLUX.2 เมื่อเทียบกับโมเดลภาพแบบ open-weight และแบบโฮสต์ร่วมสมัย ตัวเลขสำคัญที่เผยแพร่ (BFL / สรุปจากสื่อ):
- อัตราการชนะ Text-to-image: FLUX.2 ~66.6% (เทียบกับ Qwen-Image 51.3%, Hunyuan ~48.1% ในชุดข้อมูล head-to-head ของ BFL)
- อัตราการชนะการแก้ไขแบบเรเฟอเรนซ์เดี่ยว: FLUX.2 ~59.8% (เทียบกับ Qwen-Image 49.3%, FLUX.1 Kontext ~41.2%).
- อัตราการชนะการแก้ไขแบบหลายเรเฟอเรนซ์: FLUX.2 ~63.6% (เทียบกับ Qwen-Image 36.4%). BFL รายงานด้วยว่าความสามารถแบบหลายเรเฟอเรนซ์รองรับได้สูงสุดถึง 10 เรเฟอเรนซ์ ในชุดการประเมินของพวกเขา
กรณีใช้งานทั่วไป / ข้อแนะนำ
- ภาพโฆษณาและการตลาดหลายเวอร์ชัน ซึ่งโมเดล/นักแสดง/สินค้าเดียวกันต้องคงความสอดคล้องข้ามหลายฉากหรือพื้นหลัง (ความสอดคล้องแบบหลายเรเฟอเรนซ์)
- ภาพถ่ายสินค้า & การลองเสมือน (คงรายละเอียดสินค้าข้ามพื้นหลัง)
- งานบรรณาธิการ/แฟชั่นสเปรด ที่ต้องการอัตลักษณ์เดียวกันในหลายช็อต
- การทำต้นแบบอย่างรวดเร็วและงานวิจัย (เช็คพอยต์ dev อนุญาตให้ทดลอง ปรับจูน และเวิร์กโฟลว์ LoRA/อแดปเตอร์)
วิธีเข้าถึง Flux.2 dev API
ขั้นตอนที่ 1: สมัครเพื่อรับ API Key
เข้าสู่ระบบที่ cometapi.com หากคุณยังไม่เป็นผู้ใช้ของเรา โปรดลงทะเบียนก่อน ลงชื่อเข้าใช้คอนโซล CometAPI รับ API key สิทธิ์เข้าถึงของอินเทอร์เฟซ คลิก “Add Token” ที่ API token ในศูนย์ส่วนบุคคล รับคีย์โทเคน: sk-xxxxx และส่ง

ขั้นตอนที่ 2: ส่งคำขอไปยัง Flux.2 dev API
เลือกเอ็นด์พอยต์ “black-forest-labs/flux-2-dev” เพื่อส่งคำขอ API และตั้งค่า request body วิธีการร้องขอและ request body สามารถดูได้จากเอกสาร API บนเว็บไซต์ของเรา เว็บไซต์ของเรายังมีการทดสอบผ่าน Apifox เพื่อความสะดวก แทนที่ <YOUR_API_KEY> ด้วย CometAPI key จริงจากบัญชีของคุณ
ใส่คำถามหรือคำขอของคุณลงในช่อง content—นี่คือสิ่งที่โมเดลจะตอบกลับ . ประมวลผล API response เพื่อรับคำตอบที่สร้างขึ้น
ขั้นตอนที่ 3: เรียกและตรวจสอบผลลัพธ์
ประมวลผล API response เพื่อรับคำตอบที่สร้างขึ้น หลังการประมวลผล API จะตอบกลับด้วยสถานะงานและข้อมูลผลลัพธ์
CometAPI ขณะนี้รองรับโมเดลรูปแบบ Replicate: 🔹 black-forest-labs/flux-2-pro 🔹 black-forest-labs/flux-2-dev 🔹 black-forest-labs/flux-2-flex
โปรโมชันจำกัดเวลา: ราคาต่ำกว่าราคาอย่างเป็นทางการของ Replicate!
👇 เริ่มสร้างตอนนี้ สร้างการพยากรณ์ – เอกสาร API
⚡ ตัวเลือกที่ยืดหยุ่น:
- Pro: ออกแบบเพื่อการผลิตที่มีประสิทธิภาพสูงและส่งมอบรวดเร็ว
- Flex: เพิ่มคุณภาพภาพให้สูงสุดด้วยพารามิเตอร์ที่ปรับได้
- Dev: ปรับแต่งเหมาะกับนักพัฒนา