FLUX.2 [flex] là gì
FLUX.2 [flex] là biến thể “kiểm soát linh hoạt” trong họ FLUX.2 của Black Forest Labs: một mô hình văn bản→ảnh và chỉnh sửa ảnh hướng sản xuất, cho phép điều chỉnh các tham số suy luận (steps, guidance scale, seed) để nhà phát triển cân đối tốc độ và độ trung thực, cũng như tinh chỉnh chính xác hành vi về kiểu chữ/chi tiết mịn. Flex hỗ trợ chỉnh sửa đa tham chiếu (tối đa 10 ảnh tham chiếu trong gói Flex), chỉnh sửa đến ~4 megapixel.
FLUX.2 [flex] phù hợp để làm gì
- Kiểm soát chính xác giữa chất lượng và tốc độ (người dùng chọn số bước suy luận và hệ số hướng dẫn).
- Dựng chữ/typography vượt trội so với nhiều đối thủ — được khuyến nghị cho poster, bản mẫu UI, infographic.
- Chỉnh sửa đa tham chiếu: kết hợp và bảo toàn các yếu tố nhận diện/thương hiệu trên tối đa 10 ảnh đầu vào (Flex), với ánh sáng và vật liệu nhất quán.
- Độ phân giải gốc cao & chỉnh sửa: đầu ra đến 4MP; vùng hoạt động khuyến nghị ≤2MP cho hầu hết quy trình.
- Hỗ trợ prompt có cấu trúc: prompt JSON hoặc ngôn ngữ tự nhiên; “prompt upsampling” có thể tự động làm phong phú các prompt ngắn.
So sánh FLUX.2 [flex] với các đối thủ
Bảng ngắn (tóm tắt):
- Nano Banana Pro (Google / tên nội bộ; đối thủ độ trung thực cao): độ trung thực gốc tương tự ở độ phân giải cao; Nano Banana nhắm tới đầu ra lớn hơn trong một số bản dựng nhà cung cấp; so sánh của người dùng cho thấy tính chân thực tương đương nhưng khác biệt về hành vi theo prompt và tính nhất quán khi chỉnh sửa.
- Qwen-Image / Hunyuan Image: FLUX.2 được báo cáo có tỷ lệ thắng chủ quan cao hơn trong so sánh lúc ra mắt trên các nhiệm vụ văn bản→ảnh và chỉnh sửa đa tham chiếu (xem tin bài khi ra mắt).
- Midjourney / Commercial SaaS: Midjourney thường dùng chuỗi xử lý nâng cấp độ phân giải để cạnh tranh về số điểm ảnh cuối; FLUX.2 nhấn mạnh đầu ra độ phân giải gốc cao và chỉnh sửa đa tham chiếu chặt chẽ hơn. Các đánh giá độc lập ghi nhận những đánh đổi về phong cách bố cục và mức độ chi tiết điểm ảnh gốc.
Kết luận thực tiễn: điểm bán hàng của FLUX.2 là chỉnh sửa đa tham chiếu, khả năng xử lý chữ robust, và một họ endpoint cho phép đội ngũ chọn điểm cân bằng thông lượng/chất lượng/chi phí. Người thử nghiệm độc lập đánh giá nó cạnh tranh với các mẫu hàng đầu trong cùng giai đoạn phát hành.
Tham số chỉ dành cho [flex]:
| Tham số | Kiểu | Mặc định | Mô tả |
|---|---|---|---|
| steps | số nguyên | 50 | [chỉ flex] Số bước suy luận. Tối đa: 50, mặc định: 50. Cao hơn = chi tiết hơn, chậm hơn. |
| guidance | số thực | 4.5 | [chỉ flex] Hệ số hướng dẫn. Kiểm soát mức độ đầu ra bám sát prompt. Tối thiểu: 1.5, tối đa: 10, mặc định: 4.5. Cao hơn = bám sát prompt hơn. |
Cách truy cập Flux.2 Flex API
Bước 1: Đăng ký lấy API Key
Đăng nhập vào cometapi.com. Nếu bạn chưa phải là người dùng, vui lòng đăng ký trước. Đăng nhập vào Bảng điều khiển CometAPI. Lấy khóa API truy cập của giao diện. Nhấp “Add Token” tại mục API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu tới Flux.2 Flex API
Chọn endpoint “flux-2-flex” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức và phần thân yêu cầu được lấy từ tài liệu API trên trang web của chúng tôi. Trang web cũng cung cấp Apifox để bạn thuận tiện kiểm thử. Thay thế <YOUR_API_KEY> bằng CometAPI key thực tế từ tài khoản của bạn. base url is flux generate image(https://api.cometapi.com/flux/v1/flux-2-flex)
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đó là nội dung mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo ra.
Bước 3: Truy xuất và xác minh kết quả
Sau khi tạo, bạn có thể dùng endpoint /flux/v1/get_result để truy vấn ảnh đã tạo hoặc giám sát trạng thái tiến trình. Sau khi xử lý, API phản hồi trạng thái tác vụ và dữ liệu đầu ra.
👇 Bắt đầu xây dựng ngay Flux image generation – Tài liệu API