Thông số kỹ thuật của flux-kontext-max
| Thông số | Chi tiết |
|---|---|
| ID mô hình | flux-kontext-max |
| Nhà cung cấp / họ mô hình | Black Forest Labs FLUX.1 Kontext [max] |
| Phương thức chính | Tạo ảnh và chỉnh sửa ảnh từ đầu vào văn bản và hình ảnh |
| Trường hợp sử dụng chính | Tạo ảnh trong ngữ cảnh, chỉnh sửa cục bộ, biến đổi toàn cảnh, và thao tác hình ảnh dựa trên văn bản |
| Cấp chất lượng | Biến thể cao cấp / chất lượng tối đa trong họ FLUX.1 Kontext |
| Đầu vào nhắc lệnh | Nhắc lệnh văn bản cùng với (tùy chọn) hình ảnh đầu vào cho quy trình chỉnh sửa và biến đổi |
| Độ phân giải đầu ra | Cố định ở 1 megapixel với tỷ lệ khung hình linh hoạt |
| Giá tham khảo | 8 tín dụng mỗi ảnh, được Black Forest Labs niêm yết là $0.08 mỗi ảnh |
| Lưu ý về mức đồng thời | Tài liệu trợ giúp của Black Forest Labs liệt kê flux-kontext-max ở mức 6 tác vụ đang hoạt động, thấp hơn mức đồng thời mặc định của tài khoản là 24 |
flux-kontext-max là gì?
flux-kontext-max là định danh nền tảng của CometAPI cho FLUX.1 Kontext [max] của Black Forest Labs, một mô hình hình ảnh cao cấp được thiết kế cho cả tạo ảnh từ văn bản và chỉnh sửa ảnh trong cùng một hệ thống. Thay vì coi tạo và chỉnh sửa là các công cụ tách biệt, dòng Kontext được xây dựng cho các quy trình trong ngữ cảnh, nơi người dùng có thể cung cấp hướng dẫn bằng văn bản, tùy chọn kèm một hình ảnh, rồi tinh chỉnh, chỉnh sửa hoặc đổi phong cách kết quả qua nhiều lượt.
Biến thể [max] được định vị là tùy chọn chất lượng cao nhất trong dòng FLUX.1 Kontext. Black Forest Labs mô tả đây là mô hình cao cấp với hiệu năng tối đa, khả năng tuân thủ nhắc lệnh tốt hơn, khả năng tạo kiểu chữ mạnh hơn, và độ nhất quán cao cấp khi chỉnh sửa, đồng thời vẫn hỗ trợ các vòng lặp nhanh.
Trên thực tế, flux-kontext-max hướng tới các đội ngũ cần nhiều hơn khả năng tổng hợp ảnh cơ bản. Nó hữu ích cho hình ảnh nhất quán theo thương hiệu, chỉnh sửa giữ nguyên nhân vật, bản địa hóa các thay đổi trên ảnh hiện có, phong cách hóa, và thay thế văn bản trong cảnh như biển hiệu, nhãn hoặc các thành phần giống giao diện.
Tính năng chính của flux-kontext-max
- Tạo và chỉnh sửa hợp nhất: Hỗ trợ cả tạo ảnh từ nhắc lệnh và chỉnh sửa ảnh hiện có trong cùng một quy trình mô hình, giúp đơn giản hóa thiết kế ứng dụng cho công cụ sáng tạo và dây chuyền sản xuất.
- Cấp Kontext chất lượng tối đa: Biến thể
[max]là lựa chọn cao cấp của FLUX.1 Kontext, nhắm đến chất lượng đầu ra tốt nhất, tuân thủ nhắc lệnh mạnh hơn, và độ nhất quán cao khi chỉnh sửa. - Tính nhất quán nhân vật: Được thiết kế để giữ lại danh tính và các đặc trưng trực quan có thể nhận biết qua nhiều cảnh và các lần chỉnh sửa lặp, hữu ích cho kể chuyện, tài sản marketing và chiến dịch đa ảnh.
- Chỉnh sửa chính xác cục bộ: Có thể thay đổi các phần cụ thể của ảnh trong khi giữ nguyên bố cục xung quanh, cho phép thay thế đối tượng có mục tiêu, điều chỉnh cảnh hoặc dọn dẹp chọn lọc.
- Biến đổi cảnh trong ngữ cảnh: Cho phép nhà phát triển biến đổi các thành phần của ảnh hiện có trong khi giữ cho mối quan hệ của chúng với toàn cảnh thống nhất, thay vì tái tạo toàn bộ cảnh một cách mù quáng.
- Thế mạnh về kiểu chữ và chỉnh sửa văn bản: Black Forest Labs nhấn mạnh khả năng tạo kiểu chữ được cải thiện, và tài liệu trợ giúp nêu rõ chỉnh sửa và thay thế văn bản trong biển hiệu và nhãn là một khả năng chủ chốt.
- Tỷ lệ khung hình linh hoạt với đầu ra cố định 1 megapixel: Đầu ra được tạo ở độ phân giải cố định 1 megapixel, với linh hoạt lựa chọn tỷ lệ khung hình cho các bề mặt sản phẩm và định dạng sáng tạo khác nhau.
- Định giá theo ảnh có thể dự đoán: Black Forest Labs niêm yết mô hình ở mức 8 tín dụng hoặc $0.08 mỗi ảnh, giúp ước tính chi phí dễ dàng cho tạo và chỉnh sửa theo lô.
Cách truy cập và tích hợp flux-kontext-max
Bước 1: Đăng ký để lấy API Key
Bắt đầu bằng cách tạo tài khoản trên CometAPI và tạo API key từ bảng điều khiển. Sau đó, lưu khóa một cách an toàn dưới dạng biến môi trường để ứng dụng của bạn có thể xác thực các yêu cầu tới API.
Bước 2: Gửi yêu cầu tới API flux-kontext-max
Khi đã có API key, hãy gửi yêu cầu tới endpoint tương thích với OpenAI của CometAPI và đặt trường model thành flux-kontext-max.
curl --request POST \
--url https://api.cometapi.com/v1/images/generations \
--header "Authorization: Bearer $COMETAPI_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "flux-kontext-max",
"prompt": "Create a cinematic product-style image of a smartwatch on a reflective black surface with dramatic studio lighting"
}'
Bạn cũng có thể tích hợp bằng định dạng SDK của OpenAI:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.COMETAPI_API_KEY,
baseURL: "https://api.cometapi.com/v1"
});
const result = await client.images.generate({
model: "flux-kontext-max",
prompt: "Create a cinematic product-style image of a smartwatch on a reflective black surface with dramatic studio lighting"
});
console.log(result);
Bước 3: Truy xuất và kiểm tra kết quả
Sau khi gửi, hãy phân tích phản hồi API và lấy ảnh được tạo do nền tảng trả về. Tiếp đó, bạn nên kiểm tra chất lượng đầu ra, mức độ tuân thủ nhắc lệnh và bất kỳ chỉnh sửa hoặc chi tiết kiểu chữ được yêu cầu trước khi sử dụng trong quy trình sản xuất. Với khối lượng lớn, cũng cần tính đến hành vi đồng thời phía nhà cung cấp; Black Forest Labs ghi nhận giới hạn 6 tác vụ đang hoạt động cho flux-kontext-max.