Specyfikacja techniczna flux-kontext-max
| Specyfikacja | Szczegóły |
|---|---|
| Identyfikator modelu | flux-kontext-max |
| Dostawca / rodzina modeli | Black Forest Labs FLUX.1 Kontext [max] |
| Główna modalność | Generowanie obrazów i edycja obrazów na podstawie wejść tekstowych i obrazów |
| Kluczowe zastosowanie | Generowanie obrazów w kontekście, lokalne edycje, transformacje całej sceny oraz manipulacja obrazem oparta na tekście |
| Poziom jakości | Wariant premium / maksymalnej jakości w rodzinie FLUX.1 Kontext |
| Dane wejściowe do promptów | Prompty tekstowe oraz opcjonalne obrazy wejściowe do edycji i transformacji |
| Rozdzielczość wyjściowa | Stała 1 megapiksel przy elastycznych proporcjach obrazu |
| Informacja o cenach | 8 kredytów za obraz, według Black Forest Labs $0.08 za obraz |
| Uwaga dotycząca współbieżności | Dokumentacja pomocy Black Forest Labs podaje dla flux-kontext-max 6 aktywnych zadań, mniej niż domyślny limit współbieżności konta wynoszący 24 |
Czym jest flux-kontext-max?
flux-kontext-max to identyfikator platformy CometAPI dla FLUX.1 Kontext [max] firmy Black Forest Labs, premiumowego modelu obrazowego zaprojektowanego zarówno do generowania obrazów z tekstu, jak i do edycji obrazów w jednym systemie. Zamiast traktować generowanie i edycję jako oddzielne narzędzia, rodzina Kontext jest zbudowana z myślą o przepływach pracy w kontekście, w których użytkownicy mogą przekazywać instrukcje tekstowe, opcjonalnie dołączać obraz, a następnie w wielu iteracjach dopracowywać, modyfikować lub zmieniać styl wyniku.
Wariant [max] jest pozycjonowany jako opcja najwyższej jakości w linii FLUX.1 Kontext. Black Forest Labs opisuje go jako model premium o maksymalnej wydajności, z lepszą zgodnością z promptem, silniejszym generowaniem typografii i wyższą spójnością podczas edycji, przy jednoczesnym wsparciu szybkich, iteracyjnych przepływów pracy.
W praktyce flux-kontext-max jest skierowany do zespołów, które potrzebują czegoś więcej niż podstawowa synteza obrazów. Sprawdza się przy tworzeniu wizualizacji spójnych z marką, edycjach zachowujących tożsamość postaci, lokalnych zmianach w istniejących obrazach, stylizacji oraz wymianie tekstu w scenach, takich jak szyldy, etykiety czy elementy wizualne przypominające interfejs.
Główne funkcje flux-kontext-max
- Zunifikowane generowanie i edycja: Obsługuje zarówno tworzenie obrazów na podstawie promptów, jak i edycję istniejących obrazów w tym samym przepływie pracy modelu, co upraszcza projektowanie aplikacji dla narzędzi kreatywnych i środowisk produkcyjnych.
- Poziom Kontext o maksymalnej jakości: Wariant
[max]to oferta premium FLUX.1 Kontext, przeznaczona do najlepszej jakości wyników, lepszej zgodności z promptem oraz wyższej spójności edycji. - Spójność postaci: Zaprojektowany, aby zachowywać tożsamość i rozpoznawalne cechy wizualne w wielu scenach i iteracyjnych edycjach, co jest cenne dla opowiadania historii, materiałów marketingowych i kampanii wieloobrazowych.
- Precyzyjna edycja lokalna: Umożliwia modyfikowanie konkretnych części obrazu przy zachowaniu otaczającej kompozycji, co pozwala na celowane podmiany obiektów, dostrajanie sceny lub selektywne czyszczenie.
- Transformacja sceny w kontekście: Pozwala przekształcać elementy istniejącego obrazu, zachowując ich relacje z szerszą sceną, zamiast ślepego regenerowania całego obrazu.
- Mocne strony w typografii i edycji tekstu: Black Forest Labs podkreśla ulepszone generowanie typografii, a w dokumentacji pomocy wyraźnie wskazuje edycję i podmianę tekstu na znakach i etykietach jako kluczową funkcję.
- Elastyczne proporcje przy stałej rozdzielczości 1 MP: Wyniki generowane są w stałej rozdzielczości 1 megapiksela, z możliwością wyboru różnych proporcji dla rozmaitych powierzchni produktowych i formatów kreatywnych.
- Przewidywalna cena za obraz: Black Forest Labs wycenia model na 8 kredytów lub $0.08 za obraz, co ułatwia szacowanie kosztów dla wsadów generowania i edycji.
Jak uzyskać dostęp i zintegrować flux-kontext-max
Krok 1: Zarejestruj się po klucz API
Aby rozpocząć, utwórz konto w CometAPI i wygeneruj klucz API z pulpitu nawigacyjnego. Następnie bezpiecznie przechowuj klucz jako zmienną środowiskową, aby Twoja aplikacja mogła uwierzytelniać żądania do API.
Krok 2: Wysyłaj żądania do interfejsu API flux-kontext-max
Gdy masz już klucz API, wysyłaj żądania do zgodnego z OpenAI punktu końcowego CometAPI i ustaw pole model na flux-kontext-max.
curl --request POST \
--url https://api.cometapi.com/v1/images/generations \
--header "Authorization: Bearer $COMETAPI_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "flux-kontext-max",
"prompt": "Create a cinematic product-style image of a smartwatch on a reflective black surface with dramatic studio lighting"
}'
Możesz też zintegrować to, korzystając z formatu SDK OpenAI:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.COMETAPI_API_KEY,
baseURL: "https://api.cometapi.com/v1"
});
const result = await client.images.generate({
model: "flux-kontext-max",
prompt: "Create a cinematic product-style image of a smartwatch on a reflective black surface with dramatic studio lighting"
});
console.log(result);
Krok 3: Odbierz i zweryfikuj wyniki
Po wysłaniu przeanalizuj odpowiedź API i pobierz wygenerowany obraz zwrócony przez platformę. Następnie zweryfikuj jakość wyjścia, zgodność z promptem oraz wszelkie żądane edycje czy szczegóły typografii, zanim użyjesz wyniku w procesach produkcyjnych. Przy dużej skali uwzględnij też zachowanie współbieżności po stronie dostawcy; Black Forest Labs dokumentuje limit 6 aktywnych zadań dla flux-kontext-max.