Technische Spezifikationen von mj-turbo-describe
| Spezifikation | Details |
|---|---|
| Model ID | mj-turbo-describe |
| Provider / Family | Describe-Funktion von Midjourney, bereitgestellt über CometAPI mit der Plattform-Modellkennung mj-turbo-describe |
| Modalität | Bild-zu-Text-Prompt-Generierung |
| Primäre Funktion | Analysiert ein hochgeladenes Bild und gibt beschreibende Promptvorschläge zurück, die für die Bildgenerierung wiederverwendet werden können |
| Eingabetyp | Bild-Upload oder Bild-URL, abhängig von der Client-Implementierung |
| Ausgabetyp | Mehrere textbasierte Promptvorschläge, abgeleitet aus dem Eingabebild |
| Typische Anzahl der Ausgaben | Der Describe-Workflow von Midjourney liefert vier Promptvorschläge pro Bild |
| Interaktionsmuster | Asynchrone kreative Prompt-Generierung aus visuellen Eingaben |
| Am besten geeignet für | Reverse-Prompting, Ideenfindung für Prompts, Stilentdeckung, Remix-Workflows und das Umwandeln von Referenzvisuals in wiederverwendbare Text-Prompts |
| Plattformzugang | Verfügbar über CometAPI unter dem Modellcode mj-turbo-describe |
| Hinweise zum Upstream-Verhalten | Midjourney gibt an, dass Describe ein Bild-zu-Text-Tool ist, das dazu gedacht ist, Prompts zu inspirieren, statt das Ausgangsbild präzise zu reproduzieren; wiederholte Durchläufe mit demselben Bild können zu unterschiedlichen Vorschlägen führen. |
Was ist mj-turbo-describe?
mj-turbo-describe ist die Plattformkennung von CometAPI für die Describe-ähnliche Bild-zu-Text-Funktionalität von Midjourney. Anstatt aus einem Textprompt ein Bild zu generieren, arbeitet dieses Modell in umgekehrter Richtung: Es untersucht ein hochgeladenes Bild und schlägt Promptformulierungen vor, die visuelle Elemente, Stilhinweise und kreative Rahmungen erfassen. Midjourney beschreibt Describe offiziell als ein Tool, das ein Bild analysiert und Wörter sowie Phrasen anbietet, die als Prompt-Inspiration dienen können.
In der Praxis ist mj-turbo-describe damit nützlich für Nutzer, die bestehende Visuals in wiederverwendbare Prompt-Sprache verwandeln möchten. Es kann stilistisches Vokabular extrahieren, Kompositionsmuster identifizieren und die Experimentation beim Erstellen von Prompts für nachgelagerte Bildgenerierung beschleunigen. Midjourney weist zudem darauf hin, dass die Vorschläge eher inspirierend sind als exakte Repliken des Ausgangsbildes; das Modell ist daher als kreativer Prompt-Generator zu verstehen, nicht als strenges Captioning- oder forensisches Vision-System.
Da wiederholte Describe-Durchläufe für dasselbe Bild unterschiedliche Promptsets erzeugen können, eignet sich mj-turbo-describe besonders für iterative Ideations-Workflows, bei denen Variation erwünscht ist.
Hauptfunktionen von mj-turbo-describe
- Bild-zu-Prompt-Konvertierung: Wandelt ein Quellbild in Promptvorschläge um und erleichtert so den Übergang von visueller Inspiration zu promptfähigem Text.
- Mehrere Promptvorschläge: Liefert vier Promptvorschläge pro Bild und bietet damit mehrere kreative Richtungen statt einer einzigen starren Beschreibung.
- Unterstützung bei der Prompt-Ideenfindung: Hilft, Wörter und Phrasen für Stil, Stimmung, Komposition und Motiv zu entdecken, die man manuell möglicherweise nicht formuliert hätte.
- Nichtdeterministische kreative Variation: Erneutes Ausführen von Describe mit demselben Bild kann andere Promptvorschläge liefern – hilfreich für Brainstorming und Exploration.
- Referenzgetriebener Workflow: Unterstützt Workflows auf Basis hochgeladener Bilder oder Bildlinks und passt damit zu Kreativen, die von Skizzen, Fotos, Mood-Referenzen oder früheren Generierungen ausgehen.
- Schnelle Wiederverwendung in Generations-Pipelines: Die Describe-Ergebnisse von Midjourney sind zur unmittelbaren Wiederverwendung als Prompts gedacht und fügen sich gut in API-gesteuerte kreative Automatisierung ein.
- Stilentdeckung: Besonders nützlich, um in einem Referenzbild eingebettete visuelle Sprache zu identifizieren, einschließlich ästhetischer Hinweise, die künftige Generierungen anstoßen können.
Zugriff und Integration von mj-turbo-describe
Schritt 1: Für API-Schlüssel registrieren
Registrieren Sie sich bei CometAPI und generieren Sie Ihren API-Schlüssel im Dashboard. Speichern Sie den Schlüssel anschließend sicher als Umgebungsvariable, zum Beispiel COMETAPI_API_KEY. Dieser Schlüssel wird zur Authentifizierung jeder Anfrage an die mj-turbo-describe-API verwendet.
Schritt 2: An die mj-turbo-describe-API Anfragen senden
Verwenden Sie den mit Midjourney kompatiblen Endpunkt von CometAPI unter POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Schritt 3: Ergebnisse abrufen und verifizieren
Die API gibt ein Task-Objekt mit einer Task-ID zurück. Pollen Sie GET /mj/task/{task_id}/fetch, um den Generierungsstatus zu prüfen und die Ausgabe-Bild-URL abzurufen, wenn die Aufgabe einen Endzustand erreicht.