Spécifications techniques de mj-turbo-describe
| Spécification | Détails |
|---|---|
| ID du modèle | mj-turbo-describe |
| Fournisseur / Famille | Fonctionnalité Describe de Midjourney, exposée via CometAPI à l’aide de l’identifiant de modèle de plateforme mj-turbo-describe |
| Modalité | Génération de prompts image-vers-texte |
| Fonction principale | Analyse une image téléversée et renvoie des propositions de prompts descriptifs réutilisables pour la génération d’images |
| Type d’entrée | Téléversement d’image ou URL d’image, selon l’implémentation côté client |
| Type de sortie | Plusieurs suggestions de prompts textuels dérivées de l’image en entrée |
| Nombre de sorties habituel | Le flux Describe de Midjourney renvoie quatre suggestions de prompt par image |
| Mode d’interaction | Génération asynchrone de prompts créatifs à partir d’une entrée visuelle |
| Idéal pour | Prompt inversé, idéation de prompts, découverte de styles, workflows de remix, et conversion de visuels de référence en prompts textuels réutilisables |
| Accès à la plateforme | Disponible via CometAPI sous le code de modèle mj-turbo-describe |
| Notes sur le comportement amont | Midjourney indique que Describe est un outil image-vers-texte destiné à inspirer des prompts plutôt qu’à reproduire précisément l’image source, et que des exécutions répétées sur la même image peuvent produire des suggestions différentes. |
Qu’est-ce que mj-turbo-describe ?
mj-turbo-describe est l’identifiant de plateforme de CometAPI pour la fonctionnalité image-vers-texte de type Describe de Midjourney. Au lieu de générer une image à partir d’un prompt textuel, ce modèle fonctionne en sens inverse : il examine une image téléversée et propose un langage de prompt qui capture les éléments visuels, les signaux de style et le cadrage créatif. Midjourney décrit officiellement Describe comme un outil qui analyse une image et propose des mots et expressions pouvant servir d’inspiration pour des prompts.
Concrètement, cela rend mj-turbo-describe utile aux utilisateurs souhaitant transformer des visuels existants en langage de prompt réutilisable. Il peut aider à extraire un vocabulaire stylistique, à identifier des schémas de composition et à accélérer l’expérimentation lors de la création de prompts pour la génération d’images en aval. Midjourney précise également que les suggestions sont inspirantes plutôt que des répliques exactes de l’image source ; le modèle doit donc être compris comme un générateur créatif de prompts, et non comme un système strict de légendage ou d’analyse forensique.
Puisque des exécutions répétées de Describe peuvent produire des ensembles de prompts différents pour la même image, mj-turbo-describe convient aussi très bien aux workflows d’idéation itérative où la variation a de la valeur.
Principales fonctionnalités de mj-turbo-describe
- Conversion image-vers-prompt : Convertit une image source en suggestions de prompts textuels, ce qui facilite le passage d’une inspiration visuelle à un texte de prompt prêt pour la génération.
- Multiples candidats de prompt : Renvoie quatre suggestions de prompt par image, offrant plusieurs directions créatives plutôt qu’une description unique et rigide.
- Aide à l’idéation de prompts : Aide à découvrir des mots et expressions pour le style, l’ambiance, la composition et le sujet, que les utilisateurs n’auraient peut-être pas formulés manuellement.
- Variation créative non déterministe : Relancer Describe sur la même image peut produire un ensemble différent de suggestions de prompts, utile pour le brainstorming et l’exploration.
- Flux axé sur la référence : Prend en charge des workflows basés sur des images téléversées ou des liens d’images, adapté aux créateurs qui partent de croquis, photos, références d’ambiance ou générations antérieures.
- Réutilisation rapide dans les pipelines de génération : Les résultats de Describe de Midjourney sont conçus pour être réutilisés immédiatement comme prompts, ce qui s’intègre bien à l’automatisation créative pilotée par API.
- Découverte de style : Particulièrement utile pour identifier le langage visuel contenu dans une image de référence, y compris des indices esthétiques pouvant alimenter de futures générations.
Comment accéder à et intégrer mj-turbo-describe
Étape 1 : Inscrivez-vous pour obtenir une clé API
Pour commencer, inscrivez-vous sur CometAPI et générez votre clé API depuis le tableau de bord. Ensuite, stockez la clé de manière sécurisée en tant que variable d’environnement, par exemple COMETAPI_API_KEY. Cette clé sera utilisée pour authentifier chaque requête envoyée à l’API mj-turbo-describe.
Étape 2 : Envoyer des requêtes à l’API mj-turbo-describe
Utilisez le point de terminaison de CometAPI compatible avec Midjourney à POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Étape 3 : Récupérer et vérifier les résultats
L’API renvoie un objet de tâche avec un identifiant de tâche. Sondez GET /mj/task/{task_id}/fetch pour vérifier l’état de génération et récupérer l’URL de l’image de sortie lorsque la tâche atteint un état terminal.