Especificaciones técnicas de mj-turbo-describe
| Especificación | Detalles |
|---|---|
| ID del modelo | mj-turbo-describe |
| Proveedor / Familia | Capacidad Describe de Midjourney, expuesta a través de CometAPI usando el identificador de modelo de la plataforma mj-turbo-describe |
| Modalidad | Generación de prompts de imagen a texto |
| Función principal | Analiza una imagen cargada y devuelve sugerencias de prompts descriptivos que pueden reutilizarse para generar imágenes |
| Tipo de entrada | Carga de imagen o URL de imagen, según la implementación del cliente |
| Tipo de salida | Múltiples sugerencias de prompts de texto derivadas de la imagen de entrada |
| Cantidad de salidas típica | El flujo de trabajo Describe de Midjourney devuelve cuatro sugerencias de prompt por imagen |
| Patrón de interacción | Generación asíncrona de prompts creativos a partir de una entrada visual |
| Ideal para | Ingeniería inversa de prompts, ideación de prompts, descubrimiento de estilo, flujos de trabajo de remix y convertir referencias visuales en prompts de texto reutilizables |
| Acceso a la plataforma | Disponible a través de CometAPI bajo el código de modelo mj-turbo-describe |
| Notas sobre el comportamiento del servicio de origen | Midjourney indica que Describe es una herramienta de imagen a texto destinada a inspirar prompts en lugar de reproducir con precisión la imagen original, y que ejecuciones repetidas sobre la misma imagen pueden generar sugerencias diferentes. |
¿Qué es mj-turbo-describe?
mj-turbo-describe es el identificador de plataforma de CometAPI para la capacidad de imagen a texto al estilo Describe de Midjourney. En lugar de generar una imagen a partir de un prompt de texto, este modelo funciona en la dirección inversa: examina una imagen cargada y propone lenguaje de prompt que captura elementos visuales, señales de estilo y encuadres creativos. Midjourney describe oficialmente Describe como una herramienta que analiza una imagen y ofrece palabras y frases que pueden usarse como inspiración de prompts.
En términos prácticos, esto hace que mj-turbo-describe sea útil para usuarios que desean convertir visuales existentes en lenguaje de prompts reutilizable. Puede ayudar a extraer vocabulario estilístico, identificar patrones compositivos y acelerar la experimentación al crear prompts para la generación de imágenes posterior. Midjourney también señala que las sugerencias son inspiracionales en lugar de réplicas exactas de la imagen de origen, por lo que el modelo se entiende mejor como un generador creativo de prompts, no como un sistema estricto de subtitulado o visión forense.
Dado que ejecuciones repetidas de Describe pueden producir conjuntos de prompts diferentes para la misma imagen, mj-turbo-describe también es adecuado para flujos de ideación iterativos donde la variación es valiosa.
Funciones principales de mj-turbo-describe
- Conversión de imagen a prompt: Convierte una imagen fuente en sugerencias de prompts de texto, facilitando pasar de la inspiración visual a texto listo para generación.
- Múltiples candidatos de prompt: Devuelve cuatro sugerencias de prompt por imagen, ofreciendo varias direcciones creativas en lugar de una única descripción rígida.
- Soporte para ideación de prompts: Ayuda a descubrir palabras y frases para estilo, estado de ánimo, composición y temática que quizá no se escribirían manualmente.
- Variación creativa no determinista: Volver a ejecutar Describe sobre la misma imagen puede producir un conjunto diferente de sugerencias, útil para lluvia de ideas y exploración.
- Flujo de trabajo basado en referencias: Admite flujos basados en imágenes cargadas o enlaces de imagen, alineándose con creadores que parten de bocetos, fotos, referencias de mood o generaciones previas.
- Reutilización rápida en canalizaciones de generación: Los resultados de Describe de Midjourney están diseñados para reutilizarse inmediatamente como prompts, lo que encaja con la automatización creativa basada en API.
- Descubrimiento de estilo: Especialmente útil para identificar el lenguaje visual incrustado en una imagen de referencia, incluidas señales estéticas que pueden sembrar generaciones futuras.
Cómo acceder e integrar mj-turbo-describe
Paso 1: Regístrate para obtener una clave de API
Para comenzar, regístrate en CometAPI y genera tu clave de API desde el panel. Después, almacena la clave de forma segura como una variable de entorno, por ejemplo COMETAPI_API_KEY. Esta clave se utilizará para autenticar cada solicitud que envíes a la API de mj-turbo-describe.
Paso 2: Envía solicitudes a la API de mj-turbo-describe
Usa el endpoint compatible con Midjourney de CometAPI en POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Paso 3: Recupera y verifica los resultados
La API devuelve un objeto de tarea con un ID de tarea. Consulta GET /mj/task/{task_id}/fetch para comprobar el estado de generación y recuperar la URL de la imagen de salida cuando la tarea alcance un estado terminal.