Especificaciones técnicas de mj-fast-describe
| Especificación | Detalles |
|---|---|
| ID del modelo | mj-fast-describe |
| Categoría del proveedor | Modelo compatible con Midjourney para comprensión de imágenes / descripción de prompts |
| Modalidad principal | Imagen a texto |
| Función principal | Analiza una imagen subida y devuelve sugerencias de prompts descriptivos que pueden usarse para creación creativa de prompts |
| Salida típica | Múltiples candidatos de prompt que describen la imagen subida |
| Perfil de velocidad | Flujo orientado a descripciones rápidas, pensado para extracción ágil de prompts e ideación |
| Uso comercial | Compatible en la lista de modelos de CometAPI. |
| Visualización de precios en CometAPI | Figura como precio por solicitud en la página del modelo de CometAPI. |
| Canal de integración | Accesible a través de la plataforma de API de CometAPI para modelos relacionados con Midjourney. |
¿Qué es mj-fast-describe?
mj-fast-describe es un endpoint de imagen a texto orientado a Midjourney expuesto a través de CometAPI, diseñado para inspeccionar una imagen de entrada y generar descripciones textuales en formato de prompt. Basado en la documentación oficial de Describe de Midjourney, el flujo de trabajo subyacente está pensado para ayudar a los usuarios a generar prompts creativos analizando una imagen subida y ofreciendo palabras y frases que la caractericen.
En la práctica, este tipo de modelo es útil cuando quieres hacer ingeniería inversa de una imagen para obtener ideas de prompts, iniciar nuevas generaciones a partir de referencias visuales o descubrir lenguaje estilístico que quizás no habrías escrito manualmente. La documentación oficial de Midjourney también señala que las sugerencias de Describe están orientadas a la inspiración, más que a instrucciones de reconstrucción exacta, y que ejecuciones repetidas sobre la misma imagen pueden producir conjuntos de prompts diferentes.
Características principales de mj-fast-describe
- Extracción de prompts de imagen a texto:
mj-fast-describeestá hecho para convertir entradas visuales en prompts descriptivos, lo que lo hace útil para ingeniería de prompts, análisis de referencias e ideación creativa. - Flujo creativo de sugerencias de prompts: el proceso de Describe busca inspirar nuevas direcciones de prompts en lugar de producir una copia literal perfecta de la imagen fuente.
- Múltiples candidatos de prompt: el flujo Describe de Midjourney genera cuatro sugerencias de prompt para una imagen subida, lo que es un fuerte indicador de la experiencia de usuario esperada para esta categoría de modelos.
- Ideación rápida a partir de referencias visuales: este modelo es adecuado para extraer rápidamente palabras de estilo, señales de escena y formulaciones de una imagen, de modo que los equipos puedan iterar más rápido en prompts para la generación posterior. Esto es una inferencia basada en el comportamiento documentado de Describe y la denominación "fast describe" del modelo.
- Útil para el descubrimiento y la remezcla de prompts: puedes usar las descripciones devueltas tal cual, editarlas o emplearlas como punto de partida para una exploración creativa más amplia.
- Listo para API a través de CometAPI: en lugar de usar directamente la interfaz nativa de Midjourney, los desarrolladores pueden acceder a esta capacidad a través de la capa de acceso unificado de modelos de CometAPI.
Cómo acceder e integrar mj-fast-describe
Paso 1: Regístrate para obtener una clave de API
Regístrate en CometAPI y crea tu clave de API desde el panel de desarrollador. Una vez emitida, almacénala de forma segura y úsala como tu token Bearer para todas las solicitudes a mj-fast-describe.
Paso 2: Envía solicitudes a la API de mj-fast-describe
Usa el endpoint compatible con Midjourney de CometAPI en POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["FAST"]
}
}'
Paso 3: Recupera y verifica los resultados
La API devuelve un objeto de tarea con un ID de tarea. Realiza sondeos a GET /mj/task/{task_id}/fetch para comprobar el estado de la generación y recuperar la URL de la imagen de salida cuando la tarea alcance un estado terminal.