Especificações técnicas de mj-turbo-describe
| Especificação | Detalhes |
|---|---|
| Model ID | mj-turbo-describe |
| Provider / Family | Capacidade Describe da Midjourney, exposta via CometAPI usando o identificador de modelo da plataforma mj-turbo-describe |
| Modality | Geração de prompts de imagem para texto |
| Primary Function | Analisa uma imagem enviada e retorna sugestões de prompts descritivos que podem ser reutilizadas para geração de imagens |
| Input Type | Upload de imagem ou URL de imagem, dependendo da implementação do cliente |
| Output Type | Múltiplas sugestões de prompts em texto derivadas da imagem de entrada |
| Typical Output Count | O fluxo Describe da Midjourney retorna quatro sugestões de prompt por imagem |
| Interaction Pattern | Geração assíncrona de prompts criativos a partir de entrada visual |
| Best For | Prompt reverso, ideação de prompts, descoberta de estilo, fluxos de remix e conversão de visuais de referência em prompts de texto reutilizáveis |
| Platform Access | Disponível via CometAPI sob o código de modelo mj-turbo-describe |
| Upstream Behavior Notes | A Midjourney afirma que o Describe é uma ferramenta de imagem para texto destinada a inspirar prompts em vez de reproduzir com precisão a imagem fonte, e execuções repetidas na mesma imagem podem gerar sugestões diferentes. |
O que é mj-turbo-describe?
mj-turbo-describe é o identificador de plataforma da CometAPI para a capacidade de imagem para texto no estilo Describe da Midjourney. Em vez de gerar uma imagem a partir de um prompt de texto, esse modelo funciona na direção inversa: ele examina uma imagem enviada e propõe linguagem de prompt que captura elementos visuais, pistas de estilo e enquadramento criativo. A Midjourney descreve oficialmente o Describe como uma ferramenta que analisa uma imagem e oferece palavras e frases que podem ser usadas como inspiração de prompt.
Na prática, isso torna o mj-turbo-describe útil para usuários que desejam transformar visuais existentes em linguagem de prompt reutilizável. Ele pode ajudar a extrair vocabulário estilístico, identificar padrões de composição e acelerar a experimentação ao construir prompts para geração de imagens a jusante. A Midjourney também observa que as sugestões são inspiracionais, em vez de réplicas exatas da imagem fonte, portanto o modelo deve ser entendido como um gerador criativo de prompts, não como um sistema rigoroso de legendagem ou de visão forense.
Como execuções repetidas do Describe podem produzir conjuntos diferentes de prompts para a mesma imagem, o mj-turbo-describe também é adequado a fluxos de ideação iterativos, nos quais a variação é valiosa.
Principais recursos de mj-turbo-describe
- Conversão de imagem para prompt: Converte uma imagem fonte em sugestões de prompts em texto, facilitando a passagem da inspiração visual para texto de prompt pronto para geração.
- Múltiplos candidatos de prompt: Retorna quatro sugestões de prompt por imagem, oferecendo várias direções criativas em vez de uma única descrição rígida.
- Suporte à ideação de prompts: Ajuda usuários a descobrir palavras e frases para estilo, atmosfera, composição e tema que talvez não fossem escritas manualmente.
- Variação criativa não determinística: Reexecutar o Describe na mesma imagem pode produzir um conjunto diferente de sugestões de prompt, o que é útil para brainstorming e exploração.
- Fluxo de trabalho orientado por referências: Suporta fluxos de trabalho baseados em imagens enviadas ou links de imagem, alinhando-se bem com criadores que partem de esboços, fotos, referências de ambiente ou gerações anteriores.
- Reutilização rápida em pipelines de geração: Os resultados do Describe da Midjourney são projetados para serem reutilizados imediatamente como prompts, o que se integra de forma limpa à automação criativa orientada por API.
- Descoberta de estilo: Particularmente útil para identificar a linguagem visual presente em uma imagem de referência, incluindo pistas estéticas que podem servir de base para gerações futuras.
Como acessar e integrar mj-turbo-describe
Etapa 1: Cadastre-se para obter a chave de API
Para começar, cadastre-se na CometAPI e gere sua chave de API no painel. Em seguida, armazene a chave com segurança como uma variável de ambiente, como COMETAPI_API_KEY. Essa chave será usada para autenticar todas as solicitações enviadas à API mj-turbo-describe.
Etapa 2: Envie solicitações para a API mj-turbo-describe
Use o endpoint compatível com Midjourney da CometAPI em POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Etapa 3: Recuperar e verificar os resultados
A API retorna um objeto de tarefa com um ID de tarefa. Faça polling em GET /mj/task/{task_id}/fetch para verificar o status da geração e recuperar a URL da imagem de saída quando a tarefa atingir um estado terminal.