Especificações técnicas de mj-turbo-pic-reader
| Atributo | Detalhes |
|---|---|
| ID do modelo | mj-turbo-pic-reader |
| Provedor / família de modelos | Fluxo de leitura de prompts de imagem baseado no Midjourney, exposto na CometAPI sob o identificador mj-turbo-pic-reader. |
| Capacidade principal | Lê e interpreta prompts de imagem para que possam ser usados para orientar a geração de imagens no Midjourney. |
| Tipo de entrada | Entrada de prompt de imagem, normalmente combinada com instruções opcionais de prompt de texto para maior controle sobre composição e conteúdo. |
| Tipo de saída | Compreensão do prompt / contexto de geração guiada por imagem usado para criação de imagens no estilo Midjourney em etapas posteriores. |
| Contexto do modo de geração | Associado a fluxos de trabalho Turbo do Midjourney, em que o Modo Turbo foi projetado para gerar imagens até quatro vezes mais rápido do que o Modo Fast, consumindo o dobro do tempo Fast. |
| Contexto Midjourney compatível | O Modo Turbo está disponível para o Midjourney versão 5 e posteriores; versões mais recentes do Midjourney melhoram a precisão para prompts de texto e de imagem. |
| Casos de uso comuns | Análise de imagens de referência, prompting condicionado por imagem, direcionamento de estilo, orientação de composição e iteração criativa rápida. |
| Método de acesso | Via API unificada da CometAPI usando o ID de modelo mj-turbo-pic-reader. |
O que é mj-turbo-pic-reader?
mj-turbo-pic-reader é o identificador de plataforma da CometAPI para um fluxo de leitura de prompts de imagem orientado ao Midjourney. Com base no comportamento de prompting por imagem do Midjourney, o modelo é melhor entendido como uma ferramenta para analisar uma imagem fornecida e usar seus elementos visuais centrais como orientação para novas gerações, especialmente quando combinado com um prompt de texto. O Midjourney descreve prompts de imagem como uma forma de orientar conteúdo, composição e cor, fazendo o sistema observar os elementos centrais de uma imagem e usá-los como inspiração para uma nova saída.
A parte “turbo” do identificador sugere fortemente alinhamento com os fluxos Turbo do Midjourney, em vez de um nome separado de modelo base público do Midjourney. A documentação oficial do Midjourney explica que o Modo Turbo é um modo de GPU de alta velocidade que pode gerar imagens até quatro vezes mais rápido do que o Modo Fast, embora utilize mais tempo de GPU cobrado. Isso torna mj-turbo-pic-reader uma opção prática para pipelines criativos liderados por imagem em que a rapidez de retorno é importante.
Na prática, este ID de modelo é mais adequado quando você deseja enviar uma imagem como referência visual, extrair ou aproveitar seus sinais estilísticos e composicionais, e conduzir um fluxo de geração no estilo Midjourney via CometAPI sem lidar diretamente com diferenças de integração específicas do provedor. Esta descrição é uma inferência a partir da documentação oficial do Midjourney sobre prompts de imagem e Modo Turbo, combinada com o identificador de modelo da CometAPI.
Principais recursos de mj-turbo-pic-reader
- Interpretação de prompt de imagem: Aceita uma imagem como entrada orientadora para que o fluxo de geração possa usar pistas visuais como composição, assunto e direção de cor.
- Prompt de texto mais imagem: Funciona melhor em fluxos onde uma imagem de referência é combinada com texto descritivo, oferecendo controle mais explícito sobre o resultado final.
- Perfil de velocidade alinhado ao Turbo: Adequado para iterações criativas mais rápidas, pois o Modo Turbo do Midjourney é projetado para gerar imagens substancialmente mais rápido do que o Modo Fast padrão.
- Experimentação rápida: Útil para equipes que testam múltiplas direções visuais rapidamente, especialmente em fluxos de conceituação, moodboard e exploração de estilo. Esta é uma inferência prática do Modo Turbo combinada às mecânicas de prompt de imagem do Midjourney.
- Maior fidelidade ao prompt em gerações mais recentes do Midjourney: A documentação do Midjourney observa que versões mais novas melhoram o tratamento de prompts de texto e de imagem, o que beneficia fluxos do tipo leitor de imagem.
- Orientação criativa em vez de extração exata: Prompts de imagem do Midjourney são usados como inspiração com base em elementos centrais; portanto, o fluxo é melhor para geração guiada do que para análise determinística de imagem ou leitura no estilo OCR.
Como acessar e integrar mj-turbo-pic-reader
Etapa 1: Cadastre-se para obter uma chave de API
Cadastre-se na CometAPI e crie uma chave de API no seu painel. A CometAPI fornece uma camada de API unificada, assim você pode acessar mj-turbo-pic-reader usando o mesmo padrão de autenticação que utiliza para outros modelos compatíveis.
Etapa 2: Envie solicitações para a API de mj-turbo-pic-reader
Use o endpoint compatível com Midjourney da CometAPI em POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Etapa 3: Recupere e verifique os resultados
A API retorna um objeto de tarefa com um ID de tarefa. Faça polling em GET /mj/task/{task_id}/fetch para verificar o status da geração e recuperar a URL da imagem de saída quando a tarefa atingir um estado terminal.