Технические характеристики mj-turbo-describe
| Параметр | Сведения |
|---|---|
| ID модели | mj-turbo-describe |
| Поставщик / Семейство | Возможность Describe от Midjourney, доступная через CometAPI с использованием идентификатора модели платформы mj-turbo-describe |
| Модальность | Генерация текстовых подсказок по изображению |
| Основная функция | Анализирует загруженное изображение и возвращает описательные варианты подсказок, которые можно повторно использовать для генерации изображений |
| Тип входных данных | Загрузка изображения или URL изображения, в зависимости от реализации клиента |
| Тип выходных данных | Несколько текстовых вариантов подсказок, полученных из входного изображения |
| Типичное количество результатов | В рабочем процессе Describe от Midjourney возвращаются четыре варианта подсказки на изображение |
| Модель взаимодействия | Асинхронная генерация креативных подсказок по визуальному входу |
| Лучше всего подходит для | Реверс-промптинга, генерации идей для подсказок, поиска стиля, рабочих процессов ремикса и преобразования референсных визуалов в пригодные к повторному использованию текстовые подсказки |
| Доступ к платформе | Доступен через CometAPI под кодом модели mj-turbo-describe |
| Примечания к особенностям работы | Midjourney отмечает, что Describe — это инструмент «изображение-в-текст», предназначенный для вдохновения подсказок, а не точного воспроизведения исходного изображения; повторные запуски на одном и том же изображении могут давать разные предложения. |
Что такое mj-turbo-describe?
mj-turbo-describe — это идентификатор платформы CometAPI для возможности Midjourney в стиле Describe, преобразующей изображение в текст. Вместо генерации изображения из текстовой подсказки эта модель работает в обратном направлении: она изучает загруженное изображение и предлагает языковые формулировки подсказок, которые отражают визуальные элементы, стилистические ориентиры и креативную подачу. Midjourney официально описывает Describe как инструмент, который анализирует изображение и предлагает слова и фразы, пригодные для вдохновения при написании подсказок.
На практике это делает mj-turbo-describe полезным для пользователей, желающих превратить готовые визуалы в пригодный к повторному использованию язык подсказок. Он помогает извлекать стилистический словарь, выявлять композиционные паттерны и ускорять эксперименты при построении подсказок для последующей генерации изображений. Midjourney также отмечает, что предлагаемые варианты предназначены для вдохновения, а не для точного копирования исходного изображения, поэтому модель корректнее понимать как генератор креативных подсказок, а не как строгую систему подписи или инструмент форензического анализа изображений.
Поскольку повторные запуски Describe могут выдавать разные наборы подсказок для одного и того же изображения, mj-turbo-describe также хорошо подходит для итеративных процессов генерации идей, где вариативность имеет ценность.
Основные возможности mj-turbo-describe
- Преобразование изображения в подсказки: Преобразует исходное изображение в предложения текстовых подсказок, облегчая переход от визуального референса к готовому к генерации тексту.
- Несколько вариантов подсказок: Возвращает четыре варианта подсказок на изображение, предлагая несколько творческих направлений вместо одной жёсткой формулировки.
- Поддержка генерации идей для подсказок: Помогает находить слова и фразы для стиля, настроения, композиции и темы, которые могло быть сложно подобрать вручную.
- Недетерминированные творческие вариации: Повторный запуск Describe для одного и того же изображения может дать иной набор подсказок, что полезно для мозгового штурма и исследования вариантов.
- Рабочий процесс, основанный на референсах: Поддерживает рабочие процессы с загрузкой изображений или ссылками на них, что удобно для тех, кто начинает с эскизов, фотографий, референсов или ранее сгенерированных материалов.
- Быстрое повторное использование в конвейерах генерации: Результаты Describe от Midjourney спроектированы для прямого повторного использования как подсказки, что хорошо ложится на API-ориентированную креативную автоматизацию.
- Обнаружение стиля: Особенно полезен для выявления визуального языка, заложенного в референсном изображении, включая эстетические подсказки, которые могут послужить основой для будущих генераций.
Как получить доступ и интегрировать mj-turbo-describe
Шаг 1: Зарегистрируйтесь и получите ключ API
Для начала зарегистрируйтесь в CometAPI и сгенерируйте ключ API в панели управления. После этого сохраните ключ в безопасном виде как переменную окружения, например COMETAPI_API_KEY. Этот ключ будет использоваться для аутентификации каждого запроса к API mj-turbo-describe.
Шаг 2: Отправляйте запросы к API mj-turbo-describe
Используйте совместимую с Midjourney конечную точку CometAPI: POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Шаг 3: Получение и проверка результатов
API возвращает объект задачи с её идентификатором. Периодически опрашивайте GET /mj/task/{task_id}/fetch, чтобы проверить статус генерации и получить URL выходного изображения, когда задача достигнет конечного состояния.