Что такое API GPT-Image-1.5?
GPT-Image-1.5 — новейший представитель семейства OpenAI GPT Image и модель, стоящая за обновленным опытом Images в ChatGPT. Она создана, чтобы перевести генерацию изображений из разряда экспериментальных новинок в производственные креативные инструменты: более высокая фотореалистичность, более тонкий контроль для итеративного редактирования и более быстрый инференс для поддержки интерактивных и корпоративных рабочих процессов.
gpt-image-1.5 API — это мультимодальная конечная точка модели изображений, принимающая один или несколько входов изображений (идентификаторы файлов или байты) плюс текстовый промпт и возвращающая сгенерированные или отредактированные изображения. Поддерживает:
- Генерацию по тексту (создание по промпту),
- Редактирование изображений / инпейтинг / композитинг (применение инструкций к существующим изображениям, допустимы несколько входных изображений), и
- Итеративные, многошаговые процессы редактирования через Responses API (позволяет создавать интерфейсы «подправить и повторить»).
API обрабатывает промпты с изображениями иначе, чем старые ограничения DALL·E: модели GPT для изображений принимают значительно более длинные текстовые промпты (рекомендация — до 32 000 символов), что делает возможными сложные инструкции с множеством ограничений.
Основные возможности (практическое)
- Улучшенная редактируемость / межшаговая согласованность: сохраняет внешний вид персонажей, освещение и ключевые визуальные атрибуты при итеративных правках. Это делает сценарии «та же модель, повторные правки» более надежными для рабочих процессов вроде товарных каталогов или бренд-активов.
- Более высокая пропускная способность — ускорение до 4× по сравнению с GPT Image 1, нацеленное на снижение задержек в итеративных креативных сценариях.
- Оптимизация стоимости — затраты на ввод/вывод изображений снижены примерно на 20% по сравнению с GPT Image 1, уменьшая стоимость итераций на изображение для пользователей с большим объемом.
- Мультикомпозитинг и референс стиля — прием нескольких референсных изображений для композитинга сцен или переноса стиля/освещения.
- Регуляторы качества/точности — параметры API для баланса между скоростью и точностью (используйте более низкое качество для массовой генерации; более высокое — для продакшн-активов).
- Многошаговое редактирование / интеграция с Responses API — обеспечивает пошаговые процессы (запросите изменения, затем «сделайте правки» с сохранением состояния).
Технические возможности
- Лимит текстового промпта (для моделей изображений): до 32 000 символов (примечание: OpenAI задокументировала это как допустимую длину текста для моделей изображений GPT). Используйте для длинных промптов с множеством ограничений.
- Входы изображений: принимает идентификаторы файлов (предпочтительно для многошаговых процессов) или сырые байты; можно предоставить несколько изображений для композитинга и референсов.
- Выходы: PNG/JPEG или дефолтные артефакты изображений платформы, возвращаемые API (или как вложения в ChatGPT). Результаты могут включать несколько кандидатных изображений и поддерживают итеративные запросы для уточнения результата.
- Режимы генерации: текст-в-изображение, редактирование изображений (инпейтинг/расширение по инструкциям) и варианты. Многошаговое редактирование поддерживает инструкции в стиле «добавить/убрать/комбинировать».
- Редактирование с учетом инструкций: модели оптимизированы для точного соблюдения инструкций (с сохранением указанных инвариантов, например «не менять логотип», «сохранить позу и освещение»). Приемы промпт-инжиниринга (явное повторение инвариантов на каждой итерации) уменьшают семантический дрейф.
Результаты бенчмарков
- Позиция в таблице лидеров: согласно одному сводному отчету, GPT Image 1.5 лидировала в рейтингах генерации «текст-в-изображение» с показателем ~1264 балла на таблице лидеров Artificial Analysis, опережая следующую модель на заметную величину.
- Метрики на уровне задач (редактирование и сохранение): сводка метрик оценки от Microsoft Foundry показывает, что GPT-Image-1.5 достигает почти идеального успеха двоичных модификаций (100% в одношаговом BinaryEval) и высоких показателей сохранения лиц (около 90% по мере AuraFace) в сравнительной таблице с конкурентами и предыдущими моделями OpenAI. Эти сравнительные метрики ставят GPT-Image-1.5 впереди ряда соперников по сохранению и точности редактирования.

Как GPT-Image-1.5 сравнивается с аналогами
- По сравнению с GPT Image 1 (предыдущее поколение OpenAI): быстрее (до 4×), дешевле (примерно на 20% ниже стоимость ввода/вывода изображений) и с более высокой точностью редактирования — нацелен на переход от «прототипа/демо» к «дружественным к продакшну» процессам работы с изображениями.
- По сравнению с Google’s Nano Banana Pro / моделями изображений Gemini: GPT-Image-1.5 и Google’s Nano Banana Pro / семейство Gemini 3 — близкие конкуренты, каждый силен в разных классах промптов. Акценты OpenAI — точность редактирования и скорость итераций; решение Google хвалят за студийный уровень реализма в ряде примеров.
- По сравнению с Qwen Image и другими открытыми/закрытыми моделями: GPT-Image-1.5 превосходит Qwen Image по нескольким метрикам редактирования и сохранения в одношаговых оценках, однако разрыв сокращается в многошаговых или других предметно-специфичных тестах.
Где GPT-Image-1.5 силен
- Изображения для e-commerce: массовые варианты, замена фона, единообразные товарные каталоги из одного фото (с сохранением бренда/логотипа).
- Создание креативов и маркетинговых материалов: быстрые итерации концептов, фотореалистичные мокапы, контролируемый перенос стиля.
- Ретушь фото и редакционные процессы: реалистичные «примерки» одежды/причесок, селективная ретушь с сохранением идентичности и освещения.
- Интеграция в инструменты дизайна: встраивание в платформы дизайна или CMS для генерации вариантов изображений по требованию (регуляторы точности помогают контролировать стоимость).
- Многошаговые конвейеры композитинга: несколько входных изображений позволяют композитинг и генерацию на основе референсов для сложных сцен.
Как получить доступ к API GPT Image 1.5
Шаг 1: Зарегистрируйтесь для получения ключа API
Войдите на cometapi.com. Если вы еще не являетесь нашим пользователем, сначала зарегистрируйтесь. Авторизуйтесь в консоли CometAPI. Получите ключ API для доступа к интерфейсу. Нажмите «Add Token» в разделе токенов API в личном кабинете, получите ключ токена: sk-xxxxx и отправьте.
Шаг 2: Отправляйте запросы в API GPT Image 1.5
Выберите конечную точку “gpt-image-1.5” для отправки запроса к API и задайте тело запроса. Метод и тело запроса берутся из документации API на нашем сайте. На сайте также доступен тест в Apifox для вашего удобства. Замените <YOUR_API_KEY> на ваш фактический ключ CometAPI из вашего аккаунта. Базовый URL: Изображения (https://api.cometapi.com/v1/images/generations) и [Редактирование изображений]
Вставьте ваш вопрос или запрос в поле content — именно на него модель ответит. Обработайте ответ API, чтобы получить сгенерированный результат.
Шаг 3: Получите и проверьте результаты
Обработайте ответ API, чтобы получить сгенерированный результат. После обработки API возвращает статус задачи и выходные данные.
См. также Предварительная версия API Gemini 3 Pro