
GPT-6 Astra
GPT-6 Astra — флагманская модель для сложных рассуждений и программирования. Выберите GPT-5.6 Terra, чтобы сбалансировать интеллектуальные возможности и стоимость,

GPT-6 Astra — флагманская модель для сложных рассуждений и программирования. Выберите GPT-5.6 Terra, чтобы сбалансировать интеллектуальные возможности и стоимость,

GPT Image 2 — передовая модель openai для быстрой, высококачественной генерации и редактирования изображений. Она поддерживает гибкие размеры изображений и высокоточные входные изображения.

Изучите API модели gpt-oss-20b(free).

GPT-5.4 Mini — легковесная и эффективная модель ИИ, оптимизированная для скорости и продуктивности в повседневных задачах. Она обеспечивает надёжные диалоговые возможности, генерацию контента и помощь в выполнении задач, поддерживая низкую задержку и минимальное использование ресурсов.

Изучите API модели GPT Image 2.5(sunburst).

GPT-5.4 Pro — высокопроизводительная модель ИИ, созданная для профессионального и бизнес-применения. Она обеспечивает мощные возможности рассуждения, надёжную точность и эффективное выполнение задач, таких как создание контента, программирование, проведение исследований и анализ данных.

GPT-5.5 Pro сочетает передовой интеллект, точность и эффективность для решения сложных задач. От разработки программного обеспечения и анализа данных до исследований и поддержки принятия решений он предоставляет помощь уровня эксперта быстро и стабильно.

GPT Image 2 ALL — это комплексная модель генерации изображений, предназначенная для решения широкого спектра творческих и профессиональных визуальных задач. Она сочетает высококачественную генерацию изображений, продвинутое понимание запросов и гибкую поддержку стилей, чтобы обеспечивать выдающиеся результаты в самых разных сценариях использования.

Sora 2 Pro — наша самая передовая и мощная модель генерации медиаконтента, способная создавать видео с синхронизированным звуком. Она может создавать детализированные, динамичные видеоролики из текста на естественном языке или из изображений.

Изучите API модели GPT Image 2.5 Flare.

Сверхмощная модель для генерации видео со звуковыми эффектами, поддерживает формат чата.
.jpeg&w=3840&q=75)
Model 5.5 — это модель искусственного интеллекта нового поколения, разработанная для более развитого рассуждения, более быстрых ответов и повышенной точности в широком спектре задач. Она превосходно понимает сложные инструкции, генерирует высококачественный контент и помогает в программировании, анализе и решении проблем.

GPT-5.4 — передовая модель для сложной профессиональной работы. Reasoning.effort поддерживает: none (по умолчанию), low, medium, high и xhigh.

Модель GPT-5.3 Instant, используемая в ChatGPT

Лучшая голосовая модель для ввода и вывода аудио с Chat Completions.
GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.

Начните с GPT-5.6 Sol для сложного рассуждения и программирования, выберите GPT-5.6 Terra для баланса интеллекта и стоимости, или используйте GPT-5.6 Luna для чувствительных к затратам, высокообъёмных рабочих нагрузок.
GPT-Realtime-2 — наша самая мощная голосовая модель реального времени. Она поддерживает взаимодействия «речь‑в‑речь» с настраиваемой глубиной рассуждений, более точным следованием инструкциям и более надежным использованием инструментов для сложных рабочих процессов голосовых агентов.

GPT-5.4 Nano — предельно легковесная модель ИИ, созданная для максимальной скорости и эффективности. Она оптимизирована для простых задач, взаимодействий в реальном времени и крупномасштабных развёртываний, где критически важны низкая задержка и минимальное потребление ресурсов.

Лучшая модель речи для ввода и вывода аудио.

GPT-5.3-Codex оптимизирован для агентных задач программирования в Codex или аналогичных средах. GPT-5.3-Codex поддерживает уровни интенсивности рассуждения: low, medium, high и xhigh.

GPT-Image-1.5 — это модель OpenAI для изображений в семействе GPT Image . Это нативно мультимодальная модель GPT, предназначенная для генерации изображений по текстовым подсказкам и выполнения высокоточного редактирования входных изображений при точном следовании инструкциям пользователя.

gpt-5.2-pro — самая мощная, ориентированная на продакшн модель семейства GPT-5.2 от OpenAI, доступная через Responses API для рабочих нагрузок, требующих максимальной точности, многошагового рассуждения, широкого использования инструментов и наибольших доступных у OpenAI лимитов контекста и пропускной способности.
GPT-5.1 — универсальная инструкционно дообученная языковая модель, ориентированная на генерацию текста и рассуждение в рамках продуктовых рабочих процессов. Она поддерживает многоходовой диалог, форматирование структурированного вывода и ориентированные на код задачи, такие как подготовка черновиков, рефакторинг и объяснение. Типичные сценарии использования включают чат-ассистенты, вопросно-ответные системы, дополненные поиском, преобразование данных и автоматизацию в агентном стиле с использованием инструментов или API при наличии поддержки. К ключевым техническим особенностям относятся текстоцентричная модальность, следование инструкциям, вывод в стиле JSON и совместимость с вызовом функций в распространённых оркестрационных фреймворках.
Оптимизированная по стоимости версия GPT Image 1. Это нативная мультимодальная языковая модель, которая принимает на вход текст и изображения и генерирует изображения.
GPT-5 — самая мощная на сегодняшний день модель для программирования от OpenAI. Она демонстрирует значительные улучшения в генерации сложного фронтенда и отладке крупных кодовых баз. Она способна превращать идеи в реальность, обеспечивая интуитивно понятные и эстетически привлекательные результаты, создавая красивые и адаптивные веб-сайты, приложения и игры с тонким чувством эстетики — всё по одному запросу. Ранние тестировщики также отметили её дизайнерские решения и более глубокое понимание таких элементов, как отступы, типографика и белое пространство.
GPT-5 Nano — модель искусственного интеллекта, предоставляемая OpenAI.
GPT-5 mini — оптимизированный по стоимости и задержке представитель семейства GPT-5 от OpenAI, предназначенный для предоставления значительной части мультимодальных возможностей и качества следования инструкциям, присущих GPT-5, при значительно более низкой стоимости для крупномасштабного промышленного применения. Он ориентирован на среды, где основными ограничениями являются пропускная способность, предсказуемая цена за токен и быстрые ответы, при этом сохраняя мощные универсальные возможности.
Скоро
gpt-4o-image генерирует изображения на выходе, опционально используя изображения на входе

GPT-5.2 — это набор моделей с несколькими вариантами (Instant, Thinking, Pro), спроектированный для лучшего понимания длинных контекстов, улучшенных возможностей написания кода и работы с инструментами, а также существенно лучших результатов на профессиональных бенчмарках «интеллектуальной работы».
OpenAI o3‑pro — «pro»-вариант модели рассуждений o3, спроектированный для более длительного размышления и выдачи максимально надёжных ответов за счёт применения приватного обучения с подкреплением по цепочке рассуждений и устанавливающий новые передовые бенчмарки в таких областях, как наука, программирование и бизнес — при этом автономно интегрируя в рамках API такие инструменты, как веб‑поиск, анализ файлов, выполнение кода на Python и визуальные рассуждения.

Преобразование текста в речь OpenAI

Преобразование речи в текст, создание переводов
Изучите API модели tts-1.
GPT-4o mini TTS — нейросетевая модель преобразования текста в речь, предназначенная для естественной генерации речи с низкой задержкой в пользовательских приложениях. Она преобразует текст в естественно звучащую речь с возможностью выбора голосов, поддержкой вывода в нескольких форматах и потоковым синтезом для обеспечения отзывчивого взаимодействия. Типичные сценарии использования включают голосовых ассистентов, IVR и контактные сценарии, чтение вслух в продукте и дикторское сопровождение медиаконтента. К техническим особенностям относятся потоковая передача через API и экспорт в распространённые аудиоформаты, такие как MP3 и WAV.
Изучите API модели o1-pro-2025-03-19.
GPT-4o Transcribe — это модель преобразования аудио в текст для многоязычного распознавания речи с низкой задержкой. Она поддерживает потоковую обработку в реальном времени и пакетное транскрибирование из распространённых аудиоформатов с расстановкой знаков препинания и сегментацией на предложения. Типичные сценарии использования включают субтитры в реальном времени, ввод для голосовых ассистентов, заметки по встречам и транскрибирование медиаконтента или записей звонков. К техническим особенностям относятся поддержка аудиомодальности, обработка длинных записей и API, подходящие для интерактивных и серверных рабочих процессов.
GPT-4o mini Audio Preview — компактная мультимодальная модель для создания разговорных аудиоприложений. Она поддерживает голосовой ввод и вывод наряду с текстом, обеспечивая распознавание речи, синтез речи и смешанные текстово-аудио диалоги с вызовом инструментов и функций для структурированных действий. Типичные сценарии использования включают: голосовые ассистенты, потоковую транскрипцию с суммаризацией, рабочие процессы IVR и колл-ботов, а также помощников в приложениях с поддержкой аудио. Ключевые технические возможности включают аудио-ввод/вывод, потоковые ответы, следование инструкциям и интеграцию через API чата и инструментов.
GPT-4o mini Realtime Preview — это мультимодальная модель реального времени для интерактивных голосовых и визуальных взаимодействий. Она обрабатывает речь, текст и изображения с потоковым вводом и выводом, а также поддерживает вызов инструментов и функций для выполнения контекстно привязанных действий. Типичные сценарии использования включают голосовых ассистентов, обработку звонков в реальном времени, субтитрование в реальном времени и визуальные ответы на вопросы по содержимому с камеры или экрана. К техническим особенностям относятся двунаправленный аудиообмен, понимание визуальной информации, потоковые ответы и структурированные выходные данные через функции.
Изучите API модели o1-2024-12-17.

GPT-4o mini Audio — мультимодальная модель для речевого и текстового взаимодействия. Она выполняет распознавание речи, перевод и синтез речи, следует инструкциям и может вызывать инструменты для выполнения структурированных действий с потоковыми ответами. Типичные варианты использования включают голосовых ассистентов в реальном времени, создание субтитров и перевод в реальном времени, суммаризацию звонков и приложения с голосовым управлением. К техническим особенностям относятся ввод и вывод аудио, потоковые ответы, вызов функций и структурированный вывод в формате JSON.
Изучите API модели omni-moderation-2024-09-26.
Изучите API модели omni-moderation-latest.
Изучите API модели tts-1-hd-1106.
Изучите API модели tts-1-1106.
Изучите API модели tts-1-hd.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
Продвинутая модель искусственного интеллекта для генерации изображений на основе текстовых описаний.
New version of DALL-E for image generation.

Скоро

Скоро

coming soon
O4-mini — это модель искусственного интеллекта, предоставляемая компанией OpenAI.
O3-mini — это модель искусственного интеллекта от OpenAI.
O3 — модель искусственного интеллекта, предоставляемая компанией OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b является моделью искусственного интеллекта, предоставляемой cloudflare-workers-ai.
gpt-oss-120b — это модель искусственного интеллекта, предоставляемая cloudflare-workers-ai.
GPT-4o mini — модель искусственного интеллекта, предоставляемая OpenAI.
GPT-4o — самая продвинутая мультимодальная модель OpenAI, быстрее и дешевле, чем GPT-4 Turbo, с более мощными визуальными возможностями. Эта модель имеет контекст 128K и отсечку знаний по состоянию на октябрь 2023 года. Модели серии 1106 и выше поддерживают tool_calls и function_call. Эта модель поддерживает максимальную длину контекста 128,000 токенов.
GPT-4.1 nano — модель искусственного интеллекта, предоставляемая OpenAI. gpt-4.1-nano: Обладает увеличенным контекстным окном — поддерживает до 1 миллиона токенов контекста и способна лучше использовать этот контекст благодаря улучшенному пониманию длинного контекста. Имеет обновленную дату отсечения знаний: июнь 2024 года. Эта модель поддерживает максимальную длину контекста 1,047,576 токенов.
GPT-4.1 mini — модель искусственного интеллекта, предоставляемая OpenAI. gpt-4.1-mini: Значительный скачок в производительности небольших моделей, даже превосходит GPT-4o во многих бенчмарках. Эта модель соответствует или превосходит GPT-4o в оценке интеллектуальных возможностей, при этом снижая задержку почти вдвое и стоимость на 83%. Эта модель поддерживает максимальную длину контекста в 1,047,576 токенов.
GPT-4.1 — модель искусственного интеллекта, предоставляемая компанией OpenAI. gpt-4.1-nano: Обладает увеличенным контекстным окном — поддерживает до 1 миллиона контекстных токенов и лучше использует этот контекст благодаря улучшенному пониманию длинных контекстов. Имеет обновлённый срез знаний по состоянию на июнь 2024 года. Эта модель поддерживает максимальную длину контекста 1,047,576 токенов.