GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
new/Исследования CometAPI

Может ли GPT-OSS стать будущим локального развертывания ИИ?

Компания OpenAI объявила о выпуске GPT-OSS, семейства из двух моделей открытого языка — gpt-oss-120b и gpt-oss-20b — под разрешительной лицензией Apache 2.0.

CometAPI
AnnaКоманда исследователей AI-моделей и API
Обновлено Sep 3, 2026 4 мин. чтения
Может ли GPT-OSS стать будущим локального развертывания ИИ?
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

OpenAI объявила о выпуске GPT-OSS, семейство из двух моделей открытого языка —gpt-oss-120b и gpt-oss-20b— под разрешительной лицензией Apache 2.0, что является первым крупным предложением с открытым весом после GPT-2. В объявлении, опубликованном 5 августа 2025 года, подчёркивается, что эти модели обеспечивают передовую производительность рассуждений при стоимости, составляющей лишь малую часть стоимости, связанной с проприетарными альтернативами, и, что особенно важно, могут быть развернуты как в локальной, так и в облачной инфраструктуре.

Техническая Архитектура

Серия GPT-OSS использует Смесь экспертов (МО) Трансформаторная архитектура для баланса производительности и эффективности.

  • gpt-oss-120b: 117 миллиардов параметров в целом, активирует 5.1 миллиарда параметров на токен, использует 128 экспертов (4 активных на токен) и охватывает 36 слоев.
  • gpt-oss-20b: 21 миллиардов параметров в целом, активирует 3.6 миллиарда параметров на токен, использует 32 экспертов (4 активных на токен) и охватывает 24 слоев.
    Обе модели используют чередующиеся плотные и локально разреженные шаблоны внимания, а также сгруппированное многозапросное внимание для эффективного использования памяти.

Оценки производительности и безопасности

OpenAI сообщает, что gpt-oss-120b По производительности он соответствует или превосходит собственную модель o4-mini в различных внутренних тестах, включая соревновательное кодирование (Codeforces), решение общих задач (MMLU и HLE) и запросы, связанные со здоровьем (HealthBench). gpt-oss-20b превосходит старый o3-mini по задачам олимпиадной математики (AIME 2024 и 2025) и здоровья, несмотря на свой меньший размер.

Кроме того, внешние эксперты проверили методологию безопасности, подтвердив, что она соответствует тем же строгим стандартам безопасности, что и решения OpenAI с закрытым весом. Консультативная группа по безопасности OpenAI также провела тщательную настройку gpt-oss-120b для проверки высокорисковых возможностей (биологических, химических, кибернетических), не найдя никаких доказательств того, что выпуск с открытым весом значительно расширяет эти векторы угроз по сравнению с существующими открытыми моделями.


Доступность и развертывание

Ключевым этапом GPT OSS является местное исполнение:

  • gpt-oss-20b может работать на мощном ноутбуке с современным графическим процессором, позволяя запускать как автономные, так и локальные приложения.
  • gpt-oss-120b оптимизирован для работы на одном графическом процессоре корпоративного уровня, что делает его доступным для организаций среднего размера без крупных вычислительных кластеров.
  • Суверенитет данных и конфиденциальность: Сохраняя все выводы локально, GPT-OSS сводит к минимуму нормативные риски и риски безопасности, что критически важно для таких секторов, как финансы, здравоохранение и государственное управление.
  • Полная интеграция: Предварительно настроенная поддержка в Hugging Face Transformers (v4.55.0) и руководства по контейнерному развертыванию от Northflank делают развертывание GPT-OSS таким же простым, как запуск локального сервера.

«Благодаря GPT OSS мы предоставляем разработчикам и организациям возможность использовать передовые технологии ИИ как полностью собственные, настраиваемые ресурсы», — заявил Сэм Альтман, генеральный директор OpenAI. «Этот выпуск знаменует собой поворотный момент в демократизации доступа к передовым языковым моделям, сохраняя при этом высочайшие стандарты безопасности и производительности».

Открывая исходный код этих мощных моделей, OpenAI стремится создать более динамичную экосистему инноваций, стимулируя индивидуальную настройку, создание новых плагинов и креативных приложений, которые продвигают ИИ вперёд. Разработчики и компании могут сразу скачать модели из репозитория OpenAI на GitHub и начать экспериментировать с локальным выводом, пользовательскими интеграциями и специализированными оценками безопасности.

Первые шаги

CometAPI — это унифицированная платформа API, которая объединяет более 500 моделей ИИ от ведущих поставщиков, таких как серия GPT OpenAI, Gemini от Google, Claude от Anthropic, Midjourney, Suno и других, в единый, удобный для разработчиков интерфейс. Предлагая последовательную аутентификацию, форматирование запросов и обработку ответов, CometAPI значительно упрощает интеграцию возможностей ИИ в ваши приложения. Независимо от того, создаете ли вы чат-ботов, генераторы изображений, композиторов музыки или конвейеры аналитики на основе данных, CometAPI позволяет вам выполнять итерации быстрее, контролировать расходы и оставаться независимыми от поставщика — и все это при использовании последних достижений в экосистеме ИИ.

Разработчики могут получить доступ ГПТ-ОСС-20Б и ГПТ-ОСС-120Б через CometAPIПоследние версии моделей указаны на дату публикации статьи. Для начала изучите возможности модели в Детская Площадка и проконсультируйтесь с API-руководство для получения подробных инструкций. Перед доступом убедитесь, что вы вошли в CometAPI и получили ключ API. CometAPI предложить цену намного ниже официальной, чтобы помочь вам интегрироваться.

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Aug 6, 2025
Последнее обновление Sep 3, 2026
30 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Готовы сократить затраты на AI-разработку на 20%?

Начните бесплатно за несколько минут. Пробные кредиты включены. Карта не нужна.

Читать далее