Технические характеристики Qwen3.7-Plus
| Параметр | Характеристика |
|---|---|
| Название модели | Qwen3.7-Plus |
| Поставщик | Alibaba Cloud (Qwen Team) |
| Идентификатор модели API | qwen3.7-plus |
| Тип модели | Мультимодальная агентная модель |
| Типы ввода | Текст, изображения, видео |
| Типы вывода | Текст |
| Контекстное окно | До 1,000,000 токенов |
| Максимальное число токенов на входе | ~991.8K |
| Максимальное число токенов на выходе | ~65.5K |
| Ключевые сильные стороны | Визуально-языковое рассуждение, программирование, взаимодействие с GUI, агентные рабочие процессы |
| Встроенные возможности | Вызов функций, структурированные ответы, кэш, веб-поиск, пакетный API |
| Совместимость API | Совместим с OpenAI через DashScope / Model Studio |
Что такое Qwen3.7-Plus?
Qwen3.7-Plus — сбалансированный мультимодальный флагман в поколении Qwen 3.7 от Alibaba. В то время как Qwen3.7-Max фокусируется на чистом текстовом рассуждении и программировании на длинных горизонтах, Qwen3.7-Plus расширяет эти возможности за счет встроенного понимания изображений и видео, что позволяет ему рассуждать одновременно по визуальной и текстовой информации в рамках одной модели.
Модель построена вокруг идеи мультимодального интерактивного гибридного агента: она может интерпретировать скриншоты, анализировать диаграммы, понимать интерфейсы, генерировать код по визуальным референсам и использовать инструменты для выполнения многошаговых задач. Это делает ее особенно привлекательной для ИИ-агентов, автоматизации GUI и рабочих процессов, где важен визуальный контекст.
Основные возможности Qwen3.7-Plus
- Нативный мультимодальный ввод с поддержкой текста, изображений и видео в единой цепочке рассуждений.
- Контекстное окно до 1M токенов, что позволяет анализировать крупные кодовые базы и работать с длинными документами.
- Гибридные агентные возможности GUI + CLI, позволяющие модели понимать экраны и взаимодействовать с программными средами.
- Продвинутые возможности программирования и работы с инструментами, включая вызов функций, структурированные ответы и интеграцию внешних инструментов.
- Визуальное понимание диаграмм, документов и скриншотов, что делает модель полезной для бизнес-, инженерных и UI-задач.
- Конечная точка API, совместимая с OpenAI, что упрощает миграцию с существующей инфраструктуры LLM.
Результаты бенчмарков Qwen3.7-Plus
Согласно публичным отчетам по бенчмаркам и платформам сторонней оценки, Qwen3.7-Plus демонстрирует передовой уровень производительности в мультимодальных и агентных задачах:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: приблизительно 90.0%.
- IFBench: приблизительно 78.0%.
- AA Long Context Reasoning (AA-LCR): приблизительно 65.0%.
- Terminal-Bench Hard: приблизительно 47.0%, что отражает сильные агентные возможности в области программирования.
Alibaba также сообщает, что Qwen3.7-Plus показывает конкурентные результаты по сравнению с ведущими проприетарными моделями в агентных и кодовых бенчмарках, особенно сильна в мультимодальных задачах и взаимодействии с UI.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| Характеристика | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| Модальности ввода | Текст, изображение, видео | Только текст | Текст, изображение |
| Контекстное окно | До 1M токенов | 1M токенов | Большое контекстное окно |
| Понимание визуальной информации | Отличное | Не поддерживается | Сильное |
| Агент / взаимодействие с GUI | Основной акцент | Ограниченное | Хорошее |
| Долгосрочное текстовое рассуждение | Очень сильное | Лучшее в семействе Qwen | Отличное |
| Оптимальные сценарии использования | Мультимодальные агенты и повышение продуктивности | Программирование, математика, глубокие рассуждения | Корпоративные сценарии рассуждений и программирование |
Для проектов, связанных со скриншотами, автоматизацией UI, визуальной отладкой или мультимодальными рабочими процессами, как правило, лучше подходит Qwen3.7-Plus. Для чисто текстового рассуждения или программирования на уровне репозиториев более сильным вариантом остается Qwen3.7-Max.
Ограничения
- Qwen3.7-Plus в настоящее время выпущена как проприетарная модель на стадии предварительного релиза; некоторые возможности могут измениться до стабильного релиза.
- Вызов функций и некоторые возможности инструментов агента все еще внедряются.
- Для чисто текстовых, требовательных к рассуждению задач Qwen3.7-Max может показывать немного лучшую производительность.
- Как и в случае большинства крупных мультимодальных моделей, разработчикам следует валидировать качество на собственных датасетах изображений и UI перед внедрением в продакшен.
Типичные сценарии использования
- ИИ-агенты, объединяющие взаимодействие с браузером, GUI и терминалом.
- Отладка ПО по скриншотам и снимкам интерфейсов.
- Анализ документов, диаграмм и дашбордов.
- Визуальные ассистенты для кодирования, генерирующие код по макетам или диаграммам.
- Корпоративные рабочие процессы повышения продуктивности с комбинированным вводом текста и изображений.
- Мультимодальные исследовательские ассистенты, сочетающие веб-поиск с визуальным пониманием