Технические характеристики Qwen3.7-Plus
| Пункт | Характеристика |
|---|---|
| Название модели | Qwen3.7-Plus |
| Поставщик | Alibaba Cloud (Qwen Team) |
| Идентификатор модели API | qwen3.7-plus |
| Тип модели | Мультимодальная агентная модель |
| Типы ввода | Текст, Изображения, Видео |
| Типы вывода | Текст |
| Окно контекста | До 1,000,000 токенов |
| Максимум токенов на входе | ~991.8K |
| Максимум токенов на выходе | ~65.5K |
| Ключевые сильные стороны | Визуально-языковое рассуждение, программирование, взаимодействие с GUI, агентные рабочие процессы |
| Встроенные возможности | Вызов функций, структурированные ответы, кэш, веб-поиск, пакетный API |
| Совместимость API | Совместим с OpenAI через DashScope / Model Studio |
Что такое Qwen3.7-Plus?
Qwen3.7-Plus — сбалансированный мультимодальный флагман в поколении Qwen 3.7 от Alibaba. В то время как Qwen3.7-Max сосредоточен на чисто текстовом рассуждении и долгосрочном кодинге, Qwen3.7-Plus расширяет эти возможности за счет встроенного понимания изображений и видео, позволяя рассуждать на основе визуальной и текстовой информации в рамках одной модели.
Модель разработана вокруг идеи мультимодального интерактивного гибридного агента: она может интерпретировать скриншоты, анализировать диаграммы, понимать интерфейсы, генерировать код по визуальным референсам и использовать инструменты для выполнения многошаговых задач. Это делает ее особенно привлекательной для ИИ-агентов, автоматизации GUI и рабочих процессов повышения продуктивности, где важен визуальный контекст.
Основные возможности Qwen3.7-Plus
- Родная мультимодальная подача с поддержкой текста, изображений и видео в едином конвейере рассуждений.
- Контекстное окно до 1M токенов, позволяющее анализировать крупные кодовые базы и работать с длинными документами.
- Гибридные возможности агента для GUI и CLI, что позволяет модели понимать экраны и взаимодействовать с программной средой.
- Продвинутый кодинг и использование инструментов, включая вызов функций, структурированные ответы и интеграцию с внешними инструментами.
- Визуальное понимание диаграмм, документов и скриншотов, полезное для бизнес-, инженерных и UI‑задач.
- Совместимая с OpenAI конечная точка API, упрощающая миграцию с существующей инфраструктуры LLM.
Результаты бенчмарков Qwen3.7-Plus
Согласно публичным отчетам по бенчмаркам и сторонним платформам оценки, Qwen3.7-Plus демонстрирует передовой уровень мультимодальной и агентной производительности:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: примерно 90.0%.
- IFBench: примерно 78.0%.
- AA Long Context Reasoning (AA-LCR): примерно 65.0%.
- Terminal-Bench Hard: примерно 47.0%, что отражает сильные агентные возможности в программировании.
Alibaba также сообщает, rằng Qwen3.7-Plus показывает конкурентные результаты по сравнению с ведущими проприетарными моделями в агентных и кодинговых бенчмарках, демонстрируя особую силу в мультимодальных задачах и взаимодействии с UI.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| Характеристика | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| Модальности ввода | Текст, Изображение, Видео | Только текст | Текст, Изображение |
| Окно контекста | До 1M токенов | 1M токенов | Большой контекст |
| Понимание визуальной информации | Отличное | Не поддерживается | Сильное |
| Агентное/GUI‑взаимодействие | Основной акцент | Ограниченное | Хорошее |
| Долговременное текстовое рассуждение | Очень сильное | Лучшее в семействе Qwen | Отличное |
| Оптимальное применение | Мультимодальные агенты и продуктивность | Кодинг, математика, глубокое рассуждение | Корпоративные сценарии рассуждения и программирования |
Для проектов, связанных со скриншотами, автоматизацией UI, визуальной отладкой или мультимодальными рабочими процессами, Qwen3.7-Plus обычно является лучшим выбором. Для сугубо текстовых задач или кодинга на уровне репозиториев Qwen3.7-Max остается более сильным вариантом.
Ограничения
- Qwen3.7-Plus в настоящее время выпущена как проприетарная модель на стадии превью, и некоторые возможности могут измениться до стабильного релиза.
- Функция вызова функций и часть инструментов агента еще находятся в процессе внедрения.
- Для чисто текстовых задач, требующих интенсивного рассуждения, Qwen3.7-Max может обеспечивать немного лучшую производительность.
- Как и для большинства крупных мультимодальных моделей, разработчикам следует валидировать показатели на собственных наборах изображений и UI перед внедрением в продакшн.
Типичные сценарии использования
- ИИ‑агенты, объединяющие взаимодействия в браузере, GUI и терминале.
- Отладка ПО по скриншотам и снимкам интерфейсов.
- Анализ документов, диаграмм и дашбордов.
- Визуальные ассистенты по программированию, которые генерируют код по макетам или диаграммам.
- Корпоративные рабочие процессы продуктивности с комбинированными текстовыми и графическими входными данными.
- Мультимодальные исследовательские ассистенты, сочетающие веб‑поиск с визуальным пониманием.