Qwen3.7-Plus の技術仕様
| 項目 | 仕様 |
|---|---|
| モデル名 | Qwen3.7-Plus |
| 提供元 | Alibaba Cloud (Qwen Team) |
| API モデル ID | qwen3.7-plus |
| モデルタイプ | マルチモーダルエージェントモデル |
| 入力タイプ | テキスト、画像、動画 |
| 出力タイプ | テキスト |
| コンテキストウィンドウ | 最大 1,000,000 トークン |
| 最大入力トークン数 | ~991.8K |
| 最大出力トークン数 | ~65.5K |
| コア強み | 視覚と言語の推論、コーディング、GUI インタラクション、エージェントワークフロー |
| 内蔵機能 | 関数呼び出し、構造化出力、キャッシュ、ウェブ検索、バッチ API |
| API 互換性 | DashScope / Model Studio を介した OpenAI 互換 |
Qwen3.7-Plus とは?
Qwen3.7-Plus は、Alibaba の Qwen 3.7 世代におけるバランス型のマルチモーダル・フラッグシップです。Qwen3.7-Max が純粋なテキスト推論や長期的なコーディングに特化する一方で、Qwen3.7-Plus はネイティブな画像・動画理解を加えることでそれらの能力を拡張し、単一のモデル内で視覚情報とテキスト情報をまたいだ推論を可能にします。
本モデルは、マルチモーダル対話型ハイブリッドエージェントという発想を中心に設計されています。スクリーンショットの解釈、チャートの分析、インターフェースの理解、視覚的参照からのコード生成、そしてツールを用いたマルチステップ作業の遂行が可能です。これにより、視覚的文脈が重要となる AI エージェント、GUI 自動化、生産性ワークフローに特に有用です。
Qwen3.7-Plus の主な機能
- ネイティブなマルチモーダル入力:テキスト、画像、動画を単一の推論パイプラインで統合処理。
- 最大 1M トークンのコンテキストウィンドウ:大規模コードベース解析や長文ドキュメントの処理を実現。
- GUI と CLI のハイブリッドエージェント機能:画面の理解とソフトウェア環境との対話に対応。
- 高度なコーディングとツール利用:関数呼び出し、構造化出力、外部ツール連携に対応。
- チャート、ドキュメント、スクリーンショットの視覚理解:ビジネス、エンジニアリング、UI タスクで有用。
- OpenAI 互換 API エンドポイント:既存の LLM 基盤から比較的容易に移行可能。
Qwen3.7-Plus のベンチマーク性能
公開ベンチマーク報告および第三者評価プラットフォームによれば、Qwen3.7-Plus は最先端レベルのマルチモーダルおよびエージェント性能を示しています。
- Artificial Analysis Intelligence Index: 53.3。
- GPQA Diamond: 約 90.0%。
- IFBench: 約 78.0%。
- AA Long Context Reasoning (AA-LCR): 約 65.0%。
- Terminal-Bench Hard: 約 47.0%(エージェント型のコーディング能力の高さを反映)。
また、Alibaba は、Qwen3.7-Plus がエージェントやコーディング系ベンチマークで主要なプロプライエタリモデルと競合する性能を発揮し、特にマルチモーダルタスクと UI 連携に強みがあると報告しています。
Qwen3.7-Plus と Qwen3.7-Max と Claude Opus 4.6 の比較
| 機能 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 入力モダリティ | テキスト、画像、動画 | テキストのみ | テキスト、画像 |
| コンテキストウィンドウ | 最大 1M トークン | 1M トークン | 大容量コンテキスト |
| 視覚理解 | 優れた | 非対応 | 強力 |
| エージェント / GUI インタラクション | ネイティブ対応を重視 | 限定的 | 良好 |
| 長期的なテキスト推論 | 非常に強力 | Qwen ファミリーで最良 | 優れた |
| 最適なユースケース | マルチモーダルエージェントと生産性向上 | コーディング、数学、深い推論 | エンタープライズ向けの推論とコーディング |
スクリーンショット、UI 自動化、ビジュアルデバッグ、またはマルチモーダルワークフローを含むプロジェクトには、Qwen3.7-Plus が概してより適しています。純粋にテキストベースの推論やリポジトリ規模のコーディングには、Qwen3.7-Max が依然としてより強力な選択肢です。
制限事項
- Qwen3.7-Plus は現在、プレビュー段階のプロプライエタリモデルとして公開されており、安定版リリース前に一部の機能が変更される可能性があります。
- 関数呼び出しや一部のエージェント用ツール機能は、順次ロールアウト中です。
- 純粋にテキストのみで推論負荷が高いワークロードでは、Qwen3.7-Max の方がわずかに高い性能を示す場合があります。
- 他の大規模マルチモーダルモデル同様、本番導入前に自社の画像および UI データセットで性能検証を行う必要があります。
代表的なユースケース
- ブラウザ、GUI、ターミナル操作を組み合わせた AI エージェント。
- スクリーンショットや UI キャプチャからのソフトウェアデバッグ。
- ドキュメント、チャート、ダッシュボードの分析。
- モックアップやダイアグラムからコードを生成するビジュアルコーディングアシスタント。
- テキストと画像入力を組み合わせたエンタープライズの生産性ワークフロー。
- ウェブ検索と視覚理解を統合するマルチモーダル研究アシスタント。