Qwen3.7-Plus の技術仕様
| 項目 | 仕様 |
|---|---|
| モデル名 | Qwen3.7-Plus |
| 提供元 | Alibaba Cloud (Qwen Team) |
| API モデル ID | qwen3.7-plus |
| モデルタイプ | マルチモーダルエージェントモデル |
| 入力タイプ | テキスト、画像、動画 |
| 出力タイプ | テキスト |
| コンテキストウィンドウ | 最大 1,000,000 トークン |
| 最大入力トークン数 | ~991.8K |
| 最大出力トークン数 | ~65.5K |
| 主な強み | 視覚と言語の推論、コーディング、GUI インタラクション、エージェントワークフロー |
| 内蔵機能 | 関数呼び出し、構造化出力、キャッシュ、ウェブ検索、バッチ API |
| API 互換性 | DashScope / Model Studio 経由で OpenAI 互換 |
Qwen3.7-Plus とは?
Qwen3.7-Plus は、Alibaba の Qwen 3.7 世代におけるバランスの取れたマルチモーダル・フラッグシップです。Qwen3.7-Max が純粋なテキスト推論と長期的なコーディングに特化しているのに対し、Qwen3.7-Plus はそれらの能力を拡張し、画像や動画のネイティブ理解を備えることで、単一のモデル内で視覚情報と言語情報を横断的に推論できます。
本モデルは、マルチモーダル対話型ハイブリッドエージェントというコンセプトに基づいて設計されています。スクリーンショットの解釈、チャートの分析、インターフェースの理解、視覚的な参照からのコード生成、ツールの活用によるマルチステップタスクの遂行が可能です。これにより、視覚コンテキストが重要な AI エージェント、GUI 自動化、生産性ワークフローに特に適しています。
Qwen3.7-Plus の主な機能
- テキスト・画像・動画を統合した推論パイプラインで扱うネイティブなマルチモーダル入力。
- 最大 1M トークンのコンテキストウィンドウにより、大規模コードベース解析や長文ドキュメントの処理が可能。
- GUI + CLI のハイブリッドなエージェント機能により、画面の理解とソフトウェア環境へのインタラクションを実現。
- 関数呼び出し、構造化出力、外部ツール連携などを含む高度なコーディングとツール利用。
- チャート、ドキュメント、スクリーンショットに対する視覚理解で、ビジネス、エンジニアリング、UI のタスクに有用。
- OpenAI 互換の API エンドポイントにより、既存の LLM 基盤から比較的容易に移行可能。
Qwen3.7-Plus のベンチマーク性能
公開ベンチマークのレポートおよび第三者評価プラットフォームによれば、Qwen3.7-Plus はマルチモーダルおよびエージェント領域で最前線レベルの性能を示します。
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: 約 90.0%。
- IFBench: 約 78.0%。
- AA Long Context Reasoning (AA-LCR): 約 65.0%。
- Terminal-Bench Hard: 約 47.0%(エージェント志向のコーディング能力の高さを反映)。
Alibaba はまた、Qwen3.7-Plus がエージェントやコーディングのベンチマークにおいて主要なプロプライエタリモデルと競合し、特にマルチモーダルタスクや UI インタラクションで強みを示すと報告しています。
Qwen3.7-Plus と Qwen3.7-Max と Claude Opus 4.6 の比較
| 機能 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 入力モダリティ | テキスト、画像、動画 | テキストのみ | テキスト、画像 |
| コンテキストウィンドウ | 最大 1M トークン | 1M トークン | 大きなコンテキスト |
| 視覚理解 | 優秀 | 非対応 | 強力 |
| エージェント / GUI インタラクション | ネイティブに注力 | 限定的 | 良好 |
| 長期的なテキスト推論 | 非常に強力 | Qwen ファミリー内で最強 | 優れた |
| 最適なユースケース | マルチモーダルエージェントと生産性 | コーディング、数学、深い推論 | 企業向けの推論とコーディング |
スクリーンショット、UI 自動化、ビジュアルデバッグ、マルチモーダルなワークフローを伴うプロジェクトには、一般に Qwen3.7-Plus が適しています。純粋にテキストベースの推論やリポジトリ規模のコーディングには、Qwen3.7-Max がより強力な選択肢です。
制限事項
- Qwen3.7-Plus は現在、プレビュー段階のプロプライエタリモデルとして提供されており、安定版のリリースまでに一部の機能が変化する可能性があります。
- 関数呼び出しや一部のエージェント向けツール機能は、まだ段階的に展開中です。
- 純粋にテキストのみで推論負荷の高いワークロードでは、Qwen3.7-Max の方がわずかに高い性能を示す場合があります。
- 多くの大規模マルチモーダルモデルと同様に、本番導入前には自社の画像や UI データセットで性能検証を行う必要があります。
代表的なユースケース
- ブラウザ、GUI、ターミナルの操作を組み合わせる AI エージェント。
- スクリーンショットや UI キャプチャからのソフトウェアデバッグ。
- ドキュメント、チャート、ダッシュボードの分析。
- モックアップやダイアグラムからコードを生成するビジュアルコーディングアシスタント。
- テキストと画像が混在するエンタープライズ生産性ワークフロー。
- ウェブ検索と視覚理解を組み合わせたマルチモーダル研究アシスタント