Qwen3.7-Plus 的技術規格
| 項目 | 規格 |
|---|---|
| 模型名稱 | Qwen3.7-Plus |
| 供應商 | Alibaba Cloud (Qwen Team) |
| API 模型 ID | qwen3.7-plus |
| 模型類型 | 多模態代理模型 |
| 輸入類型 | 文字、圖片、影片 |
| 輸出類型 | 文字 |
| 上下文視窗 | 最多 1,000,000 tokens |
| 最大輸入 Token 數 | ~991.8K |
| 最大輸出 Token 數 | ~65.5K |
| 核心優勢 | 視覺-語言推理、程式設計、GUI 互動、代理工作流程 |
| 內建功能 | 函式呼叫、結構化輸出、快取、網路搜尋、批次 API |
| API 相容性 | 透過 DashScope / Model Studio 與 OpenAI 相容 |
什麼是 Qwen3.7-Plus?
Qwen3.7-Plus 是阿里巴巴 Qwen 3.7 世代中定位為平衡型的多模態旗艦。雖然 Qwen3.7-Max 著重於純文字推理與長程程式設計,Qwen3.7-Plus 則在此基礎上擴展了原生的影像與影片理解能力,使其能在單一模型內跨視覺與文本資訊進行推理。
此模型以「多模態互動式混合代理」的理念設計:能解讀截圖、分析圖表、理解介面、根據視覺參考產生程式碼,並使用工具完成多步驟任務。這使其特別適合需要視覺脈絡的 AI 代理、GUI 自動化與生產力工作流程。
Qwen3.7-Plus 的主要功能
- 原生多模態輸入,在統一的推理流程中支援文字、圖片與影片。
- 最多 1M Token 的上下文視窗,可支援大型程式碼庫分析與長文件工作流程。
- 混合式 GUI + CLI 代理能力,讓模型能理解畫面並與軟體環境互動。
- 先進的程式設計與工具使用,包含函式呼叫、結構化輸出與外部工具整合。
- 對圖表、文件與截圖的視覺理解,適用於商務、工程與 UI 任務。
- 與 OpenAI 相容的 API 端點,便於從既有 LLM 基礎架構相對容易地遷移。
Qwen3.7-Plus 的基準表現
根據公開基準報告與第三方評測平台,Qwen3.7-Plus 在多模態與代理能力方面達到前沿水準:
- Artificial Analysis Intelligence Index: 53.3。
- GPQA Diamond: 約 90.0%。
- IFBench: 約 78.0%。
- AA Long Context Reasoning (AA-LCR): 約 65.0%。
- Terminal-Bench Hard: 約 47.0%,展現出色的代理型程式設計能力。
阿里巴巴亦表示,Qwen3.7-Plus 在代理與程式設計基準上與領先的商業模型具競爭力,尤其在多模態任務與 UI 互動方面表現突出。
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| 功能 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 輸入模態 | 文字、圖片、影片 | 僅文字 | 文字、圖片 |
| 上下文視窗 | 最多 1M tokens | 1M tokens | 大型上下文 |
| 視覺理解 | 優異 | 不支援 | 強 |
| 代理 / GUI 互動 | 原生著重 | 受限 | 良好 |
| 長程文字推理 | 非常強 | Qwen 系列中最佳 | 優秀 |
| 最佳使用情境 | 多模態代理與生產力 | 程式設計、數學、深度推理 | 企業級推理與程式設計 |
若專案涉及截圖、UI 自動化、視覺除錯或多模態工作流程,Qwen3.7-Plus 通常是更好的選擇。若是純文字推理或儲庫級程式碼處理,Qwen3.7-Max 仍然更為強勢。
限制
- Qwen3.7-Plus 目前以預覽階段的商用專有模型釋出,部分能力在穩定版發布前可能會有所調整。
- 函式呼叫與部分代理工具功能仍在陸續推出中。
- 對於純文字、重度推理的工作負載,Qwen3.7-Max 可能提供略優的效能。
- 與多數大型多模態模型相同,開發者在投入生產前應先在自身影像與 UI 資料集上驗證效能。
代表性使用案例
- 結合瀏覽器、GUI 與終端互動的 AI 代理。
- 根據截圖與 UI 擷取進行軟體除錯。
- 文件、圖表與儀表板分析。
- 從雛形或圖表產生程式碼的視覺化程式設計助理。
- 涉及文字與圖片混合輸入的企業生產力工作流程。
- 結合網路搜尋與視覺理解的多模態研究助理。