Qwen3.7-Plus 的技術規格
| 項目 | 規格 |
|---|---|
| 型號名稱 | Qwen3.7-Plus |
| 提供方 | Alibaba Cloud (Qwen Team) |
| API 模型 ID | qwen3.7-plus |
| 模型類型 | 多模態代理模型 |
| 輸入類型 | 文字、圖片、影片 |
| 輸出類型 | 文字 |
| 上下文窗口 | 最多 1,000,000 tokens |
| 最大輸入 Tokens | ~991.8K |
| 最大輸出 Tokens | ~65.5K |
| 核心優勢 | 視覺-語言推理、程式設計、GUI 互動、代理工作流程 |
| 內建功能 | 函式呼叫、結構化輸出、快取、網頁搜尋、批次 API |
| API 相容性 | 透過 DashScope / Model Studio 與 OpenAI 相容 |
什麼是 Qwen3.7-Plus?
Qwen3.7-Plus 是阿里巴巴 Qwen 3.7 世代中定位均衡的多模態旗艦。與專注於純文字推理與長期程式設計的 Qwen3.7-Max 不同,Qwen3.7-Plus 擴展了這些能力,具備原生的圖片與影片理解,能在單一模型中跨視覺與文字資訊進行推理。
該模型圍繞著「多模態互動式混合代理」的理念設計:它能解讀螢幕截圖、分析圖表、理解介面、從視覺參考生成程式碼,並使用工具完成多步驟任務。這使其特別適用於 AI 代理、GUI 自動化與需要視覺脈絡的生產力工作流程。
Qwen3.7-Plus 的主要特性
- 原生多模態輸入,在統一推理流程中支援文字、圖片與影片。
- 最高支援 1M-token 上下文窗口,可用於大型程式碼庫分析與長文檔工作流程。
- 混合 GUI + CLI 代理能力,使模型能理解畫面並與軟體環境互動。
- 進階程式設計與工具使用能力,包括函式呼叫、結構化輸出與外部工具整合。
- 對圖表、文件與截圖的視覺理解,適用於商務、工程與 UI 任務。
- OpenAI 相容的 API 端點,便於從現有 LLM 基礎設施相對容易地遷移。
Qwen3.7-Plus 的基準測試表現
根據公開基準報告與第三方評估平台,Qwen3.7-Plus 在多模態與代理能力上表現達到前沿級水準:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: 約 90.0%。
- IFBench: 約 78.0%。
- AA Long Context Reasoning (AA-LCR): 約 65.0%。
- Terminal-Bench Hard: 約 47.0%,反映了強勁的代理式程式設計能力。
阿里巴巴亦報告,Qwen3.7-Plus 在代理與程式設計基準上與領先的商用模型具有競爭力,尤其在多模態任務與 UI 互動方面表現突出。
Qwen3.7-Plus、Qwen3.7-Max 與 Claude Opus 4.6 的比較
| 功能 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 輸入模態 | 文字、圖片、影片 | 僅文字 | 文字、圖片 |
| 上下文窗口 | 最多 1M tokens | 1M tokens | 大型上下文 |
| 視覺理解 | 優異 | 不支援 | 強大 |
| 代理 / GUI 互動 | 原生側重 | 受限 | 良好 |
| 長程文字推理 | 非常強 | Qwen 系列中最佳 | 優異 |
| 最佳使用場景 | 多模態代理與生產力 | 程式設計、數學、深度推理 | 企業級推理與程式設計 |
對於包含截圖、UI 自動化、視覺除錯或多模態工作流程的專案,Qwen3.7-Plus 通常是更佳選擇。若是純文字推理或倉庫級程式碼處理,Qwen3.7-Max 仍是更強的方案。
限制
- Qwen3.7-Plus 目前作為預覽階段的專有模型發布,部分能力在正式版前仍可能變動。
- 函式呼叫與部分代理工具功能仍在陸續推出中。
- 對於純文字且高度依賴推理的工作負載,Qwen3.7-Max 可能提供略優的表現。
- 與多數大型多模態模型相同,開發者在生產部署前應先在自身的影像與 UI 數據集上驗證其效能。
代表性使用案例
- 結合瀏覽器、GUI 與終端互動的 AI 代理。
- 從截圖與 UI 擷取進行軟體除錯。
- 文件、圖表與儀表板分析。
- 從模型圖或圖解生成程式碼的視覺程式設計助理。
- 涉及混合文字與圖片輸入的企業生產力流程。
- 結合網頁搜尋與視覺理解的多模態研究助理。