Spesifikasi Teknikal Qwen3.7-Plus
| Perkara | Spesifikasi |
|---|---|
| Nama Model | Qwen3.7-Plus |
| Penyedia | Alibaba Cloud (Qwen Team) |
| ID Model API | qwen3.7-plus |
| Jenis Model | Model agen multimodal |
| Jenis Input | Teks, Imej, Video |
| Jenis Output | Teks |
| Tetingkap Konteks | Sehingga 1,000,000 token |
| Token Input Maksimum | ~991.8K |
| Token Output Maksimum | ~65.5K |
| Kekuatan Teras | Penaakulan penglihatan-bahasa, pengekodan, interaksi GUI, aliran kerja agen |
| Ciri Terbina Dalam | Panggilan Fungsi, Output Berstruktur, Cache, Carian Web, API Kelompok |
| Keserasian API | Serasi OpenAI melalui DashScope / Model Studio |
Apakah Qwen3.7-Plus?
Qwen3.7-Plus ialah model multimodal perdana yang seimbang dalam generasi Qwen 3.7 oleh Alibaba. Sementara Qwen3.7-Max menumpukan pada penaakulan teks tulen dan pengekodan jangka panjang, Qwen3.7-Plus meluaskan keupayaan tersebut dengan pemahaman imej dan video asli, membolehkannya menaakul merentas maklumat visual dan teks dalam satu model.
Model ini direka berasaskan idea agen hibrid interaktif multimodal: ia boleh mentafsir tangkapan skrin, menganalisis carta, memahami antara muka, menjana kod daripada rujukan visual, dan menggunakan alat untuk menyiapkan tugasan berbilang langkah. Ini menjadikannya amat sesuai untuk agen AI, automasi GUI, dan aliran kerja produktiviti yang memerlukan konteks visual.
Ciri Utama Qwen3.7-Plus
- Input multimodal asli yang menyokong teks, imej dan video dalam saluran penaakulan yang disatukan.
- Tetingkap konteks sehingga 1M token, membolehkan analisis pangkalan kod yang besar dan aliran kerja dokumen panjang.
- Keupayaan agen hibrid GUI + CLI, membolehkan model memahami skrin dan berinteraksi dengan persekitaran perisian.
- Pengekodan lanjutan dan penggunaan alat, termasuk panggilan fungsi, output berstruktur, dan penyepaduan alat luaran.
- Pemahaman visual untuk carta, dokumen dan tangkapan skrin, menjadikannya berguna untuk tugas perniagaan, kejuruteraan dan UI.
- Titik akhir API serasi OpenAI, memudahkan migrasi daripada infrastruktur LLM sedia ada.
Prestasi Penanda Aras Qwen3.7-Plus
Menurut pelaporan penanda aras awam dan platform penilaian pihak ketiga, Qwen3.7-Plus menyampaikan prestasi multimodal dan berorientasikan agen pada aras termaju:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: sekitar 90.0%.
- IFBench: sekitar 78.0%.
- AA Long Context Reasoning (AA-LCR): sekitar 65.0%.
- Terminal-Bench Hard: sekitar 47.0%, mencerminkan keupayaan pengekodan berorientasikan agen yang kukuh.
Alibaba turut melaporkan bahawa Qwen3.7-Plus berprestasi kompetitif dengan model proprietari terkemuka pada penanda aras agen dan pengekodan, dengan kekuatan khusus dalam tugasan multimodal dan interaksi UI.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| Ciri | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| Modaliti Input | Teks, Imej, Video | Hanya teks | Teks, Imej |
| Tetingkap Konteks | Sehingga 1M token | 1M token | Konteks besar |
| Pemahaman Visi | Cemerlang | Tidak disokong | Kuat |
| Interaksi Agen / GUI | Fokus asli | Terhad | Baik |
| Penaakulan Teks Jangka Panjang | Sangat kuat | Terbaik dalam keluarga Qwen | Cemerlang |
| Kegunaan Terbaik | Agen multimodal dan produktiviti | Pengekodan, matematik, penaakulan mendalam | Penaakulan dan pengekodan perusahaan |
Untuk projek yang melibatkan tangkapan skrin, automasi UI, penyahpepijatan visual atau aliran kerja multimodal, Qwen3.7-Plus lazimnya pilihan yang lebih baik. Untuk penaakulan berasaskan teks sepenuhnya atau pengekodan pada skala repositori, Qwen3.7-Max kekal sebagai pilihan yang lebih kukuh.
Had
- Qwen3.7-Plus kini dikeluarkan sebagai model proprietari peringkat pratonton, dan sesetengah keupayaan mungkin berkembang sebelum keluaran stabil.
- Ciri panggilan fungsi dan alat agen tertentu masih sedang dilancarkan.
- Untuk beban kerja berasaskan teks sepenuhnya yang intensif penaakulan, Qwen3.7-Max mungkin memberikan prestasi yang sedikit lebih baik.
- Seperti kebanyakan model multimodal besar, pembangun harus mengesahkan prestasi pada set data imej dan UI mereka sendiri sebelum penggunaan produksi.
Kes Penggunaan Representatif
- Agen AI yang menggabungkan interaksi pelayar, GUI dan terminal.
- Penyahpepijatan perisian daripada tangkapan skrin dan rakaman UI.
- Analisis dokumen, carta dan papan pemuka.
- Pembantu pengekodan visual yang menjana kod daripada lakaran atau rajah.
- Aliran kerja produktiviti perusahaan yang melibatkan input teks dan imej bercampur.
- Pembantu penyelidikan multimodal yang menggabungkan carian web dengan pemahaman visual