Spesifikasi Teknikal Qwen3.7-Plus
| Perkara | Spesifikasi |
|---|---|
| Nama Model | Qwen3.7-Plus |
| Penyedia | Alibaba Cloud (Qwen Team) |
| ID Model API | qwen3.7-plus |
| Jenis Model | Model ejen multimodal |
| Jenis Input | Teks, Imej, Video |
| Jenis Output | Teks |
| Tetingkap Konteks | Sehingga 1,000,000 token |
| Token Input Maksimum | ~991.8K |
| Token Output Maksimum | ~65.5K |
| Kekuatan Teras | Penaakulan visual-bahasa, pengekodan, interaksi GUI, aliran kerja ejen |
| Ciri Terbina Dalam | Panggilan Fungsi, Output Berstruktur, Cache, Carian Web, API Kelompok |
| Keserasian API | Serasi dengan OpenAI melalui DashScope / Model Studio |
Apakah Qwen3.7-Plus?
Qwen3.7-Plus ialah produk unggulan multimodal yang seimbang dalam generasi Qwen 3.7 oleh Alibaba. Sementara Qwen3.7-Max menumpukan pada penaakulan teks tulen dan pengekodan jangka panjang, Qwen3.7-Plus meluaskan keupayaan tersebut dengan pemahaman imej dan video natif, membolehkannya membuat penaakulan merentas maklumat visual dan teks dalam satu model.
Model ini direka berasaskan idea ejen hibrid interaktif multimodal: ia boleh mentafsir tangkapan skrin, menganalisis carta, memahami antara muka, menjana kod daripada rujukan visual, dan menggunakan alat untuk menyiapkan tugasan berbilang langkah. Ini menjadikannya amat menarik untuk ejen AI, automasi GUI, dan aliran kerja produktiviti di mana konteks visual penting.
Ciri Utama Qwen3.7-Plus
- Input multimodal natif yang menyokong teks, imej, dan video dalam saluran penaakulan bersatu.
- Tetingkap konteks sehingga 1M token, membolehkan analisis pangkalan kod besar dan aliran kerja dokumen panjang.
- Keupayaan ejen hibrid GUI + CLI, membolehkan model memahami skrin dan berinteraksi dengan persekitaran perisian.
- Pengekodan dan penggunaan alat lanjutan, termasuk panggilan fungsi, output berstruktur, dan integrasi alat luaran.
- Pemahaman visual untuk carta, dokumen, dan tangkapan skrin, menjadikannya berguna untuk tugasan perniagaan, kejuruteraan, dan UI.
- Titik akhir API serasi OpenAI, membolehkan migrasi yang agak mudah daripada infrastruktur LLM sedia ada.
Prestasi Penanda Aras Qwen3.7-Plus
Menurut pelaporan penanda aras awam dan platform penilaian pihak ketiga, Qwen3.7-Plus memberikan prestasi multimodal dan berorientasi ejen pada tahap terdepan:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: kira-kira 90.0%.
- IFBench: kira-kira 78.0%.
- AA Long Context Reasoning (AA-LCR): kira-kira 65.0%.
- Terminal-Bench Hard: kira-kira 47.0%, mencerminkan keupayaan pengekodan berorientasi ejen yang kukuh.
Alibaba turut melaporkan bahawa Qwen3.7-Plus berprestasi kompetitif berbanding model proprietari terkemuka pada penanda aras ejen dan pengekodan, dengan kekuatan khusus dalam tugasan multimodal dan interaksi UI.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| Ciri | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| Modaliti Input | Teks, Imej, Video | Teks sahaja | Teks, Imej |
| Tetingkap Konteks | Sehingga 1M token | 1M token | Konteks besar |
| Pemahaman Visual | Cemerlang | Tidak disokong | Kukuh |
| Interaksi Ejen / GUI | Fokus asli | Terhad | Baik |
| Penaakulan Teks Jangka Panjang | Sangat kukuh | Terbaik dalam keluarga Qwen | Cemerlang |
| Kes Penggunaan Terbaik | Ejen multimodal dan produktiviti | Pengekodan, matematik, penaakulan mendalam | Penaakulan dan pengekodan perusahaan |
Untuk projek yang melibatkan tangkapan skrin, automasi UI, nyahpepijat visual, atau aliran kerja multimodal, Qwen3.7-Plus lazimnya pilihan yang lebih baik. Untuk penaakulan berasaskan teks semata-mata atau pengekodan pada skala repositori, Qwen3.7-Max kekal sebagai pilihan yang lebih kukuh.
Batasan
- Qwen3.7-Plus pada masa ini dikeluarkan sebagai model proprietari peringkat pratonton, dan sesetengah keupayaan mungkin berkembang sebelum keluaran stabil.
- Ciri panggilan fungsi dan sesetengah keupayaan alat ejen masih sedang dilancarkan.
- Untuk beban kerja berasaskan teks sahaja yang memerlukan penaakulan intensif, Qwen3.7-Max mungkin memberikan prestasi yang sedikit lebih baik.
- Seperti kebanyakan model multimodal berskala besar, pembangun harus mengesahkan prestasi pada set data imej dan UI mereka sendiri sebelum digunakan dalam persekitaran produksi.
Kes Penggunaan Representatif
- Ejen AI yang menggabungkan interaksi pelayar, GUI, dan terminal.
- Nyahpepijat perisian daripada tangkapan skrin dan rakaman UI.
- Analisis dokumen, carta, dan papan pemuka.
- Pembantu pengekodan visual yang menjana kod daripada lakaran atau rajah.
- Aliran kerja produktiviti perusahaan yang melibatkan input teks dan imej bercampur.
- Pembantu penyelidikan multimodal yang menggabungkan carian web dengan pemahaman visual.