Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI โ†’

Qwen 3.7 Max: Dengan 2.4 trilion parameter, melebihi Kimi K3?

CometAPI
AnnaJul 21, 2026
Qwen 3.7 Max: Dengan 2.4 trilion parameter, melebihi Kimi K3?

TLDR: Alibabaโ€™s Qwen3.8-Max (pratonton, 2.4 trilion parameter, multimodal dengan input imej/video/dokumen) bersaing secara langsung dengan Kimi K3 daripada Moonshot AI (2.8T parameter, open weights tidak lama lagi, konteks 1M). Qwen3.8-Max cemerlang dalam tugas multimodal dan produktiviti dengan harga pratonton kira-kira 10% daripada kadar standard, manakala Kimi K3 mendahului beberapa penanda aras terbuka dan dari segi keterbukaan.

Kedua-duanya ialah model barisan hadapan yang boleh diakses hari ini melalui API. Untuk integrasi yang boleh dipercayai dan berkesan kos, CometAPI menawarkan akses Qwen yang lancar dengan titik akhir serasi OpenAI, harga berdaya saing, dan penskalaan mudah untuk pembangun serta perniagaan.

Perkara Utama:

  • Skala & Keupayaan: Daripada x's post, Qwen3.8-Max membawa multimodal asli (imej, video, dokumen) ke model 2.4T parameter; Qwen3.7-Max menyerlah dalam pengekodan berasaskan ejen dan tugasan jangka panjang.
  • Harga & Akses: Qwen3.8-Max mempunyai kadar API berdaya saing (~$2.50/$7.50 per 1M input/output, sering didiskaunkan); pratonton Qwen 3.8 pada kadar dikurangkan melalui Token Plan/Qoder.
  • Berbanding Kimi K3: Kimi K3 (2.8T, open weights 27 Julai 2026) kerap mengatasi penanda aras tetapi Qwen menawarkan multimodal dan integrasi ekosistem yang lebih kukuh; Qwen lebih murah dalam banyak senario API.
  • Akses Hari Ini: Pratonton di Alibaba Cloud/Token Plan/Qoder pada kadar diskaun; serasi API OpenAI/Anthropic.
  • Kemenangan Praktikal: Unggul untuk dev full-stack, automasi pejabat, analisis video, dan aliran kerja ejen.

Apa Itu Qwen 3.8 Max?

Qwen 3.8 Max, secara rasmi dipratonton sebagai Qwen3.8-Max-Preview, ialah model bahasa besar (LLM) utama terkini daripada pasukan Qwen Alibaba. Diumumkan di World AI Conference di Shanghai sekitar 19 Julai 2026, ia mewakili lonjakan besar dalam skala daripada siri Qwen 3.7.

Spesifikasi Teras

  • Parameter: 2.4 trilion keseluruhan โ€” menjadikannya antara model terbesar yang dibincangkan secara terbuka, kedua selepas Kimi K3 Moonshot AI pada ~2.8T.
  • Seni bina: Sparse Mixture-of-Experts (MoE). Hanya subset parameter diaktifkan per token, mengimbangi kuasa dengan kecekapan (kiraan parameter aktif belum didedahkan โ€” butiran utama untuk kos inferens).
  • Keupayaan Multimodal: Memproses teks, imej, video, dan dokumen secara asli. Ini ialah model Qwen pertama melebihi 1 trilion parameter dengan sokongan multimodal yang kukuh.
  • Tetingkap Konteks: Sehingga 1 juta token, diwarisi dan diperhalusi daripada Qwen 3.7 Max.
  • Varian: Max 2.4T sebagai flagship serta varian lebih kecil ~27B untuk kegunaan lebih ringan.

Cara Qwen 3.8 Max Berfungsi: Inovasi dan Keunggulan Teknikal

Qwen3.8-Max memanfaatkan kepakaran penskalaan Alibaba selama bertahun-tahun:

  1. Skala Besar dengan Kecekapan: 2.4T parameter melalui MoE โ€“ hanya subset diaktifkan per token, mengimbangi kuasa dan kos inferens (serupa MoE Qwen terdahulu seperti 235B-A22B).
  2. Penaakulan Hibrid: Mewarisi mod โ€œThinking/Non-Thinkingโ€ untuk kawalan fleksibel terhadap kedalaman, kelajuan, dan kos. Sesuai untuk tugas berasaskan ejen yang memerlukan perancangan berbilang langkah.
  3. Integrasi Multimodal: Pemprosesan bersatu teks + visi + video. Membolehkan aplikasi lebih kaya seperti analisis dokumen dengan imej atau penaakulan berasaskan video.
  4. Fokus Konteks Panjang dan Ejen: Dioptimumkan untuk tugasan jangka panjang (cth., pengklonan aplikasi penuh, aliran kerja kompleks). Menyokong penggunaan alat lanjutan, RAG, dan panggilan fungsi.
  5. Kemajuan Latihan: Dibina atas data berbilang bahasa yang luas (119+ bahasa), pembenam kedudukan yang dipertingkat, dan teknik yang mengurangkan halusinasi sambil meningkatkan STEM/pengekodan.

Cara Ia Berfungsi dalam Amalan:

  • Input โ†’ Penjejak token + pembenam โ†’ Router MoE memilih pakar โ†’ Lapisan Transformer memproses โ†’ Penjanaan output.
  • Menyokong pengekodan berasaskan ejen (cth., projek full-stack), saluran paip analisis data, dan automasi pejabat.

Ujian komuniti Reddit menunjukkan kuasa mentah yang menjanjikan dalam pengekodan dan pertanyaan kompleks, walaupun sesetengahnya menyatakan gelung pemikiran sekali-sekala dalam pratonton awal.

Untuk pembangun: Padankan dengan alat seperti CometAPI untuk akses bersatu yang boleh dipercayai merentas penyedia, mengurangkan kependaman dan kos sambil menguji Qwen bersama Claude, GPT, dsb.

Harga dan Akses: Apa yang Sebenarnya Boleh Anda Guna Hari Ini

Ketersediaan Pratonton (setakat Julai 2026):

  • Alibaba Token Plan: Langganan berasaskan kredit.
    • Lite: $6 untuk 2,500 kredit/minggu.
    • Pro: $68 untuk 40,000 kredit/minggu (menyokong 6โ€“8 ejen serentak).
  • Diskaun: 10% daripada harga standard semasa pratonton.
  • Platform: Qwen Chat, Alibaba Cloud, Qoder (pengekodan), QoderWork (produktiviti).
  • API: Serasi OpenAI/Anthropic. Tiada kadar per token berdiri sendiri diterbitkan lagi untuk 3.8-Max (pendahulu: ~$1.25/M input, $3.75/M output).

Open-Weights: Dijanjikan โ€œsegeraโ€ โ€” besar untuk hos sendiri/penalaan halus, walaupun keperluan perkakasan sangat tinggi (~1.2TB pada 4-bit).

Cadangan CometAPI: Untuk produksi, elakkan pengurusan vendor langsung. CometAPI menyediakan satu kunci API untuk 500+ model, termasuk siri Qwen. Pengebilan, titik akhir, dan kebolehpercayaan bersatu โ€” sesuai untuk A/B testing Qwen 3.8 Max berbanding yang lain tanpa menulis semula kod. Sempurna untuk pengguna Cometapi.com yang membina aplikasi AI. Daftar di cometapi.com untuk integrasi lancar.

Ini menjadikan Qwen boleh diakses tanpa komitmen Alibaba Cloud, bagus untuk startup dan pembangun global.

Adakah Qwen3.8 Max Mengatasi Kimi K3?

Dari segi kiraan parameter: tidak

Jika soalnya โ€œadakah Qwen3.8 Max mempunyai lebih banyak parameter berbanding Kimi K3?โ€, jawapannya jelas: tidak. Qwen3.8-Max-Preview dilaporkan oleh Qoder sebagai model 2.4T parameter. Kimi K3 didokumenkan oleh Moonshot sebagai model 2.8T parameter. Pada jumlah parameter semata-mata, Kimi K3 lebih besar sebanyak 400 bilion parameter.

Itu tidak secara automatik menjadikan Kimi K3 lebih baik untuk setiap tugas. Kiraan parameter bukan penentu tunggal. Data latihan, seni bina, penghalaan pakar, parameter aktif per token, pasca latihan, timbunan inferens, rangka alat, dan pengurusan konteks semuanya mempengaruhi prestasi sebenar. Model lebih kecil boleh menewaskan model lebih besar pada sesetengah tugas jika ia mempunyai data lebih baik, pasca latihan lebih baik, alat lebih baik, atau penaakulan masa inferens lebih baik.

Berdasarkan bukti umum: Kimi K3 mendahului buat masa ini

Kimi K3 kini mempunyai pakej bukti umum yang lebih baik. Panduan dan blog teknikal Kimi K3 Moonshot mendedahkan seni bina, konteks, visi, pengaktifan pakar, had API, dan rancangan keluaran. Halaman Kimi K3 OpenLM mencerminkan jadual penanda aras terperinci merentas pengekodan, kerja berasaskan ejen, penaakulan, kerja pengetahuan, dan visi. Keputusan Frontend Code Arena Kimi K3 pada 1,679 mata dan merumuskan konteks 1M model, pengaktifan pakar 16/896, serta isyarat harga.

Qwen3.8-Max-Preview sangat penting, tetapi pratontonnya kurang didokumenkan. Sumber terkuat semasa ialah halaman pelancaran Qoder dan konfigurasi OpenCode Model Studio Alibaba Cloud. Itu berharga, tetapi belum lagi memberikan tahap butiran penanda aras, pendedahan parameter aktif, penjelasan seni bina, terma lesen, atau butiran laluan produksi CometAPI yang sama seperti Kimi K3.

AspekQwen3.8-Max (Pratonton)Qwen3.7-MaxKimi K3 (Moonshot)
Parameter2.4T~1T+ (lebih awal)2.8T
MultimodalYa (imej/video/dokumen)Terhad/berfokus teksYa (visi asli/3D)
Tetingkap KonteksBesar (multimodal)262K+1M token
KekuatanBerasaskan ejen, pengekodan, produktiviti, multimodalEjen jangka panjang, penaakulanOpen weights, arena pengekodan, penaakulan
Penanda aras (Contoh)Kuat dalam KingBench (~ke-2), dalaman teratasGPQA 92.4, SWE-Pro 60.6Mendahului banyak (Frontend Arena), kompetitif keseluruhan
Harga (anggaran API)Pratonton ~10% standardBerdaya saing (~$1-5/M campuran)$3 in / $15 out per 1M
AksesPratonton Alibaba + CometAPIAlibaba + CometAPIAPI kini, open weights tidak lama lagi
Terbaik UntukAliran kerja multimodal perusahaanRangka ejen, pembangunanHos sendiri, penyesuaian

Perbezaan Utama:

  • Keterbukaan: Kimi K3 menang dengan open weights penuh yang bakal tiba untuk hos sendiri/penalaan halus. Qwen3.8-Max pratonton sekarang, akan dibuka tidak lama lagi.
  • Multimodal: Kedua-duanya kuat; Qwen3.8 menekankan integrasi video/dokumen.
  • Prestasi: Kimi K3 kerap mendahului penanda aras mentah (cth., GPQA, arena pengekodan); Qwen kompetitif atau unggul dalam rangka ejen/produktiviti dan tugas khusus seperti spreadsheet/kernel opt. Qwen lebih murah dalam penggunaan API (cth., 3x dalam beberapa perbandingan).
  • Konteks & Kelajuan: Kimi 1M konteks; Qwen kuat dalam konteks panjang (262K+ sebelum ini). Qwen kerap menghasilkan output lebih pantas.
  • Kes Penggunaan: Qwen untuk ekosistem Alibaba bersepadu, automasi pejabat, multimodal perusahaan. Kimi untuk penggemar sumber terbuka dan penyesuaian maksimum.

Kesimpulan: Patutkah Anda Mengguna Pakai Qwen 3.8 Max?

Ya untuk percubaan dan keperluan pengekodan/multimodal โ€” terutamanya melalui platform boleh diakses seperti CometAPI. Ia belum lagi pengganti penuh bagi model tertutup barisan hadapan tetapi merupakan pilihan berkuasa dan mampu milik yang memacu ekosistem ke hadapan. Nantikan penanda aras dan keluaran penuh.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi