Kimi K3 is now live on CometAPI โ†’

Apakah itu Kimi K3: Penanda Aras, Keupayaan & Panduan Akses pada tahun 2026

CometAPI
AnnaJul 20, 2026
Apakah itu Kimi K3: Penanda Aras, Keupayaan & Panduan Akses pada tahun 2026

TLDR: Moonshot AI melancarkan Kimi K3 pada 16 Julai 2026 โ€“ model open-weights 2.8 trilion parameter yang terobosan (yang pertama dalam kelas 3T) dengan multimodaliti asli, konteks 1 juta token, dan prestasi frontier yang menandingi atau mengatasi model proprietari teratas seperti Claude Fable 5 dan GPT-5.6 Sol dalam pengaturcaraan, tugasan agenik, pembangunan frontend, dan kerja pengetahuan.

Intipati Utama

  • Skala & Inovasi: 2.8T parameter, MoE dengan 16/896 pakar aktif, Kimi Delta Attention (KDA), Attention Residuals โ€“ ~2.5x kecekapan penskalaan berbanding K2, Kimi K3 - Kimi API Platform
  • Prestasi: Artificial Analysis Intelligence Index ~57 (4 teratas, mendahului Claude Opus 4.8), mendahului Frontend Code Arena, kukuh pada Terminal-Bench (88.3%), BrowseComp (91.2%), GPQA-Diamond (93.5%). Ketinggalan sedikit di belakang Fable 5/Sol secara keseluruhan tetapi mengatasi kebanyakan yang lain; #1 pada Arena.ai Frontend Code Arena (1,679 Elo, mengatasi Fable 5), Arena post on X dan Tom's Hardware coverage.
  • Keupayaan: Visi/video asli, konteks 1M untuk repo/pangkalan kod besar, pengaturcaraan agenik, penaakulan 3D, penyuntingan video, papan pemuka penyelidikan.
  • Akses: Serta-merta melalui kimi.com, API (model kimi-k3, access guide); open weights tidak lama lagi. Moonshot buat sementara waktu menghentikan langganan Kimi K3 baharu selepas lonjakan permintaan. Integrasi mudah melalui CometAPI.
  • Nilai: Kos per tugasan lebih rendah (~$0.94 dalam sesetengah penilaian), kurang penolakan, sesuai untuk aliran kerja pengaturcaraan/Visi.

Kimi K3 Tech Blog menerangkan Kimi K3 sebagai "Open Frontier Intelligence, Kimi K3 menandakan detik penting dalam pendemokrasian AI. Ketika makmal AI China seperti Moonshot terus meneroka batasan walaupun kekangan pengkomputeran, model terbuka ini mencabar dominasi frontier tertutup AS dan memperkasakan pembangun di seluruh dunia.

Apakah Kimi K3? Model Terbuka Kelas 3T daripada Moonshot AI

Moonshot AI, sebuah startup berpangkalan di Beijing, melancarkan Kimi K3 pada 16 Julai 2026 sebagai model utamanya. Ia secara jelas diposisikan sebagai model terbuka pertama dalam kelas kira-kira 3 trilion parameter, dengan 2.8 trilion jumlah parameter dalam seni bina Mixture-of-Experts (MoE) jarang. Hanya 16 daripada 896 pakar diaktifkan setiap token, mengimbangi skala besar dengan kecekapan.

Ini dibina atas siri Kimi K2 (K2.5, K2.6, dsb.) yang telah mendapat perhatian untuk pengaturcaraan dan multimodaliti. K3 memperkenalkan inovasi seni bina: Kimi Delta Attention (KDA) dan Attention Residuals (AttnRes), bersama Stable LatentMoE dan latihan sedar kuantisasi (berat MXFP4, pengaktifan MXFP8 dari peringkat SFT). Ini menghasilkan ~2.5x kecekapan penskalaan lebih baik dan sehingga 6.3x nyahkod lebih pantas berbanding pendahulunya.

Key Specs ( Kimi K3 Technical Specifications):

  • Parameters: 2.8T jumlah (sparse MoE).
  • Context Window: 1,048,576 token (~1M).
  • Modalities: Pemahaman teks + imej + video asli; output teks.
  • Max Output: Lalai 131k token, sehingga had konteks.
  • Reasoning: Usaha maksimum secara lalai semasa pelancaran; mod lebih rendah/lebih tinggi akan datang.
  • Open Weights: Dijanjikan menjelang 27 Julai 2026 (gaya MIT diubah suai, mengikut preseden K2).

K3 menyasarkan tugas jangka panjang โ€” bukan sekadar jawapan pantas, tetapi menyiapkan kejuruteraan kompleks, penyelidikan, atau aliran kerja agen dengan maklum balas visual ("Vision in the Loop"). Demo termasuk membina penyusun GPU autonomi (menyaingi Triton), reka bentuk cip pada proses 45nm, dan penyelidikan astrofizik pantas.

Permintaan sudah menekan kapasiti

Penerimaan awal model ini cukup kuat hingga mencipta tekanan kapasiti. Moonshot memuat naik di X bahawa permintaan sepanjang 48 jam sebelumnya hampir mencapai had GPU semasa dan langganan baharu akan dihentikan sementara waktu sementara syarikat menambah kapasiti. Business Insider melaporkan jeda kapasiti yang sama dan menyatakan bahawa pelanggan sedia ada tidak terjejas.

Ini penting untuk perancangan pengeluaran. Sebuah model boleh cemerlang namun tetap menghadapi kekangan ketersediaan jika permintaan melebihi pengkomputeran. Pasukan yang menilai Kimi K3 harus mengelakkan kebergantungan pada satu penyedia, memantau latensi dan kadar ralat, serta menggunakan penghalaan sandaran melalui penyedia bersepadu seperti CometAPI bila boleh.

Penanda Aras Pengaturcaraan: Di mana Kimi K3 Paling Menonjol

Profil pengaturcaraan Kimi K3 ialah sebab utama pembangun memberi perhatian. Ia hampir setara dengan GPT-5.6 Sol pada Terminal-Bench 2.1, mengatasi GPT-5.6 Sol dan Claude Fable 5 pada Program Bench, dan mendahului GPT-5.6 Sol dengan margin bermakna pada FrontierSWE. Ia juga mengatasi model dibandingkan pada SWE Marathon dalam jadual OpenLM.

Keputusan Arena frontend menambah isyarat praktikal lain. Arena melaporkan Kimi K3 pada 1679 mata pada Frontend Code Arena, mengatasi Claude Fable 5. Penanda aras itu penting kerana kerja frontend sering dinilai oleh keutamaan manusia, bukan hanya ujian unit. Pembantu pengaturcaraan yang boleh menghasilkan UI yang bersih dan koheren secara visual daripada prompt adalah bernilai untuk pasukan produk, agensi, pembina SaaS, dan alat dalaman.

Papan Kedudukan Keseluruhan

  • Artificial Analysis AI Leaderboard: Debut pada #3. Skor Intelligence Index meletakkannya kompetitif (cth., ~57.1 dalam sesetengah penilaian).
  • Private Long-Horizon Knowledge Work Eval: Elo 1547 (+732 daripada K2.6), di belakang hanya Fable 5.

Penanda Aras Pengaturcaraan & Agenik (Dilapor Sendiri & Bebas)

K3 menonjol di sini, memanfaatkan skalanya dan seni bina untuk prestasi agenik berterusan.

  • Frontend Code Arena (Arena.ai): #1 dengan 1,679 mata, mengatasi Fable 5 dan GPT-5.6 Sol. Cemerlang dalam keutamaan pembangun buta untuk pembangunan web.
  • DeepSWE: 67.3โ€“67.5 (kukuh, dengan rangka kerja KimiCode).
  • Program Bench: #1 pada 77.8.
  • SWE Marathon: #1 pada 42.0 (sesetengah rangka kerja).
  • Terminal-Bench 2.1: Kompetitif, hampir dengan GPT-5.6 Sol.

Visi & Multimodal

Latihan asli (bukan ditampal) menghasilkan keputusan kukuh:

  • MMMU-Pro: 81.6%
  • MathVision: Kompetitif/90-an tinggi dalam beberapa laporan.
  • OmniDocBench: 91.1% (mendahului).

Menyokong tangkapan skrin, diagram, video untuk tugasan gelung tertutup seperti penapisan UI atau pembangunan permainan.

Comparison Table: Kimi K3 vs. Leading Models (Anggaran/Dikompilasi daripada Laporan; Usaha Maksimum Jika Tidak Dinyatakan)

BenchmarkKimi K3Claude Fable 5GPT-5.6 SolNotes/Source
Frontend Code Arena1,679 (#1)Lebih rendahLebih rendahArena.ai
DeepSWE67.3โ€“67.5Kompetitif-Moonshot/KimiCode
Program Bench77.8 (#1)-HampirVals.ai
Intelligence Index (AA)~57.1~59.9~58.9Artificial Analysis
Long-Horizon Elo1547Lebih tinggi-Internal Moonshot
Cost per Task (Evals)~$0.94Lebih tinggiLebih tinggiIndependent

Data sourced from Moonshot's technical blog, independent leaderboards, and analyses. Results can vary by harness/effort; always verify latest.

K3 menunjukkan kurang penolakan pada topik sensitif dan konsistensi kukuh dalam aliran agenik. Ujian bebas (cth., penilaian YouTube, Vals AI) mengesahkannya sebagai salah satu model terbuka terkuat untuk pengaturcaraan dunia nyata.

Apa Yang Boleh Dilakukan Kimi K3? Keupayaan dalam Pengaturcaraan, Visi, dan Lain-lain

Pengaturcaraan & Kejuruteraan Agenik

K3 mengekalkan sesi panjang dengan pengawasan minimum: menavigasi repo besar, menggunakan alat, menyahpepijat melalui tangkapan skrin ("vision in the loop").

Contoh:

  • Pengoptimuman Kernel & Pembangunan Penyusun: Membina MiniTriton (penyusun seperti Triton) dari awal, menyaingi timbunan dioptimumkan. Mengoptimumkan kernel GPU secara kompetitif dengan Fable 5.
  • Pembangunan Permainan: Mengubah konsep/imej/video menjadi pengalaman 3D/multiplayer yang boleh dimainkan dengan penambahbaikan berulang.
  • Reka Bentuk Cip: Larian autonomi 48 jam mereka bentuk cip model nano.
  • Frontend: Mendahului papan kedudukan untuk aplikasi web, tugas full-stack.

Visi & Multimodal

Pemahaman imej/video asli membolehkan:

  • Penyuntingan video: Menyunting teaser sendiri daripada 56 klip (pemilihan, potongan, penyelarasan, semakan) โ€“ kerja berjam-jam dalam beberapa minit.
  • Penaakulan 3D, grafik gerakan, papan pemuka interaktif.
  • "Vision in the loop" untuk iterasi kod melalui tangkapan skrin.

Dokumen API Kimi menunjukkan input imej melalui URL data base64 dan input video melalui fail muat naik yang dirujuk oleh ms://. Mereka juga memberi amaran bahawa URL imej awam tidak disokong dalam input visi, jadi pembangun harus menghantar rujukan fail base64 atau muat naik dan menjadikan kandungan mesej sebagai tatasusunan objek. Ini ialah perincian pelaksanaan penting: jangan mensiriakan mesej imej dan teks bercampur menjadi satu rentetan biasa.

Kerja Pengetahuan & Penyelidikan

Bagi perniagaan, inilah kawasan di mana Kimi K3 mungkin lebih berharga daripada chatbot biasa. Model ini direka untuk kerja "agenik" di mana ia boleh mengekalkan pelan, memanggil alat, memproses hasil perantaraan, dan menghasilkan artifak akhir. Contoh termasuk laporan penyelidikan pasaran, pembantu pembersihan data, ringkasan pematuhan, penyelenggaraan pangkalan pengetahuan sokongan pelanggan, dan copilot kejuruteraan dalaman.

  • Menjana laporan setaraf perundingan, visualisasi interaktif, papan pemuka (cth., analisis industri ASIC 42 tahun daripada ribuan sumber).
  • Laluan saintifik: Menghasilkan semula hubungan astrofizik, menganalisis gelombang graviti dengan sub-agen.
  • Widget/Papan Pemuka dalam Kimi Work untuk pandangan berterusan berasaskan data.

K3 merapatkan jurang antara literatur dan kod boleh laksana, menghasilkan output berkualiti penerbitan dengan cekap.

Kimi K3 vs Model Frontier Lain: Perbandingan Praktikal

ModelKegunaan terbaikKekuatanPerkara perlu diperhatikanSaranan CometAPI
Kimi K3Pengaturcaraan konteks panjang, kerja pengetahuan, agen, penaakulan visualSkala MoE 2.8T, konteks 1M, penanda aras pengaturcaraan dan agenik kukuh, pelan open-weightTekanan kapasiti minggu pelancaran, sensitiviti terhadap sejarah pemikiran, sokongan visi mungkin berbeza mengikut laluanUji sebagai model utama untuk pengaturcaraan dan konteks panjang
GPT-5.6 SolPenaakulan sukar, pengaturcaraan, penyelidikan, tugas produksi luasProfil penanda aras keseluruhan sangat kukuh dan alat matangHarga lebih tinggi dalam banyak laluanGuna sebagai model perbandingan dan eskalasi
Claude Fable 5Penulisan, pengaturcaraan, aliran kerja agenik, tugas berasaskan keutamaan manusiaUX kuat dan prestasi frontier menyeluruhKos lebih tinggi dan kemungkinan fallback dasar dalam sesetengah tugasBandingkan untuk agen berorientasikan pengguna dan aplikasi penulisan
Claude Opus 4.8Penaakulan mendalam dan kerja profesional yang boleh dipercayaiTingkah laku pembantu hujung atas yang stabilLebih lama berbanding keluaran perdana terbaharuKekalkan sebagai sandaran atau garis dasar penanda aras
GLM-5.2Penilaian model terbuka sensitif kosAlternatif model terbuka yang kompetitifLebih lemah dalam beberapa perbandingan K3 yang disenaraikanSertakan dalam ujian penghalaan kos/prestasi

Cara Mengakses Kimi K3: Panduan Langkah demi Langkah

  1. Web/Apl: Lawati kimi.com atau muat turun aplikasi Kimi (iOS/Android). Pilih K3 (K3 Max atau Swarm Max).
  2. Kimi Code: Fokus Terminal/IDE untuk pembangun. Hebat untuk agen pengaturcaraan.
  3. Akses API:
    • Base URL: https://api.moonshot.ai/v1
    • Model: kimi-k3
    • Dapatkan kunci API di platform.moonshot.ai/console.
    • OpenAI-compatible SDK example (Python):

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.moonshot.ai/v1")
response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Your prompt"}]
)

Menyokong alat, mod JSON, cache konteks. Harga: $3 input, $15 output per M token (cache $0.30).

  1. Aggregator: Guna CometAPI (cometapi.com) untuk akses bersatu ke Kimi K3 + 500+ model dengan satu kunci, kos lebih rendah (penjimatan 20โ€“40%), dan penukaran mudah. Sesuai untuk produksi โ€” serasi OpenAI secara drop-in, latensi rendah.
  2. Self-Hosting: Selepas keluaran berat pada 27 Julai di Hugging Face. Jangka keperluan perkakasan berat (supernodes, 64+ accelerators disyorkan). Alat komuniti seperti vLLM akan menyusul.

CometAPI Recommendation: Integrasikan Kimi K3 melalui CometAPI untuk mengelakkan kunci/billing berbilang. Uji bersama Claude/GPT untuk A/B, optimumkan kos, dan skala dengan boleh dipercayai. Papan pemuka mereka menjejak penggunaan merentas model โ€” sesuai untuk memantau eksperimen K3. Daftar di cometapi.com untuk kredit percuma dan akses bersatu.

Kesimpulan Akhir

Kimi K3 ialah salah satu pelancaran model terpenting tahun 2026 setakat ini. Ia menggabungkan skala besar, strategi open-weight yang serius, tetingkap konteks 1M token, pemahaman visual asli, dan keputusan penanda aras yang meletakkannya hampir di puncak sistem AI pengaturcaraan dan agenik semasa. Ia tidak menghapuskan keperluan untuk GPT, Claude, Gemini, DeepSeek, Qwen, atau model lain, tetapi memberi pembangun pilihan baharu yang diyakini untuk aliran kerja konteks panjang yang paling sukar.

Mulakan hari ini di kimi.com atau melalui CometAPI untuk integrasi tanpa usaha. Uji kekuatan pengaturcaraan dan visinya โ€“ hasilnya berbicara sendiri.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi