DeepSeek V4 Pro 0813 is now live on CometAPI →

Apa itu deepseek v4 pro?

CometAPI
AnnaAug 13, 2026
Apa itu deepseek v4 pro?

Ringkasnya: DeepSeek V4 Pro adalah model V4 berkemampuan tertinggi dari DeepSeek untuk penalaran, pengodean, analisis konteks panjang, dan alur kerja agen. Ini adalah model mixture-of-experts dengan 1,6 triliun total parameter, 49 miliar parameter aktif, jendela konteks 1 juta token, dan output maksimum 384.000 token, menurut pengumuman rilis V4 DeepSeek dan tabel harga model resmi.

Hasil model dasar dari DeepSeek menempatkan V4 Pro pada 90,1 di MMLU, 73,5 di MMLU-Pro, 76,8 di HumanEval, dan 51,5 di LongBench-V2. Pengujian independen lebih bernuansa: evaluasi U.S. Center for AI Standards and Innovation menemukan hasil matematika dan sains yang kuat, termasuk 97% pada OTIS-AIME-2025 dan 90% pada GPQA-Diamond, tetapi performa lebih lemah pada uji siber yang ditahan, penalaran abstrak, dan rekayasa perangkat lunak.

Kesimpulan praktis: gunakan DeepSeek V4 Pro ketika tugas pengodean, penalaran, atau dokumen panjang yang sulit membenarkan biaya yang kira-kira tiga kali tarif token tanpa cache V4 Flash. Mulailah dengan V4 Flash untuk aplikasi volume tinggi, lalu rute hanya tugas sulit atau yang gagal ke V4 Pro. Bagi pengembang yang mencari akses multi-model sederhana dan hemat biaya, platform seperti CometAPI menyediakan endpoint terpadu yang kompatibel dengan OpenAI untuk DeepSeek V4 Pro bersama ratusan model lain.

Poin-Poin Utama

  • Arsitektur & Skala: 1,6T total / 49B parameter aktif MoE dengan hibrida Compressed Sparse Attention (CSA) + Heavily Compressed Attention (HCA), memangkas FLOPs inferensi per token tunggal menjadi ~27% dan KV cache menjadi ~10% dari level DeepSeek-V3.2 sebelumnya pada konteks 1M.
  • Konteks & Efisiensi: Konteks native 1 juta token dan hingga 384K token output maksimum, membuat agen berjangka panjang dan analisis seluruh basis kode menjadi praktis.
  • Benchmark (V4-Pro-Max): 80,6% SWE-bench Verified, 93,5% LiveCodeBench, peringkat Codeforces 3206, 90,1% GPQA Diamond, skor agen yang kuat (mis., MCPAtlas Public ~73,6). Harga resmi DeepSeek adalah $0,435/M token input tanpa cache, $0,003625/M token input cache hit, dan $0,87/M token output.
  • Model hanya teks. Ekstensi Copilot dapat mem-proxy gambar melalui model lain, tetapi itu tidak membuat V4 Pro secara native multimodal.
  • DeepSeek mendukung OpenAI Chat Completions, implementasi Responses API, antarmuka yang kompatibel dengan Anthropic, output JSON, pemanggilan alat, dan kontrol thinking.
  • CAISI mengukur V4 Pro pada 74% di SWE-bench Verified, 90% di GPQA Diamond, dan 97% di OTIS-AIME-2025, tetapi hanya 44% di PortBench dan 46% di ARC-AGI-2 semi-private.

Spesifikasi model yang dikonfirmasi

SpesifikasiDeepSeek V4 Pro
ID model APIdeepseek-v4-pro
Versi terdokumentasi saat iniDeepSeek-V4-Pro-0813
Ukuran arsitektur1,6T total parameter; 49B aktif
Jendela konteks1M token
Output maksimum384K token
Modality inputTeks
PenalaranMode berpikir dan tanpa penalaran
Upaya penalarantinggi dan didokumentasikan untuk antarmuka resmi max
Output terstrukturOutput JSON didukung
Fitur agenPemanggilan alat dan Responses API didukung
Kompatibilitas APIOpenAI Chat Completions dan API yang kompatibel dengan Anthropic
Bobot terbukaYa
Konkruensi default akun500 permintaan V4 Pro secara bersamaan

Apa itu DeepSeek V4 Pro?

DeepSeek V4 Pro (ID model biasanya deepseek-v4-pro) adalah tingkat kemampuan tinggi dari seri DeepSeek-V4, dikembangkan oleh lab AI China, DeepSeek. Pertama kali dirilis sebagai pratinjau pada 24 April 2026 bersama DeepSeek-V4-Flash yang lebih ringan, dan beralih ke ketersediaan umum pada pertengahan Agustus 2026 dengan string versi DeepSeek-V4-Pro-0813.

Dibangun sebagai model Mixture-of-Experts (MoE), ia hanya mengaktifkan sebagian kecil dari total parameternya (49B dari 1,6T) per token. Desain ini, dikombinasikan dengan inovasi arsitektur dalam attention, menghadirkan kecerdasan tingkat terdepan sekaligus menjaga efisiensi inferensi—terutama pada panjang konteks ekstrem. Model ini hanya teks (kemampuan multimodal masih dalam pengembangan), berlisensi MIT, dan tersedia sebagai bobot terbuka di Hugging Face.

Penempatan kunci dari DeepSeek: V4-Pro menargetkan kemampuan agen yang ditingkatkan, pengetahuan dunia yang kaya (memimpin model terbuka, tertinggal hanya dari varian Gemini tertentu), dan penalaran kelas dunia dalam matematika, STEM, dan pengodean yang menyaingi sistem sumber tertutup teratas.

Ia mendukung dua mode—berpikir (chain-of-thought / penalaran diperluas, default dalam banyak konfigurasi) dan tanpa penalaran (respons lebih cepat)—bersama tingkat upaya penalaran yang dapat dikonfigurasi (termasuk pengaturan maksimum “V4-Pro-Max”). Kompatibilitas API mencakup format OpenAI Chat Completions dan Anthropic Messages, plus pemanggilan alat, output JSON terstruktur, dan fitur beta seperti pelengkapan fill-in-the-middle (FIM) (mode tanpa penalaran) dan kelanjutan awalan percakapan.

Status rilis DeepSeek V4 Pro

Ada beberapa tanggal yang perlu dibedakan:

  1. 24 April 2026: DeepSeek mengumumkan V4 Preview, bobot terbuka, dan akses API untuk V4 Pro dan V4 Flash.
  2. 24 Juli 2026: DeepSeek menghentikan nama lama dan nama API setelah periode migrasi tiga bulan.deepseek-chatdeepseek-reasoner
  3. 13 Agustus 2026: Alias saat ini menunjuk ke versi model V4-Pro-0813, menurut tabel model live DeepSeek.deepseek-v4-pro

Bagaimana DeepSeek V4 Pro Bekerja?

Pada inti, V4 Pro adalah model Mixture-of-Experts (MoE) dengan 1,6 triliun total parameter dan 49 miliar parameter yang diaktifkan per forward pass. Desain ini menghadirkan kapasitas tinggi sekaligus menjaga biaya inferensi tetap terkelola. Baik V4 Pro maupun V4 Flash mendukung jendela konteks 1 juta token dan hingga 384.000 token output maksimum. Model ini hanya teks saat peluncuran (kemampuan multimodal disebutkan masih dalam pengembangan pada materi awal) dan dikirim di bawah lisensi MIT, dengan bobot terbuka tersedia di Hugging Face.

Inovasi arsitektur utama meliputi:

  • Mekanisme Attention Hibrida: Menggabungkan Compressed Sparse Attention (CSA) dan Heavily Compressed Attention (HCA). Pada pengaturan 1M token, DeepSeek-V4-Pro hanya membutuhkan sekitar 27% FLOPs inferensi per token tunggal dan 10% memori KV cache dibandingkan DeepSeek-V3.2. Ini membuat konteks sejuta token menjadi jauh lebih praktis.
  • Manifold-Constrained Hyper-Connections (mHC): Meningkatkan koneksi residual untuk stabilitas pelatihan dan propagasi sinyal yang lebih baik.
  • Optimizer Muon: Digunakan selama pra-pelatihan untuk konvergensi lebih cepat dan stabilitas lebih besar.
  • Pra-pelatihan pada lebih dari 32 triliun token berkualitas tinggi, diikuti pipeline pascapelatihan yang canggih (SFT spesifik domain + RL, lalu distilasi on-policy).

Perubahan ini memungkinkan penggunaan rutin konteks 1M token untuk tugas agen berjangka panjang, analisis seluruh basis kode, atau koleksi dokumen besar tanpa penalti memori dan komputasi sebelumnya.

Harga API DeepSeek V4 Pro

DeepSeek menagih secara terpisah untuk input cache miss, input cache hit, dan output yang dihasilkan. Harga dikutip per satu juta token.

ModelInput cache missInput cache hitOutputKonteks
DeepSeek V4 Pro$0,435$0,003625$0,871M token
DeepSeek V4 Flash$0,14$0,0028$0,281M token

Ini adalah tarif yang ditampilkan pada halaman harga API resmi DeepSeek pada saat publikasi. DeepSeek memperingatkan di sana bahwa mereka berencana meningkatkan harga API secara keseluruhan di masa depan, tetapi belum mengungkapkan tarif baru yang pasti atau tanggal efektif. Oleh karena itu, anggaran produksi sebaiknya membaca harga secara dinamis alih-alih meng-hard-code-nya ke dalam perkiraan jangka panjang.

Contoh biaya DeepSeek V4 Pro yang realistis

Rumus dasar adalah:

cost = uncached input × $0.435/M + cached input × $0.003625/M + output × $0.87/M

Beban kerjaAsumsi tokenPerkiraan biaya V4 Pro
Permintaan pengodean singkat10.000 input + 2.000 output$0,00609
Analisis tingkat repositori100.000 input + 20.000 output$0,0609
Analisis dokumen sangat panjang1M input + 100.000 output$0,522
Analisis dokumen panjang yang di-cache1M input cache hit + 100.000 output$0,090625
100.000 panggilan produksi20.000 input + 4.000 output per panggilan$1.218

Sebagai perbandingan, skenario 100.000 panggilan akhir akan berbiaya sekitar $392 pada V4 Flash, dengan asumsi semua input adalah cache miss. Itu adalah selisih $826, menjadikan strategi perutean penting secara ekonomis bahkan ketika kedua model tampak murah per panggilan.

Contoh ini adalah perkiraan biaya token, bukan anggaran infrastruktur lengkap. Mereka mengecualikan retry, giliran agen yang gagal, hasil alat berulang, moderasi, penyimpanan vektor, API pencarian, observabilitas, dan biaya apa pun yang dibebankan oleh platform terpisah.

Mengapa harga cache hit penting

Tarif input cache hit V4 Pro sekitar 120 kali lebih rendah daripada tarif input cache miss. Penghematan terbesar terjadi ketika permintaan berulang kali menggunakan awalan yang sama—misalnya:

  • Prompt sistem yang stabil dan manual kebijakan
  • Snapshot repositori bersama
  • Skema alat standar
  • Katalog produk yang panjang
  • Analisis berulang atas kontrak atau laporan yang sama

Caching tidak membuat output yang dihasilkan lebih murah. Jejak penalaran yang panjang atau penyelesaian yang verbose tetap ditagih pada tarif output. Pengembang harus memantau status cache input dan panjang output secara terpisah daripada hanya mengandalkan biaya permintaan rata-rata.

Cara Mengakses DeepSeek V4 Pro (Termasuk melalui CometAPI)

Metode akses:

  1. API resmi DeepSeek (https://api.deepseek.com) — gunakan model deepseek-v4-pro.
  2. Bobot terbuka di Hugging Face untuk penerapan lokal atau privat.
  3. Agregator dan platform serverless (OpenRouter, Together, DeepInfra, dll.).

Rekomendasi untuk pengguna CometAPI: CometAPI menawarkan akses mudah ke DeepSeek V4 Pro (dan V4 Flash) melalui satu endpoint yang kompatibel dengan OpenAI (https://api.cometapi.com/v1). Anda mendapatkan penagihan terpadu di 500+ model, tarif kompetitif (sering kali dengan penghematan di tingkat platform), dasbor penggunaan real-time, dan tanpa perubahan kode selain base URL dan key saat migrasi dari SDK OpenAI. Ini sangat berguna bagi pengembang indie dan tim yang ingin melakukan A/B test V4 Pro terhadap Claude, GPT, Gemini, atau model lain tanpa mengelola banyak akun.

Siapa yang harus menggunakan DeepSeek V4 Pro?

V4 Pro layak untuk uji coba serius bagi:

  • sintesis dokumen besar dengan sitasi yang dapat dilacak;
  • pengodean skala repositori dan peninjauan kode;
  • agen yang berjalan lama dengan konteks berulang;
  • bantuan matematika dan STEM dengan verifikasi;
  • pembuatan laporan atau dokumen terstruktur;
  • penalaran volume tinggi di mana biaya token langsung menjadi kendala utama;
  • tim yang tertarik pada jalur penerapan bobot terbuka di masa depan.

V4 Flash mungkin menjadi pilihan pertama yang lebih baik untuk tugas agen sederhana, klasifikasi, ekstraksi, perutean, atau pekerjaan yang sensitif terhadap latensi. DeepSeek sendiri mengatakan Flash mendekati Pro pada penalaran dan menyamainya pada evaluasi agen yang lebih sederhana sambil menggunakan model aktif yang lebih kecil.

V4 Pro menjadi pilihan default yang lebih lemah ketika pemahaman gambar native wajib, ketika kebijakan pengadaan melarang dependensi status pratinjau, atau ketika organisasi tidak dapat membangun kontrol evaluasi dan verifikasi. Panduan integrasi GitHub Copilot secara eksplisit menggambarkan V4 sebagai hanya teks; penanganan gambar dalam ekstensi itu dilakukan oleh model proksi terpisah.

DeepSeek V4 Pro vs V4 Flash

Faktor keputusanV4 ProV4 Flash
Peran utamaPenalaran berat, pengodean, agenPekerjaan ber-volume tinggi dan sensitif terhadap latensi
Parameter total/aktif1,6T / 49B284B / 13B
Konteks1M1M
Output maksimum384K384K
Harga input tanpa cache$0,435/M$0,14/M
Harga output$0,87/M$0,28/M
Konkruensi5002.500
Penggunaan yang direkomendasikanTingkat eskalasiTingkat perutean default

Arsitektur yang masuk akal dimulai dengan Flash untuk ekstraksi, rangkuman, klasifikasi, chat dasar, dan pengodean yang lugas. Eskalasikan ke Pro ketika Flash gagal validator, melaporkan kepercayaan rendah, mengalami perubahan repositori yang kompleks, atau membutuhkan perencanaan lebih dalam.

Pendekatan ini mencerminkan prinsip ekonomi yang lebih luas: pemilihan model harus mengikuti nilai yang diantarkan, bukan sekadar kecerdasan teoritis maksimum.

Kesimpulan dan Rekomendasi

DeepSeek V4 Pro mewakili langkah berarti untuk AI berbobot terbuka: kemampuan yang mendekati frontier dalam pengodean dan penalaran, konteks sejuta token yang praktis berkat inovasi arsitektur, dan ekonomi yang membuat kecerdasan kelas atas dapat diakses. Kombinasi bobot terbuka (MIT), benchmark agen yang kuat, dan harga resmi yang agresif memantapkan posisi DeepSeek sebagai kekuatan besar dalam lanskap AI 2026.

Bagi kebanyakan pengembang dan tim, memulai dengan API resmi atau agregator tepercaya adalah jalur tercepat. CometAPI menonjol sebagai rekomendasi praktis untuk akses yang disederhanakan—menyediakan DeepSeek V4 Pro (dan Flash) dalam platform multi-model yang lebih luas yang mengurangi friksi operasional. Baik Anda membangun agen pengodean, menganalisis dokumen panjang, atau mengoptimalkan biaya inferensi, V4 Pro layak mendapatkan evaluasi serius.

Sumber & Bacaan Lanjutan

Ikhtisar ini didasarkan pada informasi yang tersedia untuk publik per Agustus 2026. Selalu verifikasi sumber resmi terbaru sebelum penerapan produksi.

10 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya