DeepSeek Vision and Grok Imagine models are now live on CometAPI →
new/Riset CometAPI

DeepSeek-V4.1 Segera Hadir: Spesifikasi, Benchmark, dan Fitur yang Diharapkan

DeepSeek-V4.1 menarik justru karena siklus V4 saat ini menunjukkan bahwa DeepSeek dapat membuat keluarga lebih kuat secara material.

CometAPI
AnnaTim riset model AI dan API
Diperbarui Aug 23, 2026 11 menit baca
DeepSeek-V4.1 Segera Hadir: Spesifikasi, Benchmark, dan Fitur yang Diharapkan
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Keluarga V4 dari DeepSeek kini telah melampaui tahap pratinjau awalnya. DeepSeek V4 Flash memasuki beta publik sebagai V4-Flash-0731 pada 31 Juli, sementara DeepSeek V4 Pro mencapai GA sebagai V4-Pro-0813 pada 13 Agustus di APP, Web, dan API. Kedua model mempertahankan desain konteks satu juta token dan arsitektur MoE milik keluarga V4, dengan Flash dioptimalkan untuk efisiensi dan Pro diposisikan sebagai model penalaran dan Agent berkemampuan lebih tinggi.

Rilis GA Pro secara material menaikkan baseline untuk prediksi V4.1 apa pun. DeepSeek menyatakan bahwa build GA menghadirkan kapabilitas Agent yang ditingkatkan secara signifikan, khususnya di lingkungan produksi, dan kini memberikan dukungan Responses API native untuk V4-Pro dan V4-Flash serta tingkat thinking-effort low, high, dan max. Versi model API saat ini secara eksplisit dicantumkan sebagai DeepSeek-V4-Pro-0813. Lalu di mana posisi DeepSeek V4.1 sekarang? Laporan The Information pada Mei menyebut DeepSeek merencanakan rilis V4.1 pada Juni dengan perangkat enterprise yang lebih kuat dan dukungan multimodal. Jendela waktu itu telah lewat, dan log rilis DeepSeek saat ini masih belum memuat kartu model atau entri rilis V4.1. Interpretasi paling aman adalah iterasi V4 pasca-GA yang mungkin, dengan target yang dilaporkan masih bisa hadir di bawah nama V4.1 atau melalui pembaruan V4 tambahan.

DeepSeek-V4.1 Segera Hadir: Spesifikasi, Benchmark, dan Fitur yang Diharapkan

Tonggak yang dikonfirmasi menggunakan catatan perubahan DeepSeek; rencana V4.1 pada Juni sebelumnya berasal dari The Information.

Apa itu DeepSeek-V4.1?

DeepSeek-V4.1 paling tepat dipahami sebagai iterasi V4 pasca-GA yang belum dikonfirmasi, bukan sebagai model DeepSeek yang dirilis resmi. Keluarga V4 sudah memiliki checkpoint Pro produksi di V4-Pro-0813, jadi V4.1 kini akan mewakili pembaruan kapabilitas tengah siklus alih-alih langkah yang diperlukan untuk menuntaskan peluncuran V4 asli. DeepSeek belum menerbitkan kartu model V4.1, laporan teknis, changelog API, atau tabel benchmark.

PertanyaanJawaban saat iniKeyakinan
Apakah DeepSeek secara resmi mengumumkan “V4.1”?Tidak. Log rilis DeepSeek saat ini tidak memiliki entri atau kartu model V4.1.Tinggi
Apakah rilis V4.1 pernah diberitakan?Ya. The Information melaporkan rencana Juni dengan alat enterprise dan dukungan multimodal.Sedang
Apakah jendela Juni yang dilaporkan terjadi?Tidak ada rilis V4.1 resmi terpisah yang muncul selama jendela tersebut.Tinggi
Apa tonggak V4 terbaru yang dikonfirmasi?V4-Flash-0731 memasuki beta publik pada 31 Juli dan V4-Pro-0813 mencapai GA pada 13 Agustus.Tinggi
Apakah V4.1 masih bisa diluncurkan sebagai model terpisah?Ya, tetapi nama, spesifikasi, dan waktunya masih belum dikonfirmasi.Rendah/Sedang

Spesifikasi DeepSeek-V4.1 yang Diharapkan

Karena DeepSeek belum menerbitkan spesifikasi V4.1, tabel di bawah memisahkan kapabilitas V4 saat ini yang dikonfirmasi dari ekspektasi terarah. “Diharapkan” berarti kelanjutan yang wajar dari V4 atau kapabilitas yang dilaporkan media, bukan spesifikasi V4.1 resmi.

DimensiV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 (diharapkan)
Keluarga modelV4V4Kemungkinan iterasi keluarga V4
ArsitekturMoE turunan V4, hybrid attentionMoE turunan V4; GA dibangun di atas struktur PreviewKemungkinan turunan V4; tidak dikonfirmasi
Total / parameter aktif284B / 13B1.6T / 49BTidak diketahui; tidak ada angka publik yang andal
Context window1M1MKemungkinan setidaknya baseline V4
Output maksimumMaksimum API 384KMaksimum API 384KTidak diketahui
Thinking effortLow / high / maxLow / high / maxDiharapkan mempertahankan atau memperluas kontrol saat ini
Responses APIDidukungDidukungDiharapkan jika dibangun di atas tumpukan API V4 saat ini
Input gambar/berkas nativeTidak didukung dalam Responses API saat iniTidak didukung dalam Responses API saat iniArah multimodal yang dilaporkan; belum dikonfirmasi
Perangkat/alat Enterprise / AgentFunctions, pencarian web, dukungan apply_patch / CodexFunctions, pencarian web, dukungan apply_patch / CodexArea penekanan yang dilaporkan; ekspansi MCP belum dikonfirmasi
Bobot terbukaYaYa, bobot V4-Pro-0813 tersediaMungkin untuk checkpoint V4.1 terpisah; belum dikonfirmasi
Status resmiRilis API beta publikGATidak ada tanggal rilis resmi atau kartu model

Apa yang Mungkin Baru di DeepSeek-V4.1?

Agentic Coding Lebih Kuat Tanpa Model Lebih Besar

Bukti terkuat untuk apa yang datang setelah V4 kini adalah pembaruan GA V4-Pro-0813. DeepSeek menyebut kemampuan Agent meningkat secara substansial di lingkungan produksi, dengan Terminal Bench 2.1 di 87,9, NL2Repo di 61,5 dan DeepSWE di 62,7. V4-Flash-0731 sudah menunjukkan bahwa sekadar post-training saja dapat menghasilkan peningkatan Agent besar tanpa mengubah arsitektur atau ukuran model.

Jika V4.1 adalah pembaruan tengah siklus, target realistisnya bukan lagi sekadar “lebih baik dari V4 Preview.” Ia perlu mempertahankan atau melampaui baseline Agent V4-Pro-0813 sambil meningkatkan eksekusi perangkat lunak jangka panjang, keandalan tingkat repositori, orkestrasi alat, dan konsistensi produksi.

Penggunaan Alat Lebih Baik dan API Agent yang Lebih Lengkap

Tumpukan V4 saat ini dari DeepSeek sudah memberikan dukungan Responses API untuk Flash dan Pro, serta secara khusus diadaptasi untuk Codex. Tabel kompatibilitas Responses API mendukung pemanggilan fungsi dan pencarian web sisi server, sementara file_search, code_interpreter, computer_use, dan tipe alat MCP masih diabaikan. Itu membuat cakupan alat enterprise yang lebih luas menjadi peluang V4.1 yang lebih jelas daripada sekadar menambahkan Responses API itu sendiri.

Dukungan MCP native masih merupakan arah peningkatan yang masuk akal, tetapi tetap belum dikonfirmasi. Tesis V4.1 yang dapat dipertahankan adalah integrasi enterprise dan Agent yang lebih dalam di atas permukaan API yang sudah mendukung Responses, alur kerja berorientasi Codex, output terstruktur, dan pemanggilan alat.

Input Multimodal Bisa Jadi Peningkatan Tingkat Produk Terbesar

The Information melaporkan bahwa V4.1 direncanakan dengan dukungan multimodal. Ini tetap menjadi pembedaan tingkat produk paling jelas karena Responses API DeepSeek saat ini menyatakan input gambar dan berkas tidak didukung. Jika checkpoint V4.1 mendatang menambahkan pemahaman visual atau berkas native, itu akan memperluas DeepSeek ke alur kerja dokumen, tangkapan layar, dan coding visual yang saat ini tidak tercakup oleh API berbasis teks.

Sampai DeepSeek menerbitkan kartu model atau skema API V4.1, modalitas, batas resolusi, perilaku audio/video, dan benchmark multimodal yang tepat harus tetap diberi label tidak diketahui.

Kinerja Frontier dengan Biaya ala DeepSeek

Biaya inferensi rendah tetap menjadi salah satu diferensiasi terkuat DeepSeek, tetapi penetapan harga resmi berubah dengan peluncuran V4 penuh. Tabel harga saat ini menggunakan tarif peak/off-peak: input cache-miss V4-Flash adalah $0,22 off-peak / $0,44 peak dan output adalah $0,66 / $1,32 per 1M token; input V4-Pro adalah $0,66 / $1,32 dan output adalah $1,98 / $3,96. Tarif off-peak adalah setengah dari tarif peak.

Kinerja Benchmark yang Diharapkan dari DeepSeek-V4.1

Masih belum ada skor benchmark V4.1 resmi. Baseline keluarga V4 terkuat saat ini adalah DeepSeek-V4-Pro-0813 GA, yang menggantikan Pro Preview sebagai titik acuan untuk kinerja Agent. DeepSeek melaporkan 87,9 pada Terminal Bench 2.1, 61,5 pada NL2Repo, 83,3 pada Cybergym, 62,7 pada DeepSWE dan 74,1 pada Toolathlon-Verified, bersama peningkatan pada AutomationBench dan DSBench.

DeepSeek-V4.1 Segera Hadir: Spesifikasi, Benchmark, dan Fitur yang Diharapkan

Gambar 6. Nilai benchmark Agent resmi DeepSeek-V4-Pro-0813 GA, divisualisasikan dari catatan perubahan DeepSeek.

BenchmarkV4-Pro-0813V4-Flash-0731V4-Pro Preview
Terminal Bench 2.187.982.772.1
NL2Repo61.554.238.5
Cybergym83.376.752.7
DeepSWE62.754.412.8
Toolathlon-Verified74.170.355.9
Agents' Last Exam25.725.216.5
AutomationBench (Public)31.825.112.8
DSBench-FullStack71.168.7
DSBench-Hard67.259.6

DeepSeek-V4.1 Segera Hadir: Spesifikasi, Benchmark, dan Fitur yang Diharapkan

Gambar 7. V4-Pro-0813 versus V4-Flash-0731 pada benchmark Agent umum. Nilai berasal dari catatan perubahan DeepSeek; pengaturan harness dan penalaran dapat memengaruhi perbandingan lintas model.

Progres ini menyarankan tiga ekspektasi berbasis bukti untuk V4.1. Pertama, rilis V4.1 yang bermakna setidaknya harus mempertahankan baseline GA V4-Pro-0813, bukan sekadar mengalahkan Preview lama. Kedua, DeepSeek masih mengekstraksi peningkatan melalui post-training dan optimasi Agent, bukan hanya dengan meningkatkan jumlah parameter. Ketiga, peningkatan V4.1 yang paling bernilai mungkin berupa kapabilitas multimodal dan alat enterprise yang lebih luas jika kinerja Agent inti sudah mendekati batas desain V4.

DeepSeek-V4.1 vs V4-Flash vs V4-Pro

DimensiV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 (diharapkan)
PositioningModel Agent/coding yang cepat dan efisienModel penalaran/Agent V4 berkemampuan lebih tinggi saat iniPembaruan kapabilitas V4 tengah siklus
Skala284B total / 13B aktif1.6T total / 49B aktifTidak diketahui
Konteks1M1MKemungkinan setidaknya 1M jika turunan V4
Agent codingSangat kuat setelah post-training 0731Baseline Agent resmi V4 terkuat saat iniDiharapkan memenuhi atau melampaui baseline Pro GA
Thinking effortLow / high / maxLow / high / maxDiharapkan mempertahankan atau memperluas kontrol
Responses APIDidukungDidukungDiharapkan jika dibangun di atas tumpukan V4 saat ini
Input multimodalTidak ada input gambar/berkas dalam Responses API saat iniTidak ada input gambar/berkas dalam Responses API saat iniKemungkinan yang dilaporkan; belum dikonfirmasi
Biaya API resmiTier V4 lebih rendah; harga peak/off-peakTier V4 lebih tinggi; harga peak/off-peakTidak diketahui
StatusRilis API resmi dalam beta publikGABelum diumumkan oleh DeepSeek

Untuk Apa DeepSeek-V4.1 Akan Digunakan?

Jika arah yang dilaporkan bertahan, V4.1 akan paling menarik di area di mana keluarga V4 saat ini sudah kuat tetapi masih kekurangan kapabilitas produk yang lebih luas.

  1. Agen coding skala repositori. Pemahaman kode konteks panjang, pembuatan patch, loop pengujian, dan eksekusi terminal adalah kecocokan paling jelas mengingat peningkatan Agent V4-Pro-0813 dan Flash-0731.
  2. Riset enterprise dan alur kerja dokumen. Baseline konteks 1M, dukungan Responses API, dan integrasi web/alat dapat mendukung himpunan pengetahuan internal besar, korpus kebijakan, dan dokumentasi teknis. V4.1 akan menjadi lebih berguna di sini jika menambahkan retrieval atau alat berkas yang lebih kaya.
  3. Agen otonom sensitif biaya. V4-Flash tetap sangat menarik untuk perencanaan berulang dan loop pemanggilan alat, sementara V4-Pro menawarkan tier berkemampuan lebih tinggi. V4.1 akan menarik jika mempertahankan disiplin biaya ini.
  4. Analisis dokumen visual dan tangkapan layar. Ini menjadi use case native utama hanya jika kapabilitas multimodal yang dilaporkan benar-benar dihadirkan.
  5. Deployment privat atau kustom. DeepSeek telah merilis bobot V4-Pro-0813 dan V4-Flash-0731, jadi checkpoint V4.1 yang dirilis terpisah bisa tetap menarik bagi organisasi yang membutuhkan self-hosting atau adaptasi domain. Ketersediaan bobot terbuka untuk V4.1 sendiri belum dikonfirmasi.

Apa yang Masih Kita Tidak Ketahui

Risiko terbesar dalam menulis artikel “segera hadir” adalah mengubah ekstrapolasi yang masuk akal menjadi spesifikasi palsu. Poin-poin ini harus tetap secara eksplisit terbuka sampai DeepSeek menerbitkan materi pihak pertama:

  • Apakah “DeepSeek-V4.1” akan menjadi nama model resmi.
  • Apakah V4.1 merupakan checkpoint yang berbeda atau label terpisah untuk peningkatan di luar V4-Flash-0731 dan V4-Pro-0813.
  • Jumlah parameter total, parameter aktif, dan setiap perubahan arsitektural.
  • Input multimodal yang tepat dan apakah gambar, audio, video, atau berkas didukung.
  • Dukungan MCP, computer-use, file-search, atau code-interpreter native.
  • Skor benchmark resmi dan pengaturan evaluasi.
  • Harga API, ketersediaan bobot terbuka, dan ketentuan komersial untuk checkpoint V4.1 terpisah. Tanggal rilis yang pasti.

Pemikiran Akhir

DeepSeek-V4.1 menarik justru karena siklus V4 saat ini menunjukkan bahwa DeepSeek dapat membuat keluarga ini jauh lebih kuat tanpa memperkenalkan arsitektur yang benar-benar baru. Pembaruan post-training Flash-0731 menghadirkan peningkatan Agent besar, dan rilis GA Pro-0813 mendorong baseline itu lebih tinggi lagi sambil menambahkan dukungan Responses API native dan tingkat thinking-effort yang lebih fleksibel.

Tesis V4.1 yang paling kredibel bukanlah “model misterius dengan triliunan parameter.” Melainkan V4 yang lebih matang: eksekusi Agent produksi yang lebih kuat, alat enterprise yang lebih luas, kemungkinan input multimodal native, dan keseimbangan yang lebih rapat antara efisiensi Flash dan penalaran tingkat Pro. Ketidakpastian utama adalah apakah DeepSeek akan merilis peningkatan tersebut di bawah nama V4.1 sama sekali.

Pengembang sudah dapat menguji DeepSeek V4 Flash dan DeepSeek V4 Pro melalui CometAPI, sementara halaman DeepSeek V4.1 dapat digunakan untuk melacak ketersediaan CometAPI jika model terpisah menjadi dapat digunakan. CometAPI menyediakan lapisan API terpadu untuk membandingkan DeepSeek dengan model frontier lainnya tanpa membangun ulang integrasi untuk setiap penyedia.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Aug 23, 2026
Terakhir diperbarui Aug 23, 2026
0 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya