Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-comparisons/Penyelidikan CometAPI

Harga API DeepSeek: V4 Pro vs. V4.1 Flash

Saya tidak mempunyai akses masa nyata kepada kadar semasa. Untuk membandingkan dengan tepat, sila berikan pautan rasmi atau tampal jadual harga terkini (mata wang/region) bagi DeepSeek V4 Pro dan V4.1 Flash. Sementara itu, berikut rangka perbandingan dan templat pengiraan kos kerja sebenar yang boleh saya isikan sebaik anda kongsi datanya. Apa yang perlu dibandingkan - ID model tepat seperti didokumenkan di API - Tetingkap konteks maksimum dan ciri (cth. KV cache) - Harga input per 1K token: waktu puncak dan bukan puncak - Harga output per 1K token: waktu puncak dan bukan puncak - Cache: - Harga tulis cache per 1K token - Harga baca/rehydrate cache per 1K token (jika berasingan) - TTL/had saiz/polisi pelupusan cache (jika relevan) - Had kadar: TPM, RPM, RPS/QPS, had serentak - Ciri dan caj tambahan: streaming, batching, fine-tune, pembundaran bil (unit bil, caj minimum) - Diskaun volum/tiers, kredit percuma, had percubaan - Ketersediaan wilayah dan mata wang bil Templat pengiraan kos kerja sebenar - Notasi: - P = purata token prompt per permintaan - C = purata token completion per permintaan - K = token awalan boleh dicache (dikongsi merentas permintaan) - r = kadar guna semula cache (0–1) bagi permintaan selepas tulis cache - pin_peak, pout_peak = harga input/output puncak per 1K token - pin_off, pout_off = harga input/output bukan puncak per 1K token - pcw = harga tulis cache per 1K token - pcr = harga baca/rehydrate cache per 1K token (jika berkenaan) - N_peak, N_off = bilangan permintaan pada masa puncak/bukan puncak - Tanpa cache (kos per permintaan): - Kos = (P/1000)×pin + (C/1000)×pout - Dengan cache: - Kos tulis cache untuk awalan unik: (K/1000)×pcw - Kos permintaan yang guna semula cache: - Input efektif ≈ (P − K)/1000 × pin + kos baca cache (jika ada: (K/1000)×pcr) - Output ≈ (C/1000)×pout - Jika ada M permintaan berkongsi cache yang sama: - Kos keseluruhan kumpulan ≈ kos tulis cache sekali + 1× permintaan penuh (jika permintaan pertama tidak guna cache) + (M−1)× kos permintaan guna semula cache - Pengasingan puncak vs bukan puncak: - Kos_bulanan ≈ - N_peak × Kos_permintaan_peak + N_off × Kos_permintaan_off - Tambah kos tulis cache (diagih mengikut bila ia dilakukan, puncak atau bukan puncak) - Penjimatan cache: - Penjimatan% = 1 − (Kos_dengan_cache / Kos_tanpa_cache) Maklumat yang diperlukan daripada anda untuk keluaran perbandingan siap-pakai - Jadual harga rasmi (input/output per 1K token untuk puncak dan bukan puncak) bagi V4 Pro dan V4.1 Flash - Harga cache: tulis dan baca (jika berasingan), serta TTL/had - ID model API tepat untuk kedua-duanya - Had kadar (TPM/RPM/RPS) yang terpakai - Profil beban kerja anda: - P, C, K, dan anggaran r - Permintaan per minit atau RPS, serta pecahan puncak vs bukan puncak - Tempoh penggunaan bulanan (minit/jam) dan wilayah/mata wang bil - Sama ada gunakan streaming atau batching Sebaik anda kongsi butiran di atas atau pautan ke halaman harga semasa, saya akan sediakan perbandingan sisi demi sisi (kadar API, ID model, harga puncak/bukan puncak, penjimatan cache) dan kira kos sebenar untuk beban kerja anda.

CometAPI
Deon GoodwinPasukan penyelidikan model AI dan API
Dikemas kini Oct 2, 2026 8 min baca
Harga API DeepSeek: V4 Pro vs. V4.1 Flash
Guna corak ini

Buat panggilan API pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

DeepSeek V4 Pro dan V4.1 Flash ialah tawaran API langsung yang berasingan dengan harga berbeza. Jadual Models & Pricing rasmi mengenal pasti deepseek-v4-pro sebagai DeepSeek-V4-Pro-0813 dan deepseek-flash sebagai DeepSeek-V4.1-Flash. Kemas kini 10 September DeepSeek menyatakan ia akan terus menyediakan perkhidmatan API V4 Pro selepas 14 September dengan kaedah pengebilan tidak berubah. Dakwaan terdahulu bahawa permintaan V4 Pro dihalakan ke Flash dan dibil pada kadar Flash tidak lagi disokong oleh dokumentasi rasmi semasa.

Perkara Utama

  • V4.1 Flash berharga $0.003/M input cache-hit, $0.15/M input tidak di-cache, dan $0.60/M output luar puncak.
  • V4 Pro berharga $0.022/M input cache-hit, $0.66/M input tidak di-cache, dan $1.98/M output luar puncak.
  • Kadar waktu puncak adalah dua kali ganda kadar luar puncak untuk kedua-dua model. Cuti umum China adalah luar puncak sepanjang hari di bawah jadual rasmi.
  • Guna deepseek-flash untuk V4.1 Flash dan deepseek-v4-pro untuk V4 Pro. Hanya nama model V4 Flash yang telah ditamatkan digambarkan sebagai laluan keserasian ke V4.1 Flash.

Apakah Harga API DeepSeek Semasa?

Jadual harga semasa DeepSeek menyenaraikan input cache-hit, input cache-miss, dan output secara berasingan bagi setiap model dan jalur masa. Jadual di bawah menyalin kadar penyedia terus tersebut; ia tidak menerangkan harga pihak ketiga.

ModelJalur masaInput cache-hitInput cache-missOutput
V4.1 FlashLuar puncak$0.003/M$0.15/M$0.60/M
V4.1 FlashWaktu puncak$0.006/M$0.30/M$1.20/M
V4 ProLuar puncak$0.022/M$0.66/M$1.98/M
V4 ProWaktu puncak$0.044/M$1.32/M$3.96/M

Waktu puncak ialah 01:00–04:00 UTC dan 06:00–10:00 UTC, Isnin hingga Jumaat, tidak termasuk cuti umum China. Dalam Waktu Beijing, tetingkap hari bekerja ialah 09:00–12:00 dan 14:00–18:00. Hujung minggu dan cuti umum China adalah luar puncak sepanjang hari. Semak jadual rasmi sebelum merancang bajet kerana harga boleh berubah.

Harga API DeepSeek: V4 Pro vs. V4.1 Flash

Harga API rasmi DeepSeek V4.1 Flash. Sumber: [Pengumuman keluaran DeepSeek].

Berapakah Kos DeepSeek V4 Pro Sekarang?

Kemas kini keluaran DeepSeek menyatakan secara jelas ia akan meneruskan perkhidmatan API V4 Pro selepas 14 September 2026, dengan kaedah pengebilan tidak berubah. Jadual model semasanya menyenaraikan deepseek-v4-pro sebagai DeepSeek-V4-Pro-0813, di samping deepseek-flash sebagai DeepSeek-V4.1-Flash. Justeru, kedua-dua nama tidak sepatutnya dianggap sebagai dua label harga untuk model yang sama.

Nama model APIModel yang disenaraikan oleh DeepSeekPengebilan
deepseek-flashDeepSeek-V4.1-FlashKadar V4.1 Flash
deepseek-v4-proDeepSeek-V4-Pro-0813Kadar V4 Pro
deepseek-v4-flashV4.1 Flash melalui penghalaan keserasianKadar V4.1 Flash

Nota keserasian terpakai kepada nama deepseek-v4-flash dan deepseek-v4-flash-vision-exp yang telah ditamatkan. Nota rasmi tidak memasukkan deepseek-v4-pro dalam kumpulan penghalaan tersebut.

Harga DeepSeek V4 Pro vs. V4.1 Flash

Keadaan hargaInput cacheInput tidak di-cacheOutput
V4 Pro luar puncak terdahulu$0.022/M$0.66/M$1.98/M
V4.1 Flash luar puncak$0.003/M$0.15/M$0.60/M
Laluan V4 Pro semasa luar puncak$0.003/M$0.15/M$0.60/M

Bagi input tidak di-cache, kadar luar puncak V4 Pro $0.66/M adalah 4.4 kali ganda kadar Flash $0.15/M. Bagi output, $1.98/M adalah 3.3 kali ganda kadar Flash $0.60/M. Flash kira-kira 77.3% lebih murah untuk input tidak di-cache dan 69.7% lebih murah untuk output bagi perbandingan penyedia terus ini. Peratusan ini membandingkan dua model yang disenaraikan serentak; ia bukan penjimatan daripada laluan V4 Pro bertukar kepada Flash.

Kadar $0.022/M untuk input cache-hit bagi V4 Pro juga adalah semasa, bukan sekadar sejarah. Kadar $0.003/M untuk cache-hit bagi Flash kira-kira 86.4% lebih rendah. Jadual rasmi turut menunjukkan harga model berasingan pada waktu puncak: V4 Pro ialah $1.32/M untuk input cache-miss dan $3.96/M untuk output, manakala Flash ialah $0.30/M dan $1.20/M.

Apakah Maksud Harga Bagi Beban Kerja Sebenar?

Andaikan beban kerja menggunakan 10 juta token input tidak di-cache dan 2 juta token output. Pada kadar penyedia terus hari ini:

ModelKos luar puncakKos waktu puncak
deepseek-flash$2.70$5.40
deepseek-v4-pro$10.56$21.12

Pengiraan luar puncak ialah 10 × $0.15 + 2 × $0.60 = $2.70 untuk Flash, dan 10 × $0.66 + 2 × $1.98 = $10.56 untuk V4 Pro. Jumlah waktu puncak berganda di bawah kadar jalur masa semasa.

Caching boleh lagi mengurangkan bil semasa. Jika 80% daripada 10 juta token input ialah cache-hit, pengiraan luar puncak menjadi $0.024 untuk input cache, $0.30 untuk input tidak di-cache, dan $1.20 untuk output, dengan jumlah $1.524 pada V4.1 Flash. Bagi campuran token yang sama pada V4 Pro, jumlahnya ialah $0.176 + $1.32 + $3.96 = $5.456.

Bagaimanakah Ketersediaan API DeepSeek Berubah?

V4.1 Flash tersedia melalui API rasmi DeepSeek di bawah nama model deepseek-flash. Model V4 Flash dan V4 Flash Vision Exp terdahulu telah ditamatkan, walaupun ID legasi mereka diterima sementara dan dihalakan ke V4.1 Flash.

V4 Pro kekal tersedia di bawah deepseek-v4-pro. DeepSeek menyatakan kaedah pengebilannya kekal tidak berubah dan akan memberikan notis lanjut jika itu berubah. Jangan membuat inferens penamatan V4 Pro atau migrasi ke Flash daripada penamatan nama V4 Flash yang lebih lama.

Log perubahan CometAPI menyenaraikan DeepSeek Flash dan V4.1 Flash. Halaman model V4.1 Flash kini memaparkan harga permulaan $0.12/M token input, dengan pelarasan masa permintaan berasingan. Itu ialah harga CometAPI, bukan kadar API terus DeepSeek; semak terma pembayaran langsung untuk beban kerja khusus.

Berapakah Kos DeepSeek V4.1 Pro?

DeepSeek telah mengesahkan keluaran V4.1 Pro pada masa hadapan, tetapi tiada harga rasmi diterbitkan. Apa-apa angka tepat yang dibentangkan hari ini adalah spekulasi. Kaedah perancangan yang lebih selamat adalah memodelkan beberapa premium berbanding harga V4.1 Flash yang sedang berjalan.

Senario perancanganInput tidak di-cache luar puncakOutput luar puncak10M input + 2M output
2× Flash$0.30/M$1.20/M$5.40
3× Flash$0.45/M$1.80/M$8.10
4× Flash$0.60/M$2.40/M$10.80

Ini ialah senario perancangan bajet, bukan harga V4.1 Pro yang dibocorkan atau rasmi. Ia menganggap DeepSeek mengekalkan struktur waktu puncak/luar puncak semasa dan menggunakan premium 2×–4× berbanding Flash. Syarikat mungkin memilih nisbah berbeza, kadar cache, promosi pelancaran, atau reka bentuk pengebilan yang lain.

Harga V4 Pro sejarah menyediakan rujukan siling yang berguna: input tidak di-cache $0.66/M dan output $1.98/Mnya berada kira-kira 4.4× dan 3.3× di atas kadar luar puncak V4.1 Flash yang baharu. Itu menjadikan jalur senario 2×–4× munasabah untuk perancangan bajet dalaman, tetapi ia tidak meramalkan keputusan akhir DeepSeek.

Bagaimanakah Pasukan Patut Mengawal Kos API DeepSeek?

  • Pilih model yang dimaksudkan. Guna deepseek-flash untuk V4.1 Flash atau deepseek-v4-pro untuk model V4 Pro yang disenaraikan berasingan.
  • Jadualkan kerja fleksibel pada luar puncak. Kadar token waktu puncak yang disenaraikan adalah dua kali ganda kadar luar puncak; ambil kira pengecualian cuti umum China.
  • Kekalkan awalan prompt boleh guna semula. Input cache-hit adalah 50× lebih murah daripada input tidak di-cache pada kadar Flash semasa.
  • Jejaki panjang output. Output kekal sebagai komponen terbesar dalam banyak beban kerja agen.
  • Sahkan jadual harga langsung. Semak semula kedua-dua lajur model dan terma pihak ketiga sebelum komit bajet produksi.

Soalan Lazim

Berapakah kos DeepSeek V4.1 Flash?

Harga luar puncak rasmi ialah $0.003/M input cache-hit, $0.15/M input tidak di-cache, dan $0.60/M output. Kadar waktu puncak ialah $0.006/M, $0.30/M, dan $1.20/M.

Adakah DeepSeek V4 Pro masih tersedia pada harganya sendiri?

Ya. DeepSeek menyatakan ia akan meneruskan perkhidmatan API V4 Pro dengan pengebilan tidak berubah. Jadual harganya menyenaraikan $0.022/M input cache-hit, $0.66/M input cache-miss, dan $1.98/M output luar puncak; kadar waktu puncak ialah $0.044/M, $1.32/M, dan $3.96/M.

Adakah V4 Pro dan V4.1 Flash kini pada harga yang sama?

Tidak. Jadual rasmi menyenaraikan mereka sebagai model berbeza dengan kadar API terus yang berbeza. Nama keserasian Flash lama dihalakan ke V4.1 Flash; V4 Pro tidak termasuk dalam nota itu.

Adakah DeepSeek telah menerbitkan harga V4.1 Pro?

Tiada harga V4.1 Pro muncul dalam jadual model dan harga rasmi semasa. Jangan gantikan harga V4 Pro untuk model masa depan yang belum disenaraikan.

Bolehkah saya menggunakan DeepSeek V4.1 Flash melalui CometAPI?

Ya. CometAPI menyokong deepseek-flash dan deepseek-v4.1-flash melalui format Chat API mereka. Harga yang dipaparkan dan pelarasan masa adalah berasingan daripada pengebilan API terus DeepSeek.

Kesimpulan

Perbandingan teras adalah antara dua model API DeepSeek yang hidup. V4.1 Flash bermula pada $0.15/M input tidak di-cache dan $0.60/M output luar puncak. V4 Pro kekal disenaraikan pada $0.66/M dan $1.98/M masing-masing. Laluan tersebut tidak berkongsi harga rasmi: pilih model berdasarkan keupayaan, kemudian kira kos menggunakan kadar cache dan jalur masa model tersebut.

Sebelum menerbitkan atau merancang bajet, sahkan jadual harga langsung DeepSeek dan kemas kini keluaran. Tawaran pihak ketiga hendaklah disemak pada halaman harga mereka sendiri.

Metadata SEO

Tajuk Meta: DeepSeek API Pricing: V4 Pro vs. V4.1 Flash

Penerangan Meta: Bandingkan kadar API DeepSeek V4 Pro dan V4.1 Flash semasa, ID model, harga waktu puncak dan luar puncak, penjimatan cache, dan kos beban kerja sebenar.

Kata kunci: DeepSeek API price, DeepSeek V4 Pro price, DeepSeek V4.1 Flash price, DeepSeek API pricing, V4 Pro vs V4.1 Flash, DeepSeek V4.1 Pro price

Slug URL: deepseek-api-price-v4-pro-vs-v4-1-flash

Terus belajar

Sambungkan artikel ini ke keputusan seterusnya.

Lihat semua topik
Diterbitkan pada Oct 2, 2026
Terakhir dikemas kini Oct 2, 2026
21 paparan
Disemak untuk kejelasan, atribusi sumber dan terminologi API semasa.

Baca Lagi