Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-comparisons/CometAPI research

DeepSeek API-priser: V4 Pro vs. V4.1 Flash

I don’t have live access to current pricing, and “DeepSeek V4 Pro” and “V4.1 Flash” rates vary by provider (DeepSeek native API, OpenRouter, Together, Fireworks, etc.), region, and currency. Share the pricing page or paste the exact numbers and I’ll compute a precise comparison. In the meantime, here’s the checklist and formulas I’ll use: What I need from you - Provider and endpoint (e.g., DeepSeek Console, OpenRouter, Together, Fireworks) - Currency and region - Model IDs as shown by that provider (exact strings) - Input and output prices ($/1K tokens) for both peak and off‑peak - Cache pricing, if applicable (cache write/store $/1K tokens; cache read $/1K tokens; any time/size fees) - Your workload profile: - Number of requests - Average input tokens per request - Average output tokens per request - Peak traffic share (%) vs off‑peak - Expected cache hit rate (%) and whether cache read/write is billed Comparison template (I’ll fill this with your numbers) - Model: DeepSeek V4 Pro - Model ID: - Context window: - Peak: input $/1K, output $/1K - Off‑peak: input $/1K, output $/1K - Cache: write $/1K, read $/1K (or policy) - Model: DeepSeek V4.1 Flash - Model ID: - Context window: - Peak: input $/1K, output $/1K - Off‑peak: input $/1K, output $/1K - Cache: write $/1K, read $/1K (or policy) Real workload cost formulas - Define: - N = total requests - Tin = avg input tokens/request - Tout = avg output tokens/request - p = peak share (0–1); (1−p) off‑peak share - h = cache hit rate for inputs (0–1), if applicable - Prices: - Pin_peak, Pout_peak ($/1K tokens) - Pin_off, Pout_off ($/1K tokens) - Pc_write, Pc_read ($/1K tokens), if billed - Without caching: - Cost_peak = N·p·[(Tin/1000)·Pin_peak + (Tout/1000)·Pout_peak] - Cost_off = N·(1−p)·[(Tin/1000)·Pin_off + (Tout/1000)·Pout_off] - Total = Cost_peak + Cost_off - With input caching (common cases): - If cache hits billed at read price: - Effective input cost per segment: - Peak: (h·Pc_read_peak + (1−h)·Pin_peak) per 1K input tokens - Off: (h·Pc_read_off + (1−h)·Pin_off) per 1K input tokens - Add cache write if charged on first use: - Peak write cost: (Tin/1000)·(1−h)·Pc_write_peak - Off write cost: (Tin/1000)·(1−h)·Pc_write_off - Then: - Cost_peak = N·p·[(Tin/1000)·(h·Pc_read_peak + (1−h)·Pin_peak) + (Tout/1000)·Pout_peak] + N·p·(Tin/1000)·(1−h)·Pc_write_peak - Cost_off = N·(1−p)·[(Tin/1000)·(h·Pc_read_off + (1−h)·Pin_off) + (Tout/1000)·Pout_off] + N·(1−p)·(Tin/1000)·(1−h)·Pc_write_off - Total = Cost_peak + Cost_off If you paste the exact rates and your workload stats, I’ll compute: - Peak vs off‑peak costs per model - Cache savings in absolute $ and % - Effective $ per 1K tokens for your workload - Total monthly estimate and crossover point where one model becomes cheaper than the other

CometAPI
Deon GoodwinForskningshold for AI-modeller og API
Opdateret Oct 2, 2026 8 min. læsning
DeepSeek API-priser: V4 Pro vs. V4.1 Flash
Brug dette mønster

Lav det første API-kald.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

DeepSeek V4 Pro og V4.1 Flash er separate, aktive API-tilbud med forskellige priser. Den officielle Models & Pricing-tabel identificerer deepseek-v4-pro som DeepSeek-V4-Pro-0813 og deepseek-flash som DeepSeek-V4.1-Flash. DeepSeeks opdatering den 10. september siger, at V4 Pro API-tjenesten fortsætter efter 14. september med uændret afregningsmetode. Den tidligere påstand om, at V4 Pro-forespørgsler routes til Flash og faktureres til Flash-priser, understøttes ikke længere af den nuværende officielle dokumentation.

Key Takeaways

  • V4.1 Flash koster $0.003/M cache-hit-input, $0.15/M ikke-cachet input og $0.60/M output uden for spidsbelastning.
  • V4 Pro koster $0.022/M cache-hit-input, $0.66/M ikke-cachet input og $1.98/M output uden for spidsbelastning.
  • Spidsbelastningssatser er det dobbelte af satserne uden for spidsbelastning for begge modeller. Kinesiske helligdage er lavbelastning hele dagen ifølge den officielle plan.
  • Brug deepseek-flash til V4.1 Flash og deepseek-v4-pro til V4 Pro. Kun de udfasede V4 Flash-modelnavne beskrives som kompatibilitetsruter til V4.1 Flash.

What Are the Current DeepSeek API Prices?

DeepSeeks aktuelle pristabel viser cache-hit-input, cache-miss-input og output separat for hver model og tidsbånd. Tabellen nedenfor gengiver disse direkte udbyderpriser; den beskriver ikke tredjepartspriser.

ModelTidsbåndCache-hit-inputCache-miss-inputOutput
V4.1 FlashUden for spids$0.003/M$0.15/M$0.60/M
V4.1 FlashSpidsbelastning$0.006/M$0.30/M$1.20/M
V4 ProUden for spids$0.022/M$0.66/M$1.98/M
V4 ProSpidsbelastning$0.044/M$1.32/M$3.96/M

Spidsbelastningstider er 01:00–04:00 UTC og 06:00–10:00 UTC, mandag til fredag, ekskl. kinesiske helligdage. I Beijing-tid er hverdagens vinduer 09:00–12:00 og 14:00–18:00. Weekender og kinesiske helligdage er lavbelastning hele dagen. Tjek den officielle tabel, før du lægger budget, da priser kan ændre sig.

DeepSeek API-priser: V4 Pro vs. V4.1 Flash

Officiel DeepSeek V4.1 Flash API-pris. Kilde: DeepSeek release announcement.

What Does DeepSeek V4 Pro Cost Now?

DeepSeeks release-opdatering siger udtrykkeligt, at V4 Pro API-tjenesten fortsætter efter 14. september 2026 med uændret afregningsmetode. Deres aktuelle modeltabel oplister deepseek-v4-pro som DeepSeek-V4-Pro-0813 sammen med deepseek-flash som DeepSeek-V4.1-Flash. De to navne bør derfor ikke behandles som to prismærkater for den samme serverede model.

API-modelnavnModel opført af DeepSeekFakturering
deepseek-flashDeepSeek-V4.1-FlashV4.1 Flash-priser
deepseek-v4-proDeepSeek-V4-Pro-0813V4 Pro-priser
deepseek-v4-flashV4.1 Flash via kompatibilitetsroutingV4.1 Flash-priser

Bemærkningen om kompatibilitet gælder de udfasede navne deepseek-v4-flash og deepseek-v4-flash-vision-exp. Den officielle note inkluderer ikke deepseek-v4-pro i den routing-gruppe.

DeepSeek V4 Pro vs. V4.1 Flash Price

PristilstandCachet inputIkke-cachet inputOutput
Tidligere V4 Pro (lav)$0.022/M$0.66/M$1.98/M
V4.1 Flash (lav)$0.003/M$0.15/M$0.60/M
Nuværende V4 Pro-route (lav)$0.003/M$0.15/M$0.60/M

For ikke-cachet input er V4 Pros nuværende lavbelastningsrate på $0.66/M 4,4 gange Flashs $0.15/M. For output er $1.98/M 3,3 gange Flashs $0.60/M. Flash er cirka 77.3% billigere på ikke-cachet input og 69.7% billigere på output i denne direkte udbydersammenligning. Disse procenter sammenligner to samtidige modeller; de er ikke besparelser fra en V4 Pro-route, der skifter til Flash.

Satsen på $0.022/M for cache-hit-input på V4 Pro er også aktuel, ikke kun historisk. Flashs $0.003/M for cache-hit er cirka 86.4% lavere. Den officielle tabel viser også separate modelpriser i spidsbelastning: V4 Pro er $1.32/M for cache-miss-input og $3.96/M for output, mens Flash er $0.30/M og $1.20/M.

What Does the Price Mean for a Real Workload?

Antag en arbejdsbyrde med 10 millioner ikke-cachede input-tokens og 2 millioner output-tokens. Med dagens direkte udbydersatser:

ModelPris uden for spidsPris i spidsbelastning
deepseek-flash$2.70$5.40
deepseek-v4-pro$10.56$21.12

Beregningen uden for spids er 10 × $0.15 + 2 × $0.60 = $2.70 for Flash og 10 × $0.66 + 2 × $1.98 = $10.56 for V4 Pro. Totalsummer i spidsbelastning fordobles under de nuværende tidsbåndsatser.

Caching kan yderligere reducere den aktuelle regning. Hvis 80% af de 10 millioner input-tokens rammer cachen, bliver beregningen uden for spids $0.024 for cachet input, $0.30 for ikke-cachet input og $1.20 for output, i alt $1.524 på V4.1 Flash. For den samme tokenfordeling på V4 Pro er totalen $0.176 + $1.32 + $3.96 = $5.456.

How Has DeepSeek API Availability Changed?

V4.1 Flash er tilgængelig via den officielle DeepSeek API under modelnavnet deepseek-flash. De tidligere V4 Flash- og V4 Flash Vision Exp-modeller er udfaset, men deres ældre ID'er accepteres midlertidigt og routes til V4.1 Flash.

V4 Pro er fortsat tilgængelig under deepseek-v4-pro. DeepSeek siger, at afregningsmetoden forbliver uændret og vil give yderligere besked, hvis det ændrer sig. Udled ikke en udfasning af V4 Pro eller en migration til Flash ud fra udfasningen af de ældre V4 Flash-navne.

CometAPIs changelog oplister DeepSeek Flash og V4.1 Flash. Dets V4.1 Flash-modelside viser i øjeblikket en startpris på $0.12/M input-tokens med separate justeringer efter forespørgselstidspunkt. Det er CometAPI-priser, ikke DeepSeeks direkte API-rate; tjek de aktuelle betalingsvilkår for en specifik arbejdsbyrde.

What Could DeepSeek V4.1 Pro Cost?

DeepSeek har bekræftet en kommende V4.1 Pro-udgivelse, men ingen officiel pris er offentliggjort. Ethvert præcist tal i dag vil være spekulation. En sikrere planlægningsmetode er at modellere flere tillæg oven på den live V4.1 Flash-pris.

PlanlægningsscenarieUden for spids, ikke-cachet inputUden for spids, output10M input + 2M output
2× Flash$0.30/M$1.20/M$5.40
3× Flash$0.45/M$1.80/M$8.10
4× Flash$0.60/M$2.40/M$10.80

Dette er budgetteringsscenarier, ikke lækkede eller officielle V4.1 Pro-priser. De antager, at DeepSeek bevarer den nuværende struktur for spids-/lavbelastning og anvender et 2×–4× tillæg over Flash. Selskabet kan vælge et andet forhold, en anden caching-sats, en lanceringskampagne eller en anden afregningsmodel.

Den historiske V4 Pro-pris giver et nyttigt loftsreferencepunkt: dens $0.66/M for ikke-cachet input og $1.98/M for output lå cirka 4,4× og 3,3× over de nye V4.1 Flash-satser uden for spids. Det gør et 2×–4× scenariebånd rimeligt til intern budgettering, men det forudsiger ikke DeepSeeks endelige beslutning.

How Should Teams Control DeepSeek API Cost?

  • Vælg den tilsigtede model. Brug deepseek-flash til V4.1 Flash eller deepseek-v4-pro til den separat opførte V4 Pro-model.
  • Planlæg fleksible opgaver uden for spidsbelastning. De angivne spidsbelastningssatser er dobbelt så høje som satserne uden for spids; medregn undtagelsen for kinesiske helligdage.
  • Bevar genanvendelige prompt-præfikser. Cache-hit-input er 50× billigere end ikke-cachet input til den aktuelle Flash-sats.
  • Overvåg output-længde. Output er fortsat den største komponent i mange agent-workloads.
  • Verificér den live pristabel. Tjek både modelkolonner og tredjepartsvilkår igen, før du forpligter et produktionsbudget.

FAQ

Hvor meget koster DeepSeek V4.1 Flash?

Officiel pris uden for spidsbelastning er $0.003/M for cache-hit-input, $0.15/M for ikke-cachet input og $0.60/M for output. Spidsbelastningssatser er $0.006/M, $0.30/M og $1.20/M.

Er DeepSeek V4 Pro stadig tilgængelig til sin egen pris?

Ja. DeepSeek siger, at V4 Pro API-tjenesten fortsætter med uændret afregning. Dens pristabel oplister $0.022/M for cache-hit-input, $0.66/M for cache-miss-input og $1.98/M for output uden for spids; spidsbelastningssatser er $0.044/M, $1.32/M og $3.96/M.

Har V4 Pro og V4.1 Flash samme pris lige nu?

Nej. Den officielle tabel oplister dem som separate modeller med forskellige direkte API-priser. De gamle Flash-kompatibilitetsnavne routes til V4.1 Flash; V4 Pro er ikke inkluderet i den note.

Har DeepSeek offentliggjort en V4.1 Pro-pris?

Ingen V4.1 Pro-pris fremgår i den aktuelle officielle model- og pristabel. Erstat ikke V4 Pro-prisen for en ikke-opført fremtidig model.

Kan jeg bruge DeepSeek V4.1 Flash via CometAPI?

Ja. CometAPI understøtter deepseek-flash og deepseek-v4.1-flash via deres Chat API-format. Den viste pris og tidsjusteringer er adskilt fra DeepSeeks direkte API-afregning.

Conclusion

Den centrale sammenligning er mellem to live DeepSeek API-modeller. V4.1 Flash starter ved $0.15/M for ikke-cachet input og $0.60/M for output uden for spids. V4 Pro er fortsat opført med $0.66/M og $1.98/M, henholdsvis. Ruterne deler ikke en officiel pris: vælg modellen for dens kapabiliteter, og beregn derefter omkostninger ved hjælp af den models cache- og tidsbåndsatser.

Før publicering eller budgettering skal du verificere den live DeepSeek-pristabel og release-opdateringer. Tredjepartstilbud bør tjekkes på deres egne prissider.

SEO Metadata

Meta title: DeepSeek API-priser: V4 Pro vs. V4.1 Flash

Meta description: Sammenlign aktuelle priser for DeepSeek V4 Pro og V4.1 Flash API, model-ID'er, spids- og lavbelastningssatser, cache-besparelser og omkostninger for reelle workloads.

Keywords: DeepSeek API pris, DeepSeek V4 Pro pris, DeepSeek V4.1 Flash pris, DeepSeek API pricing, V4 Pro vs. V4.1 Flash, DeepSeek V4.1 Pro pris

URL slug: deepseek-api-price-v4-pro-vs-v4-1-flash

Fortsæt læring

Knyt denne artikel til den næste beslutning.

Se alle emner
Udgivet den Oct 2, 2026
Sidst opdateret Oct 2, 2026
11 visninger
Gennemgået for klarhed, kildeangivelse og aktuel API-terminologi.

Læs mere