Die V4-Familie von DeepSeek hat die ursprüngliche Preview-Phase inzwischen hinter sich gelassen. DeepSeek V4 Flash ging am 31. Juli als V4-Flash-0731 in die öffentliche Beta, während DeepSeek V4 Pro am 13. August als V4-Pro-0813 über APP, Web und API GA erreichte. Beide Modelle behalten das Ein-Million-Token-Kontextdesign und die MoE-Architektur der V4-Familie bei; Flash ist auf Effizienz optimiert, während Pro als Modell mit höherer Reasoning- und Agent-Fähigkeit positioniert ist.
Der Pro-GA-Release hebt die Basis für jede V4.1-Prognose materiell an. DeepSeek sagt, dass der GA-Build deutlich verbesserte Agent-Fähigkeiten bringt, insbesondere in produktiven Umgebungen, und nun sowohl V4-Pro als auch V4-Flash native Responses-API-Unterstützung sowie niedrige, hohe und maximale Denkaufwandstufen erhalten. Die aktuelle API-Modellversion ist ausdrücklich als DeepSeek-V4-Pro-0813 aufgeführt. Wo passt DeepSeek V4.1 jetzt hinein? Der Bericht von The Information aus dem Mai sagte, DeepSeek habe eine Veröffentlichung von V4.1 im Juni mit stärkeren Enterprise-Tools und multimodaler Unterstützung geplant. Dieses Zeitfenster ist verstrichen, und das aktuelle DeepSeek-Release-Log enthält weiterhin keine V4.1-Model Card oder Release-Eintrag. Die sicherste Interpretation ist daher eine mögliche Post-GA-V4-Iteration, deren gemeldete Ziele noch unter dem Namen V4.1 oder durch zusätzliche V4-Updates eintreffen könnten.

Bestätigte Meilensteine verwenden das DeepSeek-Änderungsprotokoll; der frühere V4.1-Juni-Plan stammt von The Information.
Was ist DeepSeek-V4.1?
DeepSeek-V4.1 lässt sich am besten als eine unbestätigte Post-GA-V4-Iteration verstehen, nicht als ein offiziell veröffentlichtes DeepSeek-Modell. Die V4-Familie hat bereits einen produktiven Pro-Checkpoint in V4-Pro-0813, sodass V4.1 nun ein Mid-Cycle-Fähigkeitsupdate darstellen würde, nicht den Schritt, der erforderlich wäre, um die ursprüngliche V4-Einführung abzuschließen. DeepSeek hat keine V4.1-Model Card, keinen technischen Bericht, kein API-Changelog oder Benchmark-Tabellen veröffentlicht.
| Frage | Aktuelle Antwort | Vertrauen |
|---|---|---|
| Hat DeepSeek „V4.1“ offiziell angekündigt? | Nein. Das aktuelle DeepSeek-Release-Log hat keinen V4.1-Eintrag oder eine Model Card. | Hoch |
| Wurde ein V4.1-Release berichtet? | Ja. The Information berichtete einen Juni-Plan mit Enterprise-Tools und multimodaler Unterstützung. | Mittel |
| Hat das gemeldete Juni-Fenster stattgefunden? | Während dieses Zeitfensters erschien kein separates offizielles V4.1-Release. | Hoch |
| Was ist der letzte bestätigte V4-Meilenstein? | V4-Flash-0731 ging am 31. Juli in die öffentliche Beta und V4-Pro-0813 erreichte am 13. August GA. | Hoch |
| Könnte V4.1 weiterhin als separates Modell starten? | Ja, aber Name, Spezifikationen und Timing bleiben unbestätigt. | Niedrig/Mittel |
Erwartete DeepSeek-V4.1-Spezifikationen
Da DeepSeek keine V4.1-Spezifikationen veröffentlicht hat, trennt die folgende Tabelle bestätigte aktuelle V4-Fähigkeiten von Richtungs-Erwartungen. „Erwartet“ bedeutet eine vernünftige Fortsetzung von V4 oder eine von Medien berichtete Fähigkeit, nicht eine offizielle V4.1-Spezifikation.
| Dimension | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 (erwartet) |
|---|---|---|---|
| Modellfamilie | V4 | V4 | Wahrscheinlich V4-Familien-Iteration |
| Architektur | V4-abgeleitete MoE-Hybrid-Attention | V4-abgeleitete MoE; GA auf Preview-Struktur aufgebaut | Wahrscheinlich V4-abgeleitet; nicht bestätigt |
| Gesamt-/aktive Parameter | 284B / 13B | 1.6T / 49B | Unbekannt; keine verlässliche öffentliche Zahl |
| Kontextfenster | 1M | 1M | Wahrscheinlich mindestens die V4-Basis |
| Maximale Ausgabe | 384K API Maximum | 384K API Maximum | Unbekannt |
| Denkaufwand | Niedrig / hoch / max | Niedrig / hoch / max | Erwartet, die aktuellen Controls beizubehalten oder zu erweitern |
| Responses API | Unterstützt | Unterstützt | Erwartet, wenn auf aktuellem V4-API-Stack aufgebaut |
| Native Bild-/Dateieingabe | In der aktuellen Responses API nicht unterstützt | In der aktuellen Responses API nicht unterstützt | Berichtete multimodale Richtung; unbestätigt |
| Enterprise-/Agent-Tooling | Functions, Websuche, apply_patch / Codex-Unterstützung | Functions, Websuche, apply_patch / Codex-Unterstützung | Berichteter Schwerpunkt; MCP-Erweiterung bleibt unbestätigt |
| Offene Gewichte | Ja | Ja, V4-Pro-0813-Gewichte verfügbar | Möglich für einen separaten V4.1-Checkpoint; unbestätigt |
| Offizieller Status | Öffentliche Beta-API-Veröffentlichung | GA | Kein offizielles Veröffentlichungsdatum oder Model Card |
Was könnte in DeepSeek-V4.1 neu sein?
Stärkeres agentisches Coding ohne größeres Modell
Der stärkste Hinweis darauf, was nach V4 kommt, ist jetzt das V4-Pro-0813-GA-Update. DeepSeek sagt, die Agent-Fähigkeit habe sich in produktiven Umgebungen erheblich verbessert, mit Terminal Bench 2.1 bei 87,9, NL2Repo bei 61,5 und DeepSWE bei 62,7. V4-Flash-0731 hatte bereits gezeigt, dass allein durch erneutes Post-Training große Agent-Gewinne erzielt werden können, ohne die Modellarchitektur oder -größe zu ändern.
Wenn V4.1 ein Mid-Cycle-Update ist, ist das realistische Ziel nicht mehr einfach „besser als V4 Preview“. Es müsste die V4-Pro-0813-Agent-Basis bewahren oder übertreffen und gleichzeitig die Ausführung über lange Zeithorizonte, Zuverlässigkeit auf Repository-Ebene, Tool-Orchestrierung und Produktionskonsistenz verbessern.
Bessere Tool-Nutzung und vollständigere Agent-APIs
DeepSeeks aktueller V4-Stack bietet bereits für Flash und Pro Responses-API-Unterstützung und ist speziell für Codex adaptiert. Die Kompatibilitätstabelle der Responses API unterstützt Funktionsaufrufe und serverseitige Websuche, während file_search, code_interpreter, computer_use und MCP-Tooltypen weiterhin ignoriert werden. Das macht eine breitere Enterprise-Tool-Abdeckung zu einer klareren V4.1-Chance als einfach die Responses API selbst hinzuzufügen.
Native MCP-Unterstützung ist weiterhin eine plausible Upgrade-Richtung, bleibt aber unbestätigt. Eine vertretbare V4.1-These ist eine tiefere Enterprise- und Agent-Integration auf einer API-Oberfläche, die bereits Responses, Codex-orientierte Workflows, strukturierte Ausgabe und Tool-Calls unterstützt.
Multimodale Eingabe könnte das größte Produkt-Upgrade sein
The Information berichtete, dass V4.1 mit multimodaler Unterstützung geplant war. Dies bleibt der klarste mögliche Produkt-Differenzierer, da die aktuelle DeepSeek Responses API sagt, Bild- und Dateieingaben werden nicht unterstützt. Wenn ein zukünftiger V4.1-Checkpoint native visuelle oder Datei-Verständnis-Fähigkeiten hinzufügt, würde er DeepSeek in Dokument-, Screenshot- und visuelle Programmier-Workflows erweitern, die die aktuelle textbasierte API nicht abdeckt.
Solange DeepSeek keine V4.1-Model Card oder API-Schema veröffentlicht, sollten die genauen Modalitäten, Auflösungsgrenzen, Audio-/Video-Verhalten und multimodalen Benchmarks weiterhin als unbekannt gekennzeichnet bleiben.
Spitzenleistung zu DeepSeek-üblichen Kosten
Niedrige Inferenzkosten bleiben eine der am stärksten differenzierten Stärken von DeepSeek, aber die offiziellen Preise haben sich mit dem vollständigen V4-Rollout geändert. Die aktuelle Preistabelle verwendet Peak-/Off-Peak-Tarife: V4-Flash Cache-Miss-Eingabe kostet $0.22 Off-Peak / $0.44 Peak und Ausgabe $0.66 / $1.32 pro 1M Token; V4-Pro Eingabe kostet $0.66 / $1.32 und Ausgabe $1.98 / $3.96. Off-Peak-Tarife betragen die Hälfte der Peak-Tarife.
Erwartete Benchmark-Performance von DeepSeek-V4.1
Es gibt weiterhin keine offiziellen V4.1-Benchmarkwerte. Die stärkste aktuelle V4-Familien-Basis ist jetzt DeepSeek-V4-Pro-0813 GA, das die Pro Preview als Referenzpunkt für Agent-Performance ersetzt. DeepSeek meldet 87,9 auf Terminal Bench 2.1, 61,5 auf NL2Repo, 83,3 auf Cybergym, 62,7 auf DeepSWE und 74,1 auf Toolathlon-Verified, zusammen mit Zugewinnen auf AutomationBench und DSBench.

Abbildung 6. Offizielle Agent-Benchmark-Werte von DeepSeek-V4-Pro-0813 GA, visualisiert aus dem DeepSeek-Änderungsprotokoll.
| Benchmark | V4-Pro-0813 | V4-Flash-0731 | V4-Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 87.9 | 82.7 | 72.1 |
| NL2Repo | 61.5 | 54.2 | 38.5 |
| Cybergym | 83.3 | 76.7 | 52.7 |
| DeepSWE | 62.7 | 54.4 | 12.8 |
| Toolathlon-Verified | 74.1 | 70.3 | 55.9 |
| Agents' Last Exam | 25.7 | 25.2 | 16.5 |
| AutomationBench (Public) | 31.8 | 25.1 | 12.8 |
| DSBench-FullStack | 71.1 | 68.7 | — |
| DSBench-Hard | 67.2 | 59.6 | — |

Abbildung 7. V4-Pro-0813 gegenüber V4-Flash-0731 auf gemeinsamen Agent-Benchmarks. Die Werte stammen aus dem DeepSeek-Änderungsprotokoll; Harness- und Reasoning-Einstellungen können Vergleiche zwischen Modellen beeinflussen.
Die Entwicklung legt drei evidenzbasierte Erwartungen für V4.1 nahe. Erstens sollte ein bedeutender V4.1-Release zumindest die V4-Pro-0813-GA-Basis bewahren, nicht nur die alte Preview übertreffen. Zweitens schöpft DeepSeek weiterhin Zugewinne durch Post-Training und Agent-Optimierung, statt ausschließlich die Parameterzahl zu skalieren. Drittens könnte das wertvollste V4.1-Upgrade eine breitere multimodale und Enterprise-Tool-Fähigkeit sein, wenn die Kern-Agent-Performance bereits nahe der Obergrenze des V4-Designs liegt.
DeepSeek-V4.1 vs V4-Flash vs V4-Pro
| Dimension | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 erwartet |
|---|---|---|---|
| Positionierung | Schnelles, effizientes Agent-/Coding-Modell | Aktuelles höherfähiges V4 Reasoning-/Agent-Modell | Mögliches Mid-Cycle-V4-Fähigkeitsupgrade |
| Skalierung | 284B gesamt / 13B aktiv | 1.6T gesamt / 49B aktiv | Unbekannt |
| Kontext | 1M | 1M | Wahrscheinlich mindestens 1M, wenn V4-abgeleitet |
| Agent-Coding | Sehr stark nach 0731 Post-Training | Stärkste aktuelle V4-offizielle Agent-Basis | Erwartet, Pro-GA-Basis zu erreichen oder zu übertreffen |
| Denkaufwand | Niedrig / hoch / max | Niedrig / hoch / max | Erwartet, Controls beizubehalten oder zu erweitern |
| Responses API | Unterstützt | Unterstützt | Erwartet, wenn auf aktuellem V4-Stack |
| Multimodale Eingabe | Keine Bild-/Dateieingabe in der aktuellen Responses API | Keine Bild-/Dateieingabe in der aktuellen Responses API | Berichtete Möglichkeit; unbestätigt |
| Offizielle API-Kosten | Niedrigere V4-Stufe; Peak-/Off-Peak-Pricing | Höhere V4-Stufe; Peak-/Off-Peak-Pricing | Unbekannt |
| Status | Offizielle API-Veröffentlichung in öffentlicher Beta | GA | Von DeepSeek nicht angekündigt |
Wofür wird DeepSeek-V4.1 verwendet werden?
Wenn die berichtete Richtung zutrifft, wäre V4.1 am überzeugendsten dort, wo die aktuelle V4-Familie bereits stark ist, aber noch breitere Produktfähigkeiten fehlt.
- Repository-scale Coding Agents. Langkontext-Codeverständnis, Patch-Erzeugung, Testschleifen und Terminal-Ausführung sind der klarste Fit angesichts der Agent-Zugewinne von V4-Pro-0813 und Flash-0731.
- Enterprise-Forschung und Dokument-Workflows. Eine 1M-Kontext-Basis, Responses-API-Unterstützung und Web-/Tool-Integration können große interne Wissensbestände, Richtlinienkorpora und technische Dokumentationen unterstützen. V4.1 würde hier nützlicher, wenn reichere Retrieval- oder Datei-Tools hinzukämen.
- Kostensensitive autonome Agents. V4-Flash bleibt besonders attraktiv für wiederholte Planungs- und Tool-Call-Schleifen, während V4-Pro eine höherfähige Stufe bietet. V4.1 wäre überzeugend, wenn diese Kostendisziplin gewahrt wird.
- Visuelle Dokument- und Screenshot-Analyse. Dies wird nur dann ein großer nativer Use Case, wenn die berichtete multimodale Fähigkeit offiziell geliefert wird.
- Private oder kundenspezifische Deployments. DeepSeek hat V4-Pro-0813 und V4-Flash-0731 Gewichte veröffentlicht, daher könnte ein separat veröffentlichter V4.1-Checkpoint für Organisationen attraktiv bleiben, die Self-Hosting oder Domain-Adaption benötigen. Die Verfügbarkeit offener Gewichte für V4.1 selbst ist nicht bestätigt.
Was wir noch nicht wissen
Die größte Gefahr beim Schreiben eines „Coming Soon“-Artikels ist, plausible Extrapolation in falsche Spezifikation zu verwandeln. Diese Punkte sollten ausdrücklich offen bleiben, bis DeepSeek Material aus erster Hand veröffentlicht:
- Ob „DeepSeek-V4.1“ der offizielle Modellname sein wird.
- Ob V4.1 ein eigener Checkpoint ist oder ein separates Label für Verbesserungen über V4-Flash-0731 und V4-Pro-0813 hinaus.
- Gesamtzahl der Parameter, aktivierte Parameter und etwaige Architekturänderungen.
- Exakte multimodale Eingaben und ob Bild, Audio, Video oder Dateien unterstützt werden.
- Native MCP-, computer_use-, file_search- oder code_interpreter-Unterstützung.
- Offizielle Benchmark-Werte und Evaluierungseinstellungen.
- API-Pricing, Verfügbarkeit offener Gewichte und kommerzielle Bedingungen für einen separaten V4.1-Checkpoint. Ein festes Veröffentlichungsdatum.
Abschließende Gedanken
DeepSeek-V4.1 ist gerade deshalb interessant, weil der aktuelle V4-Zyklus zeigt, dass DeepSeek die Familie materiell stärken kann, ohne eine völlig neue Architektur einzuführen. Das Flash-0731-Post-Training-Update lieferte große Agent-Zugewinne, und der Pro-0813-GA-Release hob diese Basis erneut an, während er native Responses-API-Unterstützung und flexiblere Denkaufwandsstufen hinzufügte.
Die glaubwürdigste V4.1-These ist daher nicht „ein mysteriöses neues Billionen-Parameter-Modell“. Es ist ein reiferes V4: stärkere produktive Agent-Ausführung, breiteres Enterprise-Tooling, möglicherweise native multimodale Eingabe und ein engeres Gleichgewicht zwischen Flash-Effizienz und Reasoning auf Pro-Niveau. Die zentrale Ungewissheit ist, ob DeepSeek diese Verbesserungen überhaupt unter dem Namen V4.1 ausliefert.
Entwickler können DeepSeek V4 Flash und DeepSeek V4 Pro bereits über CometAPI testen, während die DeepSeek V4.1-Seite genutzt werden kann, um die CometAPI-Verfügbarkeit zu verfolgen, falls ein separates Modell nutzbar wird. CometAPI bietet eine einheitliche API-Schicht zum Vergleich von DeepSeek mit anderen Frontier-Modellen, ohne die Integration für jeden Anbieter neu aufzubauen.
