La famiglia V4 di DeepSeek ha ormai superato la fase di anteprima iniziale. DeepSeek V4 Flash è entrato in beta pubblica come V4-Flash-0731 il 31 luglio, mentre DeepSeek V4 Pro ha raggiunto la GA come V4-Pro-0813 il 13 agosto su APP, Web e API. I due modelli mantengono il design del contesto da un milione di token e l’architettura MoE della famiglia V4, con Flash ottimizzato per l’efficienza e Pro posizionato come modello di ragionamento e Agent a maggiore capacità.
Il rilascio GA di Pro alza in modo sostanziale la base per qualsiasi previsione su V4.1. DeepSeek afferma che la build GA porta capacità Agent significativamente potenziate, in particolare in ambienti di produzione, e ora conferisce a V4-Pro e V4-Flash il supporto nativo alla Responses API più livelli di sforzo di ragionamento low, high e max. L’attuale versione del modello API è esplicitamente indicata come DeepSeek-V4-Pro-0813. Quindi dove si colloca ora DeepSeek V4.1? Il report di maggio di The Information ha indicato che DeepSeek pianificava un rilascio di V4.1 a giugno con strumenti enterprise più solidi e supporto multimodale. Quella finestra è passata e l’attuale registro di rilascio di DeepSeek non contiene ancora alcuna scheda modello o voce di rilascio per V4.1. L’interpretazione più prudente è quindi una possibile iterazione V4 post-GA i cui obiettivi riportati potrebbero ancora arrivare sotto il nome V4.1 o tramite ulteriori aggiornamenti V4.

Le tappe confermate utilizzano il change log di DeepSeek; il piano V4.1 di giugno precedente proviene da The Information.
Che cos’è DeepSeek-V4.1?
DeepSeek-V4.1 va compreso come un’iterazione V4 post-GA non confermata, non come un modello DeepSeek ufficialmente rilasciato. La famiglia V4 ha già un checkpoint Pro di produzione in V4-Pro-0813, quindi V4.1 rappresenterebbe ora un aggiornamento di metà ciclo delle capacità piuttosto che il passo necessario a completare il rollout V4 originale. DeepSeek non ha pubblicato una scheda modello, un report tecnico, un changelog API o una tabella di benchmark per V4.1.
| Domanda | Risposta attuale | Attendibilità |
|---|---|---|
| DeepSeek ha annunciato ufficialmente “V4.1”? | No. L’attuale registro di rilascio DeepSeek non ha alcuna voce o scheda modello V4.1. | Alta |
| È stato riportato un rilascio V4.1? | Sì. The Information ha riportato un piano di giugno con strumenti enterprise e supporto multimodale. | Media |
| La finestra di giugno riportata si è concretizzata? | Non è apparso alcun rilascio ufficiale separato di V4.1 durante quella finestra. | Alta |
| Qual è l’ultima tappa V4 confermata? | V4-Flash-0731 è entrato in beta pubblica il 31 luglio e V4-Pro-0813 ha raggiunto la GA il 13 agosto. | Alta |
| V4.1 potrebbe ancora essere lanciato come modello separato? | Sì, ma nome, specifiche e tempistiche restano non confermati. | Bassa/Media |
Specifiche attese di DeepSeek-V4.1
Poiché DeepSeek non ha pubblicato specifiche di V4.1, la tabella seguente separa le capacità V4 attuali confermate dalle aspettative direzionali. “Atteso” significa una prosecuzione ragionevole di V4 o una capacità riportata dai media, non una specifica ufficiale di V4.1.
| Dimensione | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 (atteso) |
|---|---|---|---|
| Famiglia di modelli | V4 | V4 | Iterazione probabilmente della famiglia V4 |
| Architettura | MoE con attenzione ibrida derivata da V4 | MoE derivata da V4; GA costruita sulla struttura Preview | Probabilmente derivata da V4; non confermato |
| Parametri totali / attivi | 284B / 13B | 1.6T / 49B | Sconosciuto; nessun dato pubblico affidabile |
| Finestra di contesto | 1M | 1M | Probabilmente almeno la base V4 |
| Output massimo | 384K massimo API | 384K massimo API | Sconosciuto |
| Sforzo di ragionamento | Low / high / max | Low / high / max | Atteso mantenere o estendere i controlli attuali |
| Responses API | Supportato | Supportato | Atteso se costruito sull’attuale stack API V4 |
| Input nativo di immagini/file | Non supportato nell’attuale Responses API | Non supportato nell’attuale Responses API | Direzione multimodale riportata; non confermata |
| Strumenti Enterprise/Agent | Funzioni, ricerca web, apply_patch / supporto Codex | Funzioni, ricerca web, apply_patch / supporto Codex | Area di enfasi riportata; l’espansione MCP resta non confermata |
| Pesi aperti | Sì | Sì, pesi di V4-Pro-0813 disponibili | Possibile per un checkpoint V4.1 separato; non confermato |
| Stato ufficiale | Rilascio API in beta pubblica | GA | Nessuna data di rilascio o scheda modello ufficiale |
Cosa potrebbe essere nuovo in DeepSeek-V4.1?
Coding agentico più forte senza un modello più grande
La prova più forte di ciò che segue V4 è ora l’aggiornamento GA di V4-Pro-0813. DeepSeek afferma che la capacità Agent è migliorata sostanzialmente negli ambienti di produzione, con Terminal Bench 2.1 a 87.9, NL2Repo a 61.5 e DeepSWE a 62.7. V4-Flash-0731 aveva già mostrato che il solo post-training poteva produrre grandi incrementi Agent senza modificare architettura o dimensioni del modello.
Se V4.1 è un aggiornamento di metà ciclo, l’obiettivo realistico non è più semplicemente “meglio della Preview V4”. Dovrebbe preservare o superare la base Agent di V4-Pro-0813 migliorando l’esecuzione software a lungo orizzonte, l’affidabilità a livello di repository, l’orchestrazione degli strumenti e la coerenza in produzione.
Miglior uso degli strumenti e API Agent più complete
L’attuale stack V4 di DeepSeek offre già a Flash e Pro il supporto della Responses API ed è specificamente adattato a Codex. La tabella di compatibilità della Responses API supporta le chiamate di funzione e la ricerca web lato server, mentre i tipi di strumenti file_search, code_interpreter, computer_use e MCP sono ancora ignorati. Ciò rende una copertura più ampia degli strumenti enterprise un’opportunità più chiara per V4.1 rispetto al semplice aggiungere la Responses API stessa.
Il supporto nativo MCP resta una direzione plausibile di upgrade, ma non è confermato. Una tesi difendibile per V4.1 è un’integrazione più profonda Enterprise e Agent sopra una superficie API che già supporta Responses, workflow orientati a Codex, output strutturato e chiamate a strumenti.
L’input multimodale potrebbe essere il maggiore upgrade a livello di prodotto
The Information ha riportato che V4.1 era pianificato con supporto multimodale. Questo resta il possibile differenziatore a livello di prodotto più evidente perché l’attuale Responses API di DeepSeek indica che gli input immagine e file non sono supportati. Se un futuro checkpoint V4.1 aggiungesse comprensione nativa visiva o dei file, espanderebbe DeepSeek verso workflow di documenti, screenshot e coding visivo che l’attuale API solo testo non copre.
Finché DeepSeek non pubblica una scheda modello o uno schema API per V4.1, le esatte modalità, i limiti di risoluzione, il comportamento audio/video e i benchmark multimodali dovrebbero restare etichettati come sconosciuti.
Prestazioni di frontiera al costo tipico di DeepSeek
Un basso costo di inferenza resta uno dei punti di forza più differenziati di DeepSeek, ma i prezzi ufficiali sono cambiati con il rollout completo di V4. L’attuale tabella prezzi usa tariffe peak/off-peak: l’input con cache miss di V4-Flash è $0.22 off-peak / $0.44 peak e l’output è $0.66 / $1.32 per 1M token; l’input di V4-Pro è $0.66 / $1.32 e l’output è $1.98 / $3.96. Le tariffe off-peak sono pari alla metà di quelle peak.
Prestazioni attese nei benchmark di DeepSeek-V4.1
Non ci sono ancora punteggi ufficiali di benchmark per V4.1. La base attuale più forte della famiglia V4 è ora DeepSeek-V4-Pro-0813 GA, che sostituisce la Preview Pro come punto di riferimento per le prestazioni Agent. DeepSeek riporta 87.9 su Terminal Bench 2.1, 61.5 su NL2Repo, 83.3 su Cybergym, 62.7 su DeepSWE e 74.1 su Toolathlon-Verified, insieme a incrementi su AutomationBench e DSBench.

Figura 6. Valori ufficiali dei benchmark Agent di DeepSeek-V4-Pro-0813 GA, visualizzati dal change log di DeepSeek.
| Benchmark | V4-Pro-0813 | V4-Flash-0731 | V4-Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 87.9 | 82.7 | 72.1 |
| NL2Repo | 61.5 | 54.2 | 38.5 |
| Cybergym | 83.3 | 76.7 | 52.7 |
| DeepSWE | 62.7 | 54.4 | 12.8 |
| Toolathlon-Verified | 74.1 | 70.3 | 55.9 |
| Agents' Last Exam | 25.7 | 25.2 | 16.5 |
| AutomationBench (Public) | 31.8 | 25.1 | 12.8 |
| DSBench-FullStack | 71.1 | 68.7 | — |
| DSBench-Hard | 67.2 | 59.6 | — |

Figura 7. V4-Pro-0813 rispetto a V4-Flash-0731 su benchmark Agent comuni. I valori provengono dal change log di DeepSeek; il framework e le impostazioni di ragionamento possono influire sui confronti tra modelli.
La progressione suggerisce tre aspettative basate su evidenze per V4.1. Primo, un rilascio V4.1 significativo dovrebbe almeno preservare la base GA di V4-Pro-0813, non semplicemente battere la vecchia Preview. Secondo, DeepSeek sta ancora estraendo guadagni attraverso post-training e ottimizzazione Agent piuttosto che solo scalando il numero di parametri. Terzo, l’upgrade più prezioso di V4.1 potrebbe essere una capacità multimodale e di strumenti enterprise più ampia se le prestazioni core degli Agent sono già vicino al massimo del design V4.
DeepSeek-V4.1 vs V4-Flash vs V4-Pro
| Dimensione | V4-Flash-0731 | V4-Pro-0813 | DeepSeek-V4.1 atteso |
|---|---|---|---|
| Posizionamento | Modello Agent/coding veloce ed efficiente | Attuale modello V4 di ragionamento/Agent a maggiore capacità | Possibile upgrade di capacità di metà ciclo V4 |
| Scala | 284B totali / 13B attivi | 1.6T totali / 49B attivi | Sconosciuto |
| Contesto | 1M | 1M | Probabilmente almeno 1M se derivato da V4 |
| Coding Agent | Molto forte dopo il post-training 0731 | Baseline Agent ufficiale V4 attuale più forte | Atteso soddisfare o superare la baseline Pro GA |
| Sforzo di ragionamento | Low / high / max | Low / high / max | Atteso mantenere o estendere i controlli |
| Responses API | Supportato | Supportato | Atteso se costruito sull’attuale stack V4 |
| Input multimodale | Nessun input immagine/file nell’attuale Responses API | Nessun input immagine/file nell’attuale Responses API | Possibilità riportata; non confermata |
| Costo API ufficiale | Livello V4 inferiore; prezzi peak/off-peak | Livello V4 superiore; prezzi peak/off-peak | Sconosciuto |
| Stato | Rilascio API ufficiale in beta pubblica | GA | Non annunciato da DeepSeek |
A cosa servirà DeepSeek-V4.1?
Se la direzione riportata si conferma, V4.1 sarebbe più interessante dove l’attuale famiglia V4 è già forte ma manca ancora di capacità di prodotto più ampie.
1. Agent di coding a scala repository. Comprensione del codice con contesti lunghi, generazione di patch, cicli di test ed esecuzione in terminale sono l’abbinamento più chiaro dato i guadagni Agent di V4-Pro-0813 e Flash-0731.
2. Ricerca enterprise e workflow documentali. Una base di contesto da 1M, supporto della Responses API e integrazione web/strumenti possono supportare ampi set di conoscenza interni, corpora di policy e documentazione tecnica. V4.1 diventerebbe più utile qui se aggiungesse recupero più ricco o tooling sui file.
3. Agent autonomi sensibili al costo. V4-Flash resta particolarmente attraente per loop ripetuti di pianificazione e chiamate a strumenti, mentre V4-Pro offre un livello di capacità superiore. V4.1 sarebbe interessante se preservasse questa disciplina dei costi.
4. Analisi di documenti visivi e screenshot. Questo diventa un caso d’uso nativo importante solo se la capacità multimodale riportata viene consegnata formalmente.
5. Deployment privati o personalizzati. DeepSeek ha rilasciato i pesi di V4-Pro-0813 e V4-Flash-0731, quindi un checkpoint V4.1 rilasciato separatamente potrebbe restare interessante per organizzazioni che necessitano di self-hosting o adattamento di dominio. La disponibilità di pesi open per V4.1 stesso non è confermata.
Cosa non sappiamo ancora
Il rischio maggiore nello scrivere un articolo “in arrivo” è trasformare l’estrapolazione plausibile in specifiche fittizie. Questi punti dovrebbero restare esplicitamente aperti finché DeepSeek non pubblica materiale di prima parte:
- Se “DeepSeek-V4.1” sarà il nome ufficiale del modello.
- Se V4.1 è un checkpoint distinto o un’etichetta separata per miglioramenti oltre V4-Flash-0731 e V4-Pro-0813.
- Numero totale di parametri, numero di parametri attivati e qualsiasi cambiamento architetturale.
- Esatti input multimodali e se immagini, audio, video o file sono supportati.
- Supporto nativo MCP, computer-use, file-search o code-interpreter.
- Punteggi di benchmark ufficiali e impostazioni di valutazione.
- Prezzi API, disponibilità dei pesi open e termini commerciali per un checkpoint V4.1 separato. Una data di rilascio certa.
Considerazioni finali
DeepSeek-V4.1 è interessante proprio perché l’attuale ciclo V4 mostra che DeepSeek può rendere la famiglia sostanzialmente più forte senza introdurre un’architettura completamente nuova. L’aggiornamento di post-training Flash-0731 ha fornito grandi guadagni Agent e il rilascio GA Pro-0813 ha spinto ancora più in alto quella baseline aggiungendo il supporto nativo alla Responses API e livelli di sforzo di ragionamento più flessibili.
La tesi più credibile per V4.1 non è quindi “un misterioso nuovo modello da trilioni di parametri”. È un V4 più maturo: esecuzione Agent di produzione più solida, strumenti enterprise più ampi, potenzialmente input multimodale nativo e un equilibrio più stretto tra l’efficienza di Flash e il ragionamento di livello Pro. L’incertezza centrale è se DeepSeek rilascerà tali miglioramenti sotto il nome V4.1.
Gli sviluppatori possono già testare DeepSeek V4 Flash e DeepSeek V4 Pro tramite CometAPI, mentre la pagina DeepSeek V4.1 può essere usata per tracciare la disponibilità su CometAPI se un modello separato diventasse attivabile. CometAPI fornisce un livello API unificato per confrontare DeepSeek con altri modelli di frontiera senza ricostruire l’integrazione per ciascun provider.
