
qu'est-ce qui a changé dans la mise à jour Deepseek V4 Pro 0813, spécifications officielles et tarification, modes de réflexion, modes de réflexion, diffusion en continu

DeepSeek V4 Pro est le modèle V4 le plus performant de DeepSeek pour le raisonnement, la programmation, l’analyse de contextes longs et les workflows d’agents.
DeepSeek V4 Flash 0731, avec des gains majeurs sur les benchmarks d’agents, la prise en charge de Responses API et de Codex, et une attention accrue portée à DeepSeek Harness.

Apprenez à connecter LibreChat à 500+ modèles d’IA avec CometAPI. Configurez le point de terminaison compatible OpenAI pour accéder à GPT 5.5, Claude 4-7 et DeepSeek V4.

DeepSeek V4 vs GPT-5.5 : DeepSeek V4 vs GPT-5.5 en 2026 : comparer les dernières versions officielles, les données de benchmark, le contexte. Disponible via CometAPI.

La manière pratique d’exécuter DeepSeek V4 en local consiste à utiliser les poids open source officiels avec une pile d’inférence haute performance telle que vLLM, puis à exposer le modèle via un point de terminaison local compatible OpenAI. Les documents publics actuels de DeepSeek décrivent deux modèles de la famille V4 : DeepSeek-V4-Pro avec 1.6T de paramètres au total / 49B actifs, et DeepSeek-V4-Flash avec 284B de paramètres au total / 13B actifs, tous deux avec un contexte de 1M de tokens et trois modes de raisonnement. Les exemples actuels de déploiement local de vLLM ciblent 8× B200/B300 pour Pro et 4× B200/B300 pour Flash. Si vous ne disposez pas de ce type de matériel, un recours hébergé comme CometAPI est la solution la plus pratique.

Pour les développeurs, cette combinaison est importante pour une raison simple : elle réduit les frictions de migration tout en augmentant le plafond de ce que vous pouvez créer. Vous n’avez pas à apprendre une nouvelle surface d’API. Vous mettez à jour le nom du modèle, conservez l’URL de base et livrez en tirant parti d’une fenêtre de contexte plus large avec des capacités de raisonnement plus récentes. La documentation officielle de DeepSeek indique explicitement de conserver l’URL de base et de changer le paramètre de modèle en deepseek-v4-pro ou deepseek-v4-flash.

DeepSeek-V4 est la nouvelle famille de modèles phares en préversion de DeepSeek, lancée officiellement le 24 avril 2026. Elle comprend DeepSeek-V4-Pro et DeepSeek-V4-Flash, qui prennent tous deux en charge un contexte de 1 million de jetons, exposent des API compatibles avec OpenAI et Anthropic, et sont disponibles dans l’application de DeepSeek, l’application mobile et l’API de CometAPI. Concrètement, Pro est le choix le plus performant pour le raisonnement complexe et le codage agentique, tandis que Flash est l’option plus rapide et plus économique pour les charges de travail à haut débit.