DeepSeek V4 Pro est officiellement disponible : tout ce que les développeurs doivent savoir
DeepSeek V4 Pro 0813 est désormais généralement disponible. Voici ce qui a changé, comment y accéder, combien ça coûte et comment l'évaluer en toute sécurité.

DeepSeek a enfin levé la plus grande ambiguïté autour de son modèle phare V4. Le 13 août 2026, l'entreprise a fait passer DeepSeek-V4-Pro de l'aperçu à la disponibilité générale sur son application, son expérience web et son API. Les développeurs qui appellent deepseek-v4-pro reçoivent désormais la version mise à jour V4-Pro-0813 sans changer le nom du modèle existant ni l'URL de base.
Cela ressemble à une mise à jour de version de routine. Ce n'est pas le cas. Cette version fait passer le V4 Pro d'un modèle qui vaut la peine d'être expérimenté à un modèle que les équipes d'ingénierie peuvent sérieusement évaluer pour les agents de codage, les flux de travail de recherche, les assistants utilisant des outils et l'automatisation à long contexte. Elle arrive également avec une nouvelle API Responses, un contrôle plus explicite sur l'effort de raisonnement, et un changement de tarification de l'API prévu pour le 16 août.
Ce guide distingue ce que DeepSeek a officiellement confirmé de ce que les développeurs doivent encore prouver dans leurs propres environnements. Toutes les références concernant l'état du produit et les prix ont été vérifiées par rapport à la documentation officielle de DeepSeek le 14 août 2026.
Ce que DeepSeek a réellement publié
Le premier point est le plus simple et le plus important : DeepSeek-V4-Pro est désormais en disponibilité générale (GA) , pas « bientôt disponible » et pas simplement une version préliminaire. DeepSeek indique que la version GA a été déployée sur l'application, l'interface web et l'API. La version du modèle publiée par l'API est DeepSeek-V4-Pro-0813.
La méthode d'appel reste stable :
SORTIE UNIQUEMENT TRADUCTION :
model: "deepseek-v4-pro"
L'URL de base compatible OpenAI reste https://api.deepseek.com, tandis qu'un point de terminaison compatible Anthropic est également disponible. Cette continuité est importante car elle réduit le travail de migration, mais elle n'élimine pas la nécessité de tests de régression. Un nouveau modèle derrière un alias inchangé peut produire des plans, des arguments d'outils, des correctifs de code et des niveaux de verbosité différents.
Le [journal des modifications officiel] de DeepSeek attribue les plus grandes améliorations à l'utilisation d'agents dans des environnements de production. Il publie les scores pour Terminal Bench 2.1, NL2Repo, Cybergym, DeepSWE, Toolathlon-Verified, AutomationBench et d'autres évaluations. Ces chiffres sont des signaux utiles, mais ce sont des résultats rapportés par le fournisseur. Traitez-les comme des hypothèses pour votre propre suite de tests, et non comme des garanties.
Les trois changements que les développeurs remarqueront
Prise en charge de l'API Native Responses
V4 Pro prend désormais en charge une interface de type API Responses d'OpenAI. Pour les équipes qui construisent des agents, c'est plus conséquent qu'un autre point de référence. Une API orientée réponse peut fournir une base plus propre pour les appels d'outils, l'exécution en plusieurs étapes et les boucles d'agents structurées qu'un simple transcript de chat.
La compatibilité ne doit toutefois pas être interprétée comme une équivalence comportementale parfaite. Testez les événements en streaming, les charges utiles d'appels d'outils, les objets d'erreur, les rapports d'utilisation, l'annulation et l'état multi-tour avant de remplacer un fournisseur existant. Un SDK qui accepte la requête n'est que le début ; la compatibilité en production dépend du cycle de vie complet.
Effort de réflexion faible, élevé et maximal
DeepSeek V4 Pro et V4 Flash exposent désormais trois niveaux d'effort de raisonnement : low, high et max. Les directives officielles positionnent low pour les tâches simples, high pour les tâches d'agent quotidiennes et max pour les scénarios les plus difficiles.
Il est préférable de traiter cela comme une décision de routage plutôt qu'une préférence. Un faible effort peut réduire la latence et la consommation de jetons pour l'extraction, la classification ou les transformations simples. Un effort élevé est un candidat raisonnable pour une révision de code normale et de la recherche. Le niveau maximal doit être réservé aux tâches où une exploration plus approfondie améliore de manière démontrable le taux d'achèvement. Si le niveau maximal ne fait que produire une réponse plus longue, il ne crée pas de valeur.
Un nouveau barème de prix approche
À compter du 14 août, les tarifs actuellement affichés restent en vigueur. DeepSeek a annoncé que la tarification heures pleines/heures creuses débutera à 16h00 UTC le 16 août 2026. Les tarifs heures creuses seront la moitié des tarifs heures pleines correspondants. Ne publiez pas le tableau futur comme s'il était déjà actif.
Les prix programmés du V4 Pro par million de tokens sont de 0,022 $/0,044 $ pour l'entrée en cache, 0,66 $/1,32 $ pour l'entrée non mise en cache et 1,98 $/3,96 $ pour la sortie, avec les tarifs hors pointe indiqués en premier. Confirmez la page des tarifs en direct avant de déployer ou de budgétiser, car les prix sont des données opérationnelles et peuvent changer.
Ce qui est resté le même
Le nom public du modèle et les URL de base principales n'ont pas changé. V4 Pro continue d'offrir une fenêtre de contexte publiée de 1 million de tokens, jusqu'à 384 000 tokens de sortie maximum, une sortie JSON, l'appel d'outils, la complétion avec préfixe de chat et la complétion FIM sans réflexion. Il s'agit de limites de capacité et de déclarations de fonctionnalités, et non de promesses que chaque application doit utiliser le maximum.
Un prompt d’un million de tokens peut être coûteux, lent et plus difficile à raisonner qu’un contexte plus petit bien récupéré. Une sortie de 384K peut échouer tardivement, créer un artéfact non vérifiable ou consommer beaucoup plus de budget qu’un flux de travail par étapes. La question pratique n’est pas « L’API peut-elle accepter autant ? » mais « Le fait d’utiliser autant améliore-t-il la réussite de la tâche ? »
Un plan de mise à niveau sécurisé
Commencez par épingler un ensemble d'évaluation représentatif. Incluez des tâches courantes, des tâches difficiles, des entrées mal formées, des échecs d'outils et quelques cas coûteux à contexte long. Enregistrez l'ancienne sortie avant de changer l'alias, puis comparez la nouvelle version sur :
- achèvement de bout en bout des tâches ;
- arguments d'outil valides ;
- code qui passe les tests ;
- latence aux 50e et 95e percentiles ;
- jetons d'entrée, d'entrée en cache et de sortie ;
- temps de révision humaine ;
- actions dangereuses ou inutiles.
Ensuite, utilisez un déploiement limité. Envoyez un faible pourcentage du trafic vers V4 Pro 0813, conservez une solution de repli et enregistrez la version du modèle ou l'empreinte système dès que possible. Les systèmes agents doivent exiger une confirmation avant les opérations destructrices sur les fichiers, les écritures en base de données, les déploiements, les achats ou les messages sortants.
Enfin, révisez les invites. Les modèles qui raisonnent différemment peuvent ne pas nécessiter la même structure. Des invites trop prescriptives peuvent empêcher un modèle plus performant de planifier efficacement, tandis que des invites vagues peuvent permettre une exploration inutile. Réduisez les instructions uniquement après que votre évaluation montre que cela préserve la fiabilité.
Qui devrait mettre à niveau maintenant ?
Les équipes qui évaluent déjà la version préliminaire de V4 Pro devraient basculer leur comparaison vers la version GA ; sinon, elles testent le produit d'hier. Les développeurs d'agents de codage devraient lui accorder la priorité, car la performance des agents est au cœur de cette version. Les organisations utilisant de grands ensembles de documents peuvent également en bénéficier, à condition de tester une récupération efficace plutôt que de se fier uniquement à la taille du contexte.
Les équipes ayant des charges de travail de production stables n'ont pas besoin d'une bascule du jour au lendemain. Si Flash répond déjà aux exigences de qualité, le prix futur plus élevé de Pro pourrait ne pas améliorer l'économie. De même, les flux de travail réglementés nécessitent un examen de la confidentialité, de la conservation, des aspects régionaux et contractuels au-delà de la qualité du modèle.
Pour les créateurs et les utilisateurs professionnels qui préfèrent expérimenter avant d'intégrer une API, Elser AI peut être un endroit pratique pour explorer les flux de travail assistés par l'IA et clarifier quelles étapes nécessitent réellement un modèle de pointe. L'objectif n'est pas de forcer chaque tâche à passer par la version la plus récente ; il s'agit d'identifier où un meilleur raisonnement crée un résultat mesurable.
FAQ
DeepSeek V4 Pro est-il officiellement publié ?
Oui. DeepSeek a annoncé la disponibilité générale le 13 août 2026, sur l'application, le web et l'API. La version documentée de l'API est V4-Pro-0813.
Ai-je besoin d'un nouveau nom de modèle ?
Non. La consigne officielle est de continuer à utiliser deepseek-v4-pro. Vous devez toujours exécuter les tests de régression car le modèle derrière l'alias a changé.
Est-ce que V4 Flash est aussi en disponibilité générale ?
Pas selon la documentation du 14 août. V4-Flash-0731 est décrit comme une version bêta publique, tandis que V4 Pro est en disponibilité générale.
Le nouveau tarif heures pleines/heures creuses est-il actif aujourd'hui ?
Non. DeepSeek indique que cela prend effet à 16h00 UTC le 16 août 2026. Consultez la page des tarifs au moment où vous lisez ceci.
Sources et Vérification
Cet article utilise le journal des modifications de l'API officielle de DeepSeek, la documentation sur les modèles et les tarifs, ainsi que les supports de la version V4 comme sources principales. Les étiquettes des produits sont conservées intentionnellement : V4 Pro 0813 est en disponibilité générale, tandis que V4 Flash 0731 est décrit comme étant en bêta publique à la date de vérification. Les chiffres des benchmarks sont identifiés comme étant fournis par le vendeur et non présentés comme des résultats indépendants d'Elser AI. Les tarifs programmés sont qualifiés de futurs jusqu'à leur heure d'activation annoncée. Les lecteurs prenant des décisions de production ou d'achat doivent revérifier la documentation en direct, car les alias de modèles, les prix, les limites de débit, le statut bêta et le comportement des fonctionnalités peuvent changer après la publication. Une évaluation indépendante sur des tâches représentatives reste nécessaire.
Conclusion
DeepSeek V4 Pro 0813 est une version significative orientée production : distribution GA, meilleure performance des agents revendiquée, prise en charge native de l'API Responses et contrôles explicites de l'effort de raisonnement. La réponse intelligente n'est ni une migration instantanée ni un scepticisme réflexe. Testez-la sur du travail réel, mesurez les résultats réussis plutôt que les titres des benchmarks, conservez des solutions de repli et calculez le coût selon le barème tarifaire du 16 août. C'est ainsi qu'un nouveau produit phare devient une décision technique plutôt qu'un événement médiatique.







































































