DeepSeek V4 Pro passe en GA : Bond de 5x sur DeepSWE et hausse de prix imminente

DeepSeek V4 Pro passe en GA : Bond de 5x sur DeepSWE et hausse de prix imminente

DeepSeekGrands Modèles de LangageAgent IATarification API

Sources:HN + web research

Un passage discret en version officielle à minuit

Le 13 août 2026 à 23h00, la page des modèles de la documentation API officielle de DeepSeek a été discrètement mise à jour, remplaçant l’identifiant du modèle par DeepSeek-V4-Pro-0813. DeepSeek n’a organisé aucun événement de lancement en ligne ni publié de campagne de teazing sur les réseaux sociaux. Malgré cela, cette mise à jour a rapidement grimpé en tête de Hacker News, accumulant 692 votes positifs et 246 commentaires de la communauté.

Cette stratégie de mise à niveau silencieuse réduit considérablement le coût de migration pour les intégrations existantes. Les développeurs n’ont pas besoin de modifier la logique de leur code lors des appels d’API, le système routant automatiquement les requêtes vers la version 0813 la plus récente. Les anciens identifiants comme deepseek-chat et deepseek-reasoner avaient déjà été retirés fin juillet, chacun étant respectivement associé aux modes sans réflexion et avec réflexion de l’architecture Flash. Cette mise en ligne en toute discrétion témoigne de la haute disponibilité atteinte par l’infrastructure API, qui n’a plus besoin d’éprouver la résilience de son système via des pics soudains de trafic marketing.

Capture d'écran de la page tarifaire officielle de DeepSeek Figure : Page officielle « Modèles et Tarifs » de DeepSeek, avec la version du modèle mise à jour vers DeepSeek-V4-Pro-0813. Source : Plateforme ouverte DeepSeek

Les benchmarks d’agents dépassent la version légère

En retraçant le calendrier de développement de la série V4, lors de l’annonce de la phase Preview en avril 2026, l’équipe officielle avait simultanément présenté la version Pro avec 1,6 billion (1.6T) de paramètres et la version Flash de 284 milliards (284B) de paramètres. Cependant, après l’entrée en GA du V4-Flash-0731 le 31 juillet, la version légère avait temporairement devancé la version Preview phare sur des benchmarks tels que Terminal Bench (82,7 contre 61,8). La sortie de cette version officielle 0813 réaffirme la supériorité des performances de la version Pro au sein de la gamme.

BenchmarkV4 Pro 0813V4 Pro PreviewFable 5
HLE (Sans outils / Avec outils)42.7 / 60.037.7 / 48.253.3 / 63.0
Terminal Bench 2.187.972.188.0
Cybergym83.352.783.1
DeepSWE62.712.870.0
DSBench-FullStack71.141.8

Selon les données officielles publiées, les capacités d’exécution d’agent de V4 Pro 0813 progressent de manière spectaculaire. Le score DeepSWE est notamment passé de 12,8 durant la phase Preview à 62,7, Terminal Bench 2.1 a grimpé de 72,1 à 87,9, et Cybergym a dépassé Fable 5 avec 83,3 points. Ce bond de près de cinq fois sur DeepSWE démontre l’efficacité du modèle à se généraliser dans des scénarios complexes de réparation de code sur de longs dépôts.

Benchmarks officiels de DeepSeek V4 Pro 0813 Figure : Benchmarks officiels de DeepSeek V4 Pro 0813 (évaluation d’agents). Source : Publication officielle DeepSeek / compilé par deepseekv4pro.com

Bien entendu, ces mesures proviennent d’auto-évaluations du fournisseur. Dans l’évaluation des agents, la configuration du banc d’essai (Harness), le formatage du prompt et le budget de réflexion influent considérablement sur les scores finaux. Sur les tâches sans outil comme HLE ou la réflexion approfondie sur des bases de code, un écart objectif subsiste par rapport à Opus 4.8, nécessitant des vérifications neutres de la part de la communauté.

Complétude architecturale et chantiers d’ingénierie en attente

Côté spécifications d’ingénierie, V4 Pro 0813 conserve une architecture de Mélange d’Experts (MoE) comptant 1,6T de paramètres au total, avec 49B de paramètres activés à chaque inférence. Le modèle prend en charge nativement une fenêtre de contexte de 1M de tokens, avec une limite maximale de sortie par requête fixée à 384K tokens. En ce qui concerne l’API, la version officielle comble les lacunes en ajoutant la prise en charge de la Responses API, une couche de compatibilité avec l’API Anthropic, la poursuite de préfixe de dialogue et le complétement de code FIM.

Malgré des fonctionnalités API complètes, des manques subsistent dans l’écosystème d’outils officiel. Le framework d’agents maison “DeepSeek Harness”, très attendu par la communauté, n’a pas été lancé parallèlement à cette version officielle. La documentation recommande toujours l’utilisation d’hôtes d’agents tiers tels qu’OpenAI Codex, Claude Code ou OpenClaw. De plus, l’annonce officielle n’a pas précisé si les poids open source de la version 0813 seront publiés sous licence MIT.

Une capacité de contexte de 1M associée à un plafond de sortie de 384K permet d’indexer des dépôts de code d’entreprise entiers. Néanmoins, l’absence de framework d’exécution officiel oblige les développeurs d’entreprise à concevoir eux-mêmes leurs mécanismes de découpage du contexte et de gestion d’état. L’absence de livraison simultanée de l’architecture Harness officielle implique que les entreprises doivent continuer à développer leurs propres bacs à sable de sécurité et logiques d’orchestration.

La segmentation commerciale derrière l’écart de prix du simple au triple

La stabilisation du produit s’accompagne d’un réajustement de la grille tarifaire. La page des tarifs officiels indique que les prix d’entrée en cas de manque de cache et les prix de sortie pour V4 Pro 0813 sont respectivement de 3,00 RMB ($0,435) et 6,00 RMB ($0,87) par million de tokens. Par rapport aux tarifs de Flash 0731 (1,00 RMB et 2,00 RMB), ces coûts de base ont été multipliés par trois.

Poste de facturationV4-Pro-0813V4-Flash-0731
Entrée · Succès de cache0,025 RMB ($0,003625)0,02 RMB ($0,0028)
Entrée · Échec de cache3,00 RMB ($0,435)1,00 RMB ($0,14)
Sortie6,00 RMB ($0,87)2,00 RMB ($0,28)
Limite de concurrence par client5002500

En plus de l’augmentation du coût des tokens, les plafonds de concurrence ont été considérablement resserrés. Le plafond de concurrence par client pour la version Pro est limité à 500, soit seulement un cinquième de la limite de 2 500 allouée à Flash. De plus, un multiplicateur de tarif de 2x s’applique toujours en période de pointe. L’association d’une concurrence restreinte et d’un prix triplé définit une stratégie claire à deux vitesses : Flash cible les appels à haute fréquence et grande échelle, tandis que Pro se concentre sur les raisonnements complexes à forte valeur ajoutée.

Un signal encore plus explicite est dissimulé dans les notes en anglais de la page des tarifs. Le texte indique clairement que la société prévoit de réviser à la hausse l’ensemble des tarifs des services API dans un avenir proche, annonçant une augmentation importante. Début août, des médias du secteur avaient déjà révélé ces projets de hausse, que cette annonce officielle vient désormais confirmer. L’annonce d’une hausse imminente combinée aux restrictions de concurrence marque la fin définitive de la période où le fort volume d’appels était subventionné par des tarifs extrêmement bas.

Fin de l’ère de l’API à bas coût et nouvelles règles au sommet

Le passage en version officielle de DeepSeek V4 Pro 0813 illustre la rapidité d’itération des modèles d’architecture open source sur les benchmarks d’agents. Cependant, loin d’être une simple avancée technique, il s’agit d’un point d’inflexion où DeepSeek accélère sa monétisation commerciale.

À mesure que les coûts de R&D et la consommation de ressources de calcul augmentent, la stratégie initiale d’expansion axée sur des prix d’API ultra-bas touche à sa fin. En établissant une tarification différenciée entre Flash et Pro, la société oriente les besoins à fort volume vers des modèles légers, tout en réservant les tâches complexes à forte valeur ajoutée à son modèle phare vendu avec une marge plus élevée. La hausse générale des tarifs qui suivra forcera les entreprises à réévaluer le retour sur investissement (ROI) réel de l’utilisation des API.

Dans cette nouvelle phase où la tarification des API se normalise vers un modèle durable, les simples guerres de prix au token perdent de leur attrait. La qualité globale de livraison, le taux de réussite des tâches d’agent sur le long terme et l’efficacité de l’optimisation du contexte remplaceront les prix bradés comme nouveaux critères pour évaluer la valeur réelle des fournisseurs de modèles.

Liens de référence :

  • DeepSeek API Docs: Models & Pricing
  • DeepSeek V4 Hub: V4 Pro 0813 Arrives With Strong Agent Scores
  • Chao News : Lancement officiel de DeepSeek V4 Pro : Contexte 1M + sortie 384K, prix 3x plus cher que Flash
  • Discussion HN (49274600) : DeepSeek V4 Pro 0813