
En résumé
- DeepSeek prévoit de publier la V4 vers le 17 février, avec des tests internes montrant qu'elle surpasse Claude et GPT dans les tests d'encodage.
- Le modèle V3 de DeepSeek a atteint 90,2 % sur MATH-500, dépassant les 78,3 % de Claude, et son développement n'aurait coûté que 6 millions de dollars.
- Wei Sun a qualifié le mHC d'avancée surprenante qui permet à DeepSeek de contourner les goulots d'étranglement informatiques malgré les contraintes des puces.
DeepSeek prévoit de lancer son modèle V4 à la mi-février, et si les tests internes sont une indication, les géants de l'IA de la Silicon Valley devraient être nerveux.
La startup d'IA basée à Hangzhou pourrait viser un lancement vers le 17 février (Nouvel An lunaire, bien sûr) avec un modèle spécialement conçu pour les tâches de codage, selon Les informations. Les personnes ayant une connaissance directe du projet affirment que la V4 surpasse à la fois les séries Claude d'Anthropic et GPT d'OpenAI dans les tests internes, en particulier dans la gestion des invites de code extrêmement longues.
Bien entendu, aucun benchmark ni information sur le modèle n’a été partagé publiquement, il est donc impossible de vérifier directement de telles affirmations. DeepSeek n'a pas non plus confirmé les rumeurs.
Cependant, la communauté des développeurs n’attend pas de mot officiel. Les subreddits r/DeepSeek et r/LocalLLaMA de Reddit s'échauffent déjà, les utilisateurs accumulent des crédits API et les passionnés sur
Anthropic a bloqué les sous-marins Claude dans des applications tierces comme OpenCode et aurait coupé l'accès à xAI et OpenAI.
Claude et Claude Code sont géniaux, mais pas encore 10 fois meilleurs. Cela ne fera que pousser les autres laboratoires à avancer plus rapidement sur leurs modèles/agents de codage.
Selon les rumeurs, DeepSeek V4 serait abandonné…
– Yuchen Jin (@Yuchenj_UW) 9 janvier 2026
Ce ne serait pas la première perturbation de DeepSeek. Lorsque l’entreprise a lancé son modèle de raisonnement R1 en janvier 2025, cela a déclenché une vente de 1 000 milliards de dollars sur les marchés mondiaux.
La raison ? Le R1 de DeepSeek correspondait au modèle o1 d'OpenAI en termes de mathématiques et de raisonnement, même si son développement n'aurait coûté que 6 millions de dollars, soit environ 68 fois moins cher que ce que dépensaient les concurrents. Son modèle V3 a ensuite atteint 90,2 % dans le benchmark MATH-500, dépassant de loin les 78,3 % de Claude, et la récente mise à jour « V3.2 Speciale » a encore amélioré ses performances.
L'approche de codage de la V4 constituerait un pivot stratégique. Alors que R1 mettait l'accent sur le raisonnement pur (logique, mathématiques, preuves formelles), le V4 est un modèle hybride (tâches de raisonnement et de non-raisonnement) qui cible le marché des développeurs d'entreprise où la génération de code de haute précision se traduit directement en revenus.
Pour revendiquer la domination, V4 devrait surpasser Claude Opus 4.5, qui détient actuellement le record SWE-bench Verified avec 80,9 %. Cependant, si l'on en croit les versions précédentes de DeepSeek, cela n'est peut-être pas impossible à réaliser, même avec toutes les restrictions auxquelles un laboratoire d'IA chinois serait confronté.
La sauce pas si secrète
En supposant que les rumeurs soient vraies, comment ce petit laboratoire peut-il accomplir un tel exploit ?
L'arme secrète de l'entreprise pourrait être contenue dans son document de recherche du 1er janvier : Manifold-Constrained Hyper-Connections, ou mHC. Co-écrite par le fondateur Liang Wenfeng, la nouvelle méthode de formation répond à un problème fondamental lié à la mise à l'échelle de grands modèles de langage : comment étendre la capacité d'un modèle sans qu'il ne devienne instable ou n'explose pendant la formation.
Les architectures d’IA traditionnelles forcent toutes les informations à emprunter un seul chemin étroit. mHC étend ce chemin en plusieurs flux qui peuvent échanger des informations sans provoquer d'effondrement de la formation.

Wei Sun, analyste principal en IA chez Counterpoint Research, a qualifié le mHC de « percée surprenante » dans des commentaires à Business Insider. La technique, a-t-il noté, montre que DeepSeek peut « contourner les goulots d'étranglement informatiques et débloquer des avancées en matière de renseignement », même avec un accès limité aux puces avancées en raison des restrictions américaines à l'exportation.
Lian Jye Su, analyste en chef chez Omdia, a noté que la volonté de DeepSeek de publier ses méthodes témoigne d'une « nouvelle confiance dans l'industrie chinoise de l'IA ». L'approche open source de l'entreprise en a fait un favori parmi les développeurs qui y voient l'incarnation de ce qu'était OpenAI, avant de se tourner vers des modèles fermés et des levées de fonds d'un milliard de dollars.
Tout le monde n’est pas convaincu. Certains développeurs sur Reddit se plaignent du fait que les modèles de raisonnement de DeepSeek gaspillent de la puissance de calcul sur des tâches simples, tandis que les critiques affirment que les critères de référence de l'entreprise ne reflètent pas le désordre du monde réel. Un article de Medium intitulé « DeepSeek Sucks—And I'm Done Pretending It Doesn't » est devenu viral en avril 2025, accusant les modèles de produire des « absurdités de buggy standard » et des « bibliothèques folles ».
DeepSeek transporte également des bagages. Les problèmes de confidentialité ont tourmenté l'entreprise, certains gouvernements interdisant l'application native de DeepSeek. Les liens de l'entreprise avec la Chine et les questions de censure dans ses modèles ajoutent des frictions géopolitiques aux débats techniques.
Mais la dynamique est indéniable. Deepseek a été largement adopté en Asie, et si la V4 tient ses promesses de chiffrement, l'adoption par les entreprises occidentales pourrait suivre.

Il y a aussi le moment. Selon ReutersDeepSeek avait initialement prévu de lancer son modèle R2 en mai 2025, mais a prolongé le délai après que le fondateur Liang soit devenu insatisfait de ses performances. Aujourd’hui, alors que la V4 devrait cibler février et la R2 pourrait suivre en août, la société évolue à un rythme qui suggère l’urgence – ou la confiance. Peut-être les deux.
Généralement intelligent Bulletin
Un voyage hebdomadaire en IA raconté par Gen, un modèle d'IA générative.