DeepSeek V4 : Le modèle open source moins cher, plus long, et peut-être même propulsé par Huawei
Le modèle V4 de DeepSeek est moins cher, plus intelligent et à plus long contexte que jamais - et il pourrait bien aider la Chine à se passer de Nvidia au profit de Huawei, un token à la fois.
Le 24 avril, la société chinoise d'IA DeepSeek a lancé V4, son nouveau modèle phare tant attendu, et honnêtement, c'est un sacré événement - même s'il ne secouera pas le monde de l'IA comme son prédécesseur R1 l'a fait. V4 peut traiter des prompts beaucoup plus longs grâce à une nouvelle conception astucieuse, il est open source (donc n'importe qui peut le télécharger, l'utiliser et le modifier), et il fait parler de lui pour des raisons qui vont au-delà des simples benchmarks.
D'abord, le prix. DeepSeek affirme que les performances de V4 rivalisent avec les meilleurs modèles à une fraction du coût, ce qui est une excellente nouvelle pour les développeurs qui ne veulent pas hypothéquer leur startup pour payer l'IA. V4 se décline en deux versions : V4-Pro, un modèle plus costaud pour le codage et les tâches complexes, et V4-Flash, une version plus petite et plus rapide. Les deux ont des modes de raisonnement qui permettent au modèle de montrer son travail, comme un prof de maths qui s'intéresse vraiment. Tarifs ? V4-Pro facture 1,74 $ par million de tokens en entrée et 3,48 $ par million de tokens en sortie - des cacahuètes comparé à OpenAI et Anthropic. V4-Flash est encore moins cher, à environ 0,14 $ par million de tokens en entrée et 0,28 $ par million en sortie, ce qui en fait l'un des modèles haut de gamme les moins chers du marché. C'est le genre de prix qui donne envie de créer une application juste parce qu'on le peut.
Côté performances, V4 est un bond énorme par rapport à R1, ce qui est aussi surprenant que de découvrir que l'eau est mouillée. Sur les principaux benchmarks, V4-Pro égale le Claude-Opus-4.6 d'Anthropic, le GPT-5.4 d'OpenAI et le Gemini-3.1 de Google, et il bat des rivaux open source comme Qwen-3.5 d'Alibaba et GLM-5.1 de Z.ai sur le codage, les maths et les problèmes STEM. Il excelle aussi dans les tâches de codage agentique et la résolution de problèmes en plusieurs étapes. L'enquête interne de DeepSeek auprès de 85 développeurs ? Plus de 90 % placent V4-Pro dans leurs premiers choix pour le codage. Et pour la foule agentique, V4 est optimisé pour des frameworks comme Claude Code, OpenClaw et CodeBuddy - parce que qui ne veut pas que son IA ait un acolyte ?
Maintenant, la question du long contexte. Les deux versions de V4 peuvent gérer 1 million de tokens - assez pour contenir les trois volumes du Seigneur des Anneaux et Le Hobbit combinés. C'est beaucoup de hobbits. Mais la vraie innovation réside dans la façon dont DeepSeek l'a fait : ils ont modifié le mécanisme d'attention pour le rendre plus sélectif, compressant les informations anciennes et se concentrant sur ce qui compte maintenant. Cela réduit la puissance de calcul à 27 % et la mémoire à 10 % par rapport au modèle précédent V3.2 dans un contexte d'un million de tokens (V4-Flash utilise seulement 10 % du calcul et 7 % de la mémoire). Cela signifie que vous pouvez construire un assistant de codage IA qui lit l'intégralité de votre codebase sans oublier ce qu'il a lu il y a cinq minutes.
Et maintenant, la géopolitique. V4 est le premier modèle de DeepSeek optimisé pour les puces chinoises domestiques, en particulier l'Ascend de Huawei. C'est un gros problème car c'est un test pour savoir si la Chine peut se sevrer de Nvidia. Les contrôles à l'exportation américains ont coupé les entreprises chinoises des meilleures puces de Nvidia, donc Pékin pousse pour une pile IA maison. DeepSeek aurait donné un accès anticipé uniquement aux fabricants de puces chinois, et Huawei a annoncé vendredi que ses supernodes Ascend 950 prendront en charge V4. Mais ne nous emballons pas : le rapport technique de DeepSeek suggère qu'ils utilisent des puces chinoises pour l'inférence, mais l'entraînement pourrait encore dépendre de Nvidia. Liu Zhiyuan, professeur à Tsinghua, a déclaré à MIT Technology Review que seule une partie de l'entraînement de V4 a été adaptée aux puces chinoises, et plusieurs sources anonymes ont déclaré que les puces chinoises sont meilleures pour l'inférence que pour l'entraînement. Néanmoins, DeepSeek affirme que les prix de V4-Pro pourraient chuter considérablement une fois que les supernodes Ascend 950 de Huawei seront expédiés à grande échelle au second semestre de cette année.
Alors, V4 va-t-il secouer les choses comme R1 ? Probablement pas, mais c'est un signe que la Chine construit une infrastructure IA parallèle - et le fait avec un prix qui vous fera faire une double prise.
The Good Times
Les nouvelles dans votre boîte.
Un résumé sardonique, livré selon votre horaire. Gratuit. Désabonnez-vous quand vous en avez assez.
Déjà abonné mais on n'arrive jamais dans votre boîte ? Regardez dans vos spams et cliquez sur 'Non spam' (ou 'Retirer des spams') pour nous sortir du purgatoire des indésirables. Vous rendrez service à tout le monde.
Si vous n'ouvrez aucun de nos e-mails pendant un mois, vous serez automatiquement retiré de la liste.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.