Maison
Le lancement de DeepSeek V4 est prévu pour la mi-avril, avec un modèle de plusieurs milliards de paramètres et la prise en charge de puces nationales
Liang Wenfeng, fondateur de DeepSeek, a récemment indiqué dans une note interne que le modèle phare de nouvelle génération de l'entreprise, DeepSeek V4, devrait être officiellement lancé fin avril 2026. Cette annonce marque un tournant décisif pour les grands modèles linguistiques chinois dans la course mondiale vers l'échelle des mille milliards de paramètres. En amont de la sortie de la version V4, DeepSeek a déployé les modes « Fast Mode » et « Expert Mode » sur sa plateforme web, offrant aux utilisateurs un aperçu de ses capacités grâce à des interactions différenciées telles que des recherches rapides et le traitement de requêtes complexes en plusieurs étapes.

Sur le plan technologique, DeepSeek V4 devrait représenter un bond en avant significatif, visant un trillion de paramètres et prenant en charge une fenêtre contextuelle pouvant atteindre un million de tokens. Une avancée majeure réside dans sa compatibilité native et approfondie avec le matériel national, comme les puces de la série Ascend de Huawei. Ce développement stratégique est considéré comme une étape cruciale pour le secteur chinois de l'IA afin de réduire sa dépendance à l'écosystème CUDA et de construire une base informatique autonome. Anticipant cette demande, de grandes entreprises technologiques nationales, notamment Alibaba, ByteDance et Tencent, ont passé des commandes en gros portant sur des centaines de milliers de nouvelles puces d'IA, dans le but d'intégrer rapidement la version V4 via leurs services cloud. Cette forte demande a contribué à une récente hausse d'environ 20 % des prix des puces d'IA.
Avec l'arrivée de DeepSeek V4, la concurrence dans le domaine des grands modèles passe d'une simple compétition algorithmique à une bataille globale impliquant « les performances des modèles, la puissance de calcul et le développement de l'écosystème ». En s'optimisant pour l'infrastructure informatique nationale, DeepSeek améliore non seulement la rentabilité de l'inférence des modèles, mais trace également une voie durable pour la croissance des grands modèles développés localement dans le paysage actuel de la puissance de calcul.
Article connexe
Les anciens ingénieurs de Ramp lèvent 20 millions de dollars pour la plateforme Melius après un pivot par rapport à leur premier produit
Melius, une plateforme alimentée par l’IA dédiée à la création de campagnes publicitaires, d’images et de vidéos, a annoncé mardi avoir levé 25 millions de dollars au total. Cet investissement comprend une levée de fonds de série A de 20 millions de
WeRide dévoile WIIT, un modèle de perception Physical AI pour décoder le monde réel
Au cours de la Conférence mondiale sur l’intelligence artificielle (WAIC) 2026, WeRide a présenté WIIT, un modèle fondamental de cognition en intelligence artificielle physique, qui trace une nouvelle voie pour l’intelligence artificielle, en déplaça
Le PDG d'Anthropic, Amodei, rejette les vues pessimistes et attribue la crise de confiance en l'IA aux promesses non tenues
Dans un contexte de discours public croissant sur les risques et la régulation de l’IA, le PDG d’Anthropic, Dario Amodei, a réfuté les affirmations selon lesquelles son message serait indûment pessimiste. Cette clarification répond directement aux cr
Recommandations de sujets spéciaux liés
commentaires (2)
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥
Liang Wenfeng, fondateur de DeepSeek, a récemment indiqué dans une note interne que le modèle phare de nouvelle génération de l'entreprise, DeepSeek V4, devrait être officiellement lancé fin avril 2026. Cette annonce marque un tournant décisif pour les grands modèles linguistiques chinois dans la course mondiale vers l'échelle des mille milliards de paramètres. En amont de la sortie de la version V4, DeepSeek a déployé les modes « Fast Mode » et « Expert Mode » sur sa plateforme web, offrant aux utilisateurs un aperçu de ses capacités grâce à des interactions différenciées telles que des recherches rapides et le traitement de requêtes complexes en plusieurs étapes.

Sur le plan technologique, DeepSeek V4 devrait représenter un bond en avant significatif, visant un trillion de paramètres et prenant en charge une fenêtre contextuelle pouvant atteindre un million de tokens. Une avancée majeure réside dans sa compatibilité native et approfondie avec le matériel national, comme les puces de la série Ascend de Huawei. Ce développement stratégique est considéré comme une étape cruciale pour le secteur chinois de l'IA afin de réduire sa dépendance à l'écosystème CUDA et de construire une base informatique autonome. Anticipant cette demande, de grandes entreprises technologiques nationales, notamment Alibaba, ByteDance et Tencent, ont passé des commandes en gros portant sur des centaines de milliers de nouvelles puces d'IA, dans le but d'intégrer rapidement la version V4 via leurs services cloud. Cette forte demande a contribué à une récente hausse d'environ 20 % des prix des puces d'IA.
Avec l'arrivée de DeepSeek V4, la concurrence dans le domaine des grands modèles passe d'une simple compétition algorithmique à une bataille globale impliquant « les performances des modèles, la puissance de calcul et le développement de l'écosystème ». En s'optimisant pour l'infrastructure informatique nationale, DeepSeek améliore non seulement la rentabilité de l'inférence des modèles, mais trace également une voie durable pour la croissance des grands modèles développés localement dans le paysage actuel de la puissance de calcul.
Les anciens ingénieurs de Ramp lèvent 20 millions de dollars pour la plateforme Melius après un pivot par rapport à leur premier produit
Melius, une plateforme alimentée par l’IA dédiée à la création de campagnes publicitaires, d’images et de vidéos, a annoncé mardi avoir levé 25 millions de dollars au total. Cet investissement comprend une levée de fonds de série A de 20 millions de
WeRide dévoile WIIT, un modèle de perception Physical AI pour décoder le monde réel
Au cours de la Conférence mondiale sur l’intelligence artificielle (WAIC) 2026, WeRide a présenté WIIT, un modèle fondamental de cognition en intelligence artificielle physique, qui trace une nouvelle voie pour l’intelligence artificielle, en déplaça
Le PDG d'Anthropic, Amodei, rejette les vues pessimistes et attribue la crise de confiance en l'IA aux promesses non tenues
Dans un contexte de discours public croissant sur les risques et la régulation de l’IA, le PDG d’Anthropic, Dario Amodei, a réfuté les affirmations selon lesquelles son message serait indûment pessimiste. Cette clarification répond directement aux cr
Trillion parameters and domestic chip support? Sounds like they're finally trying to break free from Nvidia's grip. But how's the power consumption? Hope it doesn't turn into a space heater 🔥











