Lancement de DeepSeek V4 avec les versions Flash et Pro : les tarifs dévoilés
Une mise à jour majeure vient de voir le jour dans le domaine des grands modèles. DeepSeek, l’une des principales entreprises chinoises spécialisées dans l’IA, a lancé aujourd’hui son nouveau modèle phare, DeepSeek V4. Sa principale particularité réside dans sa stratégie différenciée, qui répond à des besoins variés – allant des tâches légères à haute fréquence au raisonnement complexe – grâce à deux versions : Flash et Pro. Avec une tarification très compétitive, elle établit une nouvelle fois une nouvelle référence en matière de coûts commerciaux de l’IA.
Matrice des modèles : positionnement différencié de Flash et Pro
DeepSeek V4 intègre et améliore les modèles originaux deepseek-chat et deepseek-reasoner, en les scindant officiellement en deux versions :
DeepSeek-V4-Flash: axé sur un rapport coût-efficacité extrême et un débit élevé, idéal pour les conversations générales nécessitant une réponse rapide et les tâches textuelles de base.
DeepSeek-V4-Pro: optimisé pour la logique complexe, le raisonnement approfondi et le calcul haute performance, il offre des capacités de raisonnement et de traitement plus puissantes.
Les deux modèles prennent en charge le mode « thinking » (sauf dans certains cas spécifiques), la sortie JSON, les appels d’outils, la poursuite du préfixe de dialogue (en bêta) et une fenêtre de contexte pouvant contenir jusqu’à 1 million de tokens avec une sortie maximale de 384 000 tokens, offrant ainsi une base solide pour des implémentations techniques complexes.

Système de tarification : facturation transparente et échelonnée
La tarification de DeepSeek est claire et réduit considérablement le coût marginal des appels d’API d’entreprise à long terme grâce à un mécanisme de mise en cache. Voici les tarifs de facturation par million de tokens (en RMB) :
ModèleEntrée (accès au cache)Entrée (sans accès au cache)SortieDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBRemarque : les frais sont d'abord déduits du solde gratuit, puis du solde payant.
Analyse du secteur : pourquoi ce prix constitue une avancée majeure
La logique de tarification montre que DeepSeek encourage les développeurs à réduire le gaspillage de ressources de calcul en optimisant l’utilisation du cache, ce qui permet un contrôle précis des coûts grâce à l’écart de prix significatif entre les entrées mises en cache et celles qui ne le sont pas.
Pour les développeurs, la version Flash à 1 RMB par million de jetons (échec de mise en cache) réduit considérablement les obstacles à l’accès aux architectures de modèles MoE de haut niveau. Parallèlement, la tarification de la version Pro pour les tâches de raisonnement complexes offre une solution nationale pour la création de systèmes de questions-réponses basés sur des bases de connaissances, d’agents autonomes et d’autres applications avancées, en trouvant un équilibre entre performances et coûts.
Remarque importante concernant la compatibilité
Rappel officiel : les noms de modèles d’origine deepseek-chat et deepseek-reasoner seront officiellement dépréciés. Afin d’assurer une transition en douceur, les développeurs peuvent désormais appeler « deepseek-v4-flash » (correspondant au mode « non-thinking ») et « deepseek-v4-pro » (correspondant au mode « thinking »).
Pour obtenir des informations détaillées sur l’API et des guides de migration, les développeurs peuvent consulter la documentation officielle de l’API DeepSeek .
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
Une mise à jour majeure vient de voir le jour dans le domaine des grands modèles. DeepSeek, l’une des principales entreprises chinoises spécialisées dans l’IA, a lancé aujourd’hui son nouveau modèle phare, DeepSeek V4. Sa principale particularité réside dans sa stratégie différenciée, qui répond à des besoins variés – allant des tâches légères à haute fréquence au raisonnement complexe – grâce à deux versions : Flash et Pro. Avec une tarification très compétitive, elle établit une nouvelle fois une nouvelle référence en matière de coûts commerciaux de l’IA.
Matrice des modèles : positionnement différencié de Flash et Pro
DeepSeek V4 intègre et améliore les modèles originaux deepseek-chat et deepseek-reasoner, en les scindant officiellement en deux versions :
DeepSeek-V4-Flash: axé sur un rapport coût-efficacité extrême et un débit élevé, idéal pour les conversations générales nécessitant une réponse rapide et les tâches textuelles de base.
DeepSeek-V4-Pro: optimisé pour la logique complexe, le raisonnement approfondi et le calcul haute performance, il offre des capacités de raisonnement et de traitement plus puissantes.
Les deux modèles prennent en charge le mode « thinking » (sauf dans certains cas spécifiques), la sortie JSON, les appels d’outils, la poursuite du préfixe de dialogue (en bêta) et une fenêtre de contexte pouvant contenir jusqu’à 1 million de tokens avec une sortie maximale de 384 000 tokens, offrant ainsi une base solide pour des implémentations techniques complexes.

Système de tarification : facturation transparente et échelonnée
La tarification de DeepSeek est claire et réduit considérablement le coût marginal des appels d’API d’entreprise à long terme grâce à un mécanisme de mise en cache. Voici les tarifs de facturation par million de tokens (en RMB) :
ModèleEntrée (accès au cache)Entrée (sans accès au cache)SortieDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBRemarque : les frais sont d'abord déduits du solde gratuit, puis du solde payant.
Analyse du secteur : pourquoi ce prix constitue une avancée majeure
La logique de tarification montre que DeepSeek encourage les développeurs à réduire le gaspillage de ressources de calcul en optimisant l’utilisation du cache, ce qui permet un contrôle précis des coûts grâce à l’écart de prix significatif entre les entrées mises en cache et celles qui ne le sont pas.
Pour les développeurs, la version Flash à 1 RMB par million de jetons (échec de mise en cache) réduit considérablement les obstacles à l’accès aux architectures de modèles MoE de haut niveau. Parallèlement, la tarification de la version Pro pour les tâches de raisonnement complexes offre une solution nationale pour la création de systèmes de questions-réponses basés sur des bases de connaissances, d’agents autonomes et d’autres applications avancées, en trouvant un équilibre entre performances et coûts.
Remarque importante concernant la compatibilité
Rappel officiel : les noms de modèles d’origine deepseek-chat et deepseek-reasoner seront officiellement dépréciés. Afin d’assurer une transition en douceur, les développeurs peuvent désormais appeler « deepseek-v4-flash » (correspondant au mode « non-thinking ») et « deepseek-v4-pro » (correspondant au mode « thinking »).
Pour obtenir des informations détaillées sur l’API et des guides de migration, les développeurs peuvent consulter
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter





Maison






