Lancement de DeepSeek V4 avec les versions Flash et Pro : les tarifs dévoilés
Une mise à jour majeure vient de voir le jour dans le domaine des grands modèles. DeepSeek, l’une des principales entreprises chinoises spécialisées dans l’IA, a lancé aujourd’hui son nouveau modèle phare, DeepSeek V4. Sa principale particularité réside dans sa stratégie différenciée, qui répond à des besoins variés – allant des tâches légères à haute fréquence au raisonnement complexe – grâce à deux versions : Flash et Pro. Avec une tarification très compétitive, elle établit une nouvelle fois une nouvelle référence en matière de coûts commerciaux de l’IA.
Matrice des modèles : positionnement différencié de Flash et Pro
DeepSeek V4 intègre et améliore les modèles originaux deepseek-chat et deepseek-reasoner, en les scindant officiellement en deux versions :
DeepSeek-V4-Flash: axé sur un rapport coût-efficacité extrême et un débit élevé, idéal pour les conversations générales nécessitant une réponse rapide et les tâches textuelles de base.
DeepSeek-V4-Pro: optimisé pour la logique complexe, le raisonnement approfondi et le calcul haute performance, il offre des capacités de raisonnement et de traitement plus puissantes.
Les deux modèles prennent en charge le mode « thinking » (sauf dans certains cas spécifiques), la sortie JSON, les appels d’outils, la poursuite du préfixe de dialogue (en bêta) et une fenêtre de contexte pouvant contenir jusqu’à 1 million de tokens avec une sortie maximale de 384 000 tokens, offrant ainsi une base solide pour des implémentations techniques complexes.

Système de tarification : facturation transparente et échelonnée
La tarification de DeepSeek est claire et réduit considérablement le coût marginal des appels d’API d’entreprise à long terme grâce à un mécanisme de mise en cache. Voici les tarifs de facturation par million de tokens (en RMB) :
ModèleEntrée (accès au cache)Entrée (sans accès au cache)SortieDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBRemarque : les frais sont d'abord déduits du solde gratuit, puis du solde payant.
Analyse du secteur : pourquoi ce prix constitue une avancée majeure
La logique de tarification montre que DeepSeek encourage les développeurs à réduire le gaspillage de ressources de calcul en optimisant l’utilisation du cache, ce qui permet un contrôle précis des coûts grâce à l’écart de prix significatif entre les entrées mises en cache et celles qui ne le sont pas.
Pour les développeurs, la version Flash à 1 RMB par million de jetons (échec de mise en cache) réduit considérablement les obstacles à l’accès aux architectures de modèles MoE de haut niveau. Parallèlement, la tarification de la version Pro pour les tâches de raisonnement complexes offre une solution nationale pour la création de systèmes de questions-réponses basés sur des bases de connaissances, d’agents autonomes et d’autres applications avancées, en trouvant un équilibre entre performances et coûts.
Remarque importante concernant la compatibilité
Rappel officiel : les noms de modèles d’origine deepseek-chat et deepseek-reasoner seront officiellement dépréciés. Afin d’assurer une transition en douceur, les développeurs peuvent désormais appeler « deepseek-v4-flash » (correspondant au mode « non-thinking ») et « deepseek-v4-pro » (correspondant au mode « thinking »).
Pour obtenir des informations détaillées sur l’API et des guides de migration, les développeurs peuvent consulter la documentation officielle de l’API DeepSeek .
Article connexe
Les fuites d’informations internes par l’IA rebelle de Meta, renforçant la sécurité au deuxième niveau le plus élevé
Selon The Information, Meta a récemment connu un incident critique de « perte de contrôle » impliquant un agent d’intelligence artificielle. Un outil interne, conçu pour faciliter les flux de travail, a accidentellement exposé des données sensibles d
PDG de Meituan Wang Xing : Les agents IA frappent plus fort que ChatGPT
Lors d’une session de communication managériale le 13 mars 2026, Zhang Wang, PDG de Meituan, a abordé la trajectoire de l’intelligence artificielle (IA). Il a soutenu que la transformation pilotée par l’IA dépasserait l’impact de toute l’ère d’Intern
Jensen Huang révèle une opportunité de marché « toute nouvelle » de 200 milliards de dollars pour Nvidia
Le fondateur et PDG de Nvidia, Jensen Huang, se distingue comme l’un des visionnaires d’entreprise les plus convaincants, sinon le plus grand, dans la conduite du récit de son entreprise. Il pourrait même surpasser Marc Benioff de Salesforce en matiè
Recommandations de sujets spéciaux liés
commentaires (0)
Une mise à jour majeure vient de voir le jour dans le domaine des grands modèles. DeepSeek, l’une des principales entreprises chinoises spécialisées dans l’IA, a lancé aujourd’hui son nouveau modèle phare, DeepSeek V4. Sa principale particularité réside dans sa stratégie différenciée, qui répond à des besoins variés – allant des tâches légères à haute fréquence au raisonnement complexe – grâce à deux versions : Flash et Pro. Avec une tarification très compétitive, elle établit une nouvelle fois une nouvelle référence en matière de coûts commerciaux de l’IA.
Matrice des modèles : positionnement différencié de Flash et Pro
DeepSeek V4 intègre et améliore les modèles originaux deepseek-chat et deepseek-reasoner, en les scindant officiellement en deux versions :
DeepSeek-V4-Flash: axé sur un rapport coût-efficacité extrême et un débit élevé, idéal pour les conversations générales nécessitant une réponse rapide et les tâches textuelles de base.
DeepSeek-V4-Pro: optimisé pour la logique complexe, le raisonnement approfondi et le calcul haute performance, il offre des capacités de raisonnement et de traitement plus puissantes.
Les deux modèles prennent en charge le mode « thinking » (sauf dans certains cas spécifiques), la sortie JSON, les appels d’outils, la poursuite du préfixe de dialogue (en bêta) et une fenêtre de contexte pouvant contenir jusqu’à 1 million de tokens avec une sortie maximale de 384 000 tokens, offrant ainsi une base solide pour des implémentations techniques complexes.

Système de tarification : facturation transparente et échelonnée
La tarification de DeepSeek est claire et réduit considérablement le coût marginal des appels d’API d’entreprise à long terme grâce à un mécanisme de mise en cache. Voici les tarifs de facturation par million de tokens (en RMB) :
ModèleEntrée (accès au cache)Entrée (sans accès au cache)SortieDeepSeek-V4-Flash0,2 RMB1 RMB2RMBDeepSeek-V4-Pro1RMB12 RMB24 RMBRemarque : les frais sont d'abord déduits du solde gratuit, puis du solde payant.
Analyse du secteur : pourquoi ce prix constitue une avancée majeure
La logique de tarification montre que DeepSeek encourage les développeurs à réduire le gaspillage de ressources de calcul en optimisant l’utilisation du cache, ce qui permet un contrôle précis des coûts grâce à l’écart de prix significatif entre les entrées mises en cache et celles qui ne le sont pas.
Pour les développeurs, la version Flash à 1 RMB par million de jetons (échec de mise en cache) réduit considérablement les obstacles à l’accès aux architectures de modèles MoE de haut niveau. Parallèlement, la tarification de la version Pro pour les tâches de raisonnement complexes offre une solution nationale pour la création de systèmes de questions-réponses basés sur des bases de connaissances, d’agents autonomes et d’autres applications avancées, en trouvant un équilibre entre performances et coûts.
Remarque importante concernant la compatibilité
Rappel officiel : les noms de modèles d’origine deepseek-chat et deepseek-reasoner seront officiellement dépréciés. Afin d’assurer une transition en douceur, les développeurs peuvent désormais appeler « deepseek-v4-flash » (correspondant au mode « non-thinking ») et « deepseek-v4-pro » (correspondant au mode « thinking »).
Pour obtenir des informations détaillées sur l’API et des guides de migration, les développeurs peuvent consulter
Les fuites d’informations internes par l’IA rebelle de Meta, renforçant la sécurité au deuxième niveau le plus élevé
Selon The Information, Meta a récemment connu un incident critique de « perte de contrôle » impliquant un agent d’intelligence artificielle. Un outil interne, conçu pour faciliter les flux de travail, a accidentellement exposé des données sensibles d
PDG de Meituan Wang Xing : Les agents IA frappent plus fort que ChatGPT
Lors d’une session de communication managériale le 13 mars 2026, Zhang Wang, PDG de Meituan, a abordé la trajectoire de l’intelligence artificielle (IA). Il a soutenu que la transformation pilotée par l’IA dépasserait l’impact de toute l’ère d’Intern
Jensen Huang révèle une opportunité de marché « toute nouvelle » de 200 milliards de dollars pour Nvidia
Le fondateur et PDG de Nvidia, Jensen Huang, se distingue comme l’un des visionnaires d’entreprise les plus convaincants, sinon le plus grand, dans la conduite du récit de son entreprise. Il pourrait même surpasser Marc Benioff de Salesforce en matiè





Maison






