Maison
DeepSeek dévoile la version V4 en aperçu, rendant l’accès au contexte long de 1 million de tokens accessible à tous
DeepSeek a officiellement lancé et open-sourcé la version préliminaire de sa dernière série de modèles, DeepSeek-V4 . Grâce à des innovations structurelles, cette série réalise une gestion standardisée de contextes ultra-longs de 1M (un million de tokens) et devance les modèles nationaux et open-source en matière de collaboration d'agents, de connaissances mondiales et de raisonnement logique.

Disposition à deux versions : Pro pour l'excellence, Flash pour l'efficacité
DeepSeek-V4 propose deux spécifications adaptées à différents besoins d'application :
DeepSeek-V4-Pro (1,6 T de paramètres, 49B activés) : Les performances rivalisent avec les meilleurs modèles propriétaires fermés. Il obtient les meilleurs résultats open-source dans les évaluations de Codage Agentic, avec une qualité de sortie proche d'Opus4.6. En mathématiques, STEM et tests de codage compétitif, il surpasse tous les modèles open-source évalués publiquement, démontrant des capacités de raisonnement de classe mondiale.
DeepSeek-V4-Flash (284B de paramètres, 13B activés) : Privilégie un rapport coût-efficacité extrême. Bien que ses connaissances mondiales soient légèrement inférieures à celles de la version Pro, il égale les performances de raisonnement de niveau Pro pour les tâches simples et les performances d'Agent, offrant des services API plus rapides et plus économiques.
Innovation structurelle : Le mécanisme DSA rend accessible le contexte long
DeepSeek-V4 introduit un **mécanisme d'attention sparse DSA** pionnier. En compressant au niveau des tokens, le modèle réduit considérablement les exigences de calcul et de mémoire pour les contextes ultra-longs. Cela fait du contexte 1M une fonctionnalité standard sur tous les services officiels DeepSeek, répondant au point de douleur élevé de l'industrie concernant le traitement des textes longs.
Adaptation profonde à l'écosystème Agent
Optimisé pour les produits Agent grand public tels que Claude Code et CodeBuddy, DeepSeek-V4 prend en charge à la fois le mode non-réflexif et le mode réflexif. L'API expose le paramètre reasoning_effort, permettant aux utilisateurs d'ajuster l'intensité de la réflexion (élevée/maximale) en fonction de la complexité de la tâche, améliorant considérablement les performances dans des scénarios complexes tels que la génération de code et le traitement de documents.
Accès et plan d'open source
Les utilisateurs peuvent désormais accéder au dernier modèle via le site web officiel ou l'application officielle, avec des mises à jour d'API correspondantes. Notez que les anciens noms de modèle deepseek-chat et deepseek-reasoner seront abandonnés après trois mois (d'ici le 24 juillet 2026).
Liens open source : Disponibles sur Hugging Face et Moba Community .
Rapport technique : Publié dans le dépôt Hugging Face .
Cette version de DeepSeek-V4 valide la faisabilité des modèles open-source rattrapant les meilleurs modèles propriétaires fermés en matière de contexte long et de capacités d'Agent, jetant des bases solides pour la démocratisation de l'IA générale grâce à des avancées technologiques.
Article connexe
Chrome et Edge augmentent discrètement les besoins de stockage des modèles d’IA locaux à 20 Go, à mesure que les navigateurs évoluent vers des moteurs d’inférence d’IA
Google Chrome et Microsoft Edge ont augmenté les exigences en matière d’espace disque pour les modèles d’IA locaux à 20 Go. Ces navigateurs téléchargent silencieusement les modèles en arrière-plan afin d’activer les capacités d’IA sur l’appareil. En
Zhipu AI vise un revenu annuel récurrent (ARR) de 1 milliard de dollars avec un accent sur le codage après une croissance de 15x en 5 mois
Plusieurs sources indépendantes confirment que le revenu récurrent annuel (ARR) de Zhipu a atteint 1 milliard de dollars en juillet 2026. L'entreprise n'a pas encore commenté ces rapports.La programmation assistée par l'IA et la génération vidéo sont
Microsoft dévoile son premier modèle d’intelligence artificielle dédié à la cybersécurité, MAI-Cyber-1-Flash, et lance sa plateforme de sécurité Perception.
Microsoft a officiellement présenté MAI-Cyber-1-Flash, son premier modèle spécialisé en cybersécurité, ainsi qu’une nouvelle plateforme de sécurité alimentée par l’IA nommée Perception. Dévoilées lors d’un événement à San Francisco, ces innovations r
Recommandations de sujets spéciaux liés
commentaires (0)
DeepSeek a officiellement lancé et open-sourcé la version préliminaire de sa dernière série de modèles,

Disposition à deux versions : Pro pour l'excellence, Flash pour l'efficacité
DeepSeek-V4-Pro (1,6 T de paramètres, 49B activés) : Les performances rivalisent avec les meilleurs modèles propriétaires fermés. Il obtient les meilleurs résultats open-source dans les évaluations de Codage Agentic, avec une qualité de sortie proche d'Opus4.6. En mathématiques, STEM et tests de codage compétitif, il surpasse tous les modèles open-source évalués publiquement, démontrant des capacités de raisonnement de classe mondiale.
DeepSeek-V4-Flash (284B de paramètres, 13B activés) : Privilégie un rapport coût-efficacité extrême. Bien que ses connaissances mondiales soient légèrement inférieures à celles de la version Pro, il égale les performances de raisonnement de niveau Pro pour les tâches simples et les performances d'Agent, offrant des services API plus rapides et plus économiques.
Innovation structurelle : Le mécanisme DSA rend accessible le contexte long
Adaptation profonde à l'écosystème Agent
Optimisé pour les produits Agent grand public tels que Claude Code et CodeBuddy, reasoning_effort, permettant aux utilisateurs d'ajuster l'intensité de la réflexion (élevée/maximale) en fonction de la complexité de la tâche, améliorant considérablement les performances dans des scénarios complexes tels que la génération de code et le traitement de documents.
Accès et plan d'open source
Les utilisateurs peuvent désormais accéder au dernier modèle via le deepseek-chat et deepseek-reasoner seront abandonnés après trois mois (d'ici le 24 juillet 2026).
Liens open source : Disponibles sur
Rapport technique : Publié dans le dépôt
Cette version de
Chrome et Edge augmentent discrètement les besoins de stockage des modèles d’IA locaux à 20 Go, à mesure que les navigateurs évoluent vers des moteurs d’inférence d’IA
Google Chrome et Microsoft Edge ont augmenté les exigences en matière d’espace disque pour les modèles d’IA locaux à 20 Go. Ces navigateurs téléchargent silencieusement les modèles en arrière-plan afin d’activer les capacités d’IA sur l’appareil. En
Zhipu AI vise un revenu annuel récurrent (ARR) de 1 milliard de dollars avec un accent sur le codage après une croissance de 15x en 5 mois
Plusieurs sources indépendantes confirment que le revenu récurrent annuel (ARR) de Zhipu a atteint 1 milliard de dollars en juillet 2026. L'entreprise n'a pas encore commenté ces rapports.La programmation assistée par l'IA et la génération vidéo sont
Microsoft dévoile son premier modèle d’intelligence artificielle dédié à la cybersécurité, MAI-Cyber-1-Flash, et lance sa plateforme de sécurité Perception.
Microsoft a officiellement présenté MAI-Cyber-1-Flash, son premier modèle spécialisé en cybersécurité, ainsi qu’une nouvelle plateforme de sécurité alimentée par l’IA nommée Perception. Dévoilées lors d’un événement à San Francisco, ces innovations r











