Maison
NVIDIA dévoile le supermodèle open source Nemotron 3, qui rivalise avec les meilleures performances en matière d'IA

NVIDIA a une nouvelle fois marqué un grand coup dans le domaine des grands modèles d'IA. Le 12 mars, la société a officiellement dévoilé une nouvelle génération de grand modèle linguistique open source spécialement conçu pour les agents IA : Nemotron 3 Super . Grâce à son efficacité de raisonnement exceptionnelle et à son impressionnant taux de réussite dans l'exécution des tâches, ce modèle est rapidement devenu un sujet phare au sein de la communauté open source.
Innovation architecturale : une vitesse d'inférence 300 % plus rapide
Nemotron 3 Super utilise une architecture hybride Mamba-MoE innovante, comprenant 120 milliards de paramètres au total, dont seulement 12 milliards sont activés par inférence. Cette conception lui permet de maintenir des performances robustes tout en triplant la vitesse d'inférence et en quintuplant le débit. De plus, le modèle prend en charge une fenêtre de contexte ultra-longue pouvant atteindre 1 million de tokens, ce qui permet de relever efficacement les défis courants de la collaboration multi-agents, tels que la « dérive des objectifs » et l'« explosion contextuelle ».
Benchmark de performances : le nouveau « plafond de performances » pour les modèles open source
Dans plusieurs benchmarks de référence, Nemotron 3 Super a livré des résultats exceptionnels. Il a non seulement dominé les classements d'efficacité et d'ouverture d'Artificial Analysis, mais a également propulsé l'agent AI-Q développé en interne par NVIDIA à la première place des deux classements DeepResearch Bench. Il convient de noter que le modèle a atteint un taux de réussite de 85,6 % sur la tâche d'agent populaire OpenClaw, avec des performances se rapprochant de celles des principaux modèles à code source fermé tels que Claude Opus 4.6 et GPT-5.4.
Compatibilité avec la plateforme Blackwell : prise en charge native de l'entraînement NVFP4
Afin de tirer pleinement parti des avantages de son matériel propriétaire, Nemotron 3 Super prend non seulement en charge les formats BF16 et FP8, mais introduit également une prise en charge spécifique de l'entraînement NVFP4 sur la dernière plateforme Blackwell de NVIDIA et les architectures ultérieures. Cette capacité devrait permettre de réduire encore davantage les coûts d'entraînement des grands modèles et d'améliorer l'efficacité computationnelle.
Adoption par l'écosystème : les principaux acteurs du secteur ont rejoint le mouvement
À l'heure actuelle, Nemotron 3 Super a déjà été intégré par plusieurs leaders technologiques, notamment Perplexity, Palantir, Siemens et Dell, et est disponible sur les principales plateformes cloud telles qu'AWS, Azure et Google Cloud. En tant que modèle gratuit et open source, il offre aux développeurs une alternative puissante et rentable, remettant ainsi sérieusement en cause la domination actuelle sur le marché des grands modèles à code source fermé.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)

NVIDIA a une nouvelle fois marqué un grand coup dans le domaine des grands modèles d'IA. Le 12 mars, la société a officiellement dévoilé une nouvelle génération de grand modèle linguistique open source spécialement conçu pour les agents IA :
Innovation architecturale : une vitesse d'inférence 300 % plus rapide
Benchmark de performances : le nouveau « plafond de performances » pour les modèles open source
Dans plusieurs benchmarks de référence,
Compatibilité avec la plateforme Blackwell : prise en charge native de l'entraînement NVFP4
Afin de tirer pleinement parti des avantages de son matériel propriétaire,
Adoption par l'écosystème : les principaux acteurs du secteur ont rejoint le mouvement
À l'heure actuelle,
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











