MiniMax M3 passe en open source, sa vitesse de réponse double
MiniMax, une entreprise de premier plan spécialisée dans l’intelligence artificielle et basée en Chine, a annoncé aujourd’hui la mise à disposition en open source de son modèle phare multimodal natif, le MiniMax M3. Auparavant, l’équipe avait déjà mis à la disposition du secteur les poids du modèle et publié un article très technique sur les mécanismes d’attention clairsemée, qui avait suscité un vif intérêt au sein de la communauté open source.

Des performances exceptionnelles en tête de la course à l’open source
En tant que modèle phare de MiniMax, le M3 compte au total 428 milliards de paramètres, dont 23 milliards sont actifs. Il s’agit notamment du premier grand modèle linguistique open source à avoir suivi un entraînement multimodal mixte dès le tout début de son processus d’apprentissage.
Grâce à son architecture de pointe, M3 s’est rapidement hissé à la première place parmi les modèles open source sur un indice mondial de référence en matière d’intelligence, moins de deux semaines après son lancement. Suite à un pic initial de trafic ayant entraîné des ralentissements, l’équipe a optimisé la vitesse de sortie du modèle, la faisant passer de 30 TPS à 80 TPS, et prévoit d’autres améliorations.
Des capacités de codage et de livraison de code de premier plan
Lors de tests de performance exigeants portant sur le codage et les capacités des agents, MiniMax M3 a atteint des performances de pointe. Il est capable de décomposer de manière autonome des tâches complexes et d’exploiter habilement des outils externes pour un raisonnement en plusieurs étapes.
Par rapport aux modèles traditionnels, la capacité de génération de code du M3 a fait un bond qualitatif. L’équipe a précisé que son code est conçu pour être prêt à être déployé, et non pas un prototype à peine fonctionnel nécessitant d’importantes modifications manuelles — un changement qui améliorera considérablement la productivité des développeurs.
Article connexe
Hello Robot prépare ses robots domestiques pour la Silicon Valley
Martinez, en Californie, se trouve à l’extrême nord-est de la baie de San Francisco, à mille lieues du pôle technologique de la Silicon Valley. C’est là qu’est implantée Hello Robot, une start-up qui
Pourquoi les médecins peinent à vous rappeler
Tandis que le débat public sur l’intelligence artificielle dans le secteur de la santé se concentre sur le diagnostic, la découverte de médicaments et les consultations cliniques, un goulot d’étranglement critique, souvent négligé, détermine si les p
Fuite concernant le Sonnet 5.5 d’Anthropic : le contexte des 2 millions de jetons met DeepSeek au défi de retrouver sa rentabilité
Anthropic a dévoilé son dernier modèle Sonnet 5.5, connu en interne sous le nom de « Fennec » (d'après le renard du désert), dont la sortie est prévue le mois prochain. Selon des informations qui ont
Recommandations de sujets spéciaux liés
commentaires (0)
MiniMax, une entreprise de premier plan spécialisée dans l’intelligence artificielle et basée en Chine, a annoncé aujourd’hui la mise à disposition en open source de son modèle phare multimodal natif, le MiniMax M3. Auparavant, l’équipe avait déjà mis à la disposition du secteur les poids du modèle et publié un article très technique sur les mécanismes d’attention clairsemée, qui avait suscité un vif intérêt au sein de la communauté open source.

Des performances exceptionnelles en tête de la course à l’open source
En tant que modèle phare de MiniMax, le M3 compte au total 428 milliards de paramètres, dont 23 milliards sont actifs. Il s’agit notamment du premier grand modèle linguistique open source à avoir suivi un entraînement multimodal mixte dès le tout début de son processus d’apprentissage.
Grâce à son architecture de pointe, M3 s’est rapidement hissé à la première place parmi les modèles open source sur un indice mondial de référence en matière d’intelligence, moins de deux semaines après son lancement. Suite à un pic initial de trafic ayant entraîné des ralentissements, l’équipe a optimisé la vitesse de sortie du modèle, la faisant passer de 30 TPS à 80 TPS, et prévoit d’autres améliorations.
Des capacités de codage et de livraison de code de premier plan
Lors de tests de performance exigeants portant sur le codage et les capacités des agents, MiniMax M3 a atteint des performances de pointe. Il est capable de décomposer de manière autonome des tâches complexes et d’exploiter habilement des outils externes pour un raisonnement en plusieurs étapes.
Par rapport aux modèles traditionnels, la capacité de génération de code du M3 a fait un bond qualitatif. L’équipe a précisé que son code est conçu pour être prêt à être déployé, et non pas un prototype à peine fonctionnel nécessitant d’importantes modifications manuelles — un changement qui améliorera considérablement la productivité des développeurs.
Hello Robot prépare ses robots domestiques pour la Silicon Valley
Martinez, en Californie, se trouve à l’extrême nord-est de la baie de San Francisco, à mille lieues du pôle technologique de la Silicon Valley. C’est là qu’est implantée Hello Robot, une start-up qui
Pourquoi les médecins peinent à vous rappeler
Tandis que le débat public sur l’intelligence artificielle dans le secteur de la santé se concentre sur le diagnostic, la découverte de médicaments et les consultations cliniques, un goulot d’étranglement critique, souvent négligé, détermine si les p
Fuite concernant le Sonnet 5.5 d’Anthropic : le contexte des 2 millions de jetons met DeepSeek au défi de retrouver sa rentabilité
Anthropic a dévoilé son dernier modèle Sonnet 5.5, connu en interne sous le nom de « Fennec » (d'après le renard du désert), dont la sortie est prévue le mois prochain. Selon des informations qui ont





Maison






