MiniMax dévoile M3, un grand modèle d'IA national qui surpasse GPT-5.5
Le secteur de l'intelligence artificielle en Chine a connu un bond technologique majeur avec le lancement officiel du dernier grand modèle de langage de Xiyu Technology, MiniMax M3. Ce système avancé combine une maîtrise du codage de pointe avec la prise en charge d'une fenêtre de contexte ultra-longue allant jusqu'à 1 million de jetons. Il est à noter qu'il prend nativement en charge les entrées multimodales, y compris le traitement d'images et de vidéos, ainsi que l'interaction avec le bureau informatique, ce qui en fait le premier modèle open-source en Chine à intégrer ces trois capacités critiques.

Résultats exceptionnels dans les benchmarks standardisés
Lors de l'évaluation rigoureuse de programmation SWE-Bench Pro, MiniMax M3 a obtenu un score de 59,0 %, surpassant GPT-5.5 et Gemini 3.1 Pro, tout en restant proche du modèle de haut de gamme Opus 4.7. Le modèle a également démontré des performances supérieures dans le test Claw-Eval pour les capacités des agents d'IA et a obtenu les meilleurs scores sur le benchmark OmniDocBench de compréhension de documents multimodaux.
Une architecture avancée qui améliore l'efficacité
Cette performance est rendue possible par l'adoption par M3 d'une nouvelle architecture d'attention creuse (MSA). Lors du traitement de contextes ultra-longs de 1 million de jetons, cette conception réduit de moitié le calcul par jeton par rapport à son prédécesseur. Par conséquent, le modèle accélère la vitesse de compréhension de plus de 9 fois et augmente la vitesse de génération de réponses de plus de 15 fois. L'API est désormais en ligne, l'équipe officielle s'engageant à publier les poids du modèle et les rapports techniques pour les développeurs du monde entier dans un délai de 10 jours.
Article connexe
L'Inde oblige les applications d'identification des appels à partager des données sur les appels indésirables avec les opérateurs de télécommunications
L’Inde a élargi sa réglementation anti-spam pour obliger les applications d’identification de l’appelant et de gestion des appels à partager avec les opérateurs de télécommunications les signalements d’abus reçus des utilisateurs, une mesure qui a co
La plateforme Qwen AI élargit sa matrice de modèles avec le lancement officiel de GLM-5.3 et DeepSeek-V4-Pro
La plateforme d’IA Qwen d’Alibaba Cloud (MaaS) a récemment élargi sa matrice de services de modèles, en intégrant le modèle phare GLM-5.3 de Zhipu et la version officielle de DeepSeek-V4-Pro. Les services API correspondants sont désormais accessibles
Pourquoi les agents oublient et s’écartent de leur trajectoire lors de tâches longues : AWS, Claude Code et Manus décomposent quatre cadres
Les grands modèles de langage perdent souvent le fil lors d'opérations prolongées, s'éloignant de leurs objectifs initiaux — un défi persistant dans le secteur des agents intelligents. Le problème découle souvent non pas du modèle lui-même, mais du c
Recommandations de sujets spéciaux liés
commentaires (0)
Le secteur de l'intelligence artificielle en Chine a connu un bond technologique majeur avec le lancement officiel du dernier grand modèle de langage de Xiyu Technology, MiniMax M3. Ce système avancé combine une maîtrise du codage de pointe avec la prise en charge d'une fenêtre de contexte ultra-longue allant jusqu'à 1 million de jetons. Il est à noter qu'il prend nativement en charge les entrées multimodales, y compris le traitement d'images et de vidéos, ainsi que l'interaction avec le bureau informatique, ce qui en fait le premier modèle open-source en Chine à intégrer ces trois capacités critiques.

Résultats exceptionnels dans les benchmarks standardisés
Lors de l'évaluation rigoureuse de programmation SWE-Bench Pro, MiniMax M3 a obtenu un score de 59,0 %, surpassant GPT-5.5 et Gemini 3.1 Pro, tout en restant proche du modèle de haut de gamme Opus 4.7. Le modèle a également démontré des performances supérieures dans le test Claw-Eval pour les capacités des agents d'IA et a obtenu les meilleurs scores sur le benchmark OmniDocBench de compréhension de documents multimodaux.
Une architecture avancée qui améliore l'efficacité
Cette performance est rendue possible par l'adoption par M3 d'une nouvelle architecture d'attention creuse (MSA). Lors du traitement de contextes ultra-longs de 1 million de jetons, cette conception réduit de moitié le calcul par jeton par rapport à son prédécesseur. Par conséquent, le modèle accélère la vitesse de compréhension de plus de 9 fois et augmente la vitesse de génération de réponses de plus de 15 fois. L'API est désormais en ligne, l'équipe officielle s'engageant à publier les poids du modèle et les rapports techniques pour les développeurs du monde entier dans un délai de 10 jours.
L'Inde oblige les applications d'identification des appels à partager des données sur les appels indésirables avec les opérateurs de télécommunications
L’Inde a élargi sa réglementation anti-spam pour obliger les applications d’identification de l’appelant et de gestion des appels à partager avec les opérateurs de télécommunications les signalements d’abus reçus des utilisateurs, une mesure qui a co
La plateforme Qwen AI élargit sa matrice de modèles avec le lancement officiel de GLM-5.3 et DeepSeek-V4-Pro
La plateforme d’IA Qwen d’Alibaba Cloud (MaaS) a récemment élargi sa matrice de services de modèles, en intégrant le modèle phare GLM-5.3 de Zhipu et la version officielle de DeepSeek-V4-Pro. Les services API correspondants sont désormais accessibles
Pourquoi les agents oublient et s’écartent de leur trajectoire lors de tâches longues : AWS, Claude Code et Manus décomposent quatre cadres
Les grands modèles de langage perdent souvent le fil lors d'opérations prolongées, s'éloignant de leurs objectifs initiaux — un défi persistant dans le secteur des agents intelligents. Le problème découle souvent non pas du modèle lui-même, mais du c





Maison






