Hogar
MiniMax presenta M3, un modelo de inteligencia artificial de gran escala nacional que supera a GPT-5.5
El sector de inteligencia artificial de China ha experimentado un importante avance tecnológico con el lanzamiento oficial del último modelo de lenguaje grande de Xiyu Technology, MiniMax M3. Este sistema avanzado combina una competencia de codificación de última generación con soporte para una ventana de contexto ultra larga de hasta 1 millón de tokens. Cabe destacar que admite de forma nativa entradas multimodales, incluido el procesamiento de imágenes y videos, junto con la interacción con el escritorio del ordenador, lo que lo convierte en el primer modelo de código abierto en China en integrar estas tres capacidades críticas.

Resultados excepcionales en pruebas normalizadas
En la rigurosa evaluación de programación SWE-Bench Pro, MiniMax M3 obtuvo una puntuación del 59,0 %, superando a GPT-5.5 y Gemini 3.1 Pro, mientras se mantenía muy cerca del modelo de gama alta Opus 4.7. El modelo también demostró un rendimiento superior en la prueba Claw-Eval para capacidades de agentes de IA y alcanzó las mejores puntuaciones en el benchmark OmniDocBench de comprensión de documentos multimodales.
Arquitectura avanzada que mejora la eficiencia
El motor de este rendimiento es la adopción por parte de M3 de una nueva arquitectura de atención dispersa (MSA). Al manejar contextos ultra largos de 1 millón de tokens, este diseño reduce a la mitad el cálculo por token en comparación con su predecesor. En consecuencia, el modelo acelera la velocidad de comprensión en más de 9 veces y aumenta la velocidad de generación de respuestas en más de 15 veces. La API ya está disponible, y el equipo oficial se compromete a publicar los pesos del modelo y los informes técnicos para los desarrolladores de todo el mundo en un plazo de 10 días.
Artículo relacionado
India obliga a las aplicaciones de identificación de llamadas a compartir datos de spam con los operadores de telecomunicaciones
India ha ampliado sus regulaciones contra el spam para obligar a las aplicaciones de identificación de llamadas y gestión de llamadas a compartir los informes de spam de los usuarios con las operadoras de telecomunicaciones, una medida que ha llevado
La plataforma de IA Qwen amplía su matriz de modelos con el lanzamiento oficial de GLM-5.3 y DeepSeek-V4-Pro
La plataforma de inteligencia artificial Qwen de Alibaba Cloud (MaaS) ha ampliado recientemente su matriz de servicios de modelos, integrando el modelo grande insignia GLM-5.3 de Zhipu y el lanzamiento oficial de DeepSeek-V4-Pro. Los servicios API co
Por qué los agentes olvidan y se desvían en tareas largas: AWS, Claude Code y Manus desglosan cuatro marcos
Los modelos de lenguaje grandes pierden con frecuencia el enfoque durante operaciones prolongadas, desviándose de sus objetivos originales, un desafío persistente en el sector de los agentes inteligentes. El problema a menudo no proviene del modelo e
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El sector de inteligencia artificial de China ha experimentado un importante avance tecnológico con el lanzamiento oficial del último modelo de lenguaje grande de Xiyu Technology, MiniMax M3. Este sistema avanzado combina una competencia de codificación de última generación con soporte para una ventana de contexto ultra larga de hasta 1 millón de tokens. Cabe destacar que admite de forma nativa entradas multimodales, incluido el procesamiento de imágenes y videos, junto con la interacción con el escritorio del ordenador, lo que lo convierte en el primer modelo de código abierto en China en integrar estas tres capacidades críticas.

Resultados excepcionales en pruebas normalizadas
En la rigurosa evaluación de programación SWE-Bench Pro, MiniMax M3 obtuvo una puntuación del 59,0 %, superando a GPT-5.5 y Gemini 3.1 Pro, mientras se mantenía muy cerca del modelo de gama alta Opus 4.7. El modelo también demostró un rendimiento superior en la prueba Claw-Eval para capacidades de agentes de IA y alcanzó las mejores puntuaciones en el benchmark OmniDocBench de comprensión de documentos multimodales.
Arquitectura avanzada que mejora la eficiencia
El motor de este rendimiento es la adopción por parte de M3 de una nueva arquitectura de atención dispersa (MSA). Al manejar contextos ultra largos de 1 millón de tokens, este diseño reduce a la mitad el cálculo por token en comparación con su predecesor. En consecuencia, el modelo acelera la velocidad de comprensión en más de 9 veces y aumenta la velocidad de generación de respuestas en más de 15 veces. La API ya está disponible, y el equipo oficial se compromete a publicar los pesos del modelo y los informes técnicos para los desarrolladores de todo el mundo en un plazo de 10 días.
India obliga a las aplicaciones de identificación de llamadas a compartir datos de spam con los operadores de telecomunicaciones
India ha ampliado sus regulaciones contra el spam para obligar a las aplicaciones de identificación de llamadas y gestión de llamadas a compartir los informes de spam de los usuarios con las operadoras de telecomunicaciones, una medida que ha llevado
La plataforma de IA Qwen amplía su matriz de modelos con el lanzamiento oficial de GLM-5.3 y DeepSeek-V4-Pro
La plataforma de inteligencia artificial Qwen de Alibaba Cloud (MaaS) ha ampliado recientemente su matriz de servicios de modelos, integrando el modelo grande insignia GLM-5.3 de Zhipu y el lanzamiento oficial de DeepSeek-V4-Pro. Los servicios API co
Por qué los agentes olvidan y se desvían en tareas largas: AWS, Claude Code y Manus desglosan cuatro marcos
Los modelos de lenguaje grandes pierden con frecuencia el enfoque durante operaciones prolongadas, desviándose de sus objetivos originales, un desafío persistente en el sector de los agentes inteligentes. El problema a menudo no proviene del modelo e











