Hogar
MiniMax lanza en código abierto el modelo M3 Large con arquitectura MSA y 1 millón de entradas de contexto, que rivaliza con los modelos insignia extranjeros
MiniMax Xiyu Technology presentó su modelo de gran tamaño de última generación, el MiniMax M3, el 1 de junio de 2026. Se trata del primer modelo de código abierto de China que combina programación de élite, una ventana de contexto ultralarga de 1 millón de palabras y capacidades multimodales nativas, diseñado para rivalizar en todos los aspectos con los principales modelos de código cerrado extranjeros.

Para abordar los cuellos de botella de la expansión del contexto en tareas complejas de agentes, el M3 introduce una arquitectura de atención dispersa (MSA) a nivel de base. En comparación con los enfoques convencionales, ofrece una partición KV más precisa y optimizaciones a nivel de operador, alcanzando una velocidad computacional cuatro veces superior a la de soluciones de código abierto comparables. Con una longitud de contexto de 1 millón, el coste computacional por token se reduce a solo una décima parte del de la generación anterior. Acelera la etapa de prellenado más de 9 veces y la etapa de decodificación 15 veces.

A través del entrenamiento nativo de datos intercalados a escala de billones, el espacio semántico de M3 logra una profunda integración. Supera a GPT-5.5 y Gemini 3.1 Pro en evaluaciones autorizadas de ingeniería de software y multimodales como SWE-Bench Pro. En pruebas de tareas extremas, M3 demuestra una sólida planificación autónoma de hilos largos: reprodujo de forma independiente los experimentos de un artículo destacado de ICLR en 12 horas, funcionó 24 horas seguidas sin código de referencia mientras invocaba herramientas casi 2000 veces, aumentó la utilización del hardware de multiplicación de matrices FP8 en la arquitectura Hopper del 7,6 % al 71,3 %, y orquestó de forma autónoma el proceso completo de «iteración de entrenamiento de datos» en el PostTrainBench abierto.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Para abordar los cuellos de botella de la expansión del contexto en tareas complejas de agentes, el M3 introduce una arquitectura de atención dispersa (MSA) a nivel de base. En comparación con los enfoques convencionales, ofrece una partición KV más precisa y optimizaciones a nivel de operador, alcanzando una velocidad computacional cuatro veces superior a la de soluciones de código abierto comparables. Con una longitud de contexto de 1 millón, el coste computacional por token se reduce a solo una décima parte del de la generación anterior. Acelera la etapa de prellenado más de 9 veces y la etapa de decodificación 15 veces.

A través del entrenamiento nativo de datos intercalados a escala de billones, el espacio semántico de M3 logra una profunda integración. Supera a GPT-5.5 y Gemini 3.1 Pro en evaluaciones autorizadas de ingeniería de software y multimodales como SWE-Bench Pro. En pruebas de tareas extremas, M3 demuestra una sólida planificación autónoma de hilos largos: reprodujo de forma independiente los experimentos de un artículo destacado de ICLR en 12 horas, funcionó 24 horas seguidas sin código de referencia mientras invocaba herramientas casi 2000 veces, aumentó la utilización del hardware de multiplicación de matrices FP8 en la arquitectura Hopper del 7,6 % al 71,3 %, y orquestó de forma autónoma el proceso completo de «iteración de entrenamiento de datos» en el PostTrainBench abierto.
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en











