MiniMax apresenta o M3, um modelo de IA doméstico que supera o GPT-5.5
O setor de inteligência artificial da China testemunhou um grande salto tecnológico com o lançamento oficial do mais recente modelo de linguagem de grande escala da Xiyu Technology, o MiniMax M3. Este sistema avançado combina proficiência em codificação de última geração com suporte para uma janela de contexto ultra longa de até 1 milhão de tokens. Notavelmente, ele suporta nativamente entradas multimodais, incluindo processamento de imagens e vídeos, além de interação com desktops de computadores, tornando-o o primeiro modelo de código aberto na China a integrar essas três capacidades críticas.

Resultados Excepcionais em Benchmarks Padronizados
Na rigorosa avaliação de programação SWE-Bench Pro, o MiniMax M3 obteve uma pontuação de 59,0%, superando o GPT-5.5 e o Gemini 3.1 Pro, enquanto ficava muito próximo do topo do Opus 4.7. O modelo também demonstrou desempenho superior no teste Claw-Eval para capacidades de agentes de IA e alcançou as melhores pontuações no benchmark OmniDocBench de compreensão multimodal de documentos.
Arquitetura Avançada Aumenta a Eficiência
Por trás desse desempenho está a adoção pelo M3 de uma nova arquitetura de atenção esparsa (MSA). Ao lidar com contextos ultra longos de 1 milhão de tokens, este design reduz pela metade o cálculo por token em comparação com seu antecessor. Consequentemente, o modelo acelera a velocidade de compreensão em mais de 9 vezes e aumenta a velocidade de geração de respostas em mais de 15 vezes. A API já está ativa, com a equipe oficial comprometida a liberar os pesos do modelo e relatórios técnicos para desenvolvedores globais dentro de 10 dias.
Artigo relacionado
A Índia obriga aplicativos de identificação de chamadas a compartilhar dados de spam com operadoras de telecomunicações
A Índia ampliou suas regulamentações contra spam para obrigar aplicativos de identificação de chamadas e gerenciamento de chamadas a compartilhar relatórios de spam dos usuários com operadoras de telecomunicações, uma medida que levou a Truecaller, u
A plataforma de IA Qwen amplia sua matriz de modelos com o lançamento oficial do GLM-5.3 e do DeepSeek-V4-Pro
A plataforma de IA Qwen da Alibaba Cloud (MaaS) expandiu recentemente sua matriz de serviços de modelos, integrando o modelo principal GLM-5.3 da Zhipu e o lançamento oficial do DeepSeek-V4-Pro. Os serviços de API correspondentes estão agora disponív
Por que os Agentes Esquecem e Saiem do Caminho em Tarefas Longas: AWS, Claude Code e Manus Desvendam Quatro Estruturas
Os modelos de linguagem de grande porte frequentemente perdem o foco durante operações prolongadas, desviando-se de seus objetivos originais — um desafio persistente no setor de agentes inteligentes. O problema geralmente não decorre do próprio model
Recomendações de tópicos especiais relacionados
Comentários (0)
O setor de inteligência artificial da China testemunhou um grande salto tecnológico com o lançamento oficial do mais recente modelo de linguagem de grande escala da Xiyu Technology, o MiniMax M3. Este sistema avançado combina proficiência em codificação de última geração com suporte para uma janela de contexto ultra longa de até 1 milhão de tokens. Notavelmente, ele suporta nativamente entradas multimodais, incluindo processamento de imagens e vídeos, além de interação com desktops de computadores, tornando-o o primeiro modelo de código aberto na China a integrar essas três capacidades críticas.

Resultados Excepcionais em Benchmarks Padronizados
Na rigorosa avaliação de programação SWE-Bench Pro, o MiniMax M3 obteve uma pontuação de 59,0%, superando o GPT-5.5 e o Gemini 3.1 Pro, enquanto ficava muito próximo do topo do Opus 4.7. O modelo também demonstrou desempenho superior no teste Claw-Eval para capacidades de agentes de IA e alcançou as melhores pontuações no benchmark OmniDocBench de compreensão multimodal de documentos.
Arquitetura Avançada Aumenta a Eficiência
Por trás desse desempenho está a adoção pelo M3 de uma nova arquitetura de atenção esparsa (MSA). Ao lidar com contextos ultra longos de 1 milhão de tokens, este design reduz pela metade o cálculo por token em comparação com seu antecessor. Consequentemente, o modelo acelera a velocidade de compreensão em mais de 9 vezes e aumenta a velocidade de geração de respostas em mais de 15 vezes. A API já está ativa, com a equipe oficial comprometida a liberar os pesos do modelo e relatórios técnicos para desenvolvedores globais dentro de 10 dias.
A Índia obriga aplicativos de identificação de chamadas a compartilhar dados de spam com operadoras de telecomunicações
A Índia ampliou suas regulamentações contra spam para obrigar aplicativos de identificação de chamadas e gerenciamento de chamadas a compartilhar relatórios de spam dos usuários com operadoras de telecomunicações, uma medida que levou a Truecaller, u
A plataforma de IA Qwen amplia sua matriz de modelos com o lançamento oficial do GLM-5.3 e do DeepSeek-V4-Pro
A plataforma de IA Qwen da Alibaba Cloud (MaaS) expandiu recentemente sua matriz de serviços de modelos, integrando o modelo principal GLM-5.3 da Zhipu e o lançamento oficial do DeepSeek-V4-Pro. Os serviços de API correspondentes estão agora disponív
Por que os Agentes Esquecem e Saiem do Caminho em Tarefas Longas: AWS, Claude Code e Manus Desvendam Quatro Estruturas
Os modelos de linguagem de grande porte frequentemente perdem o foco durante operações prolongadas, desviando-se de seus objetivos originais — um desafio persistente no setor de agentes inteligentes. O problema geralmente não decorre do próprio model





Lar






