MiniMax stellt M3 vor, ein inländisches KI-Großmodell, das GPT-5.5 übertrifft.
Chinas KI-Branche hat einen bedeutenden technologischen Sprung vollzogen, mit der offiziellen Einführung des neuesten Large-Language-Modells von Xiyu Technology, MiniMax M3. Dieses fortschrittliche System kombiniert modernste Programmierfähigkeiten mit der Unterstützung eines extrem langen Kontextfensters von bis zu 1 Million Tokens. Bemerkenswerterweise unterstützt es nativ multimodale Eingaben, einschließlich Bild- und Videoverarbeitung, sowie die Interaktion mit Computerdesktops, was es zum ersten Open-Source-Modell in China macht, das diese drei kritischen Funktionen integriert.

Außergewöhnliche Ergebnisse in standardisierten Benchmarks
Bei der strengen SWE-Bench-Programmierungsbewertung erzielte MiniMax M3 einen Score von 59,0 %, übertraf damit GPT-5.5 und Gemini 3.1 Pro und lag knapp hinter dem Top-Modell Opus 4.7 zurück. Das Modell zeigte auch überlegene Leistungen im Claw-Eval-Test für KI-Agenten-Fähigkeiten und erreichte führende Scores auf dem OmniDocBench-Benchmark für multimodales Dokumentenverständnis.
Fortschrittliche Architektur erhöht Effizienz
Diese Leistung wird durch M3s Einführung einer neuartigen sparsamen Aufmerksamkeitsarchitektur (MSA) ermöglicht. Bei der Verarbeitung extrem langer Kontexte von 1 Million Tokens reduziert dieses Design die Berechnung pro Token im Vergleich zu seinem Vorgänger um die Hälfte. Infolgedessen beschleunigt das Modell die Verständnisgeschwindigkeit um mehr als das Neunfache und erhöht die Antwortgenerierungsgeschwindigkeit um über das 15-fache. Die API ist nun live, und das offizielle Team verpflichtet sich, Modellgewichte und technische Berichte für globale Entwickler innerhalb von 10 Tagen freizugeben.
Verwandter Artikel
Indien verpflichtet Caller-ID-Apps zur Weitergabe von Spam-Daten an Telekommunikationsanbieter
Indien hat seine Anti-Spam-Vorschriften erweitert, um vorzuschreiben, dass Caller-ID- und Call-Management-Anwendungen Nutzer-Spamberichte mit Telekommunikationsanbietern teilen, ein Schritt, der dazu geführt hat, dass Truecaller, ein bekannter Anbiet
Qwen-KI-Plattform erweitert Modellmatrix mit offizieller Einführung von GLM-5.3 und DeepSeek-V4-Pro
Die Alibaba Cloud Qwen AI-Plattform (MaaS) hat kürzlich ihre Modellservicematrix erweitert und das Flaggschiff-Großmodell GLM-5.3 von Zhipu sowie die offizielle Veröffentlichung von DeepSeek-V4-Pro integriert. Die entsprechenden API-Dienste sind nun
Warum Agenten in langen Aufgaben vergessen und vom Kurs abkommen: AWS, Claude Code und Manus entpacken vier Frameworks
Große Sprachmodelle verlieren häufig den Fokus während längerer Operationen und entfernen sich von ihren ursprünglichen Zielen – eine anhaltende Herausforderung im Bereich der intelligenten Agenten. Das Problem resultiert oft nicht aus dem Modell sel
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Chinas KI-Branche hat einen bedeutenden technologischen Sprung vollzogen, mit der offiziellen Einführung des neuesten Large-Language-Modells von Xiyu Technology, MiniMax M3. Dieses fortschrittliche System kombiniert modernste Programmierfähigkeiten mit der Unterstützung eines extrem langen Kontextfensters von bis zu 1 Million Tokens. Bemerkenswerterweise unterstützt es nativ multimodale Eingaben, einschließlich Bild- und Videoverarbeitung, sowie die Interaktion mit Computerdesktops, was es zum ersten Open-Source-Modell in China macht, das diese drei kritischen Funktionen integriert.

Außergewöhnliche Ergebnisse in standardisierten Benchmarks
Bei der strengen SWE-Bench-Programmierungsbewertung erzielte MiniMax M3 einen Score von 59,0 %, übertraf damit GPT-5.5 und Gemini 3.1 Pro und lag knapp hinter dem Top-Modell Opus 4.7 zurück. Das Modell zeigte auch überlegene Leistungen im Claw-Eval-Test für KI-Agenten-Fähigkeiten und erreichte führende Scores auf dem OmniDocBench-Benchmark für multimodales Dokumentenverständnis.
Fortschrittliche Architektur erhöht Effizienz
Diese Leistung wird durch M3s Einführung einer neuartigen sparsamen Aufmerksamkeitsarchitektur (MSA) ermöglicht. Bei der Verarbeitung extrem langer Kontexte von 1 Million Tokens reduziert dieses Design die Berechnung pro Token im Vergleich zu seinem Vorgänger um die Hälfte. Infolgedessen beschleunigt das Modell die Verständnisgeschwindigkeit um mehr als das Neunfache und erhöht die Antwortgenerierungsgeschwindigkeit um über das 15-fache. Die API ist nun live, und das offizielle Team verpflichtet sich, Modellgewichte und technische Berichte für globale Entwickler innerhalb von 10 Tagen freizugeben.
Indien verpflichtet Caller-ID-Apps zur Weitergabe von Spam-Daten an Telekommunikationsanbieter
Indien hat seine Anti-Spam-Vorschriften erweitert, um vorzuschreiben, dass Caller-ID- und Call-Management-Anwendungen Nutzer-Spamberichte mit Telekommunikationsanbietern teilen, ein Schritt, der dazu geführt hat, dass Truecaller, ein bekannter Anbiet
Qwen-KI-Plattform erweitert Modellmatrix mit offizieller Einführung von GLM-5.3 und DeepSeek-V4-Pro
Die Alibaba Cloud Qwen AI-Plattform (MaaS) hat kürzlich ihre Modellservicematrix erweitert und das Flaggschiff-Großmodell GLM-5.3 von Zhipu sowie die offizielle Veröffentlichung von DeepSeek-V4-Pro integriert. Die entsprechenden API-Dienste sind nun
Warum Agenten in langen Aufgaben vergessen und vom Kurs abkommen: AWS, Claude Code und Manus entpacken vier Frameworks
Große Sprachmodelle verlieren häufig den Fokus während längerer Operationen und entfernen sich von ihren ursprünglichen Zielen – eine anhaltende Herausforderung im Bereich der intelligenten Agenten. Das Problem resultiert oft nicht aus dem Modell sel





Heim






