Heim
Alibabas Qwen 3.5-Max erobert bei seinem sensationellen Debüt einen Platz unter den Top 5 weltweit
Chinas große Sprachmodelle haben auf der internationalen Bühne erneut Rekordergebnisse erzielt. Am 20. März stellte die Alibaba Qwen-Familie ihr neues Flaggschiff-Modell vor: das Qwen3.5-Max-Preview. Bei seinem Debüt auf der globalen LLM-Benchmark-Plattform LM Arena zog das Modell mit einer beeindruckenden Gesamtpunktzahl von 1464 Punkten sofort die Aufmerksamkeit der Branche auf sich.
Diese herausragende Leistung katapultierte Alibaba Tongyi Qianwen auf den fünften Platz im weltweiten Unternehmensranking der LM Arena und festigte damit seinen Status als führender chinesischer LLM-Anbieter. Dieser Meilenstein bedeutet, dass Chinas große Modelle nun an der Spitze des globalen Wettbewerbs stehen.

Die von der internationalen Open-Source-Forschungsgruppe LMSYS organisierte LM Arena gilt aufgrund ihres Bewertungsmechanismus mit „anonymen Wettkämpfen und Blindvoting“ weithin als einer der wertvollsten Benchmarks der Branche. Bei dieser Bewertung zeigte das Modell Qwen3.5-Max-Preview robuste und vielseitige Fähigkeiten:
Mathematisches Denken: Platz 5 weltweit, was fortgeschrittene logische Denkfähigkeiten demonstriert.
Gesamtleistung: Belegte weltweit den sechsten Platz in der Kategorie „absolute Gewinnquote“ ohne Stilanpassungen.
Aufgaben auf Expertenniveau: Eintreten in die weltweiten Top Ten bei der Bearbeitung komplexer Texte.

Laut Alibaba Cloud hat die Qwen3.5-Serie seit dem chinesischen Neujahrsfest acht Modelle unterschiedlicher Größe veröffentlicht, die von 0,8 Mrd. bis 397 Mrd. Parametern reichen. Das Flaggschiff Qwen3.5-Max-Preview stellt den Höhepunkt dieser Serie dar. Es baut auf dem Architekturprinzip „kleine Aktivierung, große Leistung“ auf und bietet Fähigkeiten, die denen einiger größerer Modelle entsprechen oder diese übertreffen, während die Betriebseffizienz gewahrt bleibt.
Das Modell ist derzeit als Vorschau verfügbar. Alibaba Cloud erklärte, dass auf der Grundlage des Feedbacks der Entwickler-Community fortlaufende Iterationen und Optimierungen vorgenommen werden, wie Tongyi Qianwen
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (2)
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔
Chinas große Sprachmodelle haben auf der internationalen Bühne erneut Rekordergebnisse erzielt. Am 20. März stellte die Alibaba Qwen-Familie ihr neues Flaggschiff-Modell vor: das Qwen3.5-Max-Preview. Bei seinem Debüt auf der globalen LLM-Benchmark-Plattform LM Arena zog das Modell mit einer beeindruckenden Gesamtpunktzahl von 1464 Punkten sofort die Aufmerksamkeit der Branche auf sich.
Diese herausragende Leistung katapultierte

Mathematisches Denken: Platz 5 weltweit, was fortgeschrittene logische Denkfähigkeiten demonstriert.
Gesamtleistung: Belegte weltweit den sechsten Platz in der Kategorie „absolute Gewinnquote“ ohne Stilanpassungen.
Aufgaben auf Expertenniveau: Eintreten in die weltweiten Top Ten bei der Bearbeitung komplexer Texte.

Laut
Das Modell ist derzeit als Vorschau verfügbar.
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔











