Heim
Alibaba Tuhao M890 debütiert mit dreifacher Leistungsfähigkeit und markiert den Beginn der Ära der vollständig integrierten Agenten für das Chip-Cloud-Modell-Inferenz-Verfahren.

Am 20. Mai 2026 kündigte Alibaba Cloud auf dem Alibaba Cloud Summit die Fertigstellung eines umfassenden Upgrades des Technologiesystems an, das speziell für die Ära der Agenten entwickelt wurde. Diese Umstrukturierung prägte den gesamten Prozess – von den zugrundeliegenden Chips und der Cloud-Plattform über die Modelle bis hin zu den Inferenzlösungen. Dadurch positioniert sich Alibaba Cloud als eine „AI-Fabrik“, die es ermöglicht, massive Agenten rund um die Uhr kontinuierlich betreiben zu können – und geht damit über die direkte Unterstützung menschlicher Nutzer hinaus.
1. Kernbasis: Tengxun Zhenwu M890-Chip und Super Node Server
Im Kern dieses Upgrades steht der nächste Generation AI-Chip von Tengxun, der Zhenwu M890, der sowohl das Training als auch die Inferenz in einem Chip integriert.
Leistungsverbesserung: Der M890 verfügt über 144 GB Arbeitsspeicher und bietet eine dreifache Leistung im Vergleich zu seinem Vorgänger, dem Zhenwu 810E. Er unterstützt nativ eine Reihe von Datengenauigkeitsstufen von FP32 bis FP4, was ihn ideal für hochpräzises Training sowie ultraschlanke Inferenz in Agentenszenarien macht.
Durchbruch bei der Cluster-Vernetzung: Durch die Integration mit dem proprietären ICN Switch 1.0-Vernetzungschip stellte Alibaba Cloud den Panjiu AL128 Super Node Server vor, der auf dem Zhenwu M890 basiert. Dieser Server koordiniert auf Systemebene Speicher-, Rechen- und Netzwerkfunktionen von 128 AI-Chips und erreicht dabei Nanosekunden-Level bei der Kommunikationsverzögerung – was die Effizienz und Stabilität großer intelligenter Rechencluster erheblich verbessert.
Zukunftspläne: Tengxun gab erstmals den Roadmap für die Zhenwu-Serie von Chips bekannt und bestätigte, dass der Zhenwu V900 und der Zhenwu J900 in den nächsten zwei Jahren auf den Markt kommen werden. Damit unterstreicht das Unternehmen seine langfristige Wettbewerbsfähigkeit auf dem Markt für Rechenzentren.
2. Kernzugangspunkt: Neu gestaltete „Qwen Cloud“ und agentenzentrierte Interaktion
Alibaba Cloud hat die Logik der Cloud-Interaktion grundlegend verändert. Während herkömmliche Cloud-Plattformen für Menschen entwickelt wurden – mit Kontrollpaneelen und Dashboards – muss die Cloud der Ära der Agenten speziell für Agenten konzipiert werden.
AI-natives Webportal „Qwen Cloud“: Das AI-native Webportal Qwen Cloud ersetzt den traditionellen, komplexen Produktkatalog durch einen standardisierten Skills-Installationscode. Agenten können diese Codeanweisungen direkt interpretieren und so selbstständig Rechen-, Speicher- und Modelfunktionen aufrufen – ohne dass eine manuelle Konfiguration der Kontrollpaneele erforderlich ist.
Standardisierung der Funktionen: Alibaba Cloud hat über 150 gängige Modelle und Cloud-Produktfunktionen in standardisierte Skills und CLI-Tools verpackt. Mit nur einer einzigen Befehlszeile können Tools wie Claude Code sowie gängige Agenten-Frameworks schnell alle Infrastrukturfunktionen von Alibaba Cloud installieren und nutzen.
3. Technische Strategie: Vollständige Integration von Chip, Cloud, Modell und Inferenz
Dieses neue System ist darauf ausgelegt, die besonderen Herausforderungen von Agentenworkloads zu bewältigen – Workloads, die durch unregelmäßige Flexibilität, kurze Lebenszyklen und extrem hohe zeitliche Konkurrenz gekennzeichnet sind.
Tiefgreifende Optimierung: Alibaba Cloud bietet nicht nur Modelle wie den Flaggschiff-Modell Qwen3.7-Max an, sondern erreicht auch eine optimale Planung der Rechenressourcen durch die tiefe Integration der zugrundeliegenden Zhenwu-Serie-Chips mit dem Inferenzframework.
Veränderung der Ziele: Wie Alibaba Clouds CTO Feifei Li und andere Experten betonten, hat sich der Fokus großer Modelle von der Anpassung an menschliche Präferenzen – also darin, Dinge „gut zu sagen“ – auf die Erfüllung von Aufgabenzielen verlagert. Die gesamte Systementwicklung stellt sicher, dass Agenten komplexe Ingenieuraufgaben in Millisekunden effizient erledigen können – was die Hürden für den Einsatz von KI in verschiedenen Branchen senkt.
Zusammenfassung:
Durch die Kombination seiner Tengxun-Chip-Matrix mit dem Qwen Cloud-Zugangspunkt sowie einer vollständig integrierten Modell-Inferenz-Struktur ist Alibaba Cloud der erste Anbieter in der Branche, der sich von einem Anbieter von Rechenleistung zur „AI-Fabrik“ entwickelt hat. Dieses System bietet nicht nur die Infrastruktur, um das explosive Wachstum von Agenten zu unterstützen, sondern zeigt auch den Ehrgeiz chinesischer Technologieführer darin, durch die Zusammenarbeit von Hardware und Software in der Ära der Agenten die globale Produktivität weiter voranzutreiben.
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Am 20. Mai 2026 kündigte Alibaba Cloud auf dem Alibaba Cloud Summit die Fertigstellung eines umfassenden Upgrades des Technologiesystems an, das speziell für die Ära der Agenten entwickelt wurde. Diese Umstrukturierung prägte den gesamten Prozess – von den zugrundeliegenden Chips und der Cloud-Plattform über die Modelle bis hin zu den Inferenzlösungen. Dadurch positioniert sich Alibaba Cloud als eine „AI-Fabrik“, die es ermöglicht, massive Agenten rund um die Uhr kontinuierlich betreiben zu können – und geht damit über die direkte Unterstützung menschlicher Nutzer hinaus.
1. Kernbasis: Tengxun Zhenwu M890-Chip und Super Node Server
Im Kern dieses Upgrades steht der nächste Generation AI-Chip von Tengxun, der Zhenwu M890, der sowohl das Training als auch die Inferenz in einem Chip integriert.
Leistungsverbesserung: Der M890 verfügt über 144 GB Arbeitsspeicher und bietet eine dreifache Leistung im Vergleich zu seinem Vorgänger, dem Zhenwu 810E. Er unterstützt nativ eine Reihe von Datengenauigkeitsstufen von FP32 bis FP4, was ihn ideal für hochpräzises Training sowie ultraschlanke Inferenz in Agentenszenarien macht.
Durchbruch bei der Cluster-Vernetzung: Durch die Integration mit dem proprietären ICN Switch 1.0-Vernetzungschip stellte Alibaba Cloud den Panjiu AL128 Super Node Server vor, der auf dem Zhenwu M890 basiert. Dieser Server koordiniert auf Systemebene Speicher-, Rechen- und Netzwerkfunktionen von 128 AI-Chips und erreicht dabei Nanosekunden-Level bei der Kommunikationsverzögerung – was die Effizienz und Stabilität großer intelligenter Rechencluster erheblich verbessert.
Zukunftspläne: Tengxun gab erstmals den Roadmap für die Zhenwu-Serie von Chips bekannt und bestätigte, dass der Zhenwu V900 und der Zhenwu J900 in den nächsten zwei Jahren auf den Markt kommen werden. Damit unterstreicht das Unternehmen seine langfristige Wettbewerbsfähigkeit auf dem Markt für Rechenzentren.
2. Kernzugangspunkt: Neu gestaltete „Qwen Cloud“ und agentenzentrierte Interaktion
Alibaba Cloud hat die Logik der Cloud-Interaktion grundlegend verändert. Während herkömmliche Cloud-Plattformen für Menschen entwickelt wurden – mit Kontrollpaneelen und Dashboards – muss die Cloud der Ära der Agenten speziell für Agenten konzipiert werden.
AI-natives Webportal „Qwen Cloud“: Das AI-native Webportal Qwen Cloud ersetzt den traditionellen, komplexen Produktkatalog durch einen standardisierten Skills-Installationscode. Agenten können diese Codeanweisungen direkt interpretieren und so selbstständig Rechen-, Speicher- und Modelfunktionen aufrufen – ohne dass eine manuelle Konfiguration der Kontrollpaneele erforderlich ist.
Standardisierung der Funktionen: Alibaba Cloud hat über 150 gängige Modelle und Cloud-Produktfunktionen in standardisierte Skills und CLI-Tools verpackt. Mit nur einer einzigen Befehlszeile können Tools wie Claude Code sowie gängige Agenten-Frameworks schnell alle Infrastrukturfunktionen von Alibaba Cloud installieren und nutzen.
3. Technische Strategie: Vollständige Integration von Chip, Cloud, Modell und Inferenz
Dieses neue System ist darauf ausgelegt, die besonderen Herausforderungen von Agentenworkloads zu bewältigen – Workloads, die durch unregelmäßige Flexibilität, kurze Lebenszyklen und extrem hohe zeitliche Konkurrenz gekennzeichnet sind.
Tiefgreifende Optimierung: Alibaba Cloud bietet nicht nur Modelle wie den Flaggschiff-Modell Qwen3.7-Max an, sondern erreicht auch eine optimale Planung der Rechenressourcen durch die tiefe Integration der zugrundeliegenden Zhenwu-Serie-Chips mit dem Inferenzframework.
Veränderung der Ziele: Wie Alibaba Clouds CTO Feifei Li und andere Experten betonten, hat sich der Fokus großer Modelle von der Anpassung an menschliche Präferenzen – also darin, Dinge „gut zu sagen“ – auf die Erfüllung von Aufgabenzielen verlagert. Die gesamte Systementwicklung stellt sicher, dass Agenten komplexe Ingenieuraufgaben in Millisekunden effizient erledigen können – was die Hürden für den Einsatz von KI in verschiedenen Branchen senkt.
Zusammenfassung:
Durch die Kombination seiner Tengxun-Chip-Matrix mit dem Qwen Cloud-Zugangspunkt sowie einer vollständig integrierten Modell-Inferenz-Struktur ist Alibaba Cloud der erste Anbieter in der Branche, der sich von einem Anbieter von Rechenleistung zur „AI-Fabrik“ entwickelt hat. Dieses System bietet nicht nur die Infrastruktur, um das explosive Wachstum von Agenten zu unterstützen, sondern zeigt auch den Ehrgeiz chinesischer Technologieführer darin, durch die Zusammenarbeit von Hardware und Software in der Ära der Agenten die globale Produktivität weiter voranzutreiben.
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











