Heim
Alibaba Tuhao M890 debütiert mit dreifacher Leistungsfähigkeit und markiert den Beginn der Ära der vollständig integrierten Agenten für das Chip-Cloud-Modell-Inferenz-Verfahren.

Am 20. Mai 2026 kündigte Alibaba Cloud auf dem Alibaba Cloud Summit die Fertigstellung eines umfassenden Upgrades des Technologiesystems an, das speziell für die Ära der Agenten entwickelt wurde. Diese Umstrukturierung prägte den gesamten Prozess – von den zugrundeliegenden Chips und der Cloud-Plattform über die Modelle bis hin zu den Inferenzlösungen. Dadurch positioniert sich Alibaba Cloud als eine „AI-Fabrik“, die es ermöglicht, massive Agenten rund um die Uhr kontinuierlich betreiben zu können – und geht damit über die direkte Unterstützung menschlicher Nutzer hinaus.
1. Kernbasis: Tengxun Zhenwu M890-Chip und Super Node Server
Im Kern dieses Upgrades steht der nächste Generation AI-Chip von Tengxun, der Zhenwu M890, der sowohl das Training als auch die Inferenz in einem Chip integriert.
Leistungsverbesserung: Der M890 verfügt über 144 GB Arbeitsspeicher und bietet eine dreifache Leistung im Vergleich zu seinem Vorgänger, dem Zhenwu 810E. Er unterstützt nativ eine Reihe von Datengenauigkeitsstufen von FP32 bis FP4, was ihn ideal für hochpräzises Training sowie ultraschlanke Inferenz in Agentenszenarien macht.
Durchbruch bei der Cluster-Vernetzung: Durch die Integration mit dem proprietären ICN Switch 1.0-Vernetzungschip stellte Alibaba Cloud den Panjiu AL128 Super Node Server vor, der auf dem Zhenwu M890 basiert. Dieser Server koordiniert auf Systemebene Speicher-, Rechen- und Netzwerkfunktionen von 128 AI-Chips und erreicht dabei Nanosekunden-Level bei der Kommunikationsverzögerung – was die Effizienz und Stabilität großer intelligenter Rechencluster erheblich verbessert.
Zukunftspläne: Tengxun gab erstmals den Roadmap für die Zhenwu-Serie von Chips bekannt und bestätigte, dass der Zhenwu V900 und der Zhenwu J900 in den nächsten zwei Jahren auf den Markt kommen werden. Damit unterstreicht das Unternehmen seine langfristige Wettbewerbsfähigkeit auf dem Markt für Rechenzentren.
2. Kernzugangspunkt: Neu gestaltete „Qwen Cloud“ und agentenzentrierte Interaktion
Alibaba Cloud hat die Logik der Cloud-Interaktion grundlegend verändert. Während herkömmliche Cloud-Plattformen für Menschen entwickelt wurden – mit Kontrollpaneelen und Dashboards – muss die Cloud der Ära der Agenten speziell für Agenten konzipiert werden.
AI-natives Webportal „Qwen Cloud“: Das AI-native Webportal Qwen Cloud ersetzt den traditionellen, komplexen Produktkatalog durch einen standardisierten Skills-Installationscode. Agenten können diese Codeanweisungen direkt interpretieren und so selbstständig Rechen-, Speicher- und Modelfunktionen aufrufen – ohne dass eine manuelle Konfiguration der Kontrollpaneele erforderlich ist.
Standardisierung der Funktionen: Alibaba Cloud hat über 150 gängige Modelle und Cloud-Produktfunktionen in standardisierte Skills und CLI-Tools verpackt. Mit nur einer einzigen Befehlszeile können Tools wie Claude Code sowie gängige Agenten-Frameworks schnell alle Infrastrukturfunktionen von Alibaba Cloud installieren und nutzen.
3. Technische Strategie: Vollständige Integration von Chip, Cloud, Modell und Inferenz
Dieses neue System ist darauf ausgelegt, die besonderen Herausforderungen von Agentenworkloads zu bewältigen – Workloads, die durch unregelmäßige Flexibilität, kurze Lebenszyklen und extrem hohe zeitliche Konkurrenz gekennzeichnet sind.
Tiefgreifende Optimierung: Alibaba Cloud bietet nicht nur Modelle wie den Flaggschiff-Modell Qwen3.7-Max an, sondern erreicht auch eine optimale Planung der Rechenressourcen durch die tiefe Integration der zugrundeliegenden Zhenwu-Serie-Chips mit dem Inferenzframework.
Veränderung der Ziele: Wie Alibaba Clouds CTO Feifei Li und andere Experten betonten, hat sich der Fokus großer Modelle von der Anpassung an menschliche Präferenzen – also darin, Dinge „gut zu sagen“ – auf die Erfüllung von Aufgabenzielen verlagert. Die gesamte Systementwicklung stellt sicher, dass Agenten komplexe Ingenieuraufgaben in Millisekunden effizient erledigen können – was die Hürden für den Einsatz von KI in verschiedenen Branchen senkt.
Zusammenfassung:
Durch die Kombination seiner Tengxun-Chip-Matrix mit dem Qwen Cloud-Zugangspunkt sowie einer vollständig integrierten Modell-Inferenz-Struktur ist Alibaba Cloud der erste Anbieter in der Branche, der sich von einem Anbieter von Rechenleistung zur „AI-Fabrik“ entwickelt hat. Dieses System bietet nicht nur die Infrastruktur, um das explosive Wachstum von Agenten zu unterstützen, sondern zeigt auch den Ehrgeiz chinesischer Technologieführer darin, durch die Zusammenarbeit von Hardware und Software in der Ära der Agenten die globale Produktivität weiter voranzutreiben.
Verwandter Artikel
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Am 20. Mai 2026 kündigte Alibaba Cloud auf dem Alibaba Cloud Summit die Fertigstellung eines umfassenden Upgrades des Technologiesystems an, das speziell für die Ära der Agenten entwickelt wurde. Diese Umstrukturierung prägte den gesamten Prozess – von den zugrundeliegenden Chips und der Cloud-Plattform über die Modelle bis hin zu den Inferenzlösungen. Dadurch positioniert sich Alibaba Cloud als eine „AI-Fabrik“, die es ermöglicht, massive Agenten rund um die Uhr kontinuierlich betreiben zu können – und geht damit über die direkte Unterstützung menschlicher Nutzer hinaus.
1. Kernbasis: Tengxun Zhenwu M890-Chip und Super Node Server
Im Kern dieses Upgrades steht der nächste Generation AI-Chip von Tengxun, der Zhenwu M890, der sowohl das Training als auch die Inferenz in einem Chip integriert.
Leistungsverbesserung: Der M890 verfügt über 144 GB Arbeitsspeicher und bietet eine dreifache Leistung im Vergleich zu seinem Vorgänger, dem Zhenwu 810E. Er unterstützt nativ eine Reihe von Datengenauigkeitsstufen von FP32 bis FP4, was ihn ideal für hochpräzises Training sowie ultraschlanke Inferenz in Agentenszenarien macht.
Durchbruch bei der Cluster-Vernetzung: Durch die Integration mit dem proprietären ICN Switch 1.0-Vernetzungschip stellte Alibaba Cloud den Panjiu AL128 Super Node Server vor, der auf dem Zhenwu M890 basiert. Dieser Server koordiniert auf Systemebene Speicher-, Rechen- und Netzwerkfunktionen von 128 AI-Chips und erreicht dabei Nanosekunden-Level bei der Kommunikationsverzögerung – was die Effizienz und Stabilität großer intelligenter Rechencluster erheblich verbessert.
Zukunftspläne: Tengxun gab erstmals den Roadmap für die Zhenwu-Serie von Chips bekannt und bestätigte, dass der Zhenwu V900 und der Zhenwu J900 in den nächsten zwei Jahren auf den Markt kommen werden. Damit unterstreicht das Unternehmen seine langfristige Wettbewerbsfähigkeit auf dem Markt für Rechenzentren.
2. Kernzugangspunkt: Neu gestaltete „Qwen Cloud“ und agentenzentrierte Interaktion
Alibaba Cloud hat die Logik der Cloud-Interaktion grundlegend verändert. Während herkömmliche Cloud-Plattformen für Menschen entwickelt wurden – mit Kontrollpaneelen und Dashboards – muss die Cloud der Ära der Agenten speziell für Agenten konzipiert werden.
AI-natives Webportal „Qwen Cloud“: Das AI-native Webportal Qwen Cloud ersetzt den traditionellen, komplexen Produktkatalog durch einen standardisierten Skills-Installationscode. Agenten können diese Codeanweisungen direkt interpretieren und so selbstständig Rechen-, Speicher- und Modelfunktionen aufrufen – ohne dass eine manuelle Konfiguration der Kontrollpaneele erforderlich ist.
Standardisierung der Funktionen: Alibaba Cloud hat über 150 gängige Modelle und Cloud-Produktfunktionen in standardisierte Skills und CLI-Tools verpackt. Mit nur einer einzigen Befehlszeile können Tools wie Claude Code sowie gängige Agenten-Frameworks schnell alle Infrastrukturfunktionen von Alibaba Cloud installieren und nutzen.
3. Technische Strategie: Vollständige Integration von Chip, Cloud, Modell und Inferenz
Dieses neue System ist darauf ausgelegt, die besonderen Herausforderungen von Agentenworkloads zu bewältigen – Workloads, die durch unregelmäßige Flexibilität, kurze Lebenszyklen und extrem hohe zeitliche Konkurrenz gekennzeichnet sind.
Tiefgreifende Optimierung: Alibaba Cloud bietet nicht nur Modelle wie den Flaggschiff-Modell Qwen3.7-Max an, sondern erreicht auch eine optimale Planung der Rechenressourcen durch die tiefe Integration der zugrundeliegenden Zhenwu-Serie-Chips mit dem Inferenzframework.
Veränderung der Ziele: Wie Alibaba Clouds CTO Feifei Li und andere Experten betonten, hat sich der Fokus großer Modelle von der Anpassung an menschliche Präferenzen – also darin, Dinge „gut zu sagen“ – auf die Erfüllung von Aufgabenzielen verlagert. Die gesamte Systementwicklung stellt sicher, dass Agenten komplexe Ingenieuraufgaben in Millisekunden effizient erledigen können – was die Hürden für den Einsatz von KI in verschiedenen Branchen senkt.
Zusammenfassung:
Durch die Kombination seiner Tengxun-Chip-Matrix mit dem Qwen Cloud-Zugangspunkt sowie einer vollständig integrierten Modell-Inferenz-Struktur ist Alibaba Cloud der erste Anbieter in der Branche, der sich von einem Anbieter von Rechenleistung zur „AI-Fabrik“ entwickelt hat. Dieses System bietet nicht nur die Infrastruktur, um das explosive Wachstum von Agenten zu unterstützen, sondern zeigt auch den Ehrgeiz chinesischer Technologieführer darin, durch die Zusammenarbeit von Hardware und Software in der Ära der Agenten die globale Produktivität weiter voranzutreiben.
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe











