Heim
Der Durchbruch bei der Moortech S5000-GPU treibt das KI-Modell „Jiutian“ von China Mobile an
Auf dem bevorstehenden 9. Digital China Summit wird das von China Mobile selbst entwickelte universelle Großsprachenmodell „Jiutian“ 35B erstmals der Öffentlichkeit vorgestellt. Als bedeutender Fortschritt für das heimische Computing-Ökosystem gab Moore Threads kürzlich bekannt, dass seine Flaggschiff-GPU mit vollem Funktionsumfang, die MTT S5000, die vollständige Prozessanpassung und Inferenzverifizierung für dieses Modell abgeschlossen hat.
Der Kern dieser Anpassung liegt in der tiefen Integration. Unter Nutzung seines proprietären MUSA-Software-Stacks und der hochleistungsfähigen Inferenz-Engine SGLang-MUSA hat Moore Threads die gesamte Inferenz-Pipeline für das „Jiutian“-35B-Modell erfolgreich implementiert. Durch die gemeinsame Optimierung des MUSA-C-Entwicklungsframeworks, der muDNN-Computing-Bibliothek und der Open-Source-MATE-Operator-Bibliothek wurde die MTT S5000 genau auf die spezifischen Aufmerksamkeitsmechanismen und Anforderungen an die Inferenz langer Sequenzen großer Modelle abgestimmt. Dies gewährleistet eine effiziente und stabile Leistung bei der Verarbeitung langer Texte und der Bearbeitung von Anfragen mit hoher Parallelität.

Die MTT S5000-Rechenkarte, die als technische Grundlage für diese Anpassung dient, hat außergewöhnliche Fähigkeiten unter Beweis gestellt. Basierend auf der MUSA-„Pinghu“-Architektur der vierten Generation liefert diese GPU eine maximale KI-Dichte-Rechenleistung von bis zu 1000 TFLOPS pro Karte. Ihre Hardwarekonfiguration umfasst 80 GB hochkapazitiven VRAM mit einer Speicherbandbreite von 1,6 TB/s und unterstützt Vollpräzisionsberechnungen von FP8 bis FP64. Darüber hinaus gewährleistet eine hohe Inter-Card-Verbindungsbandbreite von 784 GB/s eine hervorragende Skalierbarkeit in komplexen intelligenten Rechenszenarien.
Diese Zusammenarbeit bestätigt nicht nur die Zuverlässigkeit einheimischer GPUs bei der Unterstützung zentraler Großmodelle staatlicher Unternehmen, sondern unterstreicht auch die Reife von Moore Threads bei der Optimierung für Hochleistungsbetreiber und der Entwicklung eines Software-Ökosystems. Mit der offiziellen Einführung des „Jiutian“-35B-Modells liefert diese Kombination aus „einheimischem Großmodell + einheimischer Rechenleistung“ ein äußerst relevantes Praxisbeispiel für die Verwirklichung einer unabhängigen und kontrollierbaren Recheninfrastruktur.
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Auf dem bevorstehenden 9. Digital China Summit wird das von China Mobile selbst entwickelte universelle Großsprachenmodell „Jiutian“ 35B erstmals der Öffentlichkeit vorgestellt. Als bedeutender Fortschritt für das heimische Computing-Ökosystem gab Moore Threads kürzlich bekannt, dass seine Flaggschiff-GPU mit vollem Funktionsumfang, die MTT S5000, die vollständige Prozessanpassung und Inferenzverifizierung für dieses Modell abgeschlossen hat.
Der Kern dieser Anpassung liegt in der tiefen Integration. Unter Nutzung seines proprietären MUSA-Software-Stacks und der hochleistungsfähigen Inferenz-Engine SGLang-MUSA hat Moore Threads die gesamte Inferenz-Pipeline für das „Jiutian“-35B-Modell erfolgreich implementiert. Durch die gemeinsame Optimierung des MUSA-C-Entwicklungsframeworks, der muDNN-Computing-Bibliothek und der Open-Source-MATE-Operator-Bibliothek wurde die MTT S5000 genau auf die spezifischen Aufmerksamkeitsmechanismen und Anforderungen an die Inferenz langer Sequenzen großer Modelle abgestimmt. Dies gewährleistet eine effiziente und stabile Leistung bei der Verarbeitung langer Texte und der Bearbeitung von Anfragen mit hoher Parallelität.

Die MTT S5000-Rechenkarte, die als technische Grundlage für diese Anpassung dient, hat außergewöhnliche Fähigkeiten unter Beweis gestellt. Basierend auf der MUSA-„Pinghu“-Architektur der vierten Generation liefert diese GPU eine maximale KI-Dichte-Rechenleistung von bis zu 1000 TFLOPS pro Karte. Ihre Hardwarekonfiguration umfasst 80 GB hochkapazitiven VRAM mit einer Speicherbandbreite von 1,6 TB/s und unterstützt Vollpräzisionsberechnungen von FP8 bis FP64. Darüber hinaus gewährleistet eine hohe Inter-Card-Verbindungsbandbreite von 784 GB/s eine hervorragende Skalierbarkeit in komplexen intelligenten Rechenszenarien.
Diese Zusammenarbeit bestätigt nicht nur die Zuverlässigkeit einheimischer GPUs bei der Unterstützung zentraler Großmodelle staatlicher Unternehmen, sondern unterstreicht auch die Reife von Moore Threads bei der Optimierung für Hochleistungsbetreiber und der Entwicklung eines Software-Ökosystems. Mit der offiziellen Einführung des „Jiutian“-35B-Modells liefert diese Kombination aus „einheimischem Großmodell + einheimischer Rechenleistung“ ein äußerst relevantes Praxisbeispiel für die Verwirklichung einer unabhängigen und kontrollierbaren Recheninfrastruktur.
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











