Microsoft stellt einen leistungsstarken neuen AI-Inferenz-Chip vor

Microsoft hat seinen neuesten Chip, den Maia 200, vorgestellt und ihn als einen leistungsstarken Silizium-Chip bezeichnet, der speziell für die Skalierung von KI-Berechnungen entwickelt wurde.
Als Nachfolger des im Jahr 2023 veröffentlichten Maia 100 ist der Maia 200 so konzipiert, dass er fortgeschrittene KI-Modelle mit höherer Geschwindigkeit und Effizienz ausführen kann. Er verfügt über mehr als 100 Milliarden Transistoren und erreicht bei einer 4-Bit-Genauigkeit über 10 Petaflops sowie bei einer 8-Bit-Genauigkeit etwa 5 Petaflops – ein bedeutender Fortschritt im Vergleich zu seinem Vorgänger.
Die Berechnung von KI-Modellen ist ein Prozess, bei dem das Modell ausgeführt wird, im Gegensatz zur Schulung desselben. Da sich KI-Unternehmen weiterentwickeln, machen die Kosten für diese Berechnungen heute einen immer größeren Anteil der Gesamtbetriebskosten aus, was zu neuen Bemühungen führt, diesen Prozess zu optimieren.
Microsoft strebt an, dass der Maia 200 diese Optimierungen unterstützt und es KI-Unternehmen ermöglicht, mit weniger Störungen und bei geringerer Energieverbrauch zu arbeiten. „Praktisch gesehen kann ein einzelner Maia 200-Chip mühelos die größten heutigen Modelle ausführen und bietet auch genügend Leistungsfähigkeit für noch größere Modelle in der Zukunft“, so das Unternehmen.
Microsofts neuer Chip entspricht auch einer allgemeinen Tendenz unter den Technologiegiganten, ihre eigenen Silizium-Chips zu entwickeln, um ihre Abhängigkeit von Nvidia zu verringern. Denn Nvidias fortschrittliche GPUs sind für den Erfolg der KI-Branche unerlässlich. Google bietet beispielsweise seinen TPU als cloud-basierte Rechenleistung an, anstatt Chips direkt zu verkaufen. Amazon hingegen verwendet seinen Trainium-KI-Akzelerator; die neueste Version, Trainium3, wurde im Dezember veröffentlicht. Diese Chips übernehmen einen Teil der Rechenaufgaben von Nvidias GPUs, wodurch die Gesamthaushaltskosten für Hardware gesenkt werden.
Mit dem Maia positioniert sich Microsoft konkurrenzfähig gegenüber diesen Alternativen. In seiner Pressemitteilung am Montag erklärte das Unternehmen, dass der Maia dreimal so leistungsfähig wie die dritten Generationen von Amazons Trainium-Chips ist und in der FP8-Leistung sogar den siebten Generationen von Googles TPU übertrifft.
Microsoft gibt an, dass der Maia bereits die KI-Modelle seines Superintelligence-Teams antreibt sowie seinen Chatbot Copilot unterstützt. Ab Montag hat das Unternehmen Entwickler, Wissenschaftler und führende KI-Labore eingeladen, das Softwareentwicklungstool für den Maia 200 in ihren Projekten zu verwenden.
Techcrunch Event
Disrupt 2026 Tickets: Exklusives Einmalangebot
Die Tickets sind jetzt erhältlich. Sparen Sie bis zu 680 US-Dollar, solange diese Preise gelten, und seien Sie unter den ersten 500 Registrierten, die 50 Prozent Rabatt auf ihren +1-Pass erhalten. TechCrunch Disrupt bringt führende Vertreter von Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face und vielen anderen zusammen in über 250 Sessions, die dazu dienen, das Wachstum zu beschleunigen und den Wettbewerbsvorteil zu stärken. Vernetzen Sie sich mit Hunderten innovativer Start-ups und nehmen Sie an gezielten Netzwerkaktivitäten teil, die Geschäftsgelegenheiten, Erkenntnisse und Inspirationen bieten.
Disrupt 2026 Tickets: Exklusives Einmalangebot
Die Tickets sind jetzt erhältlich. Sparen Sie bis zu 680 US-Dollar, solange diese Preise gelten, und seien Sie unter den ersten 500 Registrierten, die 50 Prozent Rabatt auf ihren +1-Pass erhalten. TechCrunch Disrupt bringt führende Vertreter von Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face und vielen anderen zusammen in über 250 Sessions, die dazu dienen, das Wachstum zu beschleunigen und den Wettbewerbsvorteil zu stärken. Vernetzen Sie sich mit Hunderten innovativer Start-ups und nehmen Sie an gezielten Netzwerkaktivitäten teil, die Geschäftsgelegenheiten, Erkenntnisse und Inspirationen bieten.
San Francisco | 13.–15. Oktober 2026 Melden Sie sich jetzt an!
Verwandter Artikel
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Empfehlungen zu verwandten Spezialthemen
Kommentare (1)
Just saw the news about Microsoft's new Maia 200 chip. Finally, someone is tackling the inference bottleneck with actual silicon instead of just throwing money at cloud services. 🚀 It’s wild how fast these models are evolving, but I’m still skeptical about whether this will actually lower costs for regular users or just make big tech richer. Anyone else excited for cheaper AI access, or is it all hype? 🤔

Microsoft hat seinen neuesten Chip, den Maia 200, vorgestellt und ihn als einen leistungsstarken Silizium-Chip bezeichnet, der speziell für die Skalierung von KI-Berechnungen entwickelt wurde.
Als Nachfolger des im Jahr 2023 veröffentlichten Maia 100 ist der Maia 200 so konzipiert, dass er fortgeschrittene KI-Modelle mit höherer Geschwindigkeit und Effizienz ausführen kann. Er verfügt über mehr als 100 Milliarden Transistoren und erreicht bei einer 4-Bit-Genauigkeit über 10 Petaflops sowie bei einer 8-Bit-Genauigkeit etwa 5 Petaflops – ein bedeutender Fortschritt im Vergleich zu seinem Vorgänger.
Die Berechnung von KI-Modellen ist ein Prozess, bei dem das Modell ausgeführt wird, im Gegensatz zur Schulung desselben. Da sich KI-Unternehmen weiterentwickeln, machen die Kosten für diese Berechnungen heute einen immer größeren Anteil der Gesamtbetriebskosten aus, was zu neuen Bemühungen führt, diesen Prozess zu optimieren.
Microsoft strebt an, dass der Maia 200 diese Optimierungen unterstützt und es KI-Unternehmen ermöglicht, mit weniger Störungen und bei geringerer Energieverbrauch zu arbeiten. „Praktisch gesehen kann ein einzelner Maia 200-Chip mühelos die größten heutigen Modelle ausführen und bietet auch genügend Leistungsfähigkeit für noch größere Modelle in der Zukunft“, so das Unternehmen.
Microsofts neuer Chip entspricht auch einer allgemeinen Tendenz unter den Technologiegiganten, ihre eigenen Silizium-Chips zu entwickeln, um ihre Abhängigkeit von Nvidia zu verringern. Denn Nvidias fortschrittliche GPUs sind für den Erfolg der KI-Branche unerlässlich. Google bietet beispielsweise seinen TPU als cloud-basierte Rechenleistung an, anstatt Chips direkt zu verkaufen. Amazon hingegen verwendet seinen Trainium-KI-Akzelerator; die neueste Version, Trainium3, wurde im Dezember veröffentlicht. Diese Chips übernehmen einen Teil der Rechenaufgaben von Nvidias GPUs, wodurch die Gesamthaushaltskosten für Hardware gesenkt werden.
Mit dem Maia positioniert sich Microsoft konkurrenzfähig gegenüber diesen Alternativen. In seiner Pressemitteilung am Montag erklärte das Unternehmen, dass der Maia dreimal so leistungsfähig wie die dritten Generationen von Amazons Trainium-Chips ist und in der FP8-Leistung sogar den siebten Generationen von Googles TPU übertrifft.
Microsoft gibt an, dass der Maia bereits die KI-Modelle seines Superintelligence-Teams antreibt sowie seinen Chatbot Copilot unterstützt. Ab Montag hat das Unternehmen Entwickler, Wissenschaftler und führende KI-Labore eingeladen, das Softwareentwicklungstool für den Maia 200 in ihren Projekten zu verwenden.
Techcrunch Event
Disrupt 2026 Tickets: Exklusives Einmalangebot
Die Tickets sind jetzt erhältlich. Sparen Sie bis zu 680 US-Dollar, solange diese Preise gelten, und seien Sie unter den ersten 500 Registrierten, die 50 Prozent Rabatt auf ihren +1-Pass erhalten. TechCrunch Disrupt bringt führende Vertreter von Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face und vielen anderen zusammen in über 250 Sessions, die dazu dienen, das Wachstum zu beschleunigen und den Wettbewerbsvorteil zu stärken. Vernetzen Sie sich mit Hunderten innovativer Start-ups und nehmen Sie an gezielten Netzwerkaktivitäten teil, die Geschäftsgelegenheiten, Erkenntnisse und Inspirationen bieten.
Disrupt 2026 Tickets: Exklusives Einmalangebot
Die Tickets sind jetzt erhältlich. Sparen Sie bis zu 680 US-Dollar, solange diese Preise gelten, und seien Sie unter den ersten 500 Registrierten, die 50 Prozent Rabatt auf ihren +1-Pass erhalten. TechCrunch Disrupt bringt führende Vertreter von Google Cloud, Netflix, Microsoft, Box, a16z, Hugging Face und vielen anderen zusammen in über 250 Sessions, die dazu dienen, das Wachstum zu beschleunigen und den Wettbewerbsvorteil zu stärken. Vernetzen Sie sich mit Hunderten innovativer Start-ups und nehmen Sie an gezielten Netzwerkaktivitäten teil, die Geschäftsgelegenheiten, Erkenntnisse und Inspirationen bieten.
San Francisco | 13.–15. Oktober 2026 Melden Sie sich jetzt an!
Inside Details Exposed About Next-Gen Gemini: Strained Computing Power, Internal Teams Disagreed on Development Priorities and Resource Allocation
Berichten zufolge wurde der Start des hocherwarteten Next-Generation-Gemini-Modells von Google verschoben. Interne Uneinigkeiten über Entwicklungsprioritäten und Ressourcenallokation, kombiniert mit begrenzter Rechenkapazität und komplexen Genehmigun
OpenAI entkräftet Bedenken bezüglich des verlangsamen Wachstums und erklärt, dass mehrere Geschäftsbereiche ihre Expansion beschleunigen
Als Reaktion auf externe Kritik bezüglich des nachlassenden Umsatzwachstums und verpasster interner Zielvorgaben gab der KI-Pionier OpenAI am Dienstag, den 28. April, eine selbstbewusste Erklärung ab. Das Unternehmen präzisierte, dass seine Verbrauch
Alibaba Super Cup: Qwen3.8-Max debütiert mit verbesserten Coding- und Bürotools
Alibaba hat offiziell Qwen3.8-Max vorgestellt, ein hochmodernes Foundation-Modell mit 2,4 Billionen Parametern. Diese bedeutende KI-Entwicklung bietet erhebliche Leistungssteigerungen in Kernbereichen wie Programmierung und professionelle Büroaufgabe
Just saw the news about Microsoft's new Maia 200 chip. Finally, someone is tackling the inference bottleneck with actual silicon instead of just throwing money at cloud services. 🚀 It’s wild how fast these models are evolving, but I’m still skeptical about whether this will actually lower costs for regular users or just make big tech richer. Anyone else excited for cheaper AI access, or is it all hype? 🤔





Heim






