Heim
Baidu bringt Ernie 5.1 auf den Markt, senkt die Kosten für das Vortraining um 94 % und zählt weltweit zu den vier führenden Anbietern
Baidu hat am 11. Mai 2026 offiziell sein Sprachmodell der nächsten Generation, Ernie 5.1, vorgestellt. Aufbauend auf der im Januar veröffentlichten Vortrainingsgrundlage von Ernie 5.0 – einem Modell mit 2,4 Billionen Parametern – wurde diese neue Version unter Verwendung eines innovativen „One-Shot-Elastic-Training-Frameworks“ entwickelt. Dieser Ansatz ermöglichte es Baidu, mehrere Modellgrößen in einem einzigen Trainingszyklus zu optimieren und die Vortrainingskosten von Ernie 5.1 auf nur 6 % der Kosten vergleichbarer Modelle zu senken.

Am 9. Mai belegte Ernie 5.1 mit einer Punktzahl von 1223 Punkten weltweit den vierten Platz und rangierte unter den chinesischen Modellen an erster Stelle der Arena Search-Rangliste, was seine außergewöhnliche Effizienz und ausgewogene Leistung unterstreicht.
Architektonisch zeichnet sich Ernie 5.1 durch ein Submodell-Design aus, bei dem Tiefe, Breite und Anzahl der aktiven Experten einstellbar sind. Die Gesamtzahl der Parameter beträgt nur ein Drittel derjenigen seines Vorgängers, und die Anzahl der pro Abfrage aktivierten effektiven Parameter wurde etwa halbiert. Um den bei Multi-Skill-Trainings häufig auftretenden „See-Saw-Effekt“ zu beheben, implementierte Baidu einen vierphasigen Post-Training-Prozess. Diese Methode nutzt parallelen spezialisierten Trainingscode, Inferenz und Proxy-Expertenmodelle in Kombination mit Strategiedestillation und verstärktem Lernen und löst so effektiv die branchenweite Herausforderung, Programmierfähigkeiten mit kreativem Denken in Einklang zu bringen. Darüber hinaus entkoppelt eine überarbeitete Infrastruktur für verstärktes Lernen Modellaktualisierungen, die Generierung von Antworten und die Bewertung. In Verbindung mit einer standardisierten Bibliothek für Berechnungen mit geringer Genauigkeit verbessert dies die Stabilität des groß angelegten Trainings erheblich.

Verwandter Artikel
Meta entfernt KI-Fotobearbeitungsfunktion nach Nutzerprotesten
Meta, der Social-Media-Riese, ist erneut in eine öffentliche Debatte über die heikle Balance zwischen künstlicher Intelligenz und dem Schutz der Privatsphäre der Nutzer verwickelt. Laut TechCrunch hat Meta’s Superintelligence Labs diese Woche einen n
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Baidu hat am 11. Mai 2026 offiziell sein Sprachmodell der nächsten Generation, Ernie 5.1, vorgestellt. Aufbauend auf der im Januar veröffentlichten Vortrainingsgrundlage von Ernie 5.0 – einem Modell mit 2,4 Billionen Parametern – wurde diese neue Version unter Verwendung eines innovativen „One-Shot-Elastic-Training-Frameworks“ entwickelt. Dieser Ansatz ermöglichte es Baidu, mehrere Modellgrößen in einem einzigen Trainingszyklus zu optimieren und die Vortrainingskosten von Ernie 5.1 auf nur 6 % der Kosten vergleichbarer Modelle zu senken.

Am 9. Mai belegte Ernie 5.1 mit einer Punktzahl von 1223 Punkten weltweit den vierten Platz und rangierte unter den chinesischen Modellen an erster Stelle der Arena Search-Rangliste, was seine außergewöhnliche Effizienz und ausgewogene Leistung unterstreicht.
Architektonisch zeichnet sich Ernie 5.1 durch ein Submodell-Design aus, bei dem Tiefe, Breite und Anzahl der aktiven Experten einstellbar sind. Die Gesamtzahl der Parameter beträgt nur ein Drittel derjenigen seines Vorgängers, und die Anzahl der pro Abfrage aktivierten effektiven Parameter wurde etwa halbiert. Um den bei Multi-Skill-Trainings häufig auftretenden „See-Saw-Effekt“ zu beheben, implementierte Baidu einen vierphasigen Post-Training-Prozess. Diese Methode nutzt parallelen spezialisierten Trainingscode, Inferenz und Proxy-Expertenmodelle in Kombination mit Strategiedestillation und verstärktem Lernen und löst so effektiv die branchenweite Herausforderung, Programmierfähigkeiten mit kreativem Denken in Einklang zu bringen. Darüber hinaus entkoppelt eine überarbeitete Infrastruktur für verstärktes Lernen Modellaktualisierungen, die Generierung von Antworten und die Bewertung. In Verbindung mit einer standardisierten Bibliothek für Berechnungen mit geringer Genauigkeit verbessert dies die Stabilität des groß angelegten Trainings erheblich.

Meta entfernt KI-Fotobearbeitungsfunktion nach Nutzerprotesten
Meta, der Social-Media-Riese, ist erneut in eine öffentliche Debatte über die heikle Balance zwischen künstlicher Intelligenz und dem Schutz der Privatsphäre der Nutzer verwickelt. Laut TechCrunch hat Meta’s Superintelligence Labs diese Woche einen n
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











