Heim
Xiaomi veröffentlicht das vollständige Post-Training des VLA-Großmodells für Roboteroperationen im Submillimeterbereich als Open Source
Xiaomi macht weiterhin bedeutende Fortschritte in der Robotik. Nachdem das Unternehmen im Februar sein großes VLA-Modell „Xiaomi-Robotics-0“ veröffentlicht und als Open-Source-Projekt zur Verfügung gestellt hatte, hat es nun den gesamten Prozess nach dem Training für das Modell offengelegt. Dieser Schritt soll die Lücke der „letzten Meile“ zwischen Laborrobotern und der praktischen Produktion schließen und KI-Roboter in wirklich produktive Werkzeuge verwandeln, die sofort einsatzbereit sind.

In einer kürzlich durchgeführten Leistungsdemonstration zeigte der mit diesem Modell ausgestattete Roboter beeindruckende Fähigkeiten im Bereich der Präzisionsmanipulation. Nach nur 20 Stunden verstärkendem Training mit Aufgabendaten meisterte „Xiaomi-Robotics-0“ die äußerst anspruchsvolle Aufgabe, Kopfhörer nacheinander zu ordnen. Das Video zeigt, wie der Roboter kleine Kopfhörer reibungslos und präzise nacheinander in kompakte Ladefächer legt.
Diese scheinbar einfache Aktion ist technisch äußerst komplex. Laut offiziellen technischen Angaben stellt die Aufgabe zwei zentrale Herausforderungen dar: Präzision und Stabilität. Die Toleranz zwischen dem Kopfhörer und dem Steckplatz im Ladecase ist extrem gering, was eine räumliche Wahrnehmung im Submillimeterbereich für eine genaue Ausrichtung erfordert. Zudem führen die extrem glatten Oberflächen von Kopfhörer und Case (Oberflächenrauheit von nur Ra 0,03 μm) dazu, dass ein Verrutschen beim Kontakt wahrscheinlich ist. Das Modell muss über schnelle Echtzeit-Feedback- und Aktionskorrekturfunktionen verfügen, um Montagefehler zu verhindern.

Bemerkenswert ist, dass sich „Xiaomi-Robotics-0“ bereits im ersten Monat nach der Veröffentlichung unter den Top 6 der globalen VLA-Modell-Download-Liste auf HuggingFace platzierte, was das starke Interesse der Branche widerspiegelt. Um das Entwickler-Ökosystem weiter zu unterstützen, hat Xiaomi den technischen Bericht, die Modellgewichte und den Quellcode des Projekts vollständig als Open Source veröffentlicht.
Entwickler können nun über die Xiaomi Robotics-Website und Open-Source-Plattformen wie GitHub auf diese Ressourcen zugreifen. Durch die Open-Source-Veröffentlichung des gesamten Post-Training-Prozesses erwartet die Branche eine erhebliche Senkung der Entwicklungsbarrieren für hochleistungsfähige Roboteraufgaben, was den Einsatz intelligenter Roboter in komplexen, präzisionsintensiven Szenarien beschleunigen wird.
Technische Referenz: https://robotics.xiaomi.com/xiaomi-robotics-0.html#pack-earbuds
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Xiaomi macht weiterhin bedeutende Fortschritte in der Robotik. Nachdem das Unternehmen im Februar sein großes VLA-Modell „Xiaomi-Robotics-0“ veröffentlicht und als Open-Source-Projekt zur Verfügung gestellt hatte, hat es nun den gesamten Prozess nach dem Training für das Modell offengelegt. Dieser Schritt soll die Lücke der „letzten Meile“ zwischen Laborrobotern und der praktischen Produktion schließen und KI-Roboter in wirklich produktive Werkzeuge verwandeln, die sofort einsatzbereit sind.

In einer kürzlich durchgeführten Leistungsdemonstration zeigte der mit diesem Modell ausgestattete Roboter beeindruckende Fähigkeiten im Bereich der Präzisionsmanipulation. Nach nur 20 Stunden verstärkendem Training mit Aufgabendaten meisterte „Xiaomi-Robotics-0“ die äußerst anspruchsvolle Aufgabe, Kopfhörer nacheinander zu ordnen. Das Video zeigt, wie der Roboter kleine Kopfhörer reibungslos und präzise nacheinander in kompakte Ladefächer legt.
Diese scheinbar einfache Aktion ist technisch äußerst komplex. Laut offiziellen technischen Angaben stellt die Aufgabe zwei zentrale Herausforderungen dar: Präzision und Stabilität. Die Toleranz zwischen dem Kopfhörer und dem Steckplatz im Ladecase ist extrem gering, was eine räumliche Wahrnehmung im Submillimeterbereich für eine genaue Ausrichtung erfordert. Zudem führen die extrem glatten Oberflächen von Kopfhörer und Case (Oberflächenrauheit von nur Ra 0,03 μm) dazu, dass ein Verrutschen beim Kontakt wahrscheinlich ist. Das Modell muss über schnelle Echtzeit-Feedback- und Aktionskorrekturfunktionen verfügen, um Montagefehler zu verhindern.

Bemerkenswert ist, dass sich „Xiaomi-Robotics-0“ bereits im ersten Monat nach der Veröffentlichung unter den Top 6 der globalen VLA-Modell-Download-Liste auf HuggingFace platzierte, was das starke Interesse der Branche widerspiegelt. Um das Entwickler-Ökosystem weiter zu unterstützen, hat Xiaomi den technischen Bericht, die Modellgewichte und den Quellcode des Projekts vollständig als Open Source veröffentlicht.
Entwickler können nun über die Xiaomi Robotics-Website und Open-Source-Plattformen wie GitHub auf diese Ressourcen zugreifen. Durch die Open-Source-Veröffentlichung des gesamten Post-Training-Prozesses erwartet die Branche eine erhebliche Senkung der Entwicklungsbarrieren für hochleistungsfähige Roboteraufgaben, was den Einsatz intelligenter Roboter in komplexen, präzisionsintensiven Szenarien beschleunigen wird.
Technische Referenz: https://robotics.xiaomi.com/xiaomi-robotics-0.html#pack-earbuds
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











