Heim
Das neue KI-Modell von DeepMind läuft nativ auf Robotern, um die Leistung zu steigern
Google DeepMind veröffentlicht eine geräteinterne Version seines KI-Modells Gemini Robotics, die ohne Internetverbindung funktioniert. Dieses Vision-Language-Action-Modell (VLA) verfügt über dieselben Fähigkeiten wie das im März vorgestellte, ist aber laut Google jetzt kompakt und effizient genug, um direkt auf einem Roboter zu laufen.
Das Vorzeigemodell von Gemini Robotics ermöglicht es Robotern, verschiedene physische Aufgaben auszuführen, auch solche, für die sie nicht speziell trainiert wurden. Es unterstützt die Generalisierung neuer Szenarien, das Verstehen und Reagieren auf Anweisungen und die Durchführung von Aktivitäten, die eine feinmotorische Kontrolle erfordern.
Laut Carolina Parada, Leiterin der Robotikabteilung bei Google DeepMind, verwendet das ursprüngliche Gemini Robotics-Modell eine hybride Methode, die sowohl auf dem Gerät als auch in der Cloud funktioniert. Mit dem neuen Modell, das nur auf dem Gerät funktioniert, können die Nutzer jedoch auf Offline-Funktionen zugreifen, die fast die gleiche Leistung bieten wie die Flaggschiff-Version.

Der humanoide Bot Apollo von Apptronik gefolgt von Googles ALOHA-System. GIF: GoogleDas On-Device-Modell kann sofort mehrere Aufgaben bewältigen und sich an ungewohnte Situationen "mit nur 50 bis 100 Demonstrationen" anpassen, erklärt Parada. Obwohl Google das Modell zunächst nur auf seinem ALOHA-Roboter trainierte, passte das Unternehmen es erfolgreich an andere Roboterplattformen an, wie den humanoiden Apollo-Roboter von Apptronik und den zweiarmigen Franka FR3-Roboter.
"Das Hybridmodell von Gemini Robotics ist nach wie vor leistungsfähiger, aber wir sind wirklich beeindruckt von der Leistung dieser On-Device-Version", fügt Parada hinzu. "Es kann als Einstiegsmodell oder als ideale Lösung für Umgebungen mit unzuverlässigem Internet betrachtet werden." Es eignet sich auch für Unternehmen mit strengen Sicherheitsprotokollen.
Zusätzlich zu dem neuen Modell stellt Google ein Software Development Kit (SDK) zur Verfügung, mit dem Entwickler es testen und anpassen können - das erste Mal, dass ein solches Toolkit für eine der VLAs von Google DeepMind veröffentlicht wird.
Das On-Device-Modell von Gemini Robotics und das dazugehörige SDK werden zunächst einer ausgewählten Gruppe von vertrauenswürdigen Testern zur Verfügung gestellt, während Google weiterhin mögliche Sicherheitsbedenken prüft und minimiert.
Verwandter Artikel
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund
Amazon hat Alexa for Shopping eingeführt, indem es den Rufus-Shopping-Chatbot mit Alexa+ in der App, auf der Website und auf Echo Show-Geräten zusammenführt.Der Assistent beantwortet Produktanfragen, vergleicht Artikel, verfolgt Preise und unterstüt
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
Empfehlungen zu verwandten Spezialthemen
Kommentare (1)
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.
Google DeepMind veröffentlicht eine geräteinterne Version seines KI-Modells Gemini Robotics, die ohne Internetverbindung funktioniert. Dieses Vision-Language-Action-Modell (VLA) verfügt über dieselben Fähigkeiten wie das im März vorgestellte, ist aber laut Google jetzt kompakt und effizient genug, um direkt auf einem Roboter zu laufen.
Das Vorzeigemodell von Gemini Robotics ermöglicht es Robotern, verschiedene physische Aufgaben auszuführen, auch solche, für die sie nicht speziell trainiert wurden. Es unterstützt die Generalisierung neuer Szenarien, das Verstehen und Reagieren auf Anweisungen und die Durchführung von Aktivitäten, die eine feinmotorische Kontrolle erfordern.
Laut Carolina Parada, Leiterin der Robotikabteilung bei Google DeepMind, verwendet das ursprüngliche Gemini Robotics-Modell eine hybride Methode, die sowohl auf dem Gerät als auch in der Cloud funktioniert. Mit dem neuen Modell, das nur auf dem Gerät funktioniert, können die Nutzer jedoch auf Offline-Funktionen zugreifen, die fast die gleiche Leistung bieten wie die Flaggschiff-Version.

Das On-Device-Modell kann sofort mehrere Aufgaben bewältigen und sich an ungewohnte Situationen "mit nur 50 bis 100 Demonstrationen" anpassen, erklärt Parada. Obwohl Google das Modell zunächst nur auf seinem ALOHA-Roboter trainierte, passte das Unternehmen es erfolgreich an andere Roboterplattformen an, wie den humanoiden Apollo-Roboter von Apptronik und den zweiarmigen Franka FR3-Roboter.
"Das Hybridmodell von Gemini Robotics ist nach wie vor leistungsfähiger, aber wir sind wirklich beeindruckt von der Leistung dieser On-Device-Version", fügt Parada hinzu. "Es kann als Einstiegsmodell oder als ideale Lösung für Umgebungen mit unzuverlässigem Internet betrachtet werden." Es eignet sich auch für Unternehmen mit strengen Sicherheitsprotokollen.
Zusätzlich zu dem neuen Modell stellt Google ein Software Development Kit (SDK) zur Verfügung, mit dem Entwickler es testen und anpassen können - das erste Mal, dass ein solches Toolkit für eine der VLAs von Google DeepMind veröffentlicht wird.
Das On-Device-Modell von Gemini Robotics und das dazugehörige SDK werden zunächst einer ausgewählten Gruppe von vertrauenswürdigen Testern zur Verfügung gestellt, während Google weiterhin mögliche Sicherheitsbedenken prüft und minimiert.
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.











