Maison
Le nouveau modèle d'IA de DeepMind s'exécute nativement sur les robots pour des performances plus rapides
Google DeepMind lance une version sur appareil de son modèle d'IA Gemini Robotics qui fonctionne sans connexion internet. Ce modèle vision-langage-action (VLA) comprend les mêmes capacités dextrogyres que celles présentées en mars, mais Google précise qu'il est désormais suffisamment compact et efficace pour fonctionner directement sur un robot.
Le modèle phare Gemini Robotics permet aux robots d'effectuer diverses tâches physiques, même celles pour lesquelles ils n'ont pas été spécifiquement formés. Il permet de généraliser de nouveaux scénarios, de comprendre et de réagir à des instructions et d'effectuer des activités impliquant un contrôle moteur fin.
Selon Carolina Parada, responsable de la robotique chez Google DeepMind, le modèle original de Gemini Robotics utilise une méthode hybride qui fonctionne à la fois sur l'appareil et dans le nuage. Avec ce nouveau modèle fonctionnant uniquement sur l'appareil, les utilisateurs peuvent toutefois accéder à des capacités hors ligne qui offrent pratiquement les mêmes performances que la version phare.

Le robot humanoïde Apollo d'Apptronik suivi du système ALOHA de Google. GIF : GoogleLe modèle sur appareil peut gérer immédiatement plusieurs tâches et s'adapter à des situations inconnues "avec seulement 50 à 100 démonstrations", explique M. Parada. Bien que Google n'ait initialement formé le modèle que sur son robot ALOHA, l'entreprise l'a adapté avec succès à d'autres plateformes robotiques, telles que le robot humanoïde Apollo d'Apptronik et le robot à double bras Franka FR3.
"Le modèle hybride de Gemini Robotics reste plus puissant, mais nous avons été réellement impressionnés par les performances de cette version sur appareil", ajoute M. Parada. "Elle peut être considérée comme un modèle d'entrée de gamme ou comme une solution idéale pour les environnements où l'Internet n'est pas fiable. Il convient également aux organisations qui appliquent des protocoles de sécurité stricts.
Outre le nouveau modèle, Google met à la disposition des développeurs un kit de développement logiciel (SDK) qui leur permettra de le tester et de le personnaliser. C'est la première fois qu'un tel kit d'outils est publié pour l'un des VLA de Google DeepMind.
Le modèle Gemini Robotics sur appareil et le kit de développement logiciel qui l'accompagne seront d'abord fournis à un groupe restreint de testeurs de confiance, tandis que Google continue d'examiner et de minimiser les problèmes de sécurité potentiels.
Article connexe
Warner Music acquiert l'entreprise de démarrage Sureel AI spécialisée dans l'attribution par intelligence artificielle
Warner Music Group (WMG) a confirmé mercredi qu’elle acquiert Sureel AI, une startup spécialisée dans l’attribution par intelligence artificielle. La technologie propriétaire de Sureel génère une « ADN IA » pour les titres musicaux, en décomposant ce
Amazon présente Alexa pour les achats tout en reléguant Rufus au second plan
Amazon a lancé Alexa for Shopping, fusionnant son chatbot de shopping Rufus avec Alexa+ sur l’application, le site web et les appareils Echo Show.L’assistant répond aux requêtes sur les produits, compare les articles, suit les prix et prend en charg
Microsoft, Azure et les technologies d'IA luttent contre les risques d'incendies de forêt en Californie
Microsoft investit dans la détection des feux de forêt grâce à l'IA ; Juan Lavista Ferres, vice-président corporatif et responsable scientifique des données, évoque les stratégies visant à atténuer le
Recommandations de sujets spéciaux liés
commentaires (1)
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.
Google DeepMind lance une version sur appareil de son modèle d'IA Gemini Robotics qui fonctionne sans connexion internet. Ce modèle vision-langage-action (VLA) comprend les mêmes capacités dextrogyres que celles présentées en mars, mais Google précise qu'il est désormais suffisamment compact et efficace pour fonctionner directement sur un robot.
Le modèle phare Gemini Robotics permet aux robots d'effectuer diverses tâches physiques, même celles pour lesquelles ils n'ont pas été spécifiquement formés. Il permet de généraliser de nouveaux scénarios, de comprendre et de réagir à des instructions et d'effectuer des activités impliquant un contrôle moteur fin.
Selon Carolina Parada, responsable de la robotique chez Google DeepMind, le modèle original de Gemini Robotics utilise une méthode hybride qui fonctionne à la fois sur l'appareil et dans le nuage. Avec ce nouveau modèle fonctionnant uniquement sur l'appareil, les utilisateurs peuvent toutefois accéder à des capacités hors ligne qui offrent pratiquement les mêmes performances que la version phare.

Le modèle sur appareil peut gérer immédiatement plusieurs tâches et s'adapter à des situations inconnues "avec seulement 50 à 100 démonstrations", explique M. Parada. Bien que Google n'ait initialement formé le modèle que sur son robot ALOHA, l'entreprise l'a adapté avec succès à d'autres plateformes robotiques, telles que le robot humanoïde Apollo d'Apptronik et le robot à double bras Franka FR3.
"Le modèle hybride de Gemini Robotics reste plus puissant, mais nous avons été réellement impressionnés par les performances de cette version sur appareil", ajoute M. Parada. "Elle peut être considérée comme un modèle d'entrée de gamme ou comme une solution idéale pour les environnements où l'Internet n'est pas fiable. Il convient également aux organisations qui appliquent des protocoles de sécurité stricts.
Outre le nouveau modèle, Google met à la disposition des développeurs un kit de développement logiciel (SDK) qui leur permettra de le tester et de le personnaliser. C'est la première fois qu'un tel kit d'outils est publié pour l'un des VLA de Google DeepMind.
Le modèle Gemini Robotics sur appareil et le kit de développement logiciel qui l'accompagne seront d'abord fournis à un groupe restreint de testeurs de confiance, tandis que Google continue d'examiner et de minimiser les problèmes de sécurité potentiels.
Warner Music acquiert l'entreprise de démarrage Sureel AI spécialisée dans l'attribution par intelligence artificielle
Warner Music Group (WMG) a confirmé mercredi qu’elle acquiert Sureel AI, une startup spécialisée dans l’attribution par intelligence artificielle. La technologie propriétaire de Sureel génère une « ADN IA » pour les titres musicaux, en décomposant ce
Microsoft, Azure et les technologies d'IA luttent contre les risques d'incendies de forêt en Californie
Microsoft investit dans la détection des feux de forêt grâce à l'IA ; Juan Lavista Ferres, vice-président corporatif et responsable scientifique des données, évoque les stratégies visant à atténuer le
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.











