Maison
Le nouveau modèle d'IA de DeepMind s'exécute nativement sur les robots pour des performances plus rapides
Google DeepMind lance une version sur appareil de son modèle d'IA Gemini Robotics qui fonctionne sans connexion internet. Ce modèle vision-langage-action (VLA) comprend les mêmes capacités dextrogyres que celles présentées en mars, mais Google précise qu'il est désormais suffisamment compact et efficace pour fonctionner directement sur un robot.
Le modèle phare Gemini Robotics permet aux robots d'effectuer diverses tâches physiques, même celles pour lesquelles ils n'ont pas été spécifiquement formés. Il permet de généraliser de nouveaux scénarios, de comprendre et de réagir à des instructions et d'effectuer des activités impliquant un contrôle moteur fin.
Selon Carolina Parada, responsable de la robotique chez Google DeepMind, le modèle original de Gemini Robotics utilise une méthode hybride qui fonctionne à la fois sur l'appareil et dans le nuage. Avec ce nouveau modèle fonctionnant uniquement sur l'appareil, les utilisateurs peuvent toutefois accéder à des capacités hors ligne qui offrent pratiquement les mêmes performances que la version phare.

Le robot humanoïde Apollo d'Apptronik suivi du système ALOHA de Google. GIF : GoogleLe modèle sur appareil peut gérer immédiatement plusieurs tâches et s'adapter à des situations inconnues "avec seulement 50 à 100 démonstrations", explique M. Parada. Bien que Google n'ait initialement formé le modèle que sur son robot ALOHA, l'entreprise l'a adapté avec succès à d'autres plateformes robotiques, telles que le robot humanoïde Apollo d'Apptronik et le robot à double bras Franka FR3.
"Le modèle hybride de Gemini Robotics reste plus puissant, mais nous avons été réellement impressionnés par les performances de cette version sur appareil", ajoute M. Parada. "Elle peut être considérée comme un modèle d'entrée de gamme ou comme une solution idéale pour les environnements où l'Internet n'est pas fiable. Il convient également aux organisations qui appliquent des protocoles de sécurité stricts.
Outre le nouveau modèle, Google met à la disposition des développeurs un kit de développement logiciel (SDK) qui leur permettra de le tester et de le personnaliser. C'est la première fois qu'un tel kit d'outils est publié pour l'un des VLA de Google DeepMind.
Le modèle Gemini Robotics sur appareil et le kit de développement logiciel qui l'accompagne seront d'abord fournis à un groupe restreint de testeurs de confiance, tandis que Google continue d'examiner et de minimiser les problèmes de sécurité potentiels.
Article connexe
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Anthropic entre sur le marché de la technologie juridique en intelligence artificielle alors que la concurrence s'intensifie
Anthropic a dévoilé une série de nouvelles fonctionnalités de chatbot mardi, visant à fournir un support automatisé aux cabinets d’avocats. Ces améliorations étendent Claude for Legal, la plateforme spécifique aux cabinets lancée plus tôt cette année
Recommandations de sujets spéciaux liés
commentaires (1)
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.
Google DeepMind lance une version sur appareil de son modèle d'IA Gemini Robotics qui fonctionne sans connexion internet. Ce modèle vision-langage-action (VLA) comprend les mêmes capacités dextrogyres que celles présentées en mars, mais Google précise qu'il est désormais suffisamment compact et efficace pour fonctionner directement sur un robot.
Le modèle phare Gemini Robotics permet aux robots d'effectuer diverses tâches physiques, même celles pour lesquelles ils n'ont pas été spécifiquement formés. Il permet de généraliser de nouveaux scénarios, de comprendre et de réagir à des instructions et d'effectuer des activités impliquant un contrôle moteur fin.
Selon Carolina Parada, responsable de la robotique chez Google DeepMind, le modèle original de Gemini Robotics utilise une méthode hybride qui fonctionne à la fois sur l'appareil et dans le nuage. Avec ce nouveau modèle fonctionnant uniquement sur l'appareil, les utilisateurs peuvent toutefois accéder à des capacités hors ligne qui offrent pratiquement les mêmes performances que la version phare.

Le modèle sur appareil peut gérer immédiatement plusieurs tâches et s'adapter à des situations inconnues "avec seulement 50 à 100 démonstrations", explique M. Parada. Bien que Google n'ait initialement formé le modèle que sur son robot ALOHA, l'entreprise l'a adapté avec succès à d'autres plateformes robotiques, telles que le robot humanoïde Apollo d'Apptronik et le robot à double bras Franka FR3.
"Le modèle hybride de Gemini Robotics reste plus puissant, mais nous avons été réellement impressionnés par les performances de cette version sur appareil", ajoute M. Parada. "Elle peut être considérée comme un modèle d'entrée de gamme ou comme une solution idéale pour les environnements où l'Internet n'est pas fiable. Il convient également aux organisations qui appliquent des protocoles de sécurité stricts.
Outre le nouveau modèle, Google met à la disposition des développeurs un kit de développement logiciel (SDK) qui leur permettra de le tester et de le personnaliser. C'est la première fois qu'un tel kit d'outils est publié pour l'un des VLA de Google DeepMind.
Le modèle Gemini Robotics sur appareil et le kit de développement logiciel qui l'accompagne seront d'abord fournis à un groupe restreint de testeurs de confiance, tandis que Google continue d'examiner et de minimiser les problèmes de sécurité potentiels.
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Anthropic entre sur le marché de la technologie juridique en intelligence artificielle alors que la concurrence s'intensifie
Anthropic a dévoilé une série de nouvelles fonctionnalités de chatbot mardi, visant à fournir un support automatisé aux cabinets d’avocats. Ces améliorations étendent Claude for Legal, la plateforme spécifique aux cabinets lancée plus tôt cette année
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.











