Maison
La nouvelle IA de DeepMind permet aux robots d'effectuer des tâches par le biais d'une recherche sur le web
Google DeepMind a annoncé que ses modèles d'IA améliorés permettent désormais aux robots de gérer des tâches plus complexes et même d'utiliser des ressources web pour obtenir de l'aide. Lors d'une conférence de presse, Carolina Parada, responsable de la robotique chez Google DeepMind, a expliqué que les derniers modèles d'IA de l'entreprise collaborent pour permettre aux robots de "planifier plusieurs étapes à l'avance" avant d'exécuter des actions dans l'environnement physique.
Le système est piloté par le nouveau modèle Gemini Robotics 1.5 et le modèle de raisonnement incarné Gemini Robotics-ER 1.5, qui sont des versions améliorées des modèles d'IA que Google DeepMind a dévoilés en mars. Les robots ne sont plus limités à l'exécution de tâches individuelles telles que plier une feuille de papier ou ouvrir un sac. Ils peuvent désormais entreprendre des activités telles que le tri du linge en fonction des couleurs sombres et claires, la préparation d'une valise en fonction du temps qu'il fait à Londres, et l'aide au tri des déchets, du compost et du recyclage sur la base de directives spécifiques à un lieu donné, extraites de recherches sur le web.
"Les modèles précédents excellaient dans l'exécution d'instructions individuelles avec une grande polyvalence", note M. Parada. "Avec cette mise à jour, nous passons d'instructions en une seule étape à une véritable compréhension et à la résolution de problèmes pour des tâches physiques.
Pour ce faire, les robots utilisent le modèle Gemini Robotics-ER 1.5 mis à jour pour interpréter leur environnement et tirer parti d'outils numériques tels que Google Search pour obtenir des informations supplémentaires. Gemini Robotics-ER 1.5 convertit ensuite ces résultats en instructions en langage clair pour Gemini Robotics 1.5, ce qui permet au robot d'utiliser les capacités visuelles et linguistiques du modèle pour exécuter chaque étape.

Les modèles d'IA de Google DeepMind collaborent pour aider les robots à planifier et à exécuter des tâches. Image : GoogleSur le même sujet
- Le modèle d'IA optimisé de Google DeepMind fonctionne directement sur les robots
En outre, Google DeepMind a révélé que Gemini Robotics 1.5 permet aux robots d'"apprendre" les uns des autres, quelle que soit leur configuration matérielle. L'entreprise a constaté que les tâches démontrées sur le robot ALOHA2 - un système à deux bras mécaniques - peuvent être directement exécutées sur le robot à deux bras Franka et sur le robot humanoïde Apollo d'Apptronik. "Cela présente deux avantages majeurs : premièrement, nous pouvons contrôler des robots très divers, y compris des humanoïdes, à l'aide d'un seul modèle", a déclaré l'ingénieur logiciel de Google DeepMind, Kanishka Rao, lors de la réunion d'information. "Deuxièmement, les compétences acquises par un robot peuvent désormais être transférées à un autre."
Dans le cadre de ce déploiement, Google DeepMind met Gemini Robotics-ER 1.5 à la disposition des développeurs via l'API Gemini dans Google AI Studio, tandis que Gemini Robotics 1.5 reste accessible uniquement à des partenaires sélectionnés.
Article connexe
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Recommandations de sujets spéciaux liés
commentaires (1)
Google DeepMind a annoncé que ses modèles d'IA améliorés permettent désormais aux robots de gérer des tâches plus complexes et même d'utiliser des ressources web pour obtenir de l'aide. Lors d'une conférence de presse, Carolina Parada, responsable de la robotique chez Google DeepMind, a expliqué que les derniers modèles d'IA de l'entreprise collaborent pour permettre aux robots de "planifier plusieurs étapes à l'avance" avant d'exécuter des actions dans l'environnement physique.
Le système est piloté par le nouveau modèle Gemini Robotics 1.5 et le modèle de raisonnement incarné Gemini Robotics-ER 1.5, qui sont des versions améliorées des modèles d'IA que Google DeepMind a dévoilés en mars. Les robots ne sont plus limités à l'exécution de tâches individuelles telles que plier une feuille de papier ou ouvrir un sac. Ils peuvent désormais entreprendre des activités telles que le tri du linge en fonction des couleurs sombres et claires, la préparation d'une valise en fonction du temps qu'il fait à Londres, et l'aide au tri des déchets, du compost et du recyclage sur la base de directives spécifiques à un lieu donné, extraites de recherches sur le web.
"Les modèles précédents excellaient dans l'exécution d'instructions individuelles avec une grande polyvalence", note M. Parada. "Avec cette mise à jour, nous passons d'instructions en une seule étape à une véritable compréhension et à la résolution de problèmes pour des tâches physiques.
Pour ce faire, les robots utilisent le modèle Gemini Robotics-ER 1.5 mis à jour pour interpréter leur environnement et tirer parti d'outils numériques tels que Google Search pour obtenir des informations supplémentaires. Gemini Robotics-ER 1.5 convertit ensuite ces résultats en instructions en langage clair pour Gemini Robotics 1.5, ce qui permet au robot d'utiliser les capacités visuelles et linguistiques du modèle pour exécuter chaque étape.

Sur le même sujet
- Le modèle d'IA optimisé de Google DeepMind fonctionne directement sur les robots
En outre, Google DeepMind a révélé que Gemini Robotics 1.5 permet aux robots d'"apprendre" les uns des autres, quelle que soit leur configuration matérielle. L'entreprise a constaté que les tâches démontrées sur le robot ALOHA2 - un système à deux bras mécaniques - peuvent être directement exécutées sur le robot à deux bras Franka et sur le robot humanoïde Apollo d'Apptronik. "Cela présente deux avantages majeurs : premièrement, nous pouvons contrôler des robots très divers, y compris des humanoïdes, à l'aide d'un seul modèle", a déclaré l'ingénieur logiciel de Google DeepMind, Kanishka Rao, lors de la réunion d'information. "Deuxièmement, les compétences acquises par un robot peuvent désormais être transférées à un autre."
Dans le cadre de ce déploiement, Google DeepMind met Gemini Robotics-ER 1.5 à la disposition des développeurs via l'API Gemini dans Google AI Studio, tandis que Gemini Robotics 1.5 reste accessible uniquement à des partenaires sélectionnés.
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements











