Hogar
La nueva IA de DeepMind permite a los robots realizar tareas mediante búsquedas en Internet
Google DeepMind ha anunciado que sus modelos de IA mejorados permiten ahora a los robots realizar tareas más complejas e incluso utilizar recursos web como ayuda. Durante una rueda de prensa, Carolina Parada, responsable de robótica de Google DeepMind, explicó que los últimos modelos de IA de la empresa colaboran para que los robots puedan "planificar múltiples pasos por adelantado" antes de ejecutar acciones en el entorno físico.
El sistema se basa en el nuevo Gemini Robotics 1.5 y el modelo de razonamiento incorporado Gemini Robotics-ER 1.5, versiones mejoradas de los modelos de IA que Google DeepMind presentó en marzo. Los robots ya no se limitan a realizar tareas individuales como doblar una hoja de papel o abrir una bolsa. Ahora pueden realizar actividades como clasificar la colada por colores claros y oscuros, hacer la maleta según el tiempo que haga en Londres y ayudar a separar los residuos, el compost y el reciclaje basándose en directrices específicas de cada lugar extraídas de búsquedas en Internet.
"Los modelos anteriores destacaban en la ejecución de instrucciones individuales con gran versatilidad", señaló Parada. "Con esta actualización, estamos pasando de las instrucciones de un solo paso a la auténtica comprensión y resolución de problemas para tareas físicas".
Para ello, los robots emplean el modelo actualizado Gemini Robotics-ER 1.5 para interpretar su entorno y aprovechar herramientas digitales como Google Search para obtener información adicional. A continuación, Gemini Robotics-ER 1.5 convierte estos hallazgos en instrucciones en lenguaje llano para Gemini Robotics 1.5, lo que permite al robot utilizar las capacidades visuales y lingüísticas del modelo para ejecutar cada paso.

Los modelos de IA de Google DeepMind colaboran para ayudar a los robots a planificar y realizar tareas. Imagen: GoogleRelacionado
- El modelo de IA optimizado de Google DeepMind opera directamente sobre robots
Además, Google DeepMind reveló que Gemini Robotics 1.5 permite a los robots "aprender" unos de otros, independientemente de sus configuraciones de hardware. La empresa descubrió que las tareas demostradas en el robot ALOHA2 -un sistema con dos brazos mecánicos- pueden realizarse directamente en el robot bi-brazo Franka y en el robot humanoide Apollo de Apptronik. "Esto proporciona dos ventajas clave: en primer lugar, podemos controlar robots muy diversos, incluidos los humanoides, utilizando un único modelo", declaró Kanishka Rao, ingeniero de software de Google DeepMind, durante la sesión informativa. "En segundo lugar, las habilidades adquiridas por un robot pueden transferirse ahora a otro".
Como parte de este despliegue, Google DeepMind está poniendo Gemini Robotics-ER 1.5 a disposición de los desarrolladores a través de la API Gemini en Google AI Studio, mientras que Gemini Robotics 1.5 sigue siendo accesible solo para socios seleccionados.
Artículo relacionado
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
Recomendaciones de temas especiales relacionados
comentario (1)
0/500
Google DeepMind ha anunciado que sus modelos de IA mejorados permiten ahora a los robots realizar tareas más complejas e incluso utilizar recursos web como ayuda. Durante una rueda de prensa, Carolina Parada, responsable de robótica de Google DeepMind, explicó que los últimos modelos de IA de la empresa colaboran para que los robots puedan "planificar múltiples pasos por adelantado" antes de ejecutar acciones en el entorno físico.
El sistema se basa en el nuevo Gemini Robotics 1.5 y el modelo de razonamiento incorporado Gemini Robotics-ER 1.5, versiones mejoradas de los modelos de IA que Google DeepMind presentó en marzo. Los robots ya no se limitan a realizar tareas individuales como doblar una hoja de papel o abrir una bolsa. Ahora pueden realizar actividades como clasificar la colada por colores claros y oscuros, hacer la maleta según el tiempo que haga en Londres y ayudar a separar los residuos, el compost y el reciclaje basándose en directrices específicas de cada lugar extraídas de búsquedas en Internet.
"Los modelos anteriores destacaban en la ejecución de instrucciones individuales con gran versatilidad", señaló Parada. "Con esta actualización, estamos pasando de las instrucciones de un solo paso a la auténtica comprensión y resolución de problemas para tareas físicas".
Para ello, los robots emplean el modelo actualizado Gemini Robotics-ER 1.5 para interpretar su entorno y aprovechar herramientas digitales como Google Search para obtener información adicional. A continuación, Gemini Robotics-ER 1.5 convierte estos hallazgos en instrucciones en lenguaje llano para Gemini Robotics 1.5, lo que permite al robot utilizar las capacidades visuales y lingüísticas del modelo para ejecutar cada paso.

Relacionado
- El modelo de IA optimizado de Google DeepMind opera directamente sobre robots
Además, Google DeepMind reveló que Gemini Robotics 1.5 permite a los robots "aprender" unos de otros, independientemente de sus configuraciones de hardware. La empresa descubrió que las tareas demostradas en el robot ALOHA2 -un sistema con dos brazos mecánicos- pueden realizarse directamente en el robot bi-brazo Franka y en el robot humanoide Apollo de Apptronik. "Esto proporciona dos ventajas clave: en primer lugar, podemos controlar robots muy diversos, incluidos los humanoides, utilizando un único modelo", declaró Kanishka Rao, ingeniero de software de Google DeepMind, durante la sesión informativa. "En segundo lugar, las habilidades adquiridas por un robot pueden transferirse ahora a otro".
Como parte de este despliegue, Google DeepMind está poniendo Gemini Robotics-ER 1.5 a disposición de los desarrolladores a través de la API Gemini en Google AI Studio, mientras que Gemini Robotics 1.5 sigue siendo accesible solo para socios seleccionados.
Ollie apuesta por la privacidad para ganar la carrera de los asistentes de IA
Para resultar realmente útil, un asistente de IA debe comprender a fondo a su usuario. Ollie, un asistente personal diseñado para la vida cotidiana, parte de la premisa de que esto no implica ceder tu
Cómo AI LIVE: Londres explorará la inteligencia artificial y la automatización industrial
La cumbre reunirá a altos directivos de todo el mundo para abordar los retos más acuciantes de los sectores industriales a nivel global, que van desde la disrupción impulsada por la inteligencia artif
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est











