Lar
A nova IA da DeepMind permite que os robôs realizem tarefas por meio de pesquisa na Web
O Google DeepMind anunciou que seus modelos aprimorados de IA agora permitem que os robôs realizem tarefas mais complexas e até mesmo utilizem recursos da Web para obter assistência. Durante uma coletiva de imprensa, Carolina Parada, chefe de robótica do Google DeepMind, explicou que os modelos de IA mais recentes da empresa colaboram para permitir que os robôs "planejem várias etapas com antecedência" antes de executar ações no ambiente físico.
O sistema é conduzido pelo recém-lançado Gemini Robotics 1.5 e pelo modelo de raciocínio incorporado, Gemini Robotics-ER 1.5, que são versões atualizadas dos modelos de IA que o Google DeepMind revelou em março. Os robôs não estão mais limitados à execução de tarefas individuais, como dobrar uma folha de papel ou abrir o zíper de uma bolsa. Agora, eles podem realizar atividades como classificar a roupa suja de acordo com as cores claras e escuras, arrumar uma mala de acordo com o clima atual de Londres e ajudar na separação de lixo, adubo e reciclagem com base em diretrizes específicas do local obtidas em pesquisas na Web.
"Os modelos anteriores eram excelentes na execução de instruções individuais com alta versatilidade", observou Parada. "Com essa atualização, estamos mudando de instruções de etapa única para compreensão genuína e solução de problemas para tarefas físicas."
Para isso, os robôs empregam o modelo Gemini Robotics-ER 1.5 atualizado para interpretar o ambiente e utilizar ferramentas digitais como a Pesquisa Google para obter informações adicionais. Em seguida, o Gemini Robotics-ER 1.5 converte essas descobertas em instruções em linguagem simples para o Gemini Robotics 1.5, permitindo que o robô utilize os recursos visuais e linguísticos do modelo para executar cada etapa.

Os modelos de IA do Google DeepMind colaboram para auxiliar os robôs no planejamento e na execução de tarefas. Imagem: GoogleRelacionado
- O modelo otimizado de IA do Google DeepMind opera diretamente em robôs
Além disso, o Google DeepMind revelou que o Gemini Robotics 1.5 permite que os robôs "aprendam" uns com os outros, independentemente de suas configurações de hardware. A empresa descobriu que as tarefas demonstradas no robô ALOHA2 - um sistema com dois braços mecânicos - podem ser executadas diretamente no robô Franka com dois braços e no robô humanoide Apollo da Apptronik. "Isso proporciona duas vantagens importantes: primeiro, podemos controlar robôs altamente diversificados, incluindo humanoides, usando um único modelo", afirmou o engenheiro de software do Google DeepMind, Kanishka Rao, durante o briefing. "Em segundo lugar, as habilidades adquiridas por um robô agora podem ser transferidas para outro."
Como parte desse lançamento, o Google DeepMind está disponibilizando o Gemini Robotics-ER 1.5 para os desenvolvedores por meio da API Gemini no Google AI Studio, enquanto o Gemini Robotics 1.5 permanece acessível apenas para parceiros selecionados.
Artigo relacionado
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
Recomendações de tópicos especiais relacionados
Comentários (1)
O Google DeepMind anunciou que seus modelos aprimorados de IA agora permitem que os robôs realizem tarefas mais complexas e até mesmo utilizem recursos da Web para obter assistência. Durante uma coletiva de imprensa, Carolina Parada, chefe de robótica do Google DeepMind, explicou que os modelos de IA mais recentes da empresa colaboram para permitir que os robôs "planejem várias etapas com antecedência" antes de executar ações no ambiente físico.
O sistema é conduzido pelo recém-lançado Gemini Robotics 1.5 e pelo modelo de raciocínio incorporado, Gemini Robotics-ER 1.5, que são versões atualizadas dos modelos de IA que o Google DeepMind revelou em março. Os robôs não estão mais limitados à execução de tarefas individuais, como dobrar uma folha de papel ou abrir o zíper de uma bolsa. Agora, eles podem realizar atividades como classificar a roupa suja de acordo com as cores claras e escuras, arrumar uma mala de acordo com o clima atual de Londres e ajudar na separação de lixo, adubo e reciclagem com base em diretrizes específicas do local obtidas em pesquisas na Web.
"Os modelos anteriores eram excelentes na execução de instruções individuais com alta versatilidade", observou Parada. "Com essa atualização, estamos mudando de instruções de etapa única para compreensão genuína e solução de problemas para tarefas físicas."
Para isso, os robôs empregam o modelo Gemini Robotics-ER 1.5 atualizado para interpretar o ambiente e utilizar ferramentas digitais como a Pesquisa Google para obter informações adicionais. Em seguida, o Gemini Robotics-ER 1.5 converte essas descobertas em instruções em linguagem simples para o Gemini Robotics 1.5, permitindo que o robô utilize os recursos visuais e linguísticos do modelo para executar cada etapa.

Relacionado
- O modelo otimizado de IA do Google DeepMind opera diretamente em robôs
Além disso, o Google DeepMind revelou que o Gemini Robotics 1.5 permite que os robôs "aprendam" uns com os outros, independentemente de suas configurações de hardware. A empresa descobriu que as tarefas demonstradas no robô ALOHA2 - um sistema com dois braços mecânicos - podem ser executadas diretamente no robô Franka com dois braços e no robô humanoide Apollo da Apptronik. "Isso proporciona duas vantagens importantes: primeiro, podemos controlar robôs altamente diversificados, incluindo humanoides, usando um único modelo", afirmou o engenheiro de software do Google DeepMind, Kanishka Rao, durante o briefing. "Em segundo lugar, as habilidades adquiridas por um robô agora podem ser transferidas para outro."
Como parte desse lançamento, o Google DeepMind está disponibilizando o Gemini Robotics-ER 1.5 para os desenvolvedores por meio da API Gemini no Google AI Studio, enquanto o Gemini Robotics 1.5 permanece acessível apenas para parceiros selecionados.
Ollie aposta na privacidade para vencer a corrida dos assistentes de IA
Para ser realmente útil, um assistente de IA precisa compreender profundamente seu usuário. O Ollie, um assistente pessoal projetado para o dia a dia, opera com base na premissa de que isso não exige
Como o AI LIVE: Londres explorará a IA e a automação industrial
A cúpula reunirá executivos de alto escalão de todo o mundo para discutir os desafios urgentes enfrentados pelos setores globais, que vão desde as transformações impulsionadas pela IA até a volatilida
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica
A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada











