Новый ИИ от DeepMind позволяет роботам выполнять задания через веб-поиск
Компания Google DeepMind объявила, что ее усовершенствованные модели искусственного интеллекта позволяют роботам справляться с более сложными задачами и даже использовать веб-ресурсы для помощи. На пресс-брифинге Каролина Парада, руководитель отдела робототехники Google DeepMind, рассказала, что новейшие модели искусственного интеллекта компании позволяют роботам "планировать несколько шагов заранее" перед выполнением действий в физической среде.
Система управляется недавно выпущенными Gemini Robotics 1.5 и моделью воплощенного разума Gemini Robotics-ER 1.5, которые являются обновленными версиями моделей ИИ, представленных Google DeepMind в марте. Роботы больше не ограничиваются выполнением отдельных задач, таких как складывание листа бумаги или расстегивание молнии на сумке. Теперь они могут выполнять такие действия, как сортировка белья по темным и светлым цветам, упаковка чемодана в соответствии с текущей погодой в Лондоне, а также помощь в разделении мусора, компоста и вторсырья на основе рекомендаций, полученных из веб-поиска в конкретном месте.
"Предыдущие модели отлично справлялись с выполнением индивидуальных инструкций с высокой степенью универсальности", - отметил Парада. "С этим обновлением мы переходим от одношаговых инструкций к реальному пониманию и решению проблем при выполнении физических задач".
Для этого роботы используют обновленную модель Gemini Robotics-ER 1.5, чтобы интерпретировать окружающую обстановку и использовать цифровые инструменты, такие как Google Search, для получения дополнительной информации. Затем Gemini Robotics-ER 1.5 преобразует полученные данные в инструкции на обычном языке для Gemini Robotics 1.5, позволяя роботу использовать визуальные и лингвистические возможности модели для выполнения каждого шага.

Совместная работа моделей ИИ Google DeepMind помогает роботам планировать и выполнять задачи. Изображение: GoogleСвязанные
- Оптимизированная модель искусственного интеллекта Google DeepMind работает непосредственно на роботов
Кроме того, Google DeepMind показала, что Gemini Robotics 1.5 позволяет роботам "учиться" друг у друга, независимо от их аппаратных конфигураций. Компания обнаружила, что задачи, продемонстрированные на роботе ALOHA2 - системе с двумя механическими руками, - могут быть напрямую выполнены на двуруком роботе Franka и гуманоидном роботе Apollo компании Apptronik. "Это дает два ключевых преимущества: во-первых, мы можем управлять самыми разными роботами, включая гуманоидов, с помощью одной модели", - заявил на брифинге инженер-программист Google DeepMind Канишка Рао. "Во-вторых, навыки, приобретенные одним роботом, теперь могут быть переданы другому".
В рамках этого развертывания Google DeepMind предоставляет Gemini Robotics-ER 1.5 разработчикам через Gemini API в Google AI Studio, в то время как Gemini Robotics 1.5 остается доступной только для избранных партнеров.
Связанная статья
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Рекомендации по связанным специальным темам
Комментарии (1)
Компания Google DeepMind объявила, что ее усовершенствованные модели искусственного интеллекта позволяют роботам справляться с более сложными задачами и даже использовать веб-ресурсы для помощи. На пресс-брифинге Каролина Парада, руководитель отдела робототехники Google DeepMind, рассказала, что новейшие модели искусственного интеллекта компании позволяют роботам "планировать несколько шагов заранее" перед выполнением действий в физической среде.
Система управляется недавно выпущенными Gemini Robotics 1.5 и моделью воплощенного разума Gemini Robotics-ER 1.5, которые являются обновленными версиями моделей ИИ, представленных Google DeepMind в марте. Роботы больше не ограничиваются выполнением отдельных задач, таких как складывание листа бумаги или расстегивание молнии на сумке. Теперь они могут выполнять такие действия, как сортировка белья по темным и светлым цветам, упаковка чемодана в соответствии с текущей погодой в Лондоне, а также помощь в разделении мусора, компоста и вторсырья на основе рекомендаций, полученных из веб-поиска в конкретном месте.
"Предыдущие модели отлично справлялись с выполнением индивидуальных инструкций с высокой степенью универсальности", - отметил Парада. "С этим обновлением мы переходим от одношаговых инструкций к реальному пониманию и решению проблем при выполнении физических задач".
Для этого роботы используют обновленную модель Gemini Robotics-ER 1.5, чтобы интерпретировать окружающую обстановку и использовать цифровые инструменты, такие как Google Search, для получения дополнительной информации. Затем Gemini Robotics-ER 1.5 преобразует полученные данные в инструкции на обычном языке для Gemini Robotics 1.5, позволяя роботу использовать визуальные и лингвистические возможности модели для выполнения каждого шага.

Связанные
- Оптимизированная модель искусственного интеллекта Google DeepMind работает непосредственно на роботов
Кроме того, Google DeepMind показала, что Gemini Robotics 1.5 позволяет роботам "учиться" друг у друга, независимо от их аппаратных конфигураций. Компания обнаружила, что задачи, продемонстрированные на роботе ALOHA2 - системе с двумя механическими руками, - могут быть напрямую выполнены на двуруком роботе Franka и гуманоидном роботе Apollo компании Apptronik. "Это дает два ключевых преимущества: во-первых, мы можем управлять самыми разными роботами, включая гуманоидов, с помощью одной модели", - заявил на брифинге инженер-программист Google DeepMind Канишка Рао. "Во-вторых, навыки, приобретенные одним роботом, теперь могут быть переданы другому".
В рамках этого развертывания Google DeepMind предоставляет Gemini Robotics-ER 1.5 разработчикам через Gemini API в Google AI Studio, в то время как Gemini Robotics 1.5 остается доступной только для избранных партнеров.
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес





Дом






