Дом
Новая модель искусственного интеллекта DeepMind работает на базе роботов для повышения производительности
Google DeepMind выпускает версию своей модели искусственного интеллекта Gemini Robotics, работающую на устройстве и не требующую подключения к Интернету. Эта модель видения-языка-действия (VLA) включает в себя те же возможности ловкости, которые были представлены в марте, но Google отмечает, что теперь она достаточно компактна и эффективна, чтобы работать непосредственно на роботе.
Флагманская модель Gemini Robotics позволяет роботам выполнять различные физические задачи, даже те, которым они не были специально обучены. Она помогает обобщать новые сценарии, понимать и реагировать на инструкции, а также выполнять действия, требующие тонкого моторного контроля.
По словам Каролины Парада, руководителя отдела робототехники в Google DeepMind, оригинальная модель Gemini Robotics использует гибридный метод, который работает как на устройстве, так и в облаке. Однако в новой модели, предназначенной только для устройств, пользователи могут получить доступ к автономным возможностям, которые обеспечивают почти такую же производительность, как и флагманская версия.

Гуманоидный бот Apollo от Apptronik и система ALOHA от Google. GIF: GoogleМодель на устройстве может мгновенно справляться с несколькими задачами и адаптироваться к незнакомым ситуациям "всего за 50-100 демонстраций", объясняет Парада. Хотя изначально Google обучала модель только на своем роботе ALOHA, компания успешно адаптировала ее к другим роботизированным платформам, таким как гуманоидный робот Apollo от Apptronik и двурукий робот Franka FR3.
"Гибридная модель Gemini Robotics остается более мощной, но мы были искренне впечатлены производительностью этой версии устройства", - добавляет Парада. "Ее можно рассматривать как модель начального уровня или как идеальное решение для сред с ненадежным интернетом". Она также подходит для организаций со строгими протоколами безопасности".
В дополнение к новой модели Google выпускает комплект для разработки программного обеспечения (SDK), чтобы разработчики могли тестировать и настраивать его - это первый случай выпуска такого комплекта инструментов для одного из VLA Google DeepMind.
Модель Gemini Robotics и сопутствующий SDK будут первоначально предоставлены избранной группе доверенных тестеров, пока Google продолжает решать и минимизировать потенциальные проблемы безопасности.
Связанная статья
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Рекомендации по связанным специальным темам
Комментарии (1)
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.
Google DeepMind выпускает версию своей модели искусственного интеллекта Gemini Robotics, работающую на устройстве и не требующую подключения к Интернету. Эта модель видения-языка-действия (VLA) включает в себя те же возможности ловкости, которые были представлены в марте, но Google отмечает, что теперь она достаточно компактна и эффективна, чтобы работать непосредственно на роботе.
Флагманская модель Gemini Robotics позволяет роботам выполнять различные физические задачи, даже те, которым они не были специально обучены. Она помогает обобщать новые сценарии, понимать и реагировать на инструкции, а также выполнять действия, требующие тонкого моторного контроля.
По словам Каролины Парада, руководителя отдела робототехники в Google DeepMind, оригинальная модель Gemini Robotics использует гибридный метод, который работает как на устройстве, так и в облаке. Однако в новой модели, предназначенной только для устройств, пользователи могут получить доступ к автономным возможностям, которые обеспечивают почти такую же производительность, как и флагманская версия.

Модель на устройстве может мгновенно справляться с несколькими задачами и адаптироваться к незнакомым ситуациям "всего за 50-100 демонстраций", объясняет Парада. Хотя изначально Google обучала модель только на своем роботе ALOHA, компания успешно адаптировала ее к другим роботизированным платформам, таким как гуманоидный робот Apollo от Apptronik и двурукий робот Franka FR3.
"Гибридная модель Gemini Robotics остается более мощной, но мы были искренне впечатлены производительностью этой версии устройства", - добавляет Парада. "Ее можно рассматривать как модель начального уровня или как идеальное решение для сред с ненадежным интернетом". Она также подходит для организаций со строгими протоколами безопасности".
В дополнение к новой модели Google выпускает комплект для разработки программного обеспечения (SDK), чтобы разработчики могли тестировать и настраивать его - это первый случай выпуска такого комплекта инструментов для одного из VLA Google DeepMind.
Модель Gemini Robotics и сопутствующий SDK будут первоначально предоставлены избранной группе доверенных тестеров, пока Google продолжает решать и минимизировать потенциальные проблемы безопасности.
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.











