DeepMind 的新人工智能让机器人通过网络搜索完成任务
谷歌 DeepMind 宣布,其增强型人工智能模型现在可以让机器人处理更复杂的任务,甚至可以利用网络资源提供帮助。在一次新闻发布会上,谷歌DeepMind公司机器人技术主管卡罗琳娜-帕拉达(Carolina Parada)解释说,该公司最新的人工智能模型能够使机器人在物理环境中执行动作之前 "提前规划多个步骤"。
该系统由最新发布的双子座机器人1.5和具身推理模型Gemini Robotics-ER 1.5驱动,它们是谷歌DeepMind今年3月发布的人工智能模型的升级版本。机器人不再局限于执行单个任务,如折叠一张纸或拉开一个包的拉链。它们现在可以根据深色和浅色对衣物进行分类,根据伦敦当前的天气情况打包行李,以及根据从网络搜索中获取的特定地点指南协助进行垃圾、堆肥和回收分类等活动。
"帕拉达指出:"以前的型号在执行单个指令方面表现出色,通用性很高。"通过这次更新,我们正在从单一步骤指令转向真正理解和解决问题的物理任务。
为了实现这一目标,机器人采用了升级后的 Gemini Robotics-ER 1.5 模型来解读周围环境,并利用谷歌搜索等数字工具获取更多信息。然后,Gemini Robotics-ER 1.5 会将这些发现转化为 Gemini Robotics 1.5 的纯语言指令,让机器人利用模型的视觉和语言能力来执行每个步骤。

谷歌 DeepMind 的人工智能模型协同协助机器人规划和执行任务 :谷歌相关内容
- 谷歌 DeepMind 的优化人工智能模型可直接在机器人身上运行
此外,谷歌DeepMind还透露,Gemini Robotics 1.5可以让机器人相互 "学习",而不管它们的硬件配置如何。该公司发现,在 ALOHA2 机器人--一个拥有两个机械臂的系统--上演示的任务可以直接在双臂弗兰卡机器人和 Apptronik 的仿人机器人阿波罗上执行。"谷歌 DeepMind 软件工程师卡尼什卡-拉奥(Kanishka Rao)在发布会上表示:"这提供了两个关键优势:首先,我们可以使用单一模型控制高度多样化的机器人,包括仿人机器人。"其次,一个机器人获得的技能现在可以转移到另一个机器人身上"。
作为此次推广活动的一部分,谷歌DeepMind将通过谷歌人工智能工作室(Google AI Studio)中的Gemini API向开发者提供Gemini Robotics-ER 1.5,而Gemini Robotics 1.5仍然只对选定的合作伙伴开放。
相关文章
奥利押注隐私保护,力争在AI助手竞争中胜出
要真正发挥帮助作用,人工智能助手必须深刻理解其用户。Ollie 是一款专为日常生活设计的个人助理,其运作理念是:实现这一点无需用户交出数据,也不会损害用户的隐私。虽然某些企业级人工智能工具提供了数据隐私保护措施,但Ollie作为首批通过SOC 2认证的主流、面向家庭的人工智能服务之一,尤为突出。该认证框架允许企业通过独立审计证明,其已建立正式的控制措施来保护客户数据,并确保系统安全运行。达成这一里
AI LIVE:伦敦将如何探讨人工智能与工业自动化
本次峰会将汇聚来自全球的高管,共同探讨全球各行业面临的紧迫挑战,涵盖从人工智能驱动的颠覆性变革到经济波动等各个方面。AI LIVE:伦敦峰会将以“技术与人类使命”为主题,汇聚2,000余位国际领袖,共同探讨人工智能的新时代。BizClik旗下品牌《AI Magazine》已公布其在“AI LIVE:伦敦峰会”上举办的关于人工智能与工业自动化的联合炉边谈话环节阵容。该专题讨论会定于10月20日在伦敦
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·
相关专题推荐
评论 (1)
0/500
谷歌 DeepMind 宣布,其增强型人工智能模型现在可以让机器人处理更复杂的任务,甚至可以利用网络资源提供帮助。在一次新闻发布会上,谷歌DeepMind公司机器人技术主管卡罗琳娜-帕拉达(Carolina Parada)解释说,该公司最新的人工智能模型能够使机器人在物理环境中执行动作之前 "提前规划多个步骤"。
该系统由最新发布的双子座机器人1.5和具身推理模型Gemini Robotics-ER 1.5驱动,它们是谷歌DeepMind今年3月发布的人工智能模型的升级版本。机器人不再局限于执行单个任务,如折叠一张纸或拉开一个包的拉链。它们现在可以根据深色和浅色对衣物进行分类,根据伦敦当前的天气情况打包行李,以及根据从网络搜索中获取的特定地点指南协助进行垃圾、堆肥和回收分类等活动。
"帕拉达指出:"以前的型号在执行单个指令方面表现出色,通用性很高。"通过这次更新,我们正在从单一步骤指令转向真正理解和解决问题的物理任务。
为了实现这一目标,机器人采用了升级后的 Gemini Robotics-ER 1.5 模型来解读周围环境,并利用谷歌搜索等数字工具获取更多信息。然后,Gemini Robotics-ER 1.5 会将这些发现转化为 Gemini Robotics 1.5 的纯语言指令,让机器人利用模型的视觉和语言能力来执行每个步骤。

相关内容
- 谷歌 DeepMind 的优化人工智能模型可直接在机器人身上运行
此外,谷歌DeepMind还透露,Gemini Robotics 1.5可以让机器人相互 "学习",而不管它们的硬件配置如何。该公司发现,在 ALOHA2 机器人--一个拥有两个机械臂的系统--上演示的任务可以直接在双臂弗兰卡机器人和 Apptronik 的仿人机器人阿波罗上执行。"谷歌 DeepMind 软件工程师卡尼什卡-拉奥(Kanishka Rao)在发布会上表示:"这提供了两个关键优势:首先,我们可以使用单一模型控制高度多样化的机器人,包括仿人机器人。"其次,一个机器人获得的技能现在可以转移到另一个机器人身上"。
作为此次推广活动的一部分,谷歌DeepMind将通过谷歌人工智能工作室(Google AI Studio)中的Gemini API向开发者提供Gemini Robotics-ER 1.5,而Gemini Robotics 1.5仍然只对选定的合作伙伴开放。
奥利押注隐私保护,力争在AI助手竞争中胜出
要真正发挥帮助作用,人工智能助手必须深刻理解其用户。Ollie 是一款专为日常生活设计的个人助理,其运作理念是:实现这一点无需用户交出数据,也不会损害用户的隐私。虽然某些企业级人工智能工具提供了数据隐私保护措施,但Ollie作为首批通过SOC 2认证的主流、面向家庭的人工智能服务之一,尤为突出。该认证框架允许企业通过独立审计证明,其已建立正式的控制措施来保护客户数据,并确保系统安全运行。达成这一里
AI LIVE:伦敦将如何探讨人工智能与工业自动化
本次峰会将汇聚来自全球的高管,共同探讨全球各行业面临的紧迫挑战,涵盖从人工智能驱动的颠覆性变革到经济波动等各个方面。AI LIVE:伦敦峰会将以“技术与人类使命”为主题,汇聚2,000余位国际领袖,共同探讨人工智能的新时代。BizClik旗下品牌《AI Magazine》已公布其在“AI LIVE:伦敦峰会”上举办的关于人工智能与工业自动化的联合炉边谈话环节阵容。该专题讨论会定于10月20日在伦敦
Anthropic 进入 AI 法律科技市场,竞争日益激烈
Anthropic 于周二发布了一系列新的聊天机器人功能,旨在为法律实务提供自动化支持。这些增强功能在年初推出的特定律所平台 Claude for Legal 基础上进行了扩展,增加了针对不同法律领域的专用法律插件和 MCP 连接器。随着法律人工智能领域竞争的加剧,这些工具应运而生。今年三月,利用代理式人工智能简化法律工作流的 AI 法律初创公司 Harvey 以 110 亿美元的估值获得了 2 亿美元融资。上个月,竞争对手 Legora 完成了 6 亿美元的 D 轮融资,并启动了一场由裘德·





首页






