谷歌将Gemini语音输入功能整合到Gboard中,向语音输入初创企业发起挑战

在周二上午举行的“Android Show:I/O 2026”活动上,谷歌推出了“Rambler”——这是其广受欢迎的安卓键盘应用 Gboard 的一项全新人工智能驱动的语音输入功能。 此次发布使谷歌直接与Wispr Flow和Typeless等新兴AI语音输入应用展开竞争,这些应用近年来在桌面端和移动端都获得了广泛关注——尽管其中大多数尚未在Android平台上建立起强大的市场地位。
与其他语音输入应用一样,Rambler 能自动去除“嗯”、“啊”等口头语。它还能识别句子中的修正,例如:“我打算周三下午 3 点在我们常去的咖啡馆和你见面……嗯,是下午 2 点。”
谷歌表示,Rambler 采用了基于 Gemini 的多语言模型,该模型还支持“代码切换”(code-switching)。代码切换允许用户在句子中间切换语言——例如从英语切换到印地语——而 Rambler 能够保持上下文连贯性,不会中断输入。 这一功能反映了许多多语言使用者自然的交流方式,而大多数西方语音输入应用却迟迟未采用这一特性。
谷歌表示,当Rambler处于激活状态时,Gboard会向用户发出明确提示。该功能不会存储任何语音录音;音频仅用于转录语音。在简报会上,谷歌指出,由于Rambler可在所有应用中使用,这相当于“重新发明了键盘”。
正在加载播放器……
关于隐私问题,Android 核心体验总监本·格林伍德(Ben Greenwood)表示,谷歌采用了设备端与云端处理相结合的方式,并“多年来投入了大量资源”,以确保各项功能“安全且私密”——这一表态旨在向那些将 Rambler 与可能采用不同数据处理方式的第三方语音输入应用进行比较的用户传递明确信息。
过去几年间,众多语音输入应用相继涌现,包括 Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy 和 Typeless。然而,相关活动主要集中在桌面端和 iOS 平台,Android 平台则相对被忽视。 谷歌本身也于上个月在 iOS 平台发布了 AI Edge Eloquent,这是一款由其设备端 Gemma AI 模型驱动的“离线优先”语音输入应用。
Rambler是谷歌迄今为止为弥合这一差距所迈出的最果断的一步。最初,这些新功能将在今夏的更新中仅面向三星Galaxy和谷歌Pixel手机推出,但最终将扩展至其他Android设备。 其关键优势在于分发渠道:Gboard是全球绝大多数Android用户的默认键盘,这意味着Rambler将预装在数亿用户的设备上。 当平台巨头在操作系统层面进入市场时,独立应用必须提供令人信服的理由——更高的准确率、更深入的功能或更强的隐私保障——才能让用户愿意额外下载。
对于语音输入初创公司而言,问题已从“能否打造出优质产品”转变为“能否打造出足够优秀的产品,让用户主动去寻找它”。
相关文章
Gemini Spark 现在管理 Google Photos 图库
Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
相关专题推荐
评论 (0)
0/500

在周二上午举行的“Android Show:I/O 2026”活动上,谷歌推出了“Rambler”——这是其广受欢迎的安卓键盘应用 Gboard 的一项全新人工智能驱动的语音输入功能。 此次发布使谷歌直接与Wispr Flow和Typeless等新兴AI语音输入应用展开竞争,这些应用近年来在桌面端和移动端都获得了广泛关注——尽管其中大多数尚未在Android平台上建立起强大的市场地位。
与其他语音输入应用一样,Rambler 能自动去除“嗯”、“啊”等口头语。它还能识别句子中的修正,例如:“我打算周三下午 3 点在我们常去的咖啡馆和你见面……嗯,是下午 2 点。”
谷歌表示,Rambler 采用了基于 Gemini 的多语言模型,该模型还支持“代码切换”(code-switching)。代码切换允许用户在句子中间切换语言——例如从英语切换到印地语——而 Rambler 能够保持上下文连贯性,不会中断输入。 这一功能反映了许多多语言使用者自然的交流方式,而大多数西方语音输入应用却迟迟未采用这一特性。
谷歌表示,当Rambler处于激活状态时,Gboard会向用户发出明确提示。该功能不会存储任何语音录音;音频仅用于转录语音。在简报会上,谷歌指出,由于Rambler可在所有应用中使用,这相当于“重新发明了键盘”。
正在加载播放器……
关于隐私问题,Android 核心体验总监本·格林伍德(Ben Greenwood)表示,谷歌采用了设备端与云端处理相结合的方式,并“多年来投入了大量资源”,以确保各项功能“安全且私密”——这一表态旨在向那些将 Rambler 与可能采用不同数据处理方式的第三方语音输入应用进行比较的用户传递明确信息。
过去几年间,众多语音输入应用相继涌现,包括 Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy 和 Typeless。然而,相关活动主要集中在桌面端和 iOS 平台,Android 平台则相对被忽视。 谷歌本身也于上个月在 iOS 平台发布了 AI Edge Eloquent,这是一款由其设备端 Gemma AI 模型驱动的“离线优先”语音输入应用。
Rambler是谷歌迄今为止为弥合这一差距所迈出的最果断的一步。最初,这些新功能将在今夏的更新中仅面向三星Galaxy和谷歌Pixel手机推出,但最终将扩展至其他Android设备。 其关键优势在于分发渠道:Gboard是全球绝大多数Android用户的默认键盘,这意味着Rambler将预装在数亿用户的设备上。 当平台巨头在操作系统层面进入市场时,独立应用必须提供令人信服的理由——更高的准确率、更深入的功能或更强的隐私保障——才能让用户愿意额外下载。
对于语音输入初创公司而言,问题已从“能否打造出优质产品”转变为“能否打造出足够优秀的产品,让用户主动去寻找它”。
Gemini Spark 现在管理 Google Photos 图库
Google 正在通过启用 Gemini Spark 来管理 Google Photos 图库,从而扩大其人工智能集成范围。用户现在可以指示该代理编辑图片、整理相册、从精选照片中生成共享合集、将演唱会传单转换为日历事件,并自动化其他工作流程。Google Photos 负责人 Shimrit Ben-Yair 在 X 平台上宣布了这些新功能,表示符合条件的美国 Gemini AI Pro 和 Ultra 订阅用户将在未来几周内获得英语支持。该公司尚未明确说明这些功能是否会扩展至国际市场,以及
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met





首页






