谷歌将Gemini语音输入功能整合到Gboard中,向语音输入初创企业发起挑战

在周二上午举行的“Android Show:I/O 2026”活动上,谷歌推出了“Rambler”——这是其广受欢迎的安卓键盘应用 Gboard 的一项全新人工智能驱动的语音输入功能。 此次发布使谷歌直接与Wispr Flow和Typeless等新兴AI语音输入应用展开竞争,这些应用近年来在桌面端和移动端都获得了广泛关注——尽管其中大多数尚未在Android平台上建立起强大的市场地位。
与其他语音输入应用一样,Rambler 能自动去除“嗯”、“啊”等口头语。它还能识别句子中的修正,例如:“我打算周三下午 3 点在我们常去的咖啡馆和你见面……嗯,是下午 2 点。”
谷歌表示,Rambler 采用了基于 Gemini 的多语言模型,该模型还支持“代码切换”(code-switching)。代码切换允许用户在句子中间切换语言——例如从英语切换到印地语——而 Rambler 能够保持上下文连贯性,不会中断输入。 这一功能反映了许多多语言使用者自然的交流方式,而大多数西方语音输入应用却迟迟未采用这一特性。
谷歌表示,当Rambler处于激活状态时,Gboard会向用户发出明确提示。该功能不会存储任何语音录音;音频仅用于转录语音。在简报会上,谷歌指出,由于Rambler可在所有应用中使用,这相当于“重新发明了键盘”。
正在加载播放器……
关于隐私问题,Android 核心体验总监本·格林伍德(Ben Greenwood)表示,谷歌采用了设备端与云端处理相结合的方式,并“多年来投入了大量资源”,以确保各项功能“安全且私密”——这一表态旨在向那些将 Rambler 与可能采用不同数据处理方式的第三方语音输入应用进行比较的用户传递明确信息。
过去几年间,众多语音输入应用相继涌现,包括 Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy 和 Typeless。然而,相关活动主要集中在桌面端和 iOS 平台,Android 平台则相对被忽视。 谷歌本身也于上个月在 iOS 平台发布了 AI Edge Eloquent,这是一款由其设备端 Gemma AI 模型驱动的“离线优先”语音输入应用。
Rambler是谷歌迄今为止为弥合这一差距所迈出的最果断的一步。最初,这些新功能将在今夏的更新中仅面向三星Galaxy和谷歌Pixel手机推出,但最终将扩展至其他Android设备。 其关键优势在于分发渠道:Gboard是全球绝大多数Android用户的默认键盘,这意味着Rambler将预装在数亿用户的设备上。 当平台巨头在操作系统层面进入市场时,独立应用必须提供令人信服的理由——更高的准确率、更深入的功能或更强的隐私保障——才能让用户愿意额外下载。
对于语音输入初创公司而言,问题已从“能否打造出优质产品”转变为“能否打造出足够优秀的产品,让用户主动去寻找它”。
相关文章
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片
相关专题推荐
评论 (0)
0/500

在周二上午举行的“Android Show:I/O 2026”活动上,谷歌推出了“Rambler”——这是其广受欢迎的安卓键盘应用 Gboard 的一项全新人工智能驱动的语音输入功能。 此次发布使谷歌直接与Wispr Flow和Typeless等新兴AI语音输入应用展开竞争,这些应用近年来在桌面端和移动端都获得了广泛关注——尽管其中大多数尚未在Android平台上建立起强大的市场地位。
与其他语音输入应用一样,Rambler 能自动去除“嗯”、“啊”等口头语。它还能识别句子中的修正,例如:“我打算周三下午 3 点在我们常去的咖啡馆和你见面……嗯,是下午 2 点。”
谷歌表示,Rambler 采用了基于 Gemini 的多语言模型,该模型还支持“代码切换”(code-switching)。代码切换允许用户在句子中间切换语言——例如从英语切换到印地语——而 Rambler 能够保持上下文连贯性,不会中断输入。 这一功能反映了许多多语言使用者自然的交流方式,而大多数西方语音输入应用却迟迟未采用这一特性。
谷歌表示,当Rambler处于激活状态时,Gboard会向用户发出明确提示。该功能不会存储任何语音录音;音频仅用于转录语音。在简报会上,谷歌指出,由于Rambler可在所有应用中使用,这相当于“重新发明了键盘”。
正在加载播放器……
关于隐私问题,Android 核心体验总监本·格林伍德(Ben Greenwood)表示,谷歌采用了设备端与云端处理相结合的方式,并“多年来投入了大量资源”,以确保各项功能“安全且私密”——这一表态旨在向那些将 Rambler 与可能采用不同数据处理方式的第三方语音输入应用进行比较的用户传递明确信息。
过去几年间,众多语音输入应用相继涌现,包括 Wispr Flow、Willow、SuperWhisper、Monoglogue、Handy 和 Typeless。然而,相关活动主要集中在桌面端和 iOS 平台,Android 平台则相对被忽视。 谷歌本身也于上个月在 iOS 平台发布了 AI Edge Eloquent,这是一款由其设备端 Gemma AI 模型驱动的“离线优先”语音输入应用。
Rambler是谷歌迄今为止为弥合这一差距所迈出的最果断的一步。最初,这些新功能将在今夏的更新中仅面向三星Galaxy和谷歌Pixel手机推出,但最终将扩展至其他Android设备。 其关键优势在于分发渠道:Gboard是全球绝大多数Android用户的默认键盘,这意味着Rambler将预装在数亿用户的设备上。 当平台巨头在操作系统层面进入市场时,独立应用必须提供令人信服的理由——更高的准确率、更深入的功能或更强的隐私保障——才能让用户愿意额外下载。
对于语音输入初创公司而言,问题已从“能否打造出优质产品”转变为“能否打造出足够优秀的产品,让用户主动去寻找它”。
谷歌推出虚假来电检测功能,以防范AI深度伪造冒充诈骗
谷歌周二宣布,Android将推出虚假来电检测功能,以防范利用AI深度伪造技术实施的冒充诈骗。该功能将于本月通过“Phone by Google”在全球范围内面向Android 12及以上版本的设备逐步推出,首先适用于Pixel设备。随着人们越来越不愿接听陌生号码的来电,诈骗分子正改变策略,通过伪造可信的电话号码,并利用AI深度伪造技术模仿权威人士、家人或雇主的语气进行诈骗。例如,某人可能会接到一
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
谷歌在2026年IO大会上推出基于音频技术的智能眼镜,此举与Meta的战略如出一辙
谷歌正战略性地重返智能眼镜市场。在周二举行的谷歌I/O大会上,这家科技巨头宣布与Warby Parker和Gentle Monster合作,推出一系列搭载人工智能的新款眼镜。这些设备由谷歌与三星联合设计,经过优化可与Android和iOS平台无缝集成,计划于今年晚些时候发布。谷歌将这些设备称为“音频眼镜”,用户可通过语音指令进行交互,并利用包括Gemini在内的一系列应用和服务来完成各项任务。图片





首页






