谷歌推出AI语音功能,Workspace对话交互落地
「谷歌正式在Gmail、Docs和Keep中推出基于Gemini驱动的人工智能语音功能,分别命名为Gmail Live、Docs Live和Keep Live。用户可通过自然语言查询收件箱、生成文档初稿或整理清单,无需手动打字,系统还支持实时文字记录及多源信息调用,标志着谷歌五月开发者大会上预览的语音生态迎来重要落地。」
谷歌近日宣布,在Gmail、Docs和Keep中正式推出基于Gemini驱动的对话式人工智能语音功能,分别命名为Gmail Live、Docs Live和Keep Live。这一举措标志着谷歌在生产力工具中进一步融合自然语言交互,用户无需手动打字,即可通过语音直接向AI助手提问收件箱内容、生成文档初稿,或自动整理食谱与清单。
此次推出的语音功能并非简单的语音转文字,而是完整的对话式交互体验。系统支持用户以自然语言进行多轮问答,并能在对话过程中实时生成文字记录,方便后续查看与编辑。同时,该功能支持调用Gmail、云端硬盘以及网页等多源信息辅助创作,使AI能够结合用户现有资料提供更具针对性的建议与输出。
这一动作被认为是谷歌五月开发者大会(Google I/O)上预览的语音生态正式落地的关键一步。从产品分布来看,Gmail Live已面向Google Plus、Pro和Ultra用户开放,Docs Live与Keep Live则覆盖Pro及Ultra用户,目前支持iOS与Android平台的英文版本。谷歌表示,后续将拓展至Workplace企业用户,进一步扩大应用范围。
值得关注的是,此次升级延续了谷歌在语音交互领域的密集布局。今年4月,谷歌为Mac应用推出了跨应用语音输入功能;8月发布了Gemini 3.5 Transcribe模型,大幅提升语音转文本能力;同时在Pixel 11手机中上线了可去除语气词的Rambler语音工具。这些技术积累为此次Workspace语音功能的落地提供了底层支撑。
随着对话式语音深度融合核心应用,谷歌正加速推动AI交互从单一指令输入向全场景自然对话转型。Gmail Live、Docs Live和Keep Live的推出,不仅提升了日常办公场景中的输入效率,也使人机交互方式更接近人与人之间的沟通习惯。对于依赖文档撰写、邮件处理与信息整理的用户而言,这一升级无疑将降低操作门槛,并进一步提升生产力工具的智能化水平。
来源:Heooo AI工具导航