ChatGPT移动端上新语音智能体,动嘴就能写文档
「OpenAI 宣布 ChatGPT 移动端新增基于语音的智能体功能,用户通过说话即可完成撰写文档、总结电子邮件等任务。Pro 和 Plus 订阅用户可创建文档、撰写邮件、总结 Slack 消息,还能建网站、做 PPT、使用云端浏览器;Free 和 Go 用户可使用插件与已连接应用。语音交互正从问答走向端到端任务执行。」
OpenAI 宣布,ChatGPT 移动端将新增基于语音的智能体功能,用户只需开口说话,就能完成撰写文档、总结电子邮件等工作。这标志着 ChatGPT 的语音交互从传统的问答模式,进一步迈向能动手干活的端到端任务执行。
按照订阅层级的不同,用户可以调用的能力也有所差异。Pro 和 Plus 订阅用户可在手机上通过工作入口创建文档、撰写电子邮件或总结 Slack 消息,还能执行创建网站、制作 PPT、使用云端浏览器等进阶操作。Free 和 Go 订阅用户则可以使用插件与已连接的应用,同样能在移动端获得语音驱动的工作能力。
OpenAI 表示,ChatGPT 的语音对话将提供更丰富的文本输出。Plus 订阅用户可以在文本与语音之间轻松切换,也可以先在手机上处理工作,再转移到电脑上继续,实现跨设备的任务衔接。
从产品形态来看,这次更新的核心变化在于交互入口与执行能力的结合。过去语音更多承担提问与获取答案的角色,输出以短句和对话为主;如今语音成为发起任务的指令通道,模型需要理解目标、拆解步骤、调用工具并产出可直接使用的文档或消息摘要。对移动场景而言,这种改变尤其明显,用户在通勤、行走或不便打字的场合,也能把一段口头描述转化为结构完整的文本成果。
同时,跨设备接力与文本、语音自由切换的设计,说明语音并非要取代键盘,而是与既有输入方式并行。用户可以在语音发起任务后回到文字界面精修内容,也可以先在手机端完成初步整理,再到电脑端继续深化。这种组合方式降低了移动端处理复杂工作的门槛。
整体来看,此次更新把 ChatGPT 的语音能力从问答助手推进到任务执行代理,也让移动端成为智能体落地的重要阵地。随着插件与已连接应用向更多订阅层级开放,语音驱动的工作流有望覆盖更多日常办公场景。
来源:Heooo AI工具导航