ChatGPT移动端上线语音智能体功能 封面图
行业资讯

ChatGPT移动端上线语音智能体功能

Heooo 09月24日01时59分 20 阅读

「OpenAI为ChatGPT移动应用引入基于语音的智能体功能,用户可通过语音触发撰写文档、草拟邮件、总结Slack消息等工作流,Plus与Pro用户还能使用Work标签页、构建网站与演示文稿。语音对话将提供更丰富的文本输出,并支持文本与语音自由切换以及跨设备任务接续。」

OpenAI宣布,ChatGPT移动应用正式引入基于语音的智能体功能,用户可以通过语音直接触发各类工作流,例如撰写文档、草拟邮件或总结邮件内容。这一动作被视为OpenAI将智能体能力从桌面端向移动端延伸的关键一步,也让语音交互从简单的问答入口,升级为可以真正执行任务的操作界面。

据OpenAI介绍,此次更新后,ChatGPT的语音对话将提供更丰富的文本输出,用户可以在文本与语音之间自由切换。更重要的是,用户可以在移动场景中开始一段对话或任务,随后在桌面端无缝继续,实现跨设备的任务接续。这种连续性对于需要长时间、多步骤完成的工作尤为重要,也弥补了手机端在复杂任务处理上的天然短板。

ChatGPT移动端上线语音智能体功能

在功能划分上,Plus与Pro订阅用户将可以在手机端使用Work标签页,用来创建文档、草拟邮件以及总结Slack消息。这些付费用户还可以借助移动端构建网站、制作演示文稿、调用云端浏览器,并访问ChatGPT中的财务等其他板块。免费用户与Go用户则可以通过插件和已连接的应用程序参与其中,获得相对基础的智能体体验。这种分层策略一方面保障了付费用户的高阶生产力需求,另一方面也通过插件生态为普通用户保留了扩展空间。

回顾产品节奏,OpenAI此前推出了全新的对话模型GPT-Live,随后将其与桌面应用整合,让用户能够用语音在Work标签页中完成任务,或在Codex标签页中构建应用。此次移动端的上线,本质上把这套能力复制到手机上,使语音智能体的使用场景不再受限于坐在电脑前的时刻。对于需要频繁外出、在通勤或会议间隙处理事务的用户来说,语音入口的价值被显著放大。

这一方向背后是用户行为的明显变化。越来越多的用户开始用语音向AI助手下达指令,并期望其处理复杂任务,而不仅仅是获取一段回答。语音正在从补充性的输入方式,转变为智能体的主要交互入口之一。当语音能够稳定触发文档生成、信息汇总、网页操作等动作时,它就不再只是对话的载体,而是任务编排的起点。

竞争层面,Anthropic近期也在移动端与桌面端的任务交接上做了优化,并合并了Cowork与Chat界面,试图让协作与对话统一在一个入口中。相比之下,OpenAI仍然将聊天与工作区保持分离,把Work、Codex等能力作为相对独立的空间存在。两条路径的差异,反映出厂商对智能体产品形态的不同判断:一方追求入口的合并与统一,另一方则强调任务场景的隔离与专业化。究竟哪种形态更适合多步骤、长链路的实际工作,仍有待用户规模与留存数据来验证。

对于开发者与重度用户而言,语音智能体在移动端的落地意味着更多可编排的空间。插件与已连接应用的开放,让第三方服务有机会接入语音触发的工作流;而跨设备接续则降低了长任务的切换成本。随着语音输出的文本越来越丰富,语音与文本之间的边界也在变得模糊,用户可以在同一个任务中自由选择最合适的表达方式。

可以预见,移动端语音智能体的体验还将持续迭代,覆盖的任务类型会从文档、邮件、消息总结扩展到更多专业场景,而插件生态与云端浏览器等基础设施,将成为衡量这类产品实用性的关键指标。语音是否真能成为移动生产力的主入口,接下来的功能密度与响应质量将给出答案。

# OpenAI # ChatGPT # 语音智能体 # 移动端

来源:Heooo AI工具导航