OpenAI为ChatGPT移动端引入语音代理功能

OpenAI将语音代理功能引入ChatGPT移动端。Plus和Pro用户可通过“Work”选项卡执行创建文档、起草邮件等任务,并支持文字与语音无缝切换及跨设备同步会话。

OpenAI 于 2026 年 9 月 23 日正式宣布,将基于语音的代理功能引入 ChatGPT 移动应用程序。此次更新旨在通过语音指令触发复杂的工作流程,进一步拓展移动端 AI 助手的应用场景。

Plus/Pro用户可用语音建网站
图片来源:塞尔·博伊文/NurPhoto / 盖蒂影像

根据订阅层级的不同,用户可访问的功能存在差异。Plus 和 Pro 订阅用户现在可以通过手机上的“Work”选项卡执行多项任务,包括创建文档、起草电子邮件以及总结 Slack 消息。此外,这些用户还能在 ChatGPT 中构建网站、制作演示文稿,并使用云浏览器功能。相比之下,免费用户和 Go 计划用户则主要依赖插件及连接的应用程序来扩展功能。

在交互体验方面,OpenAI 表示 ChatGPT 的语音对话模式将提供更丰富的文本输出支持。系统允许用户在文字输入与语音交互之间无缝切换,并支持跨设备同步会话——用户可以在移动设备上发起对话,随后在桌面端继续完成剩余操作。

这一功能的推出延续了 OpenAI 今年 7 月的产品迭代路径。当时,该公司发布了新的对话模式 GPT-Live,并将其集成至桌面应用程序中,使用户能够通过声音在“Work”选项卡中处理任务或在“Codex”选项卡中构建应用程序。此次移动端更新正是将类似的语音代理能力下放至智能手机平台。

随着越来越多用户倾向于通过语音向人工智能助理下达复杂指令,行业内的交互标准正在发生变化。此前,竞争对手 Anthropic 已采取措施简化移动与桌面端之间的数据交换,并合并了其 Cowork 和 Chat 接口。不过,OpenAI 目前仍保持聊天界面与工作空间界面的分离架构。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读