OpenAI 于 2026 年 9 月 23 日正式宣布,将基于语音的代理功能引入 ChatGPT 移动应用程序。此次更新旨在通过语音指令触发复杂的工作流程,进一步拓展移动端 AI 助手的应用场景。

根据订阅层级的不同,用户可访问的功能存在差异。Plus 和 Pro 订阅用户现在可以通过手机上的“Work”选项卡执行多项任务,包括创建文档、起草电子邮件以及总结 Slack 消息。此外,这些用户还能在 ChatGPT 中构建网站、制作演示文稿,并使用云浏览器功能。相比之下,免费用户和 Go 计划用户则主要依赖插件及连接的应用程序来扩展功能。
在交互体验方面,OpenAI 表示 ChatGPT 的语音对话模式将提供更丰富的文本输出支持。系统允许用户在文字输入与语音交互之间无缝切换,并支持跨设备同步会话——用户可以在移动设备上发起对话,随后在桌面端继续完成剩余操作。
这一功能的推出延续了 OpenAI 今年 7 月的产品迭代路径。当时,该公司发布了新的对话模式 GPT-Live,并将其集成至桌面应用程序中,使用户能够通过声音在“Work”选项卡中处理任务或在“Codex”选项卡中构建应用程序。此次移动端更新正是将类似的语音代理能力下放至智能手机平台。
随着越来越多用户倾向于通过语音向人工智能助理下达复杂指令,行业内的交互标准正在发生变化。此前,竞争对手 Anthropic 已采取措施简化移动与桌面端之间的数据交换,并合并了其 Cowork 和 Chat 接口。不过,OpenAI 目前仍保持聊天界面与工作空间界面的分离架构。





