ChatGPT Voice in Work:新功能、如何开启及替代方案 (2026)

2026年9月23日,OpenAI 将 ChatGPT Voice 引入了网页端和移动端的 ChatGPT Work,并允许 Voice 使用插件。在 Work 中,您可以通过语音要求它创建文档、演示文稿和电子表格,使用已连接的应用,或在浏览器中工作。在 Work 中使用 Voice 需要同时拥有 Voice 和 Work 的访问权限。
本指南介绍了发生的变化、各个 Voice 选项的功能,以及如何在每个方案中获取访问权限。它还涵盖了使用限制、数据处理方式以及值得对比的替代方案。所有细节均源自2026年9月24日阅读的厂商帮助页面。
9月23日发生了什么变化
ChatGPT 发布说明将此次更新列在2026年9月23日下,标题为“在 Voice 中使用插件,通过语音完成工作”。两项变化同时推出。
首先,Live 语音选项现在支持网页端、iOS 和 Android 上的插件。在通话期间,您可以使用“您账户中可用的插件和已连接的应用”,并在聊天中查看书面回复。
其次,ChatGPT Voice 现在可在 Work 内部使用。发布说明简单地写道:“要求它创建文档、演示文稿和电子表格,使用已连接的应用,或在浏览器中工作。”如果您挂断电话时任务仍在运行,它可以继续以文本形式进行。
发布说明还设定了访问规则。“在 Work 中使用 Voice 需要同时拥有 Voice 和 Work 的访问权限。”Free 和 Go 用户可以在 Chat 中使用 Voice,并搭配其方案支持的插件。
第二项变化对于完成工作至关重要。在 Work 内部,ChatGPT Voice 成为了一种启动和引导任务的方式,并最终生成文件。
三种 Voice 选项
OpenAI 的帮助中心在“设置”下的“Voice”中列出了三个选项。它们的行为有所不同,因此了解您正在使用哪一个会有所帮助。
| 选项 | 工作原理 | 新增功能 |
|---|---|---|
| Live | 同时进行倾听和说话,因此您可以随时打断 | 网页搜索、记忆、小部件、文本和图像、插件以及已连接的应用 |
| Advanced | 之前的实时 Voice 体验 | 在受支持的移动应用上进行视频和屏幕共享 |
| Standard | 轮流对话;在回应前先转录您的语音 | 更简单、转录优先的流程 |
帮助中心表示,Live 由 GPT-Live-1 或 GPT-Live-1 mini 提供支持,具体取决于您的方案。它还指出了一项不足:“Live 不支持视频或屏幕共享。”如果您需要展示屏幕,可以在移动端切换到 Advanced。
您可以使用的选项可能取决于您的方案、工作区设置、地区、应用版本和家长控制。帮助中心列出了所有这五项。
Voice 在 Work 中能做什么
OpenAI 将 Work 描述为“专为更长、多步骤工作和最终交付成果而设计的智能体”。它的工作包括创建“文档、电子表格、演示文稿、报告或 Site”。ChatGPT Voice 为该智能体提供了一个语音前端。
在实践中,有三种请求非常适合:
- 启动交付成果。 描述您需要的文档或幻灯片、受众以及要使用的来源。Work 会在您于聊天中关注进度的同时构建它。
- 从已连接的应用中提取数据。 要求 Voice 使用电子邮件、日历或 Slack 插件,然后将结果融入到任务中。
- 交接并稍后继续。 当您到达办公桌前时结束通话。帮助中心表示,未完成的任务“可以继续以文本形式进行”。
有一个细节改变了您的使用方式。“在网页端和移动端,如果某个操作需要您的批准,Voice 会提示您在屏幕上进行确认。”不支持语音批准。因此,发送电子邮件或编辑文件的语音会话仍然需要看一眼屏幕。
桌面端应用的工作方式略有不同。在桌面端,ChatGPT Voice 可以通过一次对话启动任务、检查进度并协调多个智能体。它适用于 macOS 和 Windows。
如何在 Work 中访问 ChatGPT Voice
访问权限取决于两点:您的方案和您的工作区设置。
在个人方案中,符合条件的付费方案可在网页端和移动端使用 Work。发布说明补充道,Free 和 Go 用户可以在 Chat 中使用 Voice,并搭配其方案支持的插件。
在 Business、Enterprise、Edu 和 Healthcare 工作区中,帮助中心表示 ChatGPT Voice 的可用性“取决于工作区设置”。在受管理的工作区中,在 Work 中使用 Voice 需要同时拥有 Voice 和 Work 的访问权限。管理员可以通过“工作区设置”下的“权限和角色”来控制 Work。
要在网页端启动会话,请打开 ChatGPT 并选择 Work。选择 Voice 控件,如果浏览器要求,请允许麦克风访问权限。在 iOS 和 Android 上,选择消息栏中的 Voice 图标。
在升级之前,有一项帮助中心上的通知值得了解。它指出,新用户注册以及升级到 ChatGPT Pro $200 方案的通道已暂时关闭。现有订阅将照常继续续订。
使用限制和费用
在 Chat 中,Live 的使用量是在滚动 24 小时周期内计算的。帮助中心列出了这些额度。
| 方案 | Chat 中的 Live 使用量 |
|---|---|
| Free | 限制访问 GPT-Live-1 mini;限制可能会发生变化 |
| Go | 搭配 GPT-Live-1 mini 使用 3 小时 |
| Plus | 搭配 GPT-Live-1 使用 3 小时 |
| Pro $100 | 搭配 GPT-Live-1 使用 15 小时 |
| Pro $200 | 无限制使用 GPT-Live-1 |
| Business Standard | 搭配 GPT-Live-1 使用 3 小时,之后每分钟 1.25 积分 |
| Business Premium | 搭配 GPT-Live-1 使用 15 小时,之后每分钟 1.25 积分 |
| 按使用量美元计费的 Enterprise | 每分钟 $0.05 |
Work 中的 ChatGPT Voice 遵循您方案的 Voice 限制和计费规则。帮助中心补充道,“Work 任务也会计入您的正常 Work 使用量,就像您打字时一样。”因此,无论您是通过语音还是打字提出请求,长文档任务的成本都是相同的。
桌面端应用中的 Voice 具有独立的定价和限制。同时使用这两个界面的团队在广泛推广之前,应查看桌面端定价页面。
隐私和数据控制
每次 ChatGPT Voice 会话都会生成音频,因此保留规则非常重要。
帮助中心表示,来自 Live 和 Advanced 对话的音频片段会与聊天转录文本一起存储。“片段将保留 30 天。”删除聊天也会在 30 天内删除其片段,但出于安全、防范或法律原因的例外情况除外。
使用 Standard 时,音频会先被转录。OpenAI 表示,除非您选择共享音频用于训练,否则它会在转录后删除该音频。
音频训练是选择性加入的。Free、Plus 和 Pro 用户可以通过“数据控制”共享片段。用户无法共享来自 Business、Enterprise 或 Edu 工作区的音频或视频片段。
值得了解的限制
帮助中心坦言了目前 ChatGPT Voice 的不足之处。在工作使用中,有五项限制尤为突出:
- Live 目前无法从您的 ChatGPT 库中查找或添加文件。您可能仍需要手动附加文件。
- Live 不支持视频或屏幕共享。
- 它“尚未针对多发言者对话进行优化”,因此帮助中心并未将其描述为记录会议的一种方式。
- “Voice 转录文本并非逐字记录,可能与实际所说内容不完全一致。”
- 您一次只能进行一个 Voice 对话。
这些限制都不会阻碍主要的使用场景。它们确实意味着语音更适合启动和引导任务,而审查输出内容仍然需要在屏幕上进行。
目前切实可行的使用场景
以下几种模式非常契合当前的功能集:
- 在移动中简述幻灯片大纲。 在通勤时描述受众、三个要点和源文件。坐下来后再审查草稿。
- 将日历转化为准备文档。 要求 Voice 查看明天的会议,并为每个会议起草一份一页纸的简报。
- 跟进进度,然后采取行动。 让它通过插件总结电子邮件线程,然后在 Work 中开始起草回复或状态更新。
- 演练发言。 使用 Live 大声练习解释,并询问听众可能会提出什么问题。
这些场景中的每一个都以 ChatGPT Voice 开始,并以您在发送前仍需阅读的文件结束。
值得了解的替代方案
另外两款助手也提供可以使用已连接应用的语音对话。它们的帮助页面描述了不同的适用范围。
| 助手 | 语音适用平台 | 语音中已连接的工具 | 屏幕或摄像头共享 |
|---|---|---|---|
| ChatGPT Voice (Live) | 网页端、iOS、Android、桌面端 | 您账户中的插件和已连接的应用 | Live 中不支持;移动端支持 Advanced |
| Gemini Live | Gemini 移动应用 | 部分 Connected Apps,例如 Google Calendar、Keep 和 Tasks | 摄像头和屏幕共享 |
| Claude 语音模式 | 移动端、桌面端和网页端 | Gmail、Google Calendar、Google Docs、Slack 等 | 帮助页面上未描述 |
Gemini Live。Google 的帮助页面将其描述为“与 Gemini 进行自然、流畅且可随时打断的对话”。它支持移动端上的摄像头和屏幕共享。它“可以使用部分 Connected Apps 和其他服务”,例如向您的日历添加活动,相关支持正在逐步推出。该页面指出,目前 Gemini Live 在 Gemini 网页端应用中尚不可用。
Claude 语音模式。Anthropic 的帮助中心称其为在移动端、桌面端和网页端“向所有方案开放的测试版功能”。在语音模式下,Claude 可以使用已连接的工具,如 Gmail、Google Calendar、Google Docs 和 Slack。该页面指出,Claude Fable 目前在语音模式下不可用。
如果您的目标是由智能体构建一份完成的文档,那么 Work 中的 ChatGPT Voice 是其帮助页面直接描述了该项工作的选项。如果您主要是想通过交谈来解决问题,那么这三者都值得一试。
语音不再起作用的场景
口头提出请求比打字更快。但查看图表、表格或数字并不是光靠耳朵就能完成的。帮助中心也以自己的方式表达了同样的观点:转录文本并非逐字记录,且批准操作需要在屏幕上进行。
这一审查步骤正是数据源发挥作用的地方。当幻灯片包含来自电子表格的数据时,必须有人确认每个数字都与文件相符。Powerdrill Bloom 可以根据您上传的文件构建图表、文档和幻灯片。其主页写道:“每一个数字都附带其背后的页面、行和数据来源。”
对于从主题而非文件开始构建的幻灯片,我们的主题转 PPT页面涵盖了这一途径。对于其他 ChatGPT 界面,请参阅我们关于什么是 ChatGPT Work的说明以及我们对适用于 Word 的 ChatGPT的概述。
如何开始
从您每周已经在做的一项任务开始。状态更新或简短的简报是一个很好的首次测试,因为您知道最终版本应该是什么样子。
打开 Work,启动 Live 会话,并一次性描述交付成果:受众、来源和格式。让任务运行,然后阅读屏幕上的输出,并通过语音或文本进行纠正。记录下您必须修改的内容,以便在下一次请求中提前包含这些要求。
当交付成果依赖于您自己的数据时,您可以尝试 Powerdrill Bloom,将电子表格转化为有源图表或幻灯片。
常见问题解答
什么是 ChatGPT Voice?
ChatGPT Voice 让您可以与 ChatGPT 进行语音对话并听到语音回复,同时在聊天中查看文本形式的响应。它的 Live 选项可以同时进行倾听和说话。自2026年9月23日起,Live 还可以使用插件并在 ChatGPT Work 内部工作。
如何在 Work 中使用 ChatGPT Voice?
打开 ChatGPT,选择 Work,然后选择 Voice 控件以启动 Live 会话。接着要求它创建文档、演示文稿或电子表格,或者使用已连接的应用。在 Work 中使用 Voice 需要您的方案同时拥有 Voice 和 Work 的访问权限。
ChatGPT Voice 是免费的吗?
Free 用户在 Chat 中可以获得对 GPT-Live-1 mini 的有限访问权限,OpenAI 表示这些限制可能会发生变化。在 Work 中使用 Voice 需要 Work 访问权限,该权限随符合条件的付费方案提供。Go 和 Plus 在滚动 24 小时内包含 3 小时的 Chat 中 Live 使用时间。
ChatGPT Voice 可以使用插件吗?
是的。自2026年9月23日起,Live 选项可以使用您账户中可用的插件和已连接的应用。如果某个操作需要批准,您需要在屏幕上进行确认,因为不支持语音批准。
OpenAI 会将 ChatGPT Voice 音频保留多长时间?
OpenAI 的帮助中心表示,来自 Live 和 Advanced 对话的音频片段会与聊天转录文本一起保留 30 天。删除聊天会在 30 天内删除其片段,但某些法律和安全例外情况除外。使用 Standard 时,音频会在转录后被删除。
来源: ChatGPT 发布说明 · ChatGPT Voice 帮助文章 · ChatGPT Work 和 Codex 帮助文章 · 与 Gemini Live 自然对话 · Claude 帮助中心,使用语音模式。方案、限制和可用性信息源自2026年9月24日阅读的厂商帮助页面。