日常 Voice 用户
可获得更自然的重叠说话、更好的插话处理、可选智能档位与可视化答案;是否可用仍取决于地区、套餐、工作区和版本。
GPT-Live 最新更新
GPT-Live 于 7 月 8 日进入 ChatGPT Voice,7 月 23 日扩展到桌面端 Work 与 Codex;截至 2026 年 7 月 28 日,GPT-Live-1 API 仍未普遍开放。
最后核验:
消费者产品已经上线,开发者模型尚未开放。Free 用户使用 GPT-Live-1 mini,付费消费者套餐使用 GPT-Live-1;在 API 仍只是通知登记页时,开发者应继续使用 GPT-Realtime-2.1。
查看 API 发布状态OpenAI 为 ChatGPT Voice 推出 GPT-Live-1 与 GPT-Live-1 mini,带来全双工听说、插话处理、网页搜索、记忆、文字、图片和可视化结果卡片。
OpenAI 表示计划把 GPT-Live 带到 API,并发布通知登记表单,但没有公开模型 ID、价格、发布日期或开发合约。
ChatGPT 桌面应用在 macOS 与 Windows 上加入 GPT-Live 驱动的 Voice,可协调 Work 和 Codex 任务,支持已配对的 iOS 远程访问。
Live 已覆盖受支持的消费者端;视频和屏幕共享仍要使用 Advanced Voice;GPT-Realtime-2.1 仍是有正式文档的生产 API 路线。
产品推送与 API 可用性是两个不同合约。
| 领域 | 当前状态 | 应该使用 |
|---|---|---|
| ChatGPT Voice | 付费消费者套餐用 GPT-Live-1,Free 用 mini | 受支持的网页、iOS、Android 与桌面端 Live |
| 视频与屏幕共享 | Live 发布时不支持 | 符合条件的移动端订阅用户使用 Advanced Voice |
| Work 与 Codex | 受支持的 macOS 与 Windows 桌面应用可用 Voice | 通过 Voice 启动、调整、打断和检查任务 |
| 开发者 API | GPT-Live-1 未普遍开放 | GPT-Realtime-2.1 或 GPT-Realtime-2.1 mini |
可获得更自然的重叠说话、更好的插话处理、可选智能档位与可视化答案;是否可用仍取决于地区、套餐、工作区和版本。
Voice 是现有 Agent 工具与权限之上的协调层,不是新的编程模型,也不会扩大既有授权。
不要围绕虚构的 GPT-Live 端点开发。继续使用正式 Realtime API,并隔离模型 ID,为未来迁移保留清晰边界。
更新 ChatGPT,确认套餐与工作区权限,然后进入设置 → Voice,检查是否提供 Live。Enterprise 与 Edu 在早期访问阶段可能需要管理员同时启用 Voice 和 Early Model Access。
如果要在 Work 或 Codex 中使用 Voice,请确认正在使用 macOS 或 Windows 的 ChatGPT 桌面应用。Work/Codex 独立 Voice 不能直接在网页或移动端选择,但受支持的桌面会话可使用配对后的 iOS 远程访问。
如果今天就需要摄像头或屏幕共享,请在符合条件的 iOS 或 Android 账户中切换到 Advanced Voice,并阅读 GPT-Live 视频指南。
GPT-Live 正在 ChatGPT Voice 中推送,但是否可用仍取决于套餐、地区、工作区设置和应用版本。GPT-Live-1 尚未通过开发者 API 普遍开放。
目前仍没有公开的 GPT-Live-1 API 合约。GPT-Realtime-2.1 是生产语音 Agent 当前有正式文档的模型系列。
没有。Live 发布时不支持视频或屏幕共享;符合条件的订阅用户仍可通过受支持移动应用中的 Advanced Voice 使用这些输入。