📖 产品简介
GPT-Live-1 是 OpenAI 于 2026 年 9 月 12 日推向 API 的全双工语音模型,专为语音 Agent 设计:模型可以同时「听」和「说」,能自然处理用户打断,并可通过电话线运行。
它与同期进入公开测试版的 OpenAI Agents API 形成配套——开发者可用 Agents API 托管代理循环(会话编排、上下文压缩、子代理协调、崩溃恢复),并用 GPT-Live-1 作为语音交互层,从而把「语音对话 + 工具调用 + 长时任务」整合为可生产的语音 Agent。它降低了构建自然双向语音体验的门槛,使语音 Agent 从「一问一答的 TTS+ASR 拼装」走向真正的实时对话。
定位
9/12 上线的全双工语音模型 API,让开发者构建能同时听和说、可处理打断、可跑在电话线上的语音 Agent
适合人群
语音客服
语音助手开发者
电话线场景
实时对话产品
支持平台
API
开源
否
✨ 核心功能
- 全双工:同时听与说,自然双向对话
- 可处理打断:用户插话时模型即时响应
- 可跑在电话线(phone line)上
- 与 Agents API 配套:语音层 + 托管代理循环
- 面向语音 Agent 的实时工具调用与长时任务
⚖️ 优缺点分析
👍 优点
- 全双工+打断处理,语音体验更自然
- 与 Agents API 托管循环配套,降低工程复杂度
- 可电话线部署,覆盖客服等场景
- OpenAI 生态与文档支撑
👎 缺点
- 9/12 刚上线、独立基准有限
- 具体计费未充分公开
- 仅支持美国数据驻留、不支持零数据保留
- 与 ElevenLabs/笛卡尔等语音方案竞争
📊 评分详情
功能完整
9
易用程度
8.5
安全可靠
7.5
性价比
8
💬 用户评价
GPT-Live-1 把全双工语音做成 API,配合 Agents API 托管循环,语音 Agent 从拼装 TTS+ASR 走向真正实时对话。
📝 更新日志
-
2026-09-12API 上线(9/12)OpenAI 将全双工语音模型 GPT-Live-1 推向 API,让开发者构建能同时听和说、可处理打断、可跑在电话线上的语音 Agent;与同期进入公开测试版的 Agents API(agent/environment/session/events 四概念,托管代理循环+上下文压缩+子代理协调+崩溃恢复)配套,把语音对话、工具调用与长时任务整合为可生产的语音 Agent。来源:aiagentstore / theautomateddaily(2026-09-12)。