ChengRang
EN

GPT-Live-1 新增

AI 对话助手 付费
本页为 ChatGPT 的版本 / 子产品详情。查看 ChatGPT 总览 →

OpenAI 2026/9/10 上线 API 的全双工语音模型,单一模型同时听和说,实时响应打断与附和,可把深度推理与工具调用委派给 GPT-6 Astra 等后端模型,语音层每分钟 $0.05

语音 全双工 实时交互 API 智能体
访问 GPT-Live-1 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

GPT-Live-1 是 OpenAI 于 2026 年 9 月 10 日在 API 中推出的全双工语音模型,此前已先在 ChatGPT 中落地。它由单一模型同时处理语音的输入与输出,可以一边听一边说,实时响应打断和附和,这是它与传统语音转文字加大模型加文字转语音级联架构的本质区别。

级联方案里每一层交接都会增加延迟、丢失时机、上下文或对话节奏,而 GPT-Live-1 在单个模型内统一推理语音的听与说,同时原生支持回合检测,开发者仍可围绕明确的回合边界构建应用。它还能把深度推理和工具调用委派给 GPT-6 Astra 等后端文本模型,语音层保持轻快,重活交给后端。

页面公布的基准成绩显示,其 Full Duplex Bench 相比 GPT-Realtime-2.1 提升 30 个百分点,搭配 GPT-6 Astra 在 Tau3 语音智能体基准排名第一。语言学习应用 Speak 实测思考停顿期间的打断减少近 80%,有客户迁移后代码库简化 80%、删除了 23000 行代码。

核心功能

适合谁用

以下类型的用户会特别受益于 GPT-Live-1:

优点亮点

价格与方案

语音前端层定价每分钟 0.05 美元;后端模型与智能体框架由开发者自行选择搭配,费用另计。自定义语音与 OpenAI Presence 企业部署需联系销售。

总结与建议

GPT-Live-1 把语音交互从回合制带进了全双工时代,单模型同时听说的架构让打断、附和这些人类对话里最自然的部分第一次在产品里成立。配合可委派的推理后端,它实际上定义了一种新的语音智能体架构:前端管听说,后端管思考。做语音客服、陪练、实时助手的团队值得认真评估。

版本演进

分类
AI 对话助手
价格
付费
标签
语音 · 全双工 · 实时交互
官网