概览
ChatGPT 语音模式所用的模型,2026-07-08 与轻量版 GPT-Live-1 mini 一同发布,终于替换掉此前基于 GPT-4o 时代模型、知识停留在 2024 年的旧语音模式。它采用全双工架构,在生成回答的同时持续处理输入音频,因此可以被自然打断,也支持实时翻译。最实用的设计是「后台委派」:碰到需要网页搜索、深度推理或复杂工作的问题,它会把任务交给当时的前沿模型(发布时为 GPT-5.5),等结果就绪再带回对话,期间仍能和你继续聊而不冷场;OpenAI 表示后续会随新前沿模型发布持续更新委派对象。免费套餐默认 GPT-Live-1 mini,Go / Plus / Pro 默认 GPT-Live-1。目前只在 ChatGPT 的 iOS、Android 与网页端提供,未开放 API——开发者要自建语音应用应改用 GPT-Realtime-2.1。
- 模态
- 音频
能力
- 全双工架构:一边听一边说,可随时被自然打断
- 更自然的轮次切换与对话节奏
- 实时语音翻译
- 遇到需要联网检索或复杂推理的问题时,后台委派前沿模型处理并把结果带回对话
- 覆盖 iOS、Android 与网页版 ChatGPT,全部套餐可用
版本历史
2026-07 发布
- GPT-Live-1 与 GPT-Live-1 mini 上线,取代 ChatGPT 原有的 GPT-4o 时代语音模式
- 全双工架构支持边听边说与自然打断,并支持实时翻译
- 复杂问题在后台委派给前沿模型(发布时为 GPT-5.5)处理
