OpenAI于2026年8月6日在iOS、Android及网页平台上线两款新语音模型GPT-Live-1和GPT-Live-1 mini,这两款模型支持全双工对话功能,能让AI同时听和说,实现流畅的实时交流体验 [1, 2, 3, 4]

新模型替代了之前的基于轮次的高级语音模式,用户可随时打断AI发言,并在说话过程中进行实时翻译。OpenAI产品负责人Atty Eleti介绍,“这是一款全双工模型,意味着它能同时处理输入流和输出流”,使对话自然且连贯 [1, 5, 6, 2, 7, 3, 4]

GPT-Live在对复杂问题的处理上将任务路由到后台更强大的文本模型,如最新的GPT-5.5,确保推理和网络搜索的无缝衔接。模型还能在倾听时发出“嗯哼”“是啊”等简短语音反馈,增强对话的真实感 [1, 5, 8, 7, 3, 4]

这些新模型支持显示天气、体育比分和股票信息的可视化卡片,提升交互丰富度。同时,内置安全机制引导对话远离有害内容,并提供危机热线支持和适龄回答,保护青少年用户 [1, 5, 2, 7, 3, 4]

根据OpenAI此前数据,推出GPT-Live前,ChatGPT的语音和语音输入功能每周已有超过1.5亿用户使用。OpenAI研究负责人Kundan Kumar称,"GPT-Live-1是公司迄今为止最智能的语音模型",表明其科学推理和搜索能力较之前显著提升 [1, 5, 9]

OpenAI总裁Greg Brockman表示,这种全双工语音交互为用户提供了“更自然的计算机交互方式”。产品负责人Atty Eleti也展望,语音将成为主要计算接口,支持更复杂、长时间的自动化任务管理 [5, 6]

OpenAI计划未来数周内将GPT-Live集成至API接口,方便开发者及企业应用,但目前尚不支持视频或屏幕共享语音功能 [3, 4]

2026年7月8日,OpenAI正式发布了GPT-Live-1和GPT-Live-1 mini,升级了ChatGPT语音模式。今天模型全平台部署完成,付费用户可使用GPT-Live-1,免费用户可用GPT-Live-1 mini,推动更广泛的语音交互体验普及 [1, 5, 8, 2, 3, 4]