GPT-Live(OpenAI于2025年7月推出的实时语音交互模型)

GPT-Live(OpenAI于2025年7月推出的实时语音交互模型)

GPT-Live是OpenAI于2025年7月推出的新一代实时语音交互模型,专门用于驱动ChatGPT的“语音模式”。该模型基于全双工架构,能够同时进行聆听与说话,实现“边听边说”的自然交互。它可以每秒做出多次交互决策,例如是否说话、继续聆听、暂停、打断或调用工具。OpenAI推出了GPT-Live-1和GPT-Live-1 mini两个版本,分别作为付费用户与免费用户的默认语音模型。

该模型标志着ChatGPT语音功能的重要演进。其彻底取消了此前高级语音模式(AVM)的“轮流发言”限制,改为持续同步处理输入与输出。在面对需要联网搜索或复杂推理的任务时,GPT-Live会将任务委托给后台的GPT-5.5等前沿模型处理,自身则维持对话流畅性。根据OpenAI的人工偏好测试,GPT-Live-1在75.7%的对比中优于上一代AVM。

想要了解更多“GPT-Live(OpenAI于2025年7月推出的实时语音交互模型)”的信息,请点击:GPT-Live(OpenAI于2025年7月推出的实时语音交互模型)百科