OpenAI 在 API 中推出全双工语音模型 GPT-Live-1
OpenAI 宣布在 API 中开放语音模型 GPT-Live-1。该模型此前已在 ChatGPT 中推出,支持同时进行听与说,摆脱了传统“语音识别-大模型推理-语音合成”的串联级联架构,能够在单一模型内直接处理双向音频流,从而大幅降低交互延迟与轮替失误。
新 API 支持将复杂推理与工具调用委托给 GPT-6 Astra 等后端文本模型,并在系统提示词中调节语气、节奏与交流风格。在基准评测中,官方称其全双工测试性能相较 GPT-Realtime-2.1 提高 30 个百分点,且原生适配背景噪声过滤、静默管理与电话网络集成。



