OpenAI 推出 GPT-Live-1 API,支持全双工语音对话
OpenAI 在 API 中推出 GPT-Live-1 全双工语音模型,支持同时听取和生成语音,优化了对打断、停顿及背景噪音的处理,并适用于电话场景。开发者可通过系统提示控制对话风格,并可调用 GPT-6 Astra 等后端模型。该模型在 Full Duplex Bench 上的表现较 GPT-Realtime-2.1 提升 30%,在语言学习平台 Speak 的测试中,误打断率较传统系统减少近 80%。
摘要由 AI 依据原文撰写,并非投资建议。