OpenAI 推出 GPT-Live-1 API,支援全雙工語音對話
OpenAI 於 API 中推出 GPT-Live-1 全雙工語音模型,具備同時聽取與生成語音的能力,優化了對打斷、停頓及背景噪音的處理,並適用於電話場景。開發者可透過系統提示詞控制語氣與風格,並結合後端文本模型進行深度推理。該模型在 Full Duplex Bench 表現較前代提升 30%,並顯著減少了對學習者思考停頓的誤打斷。
摘要由 AI 依據原文撰寫,並非投資建議。
OpenAI 於 API 中推出 GPT-Live-1 全雙工語音模型,具備同時聽取與生成語音的能力,優化了對打斷、停頓及背景噪音的處理,並適用於電話場景。開發者可透過系統提示詞控制語氣與風格,並結合後端文本模型進行深度推理。該模型在 Full Duplex Bench 表現較前代提升 30%,並顯著減少了對學習者思考停頓的誤打斷。
摘要由 AI 依據原文撰寫,並非投資建議。