OpenAI在API中推出GPT-Live-1全雙工語音模型
金色財經報道,9 月 10 日,OpenAI 官方宣佈在 API 中推出 GPT-Live-1 全雙工語音模型。起因是傳統語音代理需拼接語音識別、大語言模型和語音合成三個組件,每次交接增加延遲並易丟失對話節奏與上下文。經過研發,GPT-Live-1 將聽和說整合在單一模型中,可實時響應打斷和確認,同時將深度推理委託給後端模型如 GPT-6Astra 或 Luna。結果顯示,該模型在全雙工基準測試中較 GPT-Realtime-2.1 提升 30 個百分點,配合 GPT-6Astra 在 Tau3 語音智能評測中排名第一;語言學習平臺 Speak 早期評估顯示思考停頓期間的打斷減少近 80%,某醫療客戶代碼庫簡化 80% 並減少 2.3 萬行代碼。該模型支持電話部署、12 種新語音,前端語音層定價爲每分鐘 0.05 美元,目前已在 API 中可用,Yelp、Fin、Cognition 等企業已接入測試。
免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。
讚










