Model Update2026-09-11
OpenAI Blog
GPT-Live-1 登陸 API,語音對話可即時插話
OpenAI 已在 API 中釋出 GPT-Live-1,把自然、全雙工的語音對話能力交到開發者手上。這款模型在指令遵循上更強,支援自訂語音,並可整合電話系統,因此很適合客服中心、語音助理以及互動式應用。
全雙工是這次最受矚目的賣點。意思是模型可以一邊聽、一邊說,不必等使用者講完才回應。傳統輪流發言的語音系統往往顯得生硬又慢半拍,尷尬的停頓與插話會打斷真實對話的節奏。GPT-Live-1 的目標就是消除這些摩擦點,讓交流更接近跟真人講話的感覺。
除了反應速度,這款模型在遵循詳細指令方面也有所提升,這對需要大規模維持一致品牌調性的企業來說格外重要。自訂語音支援讓組織能定義助理聽起來是什麼樣子,電話系統整合則打開了透過標準電話線部署的大門,而這正是許多客服作業的硬需求。
這次發表也顯示,語音正成為各家 AI 供應商競爭的核心戰場之一。當文字助理逐漸成熟,能不能流暢地進行口語對話,可能成為產品在「客戶預期打電話進來就要被聽懂」這類市場中的差異化關鍵。
對開發者而言,GPT-Live-1 提供了一條加入對話式語音的捷徑,不必再拼湊語音辨識、語音合成與對話管理等多個零散元件。接下來的問題是,它在真實環境下的表現如何——背景噪音、口音,以及真實人類對話中那些難以預測的轉折,都是考驗。