Story

OpenAI 推出 GPT-Live,革新 ChatGPT 語音對話體驗

ENTHMSVIIDZHZH-TWJAKOHI
Jul 8, 20261 min read
OpenAI 推出 GPT-Live,革新 ChatGPT 語音對話體驗

Summary

OpenAI 發表名為 GPT-Live 的新一代語音模型,旨在讓與人工智慧的對話體驗更加自然流暢。此模型採用全雙工架構,能同時聆聽和說話,為 ChatGPT 語音功能帶來重大升級。

Text size
Background

OpenAI 於本週三宣布推出新一代語音模型 GPT-Live,為 ChatGPT 的語音功能帶來重大革新。新模型旨在使人與 AI 的對話變得更加自然,目前已開始向全球 ChatGPT 用戶推送。

GPT-Live 的核心技術在於其「全雙工」(full-duplex)架構,使其能夠同時聆聽和說話,突破了以往語音系統需要等待用戶說完才能回應的限制。在對話中,模型能以「嗯哼」或「是的」等詞語表示正在聆聽,並能進行快速的來回交流,使互動感受更貼近真人。

根據 OpenAI 的說明,當遇到需要網路搜尋、深度推理或處理複雜任務時,GPT-Live 會將任務交由在背景運行的前沿模型處理。發布初期,此後端模型為 GPT-5.5,未來也將隨著新模型的推出而持續更新。

Sample IUX Markets – In-articleAd

新的 ChatGPT 語音體驗也包含多項升級。用戶可選擇「即時」、「中等」或「高等」三種不同的推理等級,以應對不同複雜度的需求。此外,在談論天氣、股市或體育賽事等話題時,ChatGPT 現在能夠顯示相關的視覺資訊卡。

GPT-Live-1 將成為 Go、Plus 和 Pro 付費用戶的預設模型,而 GPT-Live-1 mini 則提供給免費用戶使用。此更新已在 iOS、Android 和 ChatGPT 網站上線。OpenAI 表示,目前新模型暫不支援視訊通話或螢幕共享的語音功能,但計畫未來加入,並很快會透過 API 提供給開發者使用。

Back to latest news

LATEST