Story
OpenAI发布GPT-Live语音模型,提升ChatGPT对话体验

Summary
OpenAI于周三推出了名为GPT-Live的新一代语音模型,旨在使人工智能对话更加自然。该模型采用全双工架构,能够同时听和说,现已开始向全球ChatGPT用户推送。
Text size
Background
OpenAI于周三发布了其最新一代语音模型GPT-Live,该模型现已为ChatGPT语音功能提供支持。此次更新旨在通过技术革新,让用户与人工智能的语音交流变得更加流畅和自然。
与以往需要用户说完话才能回应的轮流对话模型不同,GPT-Live采用了全双工架构,能够持续处理输入信息,同时生成并输出回应,从而实现同时听和说。该模型可以在对话中做出类似“嗯”等确认性回应,进行快速交流,或在必要时保持沉默。在内部评估中,新模型在对话流畅度和自然感等方面均优于之前的版本。
OpenAI此次推出了两个版本:GPT-Live-1和GPT-Live-1 mini,并已开始向全球用户推送。其中,GPT-Live-1将成为Go、Plus和Pro付费用户的默认模型,而GPT-Live-1 mini将服务于免费用户。新模型已在iOS、安卓和ChatGPT官网上线,公司计划很快通过API提供这些模型。
Ad功能方面,GPT-Live能够将网络搜索或复杂推理等任务委托给后台的GPT-5.5等前沿模型处理。它还可以在对话中显示天气、股票等主题的可视化卡片。不过,在发布初期,新模型暂不支持视频或屏幕共享语音通话,OpenAI表示正在开发这些功能。