首页 > 快讯 > 正文

OpenAI整合团队开发音频AI模型 为发布AI个人设备铺路

金证券 2026-01-02 00:31 快讯 16 0

OpenAI整合团队开发音频AI模型,为发布AI个人设备铺路

据知情人士透露,OpenAI正在积极推进音频AI模型的开发和优化,为即将发布的由AI驱动的个人设备做好技术准备,这些设备主要依赖语音交互,这一趋势引发了广泛关注。

OpenAI的ChatGPT虽然支持语音回复,但其音频版本与文本版本在底层模型上存在差异,内部研究人员指出,当前的语音模型在回答准确性和响应速度上均不及文本模型,这一短板正在成为推动公司技术突破的重要动力。

OpenAI整合团队开发音频AI模型 为发布AI个人设备铺路

为应对这一挑战,过去两个月内,OpenAI已将工程、产品和研究团队整合到一起,共同推进音频模型的优化,提升语音模型的准确性对OpenAI尤为重要,因为公司计划推出一款支持语音指令的消费级设备,据外媒报道,这款首款设备预计将在至少一年后面世。

知情人士称,OpenAI正在开发一种新型音频模型架构,该架构能够生成更自然、更具情感且更精准深入的回应,新增功能还包括支持与用户实时对话(现有模型无法实现)以及更好地处理对话打断,据计划,该模型的目标发布时间为2026年第一季度,OpenAI发言人对此尚未做出回应。

与谷歌、亚马逊、Meta和苹果等科技巨头类似,OpenAI正在探索开发新型个人AI设备(包括可穿戴设备),研究人员认为,未来设备的交互方式可能会更加注重语音,甚至完全摒弃屏幕设计,OpenAI的无屏设计理念与合作硬件开发的前苹果设计主管乔尼·艾夫的目标相符——减少用户对设备的依赖,并纠正以往消费电子产品对人类生活的潜在负面影响。

OpenAI也面临着不少挑战,多数ChatGPT用户尚未养成通过语音与AI产品互动的习惯,音频模型的质量不足可能会影响用户体验,用户对新功能的认知和接受度也是一个重要问题,要推出以音频为核心的AI设备,OpenAI需要从培养用户的互动习惯入手。

据知情人士称,OpenAI的音频AI项目核心人物包括今夏加入的语音研究员Kundan Kumar,以及负责重构音频AI基础设施的产品研究主管Ben Newhouse,多模态ChatGPT产品经理Jackie Shannon也在项目中发挥重要作用。

关于未来产品的开发方向,OpenAI的计划是逐步发布一系列设备,而不是推出单一产品,据内部研究人员介绍,这些设备将作为用户的“协作伴侣”,不仅作为应用入口,还能主动提供目标达成建议,设备还能通过音频捕捉环境与用户信息,实现情景化交互。


关灯 顶部