- OpenAI 的新 GPT-Live 模型主打更自然的人机对话。
- 它会在用户说话时加入“嗯哼”或“好的”——并去掉了其标志性的、故意留白的停顿。
- 这一更新顺应了一个趋势。AI 实验室正试图让对话不再像接力赛一样你一句我一句地等。
OpenAI 希望 ChatGPT 别再等着轮到自己才开口。
在周三的直播中,该公司发布了 GPT-Live,这是一款驱动 ChatGPT Voice 的新语音模型。OpenAI 表示,这次更新是为了让跟 AI 聊天更像跟真人聊天。
OpenAI 表示,例如,助手不再等到每句话末尾出现明显停顿才回应,而是可以边听边说。它还会在用户仍在说话时,时不时地用“嗯哼”、“是的”和“明白了”来应和对方。
在一个演示中,用户要求ChatGPT核实即将召开的会议日期,同时检查沿途的天气和交通情况。ChatGPT以简短的确认回应,如“嗯”和“当然”,然后继续处理请求。随着用户不断追加新的需求,它始终没有跑偏。
OpenAI还展示了ChatGPT实时翻译语言的能力。以前那种一问一答式的助手必须等待说话者说完才能翻译。据OpenAI介绍,现在一个能边听边说的助手可以随着对话的展开更自然地跟上节奏。
OpenAI总裁格雷格·布罗克曼在直播中将这次更新描述为“一种更自然的跟电脑互动的方式”。
OpenAI并非唯一一家试图让AI语音助手不再像那种你一句我一句轮流等待的聊天机器人、而更像积极倾听者的公司。今年5月,由前OpenAI首席技术官米拉·穆拉蒂领导的AI实验室Thinking Machines也预告了类似技术。该公司表示,其交互模型旨在跨音频、视频和文本连续处理输入和输出,而不是依赖传统聊天机器人那种一问一答、断断续续的节奏。
Thinking Machines表示,更新后的模型能够“以更自然的方式处理交互”,并让人与AI之间的互动更加顺畅,“而不是迫使人类去迁就AI界面”。
此次更新发布之际,AI语言模型也成了互联网上的调侃对象。创作者们经常嘲讽它们那种怪里怪气的热情语气、动不动就说“太棒了”之类的毛病,以及开口回答前那段尴尬的沉默。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.