品玩6月24日讯,据 testingcatalog 报道,OpenAI即将为ChatGPT语音模式推出代号为Bidi 1的新一代双向音频模型。该模型支持同时表达、聆听与倾听,目前已在部分用户的App端及网页界面中现身,预计将于本周启动逐步发布。
在早期测试中,Bidi 1展现出卓越的交互能力。它不仅能在用户停顿或放慢语速时给出自然的简短回应,还能在对话中途即时响应用户的新指令并调整任务。此外,Bidi 1有效解决了现有语音系统易丢失上下文及在长停顿后误触发的痛点。在创意行为方面,模型保留了唱歌等互动,但对版权歌曲的处理更为严格。
此次升级旨在弥合文本模型与语音层的能力差距,将对话确立为ChatGPT的核心入口。OpenAI尚未正式宣布该模型,预计将采取渐进式发布策略,后续可能还会为Codex推出独立的语音升级。





0 条评论
请「登录」后评论