品玩5月19日讯,Boson AI 正式推出Higgs Avatar v1,这是一款面向语音智能体的实时数字人基础模型。该模型仅需一张静态图片,即可生成能够说话、倾听并实时反应的生动面部表情,且所有画面均为实时逐帧渲染,无需预设脚本或动画制作流程。
在技术性能上,Higgs Avatar v1单帧生成仅需约16毫秒,远快于实时对话所需的62.5毫秒阈值,确保口型、表情与语音完美同步。单张H100 GPU即可同时支持8路对话,有效降低了生产成本。
Higgs Avatar v1将与负责语音理解与生成的Higgs Audio模型协同工作,共同构成Boson的全栈自研体系,广泛应用于保险销售、企业教练、虚拟面试及互动娱乐等业务场景。目前,该模型已进入内测阶段。





0 条评论
请「登录」后评论