品玩9月28日讯,据谷歌官方消息,在Gemini 3.8 Live发布的基础上,谷歌正式推出搭载Live Avatar功能的Gemini 3.8 Live,为原生实时对话模型引入接近实时的视觉呈现。该功能将视频生成与语音结合,可打造能倾听、观察并以动态视觉形象交流的交互体验,即日起在Gemini Enterprise中提供。
Live Avatar具备精准唇形同步、自然表情与流畅的对话轮次切换,可同时处理视觉与音频输入。依托Gemini的高级推理能力,其支持异步工具调用,可在后台触发调用并获取数据,同时保持对话不中断。语言方面,该功能支持原生多语言语音到语音同步,可在97种语言间无缝切换,且不降低视频保真度或引入视觉漂移。
企业可在预设形象库外进行定制,通过高质量参考图像生成保留相似度与品牌风格的虚拟形象,目前该功能仅对企业白名单用户开放。所有AI生成内容均通过SynthID嵌入隐形水印,直接写入音视频输出,以减少错误信息与错误归属。





0 条评论
请「登录」后评论