品玩

科技创新者的每日必读

打开APP
关闭

Apple与特拉维夫大学提出新型语音生成加速技术PCG

2月4日

品玩2月4日讯,据 9TO5MAC 报道,Apple与Tel-Aviv University研究人员联合提出“Principled Coarse-Graining”(PCG)方法,显著提升自回归文本到语音(TTS)模型的生成速度。该技术通过将声学相似的语音令牌归为同一组,在解码阶段放宽严格匹配限制,从而提高推测性解码的接受率。

实验表明,PCG在不重新训练模型的前提下,将语音生成速度提升约40%,同时保持低词错率、高说话人相似度及4.09分(满分5分)的自然度评分。该方案仅需额外37MB内存存储声学分组信息,适用于资源受限设备。

由于PCG为推理阶段的解码优化,可直接应用于现有语音模型,有望为未来Apple平台的实时语音功能提供高效、高质量的技术支撑。

取消 发布

下载品玩App,比99.9%的人更先知道关于「苹果」的新故事

下载品玩App

比99.9%的人更先知道关于「苹果」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测