[帮助]:关于 Repcodec 和 Vevo 实现 Repcodec 的问题
作者: nghng创建于 2026年2月3日更新于 2026年2月3日
首先,感谢您的出色工作。 我有一个关于 Repcodec 和 Vevo 实现的问题。 在论文《Vevo: 可控的零样本语音模仿与自监督解耦》中提到, Vevo 实现的 Repcodec 是通过 EMA 将音频流和原始论文相结合。 当我查看 _https://GitHub.com/open-mmlab/Amphion/blob/main/models/vc/vevo/README.md_ 中的公开内容风格标记器时,发现它是 repcodec_model.py 的实例,而不是 vevo_repcodec.py。 我知道, repcodec_model.py 的码表是通过常规 VQ 损失和码表损失进行优化的,而不是使用 EMA,因此,我想知道与 vevo_repcodec 版本相比会有什么区别。 如果可能的话,我是否可以获得 vevo_repcodec 的配置训练?
内容来源: open-mmlab/Amphion