【排查与解决方法】如果你在推理时也遇到了短句复读问题
Author: gingaakeCreated Sep 7, 2026Updated Sep 9, 2026
在使用推理界面生成较短的句子,例如单个词汇、几个字如 你好呀! ,こんにちは! 或其他简短问候语时,有极高概率出现二至三次复读的现象。
经过查看源码发现,在 GPT_SoVITS/inference_webui.py 的推理按钮旁边,有一个实验性的图计算加速开关:
use_cuda_graph_checkbox = gr.Checkbox(
label="CUDA Graph " + i18n("加速"),
value=cuda_graph_supported, # 只要显卡支持,默认就是 True
interactive=True if torch.cuda.is_available() else False,
show_label=True,
scale=5,
visible=False, # 界面上被隐藏,用户不可见也不可关
)
不知道作者出于什么心态,这个甚至已经完成了界面排版的按钮被设置了 visible=False,导致其在前端网页上完全不可见;而如果用户的 GPU 是现代RTX系显卡,cuda_graph_supported 会返回 True,导致系统在用户完全不知情的情况下,默认强制启用了 CUDA Graph 推理。而 CUDA Graph 在推理超短音频时,十分容易引发模型回环复读。
亲测解决方法: 打开 GPT_SoVITS/inference_webui.py,找到 use_cuda_graph_checkbox:
方法 A(强制关闭加速,彻底恢复稳定): 将 value=cuda_graph_supported 改为 value=False。
方法 B(让开关显形,交由用户控制): 将 visible=False 改为 visible=True,并建议默认 value=False。
该按钮会在推理界面最大的【合成语音】按钮旁边显示。 测试时使用V2模型,修改关闭该功能后,短句复读问题彻底消失,发音恢复正常,短文本不再念两次。
Source: RVC-Boss/GPT-SoVITS