在较慢的本地 TTS/LLM 后端生成响应时,没有面向用户的信号

作者: alexdimmock95创建于 2026年9月13日更新于 2026年9月13日

问题

当运行具有显著延迟的本地/自主托管后端(例如用于 TTS 的 OmniVoice 或资源受限的硬件)时,用户目前没有任何信号表明正在生成响应。这使得等待变得模糊,用户很可能在第一个响应开始生成音频之前再次发言,在还没有听到响应之前就取消了它。

内容来源: huggingface/speech-to-speech