speech-to-speech · Issues· 114 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #565
监听器后台通道在播放过程中中止了活动响应
更新于 2026年9月16日 - #563
STT 可以在没有置信信号的情况下产生自信、错误标记的转录,导致无意义的输入传递到 LLM
更新于 2026年9月16日 - #519
在工具连续运行期间保留响应 API 理由项
enhancement更新于 2026年9月16日 - #559
在较慢的本地 TTS/LLM 后端生成响应时,没有面向用户的信号
更新于 2026年9月13日 - #558
在 RTC 上发送静默会导致每个客户端的背景 CPU 使用量显著增加
更新于 2026年9月13日 - #557
浏览器实时演示可以在不使用启动抖动缓冲区的情况下播放 TTS。
更新于 2026年9月10日 - #292
将 FunASR/SenseVoice 添加为自主托管的 STT 选项
更新于 2026年9月9日 - #555
STT 处理程序在各个会话中保留检测到的语言;只有 Parakeet 会将其重置。
更新于 2026年9月8日 - #479
用户讲话期间的推测执行?
更新于 2026年9月8日 - #547
支持通过 session.update 进行可选的会话中模型切换
for-hf-staff-only更新于 2026年9月5日 - #235
功能请求: 新的 VAD 和 ASR 模型非常好
更新于 2026年9月5日 - #540
LLaMA-交换支持
更新于 2026年9月5日 - #546
节假日维护人员
更新于 2026年9月4日 - #433
使用可逆的预确认音频消隐功能来减少插入延迟
更新于 2026年9月2日 - #536
支持状态化流式 STT 会话,而不是重复上传整个语句
更新于 2026年8月28日