[功能] 支持 MOSS-TTS-Nano

作者: iota9star创建于 2026年6月1日更新于 2026年9月8日
标签enhancement

介绍该功能 MOSS-TTS-Nano 是一个轻量级的多语言 TTS 模型,专门用于在仅支持 CPU 的设备上进行实时语音生成。在 sherpa-onnx 中支持此模型,开发者可以直接在移动设备、桌面设备、嵌入式设备和边缘设备上使用现有的 sherpa-onnx 生态系统,实现高质量的多语言语音合成。 MOSS-TTS-Nano 提供了多项功能,使其非常适合用于 sherpa-onnx 用户: - 小型模型大小(约 0.1B 参数) - 实时 CPU 推理 - 多语言语音合成 - 流式生成支持 - 语音克隆功能 - ONNX 原生部署工作流 - 跨平台兼容 许多开发者已经将 sherpa-onnx 用作语音应用的统一运行时。添加对 MOSS-TTS-Nano 的支持,将使以下应用成为可能: - 离线 TTS 应用 - AI 语音助理 - 听书阅读器 - 可访问性工具 - 移动设备和边缘设备语音合成 - Flutter、Android、iOS、macOS、Windows、Linux 和嵌入式部署 这也将加强 sherpa-onnx 的 TTS 生态系统,通过提供一个额外的现代开源多语言模型来补充现有的受支持语音模型。 ### 补充信息 根据官方项目,MOSS-TTS-Nano 是来自 OpenMOSS 团队的开源多语言 TTS 模型,专注于轻量级部署和实时推理。ONNX 版本特别优化了 CPU 执行,无需 PyTorch 依赖即可高效运行。(GitHub) 相关资源: - MOSS-TTS-Nano 仓库: https://GitHub.com/OpenMOSS/MOSS-TTS-Nano - MOSS-TTS 仓库: https://GitHub.com/OpenMOSS/MOSS-TTS - 技术报告: https://arxiv.org/abs/2603.18090 - 可能的实现范围 - ONNX 模型加载 - 流式 TTS 推理 - 多语言合成 - 语音克隆支持(如果适用) - C++ API 支持 - Python API 支持 - Dart/Flutter 绑定支持 - 示例应用和文档

内容来源: k2-fsa/sherpa-onnx