讨论:FunASR/SenseVoice 与 PaddleSpeech 的协作可能性

Author: LauraGPTCreated May 31, 2026Updated May 31, 2026

您好!PaddleSpeech 是优秀的语音处理工具包。

想讨论一下 FunASR / SenseVoice 是否可以作为 PaddleSpeech 的补充方案:

SenseVoice 的特色:

  • 234M 参数非自回归模型,推理速度是 Whisper large-v3 的 5 倍
  • 内置情感识别和音频事件检测
  • 支持 50+ 语种
  • 通过 OpenAI 兼容 API 提供服务
python
from funasr import AutoModel
model = AutoModel(model="iic/SenseVoiceSmall")
result = model.generate(input="audio.wav")

Fun-ASR-Nano (800M) 是 LLM-based ASR 模型,SenseVoice encoder + Qwen3-0.6B decoder,支持 31 种语言、热词增强、上下文理解。

两个项目在不同技术路线上各有优势,是否有合作或互相参考的空间?

Source: PaddlePaddle/PaddleSpeech