讨论:FunASR/SenseVoice 与 PaddleSpeech 的协作可能性
Author: LauraGPTCreated May 31, 2026Updated May 31, 2026
您好!PaddleSpeech 是优秀的语音处理工具包。
想讨论一下 FunASR / SenseVoice 是否可以作为 PaddleSpeech 的补充方案:
SenseVoice 的特色:
- 234M 参数非自回归模型,推理速度是 Whisper large-v3 的 5 倍
- 内置情感识别和音频事件检测
- 支持 50+ 语种
- 通过 OpenAI 兼容 API 提供服务
from funasr import AutoModel
model = AutoModel(model="iic/SenseVoiceSmall")
result = model.generate(input="audio.wav")Fun-ASR-Nano (800M) 是 LLM-based ASR 模型,SenseVoice encoder + Qwen3-0.6B decoder,支持 31 种语言、热词增强、上下文理解。
两个项目在不同技术路线上各有优势,是否有合作或互相参考的空间?
- FunASR: https://github.com/modelscope/FunASR (16K+ stars)
- SenseVoice: https://github.com/FunAudioLLM/SenseVoice (8K+ stars)
Source: PaddlePaddle/PaddleSpeech