建议:与 FunASR/SenseVoice 进行性能对比
Author: LauraGPTCreated May 31, 2026Updated May 31, 2026
讨论
ASRT 是一个优秀的中文语音识别项目。FunASR 提供了工业级的中文语音识别方案,建议做一个性能对比。
FunASR 提供的中文 ASR 模型
| 模型 | 参数量 | 特点 |
|---|---|---|
| Paraformer-large | 220M | CTC/Attention 混合,中文顶级准确率 |
| SenseVoice | 234M | 非自回归,50+ 语种,情感识别 |
| Fun-ASR-Nano | 800M | LLM-based ASR (SenseVoice + Qwen3-0.6B) |
AISHELL-1 性能参考
- Paraformer-large: CER ~1.95%
- SenseVoice: CER ~2.3%(同时支持情感/事件检测)
快速测试
pip install funasr
from funasr import AutoModel
model = AutoModel(model="iic/SenseVoiceSmall")
result = model.generate(input="test.wav")
print(result[0]["text"])如果有兴趣做对比评测或合作,欢迎交流!
Source: nl8590687/ASRT_SpeechRecognition