数据集

2 个数据集
已选筛选: 语音识别 MD Apache License 2.0 清除所有筛选
SenseVoiceSmall 是一款高精度多语言语音识别模型,支持超过50种语言的语音识别,并具备情感辨识和音频事件检测能力。它采用非自回归端到端框架,推理速度极快,10秒音频仅需约70毫秒处理。模型不仅能识别语音内容,还能检测音乐、掌声、笑声等常见声学事件,并输出带有情感标签的富文本转写结果。此外,它还支持便捷的微调定制和完整的服务部署,适用于多种实际应用场景。
GITATTRIBUTESJSONMDMODELMP3MVNPNGPTYAML Apache License 2.0 896 MiB 20 个文件 WeHub 同步于 2026-08-30 02:33:31 +00:00
funasr-demo 已完整同步
funasr-demo 是语音识别演示/测试资源,包含 WAV 音频、SCP/TXT/JSON 标注和说明文件,共 37 个文件、约 5.1 MB,适合 ASR 流程验证。
GITATTRIBUTESJSONMDSCPTXTWAV Apache License 2.0 4.9 MiB 37 个文件 WeHub 同步于 2026-08-20 09:08:13 +00:00