该来源未收录可展示正文,站内仅提供摘要。
阅读原文(在新标签页打开)SenseVoice 开源语音理解模型仓库:支持 ASR、情感识别与音频事件检测
AI 导读
SenseVoice 是一个语音理解基础模型,支持 ASR、语种识别、语音情感识别和音频事件检测。发布的 SenseVoiceSmall 检查点支持普通话、粤语、英语、日语和韩语,并输出情感与事件标签;采用非自回归端到端架构,同参数量级下推理速度比 Whisper-Small 快 5 倍以上、比 Whisper-Large 快 15 倍以上。
通义 QwenAudio:原创语音项目
精选
60
AI 编辑部评分,满分 100SenseVoice 开源语音理解模型仓库:支持 ASR、情感识别与音频事件检测
SenseVoice 是一个语音理解基础模型,支持 ASR、语种识别、语音情感识别和音频事件检测。发布的 SenseVoiceSmall 检查点支持普通话、粤语、英语、日语和韩语,并输出情感与事件标签;采用非自回归端到端架构,同参数量级下推理速度比 Whisper-Small 快 5 倍以上、比 Whisper-Large 快 15 倍以上。
推荐理由
官方仓库文档同时给出基准对比、部署路径和微调方案,读者可以据此评估 SenseVoice 在中英文语音识别场景的可用性。
来源:通义 QwenAudio:原创语音项目· github.com