# SenseVoice 开源语音理解模型仓库：支持 ASR、情感识别与音频事件检测

- 来源：通义 QwenAudio：原创语音项目
- 作者：QwenAudio
- 发布时间：2024-07-03 10:56
- AIHOT 分数：60
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.news/items/cmtyq8s6102v3roup5qwf5ciz
- 原文链接：https://github.com/QwenAudio/SenseVoice

## 精选理由

官方仓库文档同时给出基准对比、部署路径和微调方案，读者可以据此评估 SenseVoice 在中英文语音识别场景的可用性。

## AI 摘要

SenseVoice 是一个语音理解基础模型，支持 ASR、语种识别、语音情感识别和音频事件检测。发布的 SenseVoiceSmall 检查点支持普通话、粤语、英语、日语和韩语，并输出情感与事件标签；采用非自回归端到端架构，同参数量级下推理速度比 Whisper-Small 快 5 倍以上、比 Whisper-Large 快 15 倍以上。

## 正文

该来源未收录可展示正文，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
