通义发布 Qwen-Audio-3.1 系列语音模型
先了解这件事
2026 年 9 月 21 日,通义 QwenAudio 上线 Qwen-Audio-3.1-Realtime 产品页并放出技术报告预览,导航栏链接至报告 PDF,该仓库共 3 次提交,最新一次于当日完成,页面含 demo 与概览脚本。当时公开信息仅来自该原创语音项目,未涉及模型参数、评测或开放范围。9 月 23 日,IT之家报道称阿里千问发布 Qwen-Audio-3.1 系列语音大模型,包含 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款,覆盖语音识别、合成、实时交互和音频创作,并全线降价。早先报道仅提及 Realtime 一款产品页与技术报告预览,后续报道则称该系列共五款模型并全线降价。同日 17:11,通义千问官方 X 账号发布 Qwen-Audio-3.1 全家桶,称 ASR、TTS 与 Realtime 全面升级,新增 TTS-Next 和 ASR-Next,共五个模型覆盖理解、生成、交互与创作;全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off;Realtime 可边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。20:31,The Decoder 报道补充称 ASR 改进多语言和方言识别并自动清理填充词,ASR-Next 支持多说话人识别、时间戳及情绪和环境声检测,TTS-Next 将语言模型与扩散方法结合,可一次性生成语音、音效和背景音频。
AI 根据报道生成 · 4 小时前更新
事件进展
- 9月23日 15:15 · 3 篇报道阿里千问发布 Qwen-Audio-3.1 系列五款语音模型并全线降价通义千问 / Qwen:Qwen 发布 Qwen-Audio-3.1 全家桶,ASR、TTS、Realtime 升级并新增 TTS-Next 与 ASR-Next
- 9月21日 23:43 · 1 篇报道通义 QwenAudio 发布 Qwen-Audio-3.1-Realtime 产品页与技术报告通义 QwenAudio:原创语音项目:通义 QwenAudio 发布 Qwen-Audio-3.1-Realtime 产品页与技术报告
报道时间线
沿着报道,了解事件的不同侧面。
- The Decoder:AI News阿里 Qwen 发布 Qwen-Audio-3.1 五款语音模型,语音价格最高下调 95%
阿里 Qwen 团队发布 Qwen-Audio-3.1,包含五款覆盖语音识别(ASR)、语音合成(TTS)和实时交互的模型。ASR 改进多语言和方言识别并自动清理填充词,ASR-Next 支持多说话人识别、时间戳及情绪和环境声检测;TTS-Next 将语言模型与扩散方法结合,可一次性生成语音、音效和背景音频。同步降价:TTS 约 70%,Realtime 约 85%,ASR 最高 95%。
- X:通义千问 / Qwen (@Alibaba_Qwen)精选Qwen 发布 Qwen-Audio-3.1 全家桶,ASR、TTS、Realtime 升级并新增 TTS-Next 与 ASR-Next
Qwen 发布 Qwen-Audio-3.1,ASR、TTS 与 Realtime 全面升级,并新增音频创作模型 TTS-Next 和音频理解模型 ASR-Next,共五个模型覆盖理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off;Realtime 可边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。
- IT之家阿里千问发布 Qwen-Audio-3.1 系列五款语音模型并全线降价
千问发布 Qwen-Audio-3.1 系列语音大模型,包含 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款模型,覆盖语音识别、合成、实时交互和音频创作。
- 通义 QwenAudio:原创语音项目通义 QwenAudio 发布 Qwen-Audio-3.1-Realtime 产品页与技术报告
通义 QwenAudio 上线 Qwen-Audio-3.1-Realtime 产品页,并同步放出技术报告预览,导航栏已链接至报告 PDF。该仓库共 3 次提交,最新一次于 9 月 21 日完成,页面包含 demo 与概览脚本。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。