阶跃发布语音大模型StepAudio 3,宣称拿下多个全球第一
事件全貌
AI 综述阶跃星辰发布语音大模型 StepAudio 3,其官方公众号称该模型「拿下多个全球第一」。
据 IT之家报道,阶跃于 9 月 15 日正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,五款模型均已上线阶跃星辰开放平台。其中 StepAudio 3 Realtime 支持原生全双工实时对话,在 Artificial Analysis Conversational Dynamics 榜单以 98.9% 综合得分排名全球第一,在 Speech Reasoning 榜单以 99.7% 语音推理准确率位列全球第一;StepAudio 3 ASR 在非流式语音识别准确性榜单中 WER 为 1.7%,并列全球第一。
该系列其余模型的功能定位为:StepAudio 3 TTS 是面向实时交互场景的真人级语音生成模型,基于流式生成架构实现生成与播放同步;StepAudio 3 Gen 可基于自然语言描述和参考音频统一生成人声、音效、环境音和背景音乐,并支持对多角色音色、语气、方言口音及笑声、喘息、停顿等副语言特征的精细控制;StepAudio 3 Music 支持从零生成及基于 ABC 记谱法的多轮交互创作,支持歌曲创作、清唱配乐、歌曲翻唱等功能。
AI 汇总报道生成 · 15分钟前更新。单篇报道保留其发布时的原貌。
最新情况详见事件全貌。
报道时间线
沿着报道,了解事件的不同侧面。
- 阶跃星辰发布 StepAudio 3 系列语音大模型,含 Realtime、ASR、TTS、Gen、Music 五款
阶跃星辰发布 StepAudio 3 系列语音模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,均已上线阶跃星辰开放平台。
- 阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一
阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。