热点事件 历史事件

阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一

7 篇报道5 个报道来源

事件全貌

AI 综述

阶跃星辰发布 StepAudio 3 系列语音模型,共 5 款:StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,覆盖实时交互、语音识别、文本转语音、音频生成和音乐创作。据 IT之家 9 月 15 日报道,五款模型均已上线阶跃星辰开放平台。阶跃星辰官方账号称该系列为面向实时语音、语音识别、语音生成、音频生成和音乐的新音频模型家族,并称现已可用。

据 IT之家报道,StepAudio 3 Realtime 支持原生全双工实时对话,在 Artificial Analysis Conversational Dynamics 榜单以 98.9% 综合得分排名全球第一,在 Speech Reasoning 榜单以 99.7% 语音推理准确率位列全球第一。StepAudio 3 ASR 在 Artificial Analysis 非流式语音识别准确性榜单中 WER 为 1.7%,并列全球第一;报道称其支持中文、英文、方言、中英混说、长音频及医疗、法律、金融、汽车、编程等专业领域识别。StepAudio 3 TTS 被描述为面向实时交互场景的真人级语音生成模型,基于流式生成架构实现生成与播放同步。StepAudio 3 Gen 可基于自然语言描述和参考音频统一生成人声、音效、环境音和背景音乐。StepAudio 3 Music 支持从零生成及基于 ABC 记谱法控制的多轮交互创作,支持歌曲创作、清唱配乐、歌曲翻唱等。

第三方账号洪明在 X 上转述称,阶跃星辰发布 StepAudio 3 系列,多款模型在 Artificial Analysis 榜单中位列全球第一;其另一条内容明确标注相关排名来自厂商引用的第三方榜单,仍应结合具体语言、噪声和任务场景测试。

后续,阶跃星辰与 ACE Studio 联合发布 StepAudio 3 Music,称其为 StepFun 首个音乐生成基础模型,可将提示词和歌词转为完整歌曲,并称其由 ABC-COT 驱动,在合成前规划音乐结构与编曲,支持生成版本、改写提示词、编辑 ABC 记谱法并迭代。

AI 汇总报道生成 · 6天前更新。单篇报道保留其发布时的原貌。

最新进展

历史报道归档。当前热点以新版榜单为准。

报道时间线

沿着报道,了解事件的不同侧面。

显示 7全部报道最新在前
  1. X:Artificial Analysis (@ArtificialAnlys)官方一手
    StepFun 发布 StepAudio 3 ASR,以 1.7% WER 登顶 Artificial Analysis 非流式语音转写榜

    StepFun 发布 StepAudio 3 ASR,在 Artificial Analysis 非流式语音转写 AA-WER Index 上以 1.7% WER 排名第一,较 StepAudio 2.5 ASR 的 4.7% 明显提升。

  2. X:洪明 (@hongming731)
    BestBlogs 早报:Gradium 全双工语音与 GKE Agent

    BestBlogs 09-17 早报精讲三条内容:Gradium 用多流语言模型实现全双工语音,让用户与系统音频以两条流共同建模,并倾向用轻量语音层加后台文本模型的混合架构处理复杂推理与工具调用。

  3. X:洪明 (@hongming731)
    BestBlogs 早报:StepAudio 3 与 Agent 基座等十则

    BestBlogs 09-17 早报汇总十则 AI 动态:阶跃星辰发布 StepAudio 3 系列语音模型,覆盖实时交互、语音识别、TTS、音频生成与音乐创作,多款模型在 Artificial Analysis 榜单位列全球第一。

  4. X:阶跃星辰 StepFun (@StepFun_ai)官方一手
    阶跃星辰与 ACE Studio 发布 StepAudio 3 Music 音乐生成基础模型

    阶跃星辰(StepFun)与 ACE Studio 发布 StepAudio 3 Music,这是阶跃星辰首个音乐生成基础模型,可从提示词和歌词生成完整歌曲。模型支持歌曲生成、纯音乐生成、音乐翻唱和人声转歌曲编排四种工作流,基于 ABC-COT 先规划曲式结构再合成,用户可改写提示词、编辑 ABC 记谱迭代调整,交互式演示已上线,ABC-COT API 即将推出。

  5. X:阶跃星辰 StepFun (@StepFun_ai)官方一手
    阶跃星辰发布 StepAudio 3 系列共 5 款音频模型

    阶跃星辰发布 StepAudio 3 系列共 5 款音频模型,覆盖实时语音、语音识别、语音生成、音频生成和音乐。Realtime 在 Artificial Analysis 的 Conversational Dynamics 达 98.9%、Speech Reasoning 达 99.7%,均排名第一;ASR 词错率 1.7%,与榜单最佳持平。

  6. IT之家
    阶跃星辰发布 StepAudio 3 系列语音大模型,含 Realtime、ASR、TTS、Gen、Music 五款

    阶跃星辰发布 StepAudio 3 系列语音模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,均已上线阶跃星辰开放平台。

  7. 公众号:阶跃星辰(Step)官方一手精选
    阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一

    阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。

24 HOURS

本事件热度走势

当前热度 17峰值 199月17日 10:00近24小时变化

移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。