阶跃星辰发布 StepAudio 3 系列共 5 款音频模型

StepFun · @StepFun_ai · X·2026-09-16 01:40·10小时前
AI 导读

阶跃星辰发布 StepAudio 3 系列共 5 款音频模型,覆盖实时语音、语音识别、语音生成、音频生成和音乐。Realtime 在 Artificial Analysis 的 Conversational Dynamics 达 98.9%、Speech Reasoning 达 99.7%,均排名第一;ASR 词错率 1.7%,与榜单最佳持平。

StepFun@StepFun_ai
64AI 编辑部评分,满分 100

阶跃星辰发布 StepAudio 3 系列共 5 款音频模型

2026-09-16 01:40· 10小时前
AI 导读

阶跃星辰发布 StepAudio 3 系列共 5 款音频模型,覆盖实时语音、语音识别、语音生成、音频生成和音乐。Realtime 在 Artificial Analysis 的 Conversational Dynamics 达 98.9%、Speech Reasoning 达 99.7%,均排名第一;ASR 词错率 1.7%,与榜单最佳持平。

Introducing StepAudio 3, our new family of 5 audio models for real-time voice, speech recognition, speech generation, audio generation and music.

Realtime ranks #1 on Artificial Analysis for both Conversational Dynamics (98.9%) and Speech Reasoning (99.7%). ASR reaches 1.7% WER, matching the best result on the leaderboard.

Build voice agents that handle interruptions, reason while speaking, and call tools. Transcribe speech, generate expressive voices, and create full audio scenes and music.

Available now: Voice AI Lab: https://audio.stepfun.ai/ Blog: https://static.stepfun.com/blog/stepaudio3/