热点事件 历史事件
FireRedTeam发布FireRedAudio的Gradio网页演示,覆盖零样本TTS、instruct TTS、语音编辑、ASR和音频理解
先了解这件事
报道摘要FireRedTeam 发布 FireRedAudio 的代码与模型,一个基于 9B 参数 LLM 的通用音频语言模型,采用理解与生成解耦的连续表征设计。单模型支持 ASR、音频理解、零样本 TTS、指令 TTS、语义与声学语音编辑,以及最长一小时录音的时序定位理解,在 MMAU、Seed-TTS-Eval 等基准上取得竞争性或领先结果。
报道时间线
沿着报道,了解事件的不同侧面。
显示 1 篇全部报道,最新在前
- FireRedTeam 开源 FireRedAudio 9B 通用音频语言模型
FireRedTeam 发布 FireRedAudio 的代码与模型,一个基于 9B 参数 LLM 的通用音频语言模型,采用理解与生成解耦的连续表征设计。单模型支持 ASR、音频理解、零样本 TTS、指令 TTS、语义与声学语音编辑,以及最长一小时录音的时序定位理解,在 MMAU、Seed-TTS-Eval 等基准上取得竞争性或领先结果。