热点事件 历史事件

FireRedTeam发布FireRedAudio的Gradio网页演示,覆盖零样本TTS、instruct TTS、语音编辑、ASR和音频理解

1 篇报道1 个精选信源

先了解这件事

报道摘要

FireRedTeam 发布 FireRedAudio 的代码与模型,一个基于 9B 参数 LLM 的通用音频语言模型,采用理解与生成解耦的连续表征设计。单模型支持 ASR、音频理解、零样本 TTS、指令 TTS、语义与声学语音编辑,以及最长一小时录音的时序定位理解,在 MMAU、Seed-TTS-Eval 等基准上取得竞争性或领先结果。

摘自 FireRedTeam:原创语音与多模态项目

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. FireRedTeam:原创语音与多模态项目官方一手精选
    FireRedTeam 开源 FireRedAudio 9B 通用音频语言模型

    FireRedTeam 发布 FireRedAudio 的代码与模型,一个基于 9B 参数 LLM 的通用音频语言模型,采用理解与生成解耦的连续表征设计。单模型支持 ASR、音频理解、零样本 TTS、指令 TTS、语义与声学语音编辑,以及最长一小时录音的时序定位理解,在 MMAU、Seed-TTS-Eval 等基准上取得竞争性或领先结果。