热点事件 历史事件

OpenAI 发布 GPT-Live 实时音频新架构

2 篇报道2 个报道来源

事件全貌

AI 综述

OpenAI 发布了 GPT-Live,一种新的实时音频架构和栈,支持边听边说。

该架构从客户端到模型全面重建了语音栈,使音频持续流动,确保深度推理和工具使用不会打断对话。

OpenAI 和 Greg Brockman 均通过 X 平台宣布了这一消息,强调该架构旨在让实时音频交互在 ChatGPT 规模下显得自然。

AI 汇总报道生成 · 47天前更新。单篇报道保留其发布时的原貌。

最新进展

历史报道归档。当前热点以新版榜单为准。

报道时间线

沿着报道,了解事件的不同侧面。

显示 2全部报道最新在前
  1. X:Greg Brockman (@gdb)精选
    GPT-Live实时音频新架构发布

    GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。

  2. X:OpenAI (@OpenAI)官方一手
    OpenAI 重构语音栈,GPT-Live 边听边说

    GPT-Live 可以边听边说。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。