跳到正文
热点事件持续更新

Q Labs发布Dust:无需反向传播预训练Transformer

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

Q Labs Research 发布名为 Dust 的零阶优化方法,可在预训练 GPT 式 Transformer 语言模型时不使用反向传播。该方法在每个 token 上独立扰动激活,形成“虚拟种群”来估计更新方向。 Q Labs 称,这是首个在预训练 Transformer 语言模型上能与反向传播相竞争(competitive with backprop)的零阶方法。这一说法来自其研究论文,尚属提出者主张。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. Hacker News 热门
    Q Labs Research 提出无反向传播的预训练方法 Dust

    Q Labs Research 发布 Dust,一种零阶优化方法,通过在每个 token 上独立扰动激活(虚拟种群)预训练 GPT 式 Transformer,无需反向传播。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。