跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 1 天前AI 评分39

自然语言自编码器如何挑选最具信息量的 token 位置

Selecting The Most Informative Tokens in Natural Language Autoencoders

AI 导读

研究在 470 万条关于提示注入与隐瞒行为的解释上,比较了模型计算信号与仅用聊天结构训练的排序器,发现聊天结构通常能选出更相关的解释,且无需为位置选择做一次模型前向传播。在四个数据集中的三个上,只解释 5% 的位置就能保留解释全部位置时几乎全部的成功率。预训练 verbalizer 还能在无需额外训练的情况下还原模型经微调学会隐瞒的词语。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org