HuggingFace Daily Papers(社区热门论文)·· 1 天前AI 评分39
自然语言自编码器如何挑选最具信息量的 token 位置
Selecting The Most Informative Tokens in Natural Language Autoencoders
AI 导读
研究在 470 万条关于提示注入与隐瞒行为的解释上,比较了模型计算信号与仅用聊天结构训练的排序器,发现聊天结构通常能选出更相关的解释,且无需为位置选择做一次模型前向传播。在四个数据集中的三个上,只解释 5% 的位置就能保留解释全部位置时几乎全部的成功率。预训练 verbalizer 还能在无需额外训练的情况下还原模型经微调学会隐瞒的词语。
来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org