跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 2 天前AI 评分47

让 LLM 学会从上下文学习:基于扰动公开文档的合成训练方法

Learning to Learn from Context: Synthetic Training from Perturbed Public Documents

AI 导读

研究者构建了一套无需人工标注的合成流水线,通过扰动改写公开文档、生成需依赖文档推理的问题与评分标准,从 3.5k 篇文档生成约 10k 样本,用于训练学生模型。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org