跳到正文
HuggingFace Daily Papers·· 3 天前AI 评分42

递归自我重写(RSR):用 Qwen-3.8-27B 将多框架经验重构为通用训练轨迹

Scaling Trajectories for Complex Tasks through Recursive Self-Rewrite

AI 导读

研究提出 Recursive Self-Rewrite(RSR)框架,用单一基座模型 Qwen-3.8-27B 在多种 harness 下发现解法,再由 planner、critic、executor 重构为通用 harness 下的训练轨迹。

来源:HuggingFace Daily Papers · arxiv.org