HuggingFace Daily Papers·· 3 天前AI 评分42
递归自我重写(RSR):用 Qwen-3.8-27B 将多框架经验重构为通用训练轨迹
Scaling Trajectories for Complex Tasks through Recursive Self-Rewrite
AI 导读
研究提出 Recursive Self-Rewrite(RSR)框架,用单一基座模型 Qwen-3.8-27B 在多种 harness 下发现解法,再由 planner、critic、executor 重构为通用 harness 下的训练轨迹。
来源:HuggingFace Daily Papers · arxiv.org