跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 1 天前AI 评分38

UniEvo-VL:面向多模态模型自我改进的在线自蒸馏训练方案

UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement

AI 导读

UniEvo-VL 提出一种无需外部教师模型的多模态自进化训练方案,让同一模型分别以学生和教师身份、基于不同上下文进行在线自蒸馏,在自身采样轨迹上最小化去噪扩散分布差异。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org