HuggingFace Daily Papers(社区热门论文)·· 1 天前AI 评分38
UniEvo-VL:面向多模态模型自我改进的在线自蒸馏训练方案
UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement
AI 导读
UniEvo-VL 提出一种无需外部教师模型的多模态自进化训练方案,让同一模型分别以学生和教师身份、基于不同上下文进行在线自蒸馏,在自身采样轨迹上最小化去噪扩散分布差异。
来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org