跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 1 天前AI 评分40

LIFT:通过 On-Policy 自蒸馏实现大视角变化下的未来布局视频生成

LIFT: Layout-In-Future Video Generation under Large Viewpoint Change via On-Policy Self-Distillation

AI 导读

研究团队提出 LIFT,一个统一的图像到视频生成框架,用末帧布局作为显式控制信号,让用户指定未来视角中出现什么内容及其位置。由于稀疏布局引导比逐帧密集布局更难学习,LIFT 引入 on-policy self-distillation(OPSD),将密集布局教师模型的控制能力迁移给末帧布局学生模型。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org