跳到正文
原文
Hugging Face Daily Papers·· 4 天前AI 评分44

LIFT:通过 on-policy 自蒸馏实现大视角变化下的未来布局视频生成

LIFT: Layout-In-Future Video Generation under Large Viewpoint Change via On-Policy Self-Distillation

AI 导读

LIFT 是统一的图生视频生成框架,用最后一帧布局控制大视角变化下未来画面的内容与空间位置。该方法以 on-policy self-distillation(OPSD)将 dense-layout teacher 的控制能力迁移给 last-frame-layout student,并构建 LIFT-Vista 数据集。实验显示,LIFT 在视频质量、未来布局可控性和相机可控性上优于其他方法。

来源:Hugging Face Daily Papers · arxiv.org