跳到正文
热点事件观察中

ALIVE视频物体插入框架发布

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

2026年10月6日,Hugging Face Daily Papers 报道论文 ALIVE。该研究提出一个面向首帧引导视频编辑的交互对齐对象插入框架,目标是在视频中插入新对象后,使其能与原视频内容产生连贯交互。报道称,ALIVE 的输入只需要编辑后的首帧,以及一条注明新增对象的指令。研究构建了 35,800 个编辑对,并训练视觉语言模型(VLM)预测交互引导。在 ALIVE-interaction 基准和通用视频对象插入基准上,ALIVE 相比最强基线的 Overall 指标分别提升 43.9% 和 4.4%,VLM 引导还带来 0.95 分提升。目前报道仅披露了论文方法、数据构建与基准结果。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. Hugging Face Daily Papers
    ALIVE:面向首帧引导视频编辑的交互对齐对象插入框架

    ALIVE 让视频中新插入对象能与原视频内容产生连贯交互,只需编辑后的首帧和注明新增对象的指令。研究构建了 35,800 个编辑对,并训练 VLM 预测交互引导;在 ALIVE-interaction 和通用视频对象插入基准上,ALIVE 相比最强基线 Overall 分别提升 43.9% 和 4.4%,VLM 引导再提升 0.95 分。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。