跳到正文
原文
Hugging Face Daily Papers·· 1 天前AI 评分45

GRACE:面向高效视频生成的生成感知潜在压缩

GRACE: Generation-aware latent compression for efficient video generation

AI 导读

GRACE 提出两阶段框架,在压缩预训练视频 autoencoder 的同时保持与预训练 DiT 兼容,用于提升视频扩散模型效率。它保留冻结的基础 latent、学习残差 latent,并在冻结 DiT 特征空间中对齐压缩 latent,再通过轻量微调和非对称去噪适配 DiT。

来源:Hugging Face Daily Papers · arxiv.org