跳到正文
热点事件历史事件

FocusVTC视觉文本压缩方法发布

1 篇报道1 个报道来源3 天前更新

先了解这件事

AI 综述

2026年9月29日,Hugging Face Daily Papers 报道论文 FocusVTC。该方法面向视觉文本压缩,通过自适应分辨率将低 DPI 全局视图与选择性区域增强结合,以降低长上下文推理中的计算和内存成本。报道称,在 RULER v1 的 72 DPI 设置下,FocusVTC 以 2.9× 输入压缩取得 87.4 分,高于 Glyph 的 57.5 分;在 MRCR 延迟评测中,相对 Text 实现 2.79× 在线端到端加速。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月29日
  1. Hugging Face Daily Papers
    FocusVTC:基于自适应分辨率的高效高性能视觉文本压缩

    FocusVTC 用自适应分辨率改进视觉文本压缩,将低 DPI 全局视图与选择性区域增强结合,降低长上下文推理的计算和内存成本。在 RULER v1 的 72 DPI 设置下,FocusVTC 以 $2.9\times$ 输入压缩得分 87.4,高于 Glyph 的 57.5;在 MRCR 延迟评测中相对 Text 实现 $2.79\times$ 在线端到端加速。