热点事件历史事件
FocusVTC视觉文本压缩方法发布
1 篇报道1 个报道来源3 天前更新
先了解这件事
AI 综述
2026年9月29日,Hugging Face Daily Papers 报道论文 FocusVTC。该方法面向视觉文本压缩,通过自适应分辨率将低 DPI 全局视图与选择性区域增强结合,以降低长上下文推理中的计算和内存成本。报道称,在 RULER v1 的 72 DPI 设置下,FocusVTC 以 2.9× 输入压缩取得 87.4 分,高于 Glyph 的 57.5 分;在 MRCR 延迟评测中,相对 Text 实现 2.79× 在线端到端加速。
AI 根据报道生成 · 3 小时前更新
最新进展9月29日 08:00
FocusVTC论文展示自适应分辨率视觉文本压缩效果。报道时间线
沿着报道,了解事件的不同侧面。
9月29日
- Hugging Face Daily PapersFocusVTC:基于自适应分辨率的高效高性能视觉文本压缩
FocusVTC 用自适应分辨率改进视觉文本压缩,将低 DPI 全局视图与选择性区域增强结合,降低长上下文推理的计算和内存成本。在 RULER v1 的 72 DPI 设置下,FocusVTC 以 $2.9\times$ 输入压缩得分 87.4,高于 Glyph 的 57.5;在 MRCR 延迟评测中相对 Text 实现 $2.79\times$ 在线端到端加速。