跳到正文
原文
Hugging Face Daily Papers·· 1 天前AI 评分41

OneSearch-VL:用于图像和视频的统一多模态深度研究智能体

OneSearch-VL: Unified Multimodal Deep Research Agent for Image and Video

AI 导读

OneSearch-VL 提出以 Visually Grounded Evidence Graph(VGEG)为核心的统一多模态深度研究智能体,面向单图、多图和视频任务。

来源:Hugging Face Daily Papers · arxiv.org