Hugging Face Daily Papers·· 1 天前AI 评分41
OneSearch-VL:用于图像和视频的统一多模态深度研究智能体
OneSearch-VL: Unified Multimodal Deep Research Agent for Image and Video
AI 导读
OneSearch-VL 提出以 Visually Grounded Evidence Graph(VGEG)为核心的统一多模态深度研究智能体,面向单图、多图和视频任务。
来源:Hugging Face Daily Papers · arxiv.org