ViDR: Grounding Multimodal Deep Research Reports in Source Visual Evidence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Zhuofan, Jia, Peilun, Sun, Baoqin, Shen, Haiyang, Xie, Sixiong, Ma, Yun, Jing, Xiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DeepWeb-Bench: A Deep Research Benchmark Demanding Massive Cross-Source Evidence and Long-Horizon Derivation
par: Xie, Sixiong, et autres
Publié: (2026)
par: Xie, Sixiong, et autres
Publié: (2026)
IoDResearch: Deep Research on Private Heterogeneous Data via the Internet of Data
par: Shi, Zhuofan, et autres
Publié: (2025)
par: Shi, Zhuofan, et autres
Publié: (2025)
M3-BENCH: Process-Aware Evaluation of LLM Agents' Social Behaviors in Mixed-Motive Games
par: Xie, Sixiong, et autres
Publié: (2026)
par: Xie, Sixiong, et autres
Publié: (2026)
Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation
par: Ye, Fangda, et autres
Publié: (2026)
par: Ye, Fangda, et autres
Publié: (2026)
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
par: Shi, Zhuofan, et autres
Publié: (2026)
par: Shi, Zhuofan, et autres
Publié: (2026)
SGR-Bench: Benchmarking Search Agents on State-Gated Retrieval
par: Li, Ningyuan, et autres
Publié: (2026)
par: Li, Ningyuan, et autres
Publié: (2026)
Text-Guided Visual Representation Learning for Robust Multimodal E-Commerce Recommendation
par: Guo, Yufei, et autres
Publié: (2026)
par: Guo, Yufei, et autres
Publié: (2026)
Reinforcement Fine-Tuning for Reasoning towards Multi-Step Multi-Source Search in Large Language Models
par: Shi, Wentao, et autres
Publié: (2025)
par: Shi, Wentao, et autres
Publié: (2025)
ViDoRe Benchmark V2: Raising the Bar for Visual Retrieval
par: Macé, Quentin, et autres
Publié: (2025)
par: Macé, Quentin, et autres
Publié: (2025)
VISA: Retrieval Augmented Generation with Visual Source Attribution
par: Ma, Xueguang, et autres
Publié: (2024)
par: Ma, Xueguang, et autres
Publié: (2024)
ViLLA-MMBench: A Unified Benchmark Suite for LLM-Augmented Multimodal Movie Recommendation
par: Nazary, Fatemeh, et autres
Publié: (2025)
par: Nazary, Fatemeh, et autres
Publié: (2025)
Argus: Evidence Assembly for Scalable Deep Research Agents
par: Zhang, Zhen, et autres
Publié: (2026)
par: Zhang, Zhen, et autres
Publié: (2026)
Discrete Preference Learning for Personalized Multimodal Generation
par: Zhang, Yuting, et autres
Publié: (2026)
par: Zhang, Yuting, et autres
Publié: (2026)
DeepImageSearch: Benchmarking Multimodal Agents for Context-Aware Image Retrieval in Visual Histories
par: Deng, Chenlong, et autres
Publié: (2026)
par: Deng, Chenlong, et autres
Publié: (2026)
Evidence-Grounded Multimodal Misinformation Detection with Attention-Based GNNs
par: Duwal, Sharad, et autres
Publié: (2025)
par: Duwal, Sharad, et autres
Publié: (2025)
Deep Research: A Survey of Autonomous Research Agents
par: Zhang, Wenlin, et autres
Publié: (2025)
par: Zhang, Wenlin, et autres
Publié: (2025)
Financial Transaction Retrieval and Contextual Evidence for Knowledge-Grounded Reasoning
par: Sakhno, Artem, et autres
Publié: (2026)
par: Sakhno, Artem, et autres
Publié: (2026)
ViHERMES: A Graph-Grounded Multihop Question Answering Benchmark and System for Vietnamese Healthcare Regulations
par: Nguyen, Long S. T., et autres
Publié: (2026)
par: Nguyen, Long S. T., et autres
Publié: (2026)
Tongyi DeepResearch Technical Report
par: Tongyi DeepResearch Team, et autres
Publié: (2025)
par: Tongyi DeepResearch Team, et autres
Publié: (2025)
A Model-based Multi-Agent Personalized Short-Video Recommender System
par: Zhou, Peilun, et autres
Publié: (2024)
par: Zhou, Peilun, et autres
Publié: (2024)
Doc-Researcher: A Unified System for Multimodal Document Parsing and Deep Research
par: Dong, Kuicai, et autres
Publié: (2025)
par: Dong, Kuicai, et autres
Publié: (2025)
Enhancing Recommender Systems: A Strategy to Mitigate False Negative Impact
par: Shi, Kexin, et autres
Publié: (2022)
par: Shi, Kexin, et autres
Publié: (2022)
Evidence Units: Ontology-Grounded Document Organization for Parser-Independent Retrieval
par: Han, Yeonjee
Publié: (2026)
par: Han, Yeonjee
Publié: (2026)
JARVIS: An Evidence-Grounded Retrieval System for Interpretable Deceptive Reviews Adjudication
par: Lu, Nan, et autres
Publié: (2026)
par: Lu, Nan, et autres
Publié: (2026)
RDSA: A Robust Deep Graph Clustering Framework via Dual Soft Assignment
par: Xiang, Yang, et autres
Publié: (2024)
par: Xiang, Yang, et autres
Publié: (2024)
A Hybrid Retrieval and Reranking Framework for Evidence-Grounded Retrieval-Augmented Generation
par: Irany, Fariba Afrin, et autres
Publié: (2026)
par: Irany, Fariba Afrin, et autres
Publié: (2026)
AdaS&S: a One-Shot Supernet Approach for Automatic Embedding Size Search in Deep Recommender System
par: Wei, He, et autres
Publié: (2024)
par: Wei, He, et autres
Publié: (2024)
DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research
par: Wang, Zifeng, et autres
Publié: (2025)
par: Wang, Zifeng, et autres
Publié: (2025)
Purifying Multimodal Retrieval: Fragment-Level Evidence Selection for RAG
par: Wang, Xihang, et autres
Publié: (2026)
par: Wang, Xihang, et autres
Publié: (2026)
Reproducibility, Replicability, and Insights into Visual Document Retrieval with Late Interaction
par: Qiao, Jingfen, et autres
Publié: (2025)
par: Qiao, Jingfen, et autres
Publié: (2025)
MOSAIC: Multimodal Multistakeholder-aware Visual Art Recommendation
par: Yilma, Bereket A., et autres
Publié: (2024)
par: Yilma, Bereket A., et autres
Publié: (2024)
Rethinking Literature Search Evaluation: Deep Research Helps, and Human Citation Lists Are Not a Ground Truth
par: Sahu, Gaurav, et autres
Publié: (2026)
par: Sahu, Gaurav, et autres
Publié: (2026)
Synthetic Sources?: Auditing Generative Search Engine Citations for Evidence of AI-Generated Sources
par: Allaham, Mowafak, et autres
Publié: (2026)
par: Allaham, Mowafak, et autres
Publié: (2026)
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
Formalizing Multimedia Recommendation through Multimodal Deep Learning
par: Malitesta, Daniele, et autres
Publié: (2023)
par: Malitesta, Daniele, et autres
Publié: (2023)
Multi-Sourced, Multi-Agent Evidence Retrieval for Fact-Checking
par: Gong, Shuzhi, et autres
Publié: (2026)
par: Gong, Shuzhi, et autres
Publié: (2026)
DeepResearchGym: A Free, Transparent, and Reproducible Evaluation Sandbox for Deep Research
par: Coelho, João, et autres
Publié: (2025)
par: Coelho, João, et autres
Publié: (2025)
MedViz: An Agent-based, Visual-guided Research Assistant for Navigating Biomedical Literature
par: He, Huan, et autres
Publié: (2026)
par: He, Huan, et autres
Publié: (2026)
Failure is Feedback: History-Aware Backtracking for Agentic Traversal in Multimodal Graphs
par: Yun, Joohyung, et autres
Publié: (2026)
par: Yun, Joohyung, et autres
Publié: (2026)
HKRAG: Holistic Knowledge Retrieval-Augmented Generation Over Visually-Rich Documents
par: Tong, Anyang, et autres
Publié: (2025)
par: Tong, Anyang, et autres
Publié: (2025)
Documents similaires
-
DeepWeb-Bench: A Deep Research Benchmark Demanding Massive Cross-Source Evidence and Long-Horizon Derivation
par: Xie, Sixiong, et autres
Publié: (2026) -
IoDResearch: Deep Research on Private Heterogeneous Data via the Internet of Data
par: Shi, Zhuofan, et autres
Publié: (2025) -
M3-BENCH: Process-Aware Evaluation of LLM Agents' Social Behaviors in Mixed-Motive Games
par: Xie, Sixiong, et autres
Publié: (2026) -
Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation
par: Ye, Fangda, et autres
Publié: (2026) -
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
par: Shi, Zhuofan, et autres
Publié: (2026)