LAD-RAG: Layout-aware Dynamic RAG for Visually-Rich Document Understanding
Fuente:
arXiv
Saved in:
| Main Authors: | Sourati, Zhivar, Wang, Zheng, Liu, Marianne Menglin, Hu, Yazhe, Guo, Mengqing, Bharadwaj, Sujeeth, Han, Kyu, Sheng, Tao, Ravi, Sujith, Dehghani, Morteza, Roth, Dan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The Homogenizing Effect of Large Language Models on Human Expression and Thought
by: Sourati, Zhivar, et al.
Published: (2025)
by: Sourati, Zhivar, et al.
Published: (2025)
PAR$^2$-RAG: Planned Active Retrieval and Reasoning for Multi-Hop Question Answering
by: Li, Xingyu, et al.
Published: (2026)
by: Li, Xingyu, et al.
Published: (2026)
Structural Abstraction as an Inductive Bias for Non-Stationary Language Model Training
by: Rahmati, Elnaz, et al.
Published: (2026)
by: Rahmati, Elnaz, et al.
Published: (2026)
Theory Trace Card: Theory-Driven Socio-Cognitive Evaluation of LLMs
by: Karimi-Malekabadi, Farzan, et al.
Published: (2026)
by: Karimi-Malekabadi, Farzan, et al.
Published: (2026)
Reasoning on a Spectrum: Aligning LLMs to System 1 and System 2 Thinking
by: Ziabari, Alireza S., et al.
Published: (2025)
by: Ziabari, Alireza S., et al.
Published: (2025)
RAG Makes Guardrails Unsafe? Investigating Robustness of Guardrails under RAG-style Contexts
by: She, Yining, et al.
Published: (2025)
by: She, Yining, et al.
Published: (2025)
DiffuMask: Diffusion Language Model for Token-level Prompt Pruning
by: Zheng, Caleb, et al.
Published: (2026)
by: Zheng, Caleb, et al.
Published: (2026)
Routesplain: Towards Faithful and Intervenable Routing for Software-related Tasks
by: Štorek, Adam, et al.
Published: (2025)
by: Štorek, Adam, et al.
Published: (2025)
OraPlan-SQL: A Planning-Centric Framework for Complex Bilingual NL2SQL Reasoning
by: Liu, Marianne Menglin, et al.
Published: (2025)
by: Liu, Marianne Menglin, et al.
Published: (2025)
Secret Keepers: The Impact of LLMs on Linguistic Markers of Personal Traits
by: Sourati, Zhivar, et al.
Published: (2024)
by: Sourati, Zhivar, et al.
Published: (2024)
Contextualizing Argument Quality Assessment with Relevant Knowledge
by: Deshpande, Darshan, et al.
Published: (2023)
by: Deshpande, Darshan, et al.
Published: (2023)
ARN: Analogical Reasoning on Narratives
by: Sourati, Zhivar, et al.
Published: (2023)
by: Sourati, Zhivar, et al.
Published: (2023)
Roles of MLLMs in Visually Rich Document Retrieval for RAG: A Survey
by: Zhang, Xiantao
Published: (2025)
by: Zhang, Xiantao
Published: (2025)
VDocRAG: Retrieval-Augmented Generation over Visually-Rich Documents
by: Tanaka, Ryota, et al.
Published: (2025)
by: Tanaka, Ryota, et al.
Published: (2025)
Retrieval or Representation? Reassessing Benchmark Gaps in Multilingual and Visually Rich RAG
by: Asenov, Martin, et al.
Published: (2026)
by: Asenov, Martin, et al.
Published: (2026)
SuperRAG: Beyond RAG with Layout-Aware Graph Modeling
by: Yang, Jeff, et al.
Published: (2025)
by: Yang, Jeff, et al.
Published: (2025)
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
by: Gong, Ziyu, et al.
Published: (2025)
by: Gong, Ziyu, et al.
Published: (2025)
JTPRO: A Joint Tool-Prompt Reflective Optimization Framework for Language Agents
by: Ghoshal, Sandip, et al.
Published: (2026)
by: Ghoshal, Sandip, et al.
Published: (2026)
Robust Text Classification: Analyzing Prototype-Based Networks
by: Sourati, Zhivar, et al.
Published: (2023)
by: Sourati, Zhivar, et al.
Published: (2023)
Aligning LLMs for Multilingual Consistency in Enterprise Applications
by: Agarwal, Amit, et al.
Published: (2025)
by: Agarwal, Amit, et al.
Published: (2025)
The Shrinking Landscape of Linguistic Diversity in the Age of Large Language Models
by: Sourati, Zhivar, et al.
Published: (2025)
by: Sourati, Zhivar, et al.
Published: (2025)
SlideCoder: Layout-aware RAG-enhanced Hierarchical Slide Generation from Design
by: Tang, Wenxin, et al.
Published: (2025)
by: Tang, Wenxin, et al.
Published: (2025)
TextlessRAG: End-to-End Visual Document RAG by Speech Without Text
by: Xie, Peijin, et al.
Published: (2025)
by: Xie, Peijin, et al.
Published: (2025)
LayoutLLM: Large Language Model Instruction Tuning for Visually Rich Document Understanding
by: Fujitake, Masato
Published: (2024)
by: Fujitake, Masato
Published: (2024)
GraphER: An Efficient Graph-Based Enrichment and Reranking Method for Retrieval-Augmented Generation
by: Miao, Ruizhong, et al.
Published: (2026)
by: Miao, Ruizhong, et al.
Published: (2026)
Evaluating VisualRAG: Quantifying Cross-Modal Performance in Enterprise Document Understanding
by: Mannam, Varun, et al.
Published: (2025)
by: Mannam, Varun, et al.
Published: (2025)
RegionRAG: Region-level Retrieval-Augmented Generation for Visual Document Understanding
by: Li, Yinglu, et al.
Published: (2025)
by: Li, Yinglu, et al.
Published: (2025)
MoLoRAG: Bootstrapping Document Understanding via Multi-modal Logic-aware Retrieval
by: Wu, Xixi, et al.
Published: (2025)
by: Wu, Xixi, et al.
Published: (2025)
MARVEL: Multidimensional Abstraction and Reasoning through Visual Evaluation and Learning
by: Jiang, Yifan, et al.
Published: (2024)
by: Jiang, Yifan, et al.
Published: (2024)
LayoutRAG: Retrieval-Augmented Model for Content-agnostic Conditional Layout Generation
by: Wu, Yuxuan, et al.
Published: (2025)
by: Wu, Yuxuan, et al.
Published: (2025)
PROPEX-RAG: Enhanced GraphRAG using Prompt-Driven Prompt Execution
by: Sarnaik, Tejas, et al.
Published: (2025)
by: Sarnaik, Tejas, et al.
Published: (2025)
A Large-Scale Analysis of Persian Tweets Regarding Covid-19 Vaccination
by: ShabaniMirzaei, Taha, et al.
Published: (2023)
by: ShabaniMirzaei, Taha, et al.
Published: (2023)
Automatic Layout Planning for Visually-Rich Documents with Instruction-Following Models
by: Zhu, Wanrong, et al.
Published: (2024)
by: Zhu, Wanrong, et al.
Published: (2024)
QualiRAG: Retrieval-Augmented Generation for Visual Quality Understanding
by: Cao, Linhan, et al.
Published: (2026)
by: Cao, Linhan, et al.
Published: (2026)
HyperbolicRAG: Enhancing Retrieval-Augmented Generation with Hyperbolic Representations
by: Cao, Linxiao, et al.
Published: (2025)
by: Cao, Linxiao, et al.
Published: (2025)
The Curious Case of Nonverbal Abstract Reasoning with Multi-Modal Large Language Models
by: Ahrabian, Kian, et al.
Published: (2024)
by: Ahrabian, Kian, et al.
Published: (2024)
VRAG-RL: Empower Vision-Perception-Based RAG for Visually Rich Information Understanding via Iterative Reasoning with Reinforcement Learning
by: Wang, Qiuchen, et al.
Published: (2025)
by: Wang, Qiuchen, et al.
Published: (2025)
CDS4RAG: Cyclic Dual-Sequential Hyperparameter Optimization for RAG
by: Chen, Pengzhou, et al.
Published: (2026)
by: Chen, Pengzhou, et al.
Published: (2026)
Know3-RAG: A Knowledge-aware RAG Framework with Adaptive Retrieval, Generation, and Filtering
by: Liu, Xukai, et al.
Published: (2025)
by: Liu, Xukai, et al.
Published: (2025)
RAG Bot for Random Documents
by: D. Anjaneyulu, et al.
Published: (2025)
by: D. Anjaneyulu, et al.
Published: (2025)
Similar Items
-
The Homogenizing Effect of Large Language Models on Human Expression and Thought
by: Sourati, Zhivar, et al.
Published: (2025) -
PAR$^2$-RAG: Planned Active Retrieval and Reasoning for Multi-Hop Question Answering
by: Li, Xingyu, et al.
Published: (2026) -
Structural Abstraction as an Inductive Bias for Non-Stationary Language Model Training
by: Rahmati, Elnaz, et al.
Published: (2026) -
Theory Trace Card: Theory-Driven Socio-Cognitive Evaluation of LLMs
by: Karimi-Malekabadi, Farzan, et al.
Published: (2026) -
Reasoning on a Spectrum: Aligning LLMs to System 1 and System 2 Thinking
by: Ziabari, Alireza S., et al.
Published: (2025)