Survey on Question Answering over Visually Rich Documents: Methods, Challenges, and Trends
Fuente:
arXiv
Salvato in:
| Autori principali: | Barboule, Camille, Piwowarski, Benjamin, Chabot, Yoan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Give it Space! Explicit Disentangling of Positional and Semantic Representations in Encoders
di: Lequeu, Pierre-Antoine, et al.
Pubblicazione: (2026)
di: Lequeu, Pierre-Antoine, et al.
Pubblicazione: (2026)
TelcoLM: collecting data, adapting, and benchmarking language models for the telecommunication domain
di: Barboule, Camille, et al.
Pubblicazione: (2024)
di: Barboule, Camille, et al.
Pubblicazione: (2024)
Structural Deep Encoding for Table Question Answering
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2025)
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2025)
EVJVQA Challenge: Multilingual Visual Question Answering
di: Nguyen, Ngan Luu-Thuy, et al.
Pubblicazione: (2023)
di: Nguyen, Ngan Luu-Thuy, et al.
Pubblicazione: (2023)
Cross-modal Retrieval for Knowledge-based Visual Question Answering
di: Lerner, Paul, et al.
Pubblicazione: (2024)
di: Lerner, Paul, et al.
Pubblicazione: (2024)
Biomedical Question Answering: A Survey of Approaches and Challenges
di: Jin, Qiao, et al.
Pubblicazione: (2021)
di: Jin, Qiao, et al.
Pubblicazione: (2021)
Exploring Diverse Methods in Visual Question Answering
di: Li, Panfeng, et al.
Pubblicazione: (2024)
di: Li, Panfeng, et al.
Pubblicazione: (2024)
Towards Lossless Token Pruning in Late-Interaction Retrieval Models
di: Zong, Yuxuan, et al.
Pubblicazione: (2025)
di: Zong, Yuxuan, et al.
Pubblicazione: (2025)
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
ASTRA-QA: A Benchmark for Abstract Question Answering over Documents
di: Wang, Shu, et al.
Pubblicazione: (2026)
di: Wang, Shu, et al.
Pubblicazione: (2026)
Selectively Answering Visual Questions
di: Eisenschlos, Julian Martin, et al.
Pubblicazione: (2024)
di: Eisenschlos, Julian Martin, et al.
Pubblicazione: (2024)
Natural Language Understanding and Inference with MLLM in Visual Question Answering: A Survey
di: Kuang, Jiayi, et al.
Pubblicazione: (2024)
di: Kuang, Jiayi, et al.
Pubblicazione: (2024)
Single-Pass Document Scanning for Question Answering
di: Cao, Weili, et al.
Pubblicazione: (2025)
di: Cao, Weili, et al.
Pubblicazione: (2025)
Federated Document Visual Question Answering: A Pilot Study
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
On the Representations of Entities in Auto-regressive Large Language Models
di: Morand, Victor, et al.
Pubblicazione: (2025)
di: Morand, Victor, et al.
Pubblicazione: (2025)
Trustworthy Medical Question Answering: An Evaluation-Centric Survey
di: Wang, Yinuo, et al.
Pubblicazione: (2025)
di: Wang, Yinuo, et al.
Pubblicazione: (2025)
Agentic LLMs for Question Answering over Tabular Data
di: Tyagi, Rishit, et al.
Pubblicazione: (2025)
di: Tyagi, Rishit, et al.
Pubblicazione: (2025)
QAnswer: Towards Question Answering Search over Websites
di: Guo, Kunpeng, et al.
Pubblicazione: (2024)
di: Guo, Kunpeng, et al.
Pubblicazione: (2024)
Semantic Parsing for Question Answering over Knowledge Graphs
di: Wei, Sijia, et al.
Pubblicazione: (2023)
di: Wei, Sijia, et al.
Pubblicazione: (2023)
Building a Rich Dataset to Empower the Persian Question Answering Systems
di: Yazdinejad, Mohsen, et al.
Pubblicazione: (2024)
di: Yazdinejad, Mohsen, et al.
Pubblicazione: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
Knowledge-Based Counterfactual Queries for Visual Question Answering
di: Stoikou, Theodoti, et al.
Pubblicazione: (2023)
di: Stoikou, Theodoti, et al.
Pubblicazione: (2023)
LIVE: Learnable In-Context Vector for Visual Question Answering
di: Peng, Yingzhe, et al.
Pubblicazione: (2024)
di: Peng, Yingzhe, et al.
Pubblicazione: (2024)
DARE: Diverse Visual Question Answering with Robustness Evaluation
di: Sterz, Hannah, et al.
Pubblicazione: (2024)
di: Sterz, Hannah, et al.
Pubblicazione: (2024)
Roles of MLLMs in Visually Rich Document Retrieval for RAG: A Survey
di: Zhang, Xiantao
Pubblicazione: (2025)
di: Zhang, Xiantao
Pubblicazione: (2025)
AdaDocVQA: Adaptive Framework for Long Document Visual Question Answering in Low-Resource Settings
di: Li, Haoxuan, et al.
Pubblicazione: (2025)
di: Li, Haoxuan, et al.
Pubblicazione: (2025)
Index Light, Reason Deep: Deferred Visual Ingestion for Visual-Dense Document Question Answering
di: Xu, Tao
Pubblicazione: (2026)
di: Xu, Tao
Pubblicazione: (2026)
Synthetic Document Question Answering in Hungarian
di: Li, Jonathan, et al.
Pubblicazione: (2025)
di: Li, Jonathan, et al.
Pubblicazione: (2025)
Table Question Answering in the Era of Large Language Models: A Comprehensive Survey of Tasks, Methods, and Evaluation
di: Zhou, Wei, et al.
Pubblicazione: (2025)
di: Zhou, Wei, et al.
Pubblicazione: (2025)
Black-box Model Ensembling for Textual and Visual Question Answering via Information Fusion
di: Xia, Yuxi, et al.
Pubblicazione: (2024)
di: Xia, Yuxi, et al.
Pubblicazione: (2024)
Passage Segmentation of Documents for Extractive Question Answering
di: Liu, Zuhong, et al.
Pubblicazione: (2025)
di: Liu, Zuhong, et al.
Pubblicazione: (2025)
Multimodal Emotion Recognition in Conversations: A Survey of Methods, Trends, Challenges and Prospects
di: Wu, Chengyan, et al.
Pubblicazione: (2025)
di: Wu, Chengyan, et al.
Pubblicazione: (2025)
MST5 -- Multilingual Question Answering over Knowledge Graphs
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
Evaluating LLMs' Mathematical Reasoning in Financial Document Question Answering
di: Srivastava, Pragya, et al.
Pubblicazione: (2024)
di: Srivastava, Pragya, et al.
Pubblicazione: (2024)
CompAct: Compressing Retrieved Documents Actively for Question Answering
di: Yoon, Chanwoong, et al.
Pubblicazione: (2024)
di: Yoon, Chanwoong, et al.
Pubblicazione: (2024)
Deep Learning based Visually Rich Document Content Understanding: A Survey
di: Ding, Yihao, et al.
Pubblicazione: (2024)
di: Ding, Yihao, et al.
Pubblicazione: (2024)
IRPAPERS: A Visual Document Benchmark for Scientific Retrieval and Question Answering
di: Shorten, Connor, et al.
Pubblicazione: (2026)
di: Shorten, Connor, et al.
Pubblicazione: (2026)
A Survey on MLLM-based Visually Rich Document Understanding: Methods, Challenges, and Emerging Trends
di: Ding, Yihao, et al.
Pubblicazione: (2025)
di: Ding, Yihao, et al.
Pubblicazione: (2025)
It's High Time: A Survey of Temporal Question Answering
di: Piryani, Bhawna, et al.
Pubblicazione: (2025)
di: Piryani, Bhawna, et al.
Pubblicazione: (2025)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Give it Space! Explicit Disentangling of Positional and Semantic Representations in Encoders
di: Lequeu, Pierre-Antoine, et al.
Pubblicazione: (2026) -
TelcoLM: collecting data, adapting, and benchmarking language models for the telecommunication domain
di: Barboule, Camille, et al.
Pubblicazione: (2024) -
Structural Deep Encoding for Table Question Answering
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2025) -
EVJVQA Challenge: Multilingual Visual Question Answering
di: Nguyen, Ngan Luu-Thuy, et al.
Pubblicazione: (2023) -
Cross-modal Retrieval for Knowledge-based Visual Question Answering
di: Lerner, Paul, et al.
Pubblicazione: (2024)