Table Question Answering in the Era of Large Language Models: A Comprehensive Survey of Tasks, Methods, and Evaluation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhou, Wei, Ma, Bolei, Friedrich, Annemarie, Mesgar, Mohsen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FREB-TQA: A Fine-Grained Robustness Evaluation Benchmark for Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2024)
von: Zhou, Wei, et al.
Veröffentlicht: (2024)
Texts or Images? A Fine-grained Analysis on the Effectiveness of Input Representations and Models for Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
p2-TQA: A Process-based Preference Learning Framework for Self-Improving Table Question Answering Models
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
Efficient Multi-Agent Collaboration with Tool Use for Online Planning in Complex Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2024)
von: Zhou, Wei, et al.
Veröffentlicht: (2024)
Exploring Generative Process Reward Modeling for Semi-Structured Data: A Case Study of Table Question Answering
von: Tang, Lei, et al.
Veröffentlicht: (2025)
von: Tang, Lei, et al.
Veröffentlicht: (2025)
Pragmatics in the Era of Large Language Models: A Survey on Datasets, Evaluation, Opportunities and Challenges
von: Ma, Bolei, et al.
Veröffentlicht: (2025)
von: Ma, Bolei, et al.
Veröffentlicht: (2025)
OMoS-QA: A Dataset for Cross-Lingual Extractive Question Answering in a German Migration Context
von: Kleinle, Steffen, et al.
Veröffentlicht: (2024)
von: Kleinle, Steffen, et al.
Veröffentlicht: (2024)
The Imperfective Paradox in Large Language Models
von: Ma, Bolei, et al.
Veröffentlicht: (2026)
von: Ma, Bolei, et al.
Veröffentlicht: (2026)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
von: Gan, Aoran, et al.
Veröffentlicht: (2025)
von: Gan, Aoran, et al.
Veröffentlicht: (2025)
LLMs Beyond English: Scaling the Multilingual Capability of LLMs with Cross-Lingual Feedback
von: Lai, Wen, et al.
Veröffentlicht: (2024)
von: Lai, Wen, et al.
Veröffentlicht: (2024)
A Survey of Large Language Model Agents for Question Answering
von: Yue, Murong
Veröffentlicht: (2025)
von: Yue, Murong
Veröffentlicht: (2025)
Towards Robust Evaluation: A Comprehensive Taxonomy of Datasets and Metrics for Open Domain Question Answering in the Era of Large Language Models
von: Srivastava, Akchay, et al.
Veröffentlicht: (2024)
von: Srivastava, Akchay, et al.
Veröffentlicht: (2024)
Disambiguation in Conversational Question Answering in the Era of LLMs and Agents: A Survey
von: Tanjim, Md Mehrab, et al.
Veröffentlicht: (2025)
von: Tanjim, Md Mehrab, et al.
Veröffentlicht: (2025)
THELMA: Task Based Holistic Evaluation of Large Language Model Applications-RAG Question Answering
von: Patel, Udita, et al.
Veröffentlicht: (2025)
von: Patel, Udita, et al.
Veröffentlicht: (2025)
Capabilities and Evaluation Biases of Large Language Models in Classical Chinese Poetry Generation: A Case Study on Tang Poetry
von: Ma, Bolei, et al.
Veröffentlicht: (2025)
von: Ma, Bolei, et al.
Veröffentlicht: (2025)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
von: Wang, Can, et al.
Veröffentlicht: (2025)
von: Wang, Can, et al.
Veröffentlicht: (2025)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
von: Wu, Xianjie, et al.
Veröffentlicht: (2024)
von: Wu, Xianjie, et al.
Veröffentlicht: (2024)
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
Comprehensive Evaluation for a Large Scale Knowledge Graph Question Answering Service
von: Potdar, Saloni, et al.
Veröffentlicht: (2025)
von: Potdar, Saloni, et al.
Veröffentlicht: (2025)
Uncertainty Estimation of Large Language Models in Medical Question Answering
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
von: Wu, Jiaxin, et al.
Veröffentlicht: (2024)
Trustworthy Medical Question Answering: An Evaluation-Centric Survey
von: Wang, Yinuo, et al.
Veröffentlicht: (2025)
von: Wang, Yinuo, et al.
Veröffentlicht: (2025)
Bactrainus: Optimizing Large Language Models for Multi-hop Complex Question Answering Tasks
von: Barati, Iman, et al.
Veröffentlicht: (2025)
von: Barati, Iman, et al.
Veröffentlicht: (2025)
Coling-UniA at SciVQA 2025: Few-Shot Example Retrieval and Confidence-Informed Ensembling for Multimodal Large Language Models
von: Jaumann, Christian, et al.
Veröffentlicht: (2025)
von: Jaumann, Christian, et al.
Veröffentlicht: (2025)
RephQA: Evaluating Readability of Large Language Models in Public Health Question Answering
von: Qiu, Weikang, et al.
Veröffentlicht: (2025)
von: Qiu, Weikang, et al.
Veröffentlicht: (2025)
A Comprehensive Evaluation of GPT-4V on Knowledge-Intensive Visual Question Answering
von: Li, Yunxin, et al.
Veröffentlicht: (2023)
von: Li, Yunxin, et al.
Veröffentlicht: (2023)
A Comprehensive Survey of Contamination Detection Methods in Large Language Models
von: Ravaut, Mathieu, et al.
Veröffentlicht: (2024)
von: Ravaut, Mathieu, et al.
Veröffentlicht: (2024)
PRIV-QA: Privacy-Preserving Question Answering for Cloud Large Language Models
von: Li, Guangwei, et al.
Veröffentlicht: (2025)
von: Li, Guangwei, et al.
Veröffentlicht: (2025)
Evaluating the Meta- and Object-Level Reasoning of Large Language Models for Question Answering
von: Ferguson, Nick, et al.
Veröffentlicht: (2025)
von: Ferguson, Nick, et al.
Veröffentlicht: (2025)
Evaluating Zero-Shot Multilingual Aspect-Based Sentiment Analysis with Large Language Models
von: Wu, Chengyan, et al.
Veröffentlicht: (2024)
von: Wu, Chengyan, et al.
Veröffentlicht: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
von: Wei, Jianhui, et al.
Veröffentlicht: (2025)
An Expert Schema for Evaluating Large Language Model Errors in Scholarly Question-Answering Systems
von: Martin-Boyle, Anna, et al.
Veröffentlicht: (2026)
von: Martin-Boyle, Anna, et al.
Veröffentlicht: (2026)
A Comprehensive Study on Fine-Tuning Large Language Models for Medical Question Answering Using Classification Models and Comparative Analysis
von: Ucar, Aysegul, et al.
Veröffentlicht: (2025)
von: Ucar, Aysegul, et al.
Veröffentlicht: (2025)
Evaluating Multimodal Large Language Models on Educational Textbook Question Answering
von: Alawwad, Hessa A., et al.
Veröffentlicht: (2025)
von: Alawwad, Hessa A., et al.
Veröffentlicht: (2025)
Fine-Tuning Large Language Models and Evaluating Retrieval Methods for Improved Question Answering on Building Codes
von: Aqib, Mohammad, et al.
Veröffentlicht: (2025)
von: Aqib, Mohammad, et al.
Veröffentlicht: (2025)
RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering
von: He, Bolei, et al.
Veröffentlicht: (2025)
von: He, Bolei, et al.
Veröffentlicht: (2025)
A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges
von: Yan, Yibo, et al.
Veröffentlicht: (2024)
von: Yan, Yibo, et al.
Veröffentlicht: (2024)
Question: How do Large Language Models perform on the Question Answering tasks? Answer:
von: Fischer, Kevin, et al.
Veröffentlicht: (2024)
von: Fischer, Kevin, et al.
Veröffentlicht: (2024)
Cost-efficient Knowledge-based Question Answering with Large Language Models
von: Dong, Junnan, et al.
Veröffentlicht: (2024)
von: Dong, Junnan, et al.
Veröffentlicht: (2024)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
von: Xiao, Hanguang, et al.
Veröffentlicht: (2024)
von: Xiao, Hanguang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
FREB-TQA: A Fine-Grained Robustness Evaluation Benchmark for Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2024) -
Texts or Images? A Fine-grained Analysis on the Effectiveness of Input Representations and Models for Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2025) -
p2-TQA: A Process-based Preference Learning Framework for Self-Improving Table Question Answering Models
von: Zhou, Wei, et al.
Veröffentlicht: (2025) -
Efficient Multi-Agent Collaboration with Tool Use for Online Planning in Complex Table Question Answering
von: Zhou, Wei, et al.
Veröffentlicht: (2024) -
Exploring Generative Process Reward Modeling for Semi-Structured Data: A Case Study of Table Question Answering
von: Tang, Lei, et al.
Veröffentlicht: (2025)