TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wu, Xianjie, Yang, Jian, Chai, Linzheng, Zhang, Ge, Liu, Jiaheng, Du, Xinrun, Liang, Di, Shu, Daixin, Cheng, Xianfu, Sun, Tianzhen, Niu, Guanglin, Li, Tongliang, Li, Zhoujun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
M3TQA: Massively Multilingual Multitask Table Question Answering
von: Shu, Daixin, et al.
Veröffentlicht: (2025)
von: Shu, Daixin, et al.
Veröffentlicht: (2025)
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
von: Ji, Hangyuan, et al.
Veröffentlicht: (2024)
von: Ji, Hangyuan, et al.
Veröffentlicht: (2024)
IFEvalCode: Controlled Code Generation
von: Yang, Jian, et al.
Veröffentlicht: (2025)
von: Yang, Jian, et al.
Veröffentlicht: (2025)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
von: Hou, Xia, et al.
Veröffentlicht: (2024)
von: Hou, Xia, et al.
Veröffentlicht: (2024)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
von: Chai, Linzheng, et al.
Veröffentlicht: (2024)
von: Chai, Linzheng, et al.
Veröffentlicht: (2024)
TableVQA-Bench: A Visual Question Answering Benchmark on Multiple Table Domains
von: Kim, Yoonsik, et al.
Veröffentlicht: (2024)
von: Kim, Yoonsik, et al.
Veröffentlicht: (2024)
Knowledge Graph Embeddings: A Comprehensive Survey on Capturing Relation Properties
von: Niu, Guanglin
Veröffentlicht: (2024)
von: Niu, Guanglin
Veröffentlicht: (2024)
McEval: Massively Multilingual Code Evaluation
von: Chai, Linzheng, et al.
Veröffentlicht: (2024)
von: Chai, Linzheng, et al.
Veröffentlicht: (2024)
TableEval: A Real-World Benchmark for Complex, Multilingual, and Multi-Structured Table Question Answering
von: Zhu, Junnan, et al.
Veröffentlicht: (2025)
von: Zhu, Junnan, et al.
Veröffentlicht: (2025)
Table-R1: Region-based Reinforcement Learning for Table Understanding
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
P2P: Automated Paper-to-Poster Generation and Fine-Grained Benchmark
von: Sun, Tao, et al.
Veröffentlicht: (2025)
von: Sun, Tao, et al.
Veröffentlicht: (2025)
UniCoder: Scaling Code Large Language Model via Universal Code
von: Sun, Tao, et al.
Veröffentlicht: (2024)
von: Sun, Tao, et al.
Veröffentlicht: (2024)
Multilingual Multimodal Software Developer for Code Generation
von: Chai, Linzheng, et al.
Veröffentlicht: (2025)
von: Chai, Linzheng, et al.
Veröffentlicht: (2025)
XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form Parser
von: Cheng, Xianfu, et al.
Veröffentlicht: (2024)
von: Cheng, Xianfu, et al.
Veröffentlicht: (2024)
Hybrid CNN-Mamba Enhancement Network for Robust Multimodal Sentiment Analysis
von: Li, Xiang, et al.
Veröffentlicht: (2025)
von: Li, Xiang, et al.
Veröffentlicht: (2025)
Transfer Learning Enhanced Single-choice Decision for Multi-choice Question Answering
von: Cui, Chenhao, et al.
Veröffentlicht: (2024)
von: Cui, Chenhao, et al.
Veröffentlicht: (2024)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
von: Ma, Kaijing, et al.
Veröffentlicht: (2024)
von: Ma, Kaijing, et al.
Veröffentlicht: (2024)
MULTITAT: Benchmarking Multilingual Table-and-Text Question Answering
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
von: Zhang, Xuanliang, et al.
Veröffentlicht: (2025)
MdEval: Massively Multilingual Code Debugging
von: Liu, Shukai, et al.
Veröffentlicht: (2024)
von: Liu, Shukai, et al.
Veröffentlicht: (2024)
PilotBench: A Benchmark for General Aviation Agents with Safety Constraints
von: Wu, Yalun, et al.
Veröffentlicht: (2026)
von: Wu, Yalun, et al.
Veröffentlicht: (2026)
ReasonTabQA: A Comprehensive Benchmark for Table Question Answering from Real World Industrial Scenarios
von: Pan, Changzai, et al.
Veröffentlicht: (2026)
von: Pan, Changzai, et al.
Veröffentlicht: (2026)
ST-Raptor: LLM-Powered Semi-Structured Table Question Answering
von: Tang, Zirui, et al.
Veröffentlicht: (2025)
von: Tang, Zirui, et al.
Veröffentlicht: (2025)
GraphOTTER: Evolving LLM-based Graph Reasoning for Complex Table Question Answering
von: Li, Qianlong, et al.
Veröffentlicht: (2024)
von: Li, Qianlong, et al.
Veröffentlicht: (2024)
What Are They Talking About? A Benchmark of Knowledge-Grounded Discussion Summarization
von: Zhou, Weixiao, et al.
Veröffentlicht: (2025)
von: Zhou, Weixiao, et al.
Veröffentlicht: (2025)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
von: Yang, Liqun, et al.
Veröffentlicht: (2024)
von: Yang, Liqun, et al.
Veröffentlicht: (2024)
ASTRA: Adaptive Semantic Tree Reasoning Architecture for Complex Table Question Answering
von: Guo, Xiaoke, et al.
Veröffentlicht: (2026)
von: Guo, Xiaoke, et al.
Veröffentlicht: (2026)
Learning Efficient and Generalizable Graph Retriever for Knowledge-Graph Question Answering
von: Yao, Tianjun, et al.
Veröffentlicht: (2025)
von: Yao, Tianjun, et al.
Veröffentlicht: (2025)
SimpleVQA: Multimodal Factuality Evaluation for Multimodal Large Language Models
von: Cheng, Xianfu, et al.
Veröffentlicht: (2025)
von: Cheng, Xianfu, et al.
Veröffentlicht: (2025)
TF-Mamba: Text-enhanced Fusion Mamba with Missing Modalities for Robust Multimodal Sentiment Analysis
von: Li, Xiang, et al.
Veröffentlicht: (2025)
von: Li, Xiang, et al.
Veröffentlicht: (2025)
Learning Sparsity for Effective and Efficient Music Performance Question Answering
von: Diao, Xingjian, et al.
Veröffentlicht: (2025)
von: Diao, Xingjian, et al.
Veröffentlicht: (2025)
RADD: Retrieval-Augmented Discrete Diffusion for Multi-Modal Knowledge Graph Completion
von: Niu, Guanglin, et al.
Veröffentlicht: (2026)
von: Niu, Guanglin, et al.
Veröffentlicht: (2026)
Towards Real-world Scenario: Imbalanced New Intent Discovery
von: Zhang, Shun, et al.
Veröffentlicht: (2024)
von: Zhang, Shun, et al.
Veröffentlicht: (2024)
DisastQA: A Comprehensive Benchmark for Evaluating Question Answering in Disaster Management
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
von: Chen, Zhitong, et al.
Veröffentlicht: (2026)
Accurate Table Question Answering with Accessible LLMs
von: Jiang, Yangfan, et al.
Veröffentlicht: (2026)
von: Jiang, Yangfan, et al.
Veröffentlicht: (2026)
ChartMind: A Comprehensive Benchmark for Complex Real-world Multimodal Chart Question Answering
von: Wei, Jingxuan, et al.
Veröffentlicht: (2025)
von: Wei, Jingxuan, et al.
Veröffentlicht: (2025)
KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
von: Chen, Junhao, et al.
Veröffentlicht: (2025)
HCT-QA: A Benchmark for Question Answering on Human-Centric Tables
von: Ahmad, Mohammad S., et al.
Veröffentlicht: (2025)
von: Ahmad, Mohammad S., et al.
Veröffentlicht: (2025)
A Hybrid Search for Complex Table Question Answering in Securities Report
von: Shirafuji, Daiki, et al.
Veröffentlicht: (2025)
von: Shirafuji, Daiki, et al.
Veröffentlicht: (2025)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
von: Li, Guangyao, et al.
Veröffentlicht: (2024)
von: Li, Guangyao, et al.
Veröffentlicht: (2024)
TQA-Bench: Evaluating LLMs for Multi-Table Question Answering with Scalable Context and Symbolic Extension
von: Qiu, Zipeng, et al.
Veröffentlicht: (2024)
von: Qiu, Zipeng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
M3TQA: Massively Multilingual Multitask Table Question Answering
von: Shu, Daixin, et al.
Veröffentlicht: (2025) -
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
von: Ji, Hangyuan, et al.
Veröffentlicht: (2024) -
IFEvalCode: Controlled Code Generation
von: Yang, Jian, et al.
Veröffentlicht: (2025) -
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
von: Hou, Xia, et al.
Veröffentlicht: (2024) -
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
von: Chai, Linzheng, et al.
Veröffentlicht: (2024)