TableVista: Benchmarking Multimodal Table Reasoning under Visual and Structural Complexity
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Zheyuan, Shang, Liqiang, Chen, Junjie, Yang, Xun, Xu, Chenglong, Yuan, Bo, Jiao, Chenyuan, Sun, Yaoru, Zhao, Yilun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Table-R1: Inference-Time Scaling for Table Reasoning
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
HG2P: Hippocampus-inspired High-reward Graph and Model-Free Q-Gradient Penalty for Path Planning and Motion Control
di: Wang, Haoran, et al.
Pubblicazione: (2024)
di: Wang, Haoran, et al.
Pubblicazione: (2024)
Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning
di: Yang, Bohao, et al.
Pubblicazione: (2025)
di: Yang, Bohao, et al.
Pubblicazione: (2025)
Compress image to patches for Vision Transformer
di: Zhao, Xinfeng, et al.
Pubblicazione: (2025)
di: Zhao, Xinfeng, et al.
Pubblicazione: (2025)
Exploring Image Representation with Decoupled Classical Visual Descriptors
di: Qu, Chenyuan, et al.
Pubblicazione: (2025)
di: Qu, Chenyuan, et al.
Pubblicazione: (2025)
Visual-TableQA: Open-Domain Benchmark for Reasoning over Table Images
di: Lompo, Boammani Aser, et al.
Pubblicazione: (2025)
di: Lompo, Boammani Aser, et al.
Pubblicazione: (2025)
VideoVista: A Versatile Benchmark for Video Understanding and Reasoning
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
di: Wu, Xianjie, et al.
Pubblicazione: (2024)
di: Wu, Xianjie, et al.
Pubblicazione: (2024)
Benchmarking and Evolving Reason-Reflect-Rectify for Reflective Visual Generation
di: Wang, Junjie, et al.
Pubblicazione: (2026)
di: Wang, Junjie, et al.
Pubblicazione: (2026)
Can LLMs Generate High-Quality Test Cases for Algorithm Problems? TestCase-Eval: A Systematic Evaluation of Fault Coverage and Exposure
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
di: Yang, Zheyuan, et al.
Pubblicazione: (2025)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
di: Nie, Yiqi, et al.
Pubblicazione: (2026)
di: Nie, Yiqi, et al.
Pubblicazione: (2026)
CVBench: Benchmarking Cross-Video Synergies for Complex Multimodal Reasoning
di: Zhu, Nannan, et al.
Pubblicazione: (2025)
di: Zhu, Nannan, et al.
Pubblicazione: (2025)
Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency
di: Wang, Zhikai, et al.
Pubblicazione: (2025)
di: Wang, Zhikai, et al.
Pubblicazione: (2025)
Beyond Embeddings: The Promise of Visual Table in Visual Reasoning
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
OmniSch: A Multimodal PCB Schematic Benchmark For Structured Diagram Visual Reasoning
di: Lu, Taiting, et al.
Pubblicazione: (2026)
di: Lu, Taiting, et al.
Pubblicazione: (2026)
GeoVista: Web-Augmented Agentic Visual Reasoning for Geolocalization
di: Wang, Yikun, et al.
Pubblicazione: (2025)
di: Wang, Yikun, et al.
Pubblicazione: (2025)
MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts
di: Lu, Pan, et al.
Pubblicazione: (2023)
di: Lu, Pan, et al.
Pubblicazione: (2023)
SpaceVista: All-Scale Visual Spatial Reasoning from mm to km
di: Sun, Peiwen, et al.
Pubblicazione: (2025)
di: Sun, Peiwen, et al.
Pubblicazione: (2025)
MiMoTable: A Multi-scale Spreadsheet Benchmark with Meta Operations for Table Reasoning
di: Li, Zheng, et al.
Pubblicazione: (2024)
di: Li, Zheng, et al.
Pubblicazione: (2024)
TOMATO: Assessing Visual Temporal Reasoning Capabilities in Multimodal Foundation Models
di: Shangguan, Ziyao, et al.
Pubblicazione: (2024)
di: Shangguan, Ziyao, et al.
Pubblicazione: (2024)
ChartBench: A Benchmark for Complex Visual Reasoning in Charts
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2023)
di: Xu, Zhengzhuo, et al.
Pubblicazione: (2023)
Visual Reasoning Tracer: Object-Level Grounded Reasoning Benchmark
di: Yuan, Haobo, et al.
Pubblicazione: (2025)
di: Yuan, Haobo, et al.
Pubblicazione: (2025)
GeoVista: Visually Grounded Active Perception for Ultra-High-Resolution Remote Sensing Understanding
di: Zhu, Jiashun, et al.
Pubblicazione: (2026)
di: Zhu, Jiashun, et al.
Pubblicazione: (2026)
MagiC: Evaluating Multimodal Cognition Toward Grounded Visual Reasoning
di: Wu, Chengfei, et al.
Pubblicazione: (2025)
di: Wu, Chengfei, et al.
Pubblicazione: (2025)
Benchmarking and Bridging Emotion Conflicts for Multimodal Emotion Reasoning
di: Han, Zhiyuan, et al.
Pubblicazione: (2025)
di: Han, Zhiyuan, et al.
Pubblicazione: (2025)
VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity
di: Bi, Jing, et al.
Pubblicazione: (2025)
di: Bi, Jing, et al.
Pubblicazione: (2025)
Describe-then-Reason: Improving Multimodal Mathematical Reasoning through Visual Comprehension Training
di: Jia, Mengzhao, et al.
Pubblicazione: (2024)
di: Jia, Mengzhao, et al.
Pubblicazione: (2024)
TableEval: A Real-World Benchmark for Complex, Multilingual, and Multi-Structured Table Question Answering
di: Zhu, Junnan, et al.
Pubblicazione: (2025)
di: Zhu, Junnan, et al.
Pubblicazione: (2025)
MindJourney: Test-Time Scaling with World Models for Spatial Reasoning
di: Yang, Yuncong, et al.
Pubblicazione: (2025)
di: Yang, Yuncong, et al.
Pubblicazione: (2025)
AgentVista: Evaluating Multimodal Agents in Ultra-Challenging Realistic Visual Scenarios
di: Su, Zhaochen, et al.
Pubblicazione: (2026)
di: Su, Zhaochen, et al.
Pubblicazione: (2026)
From Reasoning to Pixels: Benchmarking the Alignment Gap in Unified Multimodal Models
di: Yang, Cheng, et al.
Pubblicazione: (2026)
di: Yang, Cheng, et al.
Pubblicazione: (2026)
DentalGPT: Incentivizing Multimodal Complex Reasoning in Dentistry
di: Cai, Zhenyang, et al.
Pubblicazione: (2025)
di: Cai, Zhenyang, et al.
Pubblicazione: (2025)
RAVENEA: A Benchmark for Multimodal Retrieval-Augmented Visual Culture Understanding
di: Li, Jiaang, et al.
Pubblicazione: (2025)
di: Li, Jiaang, et al.
Pubblicazione: (2025)
VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
MM-CoT:A Benchmark for Probing Visual Chain-of-Thought Reasoning in Multimodal Models
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks
di: Zhang, Lei, et al.
Pubblicazione: (2025)
di: Zhang, Lei, et al.
Pubblicazione: (2025)
Multimodal Inconsistency Reasoning (MMIR): A New Benchmark for Multimodal Reasoning Models
di: Yan, Qianqi, et al.
Pubblicazione: (2025)
di: Yan, Qianqi, et al.
Pubblicazione: (2025)
Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding
di: Wang, Zilong, et al.
Pubblicazione: (2024)
di: Wang, Zilong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Table-R1: Inference-Time Scaling for Table Reasoning
di: Yang, Zheyuan, et al.
Pubblicazione: (2025) -
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
di: Xiao, Yijia, et al.
Pubblicazione: (2024) -
HG2P: Hippocampus-inspired High-reward Graph and Model-Free Q-Gradient Penalty for Path Planning and Motion Control
di: Wang, Haoran, et al.
Pubblicazione: (2024) -
Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning
di: Yang, Bohao, et al.
Pubblicazione: (2025) -
Compress image to patches for Vision Transformer
di: Zhao, Xinfeng, et al.
Pubblicazione: (2025)