MMTU: A Massive Multi-Task Table Understanding and Reasoning Benchmark
Fuente:
arXiv
Saved in:
| Main Authors: | Xing, Junjie, He, Yeye, Zhou, Mengyu, Dong, Haoyu, Han, Shi, Chen, Lingjiao, Zhang, Dongmei, Chaudhuri, Surajit, Jagadish, H. V. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Table-LLM-Specialist: Language Model Specialists for Tables using Iterative Generator-Validator Fine-tuning
by: Xing, Junjie, et al.
Published: (2024)
by: Xing, Junjie, et al.
Published: (2024)
Auto-Prep: Holistic Prediction of Data Preparation Steps for Self-Service Business Intelligence
by: Lai, Eugenie Y., et al.
Published: (2025)
by: Lai, Eugenie Y., et al.
Published: (2025)
Auto-Formula: Recommend Formulas in Spreadsheets using Contrastive Learning for Table Representations
by: Chen, Sibei, et al.
Published: (2024)
by: Chen, Sibei, et al.
Published: (2024)
Auto-Test: Learning Semantic-Domain Constraints for Unsupervised Error Detection in Tables
by: Chen, Qixu, et al.
Published: (2025)
by: Chen, Qixu, et al.
Published: (2025)
OpenForge: Probabilistic Metadata Integration
by: Cong, Tianji, et al.
Published: (2024)
by: Cong, Tianji, et al.
Published: (2024)
TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
by: He, Xinyi, et al.
Published: (2025)
by: He, Xinyi, et al.
Published: (2025)
Esc: An Early-stopping Checker for Budget-aware Index Tuning
by: Wang, Xiaoying, et al.
Published: (2025)
by: Wang, Xiaoying, et al.
Published: (2025)
Evaluating the Practical Effectiveness of LLM-Driven Index Tuning with Microsoft Database Tuning Advisor
by: Wang, Xiaoying, et al.
Published: (2026)
by: Wang, Xiaoying, et al.
Published: (2026)
Nexus: Inferring Join Graphs from Metadata Alone via Iterative Low-Rank Matrix Completion
by: Cong, Tianji, et al.
Published: (2026)
by: Cong, Tianji, et al.
Published: (2026)
Wii: Dynamic Budget Reallocation In Index Tuning
by: Wang, Xiaoying, et al.
Published: (2025)
by: Wang, Xiaoying, et al.
Published: (2025)
MINT: Multi-Vector Search Index Tuning
by: Zhu, Jiongli, et al.
Published: (2025)
by: Zhu, Jiongli, et al.
Published: (2025)
MMTS-BENCH: A Comprehensive Benchmark for Time Series Understanding and Reasoning
by: Yin, Yao, et al.
Published: (2026)
by: Yin, Yao, et al.
Published: (2026)
SMARTFEAT: Efficient Feature Construction through Feature-Level Foundation Model Interactions
by: Lin, Yin, et al.
Published: (2023)
by: Lin, Yin, et al.
Published: (2023)
Vision Language Models for Spreadsheet Understanding: Challenges and Opportunities
by: Xia, Shiyu, et al.
Published: (2024)
by: Xia, Shiyu, et al.
Published: (2024)
ConStruM: A Structure-Guided LLM Framework for Context-Aware Schema Matching
by: Chen, Houming, et al.
Published: (2026)
by: Chen, Houming, et al.
Published: (2026)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
by: Ma, Kaijing, et al.
Published: (2024)
by: Ma, Kaijing, et al.
Published: (2024)
Observatory: Characterizing Embeddings of Relational Tables
by: Cong, Tianji, et al.
Published: (2023)
by: Cong, Tianji, et al.
Published: (2023)
Chameleon: Foundation Models for Fairness-aware Multi-modal Data Augmentation to Enhance Coverage of Minorities
by: Erfanian, Mahdi, et al.
Published: (2024)
by: Erfanian, Mahdi, et al.
Published: (2024)
Table Meets LLM: Can Large Language Models Understand Structured Table Data? A Benchmark and Empirical Study
by: Sui, Yuan, et al.
Published: (2023)
by: Sui, Yuan, et al.
Published: (2023)
SEMA-SQL: Beyond Traditional Relational Querying with Large Language Models
by: Lin, Yin, et al.
Published: (2026)
by: Lin, Yin, et al.
Published: (2026)
ByteCard: Enhancing ByteDance's Data Warehouse with Learned Cardinality Estimation
by: Han, Yuxing, et al.
Published: (2024)
by: Han, Yuxing, et al.
Published: (2024)
Revisiting Task-Oriented Dataset Search in the Era of Large Language Models: Challenges, Benchmark, and Solution
by: Wei, Zixin, et al.
Published: (2025)
by: Wei, Zixin, et al.
Published: (2025)
Decomposition-Driven Multi-Table Retrieval and Reasoning for Numerical Question Answering
by: Luo, Feng, et al.
Published: (2026)
by: Luo, Feng, et al.
Published: (2026)
PRMB: Benchmarking Reward Models in Long-Horizon CBT-based Counseling Dialogue
by: Zhou, Yougen, et al.
Published: (2026)
by: Zhou, Yougen, et al.
Published: (2026)
TARGET: Benchmarking Table Retrieval for Generative Tasks
by: Ji, Xingyu, et al.
Published: (2025)
by: Ji, Xingyu, et al.
Published: (2025)
Qute: Towards Quantum-Native Database
by: Chen, Muzhi, et al.
Published: (2026)
by: Chen, Muzhi, et al.
Published: (2026)
SemBench: A Benchmark for Semantic Query Processing Engines
by: Lao, Jiale, et al.
Published: (2025)
by: Lao, Jiale, et al.
Published: (2025)
Filtered Approximate Nearest Neighbor Search: A Unified Benchmark and Systematic Experimental Study [Experiment, Analysis & Benchmark]
by: Shi, Jiayang, et al.
Published: (2025)
by: Shi, Jiayang, et al.
Published: (2025)
Can LLMs Clean Up Your Mess? A Survey of Application-Ready Data Preparation with LLMs
by: Zhou, Wei, et al.
Published: (2026)
by: Zhou, Wei, et al.
Published: (2026)
Schema-Aware Multi-Task Learning for Complex Text-to-SQL
by: Wu, Yangjun, et al.
Published: (2024)
by: Wu, Yangjun, et al.
Published: (2024)
LST-Bench: Benchmarking Log-Structured Tables in the Cloud
by: Camacho-Rodríguez, Jesús, et al.
Published: (2023)
by: Camacho-Rodríguez, Jesús, et al.
Published: (2023)
PARROT: A Benchmark for Evaluating LLMs in Cross-System SQL Translation
by: Zhou, Wei, et al.
Published: (2025)
by: Zhou, Wei, et al.
Published: (2025)
Dupin: A Parallel Framework for Densest Subgraph Discovery in Fraud Detection on Massive Graphs (Technical Report)
by: Jiang, Jiaxin, et al.
Published: (2025)
by: Jiang, Jiaxin, et al.
Published: (2025)
Benchmarking Table Extraction from Heterogeneous Scientific Extraction Documents
by: Soric, Marijan, et al.
Published: (2025)
by: Soric, Marijan, et al.
Published: (2025)
Modeling and Optimization for Massive Data Allocation in Database
by: Niu, Panpan, et al.
Published: (2026)
by: Niu, Panpan, et al.
Published: (2026)
Communication-Efficient Triangle Counting under Local Differential Privacy
by: Imola, Jacob, et al.
Published: (2021)
by: Imola, Jacob, et al.
Published: (2021)
Towards Universal Tabular Embeddings: A Benchmark Across Data Tasks
by: Vogel, Liane, et al.
Published: (2026)
by: Vogel, Liane, et al.
Published: (2026)
HES-SQL: Hybrid Reasoning for Efficient Text-to-SQL with Structural Skeleton Guidance
by: Qiu, Suming, et al.
Published: (2025)
by: Qiu, Suming, et al.
Published: (2025)
UniDataBench: Evaluating Data Analytics Agents Across Structured and Unstructured Data
by: Weng, Han, et al.
Published: (2025)
by: Weng, Han, et al.
Published: (2025)
Chipmink: Efficient Delta Identification for Massive Object Graph
by: Chockchowwat, Supawit, et al.
Published: (2025)
by: Chockchowwat, Supawit, et al.
Published: (2025)
Similar Items
-
Table-LLM-Specialist: Language Model Specialists for Tables using Iterative Generator-Validator Fine-tuning
by: Xing, Junjie, et al.
Published: (2024) -
Auto-Prep: Holistic Prediction of Data Preparation Steps for Self-Service Business Intelligence
by: Lai, Eugenie Y., et al.
Published: (2025) -
Auto-Formula: Recommend Formulas in Spreadsheets using Contrastive Learning for Table Representations
by: Chen, Sibei, et al.
Published: (2024) -
Auto-Test: Learning Semantic-Domain Constraints for Unsupervised Error Detection in Tables
by: Chen, Qixu, et al.
Published: (2025) -
OpenForge: Probabilistic Metadata Integration
by: Cong, Tianji, et al.
Published: (2024)