TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Saisai, Huang, Qingyi, Yuan, Jing, Zha, Liangyu, Tang, Kai, Yang, Yuhang, Wang, Ning, Wei, Yucheng, Li, Liyao, Ye, Wentao, Chen, Hao, Zhang, Tao, Zhou, Junlin, Wang, Haobo, Chen, Gang, Zhao, Junbo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TableGPT2: A Large Multimodal Model with Tabular Data Integration
by: Su, Aofeng, et al.
Published: (2024)
by: Su, Aofeng, et al.
Published: (2024)
Data Contamination Calibration for Black-box LLMs
by: Ye, Wentao, et al.
Published: (2024)
by: Ye, Wentao, et al.
Published: (2024)
Toward Real-World Table Agents: Capabilities, Workflows, and Design Principles for LLM-based Table Intelligence
by: Tian, Jiaming, et al.
Published: (2025)
by: Tian, Jiaming, et al.
Published: (2025)
Towards Cross-Table Masked Pretraining for Web Data Mining
by: Ye, Chao, et al.
Published: (2023)
by: Ye, Chao, et al.
Published: (2023)
TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
by: Yang, Shenzhi, et al.
Published: (2025)
by: Yang, Shenzhi, et al.
Published: (2025)
SPA++: Generalized Graph Spectral Alignment for Versatile Domain Adaptation
by: Xiao, Zhiqing, et al.
Published: (2025)
by: Xiao, Zhiqing, et al.
Published: (2025)
RealHiTBench: A Comprehensive Realistic Hierarchical Table Benchmark for Evaluating LLM-Based Table Analysis
by: Wu, Pengzuo, et al.
Published: (2025)
by: Wu, Pengzuo, et al.
Published: (2025)
Navigate Complex Physical Worlds via Geometrically Constrained LLM
by: Huang, Yongqiang, et al.
Published: (2024)
by: Huang, Yongqiang, et al.
Published: (2024)
Table as a Modality for Large Language Models
by: Li, Liyao, et al.
Published: (2025)
by: Li, Liyao, et al.
Published: (2025)
An Invariant Latent Space Perspective on Language Model Inversion
by: Ye, Wentao, et al.
Published: (2025)
by: Ye, Wentao, et al.
Published: (2025)
LoongRL: Reinforcement Learning for Advanced Reasoning over Long Contexts
by: Wang, Siyuan, et al.
Published: (2025)
by: Wang, Siyuan, et al.
Published: (2025)
S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models
by: Dai, Muzhi, et al.
Published: (2025)
by: Dai, Muzhi, et al.
Published: (2025)
CYCLE-INSTRUCT: Fully Seed-Free Instruction Tuning via Dual Self-Training and Cycle Consistency
by: Shen, Zhanming, et al.
Published: (2025)
by: Shen, Zhanming, et al.
Published: (2025)
DeltaMem: Towards Agentic Memory Management via Reinforcement Learning
by: Zhang, Qi, et al.
Published: (2026)
by: Zhang, Qi, et al.
Published: (2026)
On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey
by: Long, Lin, et al.
Published: (2024)
by: Long, Lin, et al.
Published: (2024)
Towards Robust Incremental Learning under Ambiguous Supervision
by: Wang, Rui, et al.
Published: (2025)
by: Wang, Rui, et al.
Published: (2025)
Stable Reinforcement Learning for Efficient Reasoning
by: Dai, Muzhi, et al.
Published: (2025)
by: Dai, Muzhi, et al.
Published: (2025)
R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning
by: Zhao, Qingfei, et al.
Published: (2025)
by: Zhao, Qingfei, et al.
Published: (2025)
Steady-State Error Compensation for Reinforcement Learning with Quadratic Rewards
by: Wang, Liyao, et al.
Published: (2024)
by: Wang, Liyao, et al.
Published: (2024)
Context matters: The interactive effect of introvert–extrovert personality traits and object valence on object‐based attention
by: Saisai Hu, et al.
Published: (2024)
by: Saisai Hu, et al.
Published: (2024)
Can LLMs Learn to Reason Robustly under Noisy Supervision?
by: Yang, Shenzhi, et al.
Published: (2026)
by: Yang, Shenzhi, et al.
Published: (2026)
A Syllogistic Probe: Tracing the Evolution of Logic Reasoning in Large Language Models
by: Zang, Zhengqing, et al.
Published: (2026)
by: Zang, Zhengqing, et al.
Published: (2026)
Advancing Plant Microbiome Research Through Host DNA Depletion Techniques
by: Yao Wang, et al.
Published: (2025)
by: Yao Wang, et al.
Published: (2025)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
by: Wu, Da, et al.
Published: (2023)
by: Wu, Da, et al.
Published: (2023)
Reinforcing Numerical Reasoning in LLMs for Tabular Prediction via Structural Priors
by: Cai, Pengxiang, et al.
Published: (2025)
by: Cai, Pengxiang, et al.
Published: (2025)
Can ChatGPT Overcome Behavioral Biases in the Financial Sector? Classify-and-Rethink: Multi-Step Zero-Shot Reasoning in the Gold Investment
by: Liu, Shuoling, et al.
Published: (2024)
by: Liu, Shuoling, et al.
Published: (2024)
AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
by: Chen, Yang, et al.
Published: (2025)
by: Chen, Yang, et al.
Published: (2025)
Salvianolic Acid B Regulates Intestinal Bacterial/Endotoxin Translocation After Intestinal Ischemia/Reperfusion Injury in Rats Through TLR4/MyD88/MAPK Pathway
by: Rushan Fei, et al.
Published: (2025)
by: Rushan Fei, et al.
Published: (2025)
FastBUS: A Fast Bayesian Framework for Unified Weakly-Supervised Learning
by: Wang, Ziquan, et al.
Published: (2026)
by: Wang, Ziquan, et al.
Published: (2026)
Harnessing Feature Resonance under Arbitrary Target Alignment for Out-of-Distribution Node Detection
by: Yang, Shenzhi, et al.
Published: (2025)
by: Yang, Shenzhi, et al.
Published: (2025)
RECOST: External Knowledge Guided Data-efficient Instruction Tuning
by: Zhang, Qi, et al.
Published: (2024)
by: Zhang, Qi, et al.
Published: (2024)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
by: Chen, Hao, et al.
Published: (2026)
by: Chen, Hao, et al.
Published: (2026)
GRACE: Estimating Geometry-level 3D Human-Scene Contact from 2D Images
by: Wang, Chengfeng, et al.
Published: (2025)
by: Wang, Chengfeng, et al.
Published: (2025)
FLaG: Fine-Grained Latent Grouping for Hallucination Detection
by: Ye, Wentao, et al.
Published: (2026)
by: Ye, Wentao, et al.
Published: (2026)
Navigating User Experience of ChatGPT-based Conversational Recommender Systems: The Effects of Prompt Guidance and Recommendation Domain
by: Zhang, Yizhe, et al.
Published: (2024)
by: Zhang, Yizhe, et al.
Published: (2024)
Free‐Radical Polymerization Induced Grafting‐to of Polymer Chains onto Aluminum Nanoparticles†
by: Panqi Sun, et al.
Published: (2024)
by: Panqi Sun, et al.
Published: (2024)
Consensus Based Stochastic Control
by: Lyu, Liyao, et al.
Published: (2025)
by: Lyu, Liyao, et al.
Published: (2025)
RoboGPT-R1: Enhancing Robot Planning with Reinforcement Learning
by: Liu, Jinrui, et al.
Published: (2025)
by: Liu, Jinrui, et al.
Published: (2025)
FlowBench: Revisiting and Benchmarking Workflow-Guided Planning for LLM-based Agents
by: Xiao, Ruixuan, et al.
Published: (2024)
by: Xiao, Ruixuan, et al.
Published: (2024)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
by: Luo, Yang, et al.
Published: (2025)
by: Luo, Yang, et al.
Published: (2025)
Similar Items
-
TableGPT2: A Large Multimodal Model with Tabular Data Integration
by: Su, Aofeng, et al.
Published: (2024) -
Data Contamination Calibration for Black-box LLMs
by: Ye, Wentao, et al.
Published: (2024) -
Toward Real-World Table Agents: Capabilities, Workflows, and Design Principles for LLM-based Table Intelligence
by: Tian, Jiaming, et al.
Published: (2025) -
Towards Cross-Table Masked Pretraining for Web Data Mining
by: Ye, Chao, et al.
Published: (2023) -
TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
by: Yang, Shenzhi, et al.
Published: (2025)