Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lei, Fangyu, Meng, Jinxiang, Huang, Yiming, Chen, Tinghong, Zhang, Yun, He, Shizhu, Zhao, Jun, Liu, Kang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
S$^3$HQA: A Three-Stage Approach for Multi-hop Text-Table Hybrid Question Answering
par: Lei, Fangyu, et autres
Publié: (2023)
par: Lei, Fangyu, et autres
Publié: (2023)
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
par: Lei, Fangyu, et autres
Publié: (2023)
par: Lei, Fangyu, et autres
Publié: (2023)
GATE: Graph-based Adaptive Tool Evolution Across Diverse Tasks
par: Luo, Jianwen, et autres
Publié: (2025)
par: Luo, Jianwen, et autres
Publié: (2025)
MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models
par: Luo, Tongxu, et autres
Publié: (2024)
par: Luo, Tongxu, et autres
Publié: (2024)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
par: Tan, Yuqiao, et autres
Publié: (2025)
par: Tan, Yuqiao, et autres
Publié: (2025)
Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
par: Xu, Yao, et autres
Publié: (2025)
par: Xu, Yao, et autres
Publié: (2025)
Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning Tasks
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
BP4ER: Bootstrap Prompting for Explicit Reasoning in Medical Dialogue Generation
par: He, Yuhong, et autres
Publié: (2024)
par: He, Yuhong, et autres
Publié: (2024)
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
par: Huang, Yiming, et autres
Publié: (2024)
par: Huang, Yiming, et autres
Publié: (2024)
Reinforced Internal-External Knowledge Synergistic Reasoning for Efficient Adaptive Search Agent
par: Huang, Ziyang, et autres
Publié: (2025)
par: Huang, Ziyang, et autres
Publié: (2025)
Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
DAComp: Benchmarking Data Agents across the Full Data Intelligence Lifecycle
par: Lei, Fangyu, et autres
Publié: (2025)
par: Lei, Fangyu, et autres
Publié: (2025)
DV-World: Benchmarking Data Visualization Agents in Real-World Scenarios
par: Meng, Jinxiang, et autres
Publié: (2026)
par: Meng, Jinxiang, et autres
Publié: (2026)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
par: Tan, Yuqiao, et autres
Publié: (2025)
par: Tan, Yuqiao, et autres
Publié: (2025)
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
par: Liao, Huanxuan, et autres
Publié: (2026)
par: Liao, Huanxuan, et autres
Publié: (2026)
ControlLM: Crafting Diverse Personalities for Language Models
par: Weng, Yixuan, et autres
Publié: (2024)
par: Weng, Yixuan, et autres
Publié: (2024)
Explore Data Left Behind in Reinforcement Learning for Reasoning Language Models
par: Liu, Chenxi, et autres
Publié: (2025)
par: Liu, Chenxi, et autres
Publié: (2025)
SC-Taxo: Hierarchical Taxonomy Generation under Semantic Consistency Constraints using Large Language Models
par: Cai, Shiqiang, et autres
Publié: (2026)
par: Cai, Shiqiang, et autres
Publié: (2026)
Awakening Augmented Generation: Learning to Awaken Internal Knowledge of Large Language Models for Question Answering
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
par: Liao, Huanxuan, et autres
Publié: (2025)
par: Liao, Huanxuan, et autres
Publié: (2025)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
par: Tan, Yuqiao, et autres
Publié: (2026)
par: Tan, Yuqiao, et autres
Publié: (2026)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
par: Fu, Yuqian, et autres
Publié: (2025)
par: Fu, Yuqian, et autres
Publié: (2025)
Dynamic Parametric Retrieval Augmented Generation for Test-time Knowledge Enhancement
par: Tan, Yuqiao, et autres
Publié: (2025)
par: Tan, Yuqiao, et autres
Publié: (2025)
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
par: Sun, Wangtao, et autres
Publié: (2023)
par: Sun, Wangtao, et autres
Publié: (2023)
Find Parent then Label Children: A Two-stage Taxonomy Completion Method with Pre-trained Language Model
par: Xia, Fei, et autres
Publié: (2024)
par: Xia, Fei, et autres
Publié: (2024)
From Instance Training to Instruction Learning: Task Adapters Generation from Instructions
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
SEER: Facilitating Structured Reasoning and Explanation via Reinforcement Learning
par: Chen, Guoxin, et autres
Publié: (2024)
par: Chen, Guoxin, et autres
Publié: (2024)
Table-R1: Inference-Time Scaling for Table Reasoning
par: Yang, Zheyuan, et autres
Publié: (2025)
par: Yang, Zheyuan, et autres
Publié: (2025)
Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning
par: Wu, Tong, et autres
Publié: (2025)
par: Wu, Tong, et autres
Publié: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
Efficient Data Learning for Open Information Extraction with Pre-trained Language Models
par: Fan, Zhiyuan, et autres
Publié: (2023)
par: Fan, Zhiyuan, et autres
Publié: (2023)
Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding
par: Wang, Zilong, et autres
Publié: (2024)
par: Wang, Zilong, et autres
Publié: (2024)
Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning
par: Lyu, Chengqi, et autres
Publié: (2025)
par: Lyu, Chengqi, et autres
Publié: (2025)
Exploring Knowledge Conflicts for Faithful LLM Reasoning: Benchmark and Method
par: Zhao, Tianzhe, et autres
Publié: (2026)
par: Zhao, Tianzhe, et autres
Publié: (2026)
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
par: Liao, Huanxuan, et autres
Publié: (2025)
par: Liao, Huanxuan, et autres
Publié: (2025)
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
par: Jin, Rihui, et autres
Publié: (2025)
par: Jin, Rihui, et autres
Publié: (2025)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
Are Tools Always Beneficial? Learning to Invoke Tools Adaptively for Dual-Mode Multimodal LLM Reasoning
par: Ma, Qinghe, et autres
Publié: (2026)
par: Ma, Qinghe, et autres
Publié: (2026)
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
par: Sun, Zhenjie, et autres
Publié: (2025)
par: Sun, Zhenjie, et autres
Publié: (2025)
Documents similaires
-
S$^3$HQA: A Three-Stage Approach for Multi-hop Text-Table Hybrid Question Answering
par: Lei, Fangyu, et autres
Publié: (2023) -
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
par: Lei, Fangyu, et autres
Publié: (2023) -
GATE: Graph-based Adaptive Tool Evolution Across Diverse Tasks
par: Luo, Jianwen, et autres
Publié: (2025) -
MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models
par: Luo, Tongxu, et autres
Publié: (2024) -
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
par: Tan, Yuqiao, et autres
Publié: (2025)