Reasoning and Tool-use Compete in Agentic RL:From Quantifying Interference to Disentangled Tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Yu, Yi, Mingyang, Li, Xiuyu, Fan, Ju, Jiang, Fuxin, Chen, Binbin, Li, Peng, Song, Jie, Zhang, Tieying |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DeepPrep: An LLM-Powered Agentic System for Autonomous Data Preparation
von: Fan, Meihao, et al.
Veröffentlicht: (2026)
von: Fan, Meihao, et al.
Veröffentlicht: (2026)
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
von: Lin, Huawei, et al.
Veröffentlicht: (2026)
von: Lin, Huawei, et al.
Veröffentlicht: (2026)
ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment
von: Li, Xiuyu, et al.
Veröffentlicht: (2026)
von: Li, Xiuyu, et al.
Veröffentlicht: (2026)
Epistemic Gain, Aleatoric Cost: Uncertainty Decomposition in Multi-Agent Debate for Math Reasoning
von: Qiao, Dan, et al.
Veröffentlicht: (2026)
von: Qiao, Dan, et al.
Veröffentlicht: (2026)
HAGE: Harnessing Agentic Memory via RL-Driven Weighted Graph Evolution
von: Jiang, Dongming, et al.
Veröffentlicht: (2026)
von: Jiang, Dongming, et al.
Veröffentlicht: (2026)
OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner
von: Jiang, Haoyang, et al.
Veröffentlicht: (2026)
von: Jiang, Haoyang, et al.
Veröffentlicht: (2026)
RAGEN-2: Reasoning Collapse in Agentic RL
von: Wang, Zihan, et al.
Veröffentlicht: (2026)
von: Wang, Zihan, et al.
Veröffentlicht: (2026)
DBAIOps: A Reasoning LLM-Enhanced Database Operation and Maintenance System using Knowledge Graphs
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
AdaReasoner: Dynamic Tool Orchestration for Iterative Visual Reasoning
von: Song, Mingyang, et al.
Veröffentlicht: (2026)
von: Song, Mingyang, et al.
Veröffentlicht: (2026)
Disentangled Parameter-Efficient Linear Model for Long-Term Time Series Forecasting
von: Zhao, Yuang, et al.
Veröffentlicht: (2024)
von: Zhao, Yuang, et al.
Veröffentlicht: (2024)
Reward-SQL: Boosting Text-to-SQL via Stepwise Reasoning and Process-Supervised Rewards
von: Zhang, Yuxin, et al.
Veröffentlicht: (2025)
von: Zhang, Yuxin, et al.
Veröffentlicht: (2025)
Sponge Tool Attack: Stealthy Denial-of-Efficiency against Tool-Augmented Agentic Reasoning
von: Li, Qi, et al.
Veröffentlicht: (2026)
von: Li, Qi, et al.
Veröffentlicht: (2026)
ToRL: Scaling Tool-Integrated RL
von: Li, Xuefeng, et al.
Veröffentlicht: (2025)
von: Li, Xuefeng, et al.
Veröffentlicht: (2025)
Learning to Communicate Through Implicit Communication Channels
von: Wang, Han, et al.
Veröffentlicht: (2024)
von: Wang, Han, et al.
Veröffentlicht: (2024)
Tools as Continuous Flow for Evolving Agentic Reasoning
von: Huang, Tairan, et al.
Veröffentlicht: (2026)
von: Huang, Tairan, et al.
Veröffentlicht: (2026)
PyVision-RL: Forging Open Agentic Vision Models via RL
von: Zhao, Shitian, et al.
Veröffentlicht: (2026)
von: Zhao, Shitian, et al.
Veröffentlicht: (2026)
ASTER: Agentic Scaling with Tool-integrated Extended Reasoning
von: Zhang, Xuqin, et al.
Veröffentlicht: (2026)
von: Zhang, Xuqin, et al.
Veröffentlicht: (2026)
Online Ensemble Transformer for Accurate Cloud Workload Forecasting in Predictive Auto-Scaling
von: Chen, Jiadong, et al.
Veröffentlicht: (2025)
von: Chen, Jiadong, et al.
Veröffentlicht: (2025)
Fremer: Lightweight and Effective Frequency Transformer for Workload Forecasting in Cloud Services
von: Chen, Jiadong, et al.
Veröffentlicht: (2025)
von: Chen, Jiadong, et al.
Veröffentlicht: (2025)
ATFNet: Adaptive Time-Frequency Ensembled Network for Long-term Time Series Forecasting
von: Ye, Hengyu, et al.
Veröffentlicht: (2024)
von: Ye, Hengyu, et al.
Veröffentlicht: (2024)
On Effectiveness and Efficiency of Agentic Tool-calling and RL Training
von: Liu, Tong, et al.
Veröffentlicht: (2026)
von: Liu, Tong, et al.
Veröffentlicht: (2026)
Comparing the Decision-Making Mechanisms by Transformers and CNNs via Explanation Methods
von: Jiang, Mingqi, et al.
Veröffentlicht: (2022)
von: Jiang, Mingqi, et al.
Veröffentlicht: (2022)
Jahn–Teller Effect Induces Exchange Bias in Ultrasmall Magnetite
von: Mengmeng Li, et al.
Veröffentlicht: (2026)
von: Mengmeng Li, et al.
Veröffentlicht: (2026)
Jahn–Teller Effect Induces Exchange Bias in Ultrasmall Magnetite
von: Mengmeng Li, et al.
Veröffentlicht: (2026)
von: Mengmeng Li, et al.
Veröffentlicht: (2026)
RecThinker: An Agentic Framework for Tool-Augmented Reasoning in Recommendation
von: Zhang, Haobo, et al.
Veröffentlicht: (2026)
von: Zhang, Haobo, et al.
Veröffentlicht: (2026)
ADEPT: RL-Aligned Agentic Decoding of Emotion via Evidence Probing Tools -- From Consensus Learning to Ambiguity-Driven Emotion Reasoning
von: Sun, Esther, et al.
Veröffentlicht: (2026)
von: Sun, Esther, et al.
Veröffentlicht: (2026)
Object Dynamics Modeling with Hierarchical Point Cloud-based Representations
von: Kim, Chanho, et al.
Veröffentlicht: (2024)
von: Kim, Chanho, et al.
Veröffentlicht: (2024)
Point-based Instance Completion with Scene Constraints
von: Khademi, Wesley, et al.
Veröffentlicht: (2025)
von: Khademi, Wesley, et al.
Veröffentlicht: (2025)
MPRM: A Markov Path-based Rule Miner for Efficient and Interpretable Knowledge Graph Reasoning
von: Li, Mingyang, et al.
Veröffentlicht: (2025)
von: Li, Mingyang, et al.
Veröffentlicht: (2025)
Turn-PPO: Turn-Level Advantage Estimation with PPO for Improved Multi-Turn RL in Agentic LLMs
von: Li, Junbo, et al.
Veröffentlicht: (2025)
von: Li, Junbo, et al.
Veröffentlicht: (2025)
VideoThinker: Building Agentic VideoLLMs with LLM-Guided Tool Reasoning
von: Li, Chenglin, et al.
Veröffentlicht: (2026)
von: Li, Chenglin, et al.
Veröffentlicht: (2026)
FastCuRL: Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient Training R1-like Reasoning Models
von: Song, Mingyang, et al.
Veröffentlicht: (2025)
von: Song, Mingyang, et al.
Veröffentlicht: (2025)
Q-Router: Agentic Video Quality Assessment with Expert Model Routing and Artifact Localization
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
von: Xing, Shuo, et al.
Veröffentlicht: (2025)
Reflect-RL: Two-Player Online RL Fine-Tuning for LMs
von: Zhou, Runlong, et al.
Veröffentlicht: (2024)
von: Zhou, Runlong, et al.
Veröffentlicht: (2024)
Multi-Scale Accent Modeling and Disentangling for Multi-Speaker Multi-Accent Text-to-Speech Synthesis
von: Zhou, Xuehao, et al.
Veröffentlicht: (2024)
von: Zhou, Xuehao, et al.
Veröffentlicht: (2024)
Molecular Lead Optimization via Agentic Tool Planning
von: Li, Lingxiao, et al.
Veröffentlicht: (2026)
von: Li, Lingxiao, et al.
Veröffentlicht: (2026)
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
von: Wu, Junde, et al.
Veröffentlicht: (2025)
von: Wu, Junde, et al.
Veröffentlicht: (2025)
Ultra‐Flat Broadband Low‐Noise Frequency Comb in a Fiber Fabry‐Perot Resonator
von: Tieying Li, et al.
Veröffentlicht: (2025)
von: Tieying Li, et al.
Veröffentlicht: (2025)
Dynamic Dual-Granularity Skill Bank for Agentic RL
von: Tu, Songjun, et al.
Veröffentlicht: (2026)
von: Tu, Songjun, et al.
Veröffentlicht: (2026)
MarsRL: Advancing Multi-Agent Reasoning System via Reinforcement Learning with Agentic Pipeline Parallelism
von: Liu, Shulin, et al.
Veröffentlicht: (2025)
von: Liu, Shulin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DeepPrep: An LLM-Powered Agentic System for Autonomous Data Preparation
von: Fan, Meihao, et al.
Veröffentlicht: (2026) -
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
von: Lin, Huawei, et al.
Veröffentlicht: (2026) -
ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment
von: Li, Xiuyu, et al.
Veröffentlicht: (2026) -
Epistemic Gain, Aleatoric Cost: Uncertainty Decomposition in Multi-Agent Debate for Math Reasoning
von: Qiao, Dan, et al.
Veröffentlicht: (2026) -
HAGE: Harnessing Agentic Memory via RL-Driven Weighted Graph Evolution
von: Jiang, Dongming, et al.
Veröffentlicht: (2026)