Learning When Not to Act: Mitigating Tool Abuse in Agentic Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Liuji, Tang, Dianxing, Shi, Xing, Chen, Dingshuo, Liu, Qiang, Wu, Shu, Wang, Liang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Graffe: Graph Representation Learning via Diffusion Probabilistic Models
by: Chen, Dingshuo, et al.
Published: (2025)
by: Chen, Dingshuo, et al.
Published: (2025)
EX-FEVER: A Dataset for Multi-hop Explainable Fact Verification
by: Ma, Huanhuan, et al.
Published: (2023)
by: Ma, Huanhuan, et al.
Published: (2023)
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
by: Xu, Siyuan, et al.
Published: (2026)
by: Xu, Siyuan, et al.
Published: (2026)
ToolBrain: A Flexible Reinforcement Learning Framework for Agentic Tools
by: Le, Quy Minh, et al.
Published: (2025)
by: Le, Quy Minh, et al.
Published: (2025)
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
by: Jiang, Dongfu, et al.
Published: (2025)
by: Jiang, Dongfu, et al.
Published: (2025)
Select Me! When You Need a Tool: A Black-box Text Attack on Tool Selection
by: Chen, Liuji, et al.
Published: (2025)
by: Chen, Liuji, et al.
Published: (2025)
Tool-Augmented Policy Optimization: Synergizing Reasoning and Adaptive Tool Use with Reinforcement Learning
by: Wu, Wenxun, et al.
Published: (2025)
by: Wu, Wenxun, et al.
Published: (2025)
Learning When to Act: Interval-Aware Reinforcement Learning with Predictive Temporal Structure
by: Di Gioia, Davide
Published: (2026)
by: Di Gioia, Davide
Published: (2026)
Agentic Reasoning and Tool Integration for LLMs via Reinforcement Learning
by: Singh, Joykirat, et al.
Published: (2025)
by: Singh, Joykirat, et al.
Published: (2025)
Gradient Coupling: The Hidden Barrier to Generalization in Agentic Reinforcement Learning
by: Liu, Jingyu, et al.
Published: (2025)
by: Liu, Jingyu, et al.
Published: (2025)
Tools as Continuous Flow for Evolving Agentic Reasoning
by: Huang, Tairan, et al.
Published: (2026)
by: Huang, Tairan, et al.
Published: (2026)
Act Wisely: Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models
by: Yan, Shilin, et al.
Published: (2026)
by: Yan, Shilin, et al.
Published: (2026)
Beyond Efficiency: Molecular Data Pruning for Enhanced Generalization
by: Chen, Dingshuo, et al.
Published: (2024)
by: Chen, Dingshuo, et al.
Published: (2024)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
by: Xu, Ran, et al.
Published: (2025)
by: Xu, Ran, et al.
Published: (2025)
Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts
by: Zheng, Haizhong, et al.
Published: (2025)
by: Zheng, Haizhong, et al.
Published: (2025)
Teaching RL Agents to Act Better: VLM as Action Advisor for Online Reinforcement Learning
by: Wu, Xiefeng, et al.
Published: (2025)
by: Wu, Xiefeng, et al.
Published: (2025)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
by: Lu, Meng, et al.
Published: (2025)
by: Lu, Meng, et al.
Published: (2025)
CM2: Reinforcement Learning with Checklist Rewards for Multi-Turn and Multi-Step Agentic Tool Use
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
by: Wang, Jianing, et al.
Published: (2026)
by: Wang, Jianing, et al.
Published: (2026)
6GAgentGym: Tool Use, Data Synthesis, and Agentic Learning for Network Management
by: Chen, Jiao, et al.
Published: (2026)
by: Chen, Jiao, et al.
Published: (2026)
AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs
by: Zheng, Haizhong, et al.
Published: (2026)
by: Zheng, Haizhong, et al.
Published: (2026)
Scheduling Your LLM Reinforcement Learning with Reasoning Trees
by: Wang, Hong, et al.
Published: (2025)
by: Wang, Hong, et al.
Published: (2025)
FactGuard: Agentic Video Misinformation Detection via Reinforcement Learning
by: Li, Zehao, et al.
Published: (2026)
by: Li, Zehao, et al.
Published: (2026)
Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning
by: Pan, Haolin, et al.
Published: (2025)
by: Pan, Haolin, et al.
Published: (2025)
ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning
by: Wang, Xiaoxuan, et al.
Published: (2026)
by: Wang, Xiaoxuan, et al.
Published: (2026)
MolAct: An Agentic RL Framework for Molecular Editing and Property Optimization
by: Yang, Zhuo, et al.
Published: (2025)
by: Yang, Zhuo, et al.
Published: (2025)
DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents
by: Ning, Yansong, et al.
Published: (2025)
by: Ning, Yansong, et al.
Published: (2025)
ProCeedRL: Process Critic with Exploratory Demonstration Reinforcement Learning for LLM Agentic Reasoning
by: Gao, Jingyue, et al.
Published: (2026)
by: Gao, Jingyue, et al.
Published: (2026)
When should I search more: Adaptive Complex Query Optimization with Reinforcement Learning
by: Wen, Wei, et al.
Published: (2026)
by: Wen, Wei, et al.
Published: (2026)
Doctor-R1: Mastering Clinical Inquiry with Experiential Agentic Reinforcement Learning
by: Lai, Yunghwei, et al.
Published: (2025)
by: Lai, Yunghwei, et al.
Published: (2025)
ProAct: Agentic Lookahead in Interactive Environments
by: Yu, Yangbin, et al.
Published: (2026)
by: Yu, Yangbin, et al.
Published: (2026)
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
by: Zhang, Guibin, et al.
Published: (2025)
by: Zhang, Guibin, et al.
Published: (2025)
AgenTRIM: Tool Risk Mitigation for Agentic AI
by: Betser, Roy, et al.
Published: (2026)
by: Betser, Roy, et al.
Published: (2026)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
by: Yang, Tong, et al.
Published: (2026)
by: Yang, Tong, et al.
Published: (2026)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
by: He, Pengfei, et al.
Published: (2025)
by: He, Pengfei, et al.
Published: (2025)
When Agents Fail to Act: A Diagnostic Framework for Tool Invocation Reliability in Multi-Agent LLM Systems
by: Huang, Donghao, et al.
Published: (2026)
by: Huang, Donghao, et al.
Published: (2026)
Route-Induced Density and Stability (RIDE): Controlled Intervention and Mechanism Analysis of Routing-Style Meta Prompts on LLM Internal States
by: Zhang, Dianxing, et al.
Published: (2026)
by: Zhang, Dianxing, et al.
Published: (2026)
Self-Distilled Agentic Reinforcement Learning
by: Lu, Zhengxi, et al.
Published: (2026)
by: Lu, Zhengxi, et al.
Published: (2026)
Speculative Sampling with Reinforcement Learning
by: Wang, Chenan, et al.
Published: (2026)
by: Wang, Chenan, et al.
Published: (2026)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
by: Liu, Dongyi, et al.
Published: (2026)
by: Liu, Dongyi, et al.
Published: (2026)
Similar Items
-
Graffe: Graph Representation Learning via Diffusion Probabilistic Models
by: Chen, Dingshuo, et al.
Published: (2025) -
EX-FEVER: A Dataset for Multi-hop Explainable Fact Verification
by: Ma, Huanhuan, et al.
Published: (2023) -
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
by: Xu, Siyuan, et al.
Published: (2026) -
ToolBrain: A Flexible Reinforcement Learning Framework for Agentic Tools
by: Le, Quy Minh, et al.
Published: (2025) -
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
by: Jiang, Dongfu, et al.
Published: (2025)