ToolRLA: Multiplicative Reward Decomposition for Tool-Integrated Agents
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Liu, Pengbo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Guided by Trajectories: Repairing and Rewarding Tool-Use Trajectories for Tool-Integrated Reasoning
par: Gong, Siyu, et autres
Publié: (2026)
par: Gong, Siyu, et autres
Publié: (2026)
ToolPRMBench: Evaluating and Advancing Process Reward Models for Tool-using Agents
par: Li, Dawei, et autres
Publié: (2026)
par: Li, Dawei, et autres
Publié: (2026)
ToolRM: Towards Agentic Tool-Use Reward Modeling
par: Li, Renhao, et autres
Publié: (2025)
par: Li, Renhao, et autres
Publié: (2025)
Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration
par: Modecrua, Wachiravit, et autres
Publié: (2026)
par: Modecrua, Wachiravit, et autres
Publié: (2026)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
par: Ding, Keyan, et autres
Publié: (2025)
par: Ding, Keyan, et autres
Publié: (2025)
Reward Hacking Benchmark: Measuring Exploits in LLM Agents with Tool Use
par: Thaman, Kunvar
Publié: (2026)
par: Thaman, Kunvar
Publié: (2026)
ToolRL: Reward is All Tool Learning Needs
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation
par: Hou, Ruihui, et autres
Publié: (2026)
par: Hou, Ruihui, et autres
Publié: (2026)
Small Model as Master Orchestrator: Learning Unified Agent-Tool Orchestration with Parallel Subtask Decomposition
par: Yuan, Wenzhen, et autres
Publié: (2026)
par: Yuan, Wenzhen, et autres
Publié: (2026)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
par: Huang, Xu, et autres
Publié: (2025)
par: Huang, Xu, et autres
Publié: (2025)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
par: Zhang, Situo, et autres
Publié: (2026)
par: Zhang, Situo, et autres
Publié: (2026)
Tool-Planner: Task Planning with Clusters across Multiple Tools
par: Liu, Yanming, et autres
Publié: (2024)
par: Liu, Yanming, et autres
Publié: (2024)
ToolFuzz -- Automated Agent Tool Testing
par: Milev, Ivan, et autres
Publié: (2025)
par: Milev, Ivan, et autres
Publié: (2025)
ET-Agent: Incentivizing Effective Tool-Integrated Reasoning Agent via Behavior Calibration
par: Chen, Yifei, et autres
Publié: (2026)
par: Chen, Yifei, et autres
Publié: (2026)
Learning to Rewrite Tool Descriptions for Reliable LLM-Agent Tool Use
par: Guo, Ruocheng, et autres
Publié: (2026)
par: Guo, Ruocheng, et autres
Publié: (2026)
AutoTool: Efficient Tool Selection for Large Language Model Agents
par: Jia, Jingyi, et autres
Publié: (2025)
par: Jia, Jingyi, et autres
Publié: (2025)
RC-GRPO: Reward-Conditioned Group Relative Policy Optimization for Multi-Turn Tool Calling Agents
par: Zhong, Haitian, et autres
Publié: (2026)
par: Zhong, Haitian, et autres
Publié: (2026)
Are Tools All We Need? Unveiling the Tool-Use Tax in LLM Agents
par: Zhang, Kaituo, et autres
Publié: (2026)
par: Zhang, Kaituo, et autres
Publié: (2026)
ReTool-Video: Recursive Tool-Using Video Agents with Meta-Augmented Tool Grounding
par: Liu, Xiao, et autres
Publié: (2026)
par: Liu, Xiao, et autres
Publié: (2026)
Toward Scalable Verifiable Reward: Proxy State-Based Evaluation for Multi-turn Tool-Calling LLM Agents
par: Chuang, Yun-Shiuan, et autres
Publié: (2026)
par: Chuang, Yun-Shiuan, et autres
Publié: (2026)
DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning
par: He, Yang, et autres
Publié: (2026)
par: He, Yang, et autres
Publié: (2026)
Integrating Policy Summaries with Reward Decomposition for Explaining Reinforcement Learning Agents
par: Septon, Yael, et autres
Publié: (2022)
par: Septon, Yael, et autres
Publié: (2022)
ToolTweak: An Attack on Tool Selection in LLM-based Agents
par: Sneh, Jonathan, et autres
Publié: (2025)
par: Sneh, Jonathan, et autres
Publié: (2025)
ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents
par: Hu, Xuhao, et autres
Publié: (2026)
par: Hu, Xuhao, et autres
Publié: (2026)
UniToolCall: Unifying Tool-Use Representation, Data, and Evaluation for LLM Agents
par: Liang, Yijuan, et autres
Publié: (2026)
par: Liang, Yijuan, et autres
Publié: (2026)
FinToolBench: Evaluating LLM Agents for Real-World Financial Tool Use
par: Lu, Jiaxuan, et autres
Publié: (2026)
par: Lu, Jiaxuan, et autres
Publié: (2026)
PORTool: Importance-Aware Policy Optimization with Rewarded Tree for Multi-Tool-Integrated Reasoning
par: Wu, Feijie, et autres
Publié: (2025)
par: Wu, Feijie, et autres
Publié: (2025)
OMuleT: Orchestrating Multiple Tools for Practicable Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024)
par: Yoon, Se-eun, et autres
Publié: (2024)
Understanding Tool-Integrated Reasoning
par: Lin, Heng, et autres
Publié: (2025)
par: Lin, Heng, et autres
Publié: (2025)
Utility-Guided Agent Orchestration for Efficient LLM Tool Use
par: Liu, Boyan, et autres
Publié: (2026)
par: Liu, Boyan, et autres
Publié: (2026)
CuRLA: Curriculum Learning Based Deep Reinforcement Learning for Autonomous Driving
par: Uppuluri, Bhargava, et autres
Publié: (2025)
par: Uppuluri, Bhargava, et autres
Publié: (2025)
TIM-PRM: Verifying multimodal reasoning with Tool-Integrated PRM
par: Kuang, Peng, et autres
Publié: (2025)
par: Kuang, Peng, et autres
Publié: (2025)
DART: Semantic Recoverability for Structured Tool Agents
par: Yang, Ke, et autres
Publié: (2026)
par: Yang, Ke, et autres
Publié: (2026)
GTM: Simulating the World of Tools for AI Agents
par: Ren, Zhenzhen, et autres
Publié: (2025)
par: Ren, Zhenzhen, et autres
Publié: (2025)
Asynchronous Tool Usage for Real-Time Agents
par: Ginart, Antonio A., et autres
Publié: (2024)
par: Ginart, Antonio A., et autres
Publié: (2024)
Infant Agent: A Tool-Integrated, Logic-Driven Agent with Cost-Effective API Usage
par: Lei, Bin, et autres
Publié: (2024)
par: Lei, Bin, et autres
Publié: (2024)
MapAgent: A Hierarchical Agent for Geospatial Reasoning with Dynamic Map Tool Integration
par: Hasan, Md Hasebul, et autres
Publié: (2025)
par: Hasan, Md Hasebul, et autres
Publié: (2025)
AgentOrchestra: Orchestrating Multi-Agent Intelligence with the Tool-Environment-Agent(TEA) Protocol
par: Zhang, Wentao, et autres
Publié: (2025)
par: Zhang, Wentao, et autres
Publié: (2025)
ReviewGrounder: Improving Review Substantiveness with Rubric-Guided, Tool-Integrated Agents
par: Li, Zhuofeng, et autres
Publié: (2026)
par: Li, Zhuofeng, et autres
Publié: (2026)
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
Documents similaires
-
Guided by Trajectories: Repairing and Rewarding Tool-Use Trajectories for Tool-Integrated Reasoning
par: Gong, Siyu, et autres
Publié: (2026) -
ToolPRMBench: Evaluating and Advancing Process Reward Models for Tool-using Agents
par: Li, Dawei, et autres
Publié: (2026) -
ToolRM: Towards Agentic Tool-Use Reward Modeling
par: Li, Renhao, et autres
Publié: (2025) -
Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration
par: Modecrua, Wachiravit, et autres
Publié: (2026) -
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
par: Ding, Keyan, et autres
Publié: (2025)