ReTool: Reinforcement Learning for Strategic Tool Use in LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Jiazhan, Huang, Shijue, Qu, Xingwei, Zhang, Ge, Qin, Yujia, Zhong, Baoquan, Jiang, Chengquan, Chi, Jinxin, Zhong, Wanjun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
di: Huang, Shijue, et al.
Pubblicazione: (2025)
di: Huang, Shijue, et al.
Pubblicazione: (2025)
ReTool-Video: Recursive Tool-Using Video Agents with Meta-Augmented Tool Grounding
di: Liu, Xiao, et al.
Pubblicazione: (2026)
di: Liu, Xiao, et al.
Pubblicazione: (2026)
Planning, Creation, Usage: Benchmarking LLMs for Comprehensive Tool Utilization in Real-World Complex Scenarios
di: Huang, Shijue, et al.
Pubblicazione: (2024)
di: Huang, Shijue, et al.
Pubblicazione: (2024)
CLongEval: A Chinese Benchmark for Evaluating Long-Context Large Language Models
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
Process-Supervised Reinforcement Learning for Interactive Multimodal Tool-Use Agents
di: Tan, Weiting, et al.
Pubblicazione: (2025)
di: Tan, Weiting, et al.
Pubblicazione: (2025)
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
di: Jiang, Dongfu, et al.
Pubblicazione: (2025)
di: Jiang, Dongfu, et al.
Pubblicazione: (2025)
Self-Reasoning Language Models: Unfold Hidden Reasoning Chains with Few Reasoning Catalyst
di: Wang, Hongru, et al.
Pubblicazione: (2025)
di: Wang, Hongru, et al.
Pubblicazione: (2025)
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
iTool: Reinforced Fine-Tuning with Dynamic Deficiency Calibration for Advanced Tool Use
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
ToolExpander: Extending the Frontiers of Tool-Using Reinforcement Learning to Weak LLMs
di: Chen, Fu, et al.
Pubblicazione: (2025)
di: Chen, Fu, et al.
Pubblicazione: (2025)
GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
Advancing SLM Tool-Use Capability using Reinforcement Learning
di: Paprunia, Dhruvi, et al.
Pubblicazione: (2025)
di: Paprunia, Dhruvi, et al.
Pubblicazione: (2025)
CREATOR: Tool Creation for Disentangling Abstract and Concrete Reasoning of Large Language Models
di: Qian, Cheng, et al.
Pubblicazione: (2023)
di: Qian, Cheng, et al.
Pubblicazione: (2023)
StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning
di: Yu, Yuanqing, et al.
Pubblicazione: (2024)
di: Yu, Yuanqing, et al.
Pubblicazione: (2024)
Concise and Precise Context Compression for Tool-Using Language Models
di: Xu, Yang, et al.
Pubblicazione: (2024)
di: Xu, Yang, et al.
Pubblicazione: (2024)
StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models
di: Guo, Zhicheng, et al.
Pubblicazione: (2024)
di: Guo, Zhicheng, et al.
Pubblicazione: (2024)
Adaptive Tool Generation with Models as Tools and Reinforcement Learning
di: Wang, Chenpeng, et al.
Pubblicazione: (2025)
di: Wang, Chenpeng, et al.
Pubblicazione: (2025)
Reverse-Engineered Reasoning for Open-Ended Generation
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
PEARL: Plan Exploration and Adaptive Reinforcement Learning for Multihop Tool Use
di: Wang, Qihao, et al.
Pubblicazione: (2026)
di: Wang, Qihao, et al.
Pubblicazione: (2026)
Learning How to Use Tools, Not Just When: Pattern-Aware Tool-Integrated Reasoning
di: Xu, Ningning, et al.
Pubblicazione: (2025)
di: Xu, Ningning, et al.
Pubblicazione: (2025)
Learning Evolving Tools for Large Language Models
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
Learning to Use Tools via Cooperative and Interactive Agents
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
di: Li, Yunwen, et al.
Pubblicazione: (2025)
di: Li, Yunwen, et al.
Pubblicazione: (2025)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
di: Liu, Yilong, et al.
Pubblicazione: (2026)
di: Liu, Yilong, et al.
Pubblicazione: (2026)
The Evolution of Tool Use in LLM Agents: From Single-Tool Call to Multi-Tool Orchestration
di: Xu, Haoyuan, et al.
Pubblicazione: (2026)
di: Xu, Haoyuan, et al.
Pubblicazione: (2026)
FinToolSyn: A forward synthesis Framework for Financial Tool-Use Dialogue Data with Dynamic Tool Retrieval
di: Huang, Caishuang, et al.
Pubblicazione: (2026)
di: Huang, Caishuang, et al.
Pubblicazione: (2026)
The Tool Illusion: Rethinking Tool Use in Web Agents
di: Lou, Renze, et al.
Pubblicazione: (2026)
di: Lou, Renze, et al.
Pubblicazione: (2026)
ToolRM: Towards Agentic Tool-Use Reward Modeling
di: Li, Renhao, et al.
Pubblicazione: (2025)
di: Li, Renhao, et al.
Pubblicazione: (2025)
Re-Invoke: Tool Invocation Rewriting for Zero-Shot Tool Retrieval
di: Chen, Yanfei, et al.
Pubblicazione: (2024)
di: Chen, Yanfei, et al.
Pubblicazione: (2024)
Tool Unlearning for Tool-Augmented LLMs
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
ToolGate: Contract-Grounded and Verified Tool Execution for LLMs
di: Liu, Yanming, et al.
Pubblicazione: (2026)
di: Liu, Yanming, et al.
Pubblicazione: (2026)
Acting Less is Reasoning More! Teaching Model to Act Efficiently
di: Wang, Hongru, et al.
Pubblicazione: (2025)
di: Wang, Hongru, et al.
Pubblicazione: (2025)
Learning to Edit: Aligning LLMs with Knowledge Editing
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
FamilyTool: A Multi-hop Personalized Tool Use Benchmark
di: Wang, Yuxin, et al.
Pubblicazione: (2025)
di: Wang, Yuxin, et al.
Pubblicazione: (2025)
Benchmarking LLM Tool-Use in the Wild
di: Yu, Peijie, et al.
Pubblicazione: (2026)
di: Yu, Peijie, et al.
Pubblicazione: (2026)
Towards Practical Tool Usage for Continually Learning LLMs
di: Huang, Jerry, et al.
Pubblicazione: (2024)
di: Huang, Jerry, et al.
Pubblicazione: (2024)
Try, Check and Retry: A Divide-and-Conquer Framework for Boosting Long-context Tool-Calling Performance of LLMs
di: Chen, Kunfeng, et al.
Pubblicazione: (2026)
di: Chen, Kunfeng, et al.
Pubblicazione: (2026)
MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use
di: Huang, Yue, et al.
Pubblicazione: (2023)
di: Huang, Yue, et al.
Pubblicazione: (2023)
Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence
di: Dong, Guanting, et al.
Pubblicazione: (2026)
di: Dong, Guanting, et al.
Pubblicazione: (2026)
Documenti analoghi
-
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
di: Huang, Shijue, et al.
Pubblicazione: (2025) -
ReTool-Video: Recursive Tool-Using Video Agents with Meta-Augmented Tool Grounding
di: Liu, Xiao, et al.
Pubblicazione: (2026) -
Planning, Creation, Usage: Benchmarking LLMs for Comprehensive Tool Utilization in Real-World Complex Scenarios
di: Huang, Shijue, et al.
Pubblicazione: (2024) -
CLongEval: A Chinese Benchmark for Evaluating Long-Context Large Language Models
di: Qiu, Zexuan, et al.
Pubblicazione: (2024) -
Process-Supervised Reinforcement Learning for Interactive Multimodal Tool-Use Agents
di: Tan, Weiting, et al.
Pubblicazione: (2025)