ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zeng, Xingshan, Liu, Weiwen, Huang, Xu, Wang, Zezhong, Wang, Lingzhi, Li, Liangyou, Wang, Yasheng, Shang, Lifeng, Jiang, Xin, Tang, Ruiming, Liu, Qun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
di: Zeng, Xingshan, et al.
Pubblicazione: (2025)
di: Zeng, Xingshan, et al.
Pubblicazione: (2025)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
ToolACE: Winning the Points of LLM Function Calling
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
di: Liu, Weiwen, et al.
Pubblicazione: (2024)
ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
ARTIS: Agentic Risk-Aware Test-Time Scaling via Iterative Simulation
di: Zeng, Xingshan, et al.
Pubblicazione: (2026)
di: Zeng, Xingshan, et al.
Pubblicazione: (2026)
Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning
di: Wang, Zezhong, et al.
Pubblicazione: (2025)
di: Wang, Zezhong, et al.
Pubblicazione: (2025)
Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
di: Wang, Zezhong, et al.
Pubblicazione: (2024)
Advancing and Benchmarking Personalized Tool Invocation for LLMs
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
Bridging and Modeling Correlations in Pairwise Data for Direct Preference Optimization
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
Fast, Slow, and Tool-augmented Thinking for LLMs: A Review
di: Jia, Xinda, et al.
Pubblicazione: (2025)
di: Jia, Xinda, et al.
Pubblicazione: (2025)
Planning, Creation, Usage: Benchmarking LLMs for Comprehensive Tool Utilization in Real-World Complex Scenarios
di: Huang, Shijue, et al.
Pubblicazione: (2024)
di: Huang, Shijue, et al.
Pubblicazione: (2024)
Learning to Edit: Aligning LLMs with Knowledge Editing
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
di: Jiang, Yuxin, et al.
Pubblicazione: (2024)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
di: Li, Wenjun, et al.
Pubblicazione: (2025)
di: Li, Wenjun, et al.
Pubblicazione: (2025)
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models
di: Jiang, Yuxin, et al.
Pubblicazione: (2023)
di: Jiang, Yuxin, et al.
Pubblicazione: (2023)
ACE-Router: Generalizing History-Aware Routing from MCP Tools to the Agent Web
di: Yao, Zhiyuan, et al.
Pubblicazione: (2026)
di: Yao, Zhiyuan, et al.
Pubblicazione: (2026)
MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
di: Kwan, Wai-Chung, et al.
Pubblicazione: (2024)
di: Kwan, Wai-Chung, et al.
Pubblicazione: (2024)
M4LE: A Multi-Ability Multi-Range Multi-Task Multi-Domain Long-Context Evaluation Benchmark for Large Language Models
di: Kwan, Wai-Chung, et al.
Pubblicazione: (2023)
di: Kwan, Wai-Chung, et al.
Pubblicazione: (2023)
Crowd Comparative Reasoning: Unlocking Comprehensive Evaluations for LLM-as-a-Judge
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
Position: The Real Barrier to LLM Agent Usability is Agentic ROI
di: Liu, Weiwen, et al.
Pubblicazione: (2025)
di: Liu, Weiwen, et al.
Pubblicazione: (2025)
ACEBench: Who Wins the Match Point in Tool Usage?
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
RevisEval: Improving LLM-as-a-Judge via Response-Adapted References
di: Zhang, Qiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Qiyuan, et al.
Pubblicazione: (2024)
From Verifiable Dot to Reward Chain: Harnessing Verifiable Reference-based Rewards for Reinforcement Learning of Open-ended Generation
di: Jiang, Yuxin, et al.
Pubblicazione: (2026)
di: Jiang, Yuxin, et al.
Pubblicazione: (2026)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
di: Liu, Chengwu, et al.
Pubblicazione: (2025)
di: Liu, Chengwu, et al.
Pubblicazione: (2025)
Tool Zero: Training Tool-Augmented LLMs via Pure RL from Scratch
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
Instruction-Tuning Data Synthesis from Scratch via Web Reconstruction
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
Understanding the planning of LLM agents: A survey
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
SELF: Self-Evolution with Language Feedback
di: Lu, Jianqiao, et al.
Pubblicazione: (2023)
di: Lu, Jianqiao, et al.
Pubblicazione: (2023)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
ATGen: Adversarial Reinforcement Learning for Test Case Generation
di: Li, Qingyao, et al.
Pubblicazione: (2025)
di: Li, Qingyao, et al.
Pubblicazione: (2025)
GUI Agents with Foundation Models: A Comprehensive Survey
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
DAST: Difficulty-Aware Self-Training on Large Language Models
di: Xue, Boyang, et al.
Pubblicazione: (2025)
di: Xue, Boyang, et al.
Pubblicazione: (2025)
iTool: Reinforced Fine-Tuning with Dynamic Deficiency Calibration for Advanced Tool Use
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
Learning to Align Multi-Faceted Evaluation: A Unified and Robust Framework
di: Xu, Kaishuai, et al.
Pubblicazione: (2025)
di: Xu, Kaishuai, et al.
Pubblicazione: (2025)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
Data Management For Training Large Language Models: A Survey
di: Wang, Zige, et al.
Pubblicazione: (2023)
di: Wang, Zige, et al.
Pubblicazione: (2023)
LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation
di: Chen, Jizheng, et al.
Pubblicazione: (2026)
di: Chen, Jizheng, et al.
Pubblicazione: (2026)
VG-Refiner: Towards Tool-Refined Referring Grounded Reasoning via Agentic Reinforcement Learning
di: Wang, Yuji, et al.
Pubblicazione: (2025)
di: Wang, Yuji, et al.
Pubblicazione: (2025)
CELA: Cost-Efficient Language Model Alignment for CTR Prediction
di: Wang, Xingmei, et al.
Pubblicazione: (2024)
di: Wang, Xingmei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
di: Zeng, Xingshan, et al.
Pubblicazione: (2025) -
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
di: Huang, Xu, et al.
Pubblicazione: (2025) -
ToolACE: Winning the Points of LLM Function Calling
di: Liu, Weiwen, et al.
Pubblicazione: (2024) -
ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
di: Wang, Zezhong, et al.
Pubblicazione: (2024) -
ARTIS: Agentic Risk-Aware Test-Time Scaling via Iterative Simulation
di: Zeng, Xingshan, et al.
Pubblicazione: (2026)