Advancing and Benchmarking Personalized Tool Invocation for LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Xu, Huang, Yuefeng, Liu, Weiwen, Zeng, Xingshan, Wang, Yasheng, Tang, Ruiming, Xie, Hong, Lian, Defu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
por: Huang, Xu, et al.
Publicado: (2025)
por: Huang, Xu, et al.
Publicado: (2025)
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
por: Zeng, Xingshan, et al.
Publicado: (2025)
por: Zeng, Xingshan, et al.
Publicado: (2025)
Understanding the planning of LLM agents: A survey
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
por: Zeng, Xingshan, et al.
Publicado: (2025)
por: Zeng, Xingshan, et al.
Publicado: (2025)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
por: Li, Wenjun, et al.
Publicado: (2025)
por: Li, Wenjun, et al.
Publicado: (2025)
ToolACE: Winning the Points of LLM Function Calling
por: Liu, Weiwen, et al.
Publicado: (2024)
por: Liu, Weiwen, et al.
Publicado: (2024)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
por: Liu, Yilong, et al.
Publicado: (2026)
por: Liu, Yilong, et al.
Publicado: (2026)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
ACEBench: Who Wins the Match Point in Tool Usage?
por: Chen, Chen, et al.
Publicado: (2025)
por: Chen, Chen, et al.
Publicado: (2025)
iTool: Reinforced Fine-Tuning with Dynamic Deficiency Calibration for Advanced Tool Use
por: Zeng, Yirong, et al.
Publicado: (2025)
por: Zeng, Yirong, et al.
Publicado: (2025)
CodeTool: Enhancing Programmatic Tool Invocation of LLMs via Process Supervision
por: Lu, Yifei, et al.
Publicado: (2025)
por: Lu, Yifei, et al.
Publicado: (2025)
Position: The Real Barrier to LLM Agent Usability is Agentic ROI
por: Liu, Weiwen, et al.
Publicado: (2025)
por: Liu, Weiwen, et al.
Publicado: (2025)
Fast, Slow, and Tool-augmented Thinking for LLMs: A Review
por: Jia, Xinda, et al.
Publicado: (2025)
por: Jia, Xinda, et al.
Publicado: (2025)
Planning, Creation, Usage: Benchmarking LLMs for Comprehensive Tool Utilization in Real-World Complex Scenarios
por: Huang, Shijue, et al.
Publicado: (2024)
por: Huang, Shijue, et al.
Publicado: (2024)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)
por: Zhu, Dongsheng, et al.
Publicado: (2025)
Selective Forgetting: Advancing Machine Unlearning Techniques and Evaluation in Language Models
por: Wang, Lingzhi, et al.
Publicado: (2024)
por: Wang, Lingzhi, et al.
Publicado: (2024)
FamilyTool: A Multi-hop Personalized Tool Use Benchmark
por: Wang, Yuxin, et al.
Publicado: (2025)
por: Wang, Yuxin, et al.
Publicado: (2025)
Beyond Linear LLM Invocation: An Efficient and Effective Semantic Filter Paradigm
por: Hou, Nan, et al.
Publicado: (2026)
por: Hou, Nan, et al.
Publicado: (2026)
From Accuracy to Robustness: A Study of Rule- and Model-based Verifiers in Mathematical Reasoning
por: Huang, Yuzhen, et al.
Publicado: (2025)
por: Huang, Yuzhen, et al.
Publicado: (2025)
Logic Agent: Enhancing Validity with Logic Rule Invocation
por: Liu, Hanmeng, et al.
Publicado: (2024)
por: Liu, Hanmeng, et al.
Publicado: (2024)
ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
por: Wang, Zezhong, et al.
Publicado: (2024)
por: Wang, Zezhong, et al.
Publicado: (2024)
Evaluating Implicit Regulatory Compliance in LLM Tool Invocation via Logic-Guided Synthesis
por: Song, Da, et al.
Publicado: (2026)
por: Song, Da, et al.
Publicado: (2026)
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
por: Lv, Hang, et al.
Publicado: (2025)
por: Lv, Hang, et al.
Publicado: (2025)
DentalBench: Benchmarking and Advancing LLMs Capability for Bilingual Dentistry Understanding
por: Zhu, Hengchuan, et al.
Publicado: (2025)
por: Zhu, Hengchuan, et al.
Publicado: (2025)
Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning
por: Chen, Chishui, et al.
Publicado: (2026)
por: Chen, Chishui, et al.
Publicado: (2026)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
por: Chen, Jin, et al.
Publicado: (2023)
por: Chen, Jin, et al.
Publicado: (2023)
Selective Prompting Tuning for Personalized Conversations with LLMs
por: Huang, Qiushi, et al.
Publicado: (2024)
por: Huang, Qiushi, et al.
Publicado: (2024)
Retro*: Optimizing LLMs for Reasoning-Intensive Document Retrieval
por: Lan, Junwei, et al.
Publicado: (2025)
por: Lan, Junwei, et al.
Publicado: (2025)
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
por: Qian, Hongjin, et al.
Publicado: (2024)
por: Qian, Hongjin, et al.
Publicado: (2024)
Benchmarking LLMs' Mathematical Reasoning with Unseen Random Variables Questions
por: Hong, Zijin, et al.
Publicado: (2025)
por: Hong, Zijin, et al.
Publicado: (2025)
EquivPruner: Boosting Efficiency and Quality in LLM-Based Search via Action Pruning
por: Liu, Jiawei, et al.
Publicado: (2025)
por: Liu, Jiawei, et al.
Publicado: (2025)
A Survey of Calibration Process for Black-Box LLMs
por: Xie, Liangru, et al.
Publicado: (2024)
por: Xie, Liangru, et al.
Publicado: (2024)
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
por: Wang, Lei, et al.
Publicado: (2024)
por: Wang, Lei, et al.
Publicado: (2024)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
ToolSpectrum : Towards Personalized Tool Utilization for Large Language Models
por: Cheng, Zihao, et al.
Publicado: (2025)
por: Cheng, Zihao, et al.
Publicado: (2025)
WebWalker: Benchmarking LLMs in Web Traversal
por: Wu, Jialong, et al.
Publicado: (2025)
por: Wu, Jialong, et al.
Publicado: (2025)
Learning Evolving Tools for Large Language Models
por: Chen, Guoxin, et al.
Publicado: (2024)
por: Chen, Guoxin, et al.
Publicado: (2024)
ReTool: Reinforcement Learning for Strategic Tool Use in LLMs
por: Feng, Jiazhan, et al.
Publicado: (2025)
por: Feng, Jiazhan, et al.
Publicado: (2025)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
por: Jin, Haoran, et al.
Publicado: (2025)
por: Jin, Haoran, et al.
Publicado: (2025)
Ejemplares similares
-
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
por: Huang, Xu, et al.
Publicado: (2025) -
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
por: Zeng, Xingshan, et al.
Publicado: (2025) -
Understanding the planning of LLM agents: A survey
por: Huang, Xu, et al.
Publicado: (2024) -
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
por: Zeng, Xingshan, et al.
Publicado: (2025) -
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
por: Li, Wenjun, et al.
Publicado: (2025)