From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qu, Changle, Dai, Sunhao, Wei, Xiaochi, Cai, Hengyi, Wang, Shuaiqiang, Yin, Dawei, Xu, Jun, Wen, Ji-Rong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tool Learning with Large Language Models: A Survey
par: Qu, Changle, et autres
Publié: (2024)
par: Qu, Changle, et autres
Publié: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
par: Qu, Changle, et autres
Publié: (2024)
par: Qu, Changle, et autres
Publié: (2024)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
par: Qu, Changle, et autres
Publié: (2026)
par: Qu, Changle, et autres
Publié: (2026)
Efficient Thought Space Exploration Through Strategic Intervention
par: Li, Ziheng, et autres
Publié: (2025)
par: Li, Ziheng, et autres
Publié: (2025)
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
par: Ni, Xuanfan, et autres
Publié: (2024)
par: Ni, Xuanfan, et autres
Publié: (2024)
Towards Verifiable Text Generation with Evolving Memory and Self-Reflection
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
Learning to Retrieve from Agent Trajectories
par: Zhou, Yuqi, et autres
Publié: (2026)
par: Zhou, Yuqi, et autres
Publié: (2026)
ReCODE: Modeling Repeat Consumption with Neural ODE
par: Dai, Sunhao, et autres
Publié: (2024)
par: Dai, Sunhao, et autres
Publié: (2024)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
par: Sun, Hao, et autres
Publié: (2024)
par: Sun, Hao, et autres
Publié: (2024)
CurES: From Gradient Analysis to Efficient Curriculum Learning for Reasoning LLMs
par: Zeng, Yongcheng, et autres
Publié: (2025)
par: Zeng, Yongcheng, et autres
Publié: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
par: Peng, Jingyu, et autres
Publié: (2025)
par: Peng, Jingyu, et autres
Publié: (2025)
LLMs + Persona-Plug = Personalized LLMs
par: Liu, Jiongnan, et autres
Publié: (2024)
par: Liu, Jiongnan, et autres
Publié: (2024)
Exploring the Potential of Large Language Models (LLMs) in Learning on Graphs
par: Chen, Zhikai, et autres
Publié: (2023)
par: Chen, Zhikai, et autres
Publié: (2023)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
par: Gao, Heyang, et autres
Publié: (2025)
par: Gao, Heyang, et autres
Publié: (2025)
KuaiLive: A Real-time Interactive Dataset for Live Streaming Recommendation
par: Qu, Changle, et autres
Publié: (2025)
par: Qu, Changle, et autres
Publié: (2025)
Cross-model Control: Improving Multiple Large Language Models in One-time Training
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
AdaFuse: Accelerating Dynamic Adapter Inference via Token-Level Pre-Gating and Fused Kernel Optimization
par: Li, Qiyang, et autres
Publié: (2026)
par: Li, Qiyang, et autres
Publié: (2026)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
par: Hao, Bingguang, et autres
Publié: (2026)
par: Hao, Bingguang, et autres
Publié: (2026)
From Prompting to Alignment: A Generative Framework for Query Recommendation
par: Min, Erxue, et autres
Publié: (2025)
par: Min, Erxue, et autres
Publié: (2025)
Not All Preferences Are Created Equal: Stability-Aware and Gradient-Efficient Alignment for Reasoning Models
par: Wu, Hui, et autres
Publié: (2026)
par: Wu, Hui, et autres
Publié: (2026)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
par: Zhu, Dongsheng, et autres
Publié: (2025)
par: Zhu, Dongsheng, et autres
Publié: (2025)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Exploring the Escalation of Source Bias in User, Data, and Recommender System Feedback Loop
par: Zhou, Yuqi, et autres
Publié: (2024)
par: Zhou, Yuqi, et autres
Publié: (2024)
AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis
par: Sun, Zexu, et autres
Publié: (2026)
par: Sun, Zexu, et autres
Publié: (2026)
UOEP: User-Oriented Exploration Policy for Enhancing Long-Term User Experiences in Recommender Systems
par: Zhang, Changshuo, et autres
Publié: (2024)
par: Zhang, Changshuo, et autres
Publié: (2024)
Mirage of Mastery: Memorization Tricks LLMs into Artificially Inflated Self-Knowledge
par: Kale, Sahil
Publié: (2025)
par: Kale, Sahil
Publié: (2025)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
par: Zhao, Yukun, et autres
Publié: (2023)
par: Zhao, Yukun, et autres
Publié: (2023)
CTR-Guided Generative Query Suggestion in Conversational Search
par: Min, Erxue, et autres
Publié: (2025)
par: Min, Erxue, et autres
Publié: (2025)
NExT-Search: Rebuilding User Feedback Ecosystem for Generative AI Search
par: Dai, Sunhao, et autres
Publié: (2025)
par: Dai, Sunhao, et autres
Publié: (2025)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
par: Wu, Hui, et autres
Publié: (2026)
par: Wu, Hui, et autres
Publié: (2026)
CitaLaw: Enhancing LLM with Citations in Legal Domain
par: Zhang, Kepu, et autres
Publié: (2024)
par: Zhang, Kepu, et autres
Publié: (2024)
SkillMaster: Toward Autonomous Skill Mastery in LLM Agents
par: Yang, Min, et autres
Publié: (2026)
par: Yang, Min, et autres
Publié: (2026)
Replication and Exploration of Generative Retrieval over Dynamic Corpora
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
Staying in the Sweet Spot: Responsive Reasoning Evolution via Capability-Adaptive Hint Scaffolding
par: Li, Ziheng, et autres
Publié: (2025)
par: Li, Ziheng, et autres
Publié: (2025)
Leveraging Generative Models for Real-Time Query-Driven Text Summarization in Large-Scale Web Search
par: Xiong, Zeyu, et autres
Publié: (2025)
par: Xiong, Zeyu, et autres
Publié: (2025)
Towards Next-Generation Recommender Systems: A Benchmark for Personalized Recommendation Assistant with LLMs
par: Huang, Jiani, et autres
Publié: (2025)
par: Huang, Jiani, et autres
Publié: (2025)
Cocktail: A Comprehensive Information Retrieval Benchmark with LLM-Generated Documents Integration
par: Dai, Sunhao, et autres
Publié: (2024)
par: Dai, Sunhao, et autres
Publié: (2024)
Perplexity Trap: PLM-Based Retrievers Overrate Low Perplexity Documents
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
par: Zhu, Junda, et autres
Publié: (2025)
par: Zhu, Junda, et autres
Publié: (2025)
Documents similaires
-
Tool Learning with Large Language Models: A Survey
par: Qu, Changle, et autres
Publié: (2024) -
Towards Completeness-Oriented Tool Retrieval for Large Language Models
par: Qu, Changle, et autres
Publié: (2024) -
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
par: Qu, Changle, et autres
Publié: (2026) -
Efficient Thought Space Exploration Through Strategic Intervention
par: Li, Ziheng, et autres
Publié: (2025) -
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
par: Ni, Xuanfan, et autres
Publié: (2024)