Understanding the planning of LLM agents: A survey
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Xu, Liu, Weiwen, Chen, Xiaolong, Wang, Xingmei, Wang, Hao, Lian, Defu, Wang, Yasheng, Tang, Ruiming, Chen, Enhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WESE: Weak Exploration to Strong Exploitation for LLM Agents
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
ToolACE: Winning the Points of LLM Function Calling
por: Liu, Weiwen, et al.
Publicado: (2024)
por: Liu, Weiwen, et al.
Publicado: (2024)
Advancing and Benchmarking Personalized Tool Invocation for LLMs
por: Huang, Xu, et al.
Publicado: (2025)
por: Huang, Xu, et al.
Publicado: (2025)
Entropy Law: The Story Behind Data Compression and LLM Performance
por: Yin, Mingjia, et al.
Publicado: (2024)
por: Yin, Mingjia, et al.
Publicado: (2024)
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
por: Zeng, Xingshan, et al.
Publicado: (2025)
por: Zeng, Xingshan, et al.
Publicado: (2025)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
por: Huang, Xu, et al.
Publicado: (2025)
por: Huang, Xu, et al.
Publicado: (2025)
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nodes
por: Zhou, Yiming, et al.
Publicado: (2026)
por: Zhou, Yiming, et al.
Publicado: (2026)
Efficient Machine Unlearning via Influence Approximation
por: Liu, Jiawei, et al.
Publicado: (2025)
por: Liu, Jiawei, et al.
Publicado: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
por: Zeng, Xingshan, et al.
Publicado: (2025)
por: Zeng, Xingshan, et al.
Publicado: (2025)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
por: Chen, Jin, et al.
Publicado: (2023)
por: Chen, Jin, et al.
Publicado: (2023)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
por: Jin, Haoran, et al.
Publicado: (2025)
por: Jin, Haoran, et al.
Publicado: (2025)
Mitigate Negative Transfer with Similarity Heuristic Lifelong Prompt Tuning
por: Wu, Chenyuan, et al.
Publicado: (2024)
por: Wu, Chenyuan, et al.
Publicado: (2024)
Foundations and Frontiers of Graph Learning Theory
por: Huang, Yu, et al.
Publicado: (2024)
por: Huang, Yu, et al.
Publicado: (2024)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
por: Yang, Hantao, et al.
Publicado: (2024)
por: Yang, Hantao, et al.
Publicado: (2024)
M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
por: Chen, Jianlv, et al.
Publicado: (2024)
por: Chen, Jianlv, et al.
Publicado: (2024)
Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks
por: Li, Miaomiao, et al.
Publicado: (2025)
por: Li, Miaomiao, et al.
Publicado: (2025)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
por: Li, Wenjun, et al.
Publicado: (2025)
por: Li, Wenjun, et al.
Publicado: (2025)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
por: Liu, Chengwu, et al.
Publicado: (2025)
por: Liu, Chengwu, et al.
Publicado: (2025)
ChemEval: A Comprehensive Multi-Level Chemical Evaluation for Large Language Models
por: Huang, Yuqing, et al.
Publicado: (2024)
por: Huang, Yuqing, et al.
Publicado: (2024)
Understanding LLM Embeddings for Regression
por: Tang, Eric, et al.
Publicado: (2024)
por: Tang, Eric, et al.
Publicado: (2024)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
por: Zhu, Zhihao, et al.
Publicado: (2024)
por: Zhu, Zhihao, et al.
Publicado: (2024)
Bridging Human and LLM Judgments: Understanding and Narrowing the Gap
por: Polo, Felipe Maia, et al.
Publicado: (2025)
por: Polo, Felipe Maia, et al.
Publicado: (2025)
Understanding the Performance and Estimating the Cost of LLM Fine-Tuning
por: Xia, Yuchen, et al.
Publicado: (2024)
por: Xia, Yuchen, et al.
Publicado: (2024)
iTool: Reinforced Fine-Tuning with Dynamic Deficiency Calibration for Advanced Tool Use
por: Zeng, Yirong, et al.
Publicado: (2025)
por: Zeng, Yirong, et al.
Publicado: (2025)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
por: Tang, Haoyu, et al.
Publicado: (2024)
por: Tang, Haoyu, et al.
Publicado: (2024)
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning
por: Chen, Jiaqi, et al.
Publicado: (2025)
por: Chen, Jiaqi, et al.
Publicado: (2025)
YODA: Teacher-Student Progressive Learning for Language Models
por: Lu, Jianqiao, et al.
Publicado: (2024)
por: Lu, Jianqiao, et al.
Publicado: (2024)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
por: Zhang, Kangning, et al.
Publicado: (2025)
por: Zhang, Kangning, et al.
Publicado: (2025)
RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration
por: Lv, Hang, et al.
Publicado: (2026)
por: Lv, Hang, et al.
Publicado: (2026)
LLM-Powered Ensemble Learning for Paper Source Tracing: A GPU-Free Approach
por: Chen, Kunlong, et al.
Publicado: (2024)
por: Chen, Kunlong, et al.
Publicado: (2024)
KDRL: Post-Training Reasoning LLMs via Unified Knowledge Distillation and Reinforcement Learning
por: Xu, Hongling, et al.
Publicado: (2025)
por: Xu, Hongling, et al.
Publicado: (2025)
CastFlow: Learning Role-Specialized Agentic Workflows for Time Series Forecasting
por: Pan, Bokai, et al.
Publicado: (2026)
por: Pan, Bokai, et al.
Publicado: (2026)
A Unified Frequency Domain Decomposition Framework for Interpretable and Robust Time Series Forecasting
por: He, Cheng, et al.
Publicado: (2025)
por: He, Cheng, et al.
Publicado: (2025)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
por: Xie, Hong, et al.
Publicado: (2026)
por: Xie, Hong, et al.
Publicado: (2026)
Multi-agent Multi-armed Bandits with Stochastic Sharable Arm Capacities
por: Xie, Hong, et al.
Publicado: (2024)
por: Xie, Hong, et al.
Publicado: (2024)
LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning
por: Huang, Wei, et al.
Publicado: (2026)
por: Huang, Wei, et al.
Publicado: (2026)
RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery
por: Gu, Hongchao, et al.
Publicado: (2025)
por: Gu, Hongchao, et al.
Publicado: (2025)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
por: Chia, Yew Ken, et al.
Publicado: (2024)
por: Chia, Yew Ken, et al.
Publicado: (2024)
Ejemplares similares
-
WESE: Weak Exploration to Strong Exploitation for LLM Agents
por: Huang, Xu, et al.
Publicado: (2024) -
ToolACE: Winning the Points of LLM Function Calling
por: Liu, Weiwen, et al.
Publicado: (2024) -
Advancing and Benchmarking Personalized Tool Invocation for LLMs
por: Huang, Xu, et al.
Publicado: (2025) -
Entropy Law: The Story Behind Data Compression and LLM Performance
por: Yin, Mingjia, et al.
Publicado: (2024) -
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
por: Zeng, Xingshan, et al.
Publicado: (2025)