AGILE: A Novel Reinforcement Learning Framework of LLM Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Feng, Peiyuan, He, Yichen, Huang, Guanhua, Lin, Yuan, Zhang, Hanchong, Zhang, Yuchen, Li, Hang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PaSa: An LLM Agent for Comprehensive Academic Paper Search
by: He, Yichen, et al.
Published: (2025)
by: He, Yichen, et al.
Published: (2025)
Tree Search for LLM Agent Reinforcement Learning
by: Ji, Yuxiang, et al.
Published: (2025)
by: Ji, Yuxiang, et al.
Published: (2025)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
by: Feng, Lang, et al.
Published: (2026)
by: Feng, Lang, et al.
Published: (2026)
Minimax-Optimal Multi-Agent Robust Reinforcement Learning
by: Jiao, Yuchen, et al.
Published: (2024)
by: Jiao, Yuchen, et al.
Published: (2024)
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
by: Li, Yibo, et al.
Published: (2026)
by: Li, Yibo, et al.
Published: (2026)
Towards Fault Tolerance in Multi-Agent Reinforcement Learning
by: Shi, Yuchen, et al.
Published: (2024)
by: Shi, Yuchen, et al.
Published: (2024)
LEED: A Highly Efficient and Scalable LLM-Empowered Expert Demonstrations Framework for Multi-Agent Reinforcement Learning
by: Duan, Tianyang, et al.
Published: (2025)
by: Duan, Tianyang, et al.
Published: (2025)
$Agent^2$: An Agent-Generates-Agent Framework for Reinforcement Learning Automation
by: Wei, Yuan, et al.
Published: (2025)
by: Wei, Yuan, et al.
Published: (2025)
StoryTeller: Improving Long Video Description through Global Audio-Visual Character Identification
by: He, Yichen, et al.
Published: (2024)
by: He, Yichen, et al.
Published: (2024)
Heterogeneous Agent Collaborative Reinforcement Learning
by: Zhang, Zhixia, et al.
Published: (2026)
by: Zhang, Zhixia, et al.
Published: (2026)
RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use
by: Chai, Jiajun, et al.
Published: (2025)
by: Chai, Jiajun, et al.
Published: (2025)
OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents
by: Li, Xinyu, et al.
Published: (2026)
by: Li, Xinyu, et al.
Published: (2026)
Online Estimation and Inference for Robust Policy Evaluation in Reinforcement Learning
by: Liu, Weidong, et al.
Published: (2023)
by: Liu, Weidong, et al.
Published: (2023)
PepThink-R1: LLM for Interpretable Cyclic Peptide Optimization with CoT SFT and Reinforcement Learning
by: Wang, Ruheng, et al.
Published: (2025)
by: Wang, Ruheng, et al.
Published: (2025)
Learning under Commission and Omission Event Outliers
by: Zhang, Yuecheng, et al.
Published: (2025)
by: Zhang, Yuecheng, et al.
Published: (2025)
Interactive and Hybrid Imitation Learning: Provably Beating Behavior Cloning
by: Li, Yichen, et al.
Published: (2024)
by: Li, Yichen, et al.
Published: (2024)
Agnostic Interactive Imitation Learning: New Theory and Practical Algorithms
by: Li, Yichen, et al.
Published: (2023)
by: Li, Yichen, et al.
Published: (2023)
TIMRL: A Novel Meta-Reinforcement Learning Framework for Non-Stationary and Multi-Task Environments
by: Qi, Chenyang, et al.
Published: (2025)
by: Qi, Chenyang, et al.
Published: (2025)
CHoE: Cross-Domain Heterogeneous Graph Prompt Learning via Structure-Conditioned Experts
by: Li, Peiyuan, et al.
Published: (2026)
by: Li, Peiyuan, et al.
Published: (2026)
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
by: He, Zhongyu, et al.
Published: (2026)
by: He, Zhongyu, et al.
Published: (2026)
A Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement Learning
by: Xie, Zhengpeng, et al.
Published: (2025)
by: Xie, Zhengpeng, et al.
Published: (2025)
Vehicle-as-Prompt: A Unified Deep Reinforcement Learning Framework for Heterogeneous Fleet Vehicle Routing Problem
by: Huang, Shihong, et al.
Published: (2026)
by: Huang, Shihong, et al.
Published: (2026)
Revisiting DAgger in the Era of LLM-Agents
by: Li, Changhao, et al.
Published: (2026)
by: Li, Changhao, et al.
Published: (2026)
An Extremely Data-efficient and Generative LLM-based Reinforcement Learning Agent for Recommenders
by: Feng, Shuang, et al.
Published: (2024)
by: Feng, Shuang, et al.
Published: (2024)
MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering
by: Qiang, Rushi, et al.
Published: (2025)
by: Qiang, Rushi, et al.
Published: (2025)
Network Dynamics-Based Framework for Understanding Deep Neural Networks
by: Lin, Yuchen, et al.
Published: (2025)
by: Lin, Yuchen, et al.
Published: (2025)
Inherent Trade-Offs between Diversity and Stability in Multi-Task Benchmarks
by: Zhang, Guanhua, et al.
Published: (2024)
by: Zhang, Guanhua, et al.
Published: (2024)
Agent Lightning: Train ANY AI Agents with Reinforcement Learning
by: Luo, Xufang, et al.
Published: (2025)
by: Luo, Xufang, et al.
Published: (2025)
A3C-S: Automated Agent Accelerator Co-Search towards Efficient Deep Reinforcement Learning
by: Fu, Yonggan, et al.
Published: (2021)
by: Fu, Yonggan, et al.
Published: (2021)
Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning
by: Jiang, Zhida, et al.
Published: (2026)
by: Jiang, Zhida, et al.
Published: (2026)
Self-Attention as a Covariance Readout: A Unified View of In-Context Learning and Repetition
by: Xu, Haoren, et al.
Published: (2026)
by: Xu, Haoren, et al.
Published: (2026)
Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search
by: Fu, Yonggan, et al.
Published: (2020)
by: Fu, Yonggan, et al.
Published: (2020)
ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering
by: Liu, Zexi, et al.
Published: (2025)
by: Liu, Zexi, et al.
Published: (2025)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
by: Xi, Zhiheng, et al.
Published: (2025)
by: Xi, Zhiheng, et al.
Published: (2025)
Team, Then Trim: An Assembly-Line LLM Framework for High-Quality Tabular Data Generation
by: Zhang, Congjing, et al.
Published: (2026)
by: Zhang, Congjing, et al.
Published: (2026)
Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents
by: Song, Yifan, et al.
Published: (2024)
by: Song, Yifan, et al.
Published: (2024)
Mini Honor of Kings: A Lightweight Environment for Multi-Agent Reinforcement Learning
by: Liu, Lin, et al.
Published: (2024)
by: Liu, Lin, et al.
Published: (2024)
DAPO: An Open-Source LLM Reinforcement Learning System at Scale
by: Yu, Qiying, et al.
Published: (2025)
by: Yu, Qiying, et al.
Published: (2025)
RADAR: A Risk-Aware Dynamic Multi-Agent Framework for LLM Safety Evaluation via Role-Specialized Collaboration
by: Chen, Xiuyuan, et al.
Published: (2025)
by: Chen, Xiuyuan, et al.
Published: (2025)
Rationality Measurement and Theory for Reinforcement Learning Agents
by: Qian, Kejiang, et al.
Published: (2026)
by: Qian, Kejiang, et al.
Published: (2026)
Similar Items
-
PaSa: An LLM Agent for Comprehensive Academic Paper Search
by: He, Yichen, et al.
Published: (2025) -
Tree Search for LLM Agent Reinforcement Learning
by: Ji, Yuxiang, et al.
Published: (2025) -
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
by: Feng, Lang, et al.
Published: (2026) -
Minimax-Optimal Multi-Agent Robust Reinforcement Learning
by: Jiao, Yuchen, et al.
Published: (2024) -
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
by: Li, Yibo, et al.
Published: (2026)