Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Lang, Zheng, Longtao, He, Shuo, Zhang, Fuxiang, An, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning
di: Feng, Lang, et al.
Pubblicazione: (2025)
di: Feng, Lang, et al.
Pubblicazione: (2025)
Dr. Kernel: Reinforcement Learning Done Right for Triton Kernel Generations
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
Group-in-Group Policy Optimization for LLM Agent Training
di: Feng, Lang, et al.
Pubblicazione: (2025)
di: Feng, Lang, et al.
Pubblicazione: (2025)
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
di: Li, Yibo, et al.
Pubblicazione: (2026)
di: Li, Yibo, et al.
Pubblicazione: (2026)
ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering
di: Liu, Zexi, et al.
Pubblicazione: (2025)
di: Liu, Zexi, et al.
Pubblicazione: (2025)
True Knowledge Comes from Practice: Aligning LLMs with Embodied Environments via Reinforcement Learning
di: Tan, Weihao, et al.
Pubblicazione: (2024)
di: Tan, Weihao, et al.
Pubblicazione: (2024)
NeuroMAS: Multi-Agent Systems as Neural Networks with Joint Reinforcement Learning
di: Lu, Haoran, et al.
Pubblicazione: (2026)
di: Lu, Haoran, et al.
Pubblicazione: (2026)
Hierarchy-of-Groups Policy Optimization for Long-Horizon Agentic Tasks
di: He, Shuo, et al.
Pubblicazione: (2026)
di: He, Shuo, et al.
Pubblicazione: (2026)
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization
di: Li, Simin, et al.
Pubblicazione: (2023)
di: Li, Simin, et al.
Pubblicazione: (2023)
Data-Centric Interpretability for LLM-based Multi-Agent Reinforcement Learning
di: Yan, John, et al.
Pubblicazione: (2026)
di: Yan, John, et al.
Pubblicazione: (2026)
Cross-Modal Navigation with Multi-Agent Reinforcement Learning
di: Liu, Shuo, et al.
Pubblicazione: (2026)
di: Liu, Shuo, et al.
Pubblicazione: (2026)
GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning
di: Liu, Ziru, et al.
Pubblicazione: (2025)
di: Liu, Ziru, et al.
Pubblicazione: (2025)
Adaptive and Robust DBSCAN with Multi-agent Reinforcement Learning
di: Peng, Hao, et al.
Pubblicazione: (2025)
di: Peng, Hao, et al.
Pubblicazione: (2025)
Tree Search for LLM Agent Reinforcement Learning
di: Ji, Yuxiang, et al.
Pubblicazione: (2025)
di: Ji, Yuxiang, et al.
Pubblicazione: (2025)
Policy Regularization on Globally Accessible States in Cross-Dynamics Reinforcement Learning
di: Xue, Zhenghai, et al.
Pubblicazione: (2025)
di: Xue, Zhenghai, et al.
Pubblicazione: (2025)
An Extremely Data-efficient and Generative LLM-based Reinforcement Learning Agent for Recommenders
di: Feng, Shuang, et al.
Pubblicazione: (2024)
di: Feng, Shuang, et al.
Pubblicazione: (2024)
Towards Fault Tolerance in Multi-Agent Reinforcement Learning
di: Shi, Yuchen, et al.
Pubblicazione: (2024)
di: Shi, Yuchen, et al.
Pubblicazione: (2024)
MAS-ZERO: Designing Multi-Agent Systems with Zero Supervision
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
MARLIN: Multi-Agent Reinforcement Learning for Incremental DAG Discovery
di: Li, Dong, et al.
Pubblicazione: (2026)
di: Li, Dong, et al.
Pubblicazione: (2026)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
di: Hao, Chuzhan, et al.
Pubblicazione: (2025)
di: Hao, Chuzhan, et al.
Pubblicazione: (2025)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
di: Bae, Sangjun, et al.
Pubblicazione: (2026)
di: Bae, Sangjun, et al.
Pubblicazione: (2026)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
Reinforcement Learning for Long-Horizon Interactive LLM Agents
di: Chen, Kevin, et al.
Pubblicazione: (2025)
di: Chen, Kevin, et al.
Pubblicazione: (2025)
Conformal Symplectic Optimization for Stable Reinforcement Learning
di: Lyu, Yao, et al.
Pubblicazione: (2024)
di: Lyu, Yao, et al.
Pubblicazione: (2024)
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
Multi-Scenario Combination Based on Multi-Agent Reinforcement Learning to Optimize the Advertising Recommendation System
di: Zhao, Yang, et al.
Pubblicazione: (2024)
di: Zhao, Yang, et al.
Pubblicazione: (2024)
Reinforcement Learning for Machine Learning Engineering Agents
di: Yang, Sherry, et al.
Pubblicazione: (2025)
di: Yang, Sherry, et al.
Pubblicazione: (2025)
Advancing Multi-Organ Disease Care: A Hierarchical Multi-Agent Reinforcement Learning Framework
di: Tan, Daniel J., et al.
Pubblicazione: (2024)
di: Tan, Daniel J., et al.
Pubblicazione: (2024)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
di: He, Zhongyu, et al.
Pubblicazione: (2026)
di: He, Zhongyu, et al.
Pubblicazione: (2026)
Latent-Space Contrastive Reinforcement Learning for Stable and Efficient LLM Reasoning
di: Shan, Lianlei, et al.
Pubblicazione: (2026)
di: Shan, Lianlei, et al.
Pubblicazione: (2026)
AgentOCR: Reimagining Agent History via Optical Self-Compression
di: Feng, Lang, et al.
Pubblicazione: (2026)
di: Feng, Lang, et al.
Pubblicazione: (2026)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
di: Zheng, Xuejing, et al.
Pubblicazione: (2024)
di: Zheng, Xuejing, et al.
Pubblicazione: (2024)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
A Versatile Graph Learning Approach through LLM-based Agent
di: Wei, Lanning, et al.
Pubblicazione: (2023)
di: Wei, Lanning, et al.
Pubblicazione: (2023)
Agent Lightning: Train ANY AI Agents with Reinforcement Learning
di: Luo, Xufang, et al.
Pubblicazione: (2025)
di: Luo, Xufang, et al.
Pubblicazione: (2025)
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
di: Feng, Lang, et al.
Pubblicazione: (2025)
di: Feng, Lang, et al.
Pubblicazione: (2025)
FairAgent: Democratizing Fairness-Aware Machine Learning with LLM-Powered Agents
di: Dai, Yucong, et al.
Pubblicazione: (2025)
di: Dai, Yucong, et al.
Pubblicazione: (2025)
Towards Principled Unsupervised Multi-Agent Reinforcement Learning
di: Zamboni, Riccardo, et al.
Pubblicazione: (2025)
di: Zamboni, Riccardo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Efficient Online Tuning of VLM Agents via Counterfactual Soft Reinforcement Learning
di: Feng, Lang, et al.
Pubblicazione: (2025) -
Dr. Kernel: Reinforcement Learning Done Right for Triton Kernel Generations
di: Liu, Wei, et al.
Pubblicazione: (2026) -
Group-in-Group Policy Optimization for LLM Agent Training
di: Feng, Lang, et al.
Pubblicazione: (2025) -
Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates
di: Li, Yibo, et al.
Pubblicazione: (2026) -
ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering
di: Liu, Zexi, et al.
Pubblicazione: (2025)