Coevolving with the Other You: Fine-Tuning LLM with Sequential Cooperative Multi-Agent Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Hao, Hu, Tianyi, Pu, Zhiqiang, Liu, Boyin, Ai, Xiaolin, Liang, Yanyan, Chen, Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Measuring Policy Distance for Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2024)
por: Hu, Tianyi, et al.
Publicado: (2024)
Causal Mean Field Multi-Agent Reinforcement Learning
por: Ma, Hao, et al.
Publicado: (2025)
por: Ma, Hao, et al.
Publicado: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
por: Feng, Jinyuan, et al.
Publicado: (2025)
por: Feng, Jinyuan, et al.
Publicado: (2025)
Heterogeneity in Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2025)
por: Hu, Tianyi, et al.
Publicado: (2025)
YOLO-MARL: You Only LLM Once for Multi-Agent Reinforcement Learning
por: Zhuang, Yuan, et al.
Publicado: (2024)
por: Zhuang, Yuan, et al.
Publicado: (2024)
Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks
por: Feng, Pu, et al.
Publicado: (2024)
por: Feng, Pu, et al.
Publicado: (2024)
Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent Reinforcement Learning
por: Gao, Zihong, et al.
Publicado: (2026)
por: Gao, Zihong, et al.
Publicado: (2026)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
por: Bae, Sangjun, et al.
Publicado: (2026)
por: Bae, Sangjun, et al.
Publicado: (2026)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
por: Liang, Yongheng, et al.
Publicado: (2024)
por: Liang, Yongheng, et al.
Publicado: (2024)
Graphon Mean-Field Control for Cooperative Multi-Agent Reinforcement Learning
por: Hu, Yuanquan, et al.
Publicado: (2022)
por: Hu, Yuanquan, et al.
Publicado: (2022)
An Improved Multi-Agent Algorithm for Cooperative and Competitive Environments by Identifying and Encouraging Cooperation among Agents
por: Qi, Junjie, et al.
Publicado: (2025)
por: Qi, Junjie, et al.
Publicado: (2025)
MARFT: Multi-Agent Reinforcement Fine-Tuning
por: Liao, Junwei, et al.
Publicado: (2025)
por: Liao, Junwei, et al.
Publicado: (2025)
Learning Nudges for Conditional Cooperation: A Multi-Agent Reinforcement Learning Model
por: Kulkarni, Shatayu, et al.
Publicado: (2024)
por: Kulkarni, Shatayu, et al.
Publicado: (2024)
Bottom-Up Reputation Promotes Cooperation with Multi-Agent Reinforcement Learning
por: Ren, Tianyu, et al.
Publicado: (2025)
por: Ren, Tianyu, et al.
Publicado: (2025)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
por: Zhang, Junkai, et al.
Publicado: (2024)
por: Zhang, Junkai, et al.
Publicado: (2024)
Insider Attacks in Multi-Agent LLM Consensus Systems
por: Sun, Xiaolin, et al.
Publicado: (2026)
por: Sun, Xiaolin, et al.
Publicado: (2026)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
por: Ma, Hao, et al.
Publicado: (2026)
por: Ma, Hao, et al.
Publicado: (2026)
Multi-AUV Cooperative Underwater Multi-Target Tracking Based on Dynamic-Switching-enabled Multi-Agent Reinforcement Learning
por: Wang, Shengbo, et al.
Publicado: (2024)
por: Wang, Shengbo, et al.
Publicado: (2024)
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning
por: Amato, Christopher
Publicado: (2024)
por: Amato, Christopher
Publicado: (2024)
Interactive Distillation for Cooperative Multi-Agent Reinforcement Learning
por: Cho, Minwoo, et al.
Publicado: (2026)
por: Cho, Minwoo, et al.
Publicado: (2026)
Cooperation and Fairness in Multi-Agent Reinforcement Learning
por: Aloor, Jasmine Jerry, et al.
Publicado: (2024)
por: Aloor, Jasmine Jerry, et al.
Publicado: (2024)
MARLadona -- Towards Cooperative Team Play Using Multi-Agent Reinforcement Learning
por: Li, Zichong, et al.
Publicado: (2024)
por: Li, Zichong, et al.
Publicado: (2024)
Multi Agent Reinforcement Learning for Sequential Satellite Assignment Problems
por: Holder, Joshua, et al.
Publicado: (2024)
por: Holder, Joshua, et al.
Publicado: (2024)
TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination
por: Xie, Yi, et al.
Publicado: (2026)
por: Xie, Yi, et al.
Publicado: (2026)
From Pixels to Cooperation Multi Agent Reinforcement Learning based on Multimodal World Models
por: Akin, Sureyya, et al.
Publicado: (2025)
por: Akin, Sureyya, et al.
Publicado: (2025)
Safe Continuous-time Multi-Agent Reinforcement Learning via Epigraph Form
por: Wang, Xuefeng, et al.
Publicado: (2026)
por: Wang, Xuefeng, et al.
Publicado: (2026)
Hierarchical Multi-Agent Reinforcement Learning-based Coordinated Spatial Reuse for Next Generation WLANs
por: Yu, Jiaming, et al.
Publicado: (2025)
por: Yu, Jiaming, et al.
Publicado: (2025)
Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning
por: Yu, Xin, et al.
Publicado: (2023)
por: Yu, Xin, et al.
Publicado: (2023)
LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning
por: Wu, Xiaoguang, et al.
Publicado: (2026)
por: Wu, Xiaoguang, et al.
Publicado: (2026)
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
por: Li, Simin, et al.
Publicado: (2025)
por: Li, Simin, et al.
Publicado: (2025)
Optimistic ε-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning
por: Zhang, Ruoning, et al.
Publicado: (2025)
por: Zhang, Ruoning, et al.
Publicado: (2025)
Efficient Episodic Memory Utilization of Cooperative Multi-Agent Reinforcement Learning
por: Na, Hyungho, et al.
Publicado: (2024)
por: Na, Hyungho, et al.
Publicado: (2024)
Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems
por: Hu, Liyuan
Publicado: (2025)
por: Hu, Liyuan
Publicado: (2025)
MO-MIX: Multi-Objective Multi-Agent Cooperative Decision-Making With Deep Reinforcement Learning
por: Hu, Tianmeng, et al.
Publicado: (2026)
por: Hu, Tianmeng, et al.
Publicado: (2026)
Continuous-Time Value Iteration for Multi-Agent Reinforcement Learning
por: Wang, Xuefeng, et al.
Publicado: (2025)
por: Wang, Xuefeng, et al.
Publicado: (2025)
Communicating Unexpectedness for Out-of-Distribution Multi-Agent Reinforcement Learning
por: Lee, Min Whoo, et al.
Publicado: (2025)
por: Lee, Min Whoo, et al.
Publicado: (2025)
Graph Based Deep Reinforcement Learning Aided by Transformers for Multi-Agent Cooperation
por: Elrod, Michael, et al.
Publicado: (2025)
por: Elrod, Michael, et al.
Publicado: (2025)
Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning
por: Oh, Dahyun, et al.
Publicado: (2026)
por: Oh, Dahyun, et al.
Publicado: (2026)
An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning
por: Amato, Christopher
Publicado: (2024)
por: Amato, Christopher
Publicado: (2024)
Mean-Field Approximation of Cooperative Constrained Multi-Agent Reinforcement Learning (CMARL)
por: Mondal, Washim Uddin, et al.
Publicado: (2022)
por: Mondal, Washim Uddin, et al.
Publicado: (2022)
Ejemplares similares
-
Measuring Policy Distance for Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2024) -
Causal Mean Field Multi-Agent Reinforcement Learning
por: Ma, Hao, et al.
Publicado: (2025) -
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
por: Feng, Jinyuan, et al.
Publicado: (2025) -
Heterogeneity in Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2025) -
YOLO-MARL: You Only LLM Once for Multi-Agent Reinforcement Learning
por: Zhuang, Yuan, et al.
Publicado: (2024)