Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Zhenyu, Zhang, Yiting, Zhang, Yutong, Zhang, Jianshu, Luo, Haozheng, Han, Yuwei, Wu, Dennis, Chen, Hong-Yu, Yu, Philip S., Li, Manling, Liu, Han |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement Learning
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
FairReason: Balancing Reasoning and Social Bias in MLLMs
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
por: Pan, Zhenyu, et al.
Publicado: (2024)
por: Pan, Zhenyu, et al.
Publicado: (2024)
Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models
por: Pan, Zhenyu, et al.
Publicado: (2024)
por: Pan, Zhenyu, et al.
Publicado: (2024)
EvoNash-MARL: A Closed-Loop Multi-Agent Reinforcement Learning Framework for Medium-Horizon Equity Allocation
por: Jia, Chongliu, et al.
Publicado: (2026)
por: Jia, Chongliu, et al.
Publicado: (2026)
EvoMAS: Evolutionary Generation of Multi-Agent Systems
por: Hu, Yuntong, et al.
Publicado: (2026)
por: Hu, Yuntong, et al.
Publicado: (2026)
CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification
por: Zhang, Hanrong, et al.
Publicado: (2026)
por: Zhang, Hanrong, et al.
Publicado: (2026)
Smart Interrupted Routing Based on Multi-head Attention Mask Mechanism-Driven MARL in Software-defined UASNs
por: Wang, Zhenyu, et al.
Publicado: (2025)
por: Wang, Zhenyu, et al.
Publicado: (2025)
Topology Enhanced MARL for Multi-Vehicle Cooperative Decision-Making of CAVs
por: Han, Ye, et al.
Publicado: (2025)
por: Han, Ye, et al.
Publicado: (2025)
Network Topology and Information Efficiency of Multi-Agent Systems: Study based on MARL
por: Zhang, Xinren, et al.
Publicado: (2025)
por: Zhang, Xinren, et al.
Publicado: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
por: Feng, Kehua, et al.
Publicado: (2025)
por: Feng, Kehua, et al.
Publicado: (2025)
YOLO-MARL: You Only LLM Once for Multi-Agent Reinforcement Learning
por: Zhuang, Yuan, et al.
Publicado: (2024)
por: Zhuang, Yuan, et al.
Publicado: (2024)
MARL-MambaContour: Unleashing Multi-Agent Deep Reinforcement Learning for Active Contour Optimization in Medical Image Segmentation
por: Zhang, Ruicheng, et al.
Publicado: (2025)
por: Zhang, Ruicheng, et al.
Publicado: (2025)
BenchMARL: Benchmarking Multi-Agent Reinforcement Learning
por: Bettini, Matteo, et al.
Publicado: (2023)
por: Bettini, Matteo, et al.
Publicado: (2023)
EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms
por: Yuan, Siyu, et al.
Publicado: (2024)
por: Yuan, Siyu, et al.
Publicado: (2024)
EvoGM: Learning to Merge LLMs via Evolutionary Generative Optimization
por: Jiang, Tao, et al.
Publicado: (2026)
por: Jiang, Tao, et al.
Publicado: (2026)
EvoCorps: An Evolutionary Multi-Agent Framework for Depolarizing Online Discourse
por: Lin, Ning, et al.
Publicado: (2026)
por: Lin, Ning, et al.
Publicado: (2026)
RefEvo: Agentic Design with Co-Evolutionary Verification for Agile Reference Model Generation
por: Zhang, Yifan, et al.
Publicado: (2026)
por: Zhang, Yifan, et al.
Publicado: (2026)
MARL-GPT: Foundation Model for Multi-Agent Reinforcement Learning
por: Nesterova, Maria, et al.
Publicado: (2026)
por: Nesterova, Maria, et al.
Publicado: (2026)
LangMARL: Natural Language Multi-Agent Reinforcement Learning
por: Yao, Huaiyuan, et al.
Publicado: (2026)
por: Yao, Huaiyuan, et al.
Publicado: (2026)
SMUTF: Schema Matching Using Generative Tags and Hybrid Features
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
State-Novelty Guided Action Persistence in Deep Reinforcement Learning
por: Hu, Jianshu, et al.
Publicado: (2024)
por: Hu, Jianshu, et al.
Publicado: (2024)
EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning
por: Liu, Huanyu, et al.
Publicado: (2025)
por: Liu, Huanyu, et al.
Publicado: (2025)
Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning
por: Dong, Shihao, et al.
Publicado: (2026)
por: Dong, Shihao, et al.
Publicado: (2026)
MARL-OT: Multi-Agent Reinforcement Learning Guided Online Fuzzing to Detect Safety Violation in Autonomous Driving Systems
por: Liang, Linfeng, et al.
Publicado: (2025)
por: Liang, Linfeng, et al.
Publicado: (2025)
EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution
por: Hu, Haichuan, et al.
Publicado: (2026)
por: Hu, Haichuan, et al.
Publicado: (2026)
MetaSpatial: Reinforcing 3D Spatial Reasoning in VLMs for the Metaverse
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
Co-Evolution of Policy and Internal Reward for Language Agents
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
MLLM-Protector: Ensuring MLLM's Safety without Hurting Performance
por: Pi, Renjie, et al.
Publicado: (2024)
por: Pi, Renjie, et al.
Publicado: (2024)
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
por: Xing, Sixue, et al.
Publicado: (2026)
por: Xing, Sixue, et al.
Publicado: (2026)
Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks
por: Feng, Pu, et al.
Publicado: (2024)
por: Feng, Pu, et al.
Publicado: (2024)
KD-MARL: Resource-Aware Knowledge Distillation in Multi-Agent Reinforcement Learning
por: Pavel, Monirul Islam, et al.
Publicado: (2026)
por: Pavel, Monirul Islam, et al.
Publicado: (2026)
Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
DialogGuard: Multi-Agent Psychosocial Safety Evaluation of Sensitive LLM Responses
por: Luo, Han, et al.
Publicado: (2025)
por: Luo, Han, et al.
Publicado: (2025)
EvoRL: A GPU-accelerated Framework for Evolutionary Reinforcement Learning
por: Zheng, Bowen, et al.
Publicado: (2025)
por: Zheng, Bowen, et al.
Publicado: (2025)
Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL
por: Zhang, Songyuan, et al.
Publicado: (2025)
por: Zhang, Songyuan, et al.
Publicado: (2025)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
por: Zhang, Guibin, et al.
Publicado: (2026)
por: Zhang, Guibin, et al.
Publicado: (2026)
EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegation
por: Zhang, Aimin, et al.
Publicado: (2026)
por: Zhang, Aimin, et al.
Publicado: (2026)
Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning
por: Jiang, Eric Hanchen, et al.
Publicado: (2026)
por: Jiang, Eric Hanchen, et al.
Publicado: (2026)
EvoPool: Evolutionary Programmatic Annotation for Label-Efficient Specialized Supervision
por: Xu, Tianyi, et al.
Publicado: (2026)
por: Xu, Tianyi, et al.
Publicado: (2026)
Ejemplares similares
-
AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement Learning
por: Pan, Zhenyu, et al.
Publicado: (2025) -
FairReason: Balancing Reasoning and Social Bias in MLLMs
por: Pan, Zhenyu, et al.
Publicado: (2025) -
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
por: Pan, Zhenyu, et al.
Publicado: (2024) -
Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models
por: Pan, Zhenyu, et al.
Publicado: (2024) -
EvoNash-MARL: A Closed-Loop Multi-Agent Reinforcement Learning Framework for Medium-Horizon Equity Allocation
por: Jia, Chongliu, et al.
Publicado: (2026)