Vision-Based Generic Potential Function for Policy Alignment in Multi-Agent Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Hao, Wang, Shijie, Pu, Zhiqiang, Zhao, Siyao, Ai, Xiaolin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
Measuring Policy Distance for Multi-Agent Reinforcement Learning
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
di: Hu, Tianyi, et al.
Pubblicazione: (2024)
SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learning Systems
di: Ma, Oubo, et al.
Pubblicazione: (2024)
di: Ma, Oubo, et al.
Pubblicazione: (2024)
Self-Clustering Hierarchical Multi-Agent Reinforcement Learning with Extensible Cooperation Graph
di: Fu, Qingxu, et al.
Pubblicazione: (2024)
di: Fu, Qingxu, et al.
Pubblicazione: (2024)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction
di: Feng, Jinyuan, et al.
Pubblicazione: (2024)
di: Feng, Jinyuan, et al.
Pubblicazione: (2024)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
Coevolving with the Other You: Fine-Tuning LLM with Sequential Cooperative Multi-Agent Reinforcement Learning
di: Ma, Hao, et al.
Pubblicazione: (2024)
di: Ma, Hao, et al.
Pubblicazione: (2024)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
di: Wang, Xuefeng, et al.
Pubblicazione: (2024)
di: Wang, Xuefeng, et al.
Pubblicazione: (2024)
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization
di: Li, Simin, et al.
Pubblicazione: (2023)
di: Li, Simin, et al.
Pubblicazione: (2023)
NePPO: Near-Potential Policy Optimization for General-Sum Multi-Agent Reinforcement Learning
di: Kalanther, Addison, et al.
Pubblicazione: (2026)
di: Kalanther, Addison, et al.
Pubblicazione: (2026)
Robust Driving Control for Autonomous Vehicles: An Intelligent General-sum Constrained Adversarial Reinforcement Learning Approach
di: Fan, Junchao, et al.
Pubblicazione: (2025)
di: Fan, Junchao, et al.
Pubblicazione: (2025)
Multi-Scenario Combination Based on Multi-Agent Reinforcement Learning to Optimize the Advertising Recommendation System
di: Zhao, Yang, et al.
Pubblicazione: (2024)
di: Zhao, Yang, et al.
Pubblicazione: (2024)
Efficient Soft Actor-Critic with LLM-Based Action-Level Guidance for Continuous Control
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
Flow-Based Policy for Online Reinforcement Learning
di: Lv, Lei, et al.
Pubblicazione: (2025)
di: Lv, Lei, et al.
Pubblicazione: (2025)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
Generalization Limits of Reinforcement Learning Alignment
di: Shida, Haruhi, et al.
Pubblicazione: (2026)
di: Shida, Haruhi, et al.
Pubblicazione: (2026)
Rethinking Plasticity in Deep Reinforcement Learning
di: He, Zhiqiang
Pubblicazione: (2026)
di: He, Zhiqiang
Pubblicazione: (2026)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
di: Hao, Chuzhan, et al.
Pubblicazione: (2025)
di: Hao, Chuzhan, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
di: Huang, Chang, et al.
Pubblicazione: (2024)
di: Huang, Chang, et al.
Pubblicazione: (2024)
Mitigating Relative Over-Generalization in Multi-Agent Reinforcement Learning
di: Zhu, Ting, et al.
Pubblicazione: (2024)
di: Zhu, Ting, et al.
Pubblicazione: (2024)
Cooperative Edge Caching Based on Elastic Federated and Multi-Agent Deep Reinforcement Learning in Next-Generation Network
di: Wu, Qiong, et al.
Pubblicazione: (2024)
di: Wu, Qiong, et al.
Pubblicazione: (2024)
MARLIN: Multi-Agent Reinforcement Learning for Incremental DAG Discovery
di: Li, Dong, et al.
Pubblicazione: (2026)
di: Li, Dong, et al.
Pubblicazione: (2026)
Flow-based Policy With Distributional Reinforcement Learning in Trajectory Optimization
di: Hao, Ruijie, et al.
Pubblicazione: (2026)
di: Hao, Ruijie, et al.
Pubblicazione: (2026)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions
di: Jing, Gangshan, et al.
Pubblicazione: (2022)
di: Jing, Gangshan, et al.
Pubblicazione: (2022)
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
Centralized Permutation Equivariant Policy for Cooperative Multi-Agent Reinforcement Learning
di: Xu, Zhuofan, et al.
Pubblicazione: (2025)
di: Xu, Zhuofan, et al.
Pubblicazione: (2025)
Multi-objective Reinforcement Learning: A Tool for Pluralistic Alignment
di: Vamplew, Peter, et al.
Pubblicazione: (2024)
di: Vamplew, Peter, et al.
Pubblicazione: (2024)
Space Alignment Matters: The Missing Piece for Inducing Neural Collapse in Long-Tailed Learning
di: Wang, Jinping, et al.
Pubblicazione: (2025)
di: Wang, Jinping, et al.
Pubblicazione: (2025)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
di: Alon, Yoav, et al.
Pubblicazione: (2020)
di: Alon, Yoav, et al.
Pubblicazione: (2020)
ESP: Exploiting Symmetry Prior for Multi-Agent Reinforcement Learning
di: Yu, Xin, et al.
Pubblicazione: (2023)
di: Yu, Xin, et al.
Pubblicazione: (2023)
Policy-regularized Offline Multi-objective Reinforcement Learning
di: Lin, Qian, et al.
Pubblicazione: (2024)
di: Lin, Qian, et al.
Pubblicazione: (2024)
Multi-Agent Deep Reinforcement Learning Under Constrained Communications
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
di: Shaik, Shahil, et al.
Pubblicazione: (2026)
Off-Policy Correction For Multi-Agent Reinforcement Learning
di: Zawalski, Michał, et al.
Pubblicazione: (2021)
di: Zawalski, Michał, et al.
Pubblicazione: (2021)
Tree Search for LLM Agent Reinforcement Learning
di: Ji, Yuxiang, et al.
Pubblicazione: (2025)
di: Ji, Yuxiang, et al.
Pubblicazione: (2025)
Centralized Reward Agent for Knowledge Sharing and Transfer in Multi-Task Reinforcement Learning
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
$Agent^2$: An Agent-Generates-Agent Framework for Reinforcement Learning Automation
di: Wei, Yuan, et al.
Pubblicazione: (2025)
di: Wei, Yuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026) -
Measuring Policy Distance for Multi-Agent Reinforcement Learning
di: Hu, Tianyi, et al.
Pubblicazione: (2024) -
SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learning Systems
di: Ma, Oubo, et al.
Pubblicazione: (2024) -
Self-Clustering Hierarchical Multi-Agent Reinforcement Learning with Extensible Cooperation Graph
di: Fu, Qingxu, et al.
Pubblicazione: (2024) -
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)