Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wijesundara, Chulabhaya, Baisero, Andrea, Li, Zhongheng, Castañón, Gregory, Carlin, Alan, Amato, Christopher |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning
von: Baisero, Andrea, et al.
Veröffentlicht: (2025)
von: Baisero, Andrea, et al.
Veröffentlicht: (2025)
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning
von: Amato, Christopher
Veröffentlicht: (2024)
von: Amato, Christopher
Veröffentlicht: (2024)
On Stateful Value Factorization in Multi-Agent Reinforcement Learning
von: Marchesini, Enrico, et al.
Veröffentlicht: (2024)
von: Marchesini, Enrico, et al.
Veröffentlicht: (2024)
An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning
von: Amato, Christopher
Veröffentlicht: (2024)
von: Amato, Christopher
Veröffentlicht: (2024)
On Centralized Critics in Multi-Agent Reinforcement Learning
von: Lyu, Xueguang, et al.
Veröffentlicht: (2024)
von: Lyu, Xueguang, et al.
Veröffentlicht: (2024)
Cross-Modal Navigation with Multi-Agent Reinforcement Learning
von: Liu, Shuo, et al.
Veröffentlicht: (2026)
von: Liu, Shuo, et al.
Veröffentlicht: (2026)
HCPO: Hierarchical Conductor-Based Policy Optimization in Multi-Agent Reinforcement Learning
von: Liu, Zejiao, et al.
Veröffentlicht: (2025)
von: Liu, Zejiao, et al.
Veröffentlicht: (2025)
Rethinking Trust Region Bayesian Optimization in High Dimensions
von: Tang, Wei-Ting, et al.
Veröffentlicht: (2026)
von: Tang, Wei-Ting, et al.
Veröffentlicht: (2026)
Trajectory-Aware Eligibility Traces for Off-Policy Reinforcement Learning
von: Daley, Brett, et al.
Veröffentlicht: (2023)
von: Daley, Brett, et al.
Veröffentlicht: (2023)
Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning
von: Marzi, Tommaso, et al.
Veröffentlicht: (2025)
von: Marzi, Tommaso, et al.
Veröffentlicht: (2025)
Trust-Region Adaptive Policy Optimization
von: Su, Mingyu, et al.
Veröffentlicht: (2025)
von: Su, Mingyu, et al.
Veröffentlicht: (2025)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
von: Chen, Tianyu, et al.
Veröffentlicht: (2024)
von: Chen, Tianyu, et al.
Veröffentlicht: (2024)
SleeperNets: Universal Backdoor Poisoning Attacks Against Reinforcement Learning Agents
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
Trust Region Inverse Reinforcement Learning: Explicit Dual Ascent using Local Policy Updates
von: Diwan, Anish, et al.
Veröffentlicht: (2026)
von: Diwan, Anish, et al.
Veröffentlicht: (2026)
Reinforced Model Predictive Control via Trust-Region Quasi-Newton Policy Optimization
von: Brandner, Dean, et al.
Veröffentlicht: (2024)
von: Brandner, Dean, et al.
Veröffentlicht: (2024)
BandPO: Bridging Trust Regions and Ratio Clipping via Probability-Aware Bounds for LLM Reinforcement Learning
von: Li, Yuan, et al.
Veröffentlicht: (2026)
von: Li, Yuan, et al.
Veröffentlicht: (2026)
ETR: Outcome-Guided Elastic Trust Regions for Policy Optimization
von: Zhang, Shijie, et al.
Veröffentlicht: (2026)
von: Zhang, Shijie, et al.
Veröffentlicht: (2026)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
von: Liu, Zongkai, et al.
Veröffentlicht: (2024)
Trust Regions Sell, But Who's Buying? Overlap Geometry as an Alternative Trust Region for Policy Optimization
von: Trivedi, Gaurish, et al.
Veröffentlicht: (2026)
von: Trivedi, Gaurish, et al.
Veröffentlicht: (2026)
Trust Region On-Policy Distillation
von: Xing, Xingrun, et al.
Veröffentlicht: (2026)
von: Xing, Xingrun, et al.
Veröffentlicht: (2026)
Matrix Low-Rank Trust Region Policy Optimization
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
von: Rozada, Sergio, et al.
Veröffentlicht: (2024)
Trust-Region Twisted Policy Improvement
von: de Vries, Joery A., et al.
Veröffentlicht: (2025)
von: de Vries, Joery A., et al.
Veröffentlicht: (2025)
QUATRO: Query-Adaptive Trust Region Policy Optimization for LLM Fine-tuning
von: Lee, Doyeon, et al.
Veröffentlicht: (2026)
von: Lee, Doyeon, et al.
Veröffentlicht: (2026)
Trust-based Consensus in Multi-Agent Reinforcement Learning Systems
von: Fung, Ho Long, et al.
Veröffentlicht: (2022)
von: Fung, Ho Long, et al.
Veröffentlicht: (2022)
Adversarial Inception Backdoor Attacks against Reinforcement Learning
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
von: Rathbun, Ethan, et al.
Veröffentlicht: (2024)
Trust Region Continual Learning as an Implicit Meta-Learner
von: Wang, Zekun, et al.
Veröffentlicht: (2026)
von: Wang, Zekun, et al.
Veröffentlicht: (2026)
TROLL: Trust Regions improve Reinforcement Learning for Large Language Models
von: Becker, Philipp, et al.
Veröffentlicht: (2025)
von: Becker, Philipp, et al.
Veröffentlicht: (2025)
Trust, Don't Trust, or Flip: Robust Preference-Based Reinforcement Learning with Multi-Expert Feedback
von: Hosseini, Seyed Amir, et al.
Veröffentlicht: (2026)
von: Hosseini, Seyed Amir, et al.
Veröffentlicht: (2026)
EPO: Entropy-regularized Policy Optimization for LLM Agents Reinforcement Learning
von: Xu, Wujiang, et al.
Veröffentlicht: (2025)
von: Xu, Wujiang, et al.
Veröffentlicht: (2025)
Multi-Scenario Combination Based on Multi-Agent Reinforcement Learning to Optimize the Advertising Recommendation System
von: Zhao, Yang, et al.
Veröffentlicht: (2024)
von: Zhao, Yang, et al.
Veröffentlicht: (2024)
Trust Region Masking for Long-Horizon LLM Reinforcement Learning
von: Li, Yingru, et al.
Veröffentlicht: (2025)
von: Li, Yingru, et al.
Veröffentlicht: (2025)
Exploring Equity of Climate Policies using Multi-Agent Multi-Objective Reinforcement Learning
von: Biswas, Palok, et al.
Veröffentlicht: (2025)
von: Biswas, Palok, et al.
Veröffentlicht: (2025)
Vision-Based Generic Potential Function for Policy Alignment in Multi-Agent Reinforcement Learning
von: Ma, Hao, et al.
Veröffentlicht: (2025)
von: Ma, Hao, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
von: Alon, Yoav, et al.
Veröffentlicht: (2020)
von: Alon, Yoav, et al.
Veröffentlicht: (2020)
Action-Graph Policies: Learning Action Co-dependencies in Multi-Agent Reinforcement Learning
von: Gupta, Nikunj, et al.
Veröffentlicht: (2026)
von: Gupta, Nikunj, et al.
Veröffentlicht: (2026)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
von: Reddi, Aryaman, et al.
Veröffentlicht: (2025)
von: Reddi, Aryaman, et al.
Veröffentlicht: (2025)
CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning
von: Hedman, Marcel, et al.
Veröffentlicht: (2026)
von: Hedman, Marcel, et al.
Veröffentlicht: (2026)
Toward Finding Strong Pareto Optimal Policies in Multi-Agent Reinforcement Learning
von: Le, Bang Giang, et al.
Veröffentlicht: (2024)
von: Le, Bang Giang, et al.
Veröffentlicht: (2024)
Higher Replay Ratio Empowers Sample-Efficient Multi-Agent Reinforcement Learning
von: Xu, Linjie, et al.
Veröffentlicht: (2024)
von: Xu, Linjie, et al.
Veröffentlicht: (2024)
Encoding Agent Trajectories as Representations with Sequence Transformers
von: Tsiligkaridis, Athanasios, et al.
Veröffentlicht: (2024)
von: Tsiligkaridis, Athanasios, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning
von: Baisero, Andrea, et al.
Veröffentlicht: (2025) -
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning
von: Amato, Christopher
Veröffentlicht: (2024) -
On Stateful Value Factorization in Multi-Agent Reinforcement Learning
von: Marchesini, Enrico, et al.
Veröffentlicht: (2024) -
An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning
von: Amato, Christopher
Veröffentlicht: (2024) -
On Centralized Critics in Multi-Agent Reinforcement Learning
von: Lyu, Xueguang, et al.
Veröffentlicht: (2024)