Multi-Agent Trust Region Policy Optimisation: A Joint Constraint Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Shek, Chak Lam, Shi, Guangyao, Tokekar, Pratap |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
When to Localize? A Risk-Constrained Reinforcement Learning Approach
di: Shek, Chak Lam, et al.
Pubblicazione: (2024)
di: Shek, Chak Lam, et al.
Pubblicazione: (2024)
Decision-Oriented Learning Using Differentiable Submodular Maximization for Multi-Robot Coordination
di: Shi, Guangyao, et al.
Pubblicazione: (2023)
di: Shi, Guangyao, et al.
Pubblicazione: (2023)
Learning Multi-Robot Coordination through Locality-Based Factorized Multi-Agent Actor-Critic Algorithm
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
Contextual Neural Moving Horizon Estimation for Robust Quadrotor Control in Varying Conditions
di: Torshizi, Kasra, et al.
Pubblicazione: (2025)
di: Torshizi, Kasra, et al.
Pubblicazione: (2025)
Active Asymmetric Multi-Agent Multimodal Learning under Uncertainty
di: Liu, Rui, et al.
Pubblicazione: (2026)
di: Liu, Rui, et al.
Pubblicazione: (2026)
Beyond Joint Demonstrations: Personalized Expert Guidance for Efficient Multi-Agent Reinforcement Learning
di: Yu, Peihong, et al.
Pubblicazione: (2024)
di: Yu, Peihong, et al.
Pubblicazione: (2024)
CAML: Collaborative Auxiliary Modality Learning for Multi-Agent Systems
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
KGLAMP: Knowledge Graph-guided Language model for Adaptive Multi-robot Planning and Replanning
di: Shek, Chak Lam, et al.
Pubblicazione: (2026)
di: Shek, Chak Lam, et al.
Pubblicazione: (2026)
Towards Efficient Risk-Sensitive Policy Gradient: An Iteration Complexity Analysis
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
di: Barakat, Anas, et al.
Pubblicazione: (2024)
di: Barakat, Anas, et al.
Pubblicazione: (2024)
SuperLocalMemory: Privacy-Preserving Multi-Agent Memory with Bayesian Trust Defense Against Memory Poisoning
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
PLANRL: A Motion Planning and Imitation Learning Framework to Bootstrap Reinforcement Learning
di: Bhaskar, Amisha, et al.
Pubblicazione: (2024)
di: Bhaskar, Amisha, et al.
Pubblicazione: (2024)
Adaptive Visual Imitation Learning for Robotic Assisted Feeding Across Varied Bowl Configurations and Food Types
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
IMRL: Integrating Visual, Physical, Temporal, and Geometric Representations for Enhanced Food Acquisition
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
di: McClellan, Joshua, et al.
Pubblicazione: (2024)
di: McClellan, Joshua, et al.
Pubblicazione: (2024)
Data-Driven Distributionally Robust Optimal Control with State-Dependent Noise
di: Liu, Rui, et al.
Pubblicazione: (2023)
di: Liu, Rui, et al.
Pubblicazione: (2023)
MMCD: Multi-Modal Collaborative Decision-Making for Connected Autonomy with Knowledge Distillation
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
PEnGUiN: Partially Equivariant Graph NeUral Networks for Sample Efficient MARL
di: McClellan, Joshua, et al.
Pubblicazione: (2025)
di: McClellan, Joshua, et al.
Pubblicazione: (2025)
Fast Biconnectivity Restoration in Multi-Robot Systems for Robust Communication Maintenance
di: Ishat-E-Rabban, Md, et al.
Pubblicazione: (2020)
di: Ishat-E-Rabban, Md, et al.
Pubblicazione: (2020)
Adaptive Conformal Guidance for Learning under Uncertainty
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
Trust-Region Adaptive Policy Optimization
di: Su, Mingyu, et al.
Pubblicazione: (2025)
di: Su, Mingyu, et al.
Pubblicazione: (2025)
AFFORD2ACT: Affordance-Guided Automatic Keypoint Selection for Generalizable and Lightweight Robotic Manipulation
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
Sketch-to-Skill: Bootstrapping Robot Learning with Human Drawn Trajectory Sketches
di: Yu, Peihong, et al.
Pubblicazione: (2025)
di: Yu, Peihong, et al.
Pubblicazione: (2025)
Trust Regions Sell, But Who's Buying? Overlap Geometry as an Alternative Trust Region for Policy Optimization
di: Trivedi, Gaurish, et al.
Pubblicazione: (2026)
di: Trivedi, Gaurish, et al.
Pubblicazione: (2026)
Trust-Region Behavior Blending for On-Policy Distillation
di: Plyusov, Daniil, et al.
Pubblicazione: (2026)
di: Plyusov, Daniil, et al.
Pubblicazione: (2026)
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
Matrix Low-Rank Trust Region Policy Optimization
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
di: Rozada, Sergio, et al.
Pubblicazione: (2024)
Holder Policy Optimisation
di: Chen, Yuxiang, et al.
Pubblicazione: (2026)
di: Chen, Yuxiang, et al.
Pubblicazione: (2026)
DynaTrust: Defending Multi-Agent Systems Against Sleeper Agents via Dynamic Trust Graphs
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
AutoAgents: A Framework for Automatic Agent Generation
di: Chen, Guangyao, et al.
Pubblicazione: (2023)
di: Chen, Guangyao, et al.
Pubblicazione: (2023)
Fast k-connectivity Restoration in Multi-Robot Systems for Robust Communication Maintenance
di: Ishat-E-Rabban, Md, et al.
Pubblicazione: (2024)
di: Ishat-E-Rabban, Md, et al.
Pubblicazione: (2024)
Dual-Uncertainty Guided Policy Learning for Multimodal Reasoning
di: Liu, Rui, et al.
Pubblicazione: (2025)
di: Liu, Rui, et al.
Pubblicazione: (2025)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
PIP-LLM: Integrating PDDL-Integer Programming with LLMs for Coordinating Multi-Robot Teams Using Natural Language
di: Shi, Guangyao, et al.
Pubblicazione: (2025)
di: Shi, Guangyao, et al.
Pubblicazione: (2025)
Optimising Call Centre Operations using Reinforcement Learning: Value Iteration versus Proximal Policy Optimisation
di: Li, Kwong Ho, et al.
Pubblicazione: (2025)
di: Li, Kwong Ho, et al.
Pubblicazione: (2025)
A Factor Graph Model of Trust for a Collaborative Multi-Agent System
di: Akbari, Behzad, et al.
Pubblicazione: (2024)
di: Akbari, Behzad, et al.
Pubblicazione: (2024)
Agent Behavioral Contracts: Formal Specification and Runtime Enforcement for Reliable Autonomous AI Agents
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
Traffic Flow Optimisation for Lifelong Multi-Agent Path Finding
di: Chen, Zhe, et al.
Pubblicazione: (2023)
di: Chen, Zhe, et al.
Pubblicazione: (2023)
Qualixar OS: A Universal Operating System for AI Agent Orchestration
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
Documenti analoghi
-
Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning
di: Shek, Chak Lam, et al.
Pubblicazione: (2025) -
When to Localize? A Risk-Constrained Reinforcement Learning Approach
di: Shek, Chak Lam, et al.
Pubblicazione: (2024) -
Decision-Oriented Learning Using Differentiable Submodular Maximization for Multi-Robot Coordination
di: Shi, Guangyao, et al.
Pubblicazione: (2023) -
Learning Multi-Robot Coordination through Locality-Based Factorized Multi-Agent Actor-Critic Algorithm
di: Shek, Chak Lam, et al.
Pubblicazione: (2025) -
Contextual Neural Moving Horizon Estimation for Robust Quadrotor Control in Varying Conditions
di: Torshizi, Kasra, et al.
Pubblicazione: (2025)