Finite-Time Convergence and Sample Complexity of Actor-Critic Multi-Objective Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhou, Tianchen, Hairi, FNU, Yang, Haibo, Liu, Jia, Tong, Tian, Yang, Fan, Momma, Michinari, Gao, Yan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enabling Pareto-Stationarity Exploration in Multi-Objective Reinforcement Learning: A Multi-Objective Weighted-Chebyshev Actor-Critic Approach
von: Hairi, Fnu, et al.
Veröffentlicht: (2025)
von: Hairi, Fnu, et al.
Veröffentlicht: (2025)
STIMULUS: Achieving Fast Convergence and Low Sample Complexity in Stochastic Multi-Objective Learning
von: Liu, Zhuqing, et al.
Veröffentlicht: (2025)
von: Liu, Zhuqing, et al.
Veröffentlicht: (2025)
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning
von: Zhang, Zhiyao, et al.
Veröffentlicht: (2025)
von: Zhang, Zhiyao, et al.
Veröffentlicht: (2025)
Federated Multi-Objective Learning
von: Yang, Haibo, et al.
Veröffentlicht: (2023)
von: Yang, Haibo, et al.
Veröffentlicht: (2023)
Consensus-based Decentralized Multi-agent Reinforcement Learning for Random Access Network Optimization
von: Oh, Myeung Suk, et al.
Veröffentlicht: (2025)
von: Oh, Myeung Suk, et al.
Veröffentlicht: (2025)
Behavioral Feature Boosting via Substitute Relationships for E-commerce Search
von: Dong, Chaosheng, et al.
Veröffentlicht: (2026)
von: Dong, Chaosheng, et al.
Veröffentlicht: (2026)
Finite Time Analysis of Constrained Natural Critic-Actor Algorithm with Improved Sample Complexity
von: Panda, Prashansa, et al.
Veröffentlicht: (2025)
von: Panda, Prashansa, et al.
Veröffentlicht: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
von: Yang, Tong, et al.
Veröffentlicht: (2023)
von: Yang, Tong, et al.
Veröffentlicht: (2023)
Finite-time Convergence Analysis of Actor-Critic with Evolving Reward
von: Hu, Rui, et al.
Veröffentlicht: (2025)
von: Hu, Rui, et al.
Veröffentlicht: (2025)
Optimal Sample Complexity for Single Time-Scale Actor-Critic with Momentum
von: Kumar, Navdeep, et al.
Veröffentlicht: (2026)
von: Kumar, Navdeep, et al.
Veröffentlicht: (2026)
Actor-Critic Reinforcement Learning with Phased Actor
von: Wu, Ruofan, et al.
Veröffentlicht: (2024)
von: Wu, Ruofan, et al.
Veröffentlicht: (2024)
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
von: Fan, Jiale, et al.
Veröffentlicht: (2025)
von: Fan, Jiale, et al.
Veröffentlicht: (2025)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
von: Humayoo, Mahammad, et al.
Veröffentlicht: (2018)
von: Humayoo, Mahammad, et al.
Veröffentlicht: (2018)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
von: Ma, Xiaoteng, et al.
Veröffentlicht: (2020)
von: Ma, Xiaoteng, et al.
Veröffentlicht: (2020)
Adaptive Finite‐Time Optimal Control of Stochastic Nonlinear Systems via an Identifier‐Critic‐Actor Reinforcement Learning Algorithm: Application to Intelligent Ship Autopilot
von: Huanqing Wang, et al.
Veröffentlicht: (2025)
von: Huanqing Wang, et al.
Veröffentlicht: (2025)
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
von: Panda, Prashansa, et al.
Veröffentlicht: (2023)
von: Panda, Prashansa, et al.
Veröffentlicht: (2023)
Sample and Communication Efficient Fully Decentralized MARL Policy Evaluation via a New Approach: Local TD update
von: Hairi, Fnu, et al.
Veröffentlicht: (2024)
von: Hairi, Fnu, et al.
Veröffentlicht: (2024)
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration
von: Farid, Ali Moltajaei, et al.
Veröffentlicht: (2024)
von: Farid, Ali Moltajaei, et al.
Veröffentlicht: (2024)
Multi-Actor Multi-Critic Deep Deterministic Reinforcement Learning with a Novel Q-Ensemble Method
von: Wu, Andy, et al.
Veröffentlicht: (2025)
von: Wu, Andy, et al.
Veröffentlicht: (2025)
PSMGD: Periodic Stochastic Multi-Gradient Descent for Fast Multi-Objective Optimization
von: Xu, Mingjing, et al.
Veröffentlicht: (2024)
von: Xu, Mingjing, et al.
Veröffentlicht: (2024)
On the Convergence of Single-Timescale Actor-Critic
von: Kumar, Navdeep, et al.
Veröffentlicht: (2024)
von: Kumar, Navdeep, et al.
Veröffentlicht: (2024)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
von: Wang, Kexuan, et al.
Veröffentlicht: (2023)
von: Wang, Kexuan, et al.
Veröffentlicht: (2023)
Hyperparameter Optimization for SecureBoost via Constrained Multi-Objective Federated Learning
von: Kang, Yan, et al.
Veröffentlicht: (2024)
von: Kang, Yan, et al.
Veröffentlicht: (2024)
Actor-Critics Can Achieve Optimal Sample Efficiency
von: Tan, Kevin, et al.
Veröffentlicht: (2025)
von: Tan, Kevin, et al.
Veröffentlicht: (2025)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
Parallel Heuristic Search as Inference for Actor-Critic Reinforcement Learning Models
von: Yang, Hanlan, et al.
Veröffentlicht: (2025)
von: Yang, Hanlan, et al.
Veröffentlicht: (2025)
Jackpot: Optimal Budgeted Rejection Sampling for Extreme Actor-Policy Mismatch Reinforcement Learning
von: Chen, Zhuoming, et al.
Veröffentlicht: (2026)
von: Chen, Zhuoming, et al.
Veröffentlicht: (2026)
Quantum Advantage Actor-Critic for Reinforcement Learning
von: Kölle, Michael, et al.
Veröffentlicht: (2024)
von: Kölle, Michael, et al.
Veröffentlicht: (2024)
Flow Actor-Critic for Offline Reinforcement Learning
von: Chae, Jongseong, et al.
Veröffentlicht: (2026)
von: Chae, Jongseong, et al.
Veröffentlicht: (2026)
HACMan: Learning Hybrid Actor-Critic Maps for 6D Non-Prehensile Manipulation
von: Zhou, Wenxuan, et al.
Veröffentlicht: (2023)
von: Zhou, Wenxuan, et al.
Veröffentlicht: (2023)
A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic Approach
von: Ganesh, Swetha, et al.
Veröffentlicht: (2024)
von: Ganesh, Swetha, et al.
Veröffentlicht: (2024)
Finite-Time Complexity of Online Primal-Dual Natural Actor-Critic Algorithm for Constrained Markov Decision Processes
von: Zeng, Sihan, et al.
Veröffentlicht: (2021)
von: Zeng, Sihan, et al.
Veröffentlicht: (2021)
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
von: Yang, Tong, et al.
Veröffentlicht: (2025)
von: Yang, Tong, et al.
Veröffentlicht: (2025)
Solving Time-Continuous Stochastic Optimal Control Problems: Algorithm Design and Convergence Analysis of Actor-Critic Flow
von: Zhou, Mo, et al.
Veröffentlicht: (2024)
von: Zhou, Mo, et al.
Veröffentlicht: (2024)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
Benchmarking Offline Multi-Objective Reinforcement Learning in Critical Care
von: Bansal, Aryaman, et al.
Veröffentlicht: (2025)
von: Bansal, Aryaman, et al.
Veröffentlicht: (2025)
Die Diachronie der französischen Progressivperiphrase
von: Momma, Lydia
Veröffentlicht: (2024)
von: Momma, Lydia
Veröffentlicht: (2024)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
von: Bhatnagar, Shalabh, et al.
Veröffentlicht: (2022)
von: Bhatnagar, Shalabh, et al.
Veröffentlicht: (2022)
Actor-Critic with Active Importance Sampling
von: Molaei, Majid, et al.
Veröffentlicht: (2026)
von: Molaei, Majid, et al.
Veröffentlicht: (2026)
Preference-based Multi-Objective Reinforcement Learning
von: Mu, Ni, et al.
Veröffentlicht: (2025)
von: Mu, Ni, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Enabling Pareto-Stationarity Exploration in Multi-Objective Reinforcement Learning: A Multi-Objective Weighted-Chebyshev Actor-Critic Approach
von: Hairi, Fnu, et al.
Veröffentlicht: (2025) -
STIMULUS: Achieving Fast Convergence and Low Sample Complexity in Stochastic Multi-Objective Learning
von: Liu, Zhuqing, et al.
Veröffentlicht: (2025) -
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning
von: Zhang, Zhiyao, et al.
Veröffentlicht: (2025) -
Federated Multi-Objective Learning
von: Yang, Haibo, et al.
Veröffentlicht: (2023) -
Consensus-based Decentralized Multi-agent Reinforcement Learning for Random Access Network Optimization
von: Oh, Myeung Suk, et al.
Veröffentlicht: (2025)