Variance Reduced Policy Gradient Method for Multi-Objective Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guidobene, Davide, Benedetti, Lorenzo, Arapovic, Diego |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Representation Optimization Dichotomy, Lie-Algebraic Policy Optimization
par: KC, Sooraj, et autres
Publié: (2026)
par: KC, Sooraj, et autres
Publié: (2026)
An Augmented Lagrangian Method for Training Recurrent Neural Networks
par: Wang, Yue, et autres
Publié: (2024)
par: Wang, Yue, et autres
Publié: (2024)
A Globally Convergent Gradient Method with Momentum
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
Projected Gradient Methods with Momentum
par: Lapucci, Matteo, et autres
Publié: (2026)
par: Lapucci, Matteo, et autres
Publié: (2026)
Riemannian Gradient Method with Momentum
par: Leggio, Filippo, et autres
Publié: (2026)
par: Leggio, Filippo, et autres
Publié: (2026)
Riemannian Adaptive Regularized Newton Methods with Hölder Continuous Hessians
par: Zhang, Chenyu, et autres
Publié: (2023)
par: Zhang, Chenyu, et autres
Publié: (2023)
Effectively Leveraging Momentum Terms in Stochastic Line Search Frameworks for Fast Optimization of Finite-Sum Problems
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
Convergence Conditions for Stochastic Line Search Based Optimization of Over-parametrized Models
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
Policy Optimization over General State and Action Spaces
par: Ju, Caleb, et autres
Publié: (2022)
par: Ju, Caleb, et autres
Publié: (2022)
Proximal Gradient Descent Ascent Methods for Nonsmooth Nonconvex-Concave Minimax Problems on Riemannian Manifolds
par: Xie, Xiyuan, et autres
Publié: (2025)
par: Xie, Xiyuan, et autres
Publié: (2025)
Variance Reduced Distributed Non-Convex Optimization Using Matrix Stepsizes
par: Li, Hanmin, et autres
Publié: (2023)
par: Li, Hanmin, et autres
Publié: (2023)
Reinforcement Learning with Markov Risk Measures and Multipattern Risk Approximation
par: Ruszczynski, Andrzej, et autres
Publié: (2026)
par: Ruszczynski, Andrzej, et autres
Publié: (2026)
General Constrained Matrix Optimization
par: Garner, Casey, et autres
Publié: (2024)
par: Garner, Casey, et autres
Publié: (2024)
Spectrally Constrained Optimization
par: Garner, Casey, et autres
Publié: (2023)
par: Garner, Casey, et autres
Publié: (2023)
Distributed Computing for Huge-Scale Aggregative Convex Programming
par: Tao, Luoyi
Publié: (2026)
par: Tao, Luoyi
Publié: (2026)
A Riemannian Accelerated Proximal Gradient Method
par: Feng, Shuailing, et autres
Publié: (2025)
par: Feng, Shuailing, et autres
Publié: (2025)
Learning to Choose Branching Rules for Nonconvex MINLPs
par: Berthold, Timo, et autres
Publié: (2026)
par: Berthold, Timo, et autres
Publié: (2026)
A New Linear Programming Approach and a New Backtracking Strategy for Multiple-Gradient Descent in Multi-Objective Optimization
par: Della Santa, Francesco
Publié: (2024)
par: Della Santa, Francesco
Publié: (2024)
Inexact Riemannian Gradient Descent Method for Nonconvex Optimization
par: Zhou, Juan, et autres
Publié: (2024)
par: Zhou, Juan, et autres
Publié: (2024)
Fisher-Rao Gradient Flows of Linear Programs and State-Action Natural Policy Gradients
par: Müller, Johannes, et autres
Publié: (2024)
par: Müller, Johannes, et autres
Publié: (2024)
Cardinality-Constrained Multi-Objective Optimization: Novel Optimality Conditions and Algorithms
par: Lapucci, Matteo, et autres
Publié: (2023)
par: Lapucci, Matteo, et autres
Publié: (2023)
Delayed Feedback in Online Non-Convex Optimization: A Non-Stationary Approach with Applications
par: Lara, Felipe, et autres
Publié: (2024)
par: Lara, Felipe, et autres
Publié: (2024)
A Matrix Optimization Method for Blind Extraction of External Equitable Partitions from Low Pass Graph Signals
par: Teng, Wenshun, et autres
Publié: (2025)
par: Teng, Wenshun, et autres
Publié: (2025)
Dual Spectral Projected Gradient Method for Generalized Log-det Semidefinite Programming
par: Namchaisiri, Charles, et autres
Publié: (2024)
par: Namchaisiri, Charles, et autres
Publié: (2024)
Linear programming for finite-horizon vector-valued Markov decision processes
par: Mifrani, Anas, et autres
Publié: (2025)
par: Mifrani, Anas, et autres
Publié: (2025)
Adaptive Conditional Forest Sampling for Spectral Risk Optimisation under Decision-Dependent Uncertainty
par: Kurbucz, Marcell T.
Publié: (2026)
par: Kurbucz, Marcell T.
Publié: (2026)
Stochastic Algorithms for Large-Scale Composite Optimization: the Case of Single-Shot X-FEL Imaging
par: Luke, D. Russell, et autres
Publié: (2024)
par: Luke, D. Russell, et autres
Publié: (2024)
Optimization with Trained Machine Learning Models Embedded
par: Schweidtmann, Artur M., et autres
Publié: (2022)
par: Schweidtmann, Artur M., et autres
Publié: (2022)
Kurdyka-Łojasiewicz exponent via Hadamard parametrization
par: Ouyang, Wenqing, et autres
Publié: (2024)
par: Ouyang, Wenqing, et autres
Publié: (2024)
Kurdyka-Łojasiewicz exponent via square transformation
par: Ouyang, Wenqing
Publié: (2025)
par: Ouyang, Wenqing
Publié: (2025)
Low-Rank Multi-Objective Linear Programming
par: Löhne, Andreas, et autres
Publié: (2025)
par: Löhne, Andreas, et autres
Publié: (2025)
Enhancing Model Based Derivative Free Optimization using Direct Search
par: Li, Zijun, et autres
Publié: (2026)
par: Li, Zijun, et autres
Publié: (2026)
From Non-Identifiability to Goal-Integrated Decision-Making in Parametric Inverse Optimization
par: Ahmadi, Farzin, et autres
Publié: (2026)
par: Ahmadi, Farzin, et autres
Publié: (2026)
SUDA-Muon: Structural Design Principles and Boundaries for Fully Decentralized Muon
par: Zhang, Hengrui, et autres
Publié: (2026)
par: Zhang, Hengrui, et autres
Publié: (2026)
On Tackling High-Dimensional Nonconvex Stochastic Optimization via Stochastic First-Order Methods with Non-smooth Proximal Terms and Variance Reduction
par: Xie, Yue, et autres
Publié: (2025)
par: Xie, Yue, et autres
Publié: (2025)
A Stochastic Gradient Descent Method for Globally Minimizing Nearly Convex Functions
par: Bao, Chenglong, et autres
Publié: (2025)
par: Bao, Chenglong, et autres
Publié: (2025)
The Augmented Mixing Method: Computing High-Accuracy Primal-Dual Solutions to Large-Scale SDPs via Column Updates
par: Brosch, Daniel, et autres
Publié: (2025)
par: Brosch, Daniel, et autres
Publié: (2025)
Multi-Objective Optimization with Desirability and Morris-Mitchell Criterion
par: Bartz-Beielstein, Thomas, et autres
Publié: (2025)
par: Bartz-Beielstein, Thomas, et autres
Publié: (2025)
Convex Regularization and Convergence of Policy Gradient Flows under Safety Constraints
par: Malo, Pekka, et autres
Publié: (2024)
par: Malo, Pekka, et autres
Publié: (2024)
On a minimization problem of the maximum generalized eigenvalue: properties and algorithms
par: Nishioka, Akatsuki, et autres
Publié: (2023)
par: Nishioka, Akatsuki, et autres
Publié: (2023)
Documents similaires
-
A Representation Optimization Dichotomy, Lie-Algebraic Policy Optimization
par: KC, Sooraj, et autres
Publié: (2026) -
An Augmented Lagrangian Method for Training Recurrent Neural Networks
par: Wang, Yue, et autres
Publié: (2024) -
A Globally Convergent Gradient Method with Momentum
par: Lapucci, Matteo, et autres
Publié: (2024) -
Projected Gradient Methods with Momentum
par: Lapucci, Matteo, et autres
Publié: (2026) -
Riemannian Gradient Method with Momentum
par: Leggio, Filippo, et autres
Publié: (2026)