Learning mirror maps in policy mirror descent
Fuente:
arXiv
Salvato in:
| Autori principali: | Alfano, Carlo, Towers, Sebastian, Sapora, Silvia, Lu, Chris, Rebeschini, Patrick |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Novel Framework for Policy Mirror Descent with General Parameterization and Linear Convergence
di: Alfano, Carlo, et al.
Pubblicazione: (2023)
di: Alfano, Carlo, et al.
Pubblicazione: (2023)
On exploration of an interior mirror descent flow for stochastic nonconvex constrained problem
di: Ding, Kuangyu, et al.
Pubblicazione: (2025)
di: Ding, Kuangyu, et al.
Pubblicazione: (2025)
Meta-Learning Objectives for Preference Optimization
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
Entropy annealing for policy mirror descent in continuous time and space
di: Sethi, Deven, et al.
Pubblicazione: (2024)
di: Sethi, Deven, et al.
Pubblicazione: (2024)
Global minimisation of nonconvex functions by generalising the mirror descent method
di: Millán, Reinier Díaz, et al.
Pubblicazione: (2024)
di: Millán, Reinier Díaz, et al.
Pubblicazione: (2024)
Iterative regularization in classification via hinge loss diagonal descent
di: Apidopoulos, Vassilis, et al.
Pubblicazione: (2022)
di: Apidopoulos, Vassilis, et al.
Pubblicazione: (2022)
Convergence of stochastic gradient descent under a local Lojasiewicz condition for deep neural networks
di: An, Jing, et al.
Pubblicazione: (2023)
di: An, Jing, et al.
Pubblicazione: (2023)
Manifold constrained steepest descent
di: Yang, Kaiwei, et al.
Pubblicazione: (2026)
di: Yang, Kaiwei, et al.
Pubblicazione: (2026)
Riemannian coordinate descent algorithms on matrix manifolds
di: Han, Andi, et al.
Pubblicazione: (2024)
di: Han, Andi, et al.
Pubblicazione: (2024)
New logarithmic step size for stochastic gradient descent
di: Shamaee, M. Soheil, et al.
Pubblicazione: (2024)
di: Shamaee, M. Soheil, et al.
Pubblicazione: (2024)
Gradient descent in matrix factorization: Understanding large initialization
di: Chen, Hengchao, et al.
Pubblicazione: (2023)
di: Chen, Hengchao, et al.
Pubblicazione: (2023)
On the global convergence of gradient descent for wide shallow models with bounded nonlinearities
di: Petit, Romain, et al.
Pubblicazione: (2026)
di: Petit, Romain, et al.
Pubblicazione: (2026)
The duality structure gradient descent algorithm: analysis and applications to neural networks
di: Flynn, Thomas
Pubblicazione: (2017)
di: Flynn, Thomas
Pubblicazione: (2017)
On the stability of gradient descent with second order dynamics for time-varying cost functions
di: Gibson, Travis E., et al.
Pubblicazione: (2024)
di: Gibson, Travis E., et al.
Pubblicazione: (2024)
Convergence of continuous-time stochastic gradient descent with applications to deep neural networks
di: Lugosi, Gabor, et al.
Pubblicazione: (2024)
di: Lugosi, Gabor, et al.
Pubblicazione: (2024)
The Mixing method: low-rank coordinate descent for semidefinite programming with diagonal constraints
di: Wang, Po-Wei, et al.
Pubblicazione: (2017)
di: Wang, Po-Wei, et al.
Pubblicazione: (2017)
Convergence of two-timescale gradient descent ascent dynamics: finite-dimensional and mean-field perspectives
di: An, Jing, et al.
Pubblicazione: (2025)
di: An, Jing, et al.
Pubblicazione: (2025)
Error dynamics of mini-batch gradient descent with random reshuffling for least squares regression
di: Lok, Jackie, et al.
Pubblicazione: (2024)
di: Lok, Jackie, et al.
Pubblicazione: (2024)
Linear convergence of proximal descent schemes on the Wasserstein space
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2024)
di: Lascu, Razvan-Andrei, et al.
Pubblicazione: (2024)
A stochastic gradient descent algorithm with random search directions
di: Gbaguidi, Eméric
Pubblicazione: (2025)
di: Gbaguidi, Eméric
Pubblicazione: (2025)
Convergence of flow-based generative models via proximal gradient descent in Wasserstein space
di: Cheng, Xiuyuan, et al.
Pubblicazione: (2023)
di: Cheng, Xiuyuan, et al.
Pubblicazione: (2023)
An accelerated first-order regularized momentum descent ascent algorithm for stochastic nonconvex-concave minimax problems
di: Zhang, Huiling, et al.
Pubblicazione: (2023)
di: Zhang, Huiling, et al.
Pubblicazione: (2023)
A short proof of near-linear convergence of adaptive gradient descent under fourth-order growth and convexity
di: Davis, Damek, et al.
Pubblicazione: (2026)
di: Davis, Damek, et al.
Pubblicazione: (2026)
A block-coordinate descent framework for non-convex composite optimization. Application to sparse precision matrix estimation
di: Lauga, Guillaume
Pubblicazione: (2026)
di: Lauga, Guillaume
Pubblicazione: (2026)
Aiding Global Convergence in Federated Learning via Local Perturbation and Mutual Similarity Information
di: Buttaci, Emanuel, et al.
Pubblicazione: (2024)
di: Buttaci, Emanuel, et al.
Pubblicazione: (2024)
Non-convergence to global minimizers for Adam and stochastic gradient descent optimization and constructions of local minimizers in the training of artificial neural networks
di: Jentzen, Arnulf, et al.
Pubblicazione: (2024)
di: Jentzen, Arnulf, et al.
Pubblicazione: (2024)
Operator World Models for Reinforcement Learning
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
Monotone Optimisation with Learned Projections
di: Rashwan, Ahmed, et al.
Pubblicazione: (2026)
di: Rashwan, Ahmed, et al.
Pubblicazione: (2026)
Scalable Decentralized Learning with Teleportation
di: Takezawa, Yuki, et al.
Pubblicazione: (2025)
di: Takezawa, Yuki, et al.
Pubblicazione: (2025)
When majority rules, minority loses: bias amplification of gradient descent
di: Bachoc, François, et al.
Pubblicazione: (2025)
di: Bachoc, François, et al.
Pubblicazione: (2025)
Global convergence of gradient descent for phase retrieval
di: Fougereux, Théodore, et al.
Pubblicazione: (2024)
di: Fougereux, Théodore, et al.
Pubblicazione: (2024)
Deep Learning Model Predictive Control for Deep Brain Stimulation in Parkinson's Disease
di: Steffen, Sebastian, et al.
Pubblicazione: (2025)
di: Steffen, Sebastian, et al.
Pubblicazione: (2025)
Multi-objective Deep Learning: Taxonomy and Survey of the State of the Art
di: Peitz, Sebastian, et al.
Pubblicazione: (2024)
di: Peitz, Sebastian, et al.
Pubblicazione: (2024)
Locally Adaptive Federated Learning
di: Mukherjee, Sohom, et al.
Pubblicazione: (2023)
di: Mukherjee, Sohom, et al.
Pubblicazione: (2023)
A note on convergence of Wasserstein policy optimization
di: Šiška, David, et al.
Pubblicazione: (2026)
di: Šiška, David, et al.
Pubblicazione: (2026)
A General Continuous-Time Formulation of Stochastic ADMM and Its Variants
di: Li, Chris Junchi
Pubblicazione: (2024)
di: Li, Chris Junchi
Pubblicazione: (2024)
Accelerated Fully First-Order Methods for Bilevel and Minimax Optimization
di: Li, Chris Junchi
Pubblicazione: (2024)
di: Li, Chris Junchi
Pubblicazione: (2024)
Enhancing Stochastic Optimization for Statistical Efficiency Using ROOT-SGD with Diminishing Stepsize
di: Li, Chris Junchi
Pubblicazione: (2024)
di: Li, Chris Junchi
Pubblicazione: (2024)
Distributed Event-Based Learning via ADMM
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
di: Er, Guner Dilsad, et al.
Pubblicazione: (2024)
CV@R penalized portfolio optimization with biased stochastic mirror descent
di: Costa, Manon, et al.
Pubblicazione: (2024)
di: Costa, Manon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Novel Framework for Policy Mirror Descent with General Parameterization and Linear Convergence
di: Alfano, Carlo, et al.
Pubblicazione: (2023) -
On exploration of an interior mirror descent flow for stochastic nonconvex constrained problem
di: Ding, Kuangyu, et al.
Pubblicazione: (2025) -
Meta-Learning Objectives for Preference Optimization
di: Alfano, Carlo, et al.
Pubblicazione: (2024) -
Entropy annealing for policy mirror descent in continuous time and space
di: Sethi, Deven, et al.
Pubblicazione: (2024) -
Global minimisation of nonconvex functions by generalising the mirror descent method
di: Millán, Reinier Díaz, et al.
Pubblicazione: (2024)