Structure Matters: Dynamic Policy Gradient
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Klein, Sara, Zhang, Xiangyuan, Başar, Tamer, Weissmann, Simon, Döring, Leif |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
par: Kassing, Sebastian, et autres
Publié: (2025)
par: Kassing, Sebastian, et autres
Publié: (2025)
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023)
par: Klein, Sara, et autres
Publié: (2023)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
par: Zhang, Xiangyuan, et autres
Publié: (2023)
par: Zhang, Xiangyuan, et autres
Publié: (2023)
Almost sure convergence rates of stochastic gradient methods under gradient domination
par: Weissmann, Simon, et autres
Publié: (2024)
par: Weissmann, Simon, et autres
Publié: (2024)
Gradient Span Algorithms Make Predictable Progress in High Dimension
par: Benning, Felix, et autres
Publié: (2024)
par: Benning, Felix, et autres
Publié: (2024)
The Role of Target Update Frequencies in Q-Learning
par: Weissmann, Simon, et autres
Publié: (2026)
par: Weissmann, Simon, et autres
Publié: (2026)
Flatness-Aware Stochastic Gradient Langevin Dynamics
par: Bruno, Stefano, et autres
Publié: (2025)
par: Bruno, Stefano, et autres
Publié: (2025)
Random Function Descent
par: Benning, Felix, et autres
Publié: (2023)
par: Benning, Felix, et autres
Publié: (2023)
Score-Aware Policy-Gradient and Performance Guarantees using Local Lyapunov Stability
par: Comte, Céline, et autres
Publié: (2023)
par: Comte, Céline, et autres
Publié: (2023)
Convergence Error Analysis of Reflected Gradient Langevin Dynamics for Globally Optimizing Non-Convex Constrained Problems
par: Sato, Kanji, et autres
Publié: (2022)
par: Sato, Kanji, et autres
Publié: (2022)
On the mean field limit of consensus based methods
par: Koß, Marvin, et autres
Publié: (2024)
par: Koß, Marvin, et autres
Publié: (2024)
Posterior Sampling Based on Gradient Flows of the MMD with Negative Distance Kernel
par: Hagemann, Paul, et autres
Publié: (2023)
par: Hagemann, Paul, et autres
Publié: (2023)
Neural Wasserstein Gradient Flows for Maximum Mean Discrepancies with Riesz Kernels
par: Altekrüger, Fabian, et autres
Publié: (2023)
par: Altekrüger, Fabian, et autres
Publié: (2023)
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
par: Dang, Thanh, et autres
Publié: (2025)
par: Dang, Thanh, et autres
Publié: (2025)
Wasserstein Convergence of Score-based Generative Models under Semiconvexity and Discontinuous Gradients
par: Bruno, Stefano, et autres
Publié: (2025)
par: Bruno, Stefano, et autres
Publié: (2025)
Wasserstein Formulation of Reinforcement Learning. An Optimal Transport Perspective on Policy Optimization
par: Dus, Mathias
Publié: (2026)
par: Dus, Mathias
Publié: (2026)
The Silence that Speaks: Neural Estimation via Communication Gaps
par: Aggarwal, Shubham, et autres
Publié: (2025)
par: Aggarwal, Shubham, et autres
Publié: (2025)
InterQ: A DQN Framework for Optimal Intermittent Control
par: Aggarwal, Shubham, et autres
Publié: (2025)
par: Aggarwal, Shubham, et autres
Publié: (2025)
Controlgym: Large-Scale Control Environments for Benchmarking Reinforcement Learning Algorithms
par: Zhang, Xiangyuan, et autres
Publié: (2023)
par: Zhang, Xiangyuan, et autres
Publié: (2023)
Policy Optimization for PDE Control with a Warm Start
par: Zhang, Xiangyuan, et autres
Publié: (2024)
par: Zhang, Xiangyuan, et autres
Publié: (2024)
Control Disturbance Rejection in Neural ODEs
par: Bayram, Erkan, et autres
Publié: (2025)
par: Bayram, Erkan, et autres
Publié: (2025)
Geometric Foundations of Tuning without Forgetting in Neural ODEs
par: Bayram, Erkan, et autres
Publié: (2025)
par: Bayram, Erkan, et autres
Publié: (2025)
Exact Dynamics of Multi-class Stochastic Gradient Descent
par: Collins-Woodfin, Elizabeth, et autres
Publié: (2025)
par: Collins-Woodfin, Elizabeth, et autres
Publié: (2025)
Control Theoretic Approach to Fine-Tuning and Transfer Learning
par: Bayram, Erkan, et autres
Publié: (2024)
par: Bayram, Erkan, et autres
Publié: (2024)
Convergence of Actor-Critic Learning for Mean Field Games and Mean Field Control in Continuous Spaces
par: Fouque, Jean-Pierre, et autres
Publié: (2025)
par: Fouque, Jean-Pierre, et autres
Publié: (2025)
Decoupled Functional Central Limit Theorems for Two-Time-Scale Stochastic Approximation
par: Han, Yuze, et autres
Publié: (2024)
par: Han, Yuze, et autres
Publié: (2024)
Prelimit Coupling and Steady-State Convergence of Constant-stepsize Nonsmooth Contractive SA
par: Zhang, Yixuan, et autres
Publié: (2024)
par: Zhang, Yixuan, et autres
Publié: (2024)
On diffusion-based generative models and their error bounds: The log-concave case with full convergence estimates
par: Bruno, Stefano, et autres
Publié: (2023)
par: Bruno, Stefano, et autres
Publié: (2023)
Lagrangian Index Policy for Restless Bandits with Average Reward
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
par: Avrachenkov, Konstantin, et autres
Publié: (2024)
ADDQ: Adaptive Distributional Double Q-Learning
par: Döring, Leif, et autres
Publié: (2025)
par: Döring, Leif, et autres
Publié: (2025)
Duality and Policy Evaluation in Distributionally Robust Bayesian Diffusion Control
par: Blanchet, Jose, et autres
Publié: (2025)
par: Blanchet, Jose, et autres
Publié: (2025)
A Generalization Result for Convergence in Learning-to-Optimize
par: Sucker, Michael, et autres
Publié: (2024)
par: Sucker, Michael, et autres
Publié: (2024)
Asymptotic regularity of a generalised stochastic Halpern scheme
par: Pischke, Nicholas, et autres
Publié: (2024)
par: Pischke, Nicholas, et autres
Publié: (2024)
Accelerating Distributed Stochastic Optimization via Self-Repellent Random Walks
par: Hu, Jie, et autres
Publié: (2024)
par: Hu, Jie, et autres
Publié: (2024)
Stochastic Inverse Problem: stability, regularization and Wasserstein gradient flow
par: Li, Qin, et autres
Publié: (2024)
par: Li, Qin, et autres
Publié: (2024)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
Learning-Based Pricing and Matching for Two-Sided Queues
par: Yang, Zixian, et autres
Publié: (2024)
par: Yang, Zixian, et autres
Publié: (2024)
Data-driven Multistage Distributionally Robust Linear Optimization with Nested Distance
par: Gao, Rui, et autres
Publié: (2024)
par: Gao, Rui, et autres
Publié: (2024)
Regret of exploratory policy improvement and $q$-learning
par: Tang, Wenpin, et autres
Publié: (2024)
par: Tang, Wenpin, et autres
Publié: (2024)
On the SAGA algorithm with decreasing step
par: Fredes, Luis, et autres
Publié: (2024)
par: Fredes, Luis, et autres
Publié: (2024)
Documents similaires
-
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
par: Kassing, Sebastian, et autres
Publié: (2025) -
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods
par: Klein, Sara, et autres
Publié: (2023) -
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
par: Zhang, Xiangyuan, et autres
Publié: (2023) -
Almost sure convergence rates of stochastic gradient methods under gradient domination
par: Weissmann, Simon, et autres
Publié: (2024) -
Gradient Span Algorithms Make Predictable Progress in High Dimension
par: Benning, Felix, et autres
Publié: (2024)