Decoupled Continuous-Time Reinforcement Learning via Hamiltonian Flow
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Nguyen, Minh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Differential and Pointwise Control Approach to Reinforcement Learning
par: Nguyen, Minh, et autres
Publié: (2024)
par: Nguyen, Minh, et autres
Publié: (2024)
Statistical and Algorithmic Foundations of Reinforcement Learning
par: Chi, Yuejie, et autres
Publié: (2025)
par: Chi, Yuejie, et autres
Publié: (2025)
Piecewise Polynomial Regression of Tame Functions via Integer Programming
par: Bareilles, Gilles, et autres
Publié: (2023)
par: Bareilles, Gilles, et autres
Publié: (2023)
Byzantine Machine Learning: MultiKrum and an optimal notion of robustness
par: Bareilles, Gilles, et autres
Publié: (2026)
par: Bareilles, Gilles, et autres
Publié: (2026)
Inverse Mixed-Integer Programming: Learning Constraints then Objective Functions
par: Kitaoka, Akira
Publié: (2025)
par: Kitaoka, Akira
Publié: (2025)
Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward Hacking
par: Rashidinejad, Paria, et autres
Publié: (2024)
par: Rashidinejad, Paria, et autres
Publié: (2024)
Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
Learning to Fuse Temporal Proximity Networks: A Case Study in Chimpanzee Social Interactions
par: He, Yixuan, et autres
Publié: (2025)
par: He, Yixuan, et autres
Publié: (2025)
Sinkhorn Based Associative Memory Retrieval Using Spherical Hellinger Kantorovich Dynamics
par: Mustafi, Aratrika, et autres
Publié: (2026)
par: Mustafi, Aratrika, et autres
Publié: (2026)
Optimism Stabilizes Thompson Sampling for Adaptive Inference
par: Yan, Shunxing, et autres
Publié: (2026)
par: Yan, Shunxing, et autres
Publié: (2026)
Straight-Through meets Sparse Recovery: the Support Exploration Algorithm
par: Mohamed, Mimoun, et autres
Publié: (2023)
par: Mohamed, Mimoun, et autres
Publié: (2023)
Precise gradient descent training dynamics for finite-width multi-layer neural networks
par: Han, Qiyang, et autres
Publié: (2025)
par: Han, Qiyang, et autres
Publié: (2025)
FraPPE: Fast and Efficient Preference-based Pure Exploration
par: Das, Udvas, et autres
Publié: (2025)
par: Das, Udvas, et autres
Publié: (2025)
Smooth Non-Stationary Bandits
par: Jia, Su, et autres
Publié: (2023)
par: Jia, Su, et autres
Publié: (2023)
Mixing Times and Privacy Analysis for the Projected Langevin Algorithm under a Modulus of Continuity
par: Bravo, Mario, et autres
Publié: (2025)
par: Bravo, Mario, et autres
Publié: (2025)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
par: Zhang, Dake, et autres
Publié: (2024)
par: Zhang, Dake, et autres
Publié: (2024)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
par: Cheng, Ziheng, et autres
Publié: (2025)
par: Cheng, Ziheng, et autres
Publié: (2025)
Robustly Learning Monotone Generalized Linear Models via Data Augmentation
par: Zarifis, Nikos, et autres
Publié: (2025)
par: Zarifis, Nikos, et autres
Publié: (2025)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2024)
par: Huang, Yilie, et autres
Publié: (2024)
Learning the Uncertainty Sets for Control Dynamics via Set Membership: A Non-Asymptotic Analysis
par: Li, Yingying, et autres
Publié: (2023)
par: Li, Yingying, et autres
Publié: (2023)
Geometry-induced Regularization in Deep ReLU Neural Networks
par: Bona-Pellissier, Joachim, et autres
Publié: (2024)
par: Bona-Pellissier, Joachim, et autres
Publié: (2024)
Breaking the Sample Size Barrier in Model-Based Reinforcement Learning with a Generative Model
par: Li, Gen, et autres
Publié: (2020)
par: Li, Gen, et autres
Publié: (2020)
Continuous-time reinforcement learning: ellipticity enables model-free value function approximation
par: Mou, Wenlong
Publié: (2026)
par: Mou, Wenlong
Publié: (2026)
Rod Flow: A Continuous-Time Model for Gradient Descent at the Edge of Stability
par: Regis, Eric, et autres
Publié: (2026)
par: Regis, Eric, et autres
Publié: (2026)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2025)
par: Huang, Yilie, et autres
Publié: (2025)
Continuous-Time Reinforcement Learning for Asset-Liability Management
par: Huang, Yilie
Publié: (2025)
par: Huang, Yilie
Publié: (2025)
Mixing Time of the Proximal Sampler in Relative Fisher Information via Strong Data Processing Inequality
par: Wibisono, Andre
Publié: (2025)
par: Wibisono, Andre
Publié: (2025)
Causal Invariance Learning via Efficient Nonconvex Optimization
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
The High Line: Exact Risk and Learning Rate Curves of Stochastic Adaptive Learning Rate Algorithms
par: Collins-Woodfin, Elizabeth, et autres
Publié: (2024)
par: Collins-Woodfin, Elizabeth, et autres
Publié: (2024)
On Regularization via Early Stopping for Least Squares Regression
par: Sonthalia, Rishi, et autres
Publié: (2024)
par: Sonthalia, Rishi, et autres
Publié: (2024)
Implicit Regularization for Tubal Tensor Factorizations via Gradient Descent
par: Karnik, Santhosh, et autres
Publié: (2024)
par: Karnik, Santhosh, et autres
Publié: (2024)
A Theory of Feature Learning in Kernel Models
par: Chen, Yunlu, et autres
Publié: (2023)
par: Chen, Yunlu, et autres
Publié: (2023)
On the Uniform Convergence of Subdifferentials in Stochastic Optimization and Learning
par: Ruan, Feng
Publié: (2024)
par: Ruan, Feng
Publié: (2024)
Gradient Equilibrium in Online Learning: Theory and Applications
par: Angelopoulos, Anastasios N., et autres
Publié: (2025)
par: Angelopoulos, Anastasios N., et autres
Publié: (2025)
Bayesian Design Principles for Frequentist Sequential Learning
par: Xu, Yunbei, et autres
Publié: (2023)
par: Xu, Yunbei, et autres
Publié: (2023)
Learning an Optimal Assortment Policy under Observational Data
par: Han, Yuxuan, et autres
Publié: (2025)
par: Han, Yuxuan, et autres
Publié: (2025)
Frequentist Regret Analysis of Gaussian Process Thompson Sampling via Fractional Posteriors
par: Roy, Somjit, et autres
Publié: (2026)
par: Roy, Somjit, et autres
Publié: (2026)
Algorithms for mean-field variational inference via polyhedral optimization in the Wasserstein space
par: Jiang, Yiheng, et autres
Publié: (2023)
par: Jiang, Yiheng, et autres
Publié: (2023)
Stopping Rules for Stochastic Gradient Descent via Anytime-Valid Confidence Sequences
par: Aolaritei, Liviu, et autres
Publié: (2025)
par: Aolaritei, Liviu, et autres
Publié: (2025)
Learning and Decision-Making with Data: Optimal Formulations and Phase Transitions
par: Bennouna, Amine, et autres
Publié: (2021)
par: Bennouna, Amine, et autres
Publié: (2021)
Documents similaires
-
A Differential and Pointwise Control Approach to Reinforcement Learning
par: Nguyen, Minh, et autres
Publié: (2024) -
Statistical and Algorithmic Foundations of Reinforcement Learning
par: Chi, Yuejie, et autres
Publié: (2025) -
Piecewise Polynomial Regression of Tame Functions via Integer Programming
par: Bareilles, Gilles, et autres
Publié: (2023) -
Byzantine Machine Learning: MultiKrum and an optimal notion of robustness
par: Bareilles, Gilles, et autres
Publié: (2026) -
Inverse Mixed-Integer Programming: Learning Constraints then Objective Functions
par: Kitaoka, Akira
Publié: (2025)