Residuals-based Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Qing, Yu, Xian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Online Residual Learning from Offline Experts for Pedestrian Tracking
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024)
di: Zhou, Angela
Pubblicazione: (2024)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
A Covering Framework for Offline POMDPs Learning using Belief Space Metric
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
Towards Optimal Offline Reinforcement Learning
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
On the Convergence of Gradient Descent on Learning Transformers with Residual Connections
di: Qin, Zhen, et al.
Pubblicazione: (2025)
di: Qin, Zhen, et al.
Pubblicazione: (2025)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
di: Zhang, Dake, et al.
Pubblicazione: (2024)
di: Zhang, Dake, et al.
Pubblicazione: (2024)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
Offline Policy Learning with Weight Clipping and Heaviside Composite Optimization
di: Liu, Jingren, et al.
Pubblicazione: (2026)
di: Liu, Jingren, et al.
Pubblicazione: (2026)
Reinforcement Learning and Regret Bounds for Admission Control
di: Weber, Lucas, et al.
Pubblicazione: (2024)
di: Weber, Lucas, et al.
Pubblicazione: (2024)
Sampling-based Safe Reinforcement Learning for Nonlinear Dynamical Systems
di: Suttle, Wesley A., et al.
Pubblicazione: (2024)
di: Suttle, Wesley A., et al.
Pubblicazione: (2024)
Principled Penalty-based Methods for Bilevel Reinforcement Learning and RLHF
di: Shen, Han, et al.
Pubblicazione: (2024)
di: Shen, Han, et al.
Pubblicazione: (2024)
On the Global Convergence of Risk-Averse Natural Policy Gradient Methods with Expected Conditional Risk Measures
di: Yu, Xian, et al.
Pubblicazione: (2023)
di: Yu, Xian, et al.
Pubblicazione: (2023)
Towards Fast Rates for Federated and Multi-Task Reinforcement Learning
di: Zhu, Feng, et al.
Pubblicazione: (2024)
di: Zhu, Feng, et al.
Pubblicazione: (2024)
Grower-in-the-Loop Interactive Reinforcement Learning for Greenhouse Climate Control
di: Xiao, Maxiu, et al.
Pubblicazione: (2025)
di: Xiao, Maxiu, et al.
Pubblicazione: (2025)
Reinforcement Learning-based Control via Y-wise Affine Neural Networks (YANNs)
di: Braniff, Austin, et al.
Pubblicazione: (2025)
di: Braniff, Austin, et al.
Pubblicazione: (2025)
Heuristics for Combinatorial Optimization via Value-based Reinforcement Learning: A Unified Framework and Analysis
di: Davidovich, Orit, et al.
Pubblicazione: (2025)
di: Davidovich, Orit, et al.
Pubblicazione: (2025)
Wait-Less Offline Tuning and Re-solving for Online Decision Making
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
Resilient Constrained Reinforcement Learning
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Improved Regret Bound for Safe Reinforcement Learning via Tighter Cost Pessimism and Reward Optimism
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
DLMMPR:Deep Learning-based Measurement Matrix for Phase Retrieval
di: Liu, Jing, et al.
Pubblicazione: (2025)
di: Liu, Jing, et al.
Pubblicazione: (2025)
A Pontryagin Perspective on Reinforcement Learning
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
Foundations of Multivariate Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
Operator World Models for Reinforcement Learning
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
Residuals-Based Contextual Distributionally Robust Optimization with Decision-Dependent Uncertainty: Theoretical Guarantees and Decomposition Algorithm
di: Zhu, Qing, et al.
Pubblicazione: (2024)
di: Zhu, Qing, et al.
Pubblicazione: (2024)
Residual subspace evolution strategies for nonlinear inverse problems
di: Alemanno, Francesco
Pubblicazione: (2025)
di: Alemanno, Francesco
Pubblicazione: (2025)
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
Tail Distribution of Regret in Optimistic Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
Reinforcement Learning applied to Insurance Portfolio Pursuit
di: Young, Edward James, et al.
Pubblicazione: (2024)
di: Young, Edward James, et al.
Pubblicazione: (2024)
Structured Reinforcement Learning for Combinatorial Decision-Making
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
Reinforcement Learning-based Control via Y-wise Affine Neural Networks: Comparative Case Studies for Chemical Processes
di: Braniff, Austin, et al.
Pubblicazione: (2026)
di: Braniff, Austin, et al.
Pubblicazione: (2026)
Reinforcement Learning with Function Approximation for Non-Markov Processes
di: Kara, Ali Devran
Pubblicazione: (2026)
di: Kara, Ali Devran
Pubblicazione: (2026)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Deep Reinforcement Learning: A Convex Optimization Approach
di: Gattami, Ather
Pubblicazione: (2024)
di: Gattami, Ather
Pubblicazione: (2024)
Documenti analoghi
-
Online Residual Learning from Offline Experts for Pedestrian Tracking
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024) -
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025) -
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026) -
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024) -
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)