Reward-Relevance-Filtered Linear Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhou, Angela |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline-Online Reinforcement Learning for Linear Mixture MDPs
par: Zhang, Zhongjun, et autres
Publié: (2026)
par: Zhang, Zhongjun, et autres
Publié: (2026)
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
par: Ozdaglar, Asuman, et autres
Publié: (2022)
par: Ozdaglar, Asuman, et autres
Publié: (2022)
Residuals-based Offline Reinforcement Learning
par: Zhu, Qing, et autres
Publié: (2026)
par: Zhu, Qing, et autres
Publié: (2026)
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025)
par: Dimanidis, Ioannis, et autres
Publié: (2025)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
par: Schmidt, Carolin, et autres
Publié: (2024)
par: Schmidt, Carolin, et autres
Publié: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
par: Hoischen, Nicolas, et autres
Publié: (2025)
par: Hoischen, Nicolas, et autres
Publié: (2025)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
par: Di, Qiwei, et autres
Publié: (2023)
par: Di, Qiwei, et autres
Publié: (2023)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
par: Chen, Zijun, et autres
Publié: (2025)
par: Chen, Zijun, et autres
Publié: (2025)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
Near-Optimal Primal-Dual Algorithm for Learning Linear Mixture CMDPs with Adversarial Rewards
par: Yu, Kihyun, et autres
Publié: (2026)
par: Yu, Kihyun, et autres
Publié: (2026)
Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning
par: Kaya, Ege C., et autres
Publié: (2026)
par: Kaya, Ege C., et autres
Publié: (2026)
Towards Optimal Offline Reinforcement Learning
par: Li, Mengmeng, et autres
Publié: (2025)
par: Li, Mengmeng, et autres
Publié: (2025)
Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
On the Linear Speedup of Personalized Federated Reinforcement Learning with Shared Representations
par: Xiong, Guojun, et autres
Publié: (2024)
par: Xiong, Guojun, et autres
Publié: (2024)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
par: Zhang, Dake, et autres
Publié: (2024)
par: Zhang, Dake, et autres
Publié: (2024)
Improved Regret Bound for Safe Reinforcement Learning via Tighter Cost Pessimism and Reward Optimism
par: Yu, Kihyun, et autres
Publié: (2024)
par: Yu, Kihyun, et autres
Publié: (2024)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
par: Zhang, Junkai, et autres
Publié: (2023)
par: Zhang, Junkai, et autres
Publié: (2023)
Sample Complexity of the Linear Quadratic Regulator: A Reinforcement Learning Lens
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2024)
par: Moghaddam, Amirreza Neshaei, et autres
Publié: (2024)
Online Reinforcement Learning in Markov Decision Process Using Linear Programming
par: Leon, Vincent, et autres
Publié: (2023)
par: Leon, Vincent, et autres
Publié: (2023)
Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application
par: Li, Lucky
Publié: (2024)
par: Li, Lucky
Publié: (2024)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
par: Carmona, René, et autres
Publié: (2019)
par: Carmona, René, et autres
Publié: (2019)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
par: Lee, Kyungbok, et autres
Publié: (2026)
par: Lee, Kyungbok, et autres
Publié: (2026)
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
par: Cai, Qi, et autres
Publié: (2022)
par: Cai, Qi, et autres
Publié: (2022)
Offline Policy Learning with Weight Clipping and Heaviside Composite Optimization
par: Liu, Jingren, et autres
Publié: (2026)
par: Liu, Jingren, et autres
Publié: (2026)
Online Residual Learning from Offline Experts for Pedestrian Tracking
par: Vlachos, Anastasios, et autres
Publié: (2024)
par: Vlachos, Anastasios, et autres
Publié: (2024)
Optimal Single-Policy Sample Complexity and Transient Coverage for Average-Reward Offline RL
par: Zurek, Matthew, et autres
Publié: (2025)
par: Zurek, Matthew, et autres
Publié: (2025)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2024)
par: Huang, Yilie, et autres
Publié: (2024)
Risk-Aware Safe Reinforcement Learning for Control of Stochastic Linear Systems
par: Esmaeili, Babak, et autres
Publié: (2025)
par: Esmaeili, Babak, et autres
Publié: (2025)
A Covering Framework for Offline POMDPs Learning using Belief Space Metric
par: Zhu, Youheng, et autres
Publié: (2026)
par: Zhu, Youheng, et autres
Publié: (2026)
Robust Q-Learning under Corrupted Rewards
par: Maity, Sreejeet, et autres
Publié: (2024)
par: Maity, Sreejeet, et autres
Publié: (2024)
On the Foundation of Distributionally Robust Reinforcement Learning
par: Wang, Shengbo, et autres
Publié: (2023)
par: Wang, Shengbo, et autres
Publié: (2023)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2025)
par: Huang, Yilie, et autres
Publié: (2025)
Learning Fair And Effective Points-Based Rewards Programs
par: Hssaine, Chamsi, et autres
Publié: (2025)
par: Hssaine, Chamsi, et autres
Publié: (2025)
Learning of Linear Dynamical Systems as a Non-Commutative Polynomial Optimization Problem
par: Zhou, Quan, et autres
Publié: (2020)
par: Zhou, Quan, et autres
Publié: (2020)
Structured Difference-of-Q via Orthogonal Learning
par: Cao, Defu, et autres
Publié: (2024)
par: Cao, Defu, et autres
Publié: (2024)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
par: Zhang, Weitong, et autres
Publié: (2021)
par: Zhang, Weitong, et autres
Publié: (2021)
Robust Gaussian Processes via Relevance Pursuit
par: Ament, Sebastian, et autres
Publié: (2024)
par: Ament, Sebastian, et autres
Publié: (2024)
Online Learning of Kalman Filtering: From Output to State Estimation
par: Ye, Lintao, et autres
Publié: (2026)
par: Ye, Lintao, et autres
Publié: (2026)
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes
par: Wan, Yi, et autres
Publié: (2024)
par: Wan, Yi, et autres
Publié: (2024)
Learning Weakly Communicating Average-Reward CMDPs: Strong Duality and Improved Regret
par: Yu, Kihyun, et autres
Publié: (2026)
par: Yu, Kihyun, et autres
Publié: (2026)
Documents similaires
-
Offline-Online Reinforcement Learning for Linear Mixture MDPs
par: Zhang, Zhongjun, et autres
Publié: (2026) -
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
par: Ozdaglar, Asuman, et autres
Publié: (2022) -
Residuals-based Offline Reinforcement Learning
par: Zhu, Qing, et autres
Publié: (2026) -
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025) -
Offline Hierarchical Reinforcement Learning via Inverse Optimization
par: Schmidt, Carolin, et autres
Publié: (2024)