Reward-Relevance-Filtered Linear Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autore principale: | Zhou, Angela |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
Learning Infinite-Horizon Average-Reward Linear Mixture MDPs of Bounded Span
di: Chae, Woojin, et al.
Pubblicazione: (2024)
di: Chae, Woojin, et al.
Pubblicazione: (2024)
Near-Optimal Primal-Dual Algorithm for Learning Linear Mixture CMDPs with Adversarial Rewards
di: Yu, Kihyun, et al.
Pubblicazione: (2026)
di: Yu, Kihyun, et al.
Pubblicazione: (2026)
Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Towards Optimal Offline Reinforcement Learning
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation
di: Chae, Woojin, et al.
Pubblicazione: (2024)
di: Chae, Woojin, et al.
Pubblicazione: (2024)
On the Linear Speedup of Personalized Federated Reinforcement Learning with Shared Representations
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
di: Xiong, Guojun, et al.
Pubblicazione: (2024)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
di: Zhang, Dake, et al.
Pubblicazione: (2024)
di: Zhang, Dake, et al.
Pubblicazione: (2024)
Improved Regret Bound for Safe Reinforcement Learning via Tighter Cost Pessimism and Reward Optimism
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
di: Yu, Kihyun, et al.
Pubblicazione: (2024)
Optimal Horizon-Free Reward-Free Exploration for Linear Mixture MDPs
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
di: Zhang, Junkai, et al.
Pubblicazione: (2023)
Sample Complexity of the Linear Quadratic Regulator: A Reinforcement Learning Lens
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2024)
di: Moghaddam, Amirreza Neshaei, et al.
Pubblicazione: (2024)
Online Reinforcement Learning in Markov Decision Process Using Linear Programming
di: Leon, Vincent, et al.
Pubblicazione: (2023)
di: Leon, Vincent, et al.
Pubblicazione: (2023)
Reinforcement Learning for a Discrete-Time Linear-Quadratic Control Problem with an Application
di: Li, Lucky
Pubblicazione: (2024)
di: Li, Lucky
Pubblicazione: (2024)
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods
di: Carmona, René, et al.
Pubblicazione: (2019)
di: Carmona, René, et al.
Pubblicazione: (2019)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample Efficiency
di: Cai, Qi, et al.
Pubblicazione: (2022)
di: Cai, Qi, et al.
Pubblicazione: (2022)
Offline Policy Learning with Weight Clipping and Heaviside Composite Optimization
di: Liu, Jingren, et al.
Pubblicazione: (2026)
di: Liu, Jingren, et al.
Pubblicazione: (2026)
Online Residual Learning from Offline Experts for Pedestrian Tracking
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
Optimal Single-Policy Sample Complexity and Transient Coverage for Average-Reward Offline RL
di: Zurek, Matthew, et al.
Pubblicazione: (2025)
di: Zurek, Matthew, et al.
Pubblicazione: (2025)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2024)
di: Huang, Yilie, et al.
Pubblicazione: (2024)
Risk-Aware Safe Reinforcement Learning for Control of Stochastic Linear Systems
di: Esmaeili, Babak, et al.
Pubblicazione: (2025)
di: Esmaeili, Babak, et al.
Pubblicazione: (2025)
A Covering Framework for Offline POMDPs Learning using Belief Space Metric
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
Robust Q-Learning under Corrupted Rewards
di: Maity, Sreejeet, et al.
Pubblicazione: (2024)
di: Maity, Sreejeet, et al.
Pubblicazione: (2024)
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
di: Huang, Yilie, et al.
Pubblicazione: (2025)
di: Huang, Yilie, et al.
Pubblicazione: (2025)
Learning Fair And Effective Points-Based Rewards Programs
di: Hssaine, Chamsi, et al.
Pubblicazione: (2025)
di: Hssaine, Chamsi, et al.
Pubblicazione: (2025)
Learning of Linear Dynamical Systems as a Non-Commutative Polynomial Optimization Problem
di: Zhou, Quan, et al.
Pubblicazione: (2020)
di: Zhou, Quan, et al.
Pubblicazione: (2020)
Structured Difference-of-Q via Orthogonal Learning
di: Cao, Defu, et al.
Pubblicazione: (2024)
di: Cao, Defu, et al.
Pubblicazione: (2024)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
Robust Gaussian Processes via Relevance Pursuit
di: Ament, Sebastian, et al.
Pubblicazione: (2024)
di: Ament, Sebastian, et al.
Pubblicazione: (2024)
Online Learning of Kalman Filtering: From Output to State Estimation
di: Ye, Lintao, et al.
Pubblicazione: (2026)
di: Ye, Lintao, et al.
Pubblicazione: (2026)
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes
di: Wan, Yi, et al.
Pubblicazione: (2024)
di: Wan, Yi, et al.
Pubblicazione: (2024)
Learning Weakly Communicating Average-Reward CMDPs: Strong Duality and Improved Regret
di: Yu, Kihyun, et al.
Pubblicazione: (2026)
di: Yu, Kihyun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026) -
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022) -
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026) -
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025) -
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)