Epistemic Robust Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chenreddy, Abhilash Reddy, Delage, Erick |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
End-to-end Conditional Robust Optimization
par: Chenreddy, Abhilash, et autres
Publié: (2024)
par: Chenreddy, Abhilash, et autres
Publié: (2024)
A Survey of Contextual Optimization Methods for Decision Making under Uncertainty
par: Sadana, Utsav, et autres
Publié: (2023)
par: Sadana, Utsav, et autres
Publié: (2023)
Planning and Learning in Average Risk-aware MDPs
par: Wang, Weikai, et autres
Publié: (2025)
par: Wang, Weikai, et autres
Publié: (2025)
Actor-Critic Algorithm for Dynamic Expectile and CVaR
par: Luo, Yudong, et autres
Publié: (2026)
par: Luo, Yudong, et autres
Publié: (2026)
Boosting CVaR Policy Optimization with Quantile Gradients
par: Luo, Yudong, et autres
Publié: (2026)
par: Luo, Yudong, et autres
Publié: (2026)
Robust Data-driven Prescriptiveness Optimization
par: Poursoltani, Mehran, et autres
Publié: (2023)
par: Poursoltani, Mehran, et autres
Publié: (2023)
Risk-Aware Decision Making in Restless Bandits: Theory and Algorithms for Planning and Learning
par: Akbarzadeh, Nima, et autres
Publié: (2024)
par: Akbarzadeh, Nima, et autres
Publié: (2024)
Mitigating optimistic bias in entropic risk estimation and optimization
par: Sadana, Utsav, et autres
Publié: (2024)
par: Sadana, Utsav, et autres
Publié: (2024)
Sparse Offline Reinforcement Learning with Corruption Robustness
par: Tran, Nam Phuong, et autres
Publié: (2025)
par: Tran, Nam Phuong, et autres
Publié: (2025)
Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning
par: van Twiller, Jaike, et autres
Publié: (2025)
par: van Twiller, Jaike, et autres
Publié: (2025)
Active Reinforcement Learning Strategies for Offline Policy Improvement
par: Dukkipati, Ambedkar, et autres
Publié: (2024)
par: Dukkipati, Ambedkar, et autres
Publié: (2024)
Fair Resource Allocation in Weakly Coupled Markov Decision Processes
par: Tu, Xiaohui, et autres
Publié: (2024)
par: Tu, Xiaohui, et autres
Publié: (2024)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
par: Ye, Chenlu, et autres
Publié: (2023)
par: Ye, Chenlu, et autres
Publié: (2023)
Robust Offline Reinforcement Learning for Non-Markovian Decision Processes
par: Huang, Ruiquan, et autres
Publié: (2024)
par: Huang, Ruiquan, et autres
Publié: (2024)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
par: Galesloot, Maris F. L., et autres
Publié: (2026)
par: Galesloot, Maris F. L., et autres
Publié: (2026)
Corruption Robust Offline Reinforcement Learning with Human Feedback
par: Mandal, Debmalya, et autres
Publié: (2024)
par: Mandal, Debmalya, et autres
Publié: (2024)
Sample-Efficient Tabular Self-Play for Offline Robust Reinforcement Learning
par: Li, Na, et autres
Publié: (2025)
par: Li, Na, et autres
Publié: (2025)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
par: Wen, Xiaoyu, et autres
Publié: (2023)
par: Wen, Xiaoyu, et autres
Publié: (2023)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
par: Li, Mingxuan, et autres
Publié: (2026)
par: Li, Mingxuan, et autres
Publié: (2026)
TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning
par: Ormancı, Batıkan Bora, et autres
Publié: (2024)
par: Ormancı, Batıkan Bora, et autres
Publié: (2024)
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
par: Qiao, Zhongjian, et autres
Publié: (2025)
par: Qiao, Zhongjian, et autres
Publié: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Q-learning for Quantile MDPs: A Decomposition, Performance, and Convergence Analysis
par: Hau, Jia Lin, et autres
Publié: (2024)
par: Hau, Jia Lin, et autres
Publié: (2024)
Equivariant Offline Reinforcement Learning
par: Tangri, Arsh, et autres
Publié: (2024)
par: Tangri, Arsh, et autres
Publié: (2024)
Federated Offline Reinforcement Learning
par: Zhou, Doudou, et autres
Publié: (2022)
par: Zhou, Doudou, et autres
Publié: (2022)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
par: Zhan, Simon Sinong, et autres
Publié: (2025)
par: Zhan, Simon Sinong, et autres
Publié: (2025)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
par: Yang, Rui, et autres
Publié: (2023)
par: Yang, Rui, et autres
Publié: (2023)
Robust Bandwidth Estimation for Real-Time Communication with Offline Reinforcement Learning
par: Kai, Jian, et autres
Publié: (2025)
par: Kai, Jian, et autres
Publié: (2025)
Efficient Matroid Bandit Linear Optimization Leveraging Unimodality
par: Delage, Aurélien, et autres
Publié: (2025)
par: Delage, Aurélien, et autres
Publié: (2025)
Distributionally Robust Model-Based Offline Reinforcement Learning with Near-Optimal Sample Complexity
par: Shi, Laixi, et autres
Publié: (2022)
par: Shi, Laixi, et autres
Publié: (2022)
Session-Level Dynamic Ad Load Optimization using Offline Robust Reinforcement Learning
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
par: Ayabe, Shingo, et autres
Publié: (2024)
par: Ayabe, Shingo, et autres
Publié: (2024)
Offline Multitask Representation Learning for Reinforcement Learning
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
EUBRL: Epistemic Uncertainty Directed Bayesian Reinforcement Learning
par: Ma, Jianfei, et autres
Publié: (2025)
par: Ma, Jianfei, et autres
Publié: (2025)
Robust Offline Active Learning on Graphs
par: Wu, Yuanchen, et autres
Publié: (2024)
par: Wu, Yuanchen, et autres
Publié: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
par: Tang, Cheng, et autres
Publié: (2024)
par: Tang, Cheng, et autres
Publié: (2024)
Model-Free Robust $ϕ$-Divergence Reinforcement Learning Using Both Offline and Online Data
par: Panaganti, Kishan, et autres
Publié: (2024)
par: Panaganti, Kishan, et autres
Publié: (2024)
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
par: Liu, Zhishuai, et autres
Publié: (2024)
par: Liu, Zhishuai, et autres
Publié: (2024)
Information-Directed Offline-to-Online Reinforcement Learning
par: Chen, Keru
Publié: (2026)
par: Chen, Keru
Publié: (2026)
Temporal Abstraction in Reinforcement Learning with Offline Data
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2024)
par: Ayyagari, Ranga Shaarad, et autres
Publié: (2024)
Documents similaires
-
End-to-end Conditional Robust Optimization
par: Chenreddy, Abhilash, et autres
Publié: (2024) -
A Survey of Contextual Optimization Methods for Decision Making under Uncertainty
par: Sadana, Utsav, et autres
Publié: (2023) -
Planning and Learning in Average Risk-aware MDPs
par: Wang, Weikai, et autres
Publié: (2025) -
Actor-Critic Algorithm for Dynamic Expectile and CVaR
par: Luo, Yudong, et autres
Publié: (2026) -
Boosting CVaR Policy Optimization with Quantile Gradients
par: Luo, Yudong, et autres
Publié: (2026)