Distorted Distributional Policy Evaluation for Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Iwaki, Ryo, Osogami, Takayuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mirror Descent Actor Critic via Bounded Advantage Learning
di: Iwaki, Ryo
Pubblicazione: (2025)
di: Iwaki, Ryo
Pubblicazione: (2025)
Achieving PAC Guarantees in Mechanism Design through Multi-Armed Bandits
di: Osogami, Takayuki, et al.
Pubblicazione: (2024)
di: Osogami, Takayuki, et al.
Pubblicazione: (2024)
Mildly Constrained Evaluation Policy for Offline Reinforcement Learning
di: Xu, Linjie, et al.
Pubblicazione: (2023)
di: Xu, Linjie, et al.
Pubblicazione: (2023)
Discovering Multiple Solutions from a Single Task in Offline Reinforcement Learning
di: Osa, Takayuki, et al.
Pubblicazione: (2024)
di: Osa, Takayuki, et al.
Pubblicazione: (2024)
Evaluation-Time Policy Switching for Offline Reinforcement Learning
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2025)
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning from Datasets with Structured Non-Stationarity
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
di: Ackermann, Johannes, et al.
Pubblicazione: (2024)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
Distributional Offline Policy Evaluation with Predictive Error Guarantees
di: Wu, Runzhe, et al.
Pubblicazione: (2023)
di: Wu, Runzhe, et al.
Pubblicazione: (2023)
AI Agents Should be Regulated Based on the Extent of Their Autonomous Operations
di: Osogami, Takayuki
Pubblicazione: (2025)
di: Osogami, Takayuki
Pubblicazione: (2025)
Active Reinforcement Learning Strategies for Offline Policy Improvement
di: Dukkipati, Ambedkar, et al.
Pubblicazione: (2024)
di: Dukkipati, Ambedkar, et al.
Pubblicazione: (2024)
Hypercube Policy Regularization Framework for Offline Reinforcement Learning
di: Shen, Yi, et al.
Pubblicazione: (2024)
di: Shen, Yi, et al.
Pubblicazione: (2024)
Adaptive Scaling of Policy Constraints for Offline Reinforcement Learning
di: Jing, Tan, et al.
Pubblicazione: (2025)
di: Jing, Tan, et al.
Pubblicazione: (2025)
Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning
di: Kobanda, Anthony, et al.
Pubblicazione: (2024)
di: Kobanda, Anthony, et al.
Pubblicazione: (2024)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
di: Ada, Suzan Ece, et al.
Pubblicazione: (2023)
di: Ada, Suzan Ece, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Policy-regularized Offline Multi-objective Reinforcement Learning
di: Lin, Qian, et al.
Pubblicazione: (2024)
di: Lin, Qian, et al.
Pubblicazione: (2024)
SCOPE-RL: A Python Library for Offline Reinforcement Learning and Off-Policy Evaluation
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
di: McInroe, Trevor, et al.
Pubblicazione: (2023)
OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2024)
di: Yao, Yihang, et al.
Pubblicazione: (2024)
Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
di: Koirala, Prajwal, et al.
Pubblicazione: (2024)
A Non-Monolithic Policy Approach of Offline-to-Online Reinforcement Learning
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
Constrained Policy Optimization with Explicit Behavior Density for Offline Reinforcement Learning
di: Zhang, Jing, et al.
Pubblicazione: (2023)
di: Zhang, Jing, et al.
Pubblicazione: (2023)
Policy Constraint by Only Support Constraint for Offline Reinforcement Learning
di: Gao, Yunkai, et al.
Pubblicazione: (2025)
di: Gao, Yunkai, et al.
Pubblicazione: (2025)
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
di: Khattar, Vanshaj, et al.
Pubblicazione: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
di: Zhang, Tianle, et al.
Pubblicazione: (2024)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
di: Liu, Vincent, et al.
Pubblicazione: (2023)
di: Liu, Vincent, et al.
Pubblicazione: (2023)
To Switch or Not to Switch? Balanced Policy Switching in Offline Reinforcement Learning
di: Ma, Tao, et al.
Pubblicazione: (2024)
di: Ma, Tao, et al.
Pubblicazione: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
di: Hu, Jifeng, et al.
Pubblicazione: (2025)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2025)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning
di: Hedman, Marcel, et al.
Pubblicazione: (2026)
di: Hedman, Marcel, et al.
Pubblicazione: (2026)
TEA: Trajectory Encoding Augmentation for Robust and Transferable Policies in Offline Reinforcement Learning
di: Ormancı, Batıkan Bora, et al.
Pubblicazione: (2024)
di: Ormancı, Batıkan Bora, et al.
Pubblicazione: (2024)
Your Offline Policy is Not Trustworthy: Bilevel Reinforcement Learning for Sequential Portfolio Optimization
di: Yuan, Haochen, et al.
Pubblicazione: (2025)
di: Yuan, Haochen, et al.
Pubblicazione: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
Offline and Distributional Reinforcement Learning for Wireless Communications
di: Eldeeb, Eslam, et al.
Pubblicazione: (2025)
di: Eldeeb, Eslam, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mirror Descent Actor Critic via Bounded Advantage Learning
di: Iwaki, Ryo
Pubblicazione: (2025) -
Achieving PAC Guarantees in Mechanism Design through Multi-Armed Bandits
di: Osogami, Takayuki, et al.
Pubblicazione: (2024) -
Mildly Constrained Evaluation Policy for Offline Reinforcement Learning
di: Xu, Linjie, et al.
Pubblicazione: (2023) -
Discovering Multiple Solutions from a Single Task in Offline Reinforcement Learning
di: Osa, Takayuki, et al.
Pubblicazione: (2024) -
Evaluation-Time Policy Switching for Offline Reinforcement Learning
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2025)