Percentile Criterion Optimization in Offline Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Lobo, Elita A., Cousins, Cyrus, Zick, Yair, Petrik, Marek |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fair and Welfare-Efficient Constrained Multi-matchings under Uncertainty
por: Lobo, Elita, et al.
Publicado: (2024)
por: Lobo, Elita, et al.
Publicado: (2024)
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
por: Lobo, Elita, et al.
Publicado: (2024)
por: Lobo, Elita, et al.
Publicado: (2024)
Towards AI Transparency and Accountability: A Global Framework for Exchanging Information on AI Systems
por: Buckley, Warren, et al.
Publicado: (2023)
por: Buckley, Warren, et al.
Publicado: (2023)
Solving Multi-Model MDPs by Coordinate Ascent and Dynamic Programming
por: Su, Xihong, et al.
Publicado: (2024)
por: Su, Xihong, et al.
Publicado: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Online Optimization for Offline Safe Reinforcement Learning
por: Chemingui, Yassine, et al.
Publicado: (2025)
por: Chemingui, Yassine, et al.
Publicado: (2025)
Risk-averse Total-reward MDPs with ERM and EVaR
por: Su, Xihong, et al.
Publicado: (2024)
por: Su, Xihong, et al.
Publicado: (2024)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
por: Zhang, Tianle, et al.
Publicado: (2024)
por: Zhang, Tianle, et al.
Publicado: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
por: Gao, Chen-Xiao, et al.
Publicado: (2025)
por: Gao, Chen-Xiao, et al.
Publicado: (2025)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
por: Kang, Hyungkyu, et al.
Publicado: (2025)
por: Kang, Hyungkyu, et al.
Publicado: (2025)
State-Constrained Offline Reinforcement Learning
por: Hepburn, Charles A., et al.
Publicado: (2024)
por: Hepburn, Charles A., et al.
Publicado: (2024)
Policy Gradient for Robust Markov Decision Processes
por: Wang, Qiuhao, et al.
Publicado: (2024)
por: Wang, Qiuhao, et al.
Publicado: (2024)
RASR: Risk-Averse Soft-Robust MDPs with EVaR and Entropic Risk
por: Hau, Jia Lin, et al.
Publicado: (2022)
por: Hau, Jia Lin, et al.
Publicado: (2022)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
por: Ma, Yunchang, et al.
Publicado: (2025)
por: Ma, Yunchang, et al.
Publicado: (2025)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
por: Liu, Zongkai, et al.
Publicado: (2024)
por: Liu, Zongkai, et al.
Publicado: (2024)
Preference Elicitation for Offline Reinforcement Learning
por: Pace, Alizée, et al.
Publicado: (2024)
por: Pace, Alizée, et al.
Publicado: (2024)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
Offline Reinforcement Learning with Imputed Rewards
por: Romeo, Carlo, et al.
Publicado: (2024)
por: Romeo, Carlo, et al.
Publicado: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
por: Jiang, Li, et al.
Publicado: (2023)
por: Jiang, Li, et al.
Publicado: (2023)
The Generalization Gap in Offline Reinforcement Learning
por: Mediratta, Ishita, et al.
Publicado: (2023)
por: Mediratta, Ishita, et al.
Publicado: (2023)
OffSim: Offline Simulator for Model-based Offline Inverse Reinforcement Learning
por: Ahn, Woo-Jin, et al.
Publicado: (2025)
por: Ahn, Woo-Jin, et al.
Publicado: (2025)
ISEP: Implicit Support Expansion for Offline Reinforcement Learning via Stochastic Policy Optimization
por: Chen, Yifei, et al.
Publicado: (2026)
por: Chen, Yifei, et al.
Publicado: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025)
por: Xu, Qiushui, et al.
Publicado: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
por: Liu, Wenhui, et al.
Publicado: (2025)
por: Liu, Wenhui, et al.
Publicado: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022)
por: Lyu, Jiafei, et al.
Publicado: (2022)
Doubly Mild Generalization for Offline Reinforcement Learning
por: Mao, Yixiu, et al.
Publicado: (2024)
por: Mao, Yixiu, et al.
Publicado: (2024)
KAN v.s. MLP for Offline Reinforcement Learning
por: Guo, Haihong, et al.
Publicado: (2024)
por: Guo, Haihong, et al.
Publicado: (2024)
Offline Reinforcement Learning with Behavioral Supervisor Tuning
por: Srinivasan, Padmanaba, et al.
Publicado: (2024)
por: Srinivasan, Padmanaba, et al.
Publicado: (2024)
Mutual Information Regularized Offline Reinforcement Learning
por: Ma, Xiao, et al.
Publicado: (2022)
por: Ma, Xiao, et al.
Publicado: (2022)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
por: Wibault, Clarisse, et al.
Publicado: (2026)
por: Wibault, Clarisse, et al.
Publicado: (2026)
Offline Reinforcement Learning with Generative Trajectory Policies
por: Feng, Xinsong, et al.
Publicado: (2025)
por: Feng, Xinsong, et al.
Publicado: (2025)
Behavior Preference Regression for Offline Reinforcement Learning
por: Srinivasan, Padmanaba, et al.
Publicado: (2025)
por: Srinivasan, Padmanaba, et al.
Publicado: (2025)
Offline Reinforcement Learning with Universal Horizon Models
por: Chung, Hojun, et al.
Publicado: (2026)
por: Chung, Hojun, et al.
Publicado: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
por: Chae, Jongseong, et al.
Publicado: (2026)
por: Chae, Jongseong, et al.
Publicado: (2026)
The Three Regimes of Offline-to-Online Reinforcement Learning
por: Li, Lu, et al.
Publicado: (2025)
por: Li, Lu, et al.
Publicado: (2025)
Federated Ensemble-Directed Offline Reinforcement Learning
por: Rengarajan, Desik, et al.
Publicado: (2023)
por: Rengarajan, Desik, et al.
Publicado: (2023)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
por: Yang, Letian, et al.
Publicado: (2026)
por: Yang, Letian, et al.
Publicado: (2026)
Ejemplares similares
-
Fair and Welfare-Efficient Constrained Multi-matchings under Uncertainty
por: Lobo, Elita, et al.
Publicado: (2024) -
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
por: Lobo, Elita, et al.
Publicado: (2024) -
Towards AI Transparency and Accountability: A Global Framework for Exchanging Information on AI Systems
por: Buckley, Warren, et al.
Publicado: (2023) -
Solving Multi-Model MDPs by Coordinate Ascent and Dynamic Programming
por: Su, Xihong, et al.
Publicado: (2024) -
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)