Mitigating Distribution Shift in Model-based Offline RL via Shifts-aware Reward Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Wang, Li, Haoran, Zhang, Zicheng, Han, Congying, Zhou, Chi, Lv, Jiayu, Guo, Tiande |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dual Alignment Maximin Optimization for Offline Model-based RL
por: Zhou, Chi, et al.
Publicado: (2025)
por: Zhou, Chi, et al.
Publicado: (2025)
Towards Optimal Adversarial Robust Reinforcement Learning with Infinity Measurement Error
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
On the Tension Between Optimality and Adversarial Robustness in Policy Optimization
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
Towards Optimal Adversarial Robust Q-learning with Bellman Infinity-error
por: Li, Haoran, et al.
Publicado: (2024)
por: Li, Haoran, et al.
Publicado: (2024)
Purity Law for Generalizable Neural TSP Solvers
por: Liu, Wenzhao, et al.
Publicado: (2025)
por: Liu, Wenzhao, et al.
Publicado: (2025)
A Fast Anti-Jamming Cognitive Radar Deployment Algorithm Based on Reinforcement Learning
por: Cai, Wencheng, et al.
Publicado: (2025)
por: Cai, Wencheng, et al.
Publicado: (2025)
Understanding Oversmoothing in Diffusion-Based GNNs From the Perspective of Operator Semigroup Theory
por: Zhao, Weichen, et al.
Publicado: (2024)
por: Zhao, Weichen, et al.
Publicado: (2024)
OMG-RL:Offline Model-based Guided Reward Learning for Heparin Treatment
por: Lim, Yooseok, et al.
Publicado: (2024)
por: Lim, Yooseok, et al.
Publicado: (2024)
ShiftKD: Benchmarking Knowledge Distillation under Distribution Shift
por: Zhang, Songming, et al.
Publicado: (2023)
por: Zhang, Songming, et al.
Publicado: (2023)
Sample-Mean Anchored Thompson Sampling for Offline-to-Online Learning with Distribution Shift
por: Li, Bochao, et al.
Publicado: (2026)
por: Li, Bochao, et al.
Publicado: (2026)
ODD: Overlap-aware Estimation of Model Performance under Distribution Shift
por: Mishra, Aayush, et al.
Publicado: (2025)
por: Mishra, Aayush, et al.
Publicado: (2025)
The Offline-Frontier Shift: Diagnosing Distributional Limits in Generative Multi-Objective Optimization
por: Holly, Stephanie, et al.
Publicado: (2026)
por: Holly, Stephanie, et al.
Publicado: (2026)
Validity Learning on Failures: Mitigating the Distribution Shift in Autonomous Vehicle Planning
por: Arasteh, Fazel, et al.
Publicado: (2024)
por: Arasteh, Fazel, et al.
Publicado: (2024)
Partial Action Replacement: Tackling Distribution Shift in Offline MARL
por: Jin, Yue, et al.
Publicado: (2025)
por: Jin, Yue, et al.
Publicado: (2025)
Variance-aware Reward Modeling with Anchor Guidance
por: Fang, Shuxing, et al.
Publicado: (2026)
por: Fang, Shuxing, et al.
Publicado: (2026)
Label Alignment Regularization for Distribution Shift
por: Imani, Ehsan, et al.
Publicado: (2022)
por: Imani, Ehsan, et al.
Publicado: (2022)
Causal-aware Graph Neural Architecture Search under Distribution Shifts
por: Li, Peiwen, et al.
Publicado: (2024)
por: Li, Peiwen, et al.
Publicado: (2024)
GraphMETRO: Mitigating Complex Graph Distribution Shifts via Mixture of Aligned Experts
por: Wu, Shirley, et al.
Publicado: (2023)
por: Wu, Shirley, et al.
Publicado: (2023)
MetaRM: Shifted Distributions Alignment via Meta-Learning
por: Dou, Shihan, et al.
Publicado: (2024)
por: Dou, Shihan, et al.
Publicado: (2024)
ComaDICE: Offline Cooperative Multi-Agent Reinforcement Learning with Stationary Distribution Shift Regularization
por: Bui, The Viet, et al.
Publicado: (2024)
por: Bui, The Viet, et al.
Publicado: (2024)
NodeReg: Mitigating the Imbalance and Distribution Shift Effects in Semi-Supervised Node Classification via Norm Consistency
por: Yang, Shenzhi, et al.
Publicado: (2025)
por: Yang, Shenzhi, et al.
Publicado: (2025)
Understanding and Mitigating Distribution Shifts For Machine Learning Force Fields
por: Kreiman, Tobias, et al.
Publicado: (2025)
por: Kreiman, Tobias, et al.
Publicado: (2025)
Resolving Endpoint Underfitting in Diffusion Bridges via Noise Alignment
por: Gao, Yurong, et al.
Publicado: (2026)
por: Gao, Yurong, et al.
Publicado: (2026)
OMPO: A Unified Framework for RL under Policy and Dynamics Shifts
por: Luo, Yu, et al.
Publicado: (2024)
por: Luo, Yu, et al.
Publicado: (2024)
Source Component Shift Adaptation via Offline Decomposition and Online Mixing Approach
por: Matsuno, Ryuta
Publicado: (2025)
por: Matsuno, Ryuta
Publicado: (2025)
Learning Clinical Representations Under Systematic Distribution Shift
por: Zhang, Yuanyun, et al.
Publicado: (2026)
por: Zhang, Yuanyun, et al.
Publicado: (2026)
GAS: Enhancing Reward-Cost Balance of Generative Model-assisted Offline Safe RL
por: Liu, Zifan, et al.
Publicado: (2026)
por: Liu, Zifan, et al.
Publicado: (2026)
Online Distribution Shift Detection via Recency Prediction
por: Luo, Rachel, et al.
Publicado: (2022)
por: Luo, Rachel, et al.
Publicado: (2022)
Benchmarking Distribution Shift in Tabular Data with TableShift
por: Gardner, Josh, et al.
Publicado: (2023)
por: Gardner, Josh, et al.
Publicado: (2023)
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
por: Qiao, Zhongjian, et al.
Publicado: (2025)
por: Qiao, Zhongjian, et al.
Publicado: (2025)
DR-BFR: Degradation Representation with Diffusion Models for Blind Face Restoration
por: Qiu, Xinmin, et al.
Publicado: (2024)
por: Qiu, Xinmin, et al.
Publicado: (2024)
Mitigating the Noise Shift for Denoising Generative Models via Noise Awareness Guidance
por: Zhong, Jincheng, et al.
Publicado: (2025)
por: Zhong, Jincheng, et al.
Publicado: (2025)
Testable Learning with Distribution Shift
por: Klivans, Adam R., et al.
Publicado: (2023)
por: Klivans, Adam R., et al.
Publicado: (2023)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
An Empirical Study on the Effectiveness of Incorporating Offline RL As Online RL Subroutines
por: Su, Jianhai, et al.
Publicado: (2025)
por: Su, Jianhai, et al.
Publicado: (2025)
Adapting to Online Distribution Shifts in Deep Learning: A Black-Box Approach
por: Baby, Dheeraj, et al.
Publicado: (2025)
por: Baby, Dheeraj, et al.
Publicado: (2025)
Spectral Invariant Learning for Dynamic Graphs under Distribution Shifts
por: Zhang, Zeyang, et al.
Publicado: (2024)
por: Zhang, Zeyang, et al.
Publicado: (2024)
Trustworthy Machine Learning under Distribution Shifts
por: Huang, Zhuo
Publicado: (2025)
por: Huang, Zhuo
Publicado: (2025)
Distribution Shift Is Key to Learning Invariant Prediction
por: Zheng, Hong, et al.
Publicado: (2026)
por: Zheng, Hong, et al.
Publicado: (2026)
Distribution Shift Aware Neural Tabular Learning
por: Ying, Wangyang, et al.
Publicado: (2025)
por: Ying, Wangyang, et al.
Publicado: (2025)
Ejemplares similares
-
Dual Alignment Maximin Optimization for Offline Model-based RL
por: Zhou, Chi, et al.
Publicado: (2025) -
Towards Optimal Adversarial Robust Reinforcement Learning with Infinity Measurement Error
por: Li, Haoran, et al.
Publicado: (2025) -
On the Tension Between Optimality and Adversarial Robustness in Policy Optimization
por: Li, Haoran, et al.
Publicado: (2025) -
Towards Optimal Adversarial Robust Q-learning with Bellman Infinity-error
por: Li, Haoran, et al.
Publicado: (2024) -
Purity Law for Generalizable Neural TSP Solvers
por: Liu, Wenzhao, et al.
Publicado: (2025)