Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Qingjun, Zhou, Hongtu, Yu, Hang, Zhao, Junqiao, Zhao, Yanping, Ye, Chen, Wang, Ziqiao, Chen, Guang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network
par: Chen, Qian, et autres
Publié: (2026)
par: Chen, Qian, et autres
Publié: (2026)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
par: Chen, Xuyang, et autres
Publié: (2025)
par: Chen, Xuyang, et autres
Publié: (2025)
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
par: Huang, Chang, et autres
Publié: (2024)
par: Huang, Chang, et autres
Publié: (2024)
MutualVPR: A Mutual Learning Framework for Resolving Supervision Inconsistencies via Adaptive Clustering
par: Gu, Qiwen, et autres
Publié: (2024)
par: Gu, Qiwen, et autres
Publié: (2024)
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
par: Ada, Suzan Ece, et autres
Publié: (2023)
par: Ada, Suzan Ece, et autres
Publié: (2023)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
par: Gao, Chen-Xiao, et autres
Publié: (2025)
par: Gao, Chen-Xiao, et autres
Publié: (2025)
ASTRO: Adaptive Stitching via Dynamics-Guided Trajectory Rollouts
par: Yu, Hang, et autres
Publié: (2025)
par: Yu, Hang, et autres
Publié: (2025)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
par: Tu, Songjun, et autres
Publié: (2024)
par: Tu, Songjun, et autres
Publié: (2024)
Towards an Information Theoretic Framework of Context-Based Offline Meta-Reinforcement Learning
par: Li, Lanqing, et autres
Publié: (2024)
par: Li, Lanqing, et autres
Publié: (2024)
Focus On What Matters: Separated Models For Visual-Based RL Generalization
par: Zhang, Di, et autres
Publié: (2024)
par: Zhang, Di, et autres
Publié: (2024)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
par: Chen, Tianyu, et autres
Publié: (2024)
par: Chen, Tianyu, et autres
Publié: (2024)
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2025)
par: Chen, Haohui, et autres
Publié: (2025)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2023)
par: McInroe, Trevor, et autres
Publié: (2023)
Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning
par: Chen, Xiaocong, et autres
Publié: (2024)
par: Chen, Xiaocong, et autres
Publié: (2024)
Offline Reinforcement Learning with Penalized Action Noise Injection
par: Oh, JunHyeok, et autres
Publié: (2025)
par: Oh, JunHyeok, et autres
Publié: (2025)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
par: Yeom, Junghyuk, et autres
Publié: (2024)
par: Yeom, Junghyuk, et autres
Publié: (2024)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
par: Liu, Jinmei, et autres
Publié: (2024)
par: Liu, Jinmei, et autres
Publié: (2024)
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
par: Zhang, Hai, et autres
Publié: (2024)
par: Zhang, Hai, et autres
Publié: (2024)
Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation
par: Zhang, Di, et autres
Publié: (2026)
par: Zhang, Di, et autres
Publié: (2026)
Diffusion for Out-of-Distribution Detection on Road Scenes and Beyond
par: Galesso, Silvio, et autres
Publié: (2024)
par: Galesso, Silvio, et autres
Publié: (2024)
Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL
par: Luo, Qin-Wen, et autres
Publié: (2025)
par: Luo, Qin-Wen, et autres
Publié: (2025)
Q-value Regularized Transformer for Offline Reinforcement Learning
par: Hu, Shengchao, et autres
Publié: (2024)
par: Hu, Shengchao, et autres
Publié: (2024)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
par: Liu, Xu-Hui, et autres
Publié: (2024)
par: Liu, Xu-Hui, et autres
Publié: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Rethinking Out-of-Distribution Detection on Imbalanced Data Distribution
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Task-based Regularization in Penalized Least-Squares for Binary Signal Detection Tasks in Medical Image Denoising
par: Chen, Wentao, et autres
Publié: (2025)
par: Chen, Wentao, et autres
Publié: (2025)
LEASE: Offline Preference-based Reinforcement Learning with High Sample Efficiency
par: Liu, Xiao-Yin, et autres
Publié: (2024)
par: Liu, Xiao-Yin, et autres
Publié: (2024)
OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
par: Yao, Yihang, et autres
Publié: (2024)
par: Yao, Yihang, et autres
Publié: (2024)
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
par: Pang, Teng, et autres
Publié: (2025)
par: Pang, Teng, et autres
Publié: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
par: Zhang, Tianle, et autres
Publié: (2024)
par: Zhang, Tianle, et autres
Publié: (2024)
Exploiting Diffusion Prior for Out-of-Distribution Detection
par: Zhu, Armando, et autres
Publié: (2024)
par: Zhu, Armando, et autres
Publié: (2024)
Gradient-Regularized Out-of-Distribution Detection
par: Sharifi, Sina, et autres
Publié: (2024)
par: Sharifi, Sina, et autres
Publié: (2024)
Distributionally Robust Graph Out-of-Distribution Recommendation via Diffusion Model
par: Zhao, Chu, et autres
Publié: (2025)
par: Zhao, Chu, et autres
Publié: (2025)
Graph Representation Learning via Causal Diffusion for Out-of-Distribution Recommendation
par: Zhao, Chu, et autres
Publié: (2024)
par: Zhao, Chu, et autres
Publié: (2024)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
par: Kim, Jeonghye, et autres
Publié: (2025)
par: Kim, Jeonghye, et autres
Publié: (2025)
Spiking Layer-Adaptive Magnitude-based Pruning
par: Wang, Junqiao, et autres
Publié: (2026)
par: Wang, Junqiao, et autres
Publié: (2026)
Vision-Based Deep Reinforcement Learning of UAV Autonomous Navigation Using Privileged Information
par: Wang, Junqiao, et autres
Publié: (2024)
par: Wang, Junqiao, et autres
Publié: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
par: Wang, Zhiyong, et autres
Publié: (2025)
par: Wang, Zhiyong, et autres
Publié: (2025)
DL-SLOT: Dynamic LiDAR SLAM and object tracking based on collaborative graph optimization
par: Tian, Xuebo, et autres
Publié: (2022)
par: Tian, Xuebo, et autres
Publié: (2022)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
par: Chen, Rufeng, et autres
Publié: (2026)
par: Chen, Rufeng, et autres
Publié: (2026)
Documents similaires
-
ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network
par: Chen, Qian, et autres
Publié: (2026) -
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
par: Chen, Xuyang, et autres
Publié: (2025) -
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
par: Huang, Chang, et autres
Publié: (2024) -
MutualVPR: A Mutual Learning Framework for Resolving Supervision Inconsistencies via Adaptive Clustering
par: Gu, Qiwen, et autres
Publié: (2024) -
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning
par: Ada, Suzan Ece, et autres
Publié: (2023)