Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Le, Chen, Jiayu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
por: Yang, Rui, et al.
Publicado: (2023)
por: Yang, Rui, et al.
Publicado: (2023)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
por: Chen, Jiayu, et al.
Publicado: (2025)
por: Chen, Jiayu, et al.
Publicado: (2025)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
por: Xu, Jiawei, et al.
Publicado: (2024)
por: Xu, Jiawei, et al.
Publicado: (2024)
Corruption Robust Offline Reinforcement Learning with Human Feedback
por: Mandal, Debmalya, et al.
Publicado: (2024)
por: Mandal, Debmalya, et al.
Publicado: (2024)
FairSAM: Fair Classification on Corrupted Data Through Sharpness-Aware Minimization
por: Dai, Yucong, et al.
Publicado: (2025)
por: Dai, Yucong, et al.
Publicado: (2025)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
por: Liu, Zeyuan, et al.
Publicado: (2025)
por: Liu, Zeyuan, et al.
Publicado: (2025)
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
por: Chen, Jiayu, et al.
Publicado: (2024)
por: Chen, Jiayu, et al.
Publicado: (2024)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
NCSAM Noise-Compensated Sharpness-Aware Minimization for Noisy Label Learning
por: Xu, Jiayu, et al.
Publicado: (2026)
por: Xu, Jiayu, et al.
Publicado: (2026)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
por: He, Longxiang, et al.
Publicado: (2025)
por: He, Longxiang, et al.
Publicado: (2025)
Sharpness-Aware Minimization in Logit Space Efficiently Enhances Direct Preference Optimization
por: Luo, Haocheng, et al.
Publicado: (2026)
por: Luo, Haocheng, et al.
Publicado: (2026)
Attributing Data for Sharpness-Aware Minimization
por: Ren, Chenyang, et al.
Publicado: (2025)
por: Ren, Chenyang, et al.
Publicado: (2025)
Stability Analysis of Sharpness-Aware Minimization
por: Kim, Hoki, et al.
Publicado: (2023)
por: Kim, Hoki, et al.
Publicado: (2023)
Fast Graph Sharpness-Aware Minimization for Enhancing and Accelerating Few-Shot Node Classification
por: Luo, Yihong, et al.
Publicado: (2024)
por: Luo, Yihong, et al.
Publicado: (2024)
Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment
por: Petitbois, Mathieu, et al.
Publicado: (2026)
por: Petitbois, Mathieu, et al.
Publicado: (2026)
QuAIL: Quality-Aware Inertial Learning for Robust Training under Data Corruption
por: Sabella, Mattia, et al.
Publicado: (2026)
por: Sabella, Mattia, et al.
Publicado: (2026)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
por: Xu, Zhongling, et al.
Publicado: (2026)
por: Xu, Zhongling, et al.
Publicado: (2026)
Towards Understanding The Calibration Benefits of Sharpness-Aware Minimization
por: Tan, Chengli, et al.
Publicado: (2025)
por: Tan, Chengli, et al.
Publicado: (2025)
Membership Privacy Risks of Sharpness Aware Minimization
por: Kim, Young In, et al.
Publicado: (2023)
por: Kim, Young In, et al.
Publicado: (2023)
Navigating Potholes with Geometry-Aware Sharpness Minimization
por: Dufort-Labbé, Simon, et al.
Publicado: (2026)
por: Dufort-Labbé, Simon, et al.
Publicado: (2026)
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
por: Liu, Zhishuai, et al.
Publicado: (2024)
por: Liu, Zhishuai, et al.
Publicado: (2024)
Revisiting Sharpness-Aware Minimization: A More Faithful and Effective Implementation
por: Chen, Jianlong, et al.
Publicado: (2026)
por: Chen, Jianlong, et al.
Publicado: (2026)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
por: Zhou, Xue, et al.
Publicado: (2025)
por: Zhou, Xue, et al.
Publicado: (2025)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
por: Galesloot, Maris F. L., et al.
Publicado: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
por: Nguyen, Thanh, et al.
Publicado: (2024)
por: Nguyen, Thanh, et al.
Publicado: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
por: Tang, Cheng, et al.
Publicado: (2024)
por: Tang, Cheng, et al.
Publicado: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
por: Jia, Zeyu, et al.
Publicado: (2024)
por: Jia, Zeyu, et al.
Publicado: (2024)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
por: Zhang, Liyu, et al.
Publicado: (2024)
por: Zhang, Liyu, et al.
Publicado: (2024)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
por: Yang, Letian, et al.
Publicado: (2026)
por: Yang, Letian, et al.
Publicado: (2026)
X-SAM: Boosting Sharpness-Aware Minimization with Dominant-Eigenvector Gradient Correction
por: Duan, Hongru, et al.
Publicado: (2026)
por: Duan, Hongru, et al.
Publicado: (2026)
Improving generalization of robot locomotion policies via Sharpness-Aware Reinforcement Learning
por: Bochem, Severin, et al.
Publicado: (2024)
por: Bochem, Severin, et al.
Publicado: (2024)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
por: Xia, Zhangjie, et al.
Publicado: (2026)
por: Xia, Zhangjie, et al.
Publicado: (2026)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
por: Wen, Xiaoyu, et al.
Publicado: (2024)
por: Wen, Xiaoyu, et al.
Publicado: (2024)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
por: Kim, Young In, et al.
Publicado: (2025)
por: Kim, Young In, et al.
Publicado: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
por: Li, Mingxuan, et al.
Publicado: (2026)
por: Li, Mingxuan, et al.
Publicado: (2026)
Offline Reinforcement Learning with Imbalanced Datasets
por: Jiang, Li, et al.
Publicado: (2023)
por: Jiang, Li, et al.
Publicado: (2023)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
por: Yang, Yiqin, et al.
Publicado: (2026)
por: Yang, Yiqin, et al.
Publicado: (2026)
Variational Offline Multi-agent Skill Discovery
por: Chen, Jiayu, et al.
Publicado: (2024)
por: Chen, Jiayu, et al.
Publicado: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
por: Yang, Rui, et al.
Publicado: (2023) -
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
por: Chen, Jiayu, et al.
Publicado: (2025) -
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
por: Xu, Jiawei, et al.
Publicado: (2024) -
Corruption Robust Offline Reinforcement Learning with Human Feedback
por: Mandal, Debmalya, et al.
Publicado: (2024) -
FairSAM: Fair Classification on Corrupted Data Through Sharpness-Aware Minimization
por: Dai, Yucong, et al.
Publicado: (2025)