Uncertainty-Aware Rank-One MIMO Q Network Framework for Accelerated Offline Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Nguyen, Thanh, Luu, Tung, Ton, Tri, Kim, Sungwoong, Yoo, Chang D. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
von: Nguyen, Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thanh, et al.
Veröffentlicht: (2024)
On the Perturbed States for Transformed Input-robust Reinforcement Learning
von: Luu, Tung M., et al.
Veröffentlicht: (2024)
von: Luu, Tung M., et al.
Veröffentlicht: (2024)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
von: Nguyen, Thanh, et al.
Veröffentlicht: (2025)
von: Nguyen, Thanh, et al.
Veröffentlicht: (2025)
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
von: Luu, Tung Minh, et al.
Veröffentlicht: (2025)
von: Luu, Tung Minh, et al.
Veröffentlicht: (2025)
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
von: Luu, Tung M., et al.
Veröffentlicht: (2025)
von: Luu, Tung M., et al.
Veröffentlicht: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
von: Yan, Teng, et al.
Veröffentlicht: (2024)
von: Yan, Teng, et al.
Veröffentlicht: (2024)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
von: Lee, Younghwan, et al.
Veröffentlicht: (2025)
von: Lee, Younghwan, et al.
Veröffentlicht: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Mitigating Adversarial Perturbations for Deep Reinforcement Learning via Vector Quantization
von: Luu, Tung M., et al.
Veröffentlicht: (2024)
von: Luu, Tung M., et al.
Veröffentlicht: (2024)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
von: Alles, Marvin, et al.
Veröffentlicht: (2025)
von: Alles, Marvin, et al.
Veröffentlicht: (2025)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
von: Wu, Kun, et al.
Veröffentlicht: (2024)
von: Wu, Kun, et al.
Veröffentlicht: (2024)
Robust Policy Learning via Offline Skill Diffusion
von: Kim, Woo Kyung, et al.
Veröffentlicht: (2024)
von: Kim, Woo Kyung, et al.
Veröffentlicht: (2024)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
von: Li, Chenhao, et al.
Veröffentlicht: (2025)
von: Li, Chenhao, et al.
Veröffentlicht: (2025)
RankQ: Offline-to-Online Reinforcement Learning via Self-Supervised Action Ranking
von: Choi, Andrew, et al.
Veröffentlicht: (2026)
von: Choi, Andrew, et al.
Veröffentlicht: (2026)
Equivariant Offline Reinforcement Learning
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
Accelerating Residual Reinforcement Learning with Uncertainty Estimation
von: Dodeja, Lakshita, et al.
Veröffentlicht: (2025)
von: Dodeja, Lakshita, et al.
Veröffentlicht: (2025)
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
von: Lee, Sungyoung, et al.
Veröffentlicht: (2026)
von: Lee, Sungyoung, et al.
Veröffentlicht: (2026)
Graph-Assisted Stitching for Offline Hierarchical Reinforcement Learning
von: Baek, Seungho, et al.
Veröffentlicht: (2025)
von: Baek, Seungho, et al.
Veröffentlicht: (2025)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
von: Song, Yeda, et al.
Veröffentlicht: (2024)
von: Song, Yeda, et al.
Veröffentlicht: (2024)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
Trajectory-Level Data Augmentation for Offline Reinforcement Learning
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
EnCoMP: Enhanced Covert Maneuver Planning with Adaptive Threat-Aware Visibility Estimation using Offline Reinforcement Learning
von: Hossain, Jumman, et al.
Veröffentlicht: (2024)
von: Hossain, Jumman, et al.
Veröffentlicht: (2024)
Offline Reinforcement Learning with Discrete Diffusion Skills
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
Improving Offline Reinforcement Learning with Inaccurate Simulators
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
A Clean Slate for Offline Reinforcement Learning
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
von: Li, Huanyu, et al.
Veröffentlicht: (2026)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
Variational OOD State Correction for Offline Reinforcement Learning
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
von: Su, Huikang, et al.
Veröffentlicht: (2025)
von: Su, Huikang, et al.
Veröffentlicht: (2025)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
von: Huang, Xingshuai, et al.
Veröffentlicht: (2024)
von: Huang, Xingshuai, et al.
Veröffentlicht: (2024)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
von: Hussing, Marcel, et al.
Veröffentlicht: (2023)
BiCQL-ML: A Bi-Level Conservative Q-Learning Framework for Maximum Likelihood Inverse Reinforcement Learning
von: Park, Junsung
Veröffentlicht: (2025)
von: Park, Junsung
Veröffentlicht: (2025)
Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation
von: Lee, Donghoon, et al.
Veröffentlicht: (2025)
von: Lee, Donghoon, et al.
Veröffentlicht: (2025)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
von: Nguyen, Thanh, et al.
Veröffentlicht: (2024) -
On the Perturbed States for Transformed Input-robust Reinforcement Learning
von: Luu, Tung M., et al.
Veröffentlicht: (2024) -
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
von: Nguyen, Thanh, et al.
Veröffentlicht: (2025) -
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
von: Luu, Tung Minh, et al.
Veröffentlicht: (2025) -
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
von: Luu, Tung M., et al.
Veröffentlicht: (2025)