Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yan, Teng, Ruan, Zhendong, Cai, Yaobang, Han, Yu, Li, Wenxian, Zhang, Yang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making
von: Kim, Jeonghye, et al.
Veröffentlicht: (2023)
von: Kim, Jeonghye, et al.
Veröffentlicht: (2023)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
von: Li, Mingxuan, et al.
Veröffentlicht: (2026)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026)
Deep Reinforcement Learning for Advanced Longitudinal Control and Collision Avoidance in High-Risk Driving Scenarios
von: Chen, Dianwei, et al.
Veröffentlicht: (2024)
von: Chen, Dianwei, et al.
Veröffentlicht: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
von: Zhao, Kai, et al.
Veröffentlicht: (2023)
Q-value Regularized Transformer for Offline Reinforcement Learning
von: Hu, Shengchao, et al.
Veröffentlicht: (2024)
von: Hu, Shengchao, et al.
Veröffentlicht: (2024)
Uncertainty-Aware Rank-One MIMO Q Network Framework for Accelerated Offline Reinforcement Learning
von: Nguyen, Thanh, et al.
Veröffentlicht: (2026)
von: Nguyen, Thanh, et al.
Veröffentlicht: (2026)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
von: Alles, Marvin, et al.
Veröffentlicht: (2025)
von: Alles, Marvin, et al.
Veröffentlicht: (2025)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
von: Wu, Kun, et al.
Veröffentlicht: (2024)
von: Wu, Kun, et al.
Veröffentlicht: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
von: Tang, Cheng, et al.
Veröffentlicht: (2024)
von: Tang, Cheng, et al.
Veröffentlicht: (2024)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
von: Omura, Motoki, et al.
Veröffentlicht: (2025)
von: Omura, Motoki, et al.
Veröffentlicht: (2025)
Equivariant Offline Reinforcement Learning
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
von: Tangri, Arsh, et al.
Veröffentlicht: (2024)
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
von: Zhang, Hongyin, et al.
Veröffentlicht: (2023)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
von: Zheng, Yinan, et al.
Veröffentlicht: (2024)
von: Zheng, Yinan, et al.
Veröffentlicht: (2024)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
von: Su, Huikang, et al.
Veröffentlicht: (2025)
von: Su, Huikang, et al.
Veröffentlicht: (2025)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2023)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
Trajectory-Level Data Augmentation for Offline Reinforcement Learning
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Nakhaei, Mohammadreza, et al.
Veröffentlicht: (2024)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
von: Pan, Minting, et al.
Veröffentlicht: (2025)
von: Pan, Minting, et al.
Veröffentlicht: (2025)
Beyond Non-Expert Demonstrations: Outcome-Driven Action Constraint for Offline Reinforcement Learning
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
von: Jiang, Ke, et al.
Veröffentlicht: (2025)
Online Decision MetaMorphFormer: A Casual Transformer-Based Reinforcement Learning Framework of Universal Embodied Intelligence
von: Ji, Luo, et al.
Veröffentlicht: (2024)
von: Ji, Luo, et al.
Veröffentlicht: (2024)
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
von: Lee, Sungyoung, et al.
Veröffentlicht: (2026)
von: Lee, Sungyoung, et al.
Veröffentlicht: (2026)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
von: Pan, Minting, et al.
Veröffentlicht: (2023)
von: Pan, Minting, et al.
Veröffentlicht: (2023)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
von: Huang, Dongchi, et al.
Veröffentlicht: (2025)
von: Huang, Dongchi, et al.
Veröffentlicht: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
von: Lee, Dongsu, et al.
Veröffentlicht: (2026)
von: Lee, Dongsu, et al.
Veröffentlicht: (2026)
Safe Offline Reinforcement Learning with Real-Time Budget Constraints
von: Lin, Qian, et al.
Veröffentlicht: (2023)
von: Lin, Qian, et al.
Veröffentlicht: (2023)
Offline Reinforcement Learning with Discrete Diffusion Skills
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
von: Qiao, RuiXi, et al.
Veröffentlicht: (2025)
Improving Offline Reinforcement Learning with Inaccurate Simulators
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
von: Hou, Yiwen, et al.
Veröffentlicht: (2024)
A Clean Slate for Offline Reinforcement Learning
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2025)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
von: Lei, Kun, et al.
Veröffentlicht: (2023)
von: Lei, Kun, et al.
Veröffentlicht: (2023)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
von: Ayabe, Shingo, et al.
Veröffentlicht: (2024)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
von: Sikchi, Harshit, et al.
Veröffentlicht: (2023)
von: Sikchi, Harshit, et al.
Veröffentlicht: (2023)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
von: Springenberg, Jost Tobias, et al.
Veröffentlicht: (2024)
von: Springenberg, Jost Tobias, et al.
Veröffentlicht: (2024)
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
von: Wang, Ruhan, et al.
Veröffentlicht: (2024)
von: Wang, Ruhan, et al.
Veröffentlicht: (2024)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
von: Ada, Suzan Ece, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making
von: Kim, Jeonghye, et al.
Veröffentlicht: (2023) -
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
von: Li, Mingxuan, et al.
Veröffentlicht: (2026) -
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
von: Gireesh, Nandiraju, et al.
Veröffentlicht: (2026) -
Deep Reinforcement Learning for Advanced Longitudinal Control and Collision Avoidance in High-Risk Driving Scenarios
von: Chen, Dianwei, et al.
Veröffentlicht: (2024) -
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)