Imagination-Limited Q-Learning for Offline Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Wenhui, Wu, Zhijian, Wang, Jingchao, Huang, Dingjiang, Zhou, Shuigeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025)
por: Xu, Qiushui, et al.
Publicado: (2025)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
por: Mao, Yixiu, et al.
Publicado: (2025)
por: Mao, Yixiu, et al.
Publicado: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022)
por: Lyu, Jiafei, et al.
Publicado: (2022)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
por: Yeom, Junghyuk, et al.
Publicado: (2024)
por: Yeom, Junghyuk, et al.
Publicado: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
por: Wu, Kun, et al.
Publicado: (2024)
por: Wu, Kun, et al.
Publicado: (2024)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
por: Zhang, Ziqi, et al.
Publicado: (2023)
por: Zhang, Ziqi, et al.
Publicado: (2023)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
por: Liu, Haolin, et al.
Publicado: (2026)
por: Liu, Haolin, et al.
Publicado: (2026)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
por: Park, Kwanyoung, et al.
Publicado: (2024)
por: Park, Kwanyoung, et al.
Publicado: (2024)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
por: Li, Mingxuan, et al.
Publicado: (2026)
por: Li, Mingxuan, et al.
Publicado: (2026)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
por: Zhao, Kai, et al.
Publicado: (2023)
por: Zhao, Kai, et al.
Publicado: (2023)
PIQL: Projective Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning
por: Han, Xinchen, et al.
Publicado: (2025)
por: Han, Xinchen, et al.
Publicado: (2025)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
por: Qiao, Nan, et al.
Publicado: (2026)
por: Qiao, Nan, et al.
Publicado: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning
por: Park, Jongchan, et al.
Publicado: (2025)
por: Park, Jongchan, et al.
Publicado: (2025)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
por: Tayal, Mumuksh, et al.
Publicado: (2026)
por: Tayal, Mumuksh, et al.
Publicado: (2026)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
por: Huang, Xingshuai, et al.
Publicado: (2024)
por: Huang, Xingshuai, et al.
Publicado: (2024)
Policy-regularized Offline Multi-objective Reinforcement Learning
por: Lin, Qian, et al.
Publicado: (2024)
por: Lin, Qian, et al.
Publicado: (2024)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
por: Alles, Marvin, et al.
Publicado: (2025)
por: Alles, Marvin, et al.
Publicado: (2025)
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
por: Wang, Zhiyong, et al.
Publicado: (2025)
por: Wang, Zhiyong, et al.
Publicado: (2025)
SPEQ: Offline Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning
por: Romeo, Carlo, et al.
Publicado: (2025)
por: Romeo, Carlo, et al.
Publicado: (2025)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
por: Huang, Xiao, et al.
Publicado: (2025)
por: Huang, Xiao, et al.
Publicado: (2025)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
por: Zhan, Simon Sinong, et al.
Publicado: (2025)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
por: Chen, Tianyu, et al.
Publicado: (2024)
por: Chen, Tianyu, et al.
Publicado: (2024)
Unlocking the Potential of MLLMs in Referring Expression Segmentation via a Light-weight Mask Decoder
por: Wang, Jingchao, et al.
Publicado: (2025)
por: Wang, Jingchao, et al.
Publicado: (2025)
KAN v.s. MLP for Offline Reinforcement Learning
por: Guo, Haihong, et al.
Publicado: (2024)
por: Guo, Haihong, et al.
Publicado: (2024)
Learning Spectral Diffusion Prior for Hyperspectral Image Reconstruction
por: Yu, Mingyang, et al.
Publicado: (2025)
por: Yu, Mingyang, et al.
Publicado: (2025)
IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning
por: Qin, Yihao, et al.
Publicado: (2026)
por: Qin, Yihao, et al.
Publicado: (2026)
Grid-Mapping Pseudo-Count Constraint for Offline Reinforcement Learning
por: Shen, Yi, et al.
Publicado: (2024)
por: Shen, Yi, et al.
Publicado: (2024)
Offline Reinforcement Learning with Generative Trajectory Policies
por: Feng, Xinsong, et al.
Publicado: (2025)
por: Feng, Xinsong, et al.
Publicado: (2025)
Solving Continual Offline Reinforcement Learning with Decision Transformer
por: Huang, Kaixin, et al.
Publicado: (2024)
por: Huang, Kaixin, et al.
Publicado: (2024)
Doubly Mild Generalization for Offline Reinforcement Learning
por: Mao, Yixiu, et al.
Publicado: (2024)
por: Mao, Yixiu, et al.
Publicado: (2024)
LEASE: Offline Preference-based Reinforcement Learning with High Sample Efficiency
por: Liu, Xiao-Yin, et al.
Publicado: (2024)
por: Liu, Xiao-Yin, et al.
Publicado: (2024)
Improving Offline Reinforcement Learning with Inaccurate Simulators
por: Hou, Yiwen, et al.
Publicado: (2024)
por: Hou, Yiwen, et al.
Publicado: (2024)
Preference Elicitation for Offline Reinforcement Learning
por: Pace, Alizée, et al.
Publicado: (2024)
por: Pace, Alizée, et al.
Publicado: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
por: Jiang, Li, et al.
Publicado: (2023)
por: Jiang, Li, et al.
Publicado: (2023)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
State-Constrained Offline Reinforcement Learning
por: Hepburn, Charles A., et al.
Publicado: (2024)
por: Hepburn, Charles A., et al.
Publicado: (2024)
The Generalization Gap in Offline Reinforcement Learning
por: Mediratta, Ishita, et al.
Publicado: (2023)
por: Mediratta, Ishita, et al.
Publicado: (2023)
Offline Reinforcement Learning with Imputed Rewards
por: Romeo, Carlo, et al.
Publicado: (2024)
por: Romeo, Carlo, et al.
Publicado: (2024)
Ejemplares similares
-
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025) -
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
por: Mao, Yixiu, et al.
Publicado: (2025) -
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022) -
Exclusively Penalized Q-learning for Offline Reinforcement Learning
por: Yeom, Junghyuk, et al.
Publicado: (2024) -
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
por: Wu, Kun, et al.
Publicado: (2024)