Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Zhiqiang, Pang, Teng, Xu, Rongjian, Wu, Guoqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Value-Guidance MeanFlow for Offline Multi-Agent Reinforcement Learning
por: Pang, Teng, et al.
Publicado: (2026)
por: Pang, Teng, et al.
Publicado: (2026)
Equivariant Efficient Joint Discrete and Continuous MeanFlow for Molecular Graph Generation
por: Xu, Rongjian, et al.
Publicado: (2026)
por: Xu, Rongjian, et al.
Publicado: (2026)
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
por: Pang, Teng, et al.
Publicado: (2025)
por: Pang, Teng, et al.
Publicado: (2025)
Offline Goal-conditioned Reinforcement Learning with Quasimetric Representations
por: Myers, Vivek, et al.
Publicado: (2025)
por: Myers, Vivek, et al.
Publicado: (2025)
Goal-conditioned Offline Reinforcement Learning through State Space Partitioning
por: Wang, Mianchu, et al.
Publicado: (2023)
por: Wang, Mianchu, et al.
Publicado: (2023)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
por: Wang, Mianchu, et al.
Publicado: (2023)
por: Wang, Mianchu, et al.
Publicado: (2023)
QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL
por: Lei, Xing, et al.
Publicado: (2026)
por: Lei, Xing, et al.
Publicado: (2026)
PIQL: Projective Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning
por: Han, Xinchen, et al.
Publicado: (2025)
por: Han, Xinchen, et al.
Publicado: (2025)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
por: Yeom, Junghyuk, et al.
Publicado: (2024)
por: Yeom, Junghyuk, et al.
Publicado: (2024)
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
por: Lee, Sungyoung, et al.
Publicado: (2026)
por: Lee, Sungyoung, et al.
Publicado: (2026)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
por: Li, Mingxuan, et al.
Publicado: (2026)
por: Li, Mingxuan, et al.
Publicado: (2026)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
por: Alles, Marvin, et al.
Publicado: (2025)
por: Alles, Marvin, et al.
Publicado: (2025)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
por: Yan, Teng, et al.
Publicado: (2024)
por: Yan, Teng, et al.
Publicado: (2024)
Data-Efficient Hierarchical Goal-Conditioned Reinforcement Learning via Normalizing Flows
por: Garg, Shaswat, et al.
Publicado: (2026)
por: Garg, Shaswat, et al.
Publicado: (2026)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
por: Huang, Xingshuai, et al.
Publicado: (2024)
por: Huang, Xingshuai, et al.
Publicado: (2024)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
por: Liu, Wenhui, et al.
Publicado: (2025)
por: Liu, Wenhui, et al.
Publicado: (2025)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
por: Wibault, Clarisse, et al.
Publicado: (2026)
por: Wibault, Clarisse, et al.
Publicado: (2026)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
por: Tayal, Mumuksh, et al.
Publicado: (2026)
por: Tayal, Mumuksh, et al.
Publicado: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
por: Xu, Qiushui, et al.
Publicado: (2025)
por: Xu, Qiushui, et al.
Publicado: (2025)
One-Step Flow Q-Learning: Addressing the Diffusion Policy Bottleneck in Offline Reinforcement Learning
por: Nguyen, Thanh, et al.
Publicado: (2025)
por: Nguyen, Thanh, et al.
Publicado: (2025)
Reachability Weighted Offline Goal-conditioned Resampling
por: Yang, Wenyan, et al.
Publicado: (2025)
por: Yang, Wenyan, et al.
Publicado: (2025)
Latent Representation Alignment for Offline Goal-Conditioned Reinforcement Learning
por: Kang, Hyungkyu, et al.
Publicado: (2026)
por: Kang, Hyungkyu, et al.
Publicado: (2026)
Test-time Offline Reinforcement Learning on Goal-related Experience
por: Bagatella, Marco, et al.
Publicado: (2025)
por: Bagatella, Marco, et al.
Publicado: (2025)
Offline Goal-Conditioned Reinforcement Learning with Projective Quasimetric Planning
por: Kobanda, Anthony, et al.
Publicado: (2025)
por: Kobanda, Anthony, et al.
Publicado: (2025)
MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning
por: Lei, Xing, et al.
Publicado: (2024)
por: Lei, Xing, et al.
Publicado: (2024)
Q-value Regularized Transformer for Offline Reinforcement Learning
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Compositional Transduction with Latent Analogies for Offline Goal-Conditioned Reinforcement Learning
por: Kim, Junseok, et al.
Publicado: (2026)
por: Kim, Junseok, et al.
Publicado: (2026)
Physics-informed Value Learner for Offline Goal-Conditioned Reinforcement Learning
por: Giammarino, Vittorio, et al.
Publicado: (2025)
por: Giammarino, Vittorio, et al.
Publicado: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022)
por: Lyu, Jiafei, et al.
Publicado: (2022)
Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning
por: Park, Jongchan, et al.
Publicado: (2025)
por: Park, Jongchan, et al.
Publicado: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
por: Gireesh, Nandiraju, et al.
Publicado: (2026)
por: Gireesh, Nandiraju, et al.
Publicado: (2026)
Convergence and stability of Q-learning in Hierarchical Reinforcement Learning
por: Manenti, Massimiliano, et al.
Publicado: (2025)
por: Manenti, Massimiliano, et al.
Publicado: (2025)
Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning
por: Kobanda, Anthony, et al.
Publicado: (2024)
por: Kobanda, Anthony, et al.
Publicado: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
por: Wu, Kun, et al.
Publicado: (2024)
por: Wu, Kun, et al.
Publicado: (2024)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
por: Venugopal, Aravind, et al.
Publicado: (2026)
por: Venugopal, Aravind, et al.
Publicado: (2026)
Adaptive Coarse-to-Fine Subgoal Refinement for Long-Horizon Offline Goal-Conditioned Reinforcement Learning
por: Ke, Kaiqiang, et al.
Publicado: (2026)
por: Ke, Kaiqiang, et al.
Publicado: (2026)
Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL
por: Choi, Jinwoo, et al.
Publicado: (2026)
por: Choi, Jinwoo, et al.
Publicado: (2026)
Deep Transfer $Q$-Learning for Offline Non-Stationary Reinforcement Learning
por: Chai, Jinhang, et al.
Publicado: (2025)
por: Chai, Jinhang, et al.
Publicado: (2025)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
por: Kim, Jeonghye, et al.
Publicado: (2024)
por: Kim, Jeonghye, et al.
Publicado: (2024)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
por: Sikchi, Harshit, et al.
Publicado: (2023)
por: Sikchi, Harshit, et al.
Publicado: (2023)
Ejemplares similares
-
Value-Guidance MeanFlow for Offline Multi-Agent Reinforcement Learning
por: Pang, Teng, et al.
Publicado: (2026) -
Equivariant Efficient Joint Discrete and Continuous MeanFlow for Molecular Graph Generation
por: Xu, Rongjian, et al.
Publicado: (2026) -
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
por: Pang, Teng, et al.
Publicado: (2025) -
Offline Goal-conditioned Reinforcement Learning with Quasimetric Representations
por: Myers, Vivek, et al.
Publicado: (2025) -
Goal-conditioned Offline Reinforcement Learning through State Space Partitioning
por: Wang, Mianchu, et al.
Publicado: (2023)