Expert Q-learning: Deep Reinforcement Learning with Coarse State Values from Offline Expert Examples
Fuente:
arXiv
Salvato in:
| Autori principali: | Meng, Li, Yazidi, Anis, Goodwin, Morten, Engelstad, Paal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2021
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving the Diversity of Bootstrapped DQN by Replacing Priors With Noise
di: Meng, Li, et al.
Pubblicazione: (2022)
di: Meng, Li, et al.
Pubblicazione: (2022)
Deep Reinforcement Learning with Swin Transformers
di: Meng, Li, et al.
Pubblicazione: (2022)
di: Meng, Li, et al.
Pubblicazione: (2022)
State Representation Learning Using an Unbalanced Atlas
di: Meng, Li, et al.
Pubblicazione: (2023)
di: Meng, Li, et al.
Pubblicazione: (2023)
Maximum Manifold Capacity Representations in State Representation Learning
di: Meng, Li, et al.
Pubblicazione: (2024)
di: Meng, Li, et al.
Pubblicazione: (2024)
A Manifold Representation of the Key in Vision Transformers
di: Meng, Li, et al.
Pubblicazione: (2024)
di: Meng, Li, et al.
Pubblicazione: (2024)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
Multi-Horizon Time Series Forecasting of non-parametric CDFs with Deep Lattice Networks
di: Erdmann, Niklas, et al.
Pubblicazione: (2025)
di: Erdmann, Niklas, et al.
Pubblicazione: (2025)
Mildly Conservative Q-Learning for Offline Reinforcement Learning
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
di: Lyu, Jiafei, et al.
Pubblicazione: (2022)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
di: Huang, Kevin, et al.
Pubblicazione: (2025)
di: Huang, Kevin, et al.
Pubblicazione: (2025)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
di: Zhang, Ziqi, et al.
Pubblicazione: (2023)
di: Zhang, Ziqi, et al.
Pubblicazione: (2023)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Residual Q-Learning: Offline and Online Policy Customization without Value
di: Li, Chenran, et al.
Pubblicazione: (2023)
di: Li, Chenran, et al.
Pubblicazione: (2023)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2025)
di: Hoang, Huy, et al.
Pubblicazione: (2025)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning with Sub-optimal Experts
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
di: Liu, Haolin, et al.
Pubblicazione: (2026)
di: Liu, Haolin, et al.
Pubblicazione: (2026)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
di: Qiao, Nan, et al.
Pubblicazione: (2026)
di: Qiao, Nan, et al.
Pubblicazione: (2026)
PIQL: Projective Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning
di: Han, Xinchen, et al.
Pubblicazione: (2025)
di: Han, Xinchen, et al.
Pubblicazione: (2025)
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning with Spiking Q-learning
di: Chen, Ding, et al.
Pubblicazione: (2022)
di: Chen, Ding, et al.
Pubblicazione: (2022)
Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning
di: Park, Jongchan, et al.
Pubblicazione: (2025)
di: Park, Jongchan, et al.
Pubblicazione: (2025)
Yes, Q-learning Helps Offline In-Context RL
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
Is Value Functions Estimation with Classification Plug-and-play for Offline Reinforcement Learning?
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
FAST-Q: Fast-track Exploration with Adversarially Balanced State Representations for Counterfactual Action Estimation in Offline Reinforcement Learning
di: Agrawal, Pulkit, et al.
Pubblicazione: (2025)
di: Agrawal, Pulkit, et al.
Pubblicazione: (2025)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2025)
di: Alles, Marvin, et al.
Pubblicazione: (2025)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
di: Ma, Yunchang, et al.
Pubblicazione: (2025)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving the Diversity of Bootstrapped DQN by Replacing Priors With Noise
di: Meng, Li, et al.
Pubblicazione: (2022) -
Deep Reinforcement Learning with Swin Transformers
di: Meng, Li, et al.
Pubblicazione: (2022) -
State Representation Learning Using an Unbalanced Atlas
di: Meng, Li, et al.
Pubblicazione: (2023) -
Maximum Manifold Capacity Representations in State Representation Learning
di: Meng, Li, et al.
Pubblicazione: (2024) -
A Manifold Representation of the Key in Vision Transformers
di: Meng, Li, et al.
Pubblicazione: (2024)