Q-Distribution guided Q-learning for offline reinforcement learning: Uncertainty penalized Q-value via consistency model

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhang, Jing, Fang, Linjiajie, Shi, Kexin, Wang, Wenjia, Jing, Bing-Yi
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!