Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Hu, Zijing, Zhang, Fengda, Chen, Long, Kuang, Kun, Li, Jiahui, Gao, Kaifeng, Xiao, Jun, Wang, Xin, Zhu, Wenwu
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!