Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ji, Jiaming, Chen, Xinyu, Pan, Rui, Zhang, Conghui, Zhu, Han, Li, Jiahao, Hong, Donghai, Chen, Boyuan, Zhou, Jiayi, Wang, Kaile, Dai, Juntao, Chan, Chi-Min, Tang, Yida, Han, Sirui, Guo, Yike, Yang, Yaodong
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!