Generative Adversarial Post-Training Mitigates Reward Hacking in Live Human-AI Music Interaction

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wu, Yusong, Brade, Stephen, Ma, Aleksandra Teng, Fowler, Tia-Jane, Yang, Enning, Banar, Berker, Courville, Aaron, Jaques, Natasha, Huang, Cheng-Zhi Anna
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!