MaPPO: Maximum a Posteriori Preference Optimization with Prior Knowledge

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Lan, Guangchen, Zhang, Sipeng, Wang, Tianle, Zhang, Yuwei, Zhang, Daoan, Wei, Xinpeng, Pan, Xiaoman, Zhang, Hongming, Han, Dong-Jun, Brinton, Christopher G.
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares