PersoDPO: Scalable Preference Optimization for Instruction-Adherent, Persona-Grounded Dialogue via Multi-LLM Evaluation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Afzoon, Saleh, Ahmadi, MohammadHossein, Naseem, Usman, Beheshti, Amin
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares