Afzoon, S., Ahmadi, M., Naseem, U., & Beheshti, A. (2026). PersoDPO: Scalable Preference Optimization for Instruction-Adherent, Persona-Grounded Dialogue via Multi-LLM Evaluation.
Cita Chicago Style (17a ed.)Afzoon, Saleh, MohammadHossein Ahmadi, Usman Naseem, y Amin Beheshti. PersoDPO: Scalable Preference Optimization for Instruction-Adherent, Persona-Grounded Dialogue via Multi-LLM Evaluation. 2026.
Cita MLA (9a ed.)Afzoon, Saleh, et al. PersoDPO: Scalable Preference Optimization for Instruction-Adherent, Persona-Grounded Dialogue via Multi-LLM Evaluation. 2026.
Precaución: Estas citas no son 100% exactas.