MidPO: Dual Preference Optimization for Safety and Helpfulness in Large Language Models via a Mixture of Experts Framework

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Qi, Yupeng, Lyu, Ziyu, Yang, Min, Wang, Yanlin, Bai, Lu, Cui, Lixin
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi