ActiveDPO: Active Direct Preference Optimization for Sample-Efficient Alignment

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Lin, Xiaoqiang, Verma, Arun, Dai, Zhongxiang, Rus, Daniela, Ng, See-Kiong, Low, Bryan Kian Hsiang
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi