Token Buncher: Shielding LLMs from Harmful Reinforcement Learning Fine-Tuning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Feng, Weitao, Wang, Lixu, Lv, Peizhuo, Wei, Tianyi, Zhang, Jie, Gao, Chongyang, Zhan, Sinong, Dong, Wei
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!