Controllable Value Alignment in Large Language Models through Neuron-Level Editing

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Yang, Yonghui, Wang, Yihui, Li, Junwei, Liu, Jilong, Zhu, Fengbin, Huang, Weibiao, Wu, Le, Hong, Richang, Chua, Tat-Seng
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!