Not Every Token Needs Forgetting: Selective Unlearning to Limit Change in Utility in Large Language Model Unlearning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wan, Yixin, Ramakrishna, Anil, Chang, Kai-Wei, Cevher, Volkan, Gupta, Rahul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
LUME: LLM Unlearning with Multitask Evaluations
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate
di: Bu, Zhiqi, et al.
Pubblicazione: (2024)
di: Bu, Zhiqi, et al.
Pubblicazione: (2024)
Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models
di: Entesari, Taha, et al.
Pubblicazione: (2025)
di: Entesari, Taha, et al.
Pubblicazione: (2025)
Answer When Needed, Forget When Not: Language Models Pretend to Forget via In-Context Knowledge Unlearning
di: Takashiro, Shota, et al.
Pubblicazione: (2024)
di: Takashiro, Shota, et al.
Pubblicazione: (2024)
Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
Selective Forgetting: Advancing Machine Unlearning Techniques and Evaluation in Language Models
di: Wang, Lingzhi, et al.
Pubblicazione: (2024)
di: Wang, Lingzhi, et al.
Pubblicazione: (2024)
Unlearning What Matters: Token-Level Attribution for Precise Language Model Unlearning
di: Wu, Jiawei, et al.
Pubblicazione: (2026)
di: Wu, Jiawei, et al.
Pubblicazione: (2026)
To Forget or Not? Towards Practical Knowledge Unlearning for Large Language Models
di: Tian, Bozhong, et al.
Pubblicazione: (2024)
di: Tian, Bozhong, et al.
Pubblicazione: (2024)
FIT to Forget: Robust Continual Unlearning for Large Language Models
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Attribute Controlled Fine-tuning for Large Language Models: A Case Study on Detoxification
di: Meng, Tao, et al.
Pubblicazione: (2024)
di: Meng, Tao, et al.
Pubblicazione: (2024)
UPCORE: Utility-Preserving Coreset Selection for Balanced Unlearning
di: Patil, Vaidehi, et al.
Pubblicazione: (2025)
di: Patil, Vaidehi, et al.
Pubblicazione: (2025)
BLUR: A Bi-Level Optimization Approach for LLM Unlearning
di: Reisizadeh, Hadi, et al.
Pubblicazione: (2025)
di: Reisizadeh, Hadi, et al.
Pubblicazione: (2025)
Soft Token Attacks Cannot Reliably Audit Unlearning in Large Language Models
di: Chen, Haokun, et al.
Pubblicazione: (2025)
di: Chen, Haokun, et al.
Pubblicazione: (2025)
Large Language Model Unlearning
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
Model Unlearning Objectives Vary for Distinct Language Functions
di: Atil, Berk, et al.
Pubblicazione: (2026)
di: Atil, Berk, et al.
Pubblicazione: (2026)
Evaluating Deep Unlearning in Large Language Models
di: Wu, Ruihan, et al.
Pubblicazione: (2024)
di: Wu, Ruihan, et al.
Pubblicazione: (2024)
Unlearning Climate Misinformation in Large Language Models
di: Fore, Michael, et al.
Pubblicazione: (2024)
di: Fore, Michael, et al.
Pubblicazione: (2024)
A Survey on Unlearning in Large Language Models
di: Qiu, Ruichen, et al.
Pubblicazione: (2025)
di: Qiu, Ruichen, et al.
Pubblicazione: (2025)
Machine Unlearning in Large Language Models
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
di: Gundavarapu, Saaketh Koundinya, et al.
Pubblicazione: (2024)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
di: Lin, Yujie, et al.
Pubblicazione: (2026)
di: Lin, Yujie, et al.
Pubblicazione: (2026)
Forgetting to Forget: Attention Sink as A Gateway for Backdooring LLM Unlearning
di: Shang, Bingqi, et al.
Pubblicazione: (2025)
di: Shang, Bingqi, et al.
Pubblicazione: (2025)
RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models
di: Wang, Bichen, et al.
Pubblicazione: (2024)
di: Wang, Bichen, et al.
Pubblicazione: (2024)
Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
di: Fan, Chongyu, et al.
Pubblicazione: (2025)
di: Fan, Chongyu, et al.
Pubblicazione: (2025)
Investigating Model Editing for Unlearning in Large Language Models
di: Hossain, Shariqah, et al.
Pubblicazione: (2025)
di: Hossain, Shariqah, et al.
Pubblicazione: (2025)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
LLM Unlearning via Loss Adjustment with Only Forget Data
di: Wang, Yaxuan, et al.
Pubblicazione: (2024)
di: Wang, Yaxuan, et al.
Pubblicazione: (2024)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
Cross-Lingual Unlearning of Selective Knowledge in Multilingual Language Models
di: Choi, Minseok, et al.
Pubblicazione: (2024)
di: Choi, Minseok, et al.
Pubblicazione: (2024)
Offset Unlearning for Large Language Models
di: Huang, James Y., et al.
Pubblicazione: (2024)
di: Huang, James Y., et al.
Pubblicazione: (2024)
Understanding the Dilemma of Unlearning for Large Language Models
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
Rethinking Machine Unlearning for Large Language Models
di: Liu, Sijia, et al.
Pubblicazione: (2024)
di: Liu, Sijia, et al.
Pubblicazione: (2024)
Direct Token Optimization: A Self-contained Approach to Large Language Model Unlearning
di: Lee, Hong kyu, et al.
Pubblicazione: (2025)
di: Lee, Hong kyu, et al.
Pubblicazione: (2025)
Shadow Unlearning: A Neuro-Semantic Approach to Fidelity-Preserving Faceless Forgetting in LLMs
di: P, Dinesh Srivasthav, et al.
Pubblicazione: (2026)
di: P, Dinesh Srivasthav, et al.
Pubblicazione: (2026)
UIPE: Enhancing LLM Unlearning by Removing Knowledge Related to Forgetting Targets
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
di: Zheng, Hao, et al.
Pubblicazione: (2025)
di: Zheng, Hao, et al.
Pubblicazione: (2025)
Tokens for Learning, Tokens for Unlearning: Mitigating Membership Inference Attacks in Large Language Models via Dual-Purpose Training
di: Tran, Toan, et al.
Pubblicazione: (2025)
di: Tran, Toan, et al.
Pubblicazione: (2025)
White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs
di: Wan, Yixin, et al.
Pubblicazione: (2024)
di: Wan, Yixin, et al.
Pubblicazione: (2024)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025) -
LUME: LLM Unlearning with Multitask Evaluations
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025) -
Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate
di: Bu, Zhiqi, et al.
Pubblicazione: (2024) -
Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models
di: Entesari, Taha, et al.
Pubblicazione: (2025) -
Answer When Needed, Forget When Not: Language Models Pretend to Forget via In-Context Knowledge Unlearning
di: Takashiro, Shota, et al.
Pubblicazione: (2024)