Investigating Model Editing for Unlearning in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hossain, Shariqah, Kagal, Lalana |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
von: Tong, Schrasing, et al.
Veröffentlicht: (2024)
von: Tong, Schrasing, et al.
Veröffentlicht: (2024)
Prompt Attacks Reveal Superficial Knowledge Removal in Unlearning Methods
von: Jang, Yeonwoo, et al.
Veröffentlicht: (2025)
von: Jang, Yeonwoo, et al.
Veröffentlicht: (2025)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
von: Veldanda, Akshaj Kumar, et al.
Veröffentlicht: (2024)
von: Veldanda, Akshaj Kumar, et al.
Veröffentlicht: (2024)
Resolving Editing-Unlearning Conflicts: A Knowledge Codebook Framework for Large Language Model Updating
von: Zhang, Binchi, et al.
Veröffentlicht: (2025)
von: Zhang, Binchi, et al.
Veröffentlicht: (2025)
Investigating the Feasibility of Mitigating Potential Copyright Infringement via Large Language Model Unlearning
von: Dou, Guangyao
Veröffentlicht: (2024)
von: Dou, Guangyao
Veröffentlicht: (2024)
Consistency-Aware Editing for Entity-level Unlearning in Language Models
von: Han, Xiaoqi, et al.
Veröffentlicht: (2025)
von: Han, Xiaoqi, et al.
Veröffentlicht: (2025)
A Survey on Unlearning in Large Language Models
von: Qiu, Ruichen, et al.
Veröffentlicht: (2025)
von: Qiu, Ruichen, et al.
Veröffentlicht: (2025)
Opt-Out: Investigating Entity-Level Unlearning for Large Language Models via Optimal Transport
von: Choi, Minseok, et al.
Veröffentlicht: (2024)
von: Choi, Minseok, et al.
Veröffentlicht: (2024)
Evaluating Deep Unlearning in Large Language Models
von: Wu, Ruihan, et al.
Veröffentlicht: (2024)
von: Wu, Ruihan, et al.
Veröffentlicht: (2024)
Unlearning Climate Misinformation in Large Language Models
von: Fore, Michael, et al.
Veröffentlicht: (2024)
von: Fore, Michael, et al.
Veröffentlicht: (2024)
Investigating Multi-Hop Factual Shortcuts in Knowledge Editing of Large Language Models
von: Ju, Tianjie, et al.
Veröffentlicht: (2024)
von: Ju, Tianjie, et al.
Veröffentlicht: (2024)
Measuring Perceptions of Fairness in AI Systems: The Effects of Infra-marginality
von: Tong, Schrasing, et al.
Veröffentlicht: (2026)
von: Tong, Schrasing, et al.
Veröffentlicht: (2026)
Machine Unlearning in Large Language Models
von: Gundavarapu, Saaketh Koundinya, et al.
Veröffentlicht: (2024)
von: Gundavarapu, Saaketh Koundinya, et al.
Veröffentlicht: (2024)
Large Language Model Unlearning
von: Yao, Yuanshun, et al.
Veröffentlicht: (2023)
von: Yao, Yuanshun, et al.
Veröffentlicht: (2023)
Mitigating Bias in Concept Bottleneck Models for Fair and Interpretable Image Classification
von: Tong, Schrasing, et al.
Veröffentlicht: (2026)
von: Tong, Schrasing, et al.
Veröffentlicht: (2026)
On the Robustness of Editing Large Language Models
von: Ma, Xinbei, et al.
Veröffentlicht: (2024)
von: Ma, Xinbei, et al.
Veröffentlicht: (2024)
Understanding the Dilemma of Unlearning for Large Language Models
von: Zhang, Qingjie, et al.
Veröffentlicht: (2025)
von: Zhang, Qingjie, et al.
Veröffentlicht: (2025)
Rethinking Machine Unlearning for Large Language Models
von: Liu, Sijia, et al.
Veröffentlicht: (2024)
von: Liu, Sijia, et al.
Veröffentlicht: (2024)
Offset Unlearning for Large Language Models
von: Huang, James Y., et al.
Veröffentlicht: (2024)
von: Huang, James Y., et al.
Veröffentlicht: (2024)
Towards Safer Large Language Models through Machine Unlearning
von: Liu, Zheyuan, et al.
Veröffentlicht: (2024)
von: Liu, Zheyuan, et al.
Veröffentlicht: (2024)
Avoiding Copyright Infringement via Large Language Model Unlearning
von: Dou, Guangyao, et al.
Veröffentlicht: (2024)
von: Dou, Guangyao, et al.
Veröffentlicht: (2024)
KnowledgeSmith: Uncovering Knowledge Updating in LLMs with Model Editing and Unlearning
von: Luo, Yinyi, et al.
Veröffentlicht: (2025)
von: Luo, Yinyi, et al.
Veröffentlicht: (2025)
Uncovering Overfitting in Large Language Model Editing
von: Zhang, Mengqi, et al.
Veröffentlicht: (2024)
von: Zhang, Mengqi, et al.
Veröffentlicht: (2024)
Stable Knowledge Editing in Large Language Models
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
Not Every Token Needs Forgetting: Selective Unlearning to Limit Change in Utility in Large Language Model Unlearning
von: Wan, Yixin, et al.
Veröffentlicht: (2025)
von: Wan, Yixin, et al.
Veröffentlicht: (2025)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
von: Lin, Yujie, et al.
Veröffentlicht: (2026)
von: Lin, Yujie, et al.
Veröffentlicht: (2026)
Dissecting Fine-Tuning Unlearning in Large Language Models
von: Hong, Yihuai, et al.
Veröffentlicht: (2024)
von: Hong, Yihuai, et al.
Veröffentlicht: (2024)
Modality-Aware Neuron Pruning for Unlearning in Multimodal Large Language Models
von: Liu, Zheyuan, et al.
Veröffentlicht: (2025)
von: Liu, Zheyuan, et al.
Veröffentlicht: (2025)
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
von: Ashuach, Tomer, et al.
Veröffentlicht: (2024)
von: Ashuach, Tomer, et al.
Veröffentlicht: (2024)
Hierarchical Federated Unlearning for Large Language Models
von: Zhong, Yisheng, et al.
Veröffentlicht: (2025)
von: Zhong, Yisheng, et al.
Veröffentlicht: (2025)
Soft Prompting for Unlearning in Large Language Models
von: Bhaila, Karuna, et al.
Veröffentlicht: (2024)
von: Bhaila, Karuna, et al.
Veröffentlicht: (2024)
Multi-Objective Large Language Model Unlearning
von: Pan, Zibin, et al.
Veröffentlicht: (2024)
von: Pan, Zibin, et al.
Veröffentlicht: (2024)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
von: He, Guoxiu, et al.
Veröffentlicht: (2025)
von: He, Guoxiu, et al.
Veröffentlicht: (2025)
Probing then Editing Response Personality of Large Language Models
von: Ju, Tianjie, et al.
Veröffentlicht: (2025)
von: Ju, Tianjie, et al.
Veröffentlicht: (2025)
Disentangling Knowledge Representations for Large Language Model Editing
von: Zhang, Mengqi, et al.
Veröffentlicht: (2025)
von: Zhang, Mengqi, et al.
Veröffentlicht: (2025)
Knowledge Graph Enhanced Large Language Model Editing
von: Zhang, Mengqi, et al.
Veröffentlicht: (2024)
von: Zhang, Mengqi, et al.
Veröffentlicht: (2024)
Neuron-Level Sequential Editing for Large Language Models
von: Jiang, Houcheng, et al.
Veröffentlicht: (2024)
von: Jiang, Houcheng, et al.
Veröffentlicht: (2024)
Neighboring Perturbations of Knowledge Editing on Large Language Models
von: Ma, Jun-Yu, et al.
Veröffentlicht: (2024)
von: Ma, Jun-Yu, et al.
Veröffentlicht: (2024)
Robust and Scalable Model Editing for Large Language Models
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
von: Hsueh, Cheng-Hsun, et al.
Veröffentlicht: (2024)
von: Hsueh, Cheng-Hsun, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
von: Tong, Schrasing, et al.
Veröffentlicht: (2024) -
Prompt Attacks Reveal Superficial Knowledge Removal in Unlearning Methods
von: Jang, Yeonwoo, et al.
Veröffentlicht: (2025) -
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
von: Veldanda, Akshaj Kumar, et al.
Veröffentlicht: (2024) -
Resolving Editing-Unlearning Conflicts: A Knowledge Codebook Framework for Large Language Model Updating
von: Zhang, Binchi, et al.
Veröffentlicht: (2025) -
Investigating the Feasibility of Mitigating Potential Copyright Infringement via Large Language Model Unlearning
von: Dou, Guangyao
Veröffentlicht: (2024)