Dissecting Language Models: Machine Unlearning via Selective Pruning
Fuente:
arXiv
Guardado en:
| Autores principales: | Pochinkov, Nicholas, Schoots, Nandi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Punctuation and Predicates in Language Models
por: Chauhan, Sonakshi, et al.
Publicado: (2025)
por: Chauhan, Sonakshi, et al.
Publicado: (2025)
Dissecting Fine-Tuning Unlearning in Large Language Models
por: Hong, Yihuai, et al.
Publicado: (2024)
por: Hong, Yihuai, et al.
Publicado: (2024)
Extending Activation Steering to Broad Skills and Multiple Behaviours
por: van der Weij, Teun, et al.
Publicado: (2024)
por: van der Weij, Teun, et al.
Publicado: (2024)
ParaScopes: What do Language Models Activations Encode About Future Text?
por: Pochinkov, Nicky, et al.
Publicado: (2025)
por: Pochinkov, Nicky, et al.
Publicado: (2025)
Rethinking Machine Unlearning for Large Language Models
por: Liu, Sijia, et al.
Publicado: (2024)
por: Liu, Sijia, et al.
Publicado: (2024)
Beyond Tokens in Language Models: Interpreting Activations through Text Genre Chunks
por: Benito-Rodriguez, Éloïse, et al.
Publicado: (2025)
por: Benito-Rodriguez, Éloïse, et al.
Publicado: (2025)
A Closer Look at Machine Unlearning for Large Language Models
por: Yuan, Xiaojian, et al.
Publicado: (2024)
por: Yuan, Xiaojian, et al.
Publicado: (2024)
Concept Unlearning in Large Language Models via Self-Constructed Knowledge Triplets
por: Yamashita, Tomoya, et al.
Publicado: (2025)
por: Yamashita, Tomoya, et al.
Publicado: (2025)
Machine Unlearning of Pre-trained Large Language Models
por: Yao, Jin, et al.
Publicado: (2024)
por: Yao, Jin, et al.
Publicado: (2024)
Second-Order Information Matters: Revisiting Machine Unlearning for Large Language Models
por: Gu, Kang, et al.
Publicado: (2024)
por: Gu, Kang, et al.
Publicado: (2024)
Structural Pruning of Pre-trained Language Models via Neural Architecture Search
por: Klein, Aaron, et al.
Publicado: (2024)
por: Klein, Aaron, et al.
Publicado: (2024)
Dissecting Linear Recurrent Models: How Different Gating Strategies Drive Selectivity and Generalization
por: Bouhadjar, Younes, et al.
Publicado: (2026)
por: Bouhadjar, Younes, et al.
Publicado: (2026)
Dissecting Persona-Driven Reasoning in Language Models via Activation Patching
por: Poonia, Ansh, et al.
Publicado: (2025)
por: Poonia, Ansh, et al.
Publicado: (2025)
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023)
por: Yao, Yuanshun, et al.
Publicado: (2023)
Large Language Model Unlearning via Embedding-Corrupted Prompts
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
Hidden in Plain Text: Emergence & Mitigation of Steganographic Collusion in LLMs
por: Mathew, Yohan, et al.
Publicado: (2024)
por: Mathew, Yohan, et al.
Publicado: (2024)
Compact Language Models via Pruning and Knowledge Distillation
por: Muralidharan, Saurav, et al.
Publicado: (2024)
por: Muralidharan, Saurav, et al.
Publicado: (2024)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
por: Xu, Tianyang, et al.
Publicado: (2025)
por: Xu, Tianyang, et al.
Publicado: (2025)
OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models
por: Xu, Xiaoyu, et al.
Publicado: (2025)
por: Xu, Xiaoyu, et al.
Publicado: (2025)
Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization
por: Guo, Phillip, et al.
Publicado: (2024)
por: Guo, Phillip, et al.
Publicado: (2024)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
por: Tang, Haoyu, et al.
Publicado: (2024)
por: Tang, Haoyu, et al.
Publicado: (2024)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
por: Lin, Yujie, et al.
Publicado: (2026)
por: Lin, Yujie, et al.
Publicado: (2026)
Disentangling the Roles of Representation and Selection in Data Pruning
por: Du, Yupei, et al.
Publicado: (2025)
por: Du, Yupei, et al.
Publicado: (2025)
Deterministic Differentiable Structured Pruning for Large Language Models
por: Huang, Weiyu, et al.
Publicado: (2026)
por: Huang, Weiyu, et al.
Publicado: (2026)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
por: Zhao, Songlin, et al.
Publicado: (2025)
por: Zhao, Songlin, et al.
Publicado: (2025)
Automating Evaluation of Diffusion Model Unlearning with (Vision-) Language Model World Knowledge
por: Yeats, Eric, et al.
Publicado: (2025)
por: Yeats, Eric, et al.
Publicado: (2025)
Offset Unlearning for Large Language Models
por: Huang, James Y., et al.
Publicado: (2024)
por: Huang, James Y., et al.
Publicado: (2024)
Model Unlearning via Sparse Autoencoder Subspace Guided Projections
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
Wanda++: Pruning Large Language Models via Regional Gradients
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language Models
por: Mekala, Anmol, et al.
Publicado: (2024)
por: Mekala, Anmol, et al.
Publicado: (2024)
Can Small Language Models Learn, Unlearn, and Retain Noise Patterns?
por: Scaria, Nicy, et al.
Publicado: (2024)
por: Scaria, Nicy, et al.
Publicado: (2024)
Sparse-Autoencoder-Guided Internal Representation Unlearning for Large Language Models
por: Yamashita, Tomoya, et al.
Publicado: (2025)
por: Yamashita, Tomoya, et al.
Publicado: (2025)
Soft Contamination Means Benchmarks Test Shallow Generalization
por: Spiesberger, Ari, et al.
Publicado: (2026)
por: Spiesberger, Ari, et al.
Publicado: (2026)
Fast and Effective Weight Update for Pruned Large Language Models
por: Boža, Vladimír
Publicado: (2024)
por: Boža, Vladimír
Publicado: (2024)
SAP: Syntactic Attention Pruning for Transformer-based Language Models
por: Lee, Tzu-Yun, et al.
Publicado: (2025)
por: Lee, Tzu-Yun, et al.
Publicado: (2025)
DarwinLM: Evolutionary Structured Pruning of Large Language Models
por: Tang, Shengkun, et al.
Publicado: (2025)
por: Tang, Shengkun, et al.
Publicado: (2025)
Frustratingly Easy Task-aware Pruning for Large Language Models
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
por: Ali, Ameen, et al.
Publicado: (2025)
por: Ali, Ameen, et al.
Publicado: (2025)
PIP: Perturbation-based Iterative Pruning for Large Language Models
por: Cao, Yi, et al.
Publicado: (2025)
por: Cao, Yi, et al.
Publicado: (2025)
Ejemplares similares
-
Punctuation and Predicates in Language Models
por: Chauhan, Sonakshi, et al.
Publicado: (2025) -
Dissecting Fine-Tuning Unlearning in Large Language Models
por: Hong, Yihuai, et al.
Publicado: (2024) -
Extending Activation Steering to Broad Skills and Multiple Behaviours
por: van der Weij, Teun, et al.
Publicado: (2024) -
ParaScopes: What do Language Models Activations Encode About Future Text?
por: Pochinkov, Nicky, et al.
Publicado: (2025) -
Rethinking Machine Unlearning for Large Language Models
por: Liu, Sijia, et al.
Publicado: (2024)