SalUn: Empowering Machine Unlearning via Gradient-based Weight Saliency in Both Image Classification and Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fan, Chongyu, Liu, Jiancheng, Zhang, Yihua, Wong, Eric, Wei, Dennis, Liu, Sijia |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Challenging Forgets: Unveiling the Worst-Case Forget Sets in Machine Unlearning
par: Fan, Chongyu, et autres
Publié: (2024)
par: Fan, Chongyu, et autres
Publié: (2024)
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
par: Zhang, Yihua, et autres
Publié: (2024)
par: Zhang, Yihua, et autres
Publié: (2024)
Forget Vectors at Play: Universal Input Perturbations Driving Machine Unlearning in Image Classification
par: Sun, Changchang, et autres
Publié: (2024)
par: Sun, Changchang, et autres
Publié: (2024)
WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models
par: Jia, Jinghan, et autres
Publié: (2024)
par: Jia, Jinghan, et autres
Publié: (2024)
Defensive Unlearning with Adversarial Training for Robust Concept Erasure in Diffusion Models
par: Zhang, Yimeng, et autres
Publié: (2024)
par: Zhang, Yimeng, et autres
Publié: (2024)
Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning
par: Lang, Yicheng, et autres
Publié: (2025)
par: Lang, Yicheng, et autres
Publié: (2025)
Reasoning Model Unlearning: Forgetting Traces, Not Just Answers, While Preserving Reasoning Skills
par: Wang, Changsheng, et autres
Publié: (2025)
par: Wang, Changsheng, et autres
Publié: (2025)
Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
par: Fan, Chongyu, et autres
Publié: (2025)
par: Fan, Chongyu, et autres
Publié: (2025)
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
par: Fan, Chongyu, et autres
Publié: (2024)
par: Fan, Chongyu, et autres
Publié: (2024)
To Generate or Not? Safety-Driven Unlearned Diffusion Models Are Still Easy To Generate Unsafe Images ... For Now
par: Zhang, Yimeng, et autres
Publié: (2023)
par: Zhang, Yimeng, et autres
Publié: (2023)
CyclicReflex: Improving Reasoning Models via Cyclical Reflection Token Scheduling
par: Fan, Chongyu, et autres
Publié: (2025)
par: Fan, Chongyu, et autres
Publié: (2025)
LLM Unlearning Under the Microscope: A Full-Stack View on Methods and Metrics
par: Fan, Chongyu, et autres
Publié: (2025)
par: Fan, Chongyu, et autres
Publié: (2025)
WSS-CL: Weight Saliency Soft-Guided Contrastive Learning for Efficient Machine Unlearning Image Classification
par: Tran, Thang Duc, et autres
Publié: (2025)
par: Tran, Thang Duc, et autres
Publié: (2025)
Invisible Watermarks, Visible Gains: Steering Machine Unlearning with Bi-Level Watermarking Design
par: Sun, Yuhao, et autres
Publié: (2025)
par: Sun, Yuhao, et autres
Publié: (2025)
Model Sparsity Can Simplify Machine Unlearning
par: Jia, Jinghan, et autres
Publié: (2023)
par: Jia, Jinghan, et autres
Publié: (2023)
SOUL: Unlocking the Power of Second-Order Optimization for LLM Unlearning
par: Jia, Jinghan, et autres
Publié: (2024)
par: Jia, Jinghan, et autres
Publié: (2024)
Label Smoothing Improves Machine Unlearning
par: Di, Zonglin, et autres
Publié: (2024)
par: Di, Zonglin, et autres
Publié: (2024)
Unlearners Can Lie: Evaluating and Improving Honesty in LLM Unlearning
par: Gu, Renjie, et autres
Publié: (2026)
par: Gu, Renjie, et autres
Publié: (2026)
LLM Unlearning on Noisy Forget Sets: A Study of Incomplete, Rewritten, and Watermarked Data
par: Wang, Changsheng, et autres
Publié: (2025)
par: Wang, Changsheng, et autres
Publié: (2025)
Safety Mirage: How Spurious Correlations Undermine VLM Safety Fine-Tuning and Can Be Mitigated by Machine Unlearning
par: Chen, Yiwei, et autres
Publié: (2025)
par: Chen, Yiwei, et autres
Publié: (2025)
Forgetting to Forget: Attention Sink as A Gateway for Backdooring LLM Unlearning
par: Shang, Bingqi, et autres
Publié: (2025)
par: Shang, Bingqi, et autres
Publié: (2025)
CoUn: Empowering Machine Unlearning via Contrastive Learning
par: Khalil, Yasser H., et autres
Publié: (2025)
par: Khalil, Yasser H., et autres
Publié: (2025)
Continual Unlearning for Text-to-Image Diffusion Models: A Regularization Perspective
par: Lee, Justin, et autres
Publié: (2025)
par: Lee, Justin, et autres
Publié: (2025)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
par: Zhuang, Haomin, et autres
Publié: (2024)
par: Zhuang, Haomin, et autres
Publié: (2024)
Invariance Makes LLM Unlearning Resilient Even to Unanticipated Downstream Fine-Tuning
par: Wang, Changsheng, et autres
Publié: (2025)
par: Wang, Changsheng, et autres
Publié: (2025)
Multi-Class Unlearning for Image Classification via Weight Filtering
par: Poppi, Samuele, et autres
Publié: (2023)
par: Poppi, Samuele, et autres
Publié: (2023)
DiffSal: Joint Audio and Video Learning for Diffusion Saliency Prediction
par: Xiong, Junwen, et autres
Publié: (2024)
par: Xiong, Junwen, et autres
Publié: (2024)
Rethinking Machine Unlearning in Image Generation Models
par: Liu, Renyang, et autres
Publié: (2025)
par: Liu, Renyang, et autres
Publié: (2025)
Deep Unlearn: Benchmarking Machine Unlearning for Image Classification
par: Cadet, Xavier F., et autres
Publié: (2024)
par: Cadet, Xavier F., et autres
Publié: (2024)
Unlearning Concepts from Text-to-Video Diffusion Models
par: Liu, Shiqi, et autres
Publié: (2024)
par: Liu, Shiqi, et autres
Publié: (2024)
Rethinking Muon Beyond Pretraining: Spectral Failures and High-Pass Remedies for VLA and RLVR
par: Fan, Chongyu, et autres
Publié: (2026)
par: Fan, Chongyu, et autres
Publié: (2026)
Single Image Unlearning: Efficient Machine Unlearning in Multimodal Large Language Models
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
Powering Up Zeroth-Order Training via Subspace Gradient Orthogonalization
par: Lang, Yicheng, et autres
Publié: (2026)
par: Lang, Yicheng, et autres
Publié: (2026)
Position: Zeroth-Order Optimization in Deep Learning Is Underexplored, Not Underpowered
par: Liu, Sijia, et autres
Publié: (2026)
par: Liu, Sijia, et autres
Publié: (2026)
SalFoM: Dynamic Saliency Prediction with Video Foundation Models
par: Moradi, Morteza, et autres
Publié: (2024)
par: Moradi, Morteza, et autres
Publié: (2024)
Controllable Machine Unlearning via Gradient Pivoting
par: Hwang, Youngsik, et autres
Publié: (2025)
par: Hwang, Youngsik, et autres
Publié: (2025)
Soft Weighted Machine Unlearning
par: Qiao, Xinbao, et autres
Publié: (2025)
par: Qiao, Xinbao, et autres
Publié: (2025)
Harmonizing Multi-Objective LLM Unlearning via Unified Domain Representation and Bidirectional Logit Distillation
par: Zhong, Yisheng, et autres
Publié: (2026)
par: Zhong, Yisheng, et autres
Publié: (2026)
EPiC: Towards Lossless Speedup for Reasoning Training through Edge-Preserving CoT Condensation
par: Jia, Jinghan, et autres
Publié: (2025)
par: Jia, Jinghan, et autres
Publié: (2025)
SalM$^{2}$: An Extremely Lightweight Saliency Mamba Model for Real-Time Cognitive Awareness of Driver Attention
par: Zhao, Chunyu, et autres
Publié: (2025)
par: Zhao, Chunyu, et autres
Publié: (2025)
Documents similaires
-
Challenging Forgets: Unveiling the Worst-Case Forget Sets in Machine Unlearning
par: Fan, Chongyu, et autres
Publié: (2024) -
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
par: Zhang, Yihua, et autres
Publié: (2024) -
Forget Vectors at Play: Universal Input Perturbations Driving Machine Unlearning in Image Classification
par: Sun, Changchang, et autres
Publié: (2024) -
WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models
par: Jia, Jinghan, et autres
Publié: (2024) -
Defensive Unlearning with Adversarial Training for Robust Concept Erasure in Diffusion Models
par: Zhang, Yimeng, et autres
Publié: (2024)