Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bu, Zhiqi, Jin, Xiaomeng, Vinzamuri, Bhanukiran, Ramakrishna, Anil, Chang, Kai-Wei, Cevher, Volkan, Hong, Mingyi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LUME: LLM Unlearning with Multitask Evaluations
par: Ramakrishna, Anil, et autres
Publié: (2025)
par: Ramakrishna, Anil, et autres
Publié: (2025)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
par: Ramakrishna, Anil, et autres
Publié: (2025)
par: Ramakrishna, Anil, et autres
Publié: (2025)
BLUR: A Bi-Level Optimization Approach for LLM Unlearning
par: Reisizadeh, Hadi, et autres
Publié: (2025)
par: Reisizadeh, Hadi, et autres
Publié: (2025)
Not Every Token Needs Forgetting: Selective Unlearning to Limit Change in Utility in Large Language Model Unlearning
par: Wan, Yixin, et autres
Publié: (2025)
par: Wan, Yixin, et autres
Publié: (2025)
MADA: Meta-Adaptive Optimizers through hyper-gradient Descent
par: Ozkara, Kaan, et autres
Publié: (2024)
par: Ozkara, Kaan, et autres
Publié: (2024)
Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
par: Fan, Chongyu, et autres
Publié: (2025)
par: Fan, Chongyu, et autres
Publié: (2025)
Easy Data Unlearning Bench
par: Rinberg, Roy, et autres
Publié: (2026)
par: Rinberg, Roy, et autres
Publié: (2026)
A Hessian-informed hyperparameter optimization for differential learning rate
par: Xu, Shiyun, et autres
Publié: (2025)
par: Xu, Shiyun, et autres
Publié: (2025)
DOPPLER: Differentially Private Optimizers with Low-pass Filter for Privacy Noise Reduction
par: Zhang, Xinwei, et autres
Publié: (2024)
par: Zhang, Xinwei, et autres
Publié: (2024)
Krylov Cubic Regularized Newton: A Subspace Second-Order Method with Dimension-Free Convergence Rate
par: Jiang, Ruichen, et autres
Publié: (2024)
par: Jiang, Ruichen, et autres
Publié: (2024)
Rate optimal learning of equilibria from data
par: Freihaut, Till, et autres
Publié: (2025)
par: Freihaut, Till, et autres
Publié: (2025)
Adaptive multi-gradient methods for quasiconvex vector optimization and applications to multi-task learning
par: Minh, Nguyen Anh, et autres
Publié: (2024)
par: Minh, Nguyen Anh, et autres
Publié: (2024)
Differentially Private SGD Without Clipping Bias: An Error-Feedback Approach
par: Zhang, Xinwei, et autres
Publié: (2023)
par: Zhang, Xinwei, et autres
Publié: (2023)
Advancing the lower bounds: An accelerated, stochastic, second-order method with optimal adaptation to inexactness
par: Agafonov, Artem, et autres
Publié: (2023)
par: Agafonov, Artem, et autres
Publié: (2023)
Provably avoiding over-optimization in Direct Preference Optimization without knowing the data distribution
par: Barla, Adam, et autres
Publié: (2026)
par: Barla, Adam, et autres
Publié: (2026)
Pre-training Differentially Private Models with Limited Public Data
par: Bu, Zhiqi, et autres
Publié: (2024)
par: Bu, Zhiqi, et autres
Publié: (2024)
Towards hyperparameter-free optimization with differential privacy
par: Bu, Zhiqi, et autres
Publié: (2025)
par: Bu, Zhiqi, et autres
Publié: (2025)
From Narrow Unlearning to Emergent Misalignment: Causes, Consequences, and Containment in LLMs
par: Mushtaq, Erum, et autres
Publié: (2025)
par: Mushtaq, Erum, et autres
Publié: (2025)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
par: Xie, Wanyun, et autres
Publié: (2025)
par: Xie, Wanyun, et autres
Publié: (2025)
Efficient Large Language Model Inference with Neural Block Linearization
par: Erdogan, Mete, et autres
Publié: (2025)
par: Erdogan, Mete, et autres
Publié: (2025)
Learning with Norm Constrained, Over-parameterized, Two-layer Neural Networks
par: Liu, Fanghui, et autres
Publié: (2024)
par: Liu, Fanghui, et autres
Publié: (2024)
SAMPa: Sharpness-aware Minimization Parallelized
par: Xie, Wanyun, et autres
Publié: (2024)
par: Xie, Wanyun, et autres
Publié: (2024)
MT-NAM: An Efficient and Adaptive Model for Epileptic Seizure Detection
par: Afzal, Arshia, et autres
Publié: (2025)
par: Afzal, Arshia, et autres
Publié: (2025)
Matching Multiple Experts: On the Exploitability of Multi-Agent Imitation Learning
par: Bergerault, Antoine, et autres
Publié: (2026)
par: Bergerault, Antoine, et autres
Publié: (2026)
MaD-Mix: Multi-Modal Data Mixtures via Latent Space Coupling for Vision-Language Model Training
par: Xie, Wanyun, et autres
Publié: (2026)
par: Xie, Wanyun, et autres
Publié: (2026)
Stable Nonconvex-Nonconcave Training via Linear Interpolation
par: Pethick, Thomas, et autres
Publié: (2023)
par: Pethick, Thomas, et autres
Publié: (2023)
IL-SOAR : Imitation Learning with Soft Optimistic Actor cRitic
par: Viel, Stefano, et autres
Publié: (2025)
par: Viel, Stefano, et autres
Publié: (2025)
Imitation Learning in Discounted Linear MDPs without exploration assumptions
par: Viano, Luca, et autres
Publié: (2024)
par: Viano, Luca, et autres
Publié: (2024)
Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models
par: Entesari, Taha, et autres
Publié: (2025)
par: Entesari, Taha, et autres
Publié: (2025)
DiSK: Differentially Private Optimizer with Simplified Kalman Filter for Noise Reduction
par: Zhang, Xinwei, et autres
Publié: (2024)
par: Zhang, Xinwei, et autres
Publié: (2024)
μP$^2$: Effective Sharpness Aware Minimization Requires Layerwise Perturbation Scaling
par: Haas, Moritz, et autres
Publié: (2024)
par: Haas, Moritz, et autres
Publié: (2024)
Hadamard product in deep learning: Introduction, Advances and Challenges
par: Chrysos, Grigorios G, et autres
Publié: (2025)
par: Chrysos, Grigorios G, et autres
Publié: (2025)
Scaling depth capacity via zero/one-layer model expansion
par: Bu, Zhiqi
Publié: (2025)
par: Bu, Zhiqi
Publié: (2025)
Task-conditioned adaptation of visual features in multi-task policy learning
par: Marza, Pierre, et autres
Publié: (2024)
par: Marza, Pierre, et autres
Publié: (2024)
Adversarial Training for Defense Against Label Poisoning Attacks
par: Bal, Melis Ilayda, et autres
Publié: (2025)
par: Bal, Melis Ilayda, et autres
Publié: (2025)
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
par: Bal, Melis Ilayda, et autres
Publié: (2025)
par: Bal, Melis Ilayda, et autres
Publié: (2025)
Randomized algorithms and PAC bounds for inverse reinforcement learning in continuous spaces
par: Kamoutsi, Angeliki, et autres
Publié: (2024)
par: Kamoutsi, Angeliki, et autres
Publié: (2024)
Non-convergence of Adam and other adaptive stochastic gradient descent optimization methods for non-vanishing learning rates
par: Dereich, Steffen, et autres
Publié: (2024)
par: Dereich, Steffen, et autres
Publié: (2024)
Multi-agent imitation learning with function approximation: Linear Markov games and beyond
par: Viano, Luca, et autres
Publié: (2026)
par: Viano, Luca, et autres
Publié: (2026)
Learning to Remove Cuts in Integer Linear Programming
par: Puigdemont, Pol, et autres
Publié: (2024)
par: Puigdemont, Pol, et autres
Publié: (2024)
Documents similaires
-
LUME: LLM Unlearning with Multitask Evaluations
par: Ramakrishna, Anil, et autres
Publié: (2025) -
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
par: Ramakrishna, Anil, et autres
Publié: (2025) -
BLUR: A Bi-Level Optimization Approach for LLM Unlearning
par: Reisizadeh, Hadi, et autres
Publié: (2025) -
Not Every Token Needs Forgetting: Selective Unlearning to Limit Change in Utility in Large Language Model Unlearning
par: Wan, Yixin, et autres
Publié: (2025) -
MADA: Meta-Adaptive Optimizers through hyper-gradient Descent
par: Ozkara, Kaan, et autres
Publié: (2024)