Mitigating Forgetting in Continual Learning with Selective Gradient Projection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singh, Anika, Dhaulakhandi, Aayush, Chopade, Varun, Malipati, Likhith, Martinez, David, Zhu, Kevin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Variance-Reduced $(\varepsilon,δ)-$Unlearning using Forget Set Gradients
par: Van Waerebeke, Martin, et autres
Publié: (2026)
par: Van Waerebeke, Martin, et autres
Publié: (2026)
When to Forget? Complexity Trade-offs in Machine Unlearning
par: Van Waerebeke, Martin, et autres
Publié: (2025)
par: Van Waerebeke, Martin, et autres
Publié: (2025)
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
par: Fernando, Heshan, et autres
Publié: (2022)
par: Fernando, Heshan, et autres
Publié: (2022)
Adaptive Moment Estimation Optimization Algorithm Using Projection Gradient for Deep Learning
par: Li, Yongqi, et autres
Publié: (2025)
par: Li, Yongqi, et autres
Publié: (2025)
Federated Learning on Riemannian Manifolds: A Gradient-Free Projection-Based Approach
par: Wang, Hongye, et autres
Publié: (2025)
par: Wang, Hongye, et autres
Publié: (2025)
On the Inherent Privacy of Zeroth Order Projected Gradient Descent
par: Gupta, Devansh, et autres
Publié: (2025)
par: Gupta, Devansh, et autres
Publié: (2025)
Do Deep Networks Forget Initialization? A Forgetting-Time View of Practical Inductive Bias
par: Das, Mohua, et autres
Publié: (2026)
par: Das, Mohua, et autres
Publié: (2026)
A Sketch-and-Project Analysis of Subsampled Natural Gradient Algorithms
par: Goldshlager, Gil, et autres
Publié: (2025)
par: Goldshlager, Gil, et autres
Publié: (2025)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
par: Zhang, Zhixin, et autres
Publié: (2025)
par: Zhang, Zhixin, et autres
Publié: (2025)
On the Convergence of Gradient Descent on Learning Transformers with Residual Connections
par: Qin, Zhen, et autres
Publié: (2025)
par: Qin, Zhen, et autres
Publié: (2025)
AutoGD: Automatic Learning Rate Selection for Gradient Descent
par: Surjanovic, Nikola, et autres
Publié: (2025)
par: Surjanovic, Nikola, et autres
Publié: (2025)
Projected Forward Gradient-Guided Frank-Wolfe Algorithm via Variance Reduction
par: Rostami, M., et autres
Publié: (2024)
par: Rostami, M., et autres
Publié: (2024)
Risk-Sensitive Q-Learning in Continuous Time with Application to Dynamic Portfolio Selection
par: Xie, Chuhan
Publié: (2025)
par: Xie, Chuhan
Publié: (2025)
AutoSGD: Automatic Learning Rate Selection for Stochastic Gradient Descent
par: Surjanovic, Nikola, et autres
Publié: (2025)
par: Surjanovic, Nikola, et autres
Publié: (2025)
Generalized Continuous-Time Models for Nesterov's Accelerated Gradient Methods
par: Park, Chanwoong, et autres
Publié: (2024)
par: Park, Chanwoong, et autres
Publié: (2024)
Convergence and Implicit Bias of Gradient Descent on Continual Linear Classification
par: Jung, Hyunji, et autres
Publié: (2025)
par: Jung, Hyunji, et autres
Publié: (2025)
Geometric Foundations of Tuning without Forgetting in Neural ODEs
par: Bayram, Erkan, et autres
Publié: (2025)
par: Bayram, Erkan, et autres
Publié: (2025)
Unbiased Gradient Low-Rank Projection
par: Pan, Rui, et autres
Publié: (2025)
par: Pan, Rui, et autres
Publié: (2025)
Monotone Optimisation with Learned Projections
par: Rashwan, Ahmed, et autres
Publié: (2026)
par: Rashwan, Ahmed, et autres
Publié: (2026)
Quantitative Convergence Analysis of Projected Stochastic Gradient Descent for Non-Convex Losses via the Goldstein Subdifferential
par: Zheng, Yuping, et autres
Publié: (2025)
par: Zheng, Yuping, et autres
Publié: (2025)
Bilevel Learning with Inexact Stochastic Gradients
par: Salehi, Mohammad Sadegh, et autres
Publié: (2024)
par: Salehi, Mohammad Sadegh, et autres
Publié: (2024)
Decision-Focused Learning with Directional Gradients
par: Huang, Michael, et autres
Publié: (2024)
par: Huang, Michael, et autres
Publié: (2024)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
par: Cheng, Ziheng, et autres
Publié: (2025)
par: Cheng, Ziheng, et autres
Publié: (2025)
Zeroth-Order primal-dual Alternating Projection Gradient Algorithms for Nonconvex Minimax Problems with Coupled linear Constraints
par: Zhang, Huiling, et autres
Publié: (2024)
par: Zhang, Huiling, et autres
Publié: (2024)
Learning Provably Improves the Convergence of Gradient Descent
par: Song, Qingyu, et autres
Publié: (2025)
par: Song, Qingyu, et autres
Publié: (2025)
Enhancing Fractional Gradient Descent with Learned Optimizers
par: Sobotka, Jan, et autres
Publié: (2025)
par: Sobotka, Jan, et autres
Publié: (2025)
Inclusive KL Minimization: A Wasserstein-Fisher-Rao Gradient Flow Perspective
par: Zhu, Jia-Jie
Publié: (2024)
par: Zhu, Jia-Jie
Publié: (2024)
Accelerated Stochastic ExtraGradient: Mixing Hessian and Gradient Similarity to Reduce Communication in Distributed and Federated Learning
par: Bylinkin, Dmitry, et autres
Publié: (2024)
par: Bylinkin, Dmitry, et autres
Publié: (2024)
Online Learning-guided Learning Rate Adaptation via Gradient Alignment
par: Jiang, Ruichen, et autres
Publié: (2025)
par: Jiang, Ruichen, et autres
Publié: (2025)
Action Gaps and Advantages in Continuous-Time Distributional Reinforcement Learning
par: Wiltzer, Harley, et autres
Publié: (2024)
par: Wiltzer, Harley, et autres
Publié: (2024)
Gauss-Newton Natural Gradient Descent for Shape Learning
par: King, James, et autres
Publié: (2026)
par: King, James, et autres
Publié: (2026)
Gradient-Variation Online Learning under Generalized Smoothness
par: Xie, Yan-Feng, et autres
Publié: (2024)
par: Xie, Yan-Feng, et autres
Publié: (2024)
Mitigating Covariate Shift in Misspecified Regression with Applications to Reinforcement Learning
par: Amortila, Philip, et autres
Publié: (2024)
par: Amortila, Philip, et autres
Publié: (2024)
Projective Proximal Gradient Descent for A Class of Nonconvex Nonsmooth Optimization Problems: Fast Convergence Without Kurdyka-Lojasiewicz (KL) Property
par: Yang, Yingzhen, et autres
Publié: (2023)
par: Yang, Yingzhen, et autres
Publié: (2023)
Multinoulli Extension: A Lossless Continuous Relaxation for Partition-Constrained Subset Selection
par: Zhang, Qixin, et autres
Publié: (2026)
par: Zhang, Qixin, et autres
Publié: (2026)
RESIST: Resilient Decentralized Learning Using Consensus Gradient Descent
par: Fang, Cheng, et autres
Publié: (2025)
par: Fang, Cheng, et autres
Publié: (2025)
Sobolev Gradient Ascent for Optimal Transport: Barycenter Optimization and Convergence Analysis
par: Kim, Kaheon, et autres
Publié: (2025)
par: Kim, Kaheon, et autres
Publié: (2025)
Mirror and Preconditioned Gradient Descent in Wasserstein Space
par: Bonet, Clément, et autres
Publié: (2024)
par: Bonet, Clément, et autres
Publié: (2024)
Neural Collapse under Gradient Flow on Shallow ReLU Networks for Orthogonally Separable Data
par: Min, Hancheng, et autres
Publié: (2025)
par: Min, Hancheng, et autres
Publié: (2025)
Nonconvex Stochastic Bregman Proximal Gradient Method with Application to Deep Learning
par: Ding, Kuangyu, et autres
Publié: (2023)
par: Ding, Kuangyu, et autres
Publié: (2023)
Documents similaires
-
Variance-Reduced $(\varepsilon,δ)-$Unlearning using Forget Set Gradients
par: Van Waerebeke, Martin, et autres
Publié: (2026) -
When to Forget? Complexity Trade-offs in Machine Unlearning
par: Van Waerebeke, Martin, et autres
Publié: (2025) -
Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent Stochastic Approach
par: Fernando, Heshan, et autres
Publié: (2022) -
Adaptive Moment Estimation Optimization Algorithm Using Projection Gradient for Deep Learning
par: Li, Yongqi, et autres
Publié: (2025) -
Federated Learning on Riemannian Manifolds: A Gradient-Free Projection-Based Approach
par: Wang, Hongye, et autres
Publié: (2025)