Fine-Tuning Without Forgetting via Loss-Adaptive Learning Rates
Fuente:
arXiv
Guardado en:
| Autores principales: | Prashant, Parjanya Prajakta, Zhu, Jiongli, Creo, Aldan, Salimi, Babak |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KAIROS: Scalable Model-Agnostic Data Valuation
por: Zhu, Jiongli, et al.
Publicado: (2025)
por: Zhu, Jiongli, et al.
Publicado: (2025)
A Lightweight Method to Disrupt Memorized Sequences in LLM
por: Prashant, Parjanya Prajakta, et al.
Publicado: (2025)
por: Prashant, Parjanya Prajakta, et al.
Publicado: (2025)
Scalable Out-of-distribution Robustness in the Presence of Unobserved Confounders
por: Prashant, Parjanya, et al.
Publicado: (2024)
por: Prashant, Parjanya, et al.
Publicado: (2024)
Learning from Uncertain Data: From Possible Worlds to Possible Models
por: Zhu, Jiongli, et al.
Publicado: (2024)
por: Zhu, Jiongli, et al.
Publicado: (2024)
Stress-Testing ML Pipelines with Adversarial Data Corruption
por: Zhu, Jiongli, et al.
Publicado: (2025)
por: Zhu, Jiongli, et al.
Publicado: (2025)
Complete Evasion, Zero Modification: PDF Attacks on AI Text Detection
por: Creo, Aldan
Publicado: (2025)
por: Creo, Aldan
Publicado: (2025)
Differentiable Causal Discovery For Latent Hierarchical Causal Models
por: Prashant, Parjanya, et al.
Publicado: (2024)
por: Prashant, Parjanya, et al.
Publicado: (2024)
Fine-Tuning Without Forgetting In-Context Learning: A Theoretical Analysis of Linear Attention Models
por: Lee, Chungpa, et al.
Publicado: (2026)
por: Lee, Chungpa, et al.
Publicado: (2026)
Grow, Don't Overwrite: Fine-tuning Without Forgetting
por: Adila, Dyah, et al.
Publicado: (2026)
por: Adila, Dyah, et al.
Publicado: (2026)
SilverSpeak: Evading AI-Generated Text Detectors using Homoglyphs
por: Creo, Aldan, et al.
Publicado: (2024)
por: Creo, Aldan, et al.
Publicado: (2024)
RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting
por: Li, Yuduo, et al.
Publicado: (2026)
por: Li, Yuduo, et al.
Publicado: (2026)
Entropy-Adaptive Fine-Tuning: Resolving Confident Conflicts to Mitigate Forgetting
por: Diao, Muxi, et al.
Publicado: (2026)
por: Diao, Muxi, et al.
Publicado: (2026)
Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning
por: Huo, Yujia, et al.
Publicado: (2025)
por: Huo, Yujia, et al.
Publicado: (2025)
Overcoming Forgetting in LLM Fine-Tuning with Evolution Strategies
por: Schweighofer, Kajetan, et al.
Publicado: (2026)
por: Schweighofer, Kajetan, et al.
Publicado: (2026)
Upweighting Easy Samples in Fine-Tuning Mitigates Forgetting
por: Sanyal, Sunny, et al.
Publicado: (2025)
por: Sanyal, Sunny, et al.
Publicado: (2025)
RL Fine-Tuning Heals OOD Forgetting in SFT
por: Jin, Hangzhan, et al.
Publicado: (2025)
por: Jin, Hangzhan, et al.
Publicado: (2025)
Don't Forget the Nonlinearity: Unlocking Activation Functions in Efficient Fine-Tuning
por: Yin, Bo, et al.
Publicado: (2025)
por: Yin, Bo, et al.
Publicado: (2025)
Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning
por: Chen, Liang, et al.
Publicado: (2025)
por: Chen, Liang, et al.
Publicado: (2025)
Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning
por: Lou, Meng, et al.
Publicado: (2026)
por: Lou, Meng, et al.
Publicado: (2026)
Forget the Data and Fine-Tuning! Just Fold the Network to Compress
por: Wang, Dong, et al.
Publicado: (2025)
por: Wang, Dong, et al.
Publicado: (2025)
On Catastrophic Forgetting in Low-Rank Decomposition-Based Parameter-Efficient Fine-Tuning
por: Ahmad, Muhammad, et al.
Publicado: (2026)
por: Ahmad, Muhammad, et al.
Publicado: (2026)
Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training
por: Lai, Song, et al.
Publicado: (2025)
por: Lai, Song, et al.
Publicado: (2025)
Bayesian Parameter-Efficient Fine-Tuning for Overcoming Catastrophic Forgetting
por: Chen, Haolin, et al.
Publicado: (2024)
por: Chen, Haolin, et al.
Publicado: (2024)
Order-Independence Without Fine Tuning
por: McIlroy-Young, Reid, et al.
Publicado: (2024)
por: McIlroy-Young, Reid, et al.
Publicado: (2024)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
por: Li, He, et al.
Publicado: (2026)
por: Li, He, et al.
Publicado: (2026)
Deeper Insights Without Updates: The Power of In-Context Learning Over Fine-Tuning
por: Yin, Qingyu, et al.
Publicado: (2024)
por: Yin, Qingyu, et al.
Publicado: (2024)
Task Switching Without Forgetting via Proximal Decoupling
por: Shamsolmoali, Pourya, et al.
Publicado: (2026)
por: Shamsolmoali, Pourya, et al.
Publicado: (2026)
MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning
por: Chen, Yupeng, et al.
Publicado: (2024)
por: Chen, Yupeng, et al.
Publicado: (2024)
Addressing Loss of Plasticity and Catastrophic Forgetting in Continual Learning
por: Elsayed, Mohamed, et al.
Publicado: (2024)
por: Elsayed, Mohamed, et al.
Publicado: (2024)
Turning Back Without Forgetting: Selective Backward Refinement for Parameter-Efficient Continual Learning
por: Tiwari, Anushka, et al.
Publicado: (2026)
por: Tiwari, Anushka, et al.
Publicado: (2026)
Not All Forgetting Is Equal: Architecture-Dependent Retention Dynamics in Fine-Tuned Image Classifiers
por: Daga, Miit, et al.
Publicado: (2026)
por: Daga, Miit, et al.
Publicado: (2026)
Modular Multimodal Classification Without Fine-Tuning: A Simple Compositional Approach
por: Bergström, Herman, et al.
Publicado: (2026)
por: Bergström, Herman, et al.
Publicado: (2026)
Matched-Learning-Rate Analysis of Attention Drift and Transfer Retention in Fine-Tuned CLIP
por: Xia, Ruize
Publicado: (2026)
por: Xia, Ruize
Publicado: (2026)
RAVQ-HoloNet: Rate-Adaptive Vector-Quantized Hologram Compression
por: Rafiei, Shima, et al.
Publicado: (2025)
por: Rafiei, Shima, et al.
Publicado: (2025)
Stress-Testing Causal Claims via Cardinality Repairs
por: Gabbay, Yarden, et al.
Publicado: (2025)
por: Gabbay, Yarden, et al.
Publicado: (2025)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
por: Kalajdzievski, Damjan
Publicado: (2024)
por: Kalajdzievski, Damjan
Publicado: (2024)
Adaptive Fine-Tuning via Pattern Specialization for Deep Time Series Forecasting
por: Saadallah, Amal, et al.
Publicado: (2025)
por: Saadallah, Amal, et al.
Publicado: (2025)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
por: Fawi, Muhammad
Publicado: (2024)
por: Fawi, Muhammad
Publicado: (2024)
Personalized Federated Learning with Mixture of Models for Adaptive Prediction and Model Fine-Tuning
por: Ghari, Pouya M., et al.
Publicado: (2024)
por: Ghari, Pouya M., et al.
Publicado: (2024)
Representation Without Reward: A JEPA Audit for LLM Fine-Tuning
por: Sengupta, Biswa
Publicado: (2026)
por: Sengupta, Biswa
Publicado: (2026)
Ejemplares similares
-
KAIROS: Scalable Model-Agnostic Data Valuation
por: Zhu, Jiongli, et al.
Publicado: (2025) -
A Lightweight Method to Disrupt Memorized Sequences in LLM
por: Prashant, Parjanya Prajakta, et al.
Publicado: (2025) -
Scalable Out-of-distribution Robustness in the Presence of Unobserved Confounders
por: Prashant, Parjanya, et al.
Publicado: (2024) -
Learning from Uncertain Data: From Possible Worlds to Possible Models
por: Zhu, Jiongli, et al.
Publicado: (2024) -
Stress-Testing ML Pipelines with Adversarial Data Corruption
por: Zhu, Jiongli, et al.
Publicado: (2025)