Mitigating Catastrophic Forgetting in Language Transfer via Model Merging
Fuente:
arXiv
Salvato in:
| Autori principali: | Alexandrov, Anton, Raychev, Veselin, Müller, Mark Niklas, Zhang, Ce, Vechev, Martin, Toutanova, Kristina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BgGPT 1.0: Extending English-centric LLMs to other languages
di: Alexandrov, Anton, et al.
Pubblicazione: (2024)
di: Alexandrov, Anton, et al.
Pubblicazione: (2024)
CodeTaste: Can LLMs Generate Human-Level Code Refactorings?
di: Thillen, Alex, et al.
Pubblicazione: (2026)
di: Thillen, Alex, et al.
Pubblicazione: (2026)
DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models
di: Berabi, Berkay, et al.
Pubblicazione: (2024)
di: Berabi, Berkay, et al.
Pubblicazione: (2024)
Mitigating Catastrophic Forgetting in Large Language Models with Forgetting-aware Pruning
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets
di: Yukhymenko, Hanna, et al.
Pubblicazione: (2026)
di: Yukhymenko, Hanna, et al.
Pubblicazione: (2026)
BaxBench: Can LLMs Generate Correct and Secure Backends?
di: Vero, Mark, et al.
Pubblicazione: (2025)
di: Vero, Mark, et al.
Pubblicazione: (2025)
Evaluating AGENTS.md: Are Repository-Level Context Files Helpful for Coding Agents?
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
Coding Agents Don't Know When to Act
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
di: Gloaguen, Thibaud, et al.
Pubblicazione: (2026)
Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting
di: Watts, Ishaan, et al.
Pubblicazione: (2026)
di: Watts, Ishaan, et al.
Pubblicazione: (2026)
Sequencing to Mitigate Catastrophic Forgetting in Continual Learning
di: Moussa, Hesham G., et al.
Pubblicazione: (2025)
di: Moussa, Hesham G., et al.
Pubblicazione: (2025)
Average Certified Radius is a Poor Metric for Randomized Smoothing
di: Sun, Chenhao, et al.
Pubblicazione: (2024)
di: Sun, Chenhao, et al.
Pubblicazione: (2024)
Catastrophic Forgetting Mitigation via Discrepancy-Weighted Experience Replay
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
Understanding Catastrophic Forgetting in Language Models via Implicit Inference
di: Kotha, Suhas, et al.
Pubblicazione: (2023)
di: Kotha, Suhas, et al.
Pubblicazione: (2023)
MEGA: Second-Order Gradient Alignment for Catastrophic Forgetting Mitigation in GFSCIL
di: Pang, Jinhui, et al.
Pubblicazione: (2025)
di: Pang, Jinhui, et al.
Pubblicazione: (2025)
Evading Data Contamination Detection for Language Models is (too) Easy
di: Dekoninck, Jasper, et al.
Pubblicazione: (2024)
di: Dekoninck, Jasper, et al.
Pubblicazione: (2024)
Automated Classification of Model Errors on ImageNet
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
Understanding Certified Training with Interval Bound Propagation
di: Mao, Yuhao, et al.
Pubblicazione: (2023)
di: Mao, Yuhao, et al.
Pubblicazione: (2023)
CORE: Mitigating Catastrophic Forgetting in Continual Learning through Cognitive Replay
di: Zhang, Jianshu, et al.
Pubblicazione: (2024)
di: Zhang, Jianshu, et al.
Pubblicazione: (2024)
Catastrophic Forgetting Mitigation Through Plateau Phase Activity Profiling
di: Mashiach, Idan, et al.
Pubblicazione: (2025)
di: Mashiach, Idan, et al.
Pubblicazione: (2025)
SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents
di: Mündler, Niels, et al.
Pubblicazione: (2024)
di: Mündler, Niels, et al.
Pubblicazione: (2024)
Fine-Grained Gradient Restriction: A Simple Approach for Mitigating Catastrophic Forgetting
di: Liu, Bo, et al.
Pubblicazione: (2024)
di: Liu, Bo, et al.
Pubblicazione: (2024)
Optimizing Pre-Training Data Mixtures with Mixtures of Data Expert Models
di: Belenki, Lior, et al.
Pubblicazione: (2025)
di: Belenki, Lior, et al.
Pubblicazione: (2025)
Mitigating Catastrophic Forgetting in Mathematical Reasoning Finetuning through Mixed Training
di: Reynolds, John Graham
Pubblicazione: (2025)
di: Reynolds, John Graham
Pubblicazione: (2025)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
di: Zhang, Zhixin, et al.
Pubblicazione: (2025)
di: Zhang, Zhixin, et al.
Pubblicazione: (2025)
Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models
di: Hsiao, Chi-Yuan, et al.
Pubblicazione: (2025)
di: Hsiao, Chi-Yuan, et al.
Pubblicazione: (2025)
An Efficient Rehearsal Scheme for Catastrophic Forgetting Mitigation during Multi-stage Fine-tuning
di: Bai, Andrew, et al.
Pubblicazione: (2024)
di: Bai, Andrew, et al.
Pubblicazione: (2024)
FlexFed: Mitigating Catastrophic Forgetting in Heterogeneous Federated Learning in Pervasive Computing Environments
di: Alosaime, Sara, et al.
Pubblicazione: (2025)
di: Alosaime, Sara, et al.
Pubblicazione: (2025)
DAGER: Exact Gradient Inversion for Large Language Models
di: Petrov, Ivo, et al.
Pubblicazione: (2024)
di: Petrov, Ivo, et al.
Pubblicazione: (2024)
Are Time Series Foundation Models Susceptible to Catastrophic Forgetting?
di: Karaouli, Nouha, et al.
Pubblicazione: (2025)
di: Karaouli, Nouha, et al.
Pubblicazione: (2025)
Federated Learning Under Temporal Drift -- Mitigating Catastrophic Forgetting via Experience Replay
di: Kokkula, Sahasra, et al.
Pubblicazione: (2026)
di: Kokkula, Sahasra, et al.
Pubblicazione: (2026)
Predicting the Susceptibility of Examples to Catastrophic Forgetting
di: Hacohen, Guy, et al.
Pubblicazione: (2024)
di: Hacohen, Guy, et al.
Pubblicazione: (2024)
Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation
di: Mündler, Niels, et al.
Pubblicazione: (2023)
di: Mündler, Niels, et al.
Pubblicazione: (2023)
Gaussian Loss Smoothing Enables Certified Training with Tight Convex Relaxations
di: Balauca, Stefan, et al.
Pubblicazione: (2024)
di: Balauca, Stefan, et al.
Pubblicazione: (2024)
Continual Deep Reinforcement Learning to Prevent Catastrophic Forgetting in Jamming Mitigation
di: Davaslioglu, Kemal, et al.
Pubblicazione: (2024)
di: Davaslioglu, Kemal, et al.
Pubblicazione: (2024)
Mitigating Catastrophic Forgetting and Mode Collapse in Text-to-Image Diffusion via Latent Replay
di: Otani, Aoi
Pubblicazione: (2025)
di: Otani, Aoi
Pubblicazione: (2025)
Measuring Catastrophic Forgetting in Cross-Lingual Transfer Paradigms: Exploring Tuning Strategies
di: Koloski, Boshko, et al.
Pubblicazione: (2023)
di: Koloski, Boshko, et al.
Pubblicazione: (2023)
Robust Policy Optimization to Prevent Catastrophic Forgetting
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
di: Sabbaghi, Mahdi, et al.
Pubblicazione: (2026)
Unlocking the Power of Function Vectors for Characterizing and Mitigating Catastrophic Forgetting in Continual Instruction Tuning
di: Jiang, Gangwei, et al.
Pubblicazione: (2025)
di: Jiang, Gangwei, et al.
Pubblicazione: (2025)
Catastrophic Forgetting in Kolmogorov-Arnold Networks
di: Rahman, Mohammad Marufur, et al.
Pubblicazione: (2025)
di: Rahman, Mohammad Marufur, et al.
Pubblicazione: (2025)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
di: Fawi, Muhammad
Pubblicazione: (2024)
di: Fawi, Muhammad
Pubblicazione: (2024)
Documenti analoghi
-
BgGPT 1.0: Extending English-centric LLMs to other languages
di: Alexandrov, Anton, et al.
Pubblicazione: (2024) -
CodeTaste: Can LLMs Generate Human-Level Code Refactorings?
di: Thillen, Alex, et al.
Pubblicazione: (2026) -
DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models
di: Berabi, Berkay, et al.
Pubblicazione: (2024) -
Mitigating Catastrophic Forgetting in Large Language Models with Forgetting-aware Pruning
di: Huang, Wei, et al.
Pubblicazione: (2025) -
Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets
di: Yukhymenko, Hanna, et al.
Pubblicazione: (2026)