Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Jianheng, Cui, Leyang, Wang, Ante, Yang, Chengyi, Liao, Xinting, Song, Linfeng, Yao, Junfeng, Su, Jinsong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Response Enhanced Semi-supervised Dialogue Query Generation
por: Huang, Jianheng, et al.
Publicado: (2023)
por: Huang, Jianheng, et al.
Publicado: (2023)
Mitigating the Negative Impact of Over-association for Conversational Query Production
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
por: Wang, Zhihao, et al.
Publicado: (2024)
por: Wang, Zhihao, et al.
Publicado: (2024)
Model Tailor: Mitigating Catastrophic Forgetting in Multi-modal Large Language Models
por: Zhu, Didi, et al.
Publicado: (2024)
por: Zhu, Didi, et al.
Publicado: (2024)
Inferflow: an Efficient and Highly Configurable Inference Engine for Large Language Models
por: Shi, Shuming, et al.
Publicado: (2024)
por: Shi, Shuming, et al.
Publicado: (2024)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
por: Ding, Fei, et al.
Publicado: (2025)
por: Ding, Fei, et al.
Publicado: (2025)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
por: Lin, Yujie, et al.
Publicado: (2026)
por: Lin, Yujie, et al.
Publicado: (2026)
Balancing Speciality and Versatility: A Coarse to Fine Framework for Mitigating Catastrophic Forgetting in Large Language Models
por: Zhang, Hengyuan, et al.
Publicado: (2024)
por: Zhang, Hengyuan, et al.
Publicado: (2024)
Parameter Alignment Mitigates Catastrophic Forgetting in Multilingual Expert Language Models
por: Ahuja, Sanchit, et al.
Publicado: (2026)
por: Ahuja, Sanchit, et al.
Publicado: (2026)
SelfAug: Mitigating Catastrophic Forgetting in Retrieval-Augmented Generation via Distribution Self-Alignment
por: Huang, Yuqing, et al.
Publicado: (2025)
por: Huang, Yuqing, et al.
Publicado: (2025)
Model-Dowser: Data-Free Importance Probing to Mitigate Catastrophic Forgetting in Multimodal Large Language Models
por: Hwang, Hyeontaek, et al.
Publicado: (2026)
por: Hwang, Hyeontaek, et al.
Publicado: (2026)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Towards Better Graph-based Cross-document Relation Extraction via Non-bridge Entity Enhancement and Prediction Debiasing
por: Yue, Hao, et al.
Publicado: (2024)
por: Yue, Hao, et al.
Publicado: (2024)
A Dual-Perspective Metaphor Detection Framework Using Large Language Models
por: Lin, Yujie, et al.
Publicado: (2024)
por: Lin, Yujie, et al.
Publicado: (2024)
Mitigating Catastrophic Forgetting in Continual Learning through Model Growth
por: Süalp, Ege, et al.
Publicado: (2025)
por: Süalp, Ege, et al.
Publicado: (2025)
Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting
por: Watts, Ishaan, et al.
Publicado: (2026)
por: Watts, Ishaan, et al.
Publicado: (2026)
Not All Languages are Equal: Insights into Multilingual Retrieval-Augmented Generation
por: Wu, Suhang, et al.
Publicado: (2024)
por: Wu, Suhang, et al.
Publicado: (2024)
Locate-and-Focus: Enhancing Terminology Translation in Speech Language Models
por: Wu, Suhang, et al.
Publicado: (2025)
por: Wu, Suhang, et al.
Publicado: (2025)
Self-Consistency Boosts Calibration for Math Reasoning
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
por: Wang, Ante, et al.
Publicado: (2024)
por: Wang, Ante, et al.
Publicado: (2024)
An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
por: Luo, Yun, et al.
Publicado: (2023)
por: Luo, Yun, et al.
Publicado: (2023)
Mitigating Catastrophic Forgetting in Large Language Models with Forgetting-aware Pruning
por: Huang, Wei, et al.
Publicado: (2025)
por: Huang, Wei, et al.
Publicado: (2025)
Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models
por: Hsiao, Chi-Yuan, et al.
Publicado: (2025)
por: Hsiao, Chi-Yuan, et al.
Publicado: (2025)
Not All Preference Pairs Are Created Equal: A Recipe for Annotation-Efficient Iterative Preference Learning
por: Yang, Sen, et al.
Publicado: (2024)
por: Yang, Sen, et al.
Publicado: (2024)
Mitigating Catastrophic Forgetting in Target Language Adaptation of LLMs via Source-Shielded Updates
por: Yamaguchi, Atsuki, et al.
Publicado: (2025)
por: Yamaguchi, Atsuki, et al.
Publicado: (2025)
MoE-CT: A Novel Approach For Large Language Models Training With Resistance To Catastrophic Forgetting
por: Li, Tianhao, et al.
Publicado: (2024)
por: Li, Tianhao, et al.
Publicado: (2024)
Understanding Catastrophic Forgetting in Language Models via Implicit Inference
por: Kotha, Suhas, et al.
Publicado: (2023)
por: Kotha, Suhas, et al.
Publicado: (2023)
Mitigating Catastrophic Forgetting in Mathematical Reasoning Finetuning through Mixed Training
por: Reynolds, John Graham
Publicado: (2025)
por: Reynolds, John Graham
Publicado: (2025)
An Efficient Rehearsal Scheme for Catastrophic Forgetting Mitigation during Multi-stage Fine-tuning
por: Bai, Andrew, et al.
Publicado: (2024)
por: Bai, Andrew, et al.
Publicado: (2024)
Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferability
por: Chung, Tsz Ting, et al.
Publicado: (2024)
por: Chung, Tsz Ting, et al.
Publicado: (2024)
Knowledge Verification to Nip Hallucination in the Bud
por: Wan, Fanqi, et al.
Publicado: (2024)
por: Wan, Fanqi, et al.
Publicado: (2024)
Locate-then-Merge: Neuron-Level Parameter Fusion for Mitigating Catastrophic Forgetting in Multimodal LLMs
por: Yu, Zeping, et al.
Publicado: (2025)
por: Yu, Zeping, et al.
Publicado: (2025)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
por: Zhang, Zhixin, et al.
Publicado: (2025)
por: Zhang, Zhixin, et al.
Publicado: (2025)
Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP Tasks
por: Li, Qintong, et al.
Publicado: (2023)
por: Li, Qintong, et al.
Publicado: (2023)
Mitigating Catastrophic Forgetting in Multi-domain Chinese Spelling Correction by Multi-stage Knowledge Transfer Framework
por: Xing, Peng, et al.
Publicado: (2024)
por: Xing, Peng, et al.
Publicado: (2024)
Conditions for Catastrophic Forgetting in Multilingual Translation
por: Liu, Danni, et al.
Publicado: (2025)
por: Liu, Danni, et al.
Publicado: (2025)
Alleviating Hallucinations of Large Language Models through Induced Hallucinations
por: Zhang, Yue, et al.
Publicado: (2023)
por: Zhang, Yue, et al.
Publicado: (2023)
A Comparative Empirical Study of Catastrophic Forgetting Mitigation in Sequential Task Adaptation for Continual Natural Language Processing Systems
por: Abrahamyan, Aram, et al.
Publicado: (2026)
por: Abrahamyan, Aram, et al.
Publicado: (2026)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
por: Lyu, Mengxian, et al.
Publicado: (2026)
por: Lyu, Mengxian, et al.
Publicado: (2026)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
por: Fawi, Muhammad
Publicado: (2024)
por: Fawi, Muhammad
Publicado: (2024)
Ejemplares similares
-
Response Enhanced Semi-supervised Dialogue Query Generation
por: Huang, Jianheng, et al.
Publicado: (2023) -
Mitigating the Negative Impact of Over-association for Conversational Query Production
por: Wang, Ante, et al.
Publicado: (2024) -
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
por: Wang, Zhihao, et al.
Publicado: (2024) -
Model Tailor: Mitigating Catastrophic Forgetting in Multi-modal Large Language Models
por: Zhu, Didi, et al.
Publicado: (2024) -
Inferflow: an Efficient and Highly Configurable Inference Engine for Large Language Models
por: Shi, Shuming, et al.
Publicado: (2024)