Graceful Forgetting in Generative Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Chunyang, Chan, Chi-min, Cai, Yiyang, Liu, Yulong, Xue, Wei, Guo, Yike |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Importance Weighting Can Help Large Language Models Self-Improve
por: Jiang, Chunyang, et al.
Publicado: (2024)
por: Jiang, Chunyang, et al.
Publicado: (2024)
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoning
por: Chan, Chi-Min, et al.
Publicado: (2026)
por: Chan, Chi-Min, et al.
Publicado: (2026)
Offline Learning and Forgetting for Reasoning with Large Language Models
por: Ni, Tianwei, et al.
Publicado: (2025)
por: Ni, Tianwei, et al.
Publicado: (2025)
Mapping Post-Training Forgetting in Language Models at Scale
por: Harmon, Jackson, et al.
Publicado: (2025)
por: Harmon, Jackson, et al.
Publicado: (2025)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
por: Sun, Huashan, et al.
Publicado: (2024)
por: Sun, Huashan, et al.
Publicado: (2024)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
por: Feng, Yujie, et al.
Publicado: (2026)
por: Feng, Yujie, et al.
Publicado: (2026)
LLM Unlearning via Loss Adjustment with Only Forget Data
por: Wang, Yaxuan, et al.
Publicado: (2024)
por: Wang, Yaxuan, et al.
Publicado: (2024)
Self-Distillation as a Performance Recovery Mechanism for LLMs: Counteracting Compression and Catastrophic Forgetting
por: Liu, Chi, et al.
Publicado: (2026)
por: Liu, Chi, et al.
Publicado: (2026)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
por: Wang, Yulong, et al.
Publicado: (2024)
por: Wang, Yulong, et al.
Publicado: (2024)
Forgetting Transformer: Softmax Attention with a Forget Gate
por: Lin, Zhixuan, et al.
Publicado: (2025)
por: Lin, Zhixuan, et al.
Publicado: (2025)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
por: Lee, Gihun, et al.
Publicado: (2024)
por: Lee, Gihun, et al.
Publicado: (2024)
Did You Forget What I Asked? Prospective Memory Failures in Large Language Models
por: Mittal, Avni
Publicado: (2026)
por: Mittal, Avni
Publicado: (2026)
Embedding Enhancement via Fine-Tuned Language Models for Learner-Item Cognitive Modeling
por: Liu, Yuanhao, et al.
Publicado: (2026)
por: Liu, Yuanhao, et al.
Publicado: (2026)
Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models
por: Hsiao, Chi-Yuan, et al.
Publicado: (2025)
por: Hsiao, Chi-Yuan, et al.
Publicado: (2025)
GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay
por: Zhang, Yunan, et al.
Publicado: (2025)
por: Zhang, Yunan, et al.
Publicado: (2025)
Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning
por: Ren, Weijieying, et al.
Publicado: (2024)
por: Ren, Weijieying, et al.
Publicado: (2024)
FIT to Forget: Robust Continual Unlearning for Large Language Models
por: Xu, Xiaoyu, et al.
Publicado: (2026)
por: Xu, Xiaoyu, et al.
Publicado: (2026)
Stuffed Mamba: Oversized States Lead to the Inability to Forget
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
CORM: Cache Optimization with Recent Message for Large Language Model Inference
por: Dai, Jincheng, et al.
Publicado: (2024)
por: Dai, Jincheng, et al.
Publicado: (2024)
Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
por: Zaman, Kerem, et al.
Publicado: (2023)
por: Zaman, Kerem, et al.
Publicado: (2023)
Wings: Learning Multimodal LLMs without Text-only Forgetting
por: Zhang, Yi-Kai, et al.
Publicado: (2024)
por: Zhang, Yi-Kai, et al.
Publicado: (2024)
Interpreting Key Mechanisms of Factual Recall in Transformer-Based Language Models
por: Lv, Ang, et al.
Publicado: (2024)
por: Lv, Ang, et al.
Publicado: (2024)
Adaptive Computation Pruning for the Forgetting Transformer
por: Lin, Zhixuan, et al.
Publicado: (2025)
por: Lin, Zhixuan, et al.
Publicado: (2025)
QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models
por: Liu, Jing, et al.
Publicado: (2023)
por: Liu, Jing, et al.
Publicado: (2023)
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
por: Liu, Yibai, et al.
Publicado: (2025)
por: Liu, Yibai, et al.
Publicado: (2025)
Collaborative Performance Prediction for Large Language Models
por: Zhang, Qiyuan, et al.
Publicado: (2024)
por: Zhang, Qiyuan, et al.
Publicado: (2024)
Word Embeddings Are Steers for Language Models
por: Han, Chi, et al.
Publicado: (2023)
por: Han, Chi, et al.
Publicado: (2023)
Textual Aesthetics in Large Language Models
por: Jiang, Lingjie, et al.
Publicado: (2024)
por: Jiang, Lingjie, et al.
Publicado: (2024)
Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training
por: Lai, Song, et al.
Publicado: (2025)
por: Lai, Song, et al.
Publicado: (2025)
LLMExplainer: Large Language Model based Bayesian Inference for Graph Explanation Generation
por: Zhang, Jiaxing, et al.
Publicado: (2024)
por: Zhang, Jiaxing, et al.
Publicado: (2024)
EfficientLLM: Efficiency in Large Language Models
por: Yuan, Zhengqing, et al.
Publicado: (2025)
por: Yuan, Zhengqing, et al.
Publicado: (2025)
The Role of Deductive and Inductive Reasoning in Large Language Models
por: Cai, Chengkun, et al.
Publicado: (2024)
por: Cai, Chengkun, et al.
Publicado: (2024)
Evolutionary Strategies lead to Catastrophic Forgetting in LLMs
por: Abdi, Immanuel, et al.
Publicado: (2026)
por: Abdi, Immanuel, et al.
Publicado: (2026)
LoRA Learns Less and Forgets Less
por: Biderman, Dan, et al.
Publicado: (2024)
por: Biderman, Dan, et al.
Publicado: (2024)
Efficient End-to-end Language Model Fine-tuning on Graphs
por: Xue, Rui, et al.
Publicado: (2023)
por: Xue, Rui, et al.
Publicado: (2023)
Generalized Category Discovery with Large Language Models in the Loop
por: An, Wenbin, et al.
Publicado: (2023)
por: An, Wenbin, et al.
Publicado: (2023)
To Forget or Not? Towards Practical Knowledge Unlearning for Large Language Models
por: Tian, Bozhong, et al.
Publicado: (2024)
por: Tian, Bozhong, et al.
Publicado: (2024)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Ejemplares similares
-
Importance Weighting Can Help Large Language Models Self-Improve
por: Jiang, Chunyang, et al.
Publicado: (2024) -
Semantic Voting: A Self-Evaluation-Free Approach for Efficient LLM Self-Improvement on Unverifiable Open-ended Tasks
por: Jiang, Chunyang, et al.
Publicado: (2025) -
DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoning
por: Chan, Chi-Min, et al.
Publicado: (2026) -
Offline Learning and Forgetting for Reasoning with Large Language Models
por: Ni, Tianwei, et al.
Publicado: (2025) -
Mapping Post-Training Forgetting in Language Models at Scale
por: Harmon, Jackson, et al.
Publicado: (2025)