Continual Learning of Large Language Models: A Comprehensive Survey
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Haizhou, Xu, Zihao, Wang, Hengyi, Qin, Weiyi, Wang, Wenyuan, Wang, Yibin, Wang, Zifeng, Ebrahimi, Sayna, Wang, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
par: Wang, Hengyi, et autres
Publié: (2024)
par: Wang, Hengyi, et autres
Publié: (2024)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
par: Shi, Haizhou, et autres
Publié: (2024)
par: Shi, Haizhou, et autres
Publié: (2024)
BLoB: Bayesian Low-Rank Adaptation by Backpropagation for Large Language Models
par: Wang, Yibin, et autres
Publié: (2024)
par: Wang, Yibin, et autres
Publié: (2024)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
par: Zhang, Tunyu, et autres
Publié: (2025)
par: Zhang, Tunyu, et autres
Publié: (2025)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
par: Tan, Shiwei, et autres
Publié: (2026)
par: Tan, Shiwei, et autres
Publié: (2026)
Variational Language Concepts for Interpreting Foundation Language Models
par: Wang, Hengyi, et autres
Publié: (2024)
par: Wang, Hengyi, et autres
Publié: (2024)
MindMap: Knowledge Graph Prompting Sparks Graph of Thoughts in Large Language Models
par: Wen, Yilin, et autres
Publié: (2023)
par: Wen, Yilin, et autres
Publié: (2023)
Tool Learning with Large Language Models: A Survey
par: Qu, Changle, et autres
Publié: (2024)
par: Qu, Changle, et autres
Publié: (2024)
Learning Dynamics in Continual Pre-Training for Large Language Models
par: Wang, Xingjin, et autres
Publié: (2025)
par: Wang, Xingjin, et autres
Publié: (2025)
SSR: Socratic Self-Refine for Large Language Model Reasoning
par: Shi, Haizhou, et autres
Publié: (2025)
par: Shi, Haizhou, et autres
Publié: (2025)
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
par: Feng, Yujie, et autres
Publié: (2025)
par: Feng, Yujie, et autres
Publié: (2025)
Dist2ill: Distributional Distillation for One-Pass Uncertainty Estimation in Large Language Models
par: Zhao, Yicong, et autres
Publié: (2025)
par: Zhao, Yicong, et autres
Publié: (2025)
Reverse Thinking Makes LLMs Stronger Reasoners
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
par: Feng, Yujie, et autres
Publié: (2026)
par: Feng, Yujie, et autres
Publié: (2026)
Token-Efficient Leverage Learning in Large Language Models
par: Zeng, Yuanhao, et autres
Publié: (2024)
par: Zeng, Yuanhao, et autres
Publié: (2024)
Instruction Tuning for Large Language Models: A Survey
par: Zhang, Shengyu, et autres
Publié: (2023)
par: Zhang, Shengyu, et autres
Publié: (2023)
SConU: Selective Conformal Uncertainty in Large Language Models
par: Wang, Zhiyuan, et autres
Publié: (2025)
par: Wang, Zhiyuan, et autres
Publié: (2025)
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
par: Pandit, Shrey, et autres
Publié: (2025)
par: Pandit, Shrey, et autres
Publié: (2025)
Protein Large Language Models: A Comprehensive Survey
par: Xiao, Yijia, et autres
Publié: (2025)
par: Xiao, Yijia, et autres
Publié: (2025)
Large Language Models Meet Text-Attributed Graphs: A Survey of Integration Frameworks and Applications
par: Su, Guangxin, et autres
Publié: (2025)
par: Su, Guangxin, et autres
Publié: (2025)
CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
par: Hsu, I-Hung, et autres
Publié: (2024)
par: Hsu, I-Hung, et autres
Publié: (2024)
Ensemble Learning for Large Language Models in Text and Code Generation: A Survey
par: Ashiga, Mari, et autres
Publié: (2025)
par: Ashiga, Mari, et autres
Publié: (2025)
CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery
par: Song, Xiaoshuai, et autres
Publié: (2024)
par: Song, Xiaoshuai, et autres
Publié: (2024)
Graph Neural Prompting with Large Language Models
par: Tian, Yijun, et autres
Publié: (2023)
par: Tian, Yijun, et autres
Publié: (2023)
Generative Evaluation of Complex Reasoning in Large Language Models
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
Advancing Graph Representation Learning with Large Language Models: A Comprehensive Survey of Techniques
par: Mao, Qiheng, et autres
Publié: (2024)
par: Mao, Qiheng, et autres
Publié: (2024)
Shifting Attention to Relevance: Towards the Predictive Uncertainty Quantification of Free-Form Large Language Models
par: Duan, Jinhao, et autres
Publié: (2023)
par: Duan, Jinhao, et autres
Publié: (2023)
A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms
par: Gong, Ruihao, et autres
Publié: (2024)
par: Gong, Ruihao, et autres
Publié: (2024)
MLLM-LLaVA-FL: Multimodal Large Language Model Assisted Federated Learning
par: Zhang, Jianyi, et autres
Publié: (2024)
par: Zhang, Jianyi, et autres
Publié: (2024)
A Survey on Large Language Models from Concept to Implementation
par: Wang, Chen, et autres
Publié: (2024)
par: Wang, Chen, et autres
Publié: (2024)
Learn from the Past: Fast Sparse Indexing for Large Language Model Decoding
par: Yao, Feiyu, et autres
Publié: (2025)
par: Yao, Feiyu, et autres
Publié: (2025)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
par: Wang, Yiping, et autres
Publié: (2025)
par: Wang, Yiping, et autres
Publié: (2025)
Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
par: Wang, Xinyi, et autres
Publié: (2023)
par: Wang, Xinyi, et autres
Publié: (2023)
Fine-Tuning Improves Information Conveyance in Language Models
par: Cheng, Yuwei, et autres
Publié: (2026)
par: Cheng, Yuwei, et autres
Publié: (2026)
A Survey on Evaluation of Large Language Models
par: Chang, Yupeng, et autres
Publié: (2023)
par: Chang, Yupeng, et autres
Publié: (2023)
MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models
par: Wang, Wentian, et autres
Publié: (2024)
par: Wang, Wentian, et autres
Publié: (2024)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
par: Guo, Siyuan, et autres
Publié: (2026)
par: Guo, Siyuan, et autres
Publié: (2026)
Skewed Memorization in Large Language Models: Quantification and Decomposition
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
Systematic Outliers in Large Language Models
par: An, Yongqi, et autres
Publié: (2025)
par: An, Yongqi, et autres
Publié: (2025)
ConU: Conformal Uncertainty in Large Language Models with Correctness Coverage Guarantees
par: Wang, Zhiyuan, et autres
Publié: (2024)
par: Wang, Zhiyuan, et autres
Publié: (2024)
Documents similaires
-
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
par: Wang, Hengyi, et autres
Publié: (2024) -
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
par: Shi, Haizhou, et autres
Publié: (2024) -
BLoB: Bayesian Low-Rank Adaptation by Backpropagation for Large Language Models
par: Wang, Yibin, et autres
Publié: (2024) -
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
par: Zhang, Tunyu, et autres
Publié: (2025) -
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
par: Tan, Shiwei, et autres
Publié: (2026)