Continual Learning for Large Language Models: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Tongtong, Luo, Linhao, Li, Yuan-Fang, Pan, Shirui, Vu, Thuy-Trang, Haffari, Gholamreza |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Active Continual Learning: On Balancing Knowledge Retention and Learnability
di: Vu, Thuy-Trang, et al.
Pubblicazione: (2023)
di: Vu, Thuy-Trang, et al.
Pubblicazione: (2023)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
di: Luo, Linhao, et al.
Pubblicazione: (2023)
di: Luo, Linhao, et al.
Pubblicazione: (2023)
Beyond Imitation: Recovering Dense Rewards from Demonstrations
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
CARD: Towards Conditional Design of Multi-agent Topological Structures
di: Wu, Tongtong, et al.
Pubblicazione: (2026)
di: Wu, Tongtong, et al.
Pubblicazione: (2026)
AIPO: Learning to Reason from Active Interaction
di: Liu, Junnan, et al.
Pubblicazione: (2026)
di: Liu, Junnan, et al.
Pubblicazione: (2026)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
di: Liu, Junnan, et al.
Pubblicazione: (2025)
di: Liu, Junnan, et al.
Pubblicazione: (2025)
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
GTS: Inference-Time Scaling of Latent Reasoning with a Learnable Gaussian Thought Sampler
di: Wang, Minghan, et al.
Pubblicazione: (2026)
di: Wang, Minghan, et al.
Pubblicazione: (2026)
Graph-constrained Reasoning: Faithful Reasoning on Knowledge Graphs with Large Language Models
di: Luo, Linhao, et al.
Pubblicazione: (2024)
di: Luo, Linhao, et al.
Pubblicazione: (2024)
ChatRule: Mining Logical Rules with Large Language Models for Knowledge Graph Reasoning
di: Luo, Linhao, et al.
Pubblicazione: (2023)
di: Luo, Linhao, et al.
Pubblicazione: (2023)
Adapting Large Language Models for Document-Level Machine Translation
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
Towards Inference-time Scaling for Continuous Space Reasoning
di: Wang, Minghan, et al.
Pubblicazione: (2025)
di: Wang, Minghan, et al.
Pubblicazione: (2025)
Discrete Minds in a Continuous World: Do Language Models Know Time Passes?
di: Wang, Minghan, et al.
Pubblicazione: (2025)
di: Wang, Minghan, et al.
Pubblicazione: (2025)
Conversational SimulMT: Efficient Simultaneous Translation with Large Language Models
di: Wang, Minghan, et al.
Pubblicazione: (2024)
di: Wang, Minghan, et al.
Pubblicazione: (2024)
The Best of Both Worlds: Bridging Quality and Diversity in Data Selection with Bipartite Graph
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
Direct Evaluation of Chain-of-Thought in Multi-hop Reasoning with Knowledge Graphs
di: Nguyen, Minh-Vuong, et al.
Pubblicazione: (2024)
di: Nguyen, Minh-Vuong, et al.
Pubblicazione: (2024)
Simultaneous Machine Translation with Large Language Models
di: Wang, Minghan, et al.
Pubblicazione: (2023)
di: Wang, Minghan, et al.
Pubblicazione: (2023)
Table-r1: Self-supervised and Reinforcement Learning for Program-based Table Reasoning in Small Language Models
di: Jin, Rihui, et al.
Pubblicazione: (2025)
di: Jin, Rihui, et al.
Pubblicazione: (2025)
SCAR: Data Selection via Style Consistency-Aware Response Ranking for Efficient Instruction-Tuning of Large Language Models
di: Li, Zhuang, et al.
Pubblicazione: (2024)
di: Li, Zhuang, et al.
Pubblicazione: (2024)
MiniCache: KV Cache Compression in Depth Dimension for Large Language Models
di: Liu, Akide, et al.
Pubblicazione: (2024)
di: Liu, Akide, et al.
Pubblicazione: (2024)
Extending LLMs to New Languages: A Case Study of Llama and Persian Adaptation
di: Sani, Samin Mahdizadeh, et al.
Pubblicazione: (2024)
di: Sani, Samin Mahdizadeh, et al.
Pubblicazione: (2024)
GFM-RAG: Graph Foundation Model for Retrieval Augmented Generation
di: Luo, Linhao, et al.
Pubblicazione: (2025)
di: Luo, Linhao, et al.
Pubblicazione: (2025)
Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASR
di: Wang, Minghan, et al.
Pubblicazione: (2024)
di: Wang, Minghan, et al.
Pubblicazione: (2024)
Scalable Frame-based Construction of Sociocultural NormBases for Socially-Aware Dialogues
di: Qu, Shilin, et al.
Pubblicazione: (2024)
di: Qu, Shilin, et al.
Pubblicazione: (2024)
IntroLM: Introspective Language Models via Prefilling-Time Self-Evaluation
di: Kasnavieh, Hossein Hosseini, et al.
Pubblicazione: (2026)
di: Kasnavieh, Hossein Hosseini, et al.
Pubblicazione: (2026)
IRIS: An Iterative and Integrated Framework for Verifiable Causal Discovery in the Absence of Tabular Data
di: Feng, Tao, et al.
Pubblicazione: (2025)
di: Feng, Tao, et al.
Pubblicazione: (2025)
CONGRAD:Conflicting Gradient Filtering for Multilingual Preference Alignment
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
PromptDSI: Prompt-based Rehearsal-free Continual Learning for Document Retrieval
di: Huynh, Tuan-Luc, et al.
Pubblicazione: (2024)
di: Huynh, Tuan-Luc, et al.
Pubblicazione: (2024)
SpeechDialogueFactory: Generating High-Quality Speech Dialogue Data to Accelerate Your Speech-LLM Development
di: Wang, Minghan, et al.
Pubblicazione: (2025)
di: Wang, Minghan, et al.
Pubblicazione: (2025)
Continual Learning of Large Language Models: A Comprehensive Survey
di: Shi, Haizhou, et al.
Pubblicazione: (2024)
di: Shi, Haizhou, et al.
Pubblicazione: (2024)
$\text{M}^{2}$LLM: Multi-view Molecular Representation Learning with Large Language Models
di: Ju, Jiaxin, et al.
Pubblicazione: (2025)
di: Ju, Jiaxin, et al.
Pubblicazione: (2025)
Resurfacing Paralinguistic Awareness in Large Audio Language Models
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
Continual Speech Learning with Fused Speech Features
di: Wang, Guitao, et al.
Pubblicazione: (2025)
di: Wang, Guitao, et al.
Pubblicazione: (2025)
A Survey on Training-free Alignment of Large Language Models
di: Pan, Birong, et al.
Pubblicazione: (2025)
di: Pan, Birong, et al.
Pubblicazione: (2025)
Unifying Large Language Models and Knowledge Graphs: A Roadmap
di: Pan, Shirui, et al.
Pubblicazione: (2023)
di: Pan, Shirui, et al.
Pubblicazione: (2023)
Towards Lifelong Learning of Large Language Models: A Survey
di: Zheng, Junhao, et al.
Pubblicazione: (2024)
di: Zheng, Junhao, et al.
Pubblicazione: (2024)
MixLoRA-DSI: Dynamically Expandable Mixture-of-LoRA Experts for Rehearsal-Free Generative Retrieval over Dynamic Corpora
di: Huynh, Tuan-Luc, et al.
Pubblicazione: (2025)
di: Huynh, Tuan-Luc, et al.
Pubblicazione: (2025)
Beyond a Single Perspective: Text Anomaly Detection with Multi-View Language Representations
di: Liu, Yixin, et al.
Pubblicazione: (2026)
di: Liu, Yixin, et al.
Pubblicazione: (2026)
Modelling Political Coalition Negotiations Using LLM-based Agents
di: Moghimifar, Farhad, et al.
Pubblicazione: (2024)
di: Moghimifar, Farhad, et al.
Pubblicazione: (2024)
How Vision-Language Tasks Benefit from Large Pre-trained Models: A Survey
di: Qi, Yayun, et al.
Pubblicazione: (2024)
di: Qi, Yayun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Active Continual Learning: On Balancing Knowledge Retention and Learnability
di: Vu, Thuy-Trang, et al.
Pubblicazione: (2023) -
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
di: Luo, Linhao, et al.
Pubblicazione: (2023) -
Beyond Imitation: Recovering Dense Rewards from Demonstrations
di: Li, Jiangnan, et al.
Pubblicazione: (2025) -
CARD: Towards Conditional Design of Multi-agent Topological Structures
di: Wu, Tongtong, et al.
Pubblicazione: (2026) -
AIPO: Learning to Reason from Active Interaction
di: Liu, Junnan, et al.
Pubblicazione: (2026)