Self-Consolidating Language Models: Continual Knowledge Incorporation from Context
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Zekun, Gupta, Anant, Dong, Zihan, MacLellan, Christopher J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Avoid Catastrophic Forgetting with Rank-1 Fisher from Diffusion Models
di: Wang, Zekun, et al.
Pubblicazione: (2025)
di: Wang, Zekun, et al.
Pubblicazione: (2025)
Trust Region Continual Learning as an Implicit Meta-Learner
di: Wang, Zekun, et al.
Pubblicazione: (2026)
di: Wang, Zekun, et al.
Pubblicazione: (2026)
CobwebTM: Probabilistic Concept Formation for Lifelong and Hierarchical Topic Modeling
di: Singaravadivelan, Karthik, et al.
Pubblicazione: (2026)
di: Singaravadivelan, Karthik, et al.
Pubblicazione: (2026)
Test-Time Compositional Generalization in Diffusion Models via Concept Discovery
di: Wang, Zekun, et al.
Pubblicazione: (2026)
di: Wang, Zekun, et al.
Pubblicazione: (2026)
Grounded Concreteness: Human-Like Concreteness Sensitivity in Vision-Language Models
di: Roy, Aryan, et al.
Pubblicazione: (2026)
di: Roy, Aryan, et al.
Pubblicazione: (2026)
VAL: Interactive Task Learning with GPT Dialog Parsing
di: Lawley, Lane, et al.
Pubblicazione: (2023)
di: Lawley, Lane, et al.
Pubblicazione: (2023)
STAND: Self-Aware Precondition Induction for Interactive Task Learning
di: Weitekamp, Daniel, et al.
Pubblicazione: (2024)
di: Weitekamp, Daniel, et al.
Pubblicazione: (2024)
Model Human Learners: Computational Models to Guide Instructional Design
di: MacLellan, Christopher J.
Pubblicazione: (2025)
di: MacLellan, Christopher J.
Pubblicazione: (2025)
Incremental Concept Formation over Visual Images Without Catastrophic Forgetting
di: Barari, Nicki, et al.
Pubblicazione: (2024)
di: Barari, Nicki, et al.
Pubblicazione: (2024)
DAGAF: A directed acyclic generative adversarial framework for joint structure learning and tabular data synthesis
di: Petkov, Hristo, et al.
Pubblicazione: (2026)
di: Petkov, Hristo, et al.
Pubblicazione: (2026)
SEEKR: Selective Attention-Guided Knowledge Retention for Continual Learning of Large Language Models
di: He, Jinghan, et al.
Pubblicazione: (2024)
di: He, Jinghan, et al.
Pubblicazione: (2024)
A Rational Account of Categorization Based on Information Theory
di: MacLellan, Christopher J., et al.
Pubblicazione: (2026)
di: MacLellan, Christopher J., et al.
Pubblicazione: (2026)
Cobweb: An Incremental and Hierarchical Model of Human-Like Category Learning
di: Lian, Xin, et al.
Pubblicazione: (2024)
di: Lian, Xin, et al.
Pubblicazione: (2024)
Incremental and Data-Efficient Concept Formation to Support Masked Word Prediction
di: Lian, Xin, et al.
Pubblicazione: (2024)
di: Lian, Xin, et al.
Pubblicazione: (2024)
Explaining Robustness to Catastrophic Forgetting Through Incremental Concept Formation
di: Barari, Nicki, et al.
Pubblicazione: (2025)
di: Barari, Nicki, et al.
Pubblicazione: (2025)
Intelligent Tutors Beyond K-12: An Observational Study of Adult Learner Engagement and Academic Impact
di: Gupta, Adit, et al.
Pubblicazione: (2025)
di: Gupta, Adit, et al.
Pubblicazione: (2025)
Decomposed Inductive Procedure Learning: Learning Academic Tasks with Human-Like Data Efficiency
di: Weitekamp, Daniel, et al.
Pubblicazione: (2025)
di: Weitekamp, Daniel, et al.
Pubblicazione: (2025)
TRESTLE: A Model of Concept Formation in Structured Domains
di: MacLellan, Christopher J., et al.
Pubblicazione: (2024)
di: MacLellan, Christopher J., et al.
Pubblicazione: (2024)
Large Language Models Lack Temporal Awareness of Medical Knowledge
di: Guan, Zihan, et al.
Pubblicazione: (2026)
di: Guan, Zihan, et al.
Pubblicazione: (2026)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
Factual Knowledge in Language Models: Robustness and Anomalies under Simple Temporal Context Variations
di: Khodja, Hichem Ammar, et al.
Pubblicazione: (2025)
di: Khodja, Hichem Ammar, et al.
Pubblicazione: (2025)
CoCoA: Confidence and Context-Aware Adaptive Decoding for Resolving Knowledge Conflicts in Large Language Models
di: Khandelwal, Anant, et al.
Pubblicazione: (2025)
di: Khandelwal, Anant, et al.
Pubblicazione: (2025)
A Comprehensive Survey on Long Context Language Modeling
di: Liu, Jiaheng, et al.
Pubblicazione: (2025)
di: Liu, Jiaheng, et al.
Pubblicazione: (2025)
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
di: Feng, Yujie, et al.
Pubblicazione: (2025)
di: Feng, Yujie, et al.
Pubblicazione: (2025)
Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models
di: Zhang, Qizheng, et al.
Pubblicazione: (2025)
di: Zhang, Qizheng, et al.
Pubblicazione: (2025)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
Can I understand what I create? Self-Knowledge Evaluation of Large Language Models
di: Tan, Zhiquan, et al.
Pubblicazione: (2024)
di: Tan, Zhiquan, et al.
Pubblicazione: (2024)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
Core Context Aware Transformers for Long Context Language Modeling
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
Concept Unlearning in Large Language Models via Self-Constructed Knowledge Triplets
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
di: Dong, Zican, et al.
Pubblicazione: (2024)
di: Dong, Zican, et al.
Pubblicazione: (2024)
Unlocking Continual Learning Abilities in Language Models
di: Du, Wenyu, et al.
Pubblicazione: (2024)
di: Du, Wenyu, et al.
Pubblicazione: (2024)
ScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context Learning
di: She, Jingyuan Selena, et al.
Pubblicazione: (2023)
di: She, Jingyuan Selena, et al.
Pubblicazione: (2023)
Apprentice Tutor Builder: A Platform For Users to Create and Personalize Intelligent Tutors
di: Smith, Glen, et al.
Pubblicazione: (2024)
di: Smith, Glen, et al.
Pubblicazione: (2024)
Brewing Knowledge in Context: Distillation Perspectives on In-Context Learning
di: Li, Chengye, et al.
Pubblicazione: (2025)
di: Li, Chengye, et al.
Pubblicazione: (2025)
Knowledge Graph Large Language Model (KG-LLM) for Link Prediction
di: Shu, Dong, et al.
Pubblicazione: (2024)
di: Shu, Dong, et al.
Pubblicazione: (2024)
Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing
di: Liu, Tianci, et al.
Pubblicazione: (2025)
di: Liu, Tianci, et al.
Pubblicazione: (2025)
CultureLLM: Incorporating Cultural Differences into Large Language Models
di: Li, Cheng, et al.
Pubblicazione: (2024)
di: Li, Cheng, et al.
Pubblicazione: (2024)
Consolidating Rewarded Perturbations for LLM Post-Training
di: Zhang, Zheyu, et al.
Pubblicazione: (2026)
di: Zhang, Zheyu, et al.
Pubblicazione: (2026)
Erasing Conceptual Knowledge from Language Models
di: Gandikota, Rohit, et al.
Pubblicazione: (2024)
di: Gandikota, Rohit, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Avoid Catastrophic Forgetting with Rank-1 Fisher from Diffusion Models
di: Wang, Zekun, et al.
Pubblicazione: (2025) -
Trust Region Continual Learning as an Implicit Meta-Learner
di: Wang, Zekun, et al.
Pubblicazione: (2026) -
CobwebTM: Probabilistic Concept Formation for Lifelong and Hierarchical Topic Modeling
di: Singaravadivelan, Karthik, et al.
Pubblicazione: (2026) -
Test-Time Compositional Generalization in Diffusion Models via Concept Discovery
di: Wang, Zekun, et al.
Pubblicazione: (2026) -
Grounded Concreteness: Human-Like Concreteness Sensitivity in Vision-Language Models
di: Roy, Aryan, et al.
Pubblicazione: (2026)