Talking to Yourself: Defying Forgetting in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Yutao, Chen, Mingshuai, Zhao, Tiancheng, Miao, Phillip, Zhang, Zilun, Shen, Haozhan, Zhu, Ruizhe, Yin, Jianwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Self-Improvement Paradox: Can Language Models Bootstrap Reasoning Capabilities without External Scaffolding?
por: Sun, Yutao, et al.
Publicado: (2025)
por: Sun, Yutao, et al.
Publicado: (2025)
Preserving Knowledge in Large Language Model with Model-Agnostic Self-Decompression
por: Zhang, Zilun, et al.
Publicado: (2024)
por: Zhang, Zilun, et al.
Publicado: (2024)
RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2023)
por: Zhang, Zilun, et al.
Publicado: (2023)
HORAE: A Domain-Agnostic Language for Automated Service Regulation
por: Sun, Yutao, et al.
Publicado: (2024)
por: Sun, Yutao, et al.
Publicado: (2024)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2025)
por: Zhang, Zilun, et al.
Publicado: (2025)
Keeping Yourself is Important in Downstream Tuning Multimodal Large Language Model
por: Huang, Wenke, et al.
Publicado: (2025)
por: Huang, Wenke, et al.
Publicado: (2025)
Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning
por: Huang, Wenke, et al.
Publicado: (2024)
por: Huang, Wenke, et al.
Publicado: (2024)
ImageRAG: Enhancing Ultra High Resolution Remote Sensing Imagery Analysis with ImageRAG
por: Zhang, Zilun, et al.
Publicado: (2024)
por: Zhang, Zilun, et al.
Publicado: (2024)
Geo-R1: Improving Few-Shot Geospatial Referring Expression Understanding with Reinforcement Fine-Tuning
por: Zhang, Zilun, et al.
Publicado: (2025)
por: Zhang, Zilun, et al.
Publicado: (2025)
GUI Testing Arena: A Unified Benchmark for Advancing Autonomous GUI Testing Agent
por: Zhao, Kangjia, et al.
Publicado: (2024)
por: Zhao, Kangjia, et al.
Publicado: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
por: Sun, Huashan, et al.
Publicado: (2024)
por: Sun, Huashan, et al.
Publicado: (2024)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Standardizing Longitudinal Radiology Report Evaluation via Large Language Model Annotation
por: Wang, Xinyi, et al.
Publicado: (2026)
por: Wang, Xinyi, et al.
Publicado: (2026)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
por: Li, Ruizhe, et al.
Publicado: (2025)
por: Li, Ruizhe, et al.
Publicado: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
por: Zhang, Xiaotian, et al.
Publicado: (2025)
por: Zhang, Xiaotian, et al.
Publicado: (2025)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
por: Cao, Boxi, et al.
Publicado: (2023)
por: Cao, Boxi, et al.
Publicado: (2023)
Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal
por: Huang, Jianheng, et al.
Publicado: (2024)
por: Huang, Jianheng, et al.
Publicado: (2024)
What We Talk About When We Talk About LMs: Implicit Paradigm Shifts and the Ship of Language Models
por: Zhu, Shengqi, et al.
Publicado: (2024)
por: Zhu, Shengqi, et al.
Publicado: (2024)
Offline Learning and Forgetting for Reasoning with Large Language Models
por: Ni, Tianwei, et al.
Publicado: (2025)
por: Ni, Tianwei, et al.
Publicado: (2025)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
por: Ding, Fei, et al.
Publicado: (2025)
por: Ding, Fei, et al.
Publicado: (2025)
Efficient Attention Mechanisms for Large Language Models: A Survey
por: Sun, Yutao, et al.
Publicado: (2025)
por: Sun, Yutao, et al.
Publicado: (2025)
Integration of Large Language Models and Federated Learning
por: Chen, Chaochao, et al.
Publicado: (2023)
por: Chen, Chaochao, et al.
Publicado: (2023)
SciDFM: A Large Language Model with Mixture-of-Experts for Science
por: Sun, Liangtai, et al.
Publicado: (2024)
por: Sun, Liangtai, et al.
Publicado: (2024)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
por: Lyu, Mengxian, et al.
Publicado: (2026)
por: Lyu, Mengxian, et al.
Publicado: (2026)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
por: Zhang, Yuxuan, et al.
Publicado: (2024)
por: Zhang, Yuxuan, et al.
Publicado: (2024)
Maverick: Efficient and Accurate Coreference Resolution Defying Recent Trends
por: Martinelli, Giuliano, et al.
Publicado: (2024)
por: Martinelli, Giuliano, et al.
Publicado: (2024)
Which Pretraining Paradigm Better Serves Spatial Intelligence? An Empirical Comparison of Vision-Language and Video Generation Models
por: Shen, Haozhan, et al.
Publicado: (2026)
por: Shen, Haozhan, et al.
Publicado: (2026)
SEKI: Self-Evolution and Knowledge Inspiration based Neural Architecture Search via Large Language Models
por: Cai, Zicheng, et al.
Publicado: (2025)
por: Cai, Zicheng, et al.
Publicado: (2025)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
por: Zhao, Yukun, et al.
Publicado: (2025)
por: Zhao, Yukun, et al.
Publicado: (2025)
Still "Talking About Large Language Models": Some Clarifications
por: Shanahan, Murray
Publicado: (2024)
por: Shanahan, Murray
Publicado: (2024)
Walk the Talk? Measuring the Faithfulness of Large Language Model Explanations
por: Matton, Katie, et al.
Publicado: (2025)
por: Matton, Katie, et al.
Publicado: (2025)
ZoomEye: Enhancing Multimodal LLMs with Human-Like Zooming Capabilities through Tree-Based Image Exploration
por: Shen, Haozhan, et al.
Publicado: (2024)
por: Shen, Haozhan, et al.
Publicado: (2024)
Anti-adversarial Learning: Desensitizing Prompts for Large Language Models
por: Li, Xuan, et al.
Publicado: (2025)
por: Li, Xuan, et al.
Publicado: (2025)
MoE-CT: A Novel Approach For Large Language Models Training With Resistance To Catastrophic Forgetting
por: Li, Tianhao, et al.
Publicado: (2024)
por: Li, Tianhao, et al.
Publicado: (2024)
Improving Arithmetic Reasoning Ability of Large Language Models through Relation Tuples, Verification and Dynamic Feedback
por: Miao, Zhongtao, et al.
Publicado: (2024)
por: Miao, Zhongtao, et al.
Publicado: (2024)
Knowledge Editing on Black-box Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2024)
por: Song, Xiaoshuai, et al.
Publicado: (2024)
Graceful Forgetting in Generative Language Models
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
Preventing Catastrophic Forgetting: Behavior-Aware Sampling for Safer Language Model Fine-Tuning
por: Pham, Anh, et al.
Publicado: (2025)
por: Pham, Anh, et al.
Publicado: (2025)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
Ejemplares similares
-
The Self-Improvement Paradox: Can Language Models Bootstrap Reasoning Capabilities without External Scaffolding?
por: Sun, Yutao, et al.
Publicado: (2025) -
Preserving Knowledge in Large Language Model with Model-Agnostic Self-Decompression
por: Zhang, Zilun, et al.
Publicado: (2024) -
RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2023) -
HORAE: A Domain-Agnostic Language for Automated Service Regulation
por: Sun, Yutao, et al.
Publicado: (2024) -
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2025)