RECALL: REpresentation-aligned Catastrophic-forgetting ALLeviation via Hierarchical Model Merging
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Bowen, Wan, Haiyuan, Shi, Liwen, Yang, Chen, He, Peng, Ma, Yue, Han, Haochen, Li, Wenhao, Tan, Tiao, Li, Yongjian, Liu, Fangming, Gong, Yifan, Zhang, Sheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CORE: Compact Object-centric REpresentations as a New Paradigm for Token Merging in LVLMs
por: Lei, Jingyu, et al.
Publicado: (2025)
por: Lei, Jingyu, et al.
Publicado: (2025)
SPHERE: Semantic-PHysical Engaged REpresentation for 3D Semantic Scene Completion
por: Yang, Zhiwen, et al.
Publicado: (2025)
por: Yang, Zhiwen, et al.
Publicado: (2025)
THE INFLUENCE OF PRODUCT RECALL ON CONSUMER LOYALTY
por: Mariana Hammel Brandão
Publicado: (2016)
por: Mariana Hammel Brandão
Publicado: (2016)
Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
Deadline-Driven Hierarchical Agentic Resource Sharing for AI Services and RAN Functions in AI-RAN
por: Li, Haiyuan, et al.
Publicado: (2026)
por: Li, Haiyuan, et al.
Publicado: (2026)
How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization
por: Song, Shezheng, et al.
Publicado: (2025)
por: Song, Shezheng, et al.
Publicado: (2025)
RECALL: Rehearsal-free Continual Learning for Object Classification
por: Knauer, Markus, et al.
Publicado: (2022)
por: Knauer, Markus, et al.
Publicado: (2022)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
por: Lyu, Mengxian, et al.
Publicado: (2026)
por: Lyu, Mengxian, et al.
Publicado: (2026)
PHANTOM RECALL: When Familiar Puzzles Fool Smart Models
por: Mukhopadhyay, Souradeep, et al.
Publicado: (2025)
por: Mukhopadhyay, Souradeep, et al.
Publicado: (2025)
An Unconditionally Linearly Convergent ADMM Approach for the Allen-Cahn Equation with Flory-Huggins Potential
por: Jiang, Peng, et al.
Publicado: (2026)
por: Jiang, Peng, et al.
Publicado: (2026)
Enhancing Image Generation Fidelity via Progressive Prompts
por: Xiong, Zhen, et al.
Publicado: (2025)
por: Xiong, Zhen, et al.
Publicado: (2025)
Mitigating Catastrophic Forgetting in Language Transfer via Model Merging
por: Alexandrov, Anton, et al.
Publicado: (2024)
por: Alexandrov, Anton, et al.
Publicado: (2024)
A Universal Strategy for Reversible and Spatiotemporal Electrofluorochromism of Eu 3+ Metallogels Driven by Cooperative Chemical Reactions with Biomimetic Information “Memorizing‐forgetting” Behavior
por: Bowen Shi, et al.
Publicado: (2025)
por: Bowen Shi, et al.
Publicado: (2025)
TextEditBench: Evaluating Reasoning-aware Text Editing Beyond Rendering
por: Gui, Rui, et al.
Publicado: (2025)
por: Gui, Rui, et al.
Publicado: (2025)
RECALL+: Adversarial Web-based Replay for Continual Learning in Semantic Segmentation
por: Liu, Chang, et al.
Publicado: (2023)
por: Liu, Chang, et al.
Publicado: (2023)
Abductive forgetting
por: Liberatore, Paolo
Publicado: (2022)
por: Liberatore, Paolo
Publicado: (2022)
Ink and forgetting
por: Aaron Hames
Publicado: (2024)
por: Aaron Hames
Publicado: (2024)
Order-preserving pattern mining with forgetting mechanism
por: Li, Yan, et al.
Publicado: (2024)
por: Li, Yan, et al.
Publicado: (2024)
Unlearning the Noisy Correspondence Makes CLIP More Robust
por: Han, Haochen, et al.
Publicado: (2025)
por: Han, Haochen, et al.
Publicado: (2025)
Negation-Aware Test-Time Adaptation for Vision-Language Models
por: Han, Haochen, et al.
Publicado: (2025)
por: Han, Haochen, et al.
Publicado: (2025)
When Shared Knowledge Hurts: Spectral Over-Accumulation in Model Merging
por: Li, Yayuan, et al.
Publicado: (2026)
por: Li, Yayuan, et al.
Publicado: (2026)
Less is More: Efficient Model Merging with Binary Task Switch
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
Flow of Knowledge: Federated Fine-Tuning of LLMs in Healthcare under Non-IID Conditions
por: Chen, Zeyu, et al.
Publicado: (2025)
por: Chen, Zeyu, et al.
Publicado: (2025)
Human-aligned Safe Reinforcement Learning for Highway On-Ramp Merging in Dense Traffic
por: Li, Yang, et al.
Publicado: (2025)
por: Li, Yang, et al.
Publicado: (2025)
RECALL: Library-Like Behavior In Language Models is Enhanced by Self-Referencing Causal Cycles
por: Nwadike, Munachiso, et al.
Publicado: (2025)
por: Nwadike, Munachiso, et al.
Publicado: (2025)
Business. Fire and forget?
Publicado: (1996)
Publicado: (1996)
Mitigating Catastrophic Forgetting in Multi-domain Chinese Spelling Correction by Multi-stage Knowledge Transfer Framework
por: Xing, Peng, et al.
Publicado: (2024)
por: Xing, Peng, et al.
Publicado: (2024)
Domain adapted machine translation: What does catastrophic forgetting forget and why?
por: Saunders, Danielle, et al.
Publicado: (2024)
por: Saunders, Danielle, et al.
Publicado: (2024)
Adapting Network Information into Semantics for Generalizable and Plug-and-Play Multi-Scenario Network Diagnosis
por: Tan, Tiao, et al.
Publicado: (2025)
por: Tan, Tiao, et al.
Publicado: (2025)
Locate-then-Merge: Neuron-Level Parameter Fusion for Mitigating Catastrophic Forgetting in Multimodal LLMs
por: Yu, Zeping, et al.
Publicado: (2025)
por: Yu, Zeping, et al.
Publicado: (2025)
Spin alignment of vector mesons in heavy-ion collision
por: Sheng, Xin-Li, et al.
Publicado: (2025)
por: Sheng, Xin-Li, et al.
Publicado: (2025)
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models
por: Zhou, Yu, et al.
Publicado: (2024)
por: Zhou, Yu, et al.
Publicado: (2024)
Correction to: Don't forget the blogosphere
Publicado: (2024)
Publicado: (2024)
Science and technology. The cost of forgetting
Publicado: (1997)
Publicado: (1997)
Rectifying Distribution Shift in Cascaded Precipitation Nowcasting
por: Ju, Fanbo, et al.
Publicado: (2025)
por: Ju, Fanbo, et al.
Publicado: (2025)
Distributed simulation for solar radiation of all‐weather in Fujian Province based on SUNFLUX
por: Lihui Yang, et al.
Publicado: (2026)
por: Lihui Yang, et al.
Publicado: (2026)
EMR-Merging: Tuning-Free High-Performance Model Merging
por: Huang, Chenyu, et al.
Publicado: (2024)
por: Huang, Chenyu, et al.
Publicado: (2024)
DSA-Tokenizer: Disentangled Semantic-Acoustic Tokenization via Flow Matching-based Hierarchical Fusion
por: Zhang, Hanlin, et al.
Publicado: (2026)
por: Zhang, Hanlin, et al.
Publicado: (2026)
Multi-Modality Expansion and Retention for LLMs through Parameter Merging and Decoupling
por: Li, Junlin, et al.
Publicado: (2025)
por: Li, Junlin, et al.
Publicado: (2025)
A Brief Overview: On-Policy Self-Distillation In Large Language Models
por: Cui, Fangming, et al.
Publicado: (2026)
por: Cui, Fangming, et al.
Publicado: (2026)
Ejemplares similares
-
CORE: Compact Object-centric REpresentations as a New Paradigm for Token Merging in LVLMs
por: Lei, Jingyu, et al.
Publicado: (2025) -
SPHERE: Semantic-PHysical Engaged REpresentation for 3D Semantic Scene Completion
por: Yang, Zhiwen, et al.
Publicado: (2025) -
THE INFLUENCE OF PRODUCT RECALL ON CONSUMER LOYALTY
por: Mariana Hammel Brandão
Publicado: (2016) -
Spotlight Attention: Towards Efficient LLM Generation via Non-linear Hashing-based KV Cache Retrieval
por: Li, Wenhao, et al.
Publicado: (2025) -
Deadline-Driven Hierarchical Agentic Resource Sharing for AI Services and RAN Functions in AI-RAN
por: Li, Haiyuan, et al.
Publicado: (2026)