AIMMerging: Adaptive Iterative Model Merging Using Training Trajectories for Language Model Continual Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Feng, Yujie, Li, Jian, Dong, Xiaoyu, Xu, Pengfei, Zhou, Xiaohui, Zhang, Yujia, LU, Zexin, Wang, Yasha, Zhao, Alan, Chu, Xu, Wu, Xiao-Ming |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2025)
by: Feng, Yujie, et al.
Published: (2025)
Micro-Macro Retrieval: Reducing Long-Form Hallucination in Large Language Models
by: Feng, Yujie, et al.
Published: (2026)
by: Feng, Yujie, et al.
Published: (2026)
KIF: Knowledge Identification and Fusion for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2024)
by: Feng, Yujie, et al.
Published: (2024)
GeoEdit: Geometric Knowledge Editing for Large Language Models
by: Feng, Yujie, et al.
Published: (2025)
by: Feng, Yujie, et al.
Published: (2025)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2026)
by: Feng, Yujie, et al.
Published: (2026)
Continual Dialogue State Tracking via Reason-of-Select Distillation
by: Feng, Yujie, et al.
Published: (2024)
by: Feng, Yujie, et al.
Published: (2024)
SMART: Towards Pre-trained Missing-Aware Model for Patient Health Status Prediction
by: Yu, Zhihao, et al.
Published: (2024)
by: Yu, Zhihao, et al.
Published: (2024)
TPMM-DPO: Trajectory-aware Preference-guided Model Merging for Iterative Direct Preference Optimization
by: Fu, Lingling, et al.
Published: (2026)
by: Fu, Lingling, et al.
Published: (2026)
IntelliCare: Improving Healthcare Analysis with Variance-Controlled Patient-Level Knowledge from Large Language Models
by: Yu, Zhihao, et al.
Published: (2024)
by: Yu, Zhihao, et al.
Published: (2024)
TPO: Aligning Large Language Models with Multi-branch & Multi-step Preference Trees
by: Liao, Weibin, et al.
Published: (2024)
by: Liao, Weibin, et al.
Published: (2024)
TaSL: Continual Dialog State Tracking via Task Skill Localization and Consolidation
by: Feng, Yujie, et al.
Published: (2024)
by: Feng, Yujie, et al.
Published: (2024)
Parenting: Optimizing Knowledge Selection of Retrieval-Augmented Language Models with Parameter Decoupling and Tailored Tuning
by: Xu, Yongxin, et al.
Published: (2024)
by: Xu, Yongxin, et al.
Published: (2024)
Understanding Layer Significance in LLM Alignment
by: Shi, Guangyuan, et al.
Published: (2024)
by: Shi, Guangyuan, et al.
Published: (2024)
Ambiguity Awareness Optimization: Towards Semantic Disambiguation for Direct Preference Optimization
by: Li, Jian, et al.
Published: (2025)
by: Li, Jian, et al.
Published: (2025)
DIMAT: Decentralized Iterative Merging-And-Training for Deep Learning Models
by: Saadati, Nastaran, et al.
Published: (2024)
by: Saadati, Nastaran, et al.
Published: (2024)
ADEPT: Continual Pretraining via Adaptive Expansion and Dynamic Decoupled Tuning
by: Zhang, Jinyang, et al.
Published: (2025)
by: Zhang, Jinyang, et al.
Published: (2025)
Training-free Heterogeneous Model Merging
by: Xu, Zhengqi, et al.
Published: (2024)
by: Xu, Zhengqi, et al.
Published: (2024)
Training-Free Pretrained Model Merging
by: Xu, Zhengqi, et al.
Published: (2024)
by: Xu, Zhengqi, et al.
Published: (2024)
Multi-Task Model Merging via Adaptive Weight Disentanglement
by: Xiong, Feng, et al.
Published: (2024)
by: Xiong, Feng, et al.
Published: (2024)
ACE-Merging: Data-Free Model Merging with Adaptive Covariance Estimation
by: Xu, Bo, et al.
Published: (2026)
by: Xu, Bo, et al.
Published: (2026)
KnowPO: Knowledge-aware Preference Optimization for Controllable Knowledge Selection in Retrieval-Augmented Language Models
by: Zhang, Ruizhe, et al.
Published: (2024)
by: Zhang, Ruizhe, et al.
Published: (2024)
Dual Prototypes for Adaptive Pre-Trained Model in Class-Incremental Learning
by: Xu, Zhiming, et al.
Published: (2024)
by: Xu, Zhiming, et al.
Published: (2024)
LoRA Dropout as a Sparsity Regularizer for Overfitting Control
by: Lin, Yang, et al.
Published: (2024)
by: Lin, Yang, et al.
Published: (2024)
Layer-Aware Video Composition via Split-then-Merge
by: Kara, Ozgur, et al.
Published: (2025)
by: Kara, Ozgur, et al.
Published: (2025)
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
by: Zeng, Xingshan, et al.
Published: (2025)
by: Zeng, Xingshan, et al.
Published: (2025)
Abnormal Developmental Trajectories in the Brain in Individuals With Reading Disability
by: Xiaohui Yan, et al.
Published: (2025)
by: Xiaohui Yan, et al.
Published: (2025)
How Good Are LLMs at Out-of-Distribution Detection?
by: Liu, Bo, et al.
Published: (2023)
by: Liu, Bo, et al.
Published: (2023)
MAny: Merge Anything for Multimodal Continual Instruction Tuning
by: Gao, Zijian, et al.
Published: (2026)
by: Gao, Zijian, et al.
Published: (2026)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
by: Yuan, Zenghui, et al.
Published: (2025)
by: Yuan, Zenghui, et al.
Published: (2025)
Towards Adaptive Continual Model Merging via Manifold-Aware Expert Evolution
by: Qiu, Haiyun, et al.
Published: (2026)
by: Qiu, Haiyun, et al.
Published: (2026)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
by: Xie, Guofu, et al.
Published: (2025)
by: Xie, Guofu, et al.
Published: (2025)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
by: Yang, Enneng, et al.
Published: (2023)
by: Yang, Enneng, et al.
Published: (2023)
Enhancing Topic Interpretability for Neural Topic Modeling through Topic-wise Contrastive Learning
by: Gao, Xin, et al.
Published: (2024)
by: Gao, Xin, et al.
Published: (2024)
Auxiliary Model Hierarchical Iterative Parameter Estimation for Autoregressive Output‐Error Models
by: Feng Ding, et al.
Published: (2026)
by: Feng Ding, et al.
Published: (2026)
SeMe: Training-Free Language Model Merging via Semantic Alignment
by: Gu, Jian, et al.
Published: (2025)
by: Gu, Jian, et al.
Published: (2025)
现代汉语隐性方言俗字词研究:以"挡""档"两字的相关字词为例——兼论汽车变速"排挡"一词成立的语料依据
by: LU, Weihua
Published: (2026)
by: LU, Weihua
Published: (2026)
The Spillover Effect of Liquidity Transparency on Liquidity Holdings
by: YAO LU
Published: (2025)
by: YAO LU
Published: (2025)
Imputation with Inter-Series Information from Prototypes for Irregular Sampled Time Series
by: Yu, Zhihao, et al.
Published: (2024)
by: Yu, Zhihao, et al.
Published: (2024)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
by: Li, Jian, et al.
Published: (2024)
by: Li, Jian, et al.
Published: (2024)
Toward Theoretical Insights into Diffusion Trajectory Distillation via Operator Merging
by: Gao, Weiguo, et al.
Published: (2025)
by: Gao, Weiguo, et al.
Published: (2025)
Similar Items
-
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2025) -
Micro-Macro Retrieval: Reducing Long-Form Hallucination in Large Language Models
by: Feng, Yujie, et al.
Published: (2026) -
KIF: Knowledge Identification and Fusion for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2024) -
GeoEdit: Geometric Knowledge Editing for Large Language Models
by: Feng, Yujie, et al.
Published: (2025) -
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
by: Feng, Yujie, et al.
Published: (2026)