Towards Minimizing Feature Drift in Model Merging: Layer-wise Task Vector Fusion for Adaptive Knowledge Integration
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Wenju, Li, Qingyong, Wang, Wen, Liu, Yang, Geng, Yangli-ao, Li, Boyang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Task Arithmetic in Trust Region: A Training-Free Model Merging Approach to Navigate Knowledge Conflicts
by: Sun, Wenju, et al.
Published: (2025)
by: Sun, Wenju, et al.
Published: (2025)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
by: Sun, Wenju, et al.
Published: (2025)
by: Sun, Wenju, et al.
Published: (2025)
Towards Plastic and Stable Exemplar-Free Incremental Learning: A Dual-Learner Framework with Cumulative Parameter Averaging
by: Sun, Wenju, et al.
Published: (2023)
by: Sun, Wenju, et al.
Published: (2023)
Exemplar-free Class Incremental Learning via Discriminative and Comparable One-class Classifiers
by: Sun, Wenju, et al.
Published: (2022)
by: Sun, Wenju, et al.
Published: (2022)
Extending Precipitation Nowcasting Horizons via Spectral Fusion of Radar Observations and Foundation Model Priors
by: Qin, Yuze, et al.
Published: (2026)
by: Qin, Yuze, et al.
Published: (2026)
AdaLTM: Adaptive Layer-wise Task Vector Merging for Categorical Speech Emotion Recognition with ASR Knowledge Integration
by: Lee, Chia-Yu, et al.
Published: (2026)
by: Lee, Chia-Yu, et al.
Published: (2026)
Scalable Model Merging with Progressive Layer-wise Distillation
by: Xu, Jing, et al.
Published: (2025)
by: Xu, Jing, et al.
Published: (2025)
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
by: Alcover-Couso, Roberto, et al.
Published: (2024)
by: Alcover-Couso, Roberto, et al.
Published: (2024)
Purifying Task Vectors in Knowledge-Aware Subspace for Model Merging
by: An, Bang, et al.
Published: (2025)
by: An, Bang, et al.
Published: (2025)
Rethinking Layer-wise Model Merging through Chain of Merges
by: Buzzega, Pietro, et al.
Published: (2025)
by: Buzzega, Pietro, et al.
Published: (2025)
LGB: Language Model and Graph Neural Network-Driven Social Bot Detection
by: Zhou, Ming, et al.
Published: (2024)
by: Zhou, Ming, et al.
Published: (2024)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
by: Yang, Enneng, et al.
Published: (2023)
by: Yang, Enneng, et al.
Published: (2023)
LARV: Data-Free Layer-wise Adaptive Rescaling Veneer for Model Merging
by: Wang, Xinyu, et al.
Published: (2026)
by: Wang, Xinyu, et al.
Published: (2026)
Enhancing Out-of-Distribution Detection with Multitesting-based Layer-wise Feature Fusion
by: Li, Jiawei, et al.
Published: (2024)
by: Li, Jiawei, et al.
Published: (2024)
AdaTrans: Feature-wise and Sample-wise Adaptive Transfer Learning for High-dimensional Regression
by: He, Zelin, et al.
Published: (2024)
by: He, Zelin, et al.
Published: (2024)
EMS: Adaptive Evict-then-Merge Strategy for Head-wise KV Cache Compression Based on Global-Local Importance
by: Li, Yingxin, et al.
Published: (2024)
by: Li, Yingxin, et al.
Published: (2024)
Superpose Task-specific Features for Model Merging
by: Qiu, Haiquan, et al.
Published: (2025)
by: Qiu, Haiquan, et al.
Published: (2025)
Harmonizing Diverse Models: A Layer-wise Merging Strategy for Consistent Generation
by: Peng, Xujun, et al.
Published: (2025)
by: Peng, Xujun, et al.
Published: (2025)
SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration
by: Wen, Zhuofan, et al.
Published: (2026)
by: Wen, Zhuofan, et al.
Published: (2026)
Task Singular Vectors: Reducing Task Interference in Model Merging
by: Gargiulo, Antonio Andrea, et al.
Published: (2024)
by: Gargiulo, Antonio Andrea, et al.
Published: (2024)
Task Vector Quantization for Memory-Efficient Model Merging
by: Kim, Youngeun, et al.
Published: (2025)
by: Kim, Youngeun, et al.
Published: (2025)
DLink: Distilling Layer-wise and Dominant Knowledge from EEG Foundation Models
by: Wang, Jingyuan, et al.
Published: (2026)
by: Wang, Jingyuan, et al.
Published: (2026)
LayerPeeler: Autoregressive Peeling for Layer-wise Image Vectorization
by: Wu, Ronghuan, et al.
Published: (2025)
by: Wu, Ronghuan, et al.
Published: (2025)
PM-MOE: Mixture of Experts on Private Model Parameters for Personalized Federated Learning
by: Feng, Yu, et al.
Published: (2025)
by: Feng, Yu, et al.
Published: (2025)
MergeNet: Knowledge Migration across Heterogeneous Models, Tasks, and Modalities
by: Li, Kunxi, et al.
Published: (2024)
by: Li, Kunxi, et al.
Published: (2024)
Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
by: Wei, Yongxian, et al.
Published: (2025)
by: Wei, Yongxian, et al.
Published: (2025)
Dataless Knowledge Fusion by Merging Weights of Language Models
by: Jin, Xisen, et al.
Published: (2022)
by: Jin, Xisen, et al.
Published: (2022)
Tuning Layer Orbital Hall Effect via Spin Rotation in Ferromagnetic Transition Metal Dichalcogenides
by: Ji, Shilei, et al.
Published: (2025)
by: Ji, Shilei, et al.
Published: (2025)
Merging without Forgetting: Continual Fusion of Task-Specific Models via Optimal Transport
by: Pan, Zecheng, et al.
Published: (2025)
by: Pan, Zecheng, et al.
Published: (2025)
Layer-wise Regularized Dropout for Neural Language Models
by: Ni, Shiwen, et al.
Published: (2024)
by: Ni, Shiwen, et al.
Published: (2024)
Segmentation-guided Layer-wise Image Vectorization with Gradient Fills
by: Zhou, Hengyu, et al.
Published: (2024)
by: Zhou, Hengyu, et al.
Published: (2024)
Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs
by: Chen, Jack, et al.
Published: (2025)
by: Chen, Jack, et al.
Published: (2025)
Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling
by: Wang, Fei, et al.
Published: (2026)
by: Wang, Fei, et al.
Published: (2026)
Channel-wise Vector Quantization
by: Song, Wei, et al.
Published: (2026)
by: Song, Wei, et al.
Published: (2026)
FedLWS: Federated Learning with Adaptive Layer-wise Weight Shrinking
by: Shi, Changlong, et al.
Published: (2025)
by: Shi, Changlong, et al.
Published: (2025)
Magnetic Anisotropy of Cr2Te3: Competition between Surface and Middle Layers
by: Yile Wang, et al.
Published: (2024)
by: Yile Wang, et al.
Published: (2024)
Source‐Free Domain Adaptive Fundus Image Segmentation With Multiscale Feature Fusion and Stepwise Attention Integration
by: Mingtao Liu, et al.
Published: (2026)
by: Mingtao Liu, et al.
Published: (2026)
Model Merging in the Essential Subspace
by: Li, Longhua, et al.
Published: (2026)
by: Li, Longhua, et al.
Published: (2026)
VecAttention: Vector-wise Sparse Attention for Accelerating Long Context Inference
by: Liu, Anmin, et al.
Published: (2026)
by: Liu, Anmin, et al.
Published: (2026)
Integrating Intermediate Layer Optimization and Projected Gradient Descent for Solving Inverse Problems with Diffusion Models
by: Zheng, Yang, et al.
Published: (2025)
by: Zheng, Yang, et al.
Published: (2025)
Similar Items
-
Task Arithmetic in Trust Region: A Training-Free Model Merging Approach to Navigate Knowledge Conflicts
by: Sun, Wenju, et al.
Published: (2025) -
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
by: Sun, Wenju, et al.
Published: (2025) -
Towards Plastic and Stable Exemplar-Free Incremental Learning: A Dual-Learner Framework with Cumulative Parameter Averaging
by: Sun, Wenju, et al.
Published: (2023) -
Exemplar-free Class Incremental Learning via Discriminative and Comparable One-class Classifiers
by: Sun, Wenju, et al.
Published: (2022) -
Extending Precipitation Nowcasting Horizons via Spectral Fusion of Radar Observations and Foundation Model Priors
by: Qin, Yuze, et al.
Published: (2026)