Whoever Started the Interference Should End It: Guiding Data-Free Model Merging via Task Vectors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Runxi, Xiong, Feng, Wei, Yongxian, Zhu, Wanyun, Yuan, Chun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Task Model Merging via Adaptive Weight Disentanglement
par: Xiong, Feng, et autres
Publié: (2024)
par: Xiong, Feng, et autres
Publié: (2024)
Learn To Learn More Precisely
par: Cheng, Runxi, et autres
Publié: (2024)
par: Cheng, Runxi, et autres
Publié: (2024)
Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
par: Wei, Yongxian, et autres
Publié: (2025)
par: Wei, Yongxian, et autres
Publié: (2025)
Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
par: Wei, Yongxian, et autres
Publié: (2024)
par: Wei, Yongxian, et autres
Publié: (2024)
Task-Distributionally Robust Data-Free Meta-Learning
par: Hu, Zixuan, et autres
Publié: (2023)
par: Hu, Zixuan, et autres
Publié: (2023)
End-to-End Reaction Field Energy Modeling via Deep Learning based Voxel-to-voxel Transform
par: Wu, Yongxian, et autres
Publié: (2024)
par: Wu, Yongxian, et autres
Publié: (2024)
Task Singular Vectors: Reducing Task Interference in Model Merging
par: Gargiulo, Antonio Andrea, et autres
Publié: (2024)
par: Gargiulo, Antonio Andrea, et autres
Publié: (2024)
FREE: Faster and Better Data-Free Meta-Learning
par: Wei, Yongxian, et autres
Publié: (2024)
par: Wei, Yongxian, et autres
Publié: (2024)
Task Vector Quantization for Memory-Efficient Model Merging
par: Kim, Youngeun, et autres
Publié: (2025)
par: Kim, Youngeun, et autres
Publié: (2025)
Sparse Model Inversion: Efficient Inversion of Vision Transformers for Data-Free Applications
par: Hu, Zixuan, et autres
Publié: (2025)
par: Hu, Zixuan, et autres
Publié: (2025)
Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
par: Hu, Zixuan, et autres
Publié: (2024)
par: Hu, Zixuan, et autres
Publié: (2024)
DisTaC: Conditioning Task Vectors via Distillation for Robust Model Merging
par: Yoshida, Kotaro, et autres
Publié: (2025)
par: Yoshida, Kotaro, et autres
Publié: (2025)
Model Merging via Data-Free Covariance Estimation
par: Hameed, Marawan Gamal Abdel, et autres
Publié: (2026)
par: Hameed, Marawan Gamal Abdel, et autres
Publié: (2026)
Chorus: Harmonizing Context and Sensing Signals for Data-Free Model Customization in IoT
par: Zhang, Liyu, et autres
Publié: (2025)
par: Zhang, Liyu, et autres
Publié: (2025)
Tensorized Clustered LoRA Merging for Multi-Task Interference
par: Su, Zhan, et autres
Publié: (2025)
par: Su, Zhan, et autres
Publié: (2025)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
par: Wei, Yongxian, et autres
Publié: (2025)
par: Wei, Yongxian, et autres
Publié: (2025)
MaD-Mix: Multi-Modal Data Mixtures via Latent Space Coupling for Vision-Language Model Training
par: Xie, Wanyun, et autres
Publié: (2026)
par: Xie, Wanyun, et autres
Publié: (2026)
Auto-FlexSwitch: Efficient Dynamic Model Merging via Learnable Task Vector Compression
par: Gao, Junqi, et autres
Publié: (2026)
par: Gao, Junqi, et autres
Publié: (2026)
Retraining-Free Merging of Sparse MoE via Hierarchical Clustering
par: Chen, I-Chun, et autres
Publié: (2024)
par: Chen, I-Chun, et autres
Publié: (2024)
Janus-Q: End-to-End Event-Driven Trading via Hierarchical-Gated Reward Modeling
par: Li, Xiang, et autres
Publié: (2026)
par: Li, Xiang, et autres
Publié: (2026)
HS-STaR: Hierarchical Sampling for Self-Taught Reasoners via Difficulty Estimation and Budget Reallocation
par: Xiong, Feng, et autres
Publié: (2025)
par: Xiong, Feng, et autres
Publié: (2025)
SyMerge: From Non-Interference to Synergistic Merging via Single-Layer Adaptation
par: Jung, Aecheon, et autres
Publié: (2024)
par: Jung, Aecheon, et autres
Publié: (2024)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
par: Hu, Zixuan, et autres
Publié: (2025)
par: Hu, Zixuan, et autres
Publié: (2025)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
par: Xie, Wanyun, et autres
Publié: (2025)
par: Xie, Wanyun, et autres
Publié: (2025)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
par: Xie, Guofu, et autres
Publié: (2025)
par: Xie, Guofu, et autres
Publié: (2025)
Guided Model Merging for Hybrid Data Learning: Leveraging Centralized Data to Refine Decentralized Models
par: Zhu, Junyi, et autres
Publié: (2025)
par: Zhu, Junyi, et autres
Publié: (2025)
Mitigating Parameter Interference in Model Merging via Sharpness-Aware Fine-Tuning
par: Lee, Yeoreum, et autres
Publié: (2025)
par: Lee, Yeoreum, et autres
Publié: (2025)
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
par: Yang, Jinluan, et autres
Publié: (2024)
par: Yang, Jinluan, et autres
Publié: (2024)
Stable Nonconvex-Nonconcave Training via Linear Interpolation
par: Pethick, Thomas, et autres
Publié: (2023)
par: Pethick, Thomas, et autres
Publié: (2023)
Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging
par: Wang, Zhixiang, et autres
Publié: (2025)
par: Wang, Zhixiang, et autres
Publié: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
par: Zhou, Wenjie, et autres
Publié: (2026)
par: Zhou, Wenjie, et autres
Publié: (2026)
Mix Data or Merge Models? Optimizing for Diverse Multi-Task Learning
par: Aakanksha, et autres
Publié: (2024)
par: Aakanksha, et autres
Publié: (2024)
From Task-Specific Models to Unified Systems: A Review of Model Merging Approaches
par: Ruan, Wei, et autres
Publié: (2025)
par: Ruan, Wei, et autres
Publié: (2025)
Towards Minimizing Feature Drift in Model Merging: Layer-wise Task Vector Fusion for Adaptive Knowledge Integration
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
Bilinear Coordinate Alignment for Training-Free Task-Vector Transfer
par: Son, Jungyong, et autres
Publié: (2026)
par: Son, Jungyong, et autres
Publié: (2026)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
par: Zhang, Dengming, et autres
Publié: (2025)
par: Zhang, Dengming, et autres
Publié: (2025)
FedMerge: Federated Personalization via Model Merging
par: Chen, Shutong, et autres
Publié: (2025)
par: Chen, Shutong, et autres
Publié: (2025)
Computational Budget Should Be Considered in Data Selection
par: Wan, Weilin, et autres
Publié: (2025)
par: Wan, Weilin, et autres
Publié: (2025)
Conditional Rectified Flow-based End-to-End Rapid Seismic Inversion Method
par: Xu, Haofei, et autres
Publié: (2026)
par: Xu, Haofei, et autres
Publié: (2026)
Data-Free Layer-Adaptive Merging via Fisher Information for Long-to-Short Reasoning LLMs
par: Xia, Tian
Publié: (2026)
par: Xia, Tian
Publié: (2026)
Documents similaires
-
Multi-Task Model Merging via Adaptive Weight Disentanglement
par: Xiong, Feng, et autres
Publié: (2024) -
Learn To Learn More Precisely
par: Cheng, Runxi, et autres
Publié: (2024) -
Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
par: Wei, Yongxian, et autres
Publié: (2025) -
Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
par: Wei, Yongxian, et autres
Publié: (2024) -
Task-Distributionally Robust Data-Free Meta-Learning
par: Hu, Zixuan, et autres
Publié: (2023)