Enregistré dans:
| Auteurs principaux: | Qu, Xingyu, Horvath, Samuel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.05966 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Superpose Task-specific Features for Model Merging
par: Qiu, Haiquan, et autres
Publié: (2025)
par: Qiu, Haiquan, et autres
Publié: (2025)
FeatCal: Feature Calibration for Post-Merging Models
par: Gu, Yanggan, et autres
Publié: (2026)
par: Gu, Yanggan, et autres
Publié: (2026)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
MIN-Merging: Merge the Important Neurons for Model Merging
par: Liang, Yunfei
Publié: (2025)
par: Liang, Yunfei
Publié: (2025)
Can Muon Fine-tune Adam-Pretrained Models?
par: Qu, Xingyu, et autres
Publié: (2026)
par: Qu, Xingyu, et autres
Publié: (2026)
On Vanishing Variance in Transformer Length Generalization
par: Li, Ruining, et autres
Publié: (2025)
par: Li, Ruining, et autres
Publié: (2025)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
par: Zhang, Kehao, et autres
Publié: (2025)
par: Zhang, Kehao, et autres
Publié: (2025)
Bayesian Model Merging
par: Li, Kaiyang, et autres
Publié: (2026)
par: Li, Kaiyang, et autres
Publié: (2026)
Vanishing Contributions: A Unified Framework for Smooth and Iterative Model Compression
par: Nikiforos, Lorenzo, et autres
Publié: (2025)
par: Nikiforos, Lorenzo, et autres
Publié: (2025)
Vanishing Gradients in Reinforcement Finetuning of Language Models
par: Razin, Noam, et autres
Publié: (2023)
par: Razin, Noam, et autres
Publié: (2023)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
par: Zhang, Bingjie, et autres
Publié: (2025)
par: Zhang, Bingjie, et autres
Publié: (2025)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
par: Chaichana, Yuatyong, et autres
Publié: (2025)
par: Chaichana, Yuatyong, et autres
Publié: (2025)
Model Merging: Foundations and Algorithms
par: Crisostomi, Donato
Publié: (2026)
par: Crisostomi, Donato
Publié: (2026)
Model Merging in the Essential Subspace
par: Li, Longhua, et autres
Publié: (2026)
par: Li, Longhua, et autres
Publié: (2026)
Redefining Contributions: Shapley-Driven Federated Learning
par: Tastan, Nurbek, et autres
Publié: (2024)
par: Tastan, Nurbek, et autres
Publié: (2024)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
CALM: Consensus-Aware Localized Merging for Multi-Task Learning
par: Yan, Kunda, et autres
Publié: (2025)
par: Yan, Kunda, et autres
Publié: (2025)
Beyond Interpretability: The Gains of Feature Monosemanticity on Model Robustness
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
Towards Minimizing Feature Drift in Model Merging: Layer-wise Task Vector Fusion for Adaptive Knowledge Integration
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
Markov Chain Decoders Overcome the Heavy-Tail Limitations of Lipschitz Generative Models
par: Ziani, Abdelhakim, et autres
Publié: (2026)
par: Ziani, Abdelhakim, et autres
Publié: (2026)
These Are Not All the Features You Are Looking For: A Fundamental Bottleneck in Supervised Pretraining
par: Yang, Xingyu Alice, et autres
Publié: (2025)
par: Yang, Xingyu Alice, et autres
Publié: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
par: Wang, Jiapeng, et autres
Publié: (2026)
par: Wang, Jiapeng, et autres
Publié: (2026)
BD-Merging: Bias-Aware Dynamic Model Merging with Evidence-Guided Contrastive Learning
par: Xie, Yuhan, et autres
Publié: (2026)
par: Xie, Yuhan, et autres
Publié: (2026)
Training-free Heterogeneous Model Merging
par: Xu, Zhengqi, et autres
Publié: (2024)
par: Xu, Zhengqi, et autres
Publié: (2024)
Revisiting Weight Averaging for Model Merging
par: Choi, Jiho, et autres
Publié: (2024)
par: Choi, Jiho, et autres
Publié: (2024)
Multi-Level Collaboration in Model Merging
par: Li, Qi, et autres
Publié: (2025)
par: Li, Qi, et autres
Publié: (2025)
Sparsity-Aware Evolution for Model Merging
par: Zhang, Huan, et autres
Publié: (2026)
par: Zhang, Huan, et autres
Publié: (2026)
Fine, I'll Merge It Myself: A Multi-Fidelity Framework for Automated Model Merging
par: Su, Guinan, et autres
Publié: (2025)
par: Su, Guinan, et autres
Publié: (2025)
Fair Streaming Feature Selection
par: Duan, Zhangling, et autres
Publié: (2024)
par: Duan, Zhangling, et autres
Publié: (2024)
Diagnosing Transformers: Illuminating Feature Spaces for Clinical Decision-Making
par: Hsu, Aliyah R., et autres
Publié: (2023)
par: Hsu, Aliyah R., et autres
Publié: (2023)
Merge to Mix: Mixing Datasets via Model Merging
par: Tao, Zhixu Silvia, et autres
Publié: (2025)
par: Tao, Zhixu Silvia, et autres
Publié: (2025)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
par: Cai, Hongyi, et autres
Publié: (2025)
par: Cai, Hongyi, et autres
Publié: (2025)
Non-Uniform Parameter-Wise Model Merging
par: Camacho, Albert Manuel Orozco, et autres
Publié: (2024)
par: Camacho, Albert Manuel Orozco, et autres
Publié: (2024)
NegMerge: Sign-Consensual Weight Merging for Machine Unlearning
par: Kim, Hyo Seo, et autres
Publié: (2024)
par: Kim, Hyo Seo, et autres
Publié: (2024)
Vanishing Bias Heuristic-guided Reinforcement Learning Algorithm
par: Li, Qinru, et autres
Publié: (2023)
par: Li, Qinru, et autres
Publié: (2023)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
par: Li, Siyuan, et autres
Publié: (2025)
par: Li, Siyuan, et autres
Publié: (2025)
SimMerge: Learning to Select Merge Operators from Similarity Signals
par: Bolton, Oliver, et autres
Publié: (2026)
par: Bolton, Oliver, et autres
Publié: (2026)
ES-Merging: Biological MLLM Merging via Embedding Space Signals
par: Lee, Wonbin, et autres
Publié: (2026)
par: Lee, Wonbin, et autres
Publié: (2026)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
par: Goddard, Charles, et autres
Publié: (2024)
par: Goddard, Charles, et autres
Publié: (2024)
Documents similaires
-
Superpose Task-specific Features for Model Merging
par: Qiu, Haiquan, et autres
Publié: (2025) -
FeatCal: Feature Calibration for Post-Merging Models
par: Gu, Yanggan, et autres
Publié: (2026) -
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
par: Lu, Zhenyi, et autres
Publié: (2024) -
MIN-Merging: Merge the Important Neurons for Model Merging
par: Liang, Yunfei
Publié: (2025) -
Can Muon Fine-tune Adam-Pretrained Models?
par: Qu, Xingyu, et autres
Publié: (2026)