SimMerge: Learning to Select Merge Operators from Similarity Signals
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Bolton, Oliver, Aakanksha, Ahmadian, Arash, Hooker, Sara, Fadaee, Marzieh, Ermis, Beyza |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mix Data or Merge Models? Optimizing for Diverse Multi-Task Learning
von: Aakanksha, et al.
Veröffentlicht: (2024)
von: Aakanksha, et al.
Veröffentlicht: (2024)
The Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm
von: Aakanksha, et al.
Veröffentlicht: (2024)
von: Aakanksha, et al.
Veröffentlicht: (2024)
LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
von: Shimabucoro, Luísa, et al.
Veröffentlicht: (2024)
von: Shimabucoro, Luísa, et al.
Veröffentlicht: (2024)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
von: Cai, Hongyi, et al.
Veröffentlicht: (2025)
von: Cai, Hongyi, et al.
Veröffentlicht: (2025)
ES-Merging: Biological MLLM Merging via Embedding Space Signals
von: Lee, Wonbin, et al.
Veröffentlicht: (2026)
von: Lee, Wonbin, et al.
Veröffentlicht: (2026)
Diversify and Conquer: Diversity-Centric Data Selection with Iterative Refinement
von: Yu, Simon, et al.
Veröffentlicht: (2024)
von: Yu, Simon, et al.
Veröffentlicht: (2024)
The Leaderboard Illusion
von: Singh, Shivalika, et al.
Veröffentlicht: (2025)
von: Singh, Shivalika, et al.
Veröffentlicht: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
von: Liang, Yunfei
Veröffentlicht: (2025)
von: Liang, Yunfei
Veröffentlicht: (2025)
RLHF Can Speak Many Languages: Unlocking Multilingual Preference Optimization for LLMs
von: Dang, John, et al.
Veröffentlicht: (2024)
von: Dang, John, et al.
Veröffentlicht: (2024)
Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs
von: Ahmadian, Arash, et al.
Veröffentlicht: (2024)
von: Ahmadian, Arash, et al.
Veröffentlicht: (2024)
BD-Merging: Bias-Aware Dynamic Model Merging with Evidence-Guided Contrastive Learning
von: Xie, Yuhan, et al.
Veröffentlicht: (2026)
von: Xie, Yuhan, et al.
Veröffentlicht: (2026)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
von: Chen, Hao Mark, et al.
Veröffentlicht: (2025)
von: Chen, Hao Mark, et al.
Veröffentlicht: (2025)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
von: Zhang, Kehao, et al.
Veröffentlicht: (2025)
von: Zhang, Kehao, et al.
Veröffentlicht: (2025)
NegMerge: Sign-Consensual Weight Merging for Machine Unlearning
von: Kim, Hyo Seo, et al.
Veröffentlicht: (2024)
von: Kim, Hyo Seo, et al.
Veröffentlicht: (2024)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
von: Zhang, Bingjie, et al.
Veröffentlicht: (2025)
von: Zhang, Bingjie, et al.
Veröffentlicht: (2025)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
von: Chaichana, Yuatyong, et al.
Veröffentlicht: (2025)
von: Chaichana, Yuatyong, et al.
Veröffentlicht: (2025)
From One to Many: Expanding the Scope of Toxicity Mitigation in Language Models
von: Pozzobon, Luiza, et al.
Veröffentlicht: (2024)
von: Pozzobon, Luiza, et al.
Veröffentlicht: (2024)
Bayesian Model Merging
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
Channel Merging: Preserving Specialization for Merged Experts
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
Toward Theoretical Insights into Diffusion Trajectory Distillation via Operator Merging
von: Gao, Weiguo, et al.
Veröffentlicht: (2025)
von: Gao, Weiguo, et al.
Veröffentlicht: (2025)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
von: Wang, Jiapeng, et al.
Veröffentlicht: (2026)
von: Wang, Jiapeng, et al.
Veröffentlicht: (2026)
Merge to Mix: Mixing Datasets via Model Merging
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
Model Merging: Foundations and Algorithms
von: Crisostomi, Donato
Veröffentlicht: (2026)
von: Crisostomi, Donato
Veröffentlicht: (2026)
Model Merging in the Essential Subspace
von: Li, Longhua, et al.
Veröffentlicht: (2026)
von: Li, Longhua, et al.
Veröffentlicht: (2026)
Fine, I'll Merge It Myself: A Multi-Fidelity Framework for Automated Model Merging
von: Su, Guinan, et al.
Veröffentlicht: (2025)
von: Su, Guinan, et al.
Veröffentlicht: (2025)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging
von: Wang, Zhixiang, et al.
Veröffentlicht: (2025)
von: Wang, Zhixiang, et al.
Veröffentlicht: (2025)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
von: Li, Siyuan, et al.
Veröffentlicht: (2025)
von: Li, Siyuan, et al.
Veröffentlicht: (2025)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
Sparsity-Aware Evolution for Model Merging
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
Training-free Heterogeneous Model Merging
von: Xu, Zhengqi, et al.
Veröffentlicht: (2024)
von: Xu, Zhengqi, et al.
Veröffentlicht: (2024)
Multi-Level Collaboration in Model Merging
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
Revisiting Weight Averaging for Model Merging
von: Choi, Jiho, et al.
Veröffentlicht: (2024)
von: Choi, Jiho, et al.
Veröffentlicht: (2024)
Merging in a Bottle: Differentiable Adaptive Merging (DAM) and the Path from Averaging to Automation
von: Gauthier-Caron, Thomas, et al.
Veröffentlicht: (2024)
von: Gauthier-Caron, Thomas, et al.
Veröffentlicht: (2024)
Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning
von: Hiroshima, Kei, et al.
Veröffentlicht: (2026)
von: Hiroshima, Kei, et al.
Veröffentlicht: (2026)
CALM: Consensus-Aware Localized Merging for Multi-Task Learning
von: Yan, Kunda, et al.
Veröffentlicht: (2025)
von: Yan, Kunda, et al.
Veröffentlicht: (2025)
Training-Free Acceleration of ViTs with Delayed Spatial Merging
von: Heo, Jung Hwan, et al.
Veröffentlicht: (2023)
von: Heo, Jung Hwan, et al.
Veröffentlicht: (2023)
Merge-of-Thought Distillation
von: Shen, Zhanming, et al.
Veröffentlicht: (2025)
von: Shen, Zhanming, et al.
Veröffentlicht: (2025)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Mix Data or Merge Models? Optimizing for Diverse Multi-Task Learning
von: Aakanksha, et al.
Veröffentlicht: (2024) -
The Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm
von: Aakanksha, et al.
Veröffentlicht: (2024) -
LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
von: Shimabucoro, Luísa, et al.
Veröffentlicht: (2024) -
MergeIT: From Selection to Merging for Efficient Instruction Tuning
von: Cai, Hongyi, et al.
Veröffentlicht: (2025) -
ES-Merging: Biological MLLM Merging via Embedding Space Signals
von: Lee, Wonbin, et al.
Veröffentlicht: (2026)