Gespeichert in:
| Hauptverfasser: | Zhou, Yuhang, Karamanolakis, Giannis, Soto, Victor, Rumshisky, Anna, Kulkarni, Mayank, Huang, Furong, Ai, Wei, Lu, Jianhua |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2502.00997 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
von: Miao, Ruijie, et al.
Veröffentlicht: (2025)
von: Miao, Ruijie, et al.
Veröffentlicht: (2025)
Interactive Machine Teaching by Labeling Rules and Instances
von: Karamanolakis, Giannis, et al.
Veröffentlicht: (2024)
von: Karamanolakis, Giannis, et al.
Veröffentlicht: (2024)
Retraining-Free Merging of Sparse MoE via Hierarchical Clustering
von: Chen, I-Chun, et al.
Veröffentlicht: (2024)
von: Chen, I-Chun, et al.
Veröffentlicht: (2024)
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
von: Han, Ziyi, et al.
Veröffentlicht: (2025)
MAML-en-LLM: Model Agnostic Meta-Training of LLMs for Improved In-Context Learning
von: Sinha, Sanchit, et al.
Veröffentlicht: (2024)
von: Sinha, Sanchit, et al.
Veröffentlicht: (2024)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
von: Li, Lujun, et al.
Veröffentlicht: (2025)
von: Li, Lujun, et al.
Veröffentlicht: (2025)
UMM-RM: An Upcycle-and-Merge MoE Reward Model for Mitigating Reward Hacking
von: Fu, Lingling, et al.
Veröffentlicht: (2025)
von: Fu, Lingling, et al.
Veröffentlicht: (2025)
GFairHint: Improving Individual Fairness for Graph Neural Networks via Fairness Hint
von: Xu, Paiheng, et al.
Veröffentlicht: (2023)
von: Xu, Paiheng, et al.
Veröffentlicht: (2023)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
Sparse Crosscoders for diffing MoEs and Dense models
von: Chaudhari, Marmik, et al.
Veröffentlicht: (2026)
von: Chaudhari, Marmik, et al.
Veröffentlicht: (2026)
DC-Merge: Improving Model Merging with Directional Consistency
von: Zhang, Han-Chen, et al.
Veröffentlicht: (2026)
von: Zhang, Han-Chen, et al.
Veröffentlicht: (2026)
Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
von: Zhou, Yuhang, et al.
Veröffentlicht: (2023)
von: Zhou, Yuhang, et al.
Veröffentlicht: (2023)
Training-free Heterogeneous Model Merging
von: Xu, Zhengqi, et al.
Veröffentlicht: (2024)
von: Xu, Zhengqi, et al.
Veröffentlicht: (2024)
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
Enhancing Multi-modal Models with Heterogeneous MoE Adapters for Fine-tuning
von: Zhou, Sashuai, et al.
Veröffentlicht: (2025)
von: Zhou, Sashuai, et al.
Veröffentlicht: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
von: Liang, Yunfei
Veröffentlicht: (2025)
von: Liang, Yunfei
Veröffentlicht: (2025)
Polysemantic Experts, Monosemantic Paths: Routing as Control in MoEs
von: Ye, Charles, et al.
Veröffentlicht: (2026)
von: Ye, Charles, et al.
Veröffentlicht: (2026)
SonicMoE: Accelerating MoE with IO and Tile-aware Optimizations
von: Guo, Wentao, et al.
Veröffentlicht: (2025)
von: Guo, Wentao, et al.
Veröffentlicht: (2025)
CSRec: Rethinking Sequential Recommendation from A Causal Perspective
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoyu, et al.
Veröffentlicht: (2024)
FedMerge: Federated Personalization via Model Merging
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
ASD-RSD; To Merge or Not to Merge
von: Sinclair, Dorothy
Veröffentlicht: (1971)
von: Sinclair, Dorothy
Veröffentlicht: (1971)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
von: Zhang, Luyuan, et al.
Veröffentlicht: (2026)
von: Zhang, Luyuan, et al.
Veröffentlicht: (2026)
PivotMerge: Bridging Heterogeneous Multimodal Pre-training via Post-Alignment Model Merging
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
Merge to Mix: Mixing Datasets via Model Merging
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
ATM: Improving Model Merging by Alternating Tuning and Merging
von: Zhou, Luca, et al.
Veröffentlicht: (2024)
von: Zhou, Luca, et al.
Veröffentlicht: (2024)
Merge-of-Thought Distillation
von: Shen, Zhanming, et al.
Veröffentlicht: (2025)
von: Shen, Zhanming, et al.
Veröffentlicht: (2025)
To Merge and Not to Merge: Israel's Union List of Monographs in the Context of Merging Algorithms.
von: Lazinger, Susan S.
Veröffentlicht: (1994)
von: Lazinger, Susan S.
Veröffentlicht: (1994)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
EMR-Merging: Tuning-Free High-Performance Model Merging
von: Huang, Chenyu, et al.
Veröffentlicht: (2024)
von: Huang, Chenyu, et al.
Veröffentlicht: (2024)
Dirichlet-Prior Shaping: Guiding Expert Specialization in Upcycled MoEs
von: Mirvakhabova, Leyla, et al.
Veröffentlicht: (2025)
von: Mirvakhabova, Leyla, et al.
Veröffentlicht: (2025)
Continual Pre-training of MoEs: How robust is your router?
von: Thérien, Benjamin, et al.
Veröffentlicht: (2025)
von: Thérien, Benjamin, et al.
Veröffentlicht: (2025)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
von: Li, Siyuan, et al.
Veröffentlicht: (2025)
von: Li, Siyuan, et al.
Veröffentlicht: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
von: Zhou, Wenjie, et al.
Veröffentlicht: (2026)
von: Zhou, Wenjie, et al.
Veröffentlicht: (2026)
Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts
von: Wu, Haoyuan, et al.
Veröffentlicht: (2025)
von: Wu, Haoyuan, et al.
Veröffentlicht: (2025)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
von: Yuan, Zenghui, et al.
Veröffentlicht: (2025)
von: Yuan, Zenghui, et al.
Veröffentlicht: (2025)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
von: Chen, Zijun, et al.
Veröffentlicht: (2025)
DeepMerge: Deep-Learning-Based Region-Merging for Image Segmentation
von: Lv, Xianwei, et al.
Veröffentlicht: (2023)
von: Lv, Xianwei, et al.
Veröffentlicht: (2023)
Extrapolation Merging: Keep Improving With Extrapolation and Merging
von: Lin, Yiguan, et al.
Veröffentlicht: (2025)
von: Lin, Yiguan, et al.
Veröffentlicht: (2025)
Channel Merging: Preserving Specialization for Merged Experts
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
HM3: Heterogeneous Multi-Class Model Merging
von: Hackmann, Stefan
Veröffentlicht: (2024)
von: Hackmann, Stefan
Veröffentlicht: (2024)
Ähnliche Einträge
-
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
von: Miao, Ruijie, et al.
Veröffentlicht: (2025) -
Interactive Machine Teaching by Labeling Rules and Instances
von: Karamanolakis, Giannis, et al.
Veröffentlicht: (2024) -
Retraining-Free Merging of Sparse MoE via Hierarchical Clustering
von: Chen, I-Chun, et al.
Veröffentlicht: (2024) -
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
von: Han, Ziyi, et al.
Veröffentlicht: (2025) -
MAML-en-LLM: Model Agnostic Meta-Training of LLMs for Improved In-Context Learning
von: Sinha, Sanchit, et al.
Veröffentlicht: (2024)