Towards Adaptive Continual Model Merging via Manifold-Aware Expert Evolution
Fuente:
arXiv
Salvato in:
| Autori principali: | Qiu, Haiyun, Wu, Xingyu, Tan, Kay Chen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fine-Grained Model Merging via Modular Expert Recombination
di: Qiu, Haiyun, et al.
Pubblicazione: (2026)
di: Qiu, Haiyun, et al.
Pubblicazione: (2026)
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models
di: Zhou, Yu, et al.
Pubblicazione: (2024)
di: Zhou, Yu, et al.
Pubblicazione: (2024)
Diversity-Aware Policy Optimization for Large Language Model Reasoning
di: Yao, Jian, et al.
Pubblicazione: (2025)
di: Yao, Jian, et al.
Pubblicazione: (2025)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
di: Zhang, Dengming, et al.
Pubblicazione: (2025)
di: Zhang, Dengming, et al.
Pubblicazione: (2025)
Soft Merging of Experts with Adaptive Routing
di: Muqeeth, Mohammed, et al.
Pubblicazione: (2023)
di: Muqeeth, Mohammed, et al.
Pubblicazione: (2023)
Large Language Model-Enhanced Algorithm Selection: Towards Comprehensive Algorithm Representation
di: Wu, Xingyu, et al.
Pubblicazione: (2023)
di: Wu, Xingyu, et al.
Pubblicazione: (2023)
Sparsity-Aware Evolution for Model Merging
di: Zhang, Huan, et al.
Pubblicazione: (2026)
di: Zhang, Huan, et al.
Pubblicazione: (2026)
MINGLE: Mixture of Null-Space Gated Low-Rank Experts for Test-Time Continual Model Merging
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
Design Principle Transfer in Neural Architecture Search via Large Language Models
di: Zhou, Xun, et al.
Pubblicazione: (2024)
di: Zhou, Xun, et al.
Pubblicazione: (2024)
Expert Merging in Sparse Mixture of Experts with Nash Bargaining
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
di: Miao, Ruijie, et al.
Pubblicazione: (2025)
di: Miao, Ruijie, et al.
Pubblicazione: (2025)
CAMEx: Curvature-aware Merging of Experts
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
LLM Cannot Discover Causality, and Should Be Restricted to Non-Decisional Support in Causal Discovery
di: Wu, Xingyu, et al.
Pubblicazione: (2025)
di: Wu, Xingyu, et al.
Pubblicazione: (2025)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
di: Chen, Weiyu, et al.
Pubblicazione: (2024)
di: Chen, Weiyu, et al.
Pubblicazione: (2024)
FAME: Forecasting Academic Impact via Continuous-Time Manifold Evolution
di: Ding, Jianrong, et al.
Pubblicazione: (2026)
di: Ding, Jianrong, et al.
Pubblicazione: (2026)
Vanishing Feature: Diagnosing Model Merging and Beyond
di: Qu, Xingyu, et al.
Pubblicazione: (2024)
di: Qu, Xingyu, et al.
Pubblicazione: (2024)
Toward a Holistic Approach to Continual Model Merging
di: Phan, Hoang, et al.
Pubblicazione: (2025)
di: Phan, Hoang, et al.
Pubblicazione: (2025)
Learning More Generalized Experts by Merging Experts in Mixture-of-Experts
di: Park, Sejik
Pubblicazione: (2024)
di: Park, Sejik
Pubblicazione: (2024)
Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning
di: Hiroshima, Kei, et al.
Pubblicazione: (2026)
di: Hiroshima, Kei, et al.
Pubblicazione: (2026)
FedMerge: Federated Personalization via Model Merging
di: Chen, Shutong, et al.
Pubblicazione: (2025)
di: Chen, Shutong, et al.
Pubblicazione: (2025)
Merge before Forget: A Single LoRA Continual Learning via Continual Merging
di: Qiao, Fuli, et al.
Pubblicazione: (2025)
di: Qiao, Fuli, et al.
Pubblicazione: (2025)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
PASs-MoE: Mitigating Misaligned Co-drift among Router and Experts via Pathway Activation Subspaces for Continual Learning
di: Hou, Zhiyan, et al.
Pubblicazione: (2026)
di: Hou, Zhiyan, et al.
Pubblicazione: (2026)
Adaptive Substructure-Aware Expert Model for Molecular Property Prediction
di: Jiang, Tianyi, et al.
Pubblicazione: (2025)
di: Jiang, Tianyi, et al.
Pubblicazione: (2025)
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
di: Han, Ziyi, et al.
Pubblicazione: (2025)
di: Han, Ziyi, et al.
Pubblicazione: (2025)
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
di: Yang, Jinluan, et al.
Pubblicazione: (2024)
di: Yang, Jinluan, et al.
Pubblicazione: (2024)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025)
di: Li, Lujun, et al.
Pubblicazione: (2025)
Learning from B Cell Evolution: Adaptive Multi-Expert Diffusion for Antibody Design via Online Optimization
di: Feng, Hanqi, et al.
Pubblicazione: (2025)
di: Feng, Hanqi, et al.
Pubblicazione: (2025)
BD-Merging: Bias-Aware Dynamic Model Merging with Evidence-Guided Contrastive Learning
di: Xie, Yuhan, et al.
Pubblicazione: (2026)
di: Xie, Yuhan, et al.
Pubblicazione: (2026)
Null-Space Filtering for Data-Free Continual Model Merging: Preserving Stability, Promoting Plasticity
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
Data Augmentation for Continual RL via Adversarial Gradient Episodic Memory
di: Wu, Sihao, et al.
Pubblicazione: (2024)
di: Wu, Sihao, et al.
Pubblicazione: (2024)
Channel Merging: Preserving Specialization for Merged Experts
di: Zhang, Mingyang, et al.
Pubblicazione: (2024)
di: Zhang, Mingyang, et al.
Pubblicazione: (2024)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
di: Tang, Anke, et al.
Pubblicazione: (2025)
di: Tang, Anke, et al.
Pubblicazione: (2025)
CausalBench: A Comprehensive Benchmark for Causal Learning Capability of LLMs
di: Zhou, Yu, et al.
Pubblicazione: (2024)
di: Zhou, Yu, et al.
Pubblicazione: (2024)
Efficient Estimation for Longitudinal Networks via Adaptive Merging
di: Zhang, Haoran, et al.
Pubblicazione: (2022)
di: Zhang, Haoran, et al.
Pubblicazione: (2022)
Exploiting Task Relationships in Continual Learning via Transferability-Aware Task Embeddings
di: Wu, Yanru, et al.
Pubblicazione: (2025)
di: Wu, Yanru, et al.
Pubblicazione: (2025)
Task-Aware Mixture-of-Experts for Time Series Analysis
di: Wu, Xingjian, et al.
Pubblicazione: (2025)
di: Wu, Xingjian, et al.
Pubblicazione: (2025)
Unlock the Power of Algorithm Features: A Generalization Analysis for Algorithm Selection
di: Wu, Xingyu, et al.
Pubblicazione: (2024)
di: Wu, Xingyu, et al.
Pubblicazione: (2024)
Local Mixtures of Experts: Essentially Free Test-Time Training via Model Merging
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fine-Grained Model Merging via Modular Expert Recombination
di: Qiu, Haiyun, et al.
Pubblicazione: (2026) -
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models
di: Zhou, Yu, et al.
Pubblicazione: (2024) -
Diversity-Aware Policy Optimization for Large Language Model Reasoning
di: Yao, Jian, et al.
Pubblicazione: (2025) -
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
di: Zhang, Dengming, et al.
Pubblicazione: (2025) -
Soft Merging of Experts with Adaptive Routing
di: Muqeeth, Mohammed, et al.
Pubblicazione: (2023)