A Unified Generalization Framework for Model Merging: Trade-offs, Non-Linearity, and Scaling Laws
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Qinglun, Tang, Anke, Zhang, Miao, Wang, Mengzhu, Yin, Quanjun, Shen, Li |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OledFL: Unleashing the Potential of Decentralized Federated Learning via Opposite Lookahead Enhancement
por: Li, Qinglun, et al.
Publicado: (2024)
por: Li, Qinglun, et al.
Publicado: (2024)
Boosting the Performance of Decentralized Federated Learning via Catalyst Acceleration
por: Li, Qinglun, et al.
Publicado: (2024)
por: Li, Qinglun, et al.
Publicado: (2024)
Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized Training
por: Li, Qinglun, et al.
Publicado: (2025)
por: Li, Qinglun, et al.
Publicado: (2025)
PACE: Parameter Change for Unsupervised Environment Design
por: Yuan, Fang, et al.
Publicado: (2026)
por: Yuan, Fang, et al.
Publicado: (2026)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
por: Tang, Anke, et al.
Publicado: (2024)
por: Tang, Anke, et al.
Publicado: (2024)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
por: Tang, Anke, et al.
Publicado: (2025)
por: Tang, Anke, et al.
Publicado: (2025)
Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
por: Wei, Yongxian, et al.
Publicado: (2025)
por: Wei, Yongxian, et al.
Publicado: (2025)
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
por: Yang, Jinluan, et al.
Publicado: (2024)
por: Yang, Jinluan, et al.
Publicado: (2024)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
por: Xie, Guofu, et al.
Publicado: (2025)
por: Xie, Guofu, et al.
Publicado: (2025)
Trade-offs in Ensembling, Merging and Routing Among Parameter-Efficient Experts
por: Lotfi, Sanae, et al.
Publicado: (2026)
por: Lotfi, Sanae, et al.
Publicado: (2026)
HydraOpt: Navigating the Efficiency-Performance Trade-off of Adapter Merging
por: Ceritli, Taha, et al.
Publicado: (2025)
por: Ceritli, Taha, et al.
Publicado: (2025)
Does Scaling Law Apply in Time Series Forecasting?
por: Li, Zeyan, et al.
Publicado: (2025)
por: Li, Zeyan, et al.
Publicado: (2025)
Scaling Laws for Precision in High-Dimensional Linear Regression
por: Zhang, Dechen, et al.
Publicado: (2026)
por: Zhang, Dechen, et al.
Publicado: (2026)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
por: Yang, Jinluan, et al.
Publicado: (2025)
por: Yang, Jinluan, et al.
Publicado: (2025)
Breaking the Likelihood-Quality Trade-off in Diffusion Models by Merging Pretrained Experts
por: Esfandiari, Yasin, et al.
Publicado: (2025)
por: Esfandiari, Yasin, et al.
Publicado: (2025)
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
por: Shen, Li, et al.
Publicado: (2024)
por: Shen, Li, et al.
Publicado: (2024)
Understanding Generalization of Federated Learning: the Trade-off between Model Stability and Optimization
por: Zeng, Dun, et al.
Publicado: (2024)
por: Zeng, Dun, et al.
Publicado: (2024)
Parameter Efficient Multi-task Model Fusion with Partial Linearization
por: Tang, Anke, et al.
Publicado: (2023)
por: Tang, Anke, et al.
Publicado: (2023)
Efficient Linear Attention for Multivariate Time Series Modeling via Entropy Equality
por: Zhang, Mingtao, et al.
Publicado: (2025)
por: Zhang, Mingtao, et al.
Publicado: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
por: Zhang, Bingjie, et al.
Publicado: (2025)
por: Zhang, Bingjie, et al.
Publicado: (2025)
Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
por: He, Weiqing, et al.
Publicado: (2026)
por: He, Weiqing, et al.
Publicado: (2026)
Scaling Laws and In-Context Learning: A Unified Theoretical Framework
por: Mehta, Sushant, et al.
Publicado: (2025)
por: Mehta, Sushant, et al.
Publicado: (2025)
A Unified Blockwise Measurement Design for Learning Quantum Channels and Lindbladians via Low-Rank Matrix Sensing
por: Lang, Quanjun, et al.
Publicado: (2025)
por: Lang, Quanjun, et al.
Publicado: (2025)
Learning Memory Kernels in Generalized Langevin Equations
por: Lang, Quanjun, et al.
Publicado: (2024)
por: Lang, Quanjun, et al.
Publicado: (2024)
A Unified Framework for Knowledge Transfer in Bidirectional Model Scaling
por: Shen, Jianlu, et al.
Publicado: (2026)
por: Shen, Jianlu, et al.
Publicado: (2026)
The Risk of Federated Learning to Skew Fine-Tuning Features and Underperform Out-of-Distribution Robustness
por: Du, Mengyao, et al.
Publicado: (2024)
por: Du, Mengyao, et al.
Publicado: (2024)
A Unified and General Framework for Continual Learning
por: Wang, Zhenyi, et al.
Publicado: (2024)
por: Wang, Zhenyi, et al.
Publicado: (2024)
Provable Sparse Inversion and Token Relabel Enhanced One-shot Federated Learning with ViTs
por: Shen, Li, et al.
Publicado: (2026)
por: Shen, Li, et al.
Publicado: (2026)
Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging
por: Hu, Tiancheng, et al.
Publicado: (2025)
por: Hu, Tiancheng, et al.
Publicado: (2025)
Beyond the False Trade-off: Adaptive EWC for Stealthy and Generalizable T2I Backdoors
por: Bowen, Lu, et al.
Publicado: (2026)
por: Bowen, Lu, et al.
Publicado: (2026)
CoCo: A Coupled Contrastive Framework for Unsupervised Domain Adaptive Graph Classification
por: Yin, Nan, et al.
Publicado: (2023)
por: Yin, Nan, et al.
Publicado: (2023)
Differentially Private Model Merging
por: Yin, Qichuan, et al.
Publicado: (2026)
por: Yin, Qichuan, et al.
Publicado: (2026)
Unified Neural Network Scaling Laws and Scale-time Equivalence
por: Boopathy, Akhilan, et al.
Publicado: (2024)
por: Boopathy, Akhilan, et al.
Publicado: (2024)
GRE^2-MDCL: Graph Representation Embedding Enhanced via Multidimensional Contrastive Learning
por: Fan, Kaizhe, et al.
Publicado: (2024)
por: Fan, Kaizhe, et al.
Publicado: (2024)
A Unified Learn-to-Distort-Data Framework for Privacy-Utility Trade-off in Trustworthy Federated Learning
por: Zhang, Xiaojin, et al.
Publicado: (2024)
por: Zhang, Xiaojin, et al.
Publicado: (2024)
USBD: Universal Structural Basis Distillation for Source-Free Graph Domain Adaptation
por: Wang, Yingxu, et al.
Publicado: (2026)
por: Wang, Yingxu, et al.
Publicado: (2026)
Unifying Learning Dynamics and Generalization in Transformers Scaling Law
por: Yang, Chiwun
Publicado: (2025)
por: Yang, Chiwun
Publicado: (2025)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
por: Yang, Enneng, et al.
Publicado: (2023)
por: Yang, Enneng, et al.
Publicado: (2023)
FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
por: Tang, Anke, et al.
Publicado: (2024)
por: Tang, Anke, et al.
Publicado: (2024)
Unified Scaling Laws for Compressed Representations
por: Panferov, Andrei, et al.
Publicado: (2025)
por: Panferov, Andrei, et al.
Publicado: (2025)
Ejemplares similares
-
OledFL: Unleashing the Potential of Decentralized Federated Learning via Opposite Lookahead Enhancement
por: Li, Qinglun, et al.
Publicado: (2024) -
Boosting the Performance of Decentralized Federated Learning via Catalyst Acceleration
por: Li, Qinglun, et al.
Publicado: (2024) -
Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized Training
por: Li, Qinglun, et al.
Publicado: (2025) -
PACE: Parameter Change for Unsupervised Environment Design
por: Yuan, Fang, et al.
Publicado: (2026) -
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
por: Tang, Anke, et al.
Publicado: (2024)