Sparsity-Aware Evolution for Model Merging
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Huan, Zhang, Yanjian, Wisniewski, Guillaume, Tomeh, Nadi, Liu, Bang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize?
por: Zhang, Yanjian, et al.
Publicado: (2025)
por: Zhang, Yanjian, et al.
Publicado: (2025)
An Autoregressive Text-to-Graph Framework for Joint Entity and Relation Extraction
por: Zaratiana, Urchade, et al.
Publicado: (2024)
por: Zaratiana, Urchade, et al.
Publicado: (2024)
Manual Verbalizer Enrichment for Few-Shot Text Classification
por: Nguyen, Quang Anh, et al.
Publicado: (2024)
por: Nguyen, Quang Anh, et al.
Publicado: (2024)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
por: Zhang, Kehao, et al.
Publicado: (2025)
por: Zhang, Kehao, et al.
Publicado: (2025)
CALM: Consensus-Aware Localized Merging for Multi-Task Learning
por: Yan, Kunda, et al.
Publicado: (2025)
por: Yan, Kunda, et al.
Publicado: (2025)
BD-Merging: Bias-Aware Dynamic Model Merging with Evidence-Guided Contrastive Learning
por: Xie, Yuhan, et al.
Publicado: (2026)
por: Xie, Yuhan, et al.
Publicado: (2026)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
por: Zhang, Longteng, et al.
Publicado: (2026)
por: Zhang, Longteng, et al.
Publicado: (2026)
RaaS: Reasoning-Aware Attention Sparsity for Efficient LLM Reasoning
por: Hu, Junhao, et al.
Publicado: (2025)
por: Hu, Junhao, et al.
Publicado: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
por: Wang, Jiapeng, et al.
Publicado: (2026)
por: Wang, Jiapeng, et al.
Publicado: (2026)
Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning
por: Hiroshima, Kei, et al.
Publicado: (2026)
por: Hiroshima, Kei, et al.
Publicado: (2026)
CABS: Conflict-Aware and Balanced Sparsification for Enhancing Model Merging
por: Yang, Zongzhen, et al.
Publicado: (2025)
por: Yang, Zongzhen, et al.
Publicado: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
por: Liang, Yunfei
Publicado: (2025)
por: Liang, Yunfei
Publicado: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
por: Zhang, Bingjie, et al.
Publicado: (2025)
por: Zhang, Bingjie, et al.
Publicado: (2025)
ToMMeR -- Efficient Entity Mention Detection from Large Language Models
por: Morand, Victor, et al.
Publicado: (2025)
por: Morand, Victor, et al.
Publicado: (2025)
Improving MLLM Training Efficiency via Stage-Aware Sparsity
por: Shi, Kean, et al.
Publicado: (2025)
por: Shi, Kean, et al.
Publicado: (2025)
On the Identifiability of Nonlinear ICA: Sparsity and Beyond
por: Zheng, Yujia, et al.
Publicado: (2022)
por: Zheng, Yujia, et al.
Publicado: (2022)
Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression
por: Zhang, Te, et al.
Publicado: (2025)
por: Zhang, Te, et al.
Publicado: (2025)
Symmetry-Aware Graph Metanetwork Autoencoders: Model Merging through Parameter Canonicalization
por: Boufalis, Odysseas, et al.
Publicado: (2025)
por: Boufalis, Odysseas, et al.
Publicado: (2025)
Large Language Model Compression with Global Rank and Sparsity Optimization
por: Zhou, Changhai, et al.
Publicado: (2025)
por: Zhou, Changhai, et al.
Publicado: (2025)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
por: Li, Siyuan, et al.
Publicado: (2025)
por: Li, Siyuan, et al.
Publicado: (2025)
From Coefficients to Directions: Rethinking Model Merging with Directional Alignment
por: Chen, Zhikang, et al.
Publicado: (2025)
por: Chen, Zhikang, et al.
Publicado: (2025)
Bayesian Model Merging
por: Li, Kaiyang, et al.
Publicado: (2026)
por: Li, Kaiyang, et al.
Publicado: (2026)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
por: Chen, Hao Mark, et al.
Publicado: (2025)
por: Chen, Hao Mark, et al.
Publicado: (2025)
ALISA: Accelerating Large Language Model Inference via Sparsity-Aware KV Caching
por: Zhao, Youpeng, et al.
Publicado: (2024)
por: Zhao, Youpeng, et al.
Publicado: (2024)
Channel Merging: Preserving Specialization for Merged Experts
por: Zhang, Mingyang, et al.
Publicado: (2024)
por: Zhang, Mingyang, et al.
Publicado: (2024)
Amber Pruner: Leveraging N:M Activation Sparsity for Efficient Prefill in Large Language Models
por: An, Tai, et al.
Publicado: (2025)
por: An, Tai, et al.
Publicado: (2025)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
por: Chaichana, Yuatyong, et al.
Publicado: (2025)
por: Chaichana, Yuatyong, et al.
Publicado: (2025)
Model Merging: Foundations and Algorithms
por: Crisostomi, Donato
Publicado: (2026)
por: Crisostomi, Donato
Publicado: (2026)
Model Merging in the Essential Subspace
por: Li, Longhua, et al.
Publicado: (2026)
por: Li, Longhua, et al.
Publicado: (2026)
Towards the Connection between Activation Sparsity and Flat Minima
por: Peng, Ze, et al.
Publicado: (2026)
por: Peng, Ze, et al.
Publicado: (2026)
WiSparse: Boosting LLM Inference Efficiency with Weight-Aware Mixed Activation Sparsity
por: Chen, Lei, et al.
Publicado: (2026)
por: Chen, Lei, et al.
Publicado: (2026)
Dependency-Aware Semi-Structured Sparsity of GLU Variants in Large Language Models
por: Guo, Zhiyu, et al.
Publicado: (2024)
por: Guo, Zhiyu, et al.
Publicado: (2024)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
por: Sun, Wenju, et al.
Publicado: (2025)
por: Sun, Wenju, et al.
Publicado: (2025)
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
por: Su, Yupeng, et al.
Publicado: (2024)
por: Su, Yupeng, et al.
Publicado: (2024)
Sparsity in neural networks can improve their privacy
por: Gonon, Antoine, et al.
Publicado: (2023)
por: Gonon, Antoine, et al.
Publicado: (2023)
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
por: Hu, Qiang, et al.
Publicado: (2024)
por: Hu, Qiang, et al.
Publicado: (2024)
Harnessing Agentic Evolution
por: Zhang, Jiayi, et al.
Publicado: (2026)
por: Zhang, Jiayi, et al.
Publicado: (2026)
Improving Decision Sparsity
por: Sun, Yiyang, et al.
Publicado: (2024)
por: Sun, Yiyang, et al.
Publicado: (2024)
Homeostasis and Sparsity in Transformer
por: Kotyuzanskiy, Leonid, et al.
Publicado: (2024)
por: Kotyuzanskiy, Leonid, et al.
Publicado: (2024)
An Efficient Training Algorithm for Models with Block-wise Sparsity
por: Zhu, Ding, et al.
Publicado: (2025)
por: Zhu, Ding, et al.
Publicado: (2025)
Ejemplares similares
-
Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize?
por: Zhang, Yanjian, et al.
Publicado: (2025) -
An Autoregressive Text-to-Graph Framework for Joint Entity and Relation Extraction
por: Zaratiana, Urchade, et al.
Publicado: (2024) -
Manual Verbalizer Enrichment for Few-Shot Text Classification
por: Nguyen, Quang Anh, et al.
Publicado: (2024) -
PSO-Merging: Merging Models Based on Particle Swarm Optimization
por: Zhang, Kehao, et al.
Publicado: (2025) -
CALM: Consensus-Aware Localized Merging for Multi-Task Learning
por: Yan, Kunda, et al.
Publicado: (2025)