Rethinking Layer-wise Model Merging through Chain of Merges
Fuente:
arXiv
Guardado en:
| Autores principales: | Buzzega, Pietro, Salami, Riccardo, Porrello, Angelo, Calderara, Simone |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Trajectory Forecasting through Low-Rank Adaptation of Discrete Latent Codes
por: Benaglia, Riccardo, et al.
Publicado: (2024)
por: Benaglia, Riccardo, et al.
Publicado: (2024)
Federated Class-Incremental Learning with Hierarchical Generative Prototypes
por: Salami, Riccardo, et al.
Publicado: (2024)
por: Salami, Riccardo, et al.
Publicado: (2024)
Intrinsic Training Signals for Federated Learning Aggregation
por: Fiorini, Cosimo, et al.
Publicado: (2025)
por: Fiorini, Cosimo, et al.
Publicado: (2025)
A Second-Order Perspective on Model Compositionality and Incremental Learning
por: Porrello, Angelo, et al.
Publicado: (2024)
por: Porrello, Angelo, et al.
Publicado: (2024)
CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning
por: Frascaroli, Emanuele, et al.
Publicado: (2024)
por: Frascaroli, Emanuele, et al.
Publicado: (2024)
Closed-form merging of parameter-efficient modules for Federated Continual Learning
por: Salami, Riccardo, et al.
Publicado: (2024)
por: Salami, Riccardo, et al.
Publicado: (2024)
Towards Robust Knowledge Removal in Federated Learning with High Data Heterogeneity
por: Santi, Riccardo, et al.
Publicado: (2025)
por: Santi, Riccardo, et al.
Publicado: (2025)
Dataless Weight Disentanglement in Task Arithmetic via Kronecker-Factored Approximate Curvature
por: Porrello, Angelo, et al.
Publicado: (2026)
por: Porrello, Angelo, et al.
Publicado: (2026)
DOLFIN: Balancing Stability and Plasticity in Federated Continual Learning
por: Moussadek, Omayma, et al.
Publicado: (2025)
por: Moussadek, Omayma, et al.
Publicado: (2025)
How to Train Your Metamorphic Deep Neural Network
por: Sommariva, Thomas, et al.
Publicado: (2025)
por: Sommariva, Thomas, et al.
Publicado: (2025)
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
por: Sommariva, Thomas, et al.
Publicado: (2026)
por: Sommariva, Thomas, et al.
Publicado: (2026)
Scalable Model Merging with Progressive Layer-wise Distillation
por: Xu, Jing, et al.
Publicado: (2025)
por: Xu, Jing, et al.
Publicado: (2025)
Self-Labeling the Job Shop Scheduling Problem
por: Corsini, Andrea, et al.
Publicado: (2024)
por: Corsini, Andrea, et al.
Publicado: (2024)
Modular Embedding Recomposition for Incremental Learning
por: Panariello, Aniello, et al.
Publicado: (2025)
por: Panariello, Aniello, et al.
Publicado: (2025)
Transporting Task Vectors across Different Architectures without Training
por: Rinaldi, Filippo, et al.
Publicado: (2026)
por: Rinaldi, Filippo, et al.
Publicado: (2026)
DitHub: A Modular Framework for Incremental Open-Vocabulary Object Detection
por: Cappellino, Chiara, et al.
Publicado: (2025)
por: Cappellino, Chiara, et al.
Publicado: (2025)
Is Multiple Object Tracking a Matter of Specialization?
por: Mancusi, Gianluca, et al.
Publicado: (2024)
por: Mancusi, Gianluca, et al.
Publicado: (2024)
An Attention-based Representation Distillation Baseline for Multi-Label Continual Learning
por: Menabue, Martin, et al.
Publicado: (2024)
por: Menabue, Martin, et al.
Publicado: (2024)
Semantic Residual Prompts for Continual Learning
por: Menabue, Martin, et al.
Publicado: (2024)
por: Menabue, Martin, et al.
Publicado: (2024)
LayerMerge: Neural Network Depth Compression through Layer Pruning and Merging
por: Kim, Jinuk, et al.
Publicado: (2024)
por: Kim, Jinuk, et al.
Publicado: (2024)
Gradient-Sign Masking for Task Vector Transport Across Pre-Trained Models
por: Rinaldi, Filippo, et al.
Publicado: (2025)
por: Rinaldi, Filippo, et al.
Publicado: (2025)
LARV: Data-Free Layer-wise Adaptive Rescaling Veneer for Model Merging
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
por: Zhang, Dengming, et al.
Publicado: (2025)
por: Zhang, Dengming, et al.
Publicado: (2025)
May the Forgetting Be with You: Alternate Replay for Learning with Noisy Labels
por: Millunzi, Monica, et al.
Publicado: (2024)
por: Millunzi, Monica, et al.
Publicado: (2024)
Accurate and Efficient Low-Rank Model Merging in Core Space
por: Panariello, Aniello, et al.
Publicado: (2025)
por: Panariello, Aniello, et al.
Publicado: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
por: Liang, Yunfei
Publicado: (2025)
por: Liang, Yunfei
Publicado: (2025)
Towards Minimizing Feature Drift in Model Merging: Layer-wise Task Vector Fusion for Adaptive Knowledge Integration
por: Sun, Wenju, et al.
Publicado: (2025)
por: Sun, Wenju, et al.
Publicado: (2025)
SyMerge: From Non-Interference to Synergistic Merging via Single-Layer Adaptation
por: Jung, Aecheon, et al.
Publicado: (2024)
por: Jung, Aecheon, et al.
Publicado: (2024)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
por: Shenaj, Donald, et al.
Publicado: (2025)
por: Shenaj, Donald, et al.
Publicado: (2025)
Update Your Transformer to the Latest Release: Re-Basin of Task Vectors
por: Rinaldi, Filippo, et al.
Publicado: (2025)
por: Rinaldi, Filippo, et al.
Publicado: (2025)
FedMerge: Federated Personalization via Model Merging
por: Chen, Shutong, et al.
Publicado: (2025)
por: Chen, Shutong, et al.
Publicado: (2025)
From Coefficients to Directions: Rethinking Model Merging with Directional Alignment
por: Chen, Zhikang, et al.
Publicado: (2025)
por: Chen, Zhikang, et al.
Publicado: (2025)
STAER: Temporal Aligned Rehearsal for Continual Spiking Neural Network
por: Gianferrari, Matteo, et al.
Publicado: (2026)
por: Gianferrari, Matteo, et al.
Publicado: (2026)
Dataless Knowledge Fusion by Merging Weights of Language Models
por: Jin, Xisen, et al.
Publicado: (2022)
por: Jin, Xisen, et al.
Publicado: (2022)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
por: Li, Siyuan, et al.
Publicado: (2025)
por: Li, Siyuan, et al.
Publicado: (2025)
Orthogonal Model Merging
por: Yang, Sihan, et al.
Publicado: (2026)
por: Yang, Sihan, et al.
Publicado: (2026)
BadMerging: Backdoor Attacks Against Model Merging
por: Zhang, Jinghuai, et al.
Publicado: (2024)
por: Zhang, Jinghuai, et al.
Publicado: (2024)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
por: Chen, Weiyu, et al.
Publicado: (2024)
por: Chen, Weiyu, et al.
Publicado: (2024)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
por: Tang, Yao, et al.
Publicado: (2026)
por: Tang, Yao, et al.
Publicado: (2026)
MergeQuant: Accurate 4-bit Static Quantization of Large Language Models by Channel-wise Calibration
por: Wang, Jinguang, et al.
Publicado: (2025)
por: Wang, Jinguang, et al.
Publicado: (2025)
Ejemplares similares
-
Trajectory Forecasting through Low-Rank Adaptation of Discrete Latent Codes
por: Benaglia, Riccardo, et al.
Publicado: (2024) -
Federated Class-Incremental Learning with Hierarchical Generative Prototypes
por: Salami, Riccardo, et al.
Publicado: (2024) -
Intrinsic Training Signals for Federated Learning Aggregation
por: Fiorini, Cosimo, et al.
Publicado: (2025) -
A Second-Order Perspective on Model Compositionality and Incremental Learning
por: Porrello, Angelo, et al.
Publicado: (2024) -
CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning
por: Frascaroli, Emanuele, et al.
Publicado: (2024)