Rethinking Layer-wise Model Merging through Chain of Merges
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Buzzega, Pietro, Salami, Riccardo, Porrello, Angelo, Calderara, Simone |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Trajectory Forecasting through Low-Rank Adaptation of Discrete Latent Codes
par: Benaglia, Riccardo, et autres
Publié: (2024)
par: Benaglia, Riccardo, et autres
Publié: (2024)
Federated Class-Incremental Learning with Hierarchical Generative Prototypes
par: Salami, Riccardo, et autres
Publié: (2024)
par: Salami, Riccardo, et autres
Publié: (2024)
Intrinsic Training Signals for Federated Learning Aggregation
par: Fiorini, Cosimo, et autres
Publié: (2025)
par: Fiorini, Cosimo, et autres
Publié: (2025)
A Second-Order Perspective on Model Compositionality and Incremental Learning
par: Porrello, Angelo, et autres
Publié: (2024)
par: Porrello, Angelo, et autres
Publié: (2024)
CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning
par: Frascaroli, Emanuele, et autres
Publié: (2024)
par: Frascaroli, Emanuele, et autres
Publié: (2024)
Closed-form merging of parameter-efficient modules for Federated Continual Learning
par: Salami, Riccardo, et autres
Publié: (2024)
par: Salami, Riccardo, et autres
Publié: (2024)
Towards Robust Knowledge Removal in Federated Learning with High Data Heterogeneity
par: Santi, Riccardo, et autres
Publié: (2025)
par: Santi, Riccardo, et autres
Publié: (2025)
Dataless Weight Disentanglement in Task Arithmetic via Kronecker-Factored Approximate Curvature
par: Porrello, Angelo, et autres
Publié: (2026)
par: Porrello, Angelo, et autres
Publié: (2026)
DOLFIN: Balancing Stability and Plasticity in Federated Continual Learning
par: Moussadek, Omayma, et autres
Publié: (2025)
par: Moussadek, Omayma, et autres
Publié: (2025)
How to Train Your Metamorphic Deep Neural Network
par: Sommariva, Thomas, et autres
Publié: (2025)
par: Sommariva, Thomas, et autres
Publié: (2025)
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
par: Sommariva, Thomas, et autres
Publié: (2026)
par: Sommariva, Thomas, et autres
Publié: (2026)
Scalable Model Merging with Progressive Layer-wise Distillation
par: Xu, Jing, et autres
Publié: (2025)
par: Xu, Jing, et autres
Publié: (2025)
Self-Labeling the Job Shop Scheduling Problem
par: Corsini, Andrea, et autres
Publié: (2024)
par: Corsini, Andrea, et autres
Publié: (2024)
Modular Embedding Recomposition for Incremental Learning
par: Panariello, Aniello, et autres
Publié: (2025)
par: Panariello, Aniello, et autres
Publié: (2025)
Transporting Task Vectors across Different Architectures without Training
par: Rinaldi, Filippo, et autres
Publié: (2026)
par: Rinaldi, Filippo, et autres
Publié: (2026)
DitHub: A Modular Framework for Incremental Open-Vocabulary Object Detection
par: Cappellino, Chiara, et autres
Publié: (2025)
par: Cappellino, Chiara, et autres
Publié: (2025)
Is Multiple Object Tracking a Matter of Specialization?
par: Mancusi, Gianluca, et autres
Publié: (2024)
par: Mancusi, Gianluca, et autres
Publié: (2024)
An Attention-based Representation Distillation Baseline for Multi-Label Continual Learning
par: Menabue, Martin, et autres
Publié: (2024)
par: Menabue, Martin, et autres
Publié: (2024)
Semantic Residual Prompts for Continual Learning
par: Menabue, Martin, et autres
Publié: (2024)
par: Menabue, Martin, et autres
Publié: (2024)
LayerMerge: Neural Network Depth Compression through Layer Pruning and Merging
par: Kim, Jinuk, et autres
Publié: (2024)
par: Kim, Jinuk, et autres
Publié: (2024)
Gradient-Sign Masking for Task Vector Transport Across Pre-Trained Models
par: Rinaldi, Filippo, et autres
Publié: (2025)
par: Rinaldi, Filippo, et autres
Publié: (2025)
LARV: Data-Free Layer-wise Adaptive Rescaling Veneer for Model Merging
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
par: Zhang, Dengming, et autres
Publié: (2025)
par: Zhang, Dengming, et autres
Publié: (2025)
May the Forgetting Be with You: Alternate Replay for Learning with Noisy Labels
par: Millunzi, Monica, et autres
Publié: (2024)
par: Millunzi, Monica, et autres
Publié: (2024)
Accurate and Efficient Low-Rank Model Merging in Core Space
par: Panariello, Aniello, et autres
Publié: (2025)
par: Panariello, Aniello, et autres
Publié: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
par: Liang, Yunfei
Publié: (2025)
par: Liang, Yunfei
Publié: (2025)
Towards Minimizing Feature Drift in Model Merging: Layer-wise Task Vector Fusion for Adaptive Knowledge Integration
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
SyMerge: From Non-Interference to Synergistic Merging via Single-Layer Adaptation
par: Jung, Aecheon, et autres
Publié: (2024)
par: Jung, Aecheon, et autres
Publié: (2024)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
par: Shenaj, Donald, et autres
Publié: (2025)
par: Shenaj, Donald, et autres
Publié: (2025)
Update Your Transformer to the Latest Release: Re-Basin of Task Vectors
par: Rinaldi, Filippo, et autres
Publié: (2025)
par: Rinaldi, Filippo, et autres
Publié: (2025)
FedMerge: Federated Personalization via Model Merging
par: Chen, Shutong, et autres
Publié: (2025)
par: Chen, Shutong, et autres
Publié: (2025)
From Coefficients to Directions: Rethinking Model Merging with Directional Alignment
par: Chen, Zhikang, et autres
Publié: (2025)
par: Chen, Zhikang, et autres
Publié: (2025)
STAER: Temporal Aligned Rehearsal for Continual Spiking Neural Network
par: Gianferrari, Matteo, et autres
Publié: (2026)
par: Gianferrari, Matteo, et autres
Publié: (2026)
Dataless Knowledge Fusion by Merging Weights of Language Models
par: Jin, Xisen, et autres
Publié: (2022)
par: Jin, Xisen, et autres
Publié: (2022)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
par: Li, Siyuan, et autres
Publié: (2025)
par: Li, Siyuan, et autres
Publié: (2025)
Orthogonal Model Merging
par: Yang, Sihan, et autres
Publié: (2026)
par: Yang, Sihan, et autres
Publié: (2026)
BadMerging: Backdoor Attacks Against Model Merging
par: Zhang, Jinghuai, et autres
Publié: (2024)
par: Zhang, Jinghuai, et autres
Publié: (2024)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
par: Chen, Weiyu, et autres
Publié: (2024)
par: Chen, Weiyu, et autres
Publié: (2024)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
par: Tang, Yao, et autres
Publié: (2026)
par: Tang, Yao, et autres
Publié: (2026)
MergeQuant: Accurate 4-bit Static Quantization of Large Language Models by Channel-wise Calibration
par: Wang, Jinguang, et autres
Publié: (2025)
par: Wang, Jinguang, et autres
Publié: (2025)
Documents similaires
-
Trajectory Forecasting through Low-Rank Adaptation of Discrete Latent Codes
par: Benaglia, Riccardo, et autres
Publié: (2024) -
Federated Class-Incremental Learning with Hierarchical Generative Prototypes
par: Salami, Riccardo, et autres
Publié: (2024) -
Intrinsic Training Signals for Federated Learning Aggregation
par: Fiorini, Cosimo, et autres
Publié: (2025) -
A Second-Order Perspective on Model Compositionality and Incremental Learning
par: Porrello, Angelo, et autres
Publié: (2024) -
CLIP with Generative Latent Replay: a Strong Baseline for Incremental Learning
par: Frascaroli, Emanuele, et autres
Publié: (2024)