SurgeryV2: Bridging the Gap Between Model Merging and Multi-Task Learning with Deep Representation Surgery
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Enneng, Shen, Li, Wang, Zhenyi, Guo, Guibing, Wang, Xingwei, Cao, Xiaocun, Zhang, Jie, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Representation Surgery for Multi-Task Model Merging
by: Yang, Enneng, et al.
Published: (2024)
by: Yang, Enneng, et al.
Published: (2024)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
by: Yang, Enneng, et al.
Published: (2023)
by: Yang, Enneng, et al.
Published: (2023)
Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities
by: Yang, Enneng, et al.
Published: (2024)
by: Yang, Enneng, et al.
Published: (2024)
Continual Learning From a Stream of APIs
by: Yang, Enneng, et al.
Published: (2023)
by: Yang, Enneng, et al.
Published: (2023)
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
by: Shen, Li, et al.
Published: (2024)
by: Shen, Li, et al.
Published: (2024)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
by: Lan, Pengxiang, et al.
Published: (2024)
by: Lan, Pengxiang, et al.
Published: (2024)
Symmetric Graph Contrastive Learning against Noisy Views for Recommendation
by: Zhao, Chu, et al.
Published: (2024)
by: Zhao, Chu, et al.
Published: (2024)
A Comprehensive Survey of Forgetting in Deep Learning Beyond Continual Learning
by: Wang, Zhenyi, et al.
Published: (2023)
by: Wang, Zhenyi, et al.
Published: (2023)
AdaTask: A Task-aware Adaptive Learning Rate Approach to Multi-task Learning
by: Yang, Enneng, et al.
Published: (2022)
by: Yang, Enneng, et al.
Published: (2022)
Graph Representation Learning via Causal Diffusion for Out-of-Distribution Recommendation
by: Zhao, Chu, et al.
Published: (2024)
by: Zhao, Chu, et al.
Published: (2024)
Distributionally Robust Graph Out-of-Distribution Recommendation via Diffusion Model
by: Zhao, Chu, et al.
Published: (2025)
by: Zhao, Chu, et al.
Published: (2025)
Self-supervised Hierarchical Representation for Medication Recommendation
by: Liang, Yuliang, et al.
Published: (2024)
by: Liang, Yuliang, et al.
Published: (2024)
Generalized Embedding Machines for Recommender Systems
by: Yang, Enneng, et al.
Published: (2020)
by: Yang, Enneng, et al.
Published: (2020)
Data Augmentation for Sequential Recommendation: A Survey
by: Dang, Yizhou, et al.
Published: (2024)
by: Dang, Yizhou, et al.
Published: (2024)
Repeated Padding+: Simple yet Effective Data Augmentation Plugin for Sequential Recommendation
by: Dang, Yizhou, et al.
Published: (2024)
by: Dang, Yizhou, et al.
Published: (2024)
Efficient and Effective Prompt Tuning via Prompt Decomposition and Compressed Outer Product
by: Lan, Pengxiang, et al.
Published: (2025)
by: Lan, Pengxiang, et al.
Published: (2025)
Data Augmentation as Free Lunch: Exploring the Test-Time Augmentation for Sequential Recommendation
by: Dang, Yizhou, et al.
Published: (2025)
by: Dang, Yizhou, et al.
Published: (2025)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
by: Tang, Anke, et al.
Published: (2025)
by: Tang, Anke, et al.
Published: (2025)
Causal Direct Preference Optimization for Distributionally Robust Generative Recommendation
by: Zhao, Chu, et al.
Published: (2026)
by: Zhao, Chu, et al.
Published: (2026)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
by: Wei, Yongxian, et al.
Published: (2025)
by: Wei, Yongxian, et al.
Published: (2025)
ECHO: Entropy-Confidence Hybrid Optimization for Test-Time Reinforcement Learning
by: Zhao, Chu, et al.
Published: (2026)
by: Zhao, Chu, et al.
Published: (2026)
ID Embedding as Subtle Features of Content and Structure for Multimodal Recommendation
by: Liu, Yuting, et al.
Published: (2023)
by: Liu, Yuting, et al.
Published: (2023)
Augmenting Sequential Recommendation with Balanced Relevance and Diversity
by: Dang, Yizhou, et al.
Published: (2024)
by: Dang, Yizhou, et al.
Published: (2024)
Hard Negative Sampling via Large Language Models for Recommendation
by: Zhao, Chu, et al.
Published: (2025)
by: Zhao, Chu, et al.
Published: (2025)
Task-Distributionally Robust Data-Free Meta-Learning
by: Hu, Zixuan, et al.
Published: (2023)
by: Hu, Zixuan, et al.
Published: (2023)
Gradient Similarity Surgery in Multi-Task Deep Learning
by: Borsani, Thomas, et al.
Published: (2025)
by: Borsani, Thomas, et al.
Published: (2025)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
by: Tang, Anke, et al.
Published: (2024)
by: Tang, Anke, et al.
Published: (2024)
Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
by: Wei, Yongxian, et al.
Published: (2024)
by: Wei, Yongxian, et al.
Published: (2024)
Learning to Learn from APIs: Black-Box Data-Free Meta-Learning
by: Hu, Zixuan, et al.
Published: (2023)
by: Hu, Zixuan, et al.
Published: (2023)
MMGRid: Navigating Temporal-aware and Cross-domain Generative Recommendation via Model Merging
by: Wei, Tianjun, et al.
Published: (2026)
by: Wei, Tianjun, et al.
Published: (2026)
A Novel Generative Multi-Task Representation Learning Approach for Predicting Postoperative Complications in Cardiac Surgery Patients
by: Shen, Junbo, et al.
Published: (2024)
by: Shen, Junbo, et al.
Published: (2024)
FREE: Faster and Better Data-Free Meta-Learning
by: Wei, Yongxian, et al.
Published: (2024)
by: Wei, Yongxian, et al.
Published: (2024)
FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
by: Tang, Anke, et al.
Published: (2024)
by: Tang, Anke, et al.
Published: (2024)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
by: Hu, Zixuan, et al.
Published: (2025)
by: Hu, Zixuan, et al.
Published: (2025)
Architecture, Dataset and Model-Scale Agnostic Data-free Meta-Learning
by: Hu, Zixuan, et al.
Published: (2023)
by: Hu, Zixuan, et al.
Published: (2023)
Causal Negative Sampling via Diffusion Model for Out-of-Distribution Recommendation
by: Zhao, Chu, et al.
Published: (2025)
by: Zhao, Chu, et al.
Published: (2025)
Towards Understanding Generalization and Stability Gaps between Centralized and Decentralized Federated Learning
by: Sun, Yan, et al.
Published: (2023)
by: Sun, Yan, et al.
Published: (2023)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
by: Fan, Ziqing, et al.
Published: (2024)
by: Fan, Ziqing, et al.
Published: (2024)
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
by: Hu, Shengchao, et al.
Published: (2024)
by: Hu, Shengchao, et al.
Published: (2024)
Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
by: Chen, Yang, et al.
Published: (2024)
by: Chen, Yang, et al.
Published: (2024)
Similar Items
-
Representation Surgery for Multi-Task Model Merging
by: Yang, Enneng, et al.
Published: (2024) -
AdaMerging: Adaptive Model Merging for Multi-Task Learning
by: Yang, Enneng, et al.
Published: (2023) -
Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities
by: Yang, Enneng, et al.
Published: (2024) -
Continual Learning From a Stream of APIs
by: Yang, Enneng, et al.
Published: (2023) -
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
by: Shen, Li, et al.
Published: (2024)