MOMA: Masked Orthogonal Matrix Alignment for Zero-Additional-Parameter Model Merging
Fuente:
arXiv
Guardado en:
| Autores principales: | Kong, Fanshuang, Zhang, Richong, Nie, Zhijie, Zhou, Hang, Wang, Ziqiao, Sun, Qiang, Hu, Chunming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Activated Parameter Locating via Causal Intervention for Model Merging
por: Kong, Fanshuang, et al.
Publicado: (2024)
por: Kong, Fanshuang, et al.
Publicado: (2024)
LH-Mix: Local Hierarchy Correlation Guided Mixup over Hierarchical Prompt Tuning
por: Kong, Fanshuang, et al.
Publicado: (2024)
por: Kong, Fanshuang, et al.
Publicado: (2024)
inversedMixup: Data Augmentation via Inverting Mixed Embeddings
por: Kong, Fanshuang, et al.
Publicado: (2026)
por: Kong, Fanshuang, et al.
Publicado: (2026)
On SkipGram Word Embedding Models with Negative Sampling: Unified Framework and Impact of Noise Distributions
por: Liu, Dezhi, et al.
Publicado: (2020)
por: Liu, Dezhi, et al.
Publicado: (2020)
Improving Zero-Shot Cross-Lingual Transfer via Progressive Code-Switching
por: Li, Zhuoran, et al.
Publicado: (2024)
por: Li, Zhuoran, et al.
Publicado: (2024)
Nora: Normalized Orthogonal Row Alignment for Scalable Matrix Optimizer
por: Yuan, Jinghui, et al.
Publicado: (2026)
por: Yuan, Jinghui, et al.
Publicado: (2026)
Implicit Word Reordering with Knowledge Distillation for Cross-Lingual Dependency Parsing
por: Li, Zhuoran, et al.
Publicado: (2025)
por: Li, Zhuoran, et al.
Publicado: (2025)
Orthogonal Model Merging
por: Yang, Sihan, et al.
Publicado: (2026)
por: Yang, Sihan, et al.
Publicado: (2026)
Improved Operator Learning by Orthogonal Attention
por: Xiao, Zipeng, et al.
Publicado: (2023)
por: Xiao, Zipeng, et al.
Publicado: (2023)
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
por: Sun, Guanglong, et al.
Publicado: (2026)
por: Sun, Guanglong, et al.
Publicado: (2026)
Unraveling LoRA Interference: Orthogonal Subspaces for Robust Model Merging
por: Zhang, Haobo, et al.
Publicado: (2025)
por: Zhang, Haobo, et al.
Publicado: (2025)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
por: Zhang, Dengming, et al.
Publicado: (2025)
por: Zhang, Dengming, et al.
Publicado: (2025)
Model Breadcrumbs: Scaling Multi-Task Model Merging with Sparse Masks
por: Davari, MohammadReza, et al.
Publicado: (2023)
por: Davari, MohammadReza, et al.
Publicado: (2023)
Rethinking Graph Masked Autoencoders through Alignment and Uniformity
por: Wang, Liang, et al.
Publicado: (2024)
por: Wang, Liang, et al.
Publicado: (2024)
FedMerge: Federated Personalization via Model Merging
por: Chen, Shutong, et al.
Publicado: (2025)
por: Chen, Shutong, et al.
Publicado: (2025)
Fisher Mask Nodes for Language Model Merging
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
From Coefficients to Directions: Rethinking Model Merging with Directional Alignment
por: Chen, Zhikang, et al.
Publicado: (2025)
por: Chen, Zhikang, et al.
Publicado: (2025)
Non-Uniform Parameter-Wise Model Merging
por: Camacho, Albert Manuel Orozco, et al.
Publicado: (2024)
por: Camacho, Albert Manuel Orozco, et al.
Publicado: (2024)
Merging by Matching Models in Task Parameter Subspaces
por: Tam, Derek, et al.
Publicado: (2023)
por: Tam, Derek, et al.
Publicado: (2023)
FedMuon: Accelerating Federated Learning with Matrix Orthogonalization
por: Liu, Junkang, et al.
Publicado: (2025)
por: Liu, Junkang, et al.
Publicado: (2025)
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
por: Li, Mingxin, et al.
Publicado: (2024)
por: Li, Mingxin, et al.
Publicado: (2024)
Decouple and Orthogonalize: A Data-Free Framework for LoRA Merging
por: Zheng, Shenghe, et al.
Publicado: (2025)
por: Zheng, Shenghe, et al.
Publicado: (2025)
Orthogonalized Multimodal Contrastive Learning with Asymmetric Masking for Structured Representations
por: Cissee, Carolin, et al.
Publicado: (2026)
por: Cissee, Carolin, et al.
Publicado: (2026)
Cross-attention Secretly Performs Orthogonal Alignment in Recommendation Models
por: Lee, Hyunin, et al.
Publicado: (2025)
por: Lee, Hyunin, et al.
Publicado: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
por: Zhou, Wenjie, et al.
Publicado: (2026)
por: Zhou, Wenjie, et al.
Publicado: (2026)
Sparse Orthogonal Parameters Tuning for Continual Learning
por: Ning, Kun-Peng, et al.
Publicado: (2024)
por: Ning, Kun-Peng, et al.
Publicado: (2024)
MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer
por: Wang, Yuancheng, et al.
Publicado: (2024)
por: Wang, Yuancheng, et al.
Publicado: (2024)
SeMe: Training-Free Language Model Merging via Semantic Alignment
por: Gu, Jian, et al.
Publicado: (2025)
por: Gu, Jian, et al.
Publicado: (2025)
MergeSFL: Split Federated Learning with Feature Merging and Batch Size Regulation
por: Liao, Yunming, et al.
Publicado: (2023)
por: Liao, Yunming, et al.
Publicado: (2023)
Modular Delta Merging with Orthogonal Constraints: A Scalable Framework for Continual and Reversible Model Composition
por: Khan, Haris, et al.
Publicado: (2025)
por: Khan, Haris, et al.
Publicado: (2025)
Dynamic Task Vector Grouping for Efficient Multi-Task Prompt Tuning
por: Zhang, Pieyi, et al.
Publicado: (2025)
por: Zhang, Pieyi, et al.
Publicado: (2025)
FedSKD: Aggregation-free Model-heterogeneous Federated Learning via Multi-dimensional Similarity Knowledge Distillation for Medical Image Classification
por: Weng, Ziqiao, et al.
Publicado: (2025)
por: Weng, Ziqiao, et al.
Publicado: (2025)
Parameter Competition Balancing for Model Merging
por: Du, Guodong, et al.
Publicado: (2024)
por: Du, Guodong, et al.
Publicado: (2024)
Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment
por: Lu, Keming, et al.
Publicado: (2024)
por: Lu, Keming, et al.
Publicado: (2024)
Adaptive Tokenization: On the Hop-Overpriority Problem in Tokenized Graph Learning Models
por: Wang, Zhibiao, et al.
Publicado: (2025)
por: Wang, Zhibiao, et al.
Publicado: (2025)
Training-Free Self-Correction for Multimodal Masked Diffusion Models
por: Ouyang, Yidong, et al.
Publicado: (2026)
por: Ouyang, Yidong, et al.
Publicado: (2026)
COMPOT: Calibration-Optimized Matrix Procrustes Orthogonalization for Transformers Compression
por: Makhov, Denis, et al.
Publicado: (2026)
por: Makhov, Denis, et al.
Publicado: (2026)
T3: Test-Time Model Merging in VLMs for Zero-Shot Medical Imaging Analysis
por: Imam, Raza, et al.
Publicado: (2025)
por: Imam, Raza, et al.
Publicado: (2025)
Rethinking Inter-LoRA Orthogonality in Adapter Merging: Insights from Orthogonal Monte Carlo Dropout
por: Zhang, Andi, et al.
Publicado: (2025)
por: Zhang, Andi, et al.
Publicado: (2025)
MergeBench: A Benchmark for Merging Domain-Specialized LLMs
por: He, Yifei, et al.
Publicado: (2025)
por: He, Yifei, et al.
Publicado: (2025)
Ejemplares similares
-
Activated Parameter Locating via Causal Intervention for Model Merging
por: Kong, Fanshuang, et al.
Publicado: (2024) -
LH-Mix: Local Hierarchy Correlation Guided Mixup over Hierarchical Prompt Tuning
por: Kong, Fanshuang, et al.
Publicado: (2024) -
inversedMixup: Data Augmentation via Inverting Mixed Embeddings
por: Kong, Fanshuang, et al.
Publicado: (2026) -
On SkipGram Word Embedding Models with Negative Sampling: Unified Framework and Impact of Noise Distributions
por: Liu, Dezhi, et al.
Publicado: (2020) -
Improving Zero-Shot Cross-Lingual Transfer via Progressive Code-Switching
por: Li, Zhuoran, et al.
Publicado: (2024)