Model Merging with Functional Dual Anchors
Fuente:
arXiv
Guardado en:
| Autores principales: | Shi, Kexuan, Wen, Yandong, Liu, Weiyang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Orthogonal Model Merging
por: Yang, Sihan, et al.
Publicado: (2026)
por: Yang, Sihan, et al.
Publicado: (2026)
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
por: Shi, Kexuan, et al.
Publicado: (2026)
por: Shi, Kexuan, et al.
Publicado: (2026)
Symbolic Graphics Programming with Large Language Models
por: Chen, Yamei, et al.
Publicado: (2025)
por: Chen, Yamei, et al.
Publicado: (2025)
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
por: Wang, Kexuan, et al.
Publicado: (2025)
por: Wang, Kexuan, et al.
Publicado: (2025)
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
por: Wang, Kexuan, et al.
Publicado: (2025)
por: Wang, Kexuan, et al.
Publicado: (2025)
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
por: Huang, Yangyi, et al.
Publicado: (2026)
por: Huang, Yangyi, et al.
Publicado: (2026)
Drifting Preference Optimization for One-Step Generative Models
por: Jiang, Zhou, et al.
Publicado: (2026)
por: Jiang, Zhou, et al.
Publicado: (2026)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
por: Wang, Kexuan, et al.
Publicado: (2023)
por: Wang, Kexuan, et al.
Publicado: (2023)
Context-aware Constrained Reinforcement Learning Based Energy-Efficient Power Scheduling for Non-stationary XR Data Traffic
por: Wang, Kexuan, et al.
Publicado: (2025)
por: Wang, Kexuan, et al.
Publicado: (2025)
Anchor-guided Hypergraph Condensation with Dual-level Discrimination
por: Li, Fan, et al.
Publicado: (2026)
por: Li, Fan, et al.
Publicado: (2026)
Behavior Knowledge Merge in Reinforced Agentic Models
por: Yuan, Xiangchi, et al.
Publicado: (2026)
por: Yuan, Xiangchi, et al.
Publicado: (2026)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
por: Xie, Guofu, et al.
Publicado: (2025)
por: Xie, Guofu, et al.
Publicado: (2025)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
por: Yu, Zhouliang, et al.
Publicado: (2025)
por: Yu, Zhouliang, et al.
Publicado: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
por: Zhang, Bingjie, et al.
Publicado: (2025)
por: Zhang, Bingjie, et al.
Publicado: (2025)
Causal Learning for Heterogeneous Subgroups Based on Nonlinear Causal Kernel Clustering
por: Liu, Lu, et al.
Publicado: (2025)
por: Liu, Lu, et al.
Publicado: (2025)
FedMerge: Federated Personalization via Model Merging
por: Chen, Shutong, et al.
Publicado: (2025)
por: Chen, Shutong, et al.
Publicado: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
por: Liang, Yunfei
Publicado: (2025)
por: Liang, Yunfei
Publicado: (2025)
Caformer: Rethinking Time Series Analysis from Causal Perspective
por: Zhang, Kexuan, et al.
Publicado: (2024)
por: Zhang, Kexuan, et al.
Publicado: (2024)
Anchor-free Clustering based on Anchor Graph Factorization
por: Mei, Shikun, et al.
Publicado: (2024)
por: Mei, Shikun, et al.
Publicado: (2024)
Rethinking Layer-wise Model Merging through Chain of Merges
por: Buzzega, Pietro, et al.
Publicado: (2025)
por: Buzzega, Pietro, et al.
Publicado: (2025)
Norm Anchors Make Model Edits Last
por: Liu, Mingda, et al.
Publicado: (2026)
por: Liu, Mingda, et al.
Publicado: (2026)
Variance-aware Reward Modeling with Anchor Guidance
por: Fang, Shuxing, et al.
Publicado: (2026)
por: Fang, Shuxing, et al.
Publicado: (2026)
Breaking the Reasoning Horizon in Entity Alignment Foundation Models
por: Cui, Yuanning, et al.
Publicado: (2026)
por: Cui, Yuanning, et al.
Publicado: (2026)
Floating Anchor Diffusion Model for Multi-motif Scaffolding
por: Liu, Ke, et al.
Publicado: (2024)
por: Liu, Ke, et al.
Publicado: (2024)
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
por: Miao, Ruijie, et al.
Publicado: (2025)
por: Miao, Ruijie, et al.
Publicado: (2025)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
por: Chen, Weiyu, et al.
Publicado: (2024)
por: Chen, Weiyu, et al.
Publicado: (2024)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
por: Wang, Zijing, et al.
Publicado: (2025)
por: Wang, Zijing, et al.
Publicado: (2025)
AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors
por: Zhao, Mengnan, et al.
Publicado: (2024)
por: Zhao, Mengnan, et al.
Publicado: (2024)
Inductive Gradient Adjustment For Spectral Bias In Implicit Neural Representations
por: Shi, Kexuan, et al.
Publicado: (2024)
por: Shi, Kexuan, et al.
Publicado: (2024)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
por: Tang, Anke, et al.
Publicado: (2025)
por: Tang, Anke, et al.
Publicado: (2025)
Merge Now, Regret Later: The Hidden Cost of Model Merging is Adversarial Transferability
por: Gangwal, Ankit, et al.
Publicado: (2025)
por: Gangwal, Ankit, et al.
Publicado: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
por: Zhou, Wenjie, et al.
Publicado: (2026)
por: Zhou, Wenjie, et al.
Publicado: (2026)
BadMerging: Backdoor Attacks Against Model Merging
por: Zhang, Jinghuai, et al.
Publicado: (2024)
por: Zhang, Jinghuai, et al.
Publicado: (2024)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
por: Morrison, Jacob, et al.
Publicado: (2024)
por: Morrison, Jacob, et al.
Publicado: (2024)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
por: Zhang, Dengming, et al.
Publicado: (2025)
por: Zhang, Dengming, et al.
Publicado: (2025)
Parameter-Efficient Checkpoint Merging via Metrics-Weighted Averaging
por: Yu, Shi Jie, et al.
Publicado: (2025)
por: Yu, Shi Jie, et al.
Publicado: (2025)
Sparsity-Aware Evolution for Model Merging
por: Zhang, Huan, et al.
Publicado: (2026)
por: Zhang, Huan, et al.
Publicado: (2026)
CavMerge: Merging K-means Based on Local Log-Concavity
por: Qiao, Zhili, et al.
Publicado: (2026)
por: Qiao, Zhili, et al.
Publicado: (2026)
Out-of-Distribution Graph Models Merging
por: Wang, Yidi, et al.
Publicado: (2025)
por: Wang, Yidi, et al.
Publicado: (2025)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
por: Yang, Enneng, et al.
Publicado: (2023)
por: Yang, Enneng, et al.
Publicado: (2023)
Ejemplares similares
-
Orthogonal Model Merging
por: Yang, Sihan, et al.
Publicado: (2026) -
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
por: Shi, Kexuan, et al.
Publicado: (2026) -
Symbolic Graphics Programming with Large Language Models
por: Chen, Yamei, et al.
Publicado: (2025) -
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
por: Wang, Kexuan, et al.
Publicado: (2025) -
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
por: Wang, Kexuan, et al.
Publicado: (2025)