Model Merging with Functional Dual Anchors
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shi, Kexuan, Wen, Yandong, Liu, Weiyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Orthogonal Model Merging
von: Yang, Sihan, et al.
Veröffentlicht: (2026)
von: Yang, Sihan, et al.
Veröffentlicht: (2026)
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
von: Shi, Kexuan, et al.
Veröffentlicht: (2026)
von: Shi, Kexuan, et al.
Veröffentlicht: (2026)
Symbolic Graphics Programming with Large Language Models
von: Chen, Yamei, et al.
Veröffentlicht: (2025)
von: Chen, Yamei, et al.
Veröffentlicht: (2025)
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
von: Huang, Yangyi, et al.
Veröffentlicht: (2026)
von: Huang, Yangyi, et al.
Veröffentlicht: (2026)
Drifting Preference Optimization for One-Step Generative Models
von: Jiang, Zhou, et al.
Veröffentlicht: (2026)
von: Jiang, Zhou, et al.
Veröffentlicht: (2026)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
von: Wang, Kexuan, et al.
Veröffentlicht: (2023)
von: Wang, Kexuan, et al.
Veröffentlicht: (2023)
Context-aware Constrained Reinforcement Learning Based Energy-Efficient Power Scheduling for Non-stationary XR Data Traffic
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)
Anchor-guided Hypergraph Condensation with Dual-level Discrimination
von: Li, Fan, et al.
Veröffentlicht: (2026)
von: Li, Fan, et al.
Veröffentlicht: (2026)
Behavior Knowledge Merge in Reinforced Agentic Models
von: Yuan, Xiangchi, et al.
Veröffentlicht: (2026)
von: Yuan, Xiangchi, et al.
Veröffentlicht: (2026)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
von: Yu, Zhouliang, et al.
Veröffentlicht: (2025)
von: Yu, Zhouliang, et al.
Veröffentlicht: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
von: Zhang, Bingjie, et al.
Veröffentlicht: (2025)
von: Zhang, Bingjie, et al.
Veröffentlicht: (2025)
Causal Learning for Heterogeneous Subgroups Based on Nonlinear Causal Kernel Clustering
von: Liu, Lu, et al.
Veröffentlicht: (2025)
von: Liu, Lu, et al.
Veröffentlicht: (2025)
FedMerge: Federated Personalization via Model Merging
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
von: Liang, Yunfei
Veröffentlicht: (2025)
von: Liang, Yunfei
Veröffentlicht: (2025)
Caformer: Rethinking Time Series Analysis from Causal Perspective
von: Zhang, Kexuan, et al.
Veröffentlicht: (2024)
von: Zhang, Kexuan, et al.
Veröffentlicht: (2024)
Anchor-free Clustering based on Anchor Graph Factorization
von: Mei, Shikun, et al.
Veröffentlicht: (2024)
von: Mei, Shikun, et al.
Veröffentlicht: (2024)
Rethinking Layer-wise Model Merging through Chain of Merges
von: Buzzega, Pietro, et al.
Veröffentlicht: (2025)
von: Buzzega, Pietro, et al.
Veröffentlicht: (2025)
Norm Anchors Make Model Edits Last
von: Liu, Mingda, et al.
Veröffentlicht: (2026)
von: Liu, Mingda, et al.
Veröffentlicht: (2026)
Variance-aware Reward Modeling with Anchor Guidance
von: Fang, Shuxing, et al.
Veröffentlicht: (2026)
von: Fang, Shuxing, et al.
Veröffentlicht: (2026)
Breaking the Reasoning Horizon in Entity Alignment Foundation Models
von: Cui, Yuanning, et al.
Veröffentlicht: (2026)
von: Cui, Yuanning, et al.
Veröffentlicht: (2026)
Floating Anchor Diffusion Model for Multi-motif Scaffolding
von: Liu, Ke, et al.
Veröffentlicht: (2024)
von: Liu, Ke, et al.
Veröffentlicht: (2024)
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
von: Miao, Ruijie, et al.
Veröffentlicht: (2025)
von: Miao, Ruijie, et al.
Veröffentlicht: (2025)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
von: Chen, Weiyu, et al.
Veröffentlicht: (2024)
von: Chen, Weiyu, et al.
Veröffentlicht: (2024)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
von: Wang, Zijing, et al.
Veröffentlicht: (2025)
von: Wang, Zijing, et al.
Veröffentlicht: (2025)
AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors
von: Zhao, Mengnan, et al.
Veröffentlicht: (2024)
von: Zhao, Mengnan, et al.
Veröffentlicht: (2024)
Inductive Gradient Adjustment For Spectral Bias In Implicit Neural Representations
von: Shi, Kexuan, et al.
Veröffentlicht: (2024)
von: Shi, Kexuan, et al.
Veröffentlicht: (2024)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
von: Tang, Anke, et al.
Veröffentlicht: (2025)
von: Tang, Anke, et al.
Veröffentlicht: (2025)
Merge Now, Regret Later: The Hidden Cost of Model Merging is Adversarial Transferability
von: Gangwal, Ankit, et al.
Veröffentlicht: (2025)
von: Gangwal, Ankit, et al.
Veröffentlicht: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
von: Zhou, Wenjie, et al.
Veröffentlicht: (2026)
von: Zhou, Wenjie, et al.
Veröffentlicht: (2026)
BadMerging: Backdoor Attacks Against Model Merging
von: Zhang, Jinghuai, et al.
Veröffentlicht: (2024)
von: Zhang, Jinghuai, et al.
Veröffentlicht: (2024)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
von: Morrison, Jacob, et al.
Veröffentlicht: (2024)
von: Morrison, Jacob, et al.
Veröffentlicht: (2024)
Expert Merging: Model Merging with Unsupervised Expert Alignment and Importance-Guided Layer Chunking
von: Zhang, Dengming, et al.
Veröffentlicht: (2025)
von: Zhang, Dengming, et al.
Veröffentlicht: (2025)
Parameter-Efficient Checkpoint Merging via Metrics-Weighted Averaging
von: Yu, Shi Jie, et al.
Veröffentlicht: (2025)
von: Yu, Shi Jie, et al.
Veröffentlicht: (2025)
Sparsity-Aware Evolution for Model Merging
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
CavMerge: Merging K-means Based on Local Log-Concavity
von: Qiao, Zhili, et al.
Veröffentlicht: (2026)
von: Qiao, Zhili, et al.
Veröffentlicht: (2026)
Out-of-Distribution Graph Models Merging
von: Wang, Yidi, et al.
Veröffentlicht: (2025)
von: Wang, Yidi, et al.
Veröffentlicht: (2025)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Orthogonal Model Merging
von: Yang, Sihan, et al.
Veröffentlicht: (2026) -
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
von: Shi, Kexuan, et al.
Veröffentlicht: (2026) -
Symbolic Graphics Programming with Large Language Models
von: Chen, Yamei, et al.
Veröffentlicht: (2025) -
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
von: Wang, Kexuan, et al.
Veröffentlicht: (2025) -
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
von: Wang, Kexuan, et al.
Veröffentlicht: (2025)