Saved in:
| Main Authors: | Shi, Kexuan, Wen, Yandong, Liu, Weiyang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2510.21223 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Orthogonal Model Merging
by: Yang, Sihan, et al.
Published: (2026)
by: Yang, Sihan, et al.
Published: (2026)
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
by: Shi, Kexuan, et al.
Published: (2026)
by: Shi, Kexuan, et al.
Published: (2026)
Symbolic Graphics Programming with Large Language Models
by: Chen, Yamei, et al.
Published: (2025)
by: Chen, Yamei, et al.
Published: (2025)
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
by: Huang, Yangyi, et al.
Published: (2026)
by: Huang, Yangyi, et al.
Published: (2026)
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
Drifting Preference Optimization for One-Step Generative Models
by: Jiang, Zhou, et al.
Published: (2026)
by: Jiang, Zhou, et al.
Published: (2026)
Context-aware Constrained Reinforcement Learning Based Energy-Efficient Power Scheduling for Non-stationary XR Data Traffic
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
by: Wang, Kexuan, et al.
Published: (2023)
by: Wang, Kexuan, et al.
Published: (2023)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
by: Yu, Zhouliang, et al.
Published: (2025)
by: Yu, Zhouliang, et al.
Published: (2025)
Anchor-guided Hypergraph Condensation with Dual-level Discrimination
by: Li, Fan, et al.
Published: (2026)
by: Li, Fan, et al.
Published: (2026)
Behavior Knowledge Merge in Reinforced Agentic Models
by: Yuan, Xiangchi, et al.
Published: (2026)
by: Yuan, Xiangchi, et al.
Published: (2026)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
by: Xie, Guofu, et al.
Published: (2025)
by: Xie, Guofu, et al.
Published: (2025)
Causal Learning for Heterogeneous Subgroups Based on Nonlinear Causal Kernel Clustering
by: Liu, Lu, et al.
Published: (2025)
by: Liu, Lu, et al.
Published: (2025)
Caformer: Rethinking Time Series Analysis from Causal Perspective
by: Zhang, Kexuan, et al.
Published: (2024)
by: Zhang, Kexuan, et al.
Published: (2024)
Inductive Gradient Adjustment For Spectral Bias In Implicit Neural Representations
by: Shi, Kexuan, et al.
Published: (2024)
by: Shi, Kexuan, et al.
Published: (2024)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
by: Zhang, Bingjie, et al.
Published: (2025)
by: Zhang, Bingjie, et al.
Published: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
by: Liang, Yunfei
Published: (2025)
by: Liang, Yunfei
Published: (2025)
Breaking the Reasoning Horizon in Entity Alignment Foundation Models
by: Cui, Yuanning, et al.
Published: (2026)
by: Cui, Yuanning, et al.
Published: (2026)
Anchor-free Clustering based on Anchor Graph Factorization
by: Mei, Shikun, et al.
Published: (2024)
by: Mei, Shikun, et al.
Published: (2024)
FedMerge: Federated Personalization via Model Merging
by: Chen, Shutong, et al.
Published: (2025)
by: Chen, Shutong, et al.
Published: (2025)
Norm Anchors Make Model Edits Last
by: Liu, Mingda, et al.
Published: (2026)
by: Liu, Mingda, et al.
Published: (2026)
VERA: Explainable Video Anomaly Detection via Verbalized Learning of Vision-Language Models
by: Ye, Muchao, et al.
Published: (2024)
by: Ye, Muchao, et al.
Published: (2024)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
by: Qiu, Zeju, et al.
Published: (2026)
by: Qiu, Zeju, et al.
Published: (2026)
AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors
by: Zhao, Mengnan, et al.
Published: (2024)
by: Zhao, Mengnan, et al.
Published: (2024)
Rethinking Layer-wise Model Merging through Chain of Merges
by: Buzzega, Pietro, et al.
Published: (2025)
by: Buzzega, Pietro, et al.
Published: (2025)
Floating Anchor Diffusion Model for Multi-motif Scaffolding
by: Liu, Ke, et al.
Published: (2024)
by: Liu, Ke, et al.
Published: (2024)
Variance-aware Reward Modeling with Anchor Guidance
by: Fang, Shuxing, et al.
Published: (2026)
by: Fang, Shuxing, et al.
Published: (2026)
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
by: Miao, Ruijie, et al.
Published: (2025)
by: Miao, Ruijie, et al.
Published: (2025)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
by: Chen, Weiyu, et al.
Published: (2024)
by: Chen, Weiyu, et al.
Published: (2024)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
by: Wang, Zijing, et al.
Published: (2025)
by: Wang, Zijing, et al.
Published: (2025)
BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning
by: Qing, Yunpeng, et al.
Published: (2025)
by: Qing, Yunpeng, et al.
Published: (2025)
Hierarchical Koopman Diffusion: Fast Generation with Interpretable Diffusion Trajectory
by: Bai, Hanru, et al.
Published: (2025)
by: Bai, Hanru, et al.
Published: (2025)
A Compact Representation for Bayesian Neural Networks By Removing Permutation Symmetry
by: Xiao, Tim Z., et al.
Published: (2023)
by: Xiao, Tim Z., et al.
Published: (2023)
BadMerging: Backdoor Attacks Against Model Merging
by: Zhang, Jinghuai, et al.
Published: (2024)
by: Zhang, Jinghuai, et al.
Published: (2024)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
by: Yang, Enneng, et al.
Published: (2023)
by: Yang, Enneng, et al.
Published: (2023)
Merge Now, Regret Later: The Hidden Cost of Model Merging is Adversarial Transferability
by: Gangwal, Ankit, et al.
Published: (2025)
by: Gangwal, Ankit, et al.
Published: (2025)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
by: Tang, Anke, et al.
Published: (2025)
by: Tang, Anke, et al.
Published: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
by: Zhou, Wenjie, et al.
Published: (2026)
by: Zhou, Wenjie, et al.
Published: (2026)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
by: Morrison, Jacob, et al.
Published: (2024)
by: Morrison, Jacob, et al.
Published: (2024)
Similar Items
-
Orthogonal Model Merging
by: Yang, Sihan, et al.
Published: (2026) -
Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation
by: Shi, Kexuan, et al.
Published: (2026) -
Symbolic Graphics Programming with Large Language Models
by: Chen, Yamei, et al.
Published: (2025) -
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
by: Huang, Yangyi, et al.
Published: (2026) -
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
by: Wang, Kexuan, et al.
Published: (2025)