Salvato in:
| Autori principali: | Yang, Zongzhen, Qi, Binhang, Sun, Hailong, Long, Wenrui, Zhao, Ruobing, Gao, Xiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.01874 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NeMo: A Neuron-Level Modularizing-While-Training Approach for Decomposing DNN Models
di: Bi, Xiaohan, et al.
Pubblicazione: (2025)
di: Bi, Xiaohan, et al.
Pubblicazione: (2025)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
di: Sun, Wenju, et al.
Pubblicazione: (2025)
di: Sun, Wenju, et al.
Pubblicazione: (2025)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
di: Zhang, Bingjie, et al.
Pubblicazione: (2025)
di: Zhang, Bingjie, et al.
Pubblicazione: (2025)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
di: Yang, Jinluan, et al.
Pubblicazione: (2025)
di: Yang, Jinluan, et al.
Pubblicazione: (2025)
Task Arithmetic in Trust Region: A Training-Free Model Merging Approach to Navigate Knowledge Conflicts
di: Sun, Wenju, et al.
Pubblicazione: (2025)
di: Sun, Wenju, et al.
Pubblicazione: (2025)
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
di: Hu, Zengjie, et al.
Pubblicazione: (2025)
di: Hu, Zengjie, et al.
Pubblicazione: (2025)
Model Merging in the Essential Subspace
di: Li, Longhua, et al.
Pubblicazione: (2026)
di: Li, Longhua, et al.
Pubblicazione: (2026)
Sparsity-Aware Evolution for Model Merging
di: Zhang, Huan, et al.
Pubblicazione: (2026)
di: Zhang, Huan, et al.
Pubblicazione: (2026)
Graph Sparsification via Mixture of Graphs
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
Adaptive Redundancy Regulation for Balanced Multimodal Information Refinement
di: Yang, Zhe, et al.
Pubblicazione: (2025)
di: Yang, Zhe, et al.
Pubblicazione: (2025)
SPICE: Submodular Penalized Information-Conflict Selection for Efficient Large Language Model Training
di: Chang, Powei, et al.
Pubblicazione: (2026)
di: Chang, Powei, et al.
Pubblicazione: (2026)
BD-Merging: Bias-Aware Dynamic Model Merging with Evidence-Guided Contrastive Learning
di: Xie, Yuhan, et al.
Pubblicazione: (2026)
di: Xie, Yuhan, et al.
Pubblicazione: (2026)
Multi-Level Collaboration in Model Merging
di: Li, Qi, et al.
Pubblicazione: (2025)
di: Li, Qi, et al.
Pubblicazione: (2025)
PSNE: Efficient Spectral Sparsification Algorithms for Scaling Network Embedding
di: Lin, Longlong, et al.
Pubblicazione: (2024)
di: Lin, Longlong, et al.
Pubblicazione: (2024)
AtmosSci-Bench: Evaluating the Recent Advance of Large Language Model for Atmospheric Science
di: Li, Chenyue, et al.
Pubblicazione: (2025)
di: Li, Chenyue, et al.
Pubblicazione: (2025)
SQL-GEN: Bridging the Dialect Gap for Text-to-SQL Via Synthetic Data And Model Merging
di: Pourreza, Mohammadreza, et al.
Pubblicazione: (2024)
di: Pourreza, Mohammadreza, et al.
Pubblicazione: (2024)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
di: Zhang, Kehao, et al.
Pubblicazione: (2025)
di: Zhang, Kehao, et al.
Pubblicazione: (2025)
GLASS: Global-Local Aggregation for Inference-time Sparsification of LLMs
di: Sattarifard, Amirmohsen, et al.
Pubblicazione: (2025)
di: Sattarifard, Amirmohsen, et al.
Pubblicazione: (2025)
SAL: Selective Adaptive Learning for Backpropagation-Free Training with Sparsification
di: Liu, Fanping, et al.
Pubblicazione: (2026)
di: Liu, Fanping, et al.
Pubblicazione: (2026)
MIN-Merging: Merge the Important Neurons for Model Merging
di: Liang, Yunfei
Pubblicazione: (2025)
di: Liang, Yunfei
Pubblicazione: (2025)
Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning
di: Hiroshima, Kei, et al.
Pubblicazione: (2026)
di: Hiroshima, Kei, et al.
Pubblicazione: (2026)
Conflict-Aware Adversarial Training
di: Xue, Zhiyu, et al.
Pubblicazione: (2024)
di: Xue, Zhiyu, et al.
Pubblicazione: (2024)
GraSS: Scalable Data Attribution with Gradient Sparsification and Sparse Projection
di: Hu, Pingbang, et al.
Pubblicazione: (2025)
di: Hu, Pingbang, et al.
Pubblicazione: (2025)
Training-free Heterogeneous Model Merging
di: Xu, Zhengqi, et al.
Pubblicazione: (2024)
di: Xu, Zhengqi, et al.
Pubblicazione: (2024)
Parameter Competition Balancing for Model Merging
di: Du, Guodong, et al.
Pubblicazione: (2024)
di: Du, Guodong, et al.
Pubblicazione: (2024)
Toward a Holistic Approach to Continual Model Merging
di: Phan, Hoang, et al.
Pubblicazione: (2025)
di: Phan, Hoang, et al.
Pubblicazione: (2025)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
di: Cai, Hongyi, et al.
Pubblicazione: (2025)
di: Cai, Hongyi, et al.
Pubblicazione: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
Diffusion-Modeled Reinforcement Learning for Carbon and Risk-Aware Microgrid Optimization
di: Zhao, Yunyi, et al.
Pubblicazione: (2025)
di: Zhao, Yunyi, et al.
Pubblicazione: (2025)
Symmetry-Aware Graph Metanetwork Autoencoders: Model Merging through Parameter Canonicalization
di: Boufalis, Odysseas, et al.
Pubblicazione: (2025)
di: Boufalis, Odysseas, et al.
Pubblicazione: (2025)
Mediator: Memory-efficient LLM Merging with Less Parameter Conflicts and Uncertainty Based Routing
di: Lai, Kunfeng, et al.
Pubblicazione: (2025)
di: Lai, Kunfeng, et al.
Pubblicazione: (2025)
Clustering Properties of Self-Supervised Learning
di: Weng, Xi, et al.
Pubblicazione: (2025)
di: Weng, Xi, et al.
Pubblicazione: (2025)
Reliable Conflictive Multi-View Learning
di: Xu, Cai, et al.
Pubblicazione: (2024)
di: Xu, Cai, et al.
Pubblicazione: (2024)
Shapley-Value-Based Graph Sparsification for GNN Inference
di: Akkas, Selahattin, et al.
Pubblicazione: (2025)
di: Akkas, Selahattin, et al.
Pubblicazione: (2025)
CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization
di: Shi, Shuming, et al.
Pubblicazione: (2025)
di: Shi, Shuming, et al.
Pubblicazione: (2025)
Multi-level Conflict-Aware Network for Multi-modal Sentiment Analysis
di: Gao, Yubo, et al.
Pubblicazione: (2025)
di: Gao, Yubo, et al.
Pubblicazione: (2025)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
di: Chen, Hao Mark, et al.
Pubblicazione: (2025)
di: Chen, Hao Mark, et al.
Pubblicazione: (2025)
Bayesian Model Merging
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
On the Opportunities of (Re)-Exploring Atmospheric Science by Foundation Models: A Case Study
di: Zhang, Lujia, et al.
Pubblicazione: (2024)
di: Zhang, Lujia, et al.
Pubblicazione: (2024)
Documenti analoghi
-
NeMo: A Neuron-Level Modularizing-While-Training Approach for Decomposing DNN Models
di: Bi, Xiaohan, et al.
Pubblicazione: (2025) -
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
di: Sun, Wenju, et al.
Pubblicazione: (2025) -
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
di: Luo, Yingfeng, et al.
Pubblicazione: (2025) -
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
di: Zhang, Bingjie, et al.
Pubblicazione: (2025) -
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
di: Yang, Jinluan, et al.
Pubblicazione: (2025)