Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Jinluan, Jin, Dingnan, Tang, Anke, Shen, Li, Zhu, Didi, Chen, Zhengyu, Zhao, Ziyu, Wang, Daixin, Cui, Qing, Zhang, Zhiqiang, Zhou, Jun, Wu, Fei, Kuang, Kun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
von: Yang, Jinluan, et al.
Veröffentlicht: (2024)
von: Yang, Jinluan, et al.
Veröffentlicht: (2024)
Transport and Merge: Cross-Architecture Merging for Large Language Models
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
Merging LoRAs like Playing LEGO: Pushing the Modularity of LoRA to Extremes Through Rank-Wise Clustering
von: Zhao, Ziyu, et al.
Veröffentlicht: (2024)
von: Zhao, Ziyu, et al.
Veröffentlicht: (2024)
Compromising Honesty and Harmlessness in Language Models via Deception Attacks
von: Vaugrante, Laurène, et al.
Veröffentlicht: (2025)
von: Vaugrante, Laurène, et al.
Veröffentlicht: (2025)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
von: Tang, Anke, et al.
Veröffentlicht: (2025)
von: Tang, Anke, et al.
Veröffentlicht: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
von: Wang, Jiapeng, et al.
Veröffentlicht: (2026)
von: Wang, Jiapeng, et al.
Veröffentlicht: (2026)
RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction Robustness
von: Zeng, Fanhu, et al.
Veröffentlicht: (2025)
von: Zeng, Fanhu, et al.
Veröffentlicht: (2025)
Merge to Mix: Mixing Datasets via Model Merging
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
Noise Projection: Closing the Prompt-Agnostic Gap Behind Text-to-Image Misalignment in Diffusion Models
von: Tong, Yunze, et al.
Veröffentlicht: (2025)
von: Tong, Yunze, et al.
Veröffentlicht: (2025)
Sens-Merging: Sensitivity-Guided Parameter Balancing for Merging Large Language Models
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
Unifying Adversarial Perturbation for Graph Neural Networks
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
Parameter Competition Balancing for Model Merging
von: Du, Guodong, et al.
Veröffentlicht: (2024)
von: Du, Guodong, et al.
Veröffentlicht: (2024)
Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging
von: Li, Qinfeng, et al.
Veröffentlicht: (2025)
von: Li, Qinfeng, et al.
Veröffentlicht: (2025)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
von: Tang, Anke, et al.
Veröffentlicht: (2024)
von: Tang, Anke, et al.
Veröffentlicht: (2024)
Bayesian Model Merging
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
von: Yuan, Zenghui, et al.
Veröffentlicht: (2025)
von: Yuan, Zenghui, et al.
Veröffentlicht: (2025)
To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models
von: Wang, Haoqing, et al.
Veröffentlicht: (2026)
von: Wang, Haoqing, et al.
Veröffentlicht: (2026)
Model Merging in Pre-training of Large Language Models
von: Li, Yunshui, et al.
Veröffentlicht: (2025)
von: Li, Yunshui, et al.
Veröffentlicht: (2025)
Graph Neural Network with Two Uplift Estimators for Label-Scarcity Individual Uplift Modeling
von: Zhu, Dingyuan, et al.
Veröffentlicht: (2024)
von: Zhu, Dingyuan, et al.
Veröffentlicht: (2024)
MergeNet: Knowledge Migration across Heterogeneous Models, Tasks, and Modalities
von: Li, Kunxi, et al.
Veröffentlicht: (2024)
von: Li, Kunxi, et al.
Veröffentlicht: (2024)
MIN-Merging: Merge the Important Neurons for Model Merging
von: Liang, Yunfei
Veröffentlicht: (2025)
von: Liang, Yunfei
Veröffentlicht: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
von: Schesch, Benedikt, et al.
Veröffentlicht: (2026)
von: Schesch, Benedikt, et al.
Veröffentlicht: (2026)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
A Unified Generalization Framework for Model Merging: Trade-offs, Non-Linearity, and Scaling Laws
von: Li, Qinglun, et al.
Veröffentlicht: (2026)
von: Li, Qinglun, et al.
Veröffentlicht: (2026)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
1bit-Merging: Dynamic Quantized Merging for Large Language Models
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
Dishonesty in Helpful and Harmless Alignment
von: Huang, Youcheng, et al.
Veröffentlicht: (2024)
von: Huang, Youcheng, et al.
Veröffentlicht: (2024)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
von: Wei, Yongxian, et al.
Veröffentlicht: (2025)
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
von: Shen, Li, et al.
Veröffentlicht: (2024)
von: Shen, Li, et al.
Veröffentlicht: (2024)
Causal Agent based on Large Language Model
von: Han, Kairong, et al.
Veröffentlicht: (2024)
von: Han, Kairong, et al.
Veröffentlicht: (2024)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
Discovering Invariant Neighborhood Patterns for Heterophilic Graphs
von: Yang, Jinluan, et al.
Veröffentlicht: (2024)
von: Yang, Jinluan, et al.
Veröffentlicht: (2024)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
von: Morrison, Jacob, et al.
Veröffentlicht: (2024)
von: Morrison, Jacob, et al.
Veröffentlicht: (2024)
TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training
von: Yang, Jinluan, et al.
Veröffentlicht: (2026)
von: Yang, Jinluan, et al.
Veröffentlicht: (2026)
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
von: Li, Shengrui, et al.
Veröffentlicht: (2026)
von: Li, Shengrui, et al.
Veröffentlicht: (2026)
Adapting Multilingual Models to Code-Mixed Tasks via Model Merging
von: Kodali, Prashant, et al.
Veröffentlicht: (2025)
von: Kodali, Prashant, et al.
Veröffentlicht: (2025)
BadMerging: Backdoor Attacks Against Model Merging
von: Zhang, Jinghuai, et al.
Veröffentlicht: (2024)
von: Zhang, Jinghuai, et al.
Veröffentlicht: (2024)
FedMerge: Federated Personalization via Model Merging
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
von: Chen, Shutong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
von: Yang, Jinluan, et al.
Veröffentlicht: (2024) -
Transport and Merge: Cross-Architecture Merging for Large Language Models
von: Cui, Chenhang, et al.
Veröffentlicht: (2026) -
Merging LoRAs like Playing LEGO: Pushing the Modularity of LoRA to Extremes Through Rank-Wise Clustering
von: Zhao, Ziyu, et al.
Veröffentlicht: (2024) -
Compromising Honesty and Harmlessness in Language Models via Deception Attacks
von: Vaugrante, Laurène, et al.
Veröffentlicht: (2025) -
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
von: Tang, Anke, et al.
Veröffentlicht: (2025)