Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xie, Guofu, Zhang, Xiao, Yao, Ting, Shi, Yunsheng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
von: Xie, Guofu, et al.
Veröffentlicht: (2025)
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
von: Biggs, Benjamin, et al.
Veröffentlicht: (2024)
von: Biggs, Benjamin, et al.
Veröffentlicht: (2024)
Pelican Soup Framework: A Theoretical Framework for Language Model Capabilities
von: Chiang, Ting-Rui, et al.
Veröffentlicht: (2024)
von: Chiang, Ting-Rui, et al.
Veröffentlicht: (2024)
From Faithfulness to Correctness: Generative Reward Models that Think Critically
von: Ma, Qiyao, et al.
Veröffentlicht: (2025)
von: Ma, Qiyao, et al.
Veröffentlicht: (2025)
LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks
von: Prabhakar, Akshara, et al.
Veröffentlicht: (2024)
von: Prabhakar, Akshara, et al.
Veröffentlicht: (2024)
ECG-Soup: Harnessing Multi-Layer Synergy for ECG Foundation Models
von: Nguyen, Phu X., et al.
Veröffentlicht: (2025)
von: Nguyen, Phu X., et al.
Veröffentlicht: (2025)
VC-Soup: Value-Consistency Guided Multi-Value Alignment for Large Language Models
von: Xu, Hefei, et al.
Veröffentlicht: (2026)
von: Xu, Hefei, et al.
Veröffentlicht: (2026)
Soup-of-Experts: Pretraining Specialist Models via Parameters Averaging
von: Ablin, Pierre, et al.
Veröffentlicht: (2025)
von: Ablin, Pierre, et al.
Veröffentlicht: (2025)
State Soup: In-Context Skill Learning, Retrieval and Mixing
von: Pióro, Maciej, et al.
Veröffentlicht: (2024)
von: Pióro, Maciej, et al.
Veröffentlicht: (2024)
Sparse Model Soups: A Recipe for Improved Pruning via Model Averaging
von: Zimmer, Max, et al.
Veröffentlicht: (2023)
von: Zimmer, Max, et al.
Veröffentlicht: (2023)
One Model for All: Multi-Objective Controllable Language Models
von: He, Qiang, et al.
Veröffentlicht: (2026)
von: He, Qiang, et al.
Veröffentlicht: (2026)
Leveraging Model Soups to Classify Intangible Cultural Heritage Images from the Mekong Delta
von: Tran, Quoc-Khang, et al.
Veröffentlicht: (2026)
von: Tran, Quoc-Khang, et al.
Veröffentlicht: (2026)
Multi-Objective Large Language Model Unlearning
von: Pan, Zibin, et al.
Veröffentlicht: (2024)
von: Pan, Zibin, et al.
Veröffentlicht: (2024)
Soup to go: mitigating forgetting during continual learning with model averaging
von: Kleiman, Anat, et al.
Veröffentlicht: (2025)
von: Kleiman, Anat, et al.
Veröffentlicht: (2025)
HTPO: Towards Exploration-Exploitation Balanced Policy Optimization via Hierarchical Token-level Objective Control
von: Yao, Xincheng, et al.
Veröffentlicht: (2026)
von: Yao, Xincheng, et al.
Veröffentlicht: (2026)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
von: Goddard, Charles, et al.
Veröffentlicht: (2024)
Pareto Multi-Objective Alignment for Language Models
von: He, Qiang, et al.
Veröffentlicht: (2025)
von: He, Qiang, et al.
Veröffentlicht: (2025)
Merge to Mix: Mixing Datasets via Model Merging
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
von: Tao, Zhixu Silvia, et al.
Veröffentlicht: (2025)
Model Merging for Knowledge Editing
von: Fu, Zichuan, et al.
Veröffentlicht: (2025)
von: Fu, Zichuan, et al.
Veröffentlicht: (2025)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyi, et al.
Veröffentlicht: (2024)
Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
von: Wang, Kaiwen, et al.
Veröffentlicht: (2024)
von: Wang, Kaiwen, et al.
Veröffentlicht: (2024)
Channel Merging: Preserving Specialization for Merged Experts
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
von: Zhang, Mingyang, et al.
Veröffentlicht: (2024)
PRInTS: Reward Modeling for Long-Horizon Information Seeking
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
von: Lee, Jaewoo, et al.
Veröffentlicht: (2025)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
von: DeepSeek-AI, et al.
Veröffentlicht: (2024)
von: DeepSeek-AI, et al.
Veröffentlicht: (2024)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
von: Wang, Haoxiang, et al.
Veröffentlicht: (2024)
von: Wang, Haoxiang, et al.
Veröffentlicht: (2024)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
von: Saha, Swarnadeep, et al.
Veröffentlicht: (2023)
von: Saha, Swarnadeep, et al.
Veröffentlicht: (2023)
DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
von: Shao, Zhihong, et al.
Veröffentlicht: (2024)
von: Shao, Zhihong, et al.
Veröffentlicht: (2024)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
von: Shenaj, Donald, et al.
Veröffentlicht: (2025)
Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models
von: Li, Chengao, et al.
Veröffentlicht: (2025)
von: Li, Chengao, et al.
Veröffentlicht: (2025)
Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement
von: Xie, Guanwen, et al.
Veröffentlicht: (2024)
von: Xie, Guanwen, et al.
Veröffentlicht: (2024)
Training-free LLM Merging for Multi-task Learning
von: Fu, Zichuan, et al.
Veröffentlicht: (2025)
von: Fu, Zichuan, et al.
Veröffentlicht: (2025)
Model Assembly Learning with Heterogeneous Layer Weight Merging
von: Zhang, Yi-Kai, et al.
Veröffentlicht: (2025)
von: Zhang, Yi-Kai, et al.
Veröffentlicht: (2025)
Dynamic Model Merging Made Slim
von: Du, Guodong, et al.
Veröffentlicht: (2026)
von: Du, Guodong, et al.
Veröffentlicht: (2026)
What Matters for Model Merging at Scale?
von: Yadav, Prateek, et al.
Veröffentlicht: (2024)
von: Yadav, Prateek, et al.
Veröffentlicht: (2024)
Unraveling LoRA Interference: Orthogonal Subspaces for Robust Model Merging
von: Zhang, Haobo, et al.
Veröffentlicht: (2025)
von: Zhang, Haobo, et al.
Veröffentlicht: (2025)
LT-Soups: Bridging Head and Tail Classes via Subsampled Model Soups
von: Aminbeidokhti, Masih, et al.
Veröffentlicht: (2025)
von: Aminbeidokhti, Masih, et al.
Veröffentlicht: (2025)
STAR: Spectral Truncation and Rescale for Model Merging
von: Lee, Yu-Ang, et al.
Veröffentlicht: (2025)
von: Lee, Yu-Ang, et al.
Veröffentlicht: (2025)
Fisher Mask Nodes for Language Model Merging
von: K, Thennal D, et al.
Veröffentlicht: (2024)
von: K, Thennal D, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment
von: Xie, Guofu, et al.
Veröffentlicht: (2025) -
Merge and Guide: Unifying Model Merging and Guided Decoding for Controllable Multi-Objective Generation
von: Xie, Guofu, et al.
Veröffentlicht: (2025) -
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
von: Biggs, Benjamin, et al.
Veröffentlicht: (2024) -
Pelican Soup Framework: A Theoretical Framework for Language Model Capabilities
von: Chiang, Ting-Rui, et al.
Veröffentlicht: (2024) -
From Faithfulness to Correctness: Generative Reward Models that Think Critically
von: Ma, Qiyao, et al.
Veröffentlicht: (2025)