MoD: A Distribution-Based Approach for Merging Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Dang, Quy-Anh, Ngo, Chris |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't
por: Dang, Quy-Anh, et al.
Publicado: (2025)
por: Dang, Quy-Anh, et al.
Publicado: (2025)
Selective Steering: Norm-Preserving Control Through Discriminative Layer Selection
por: Dang, Quy-Anh, et al.
Publicado: (2026)
por: Dang, Quy-Anh, et al.
Publicado: (2026)
RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models
por: Dang, Quy-Anh, et al.
Publicado: (2026)
por: Dang, Quy-Anh, et al.
Publicado: (2026)
Polyglot-Lion: Efficient Multilingual ASR for Singapore via Balanced Fine-Tuning of Qwen3-ASR
por: Dang, Quy-Anh, et al.
Publicado: (2026)
por: Dang, Quy-Anh, et al.
Publicado: (2026)
MoD-DPO: Towards Mitigating Cross-modal Hallucinations in Omni LLMs using Modality Decoupled Preference Optimization
por: Chaubey, Ashutosh, et al.
Publicado: (2026)
por: Chaubey, Ashutosh, et al.
Publicado: (2026)
MergeMoE: Efficient Compression of MoE Models via Expert Output Merging
por: Miao, Ruijie, et al.
Publicado: (2025)
por: Miao, Ruijie, et al.
Publicado: (2025)
Adaptive Acquisition Selection for Bayesian Optimization with Large Language Models
por: Ngo, Giang, et al.
Publicado: (2026)
por: Ngo, Giang, et al.
Publicado: (2026)
RainbowPlus: Enhancing Adversarial Prompt Generation via Evolutionary Quality-Diversity Search
por: Dang, Quy-Anh, et al.
Publicado: (2025)
por: Dang, Quy-Anh, et al.
Publicado: (2025)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
por: Goddard, Charles, et al.
Publicado: (2024)
por: Goddard, Charles, et al.
Publicado: (2024)
DeeP-Mod: Deep Dynamic Programming based Environment Modelling using Feature Extraction
por: Child, Chris, et al.
Publicado: (2025)
por: Child, Chris, et al.
Publicado: (2025)
RN-F: A Novel Approach for Mitigating Contaminated Data in Large Language Models
por: Anh, Le Vu, et al.
Publicado: (2025)
por: Anh, Le Vu, et al.
Publicado: (2025)
Model Merging in Pre-training of Large Language Models
por: Li, Yunshui, et al.
Publicado: (2025)
por: Li, Yunshui, et al.
Publicado: (2025)
Out-of-Distribution Graph Models Merging
por: Wang, Yidi, et al.
Publicado: (2025)
por: Wang, Yidi, et al.
Publicado: (2025)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
por: Tang, Anke, et al.
Publicado: (2025)
por: Tang, Anke, et al.
Publicado: (2025)
A Systematic Study of In-the-Wild Model Merging for Large Language Models
por: Hitit, Oğuz Kağan, et al.
Publicado: (2025)
por: Hitit, Oğuz Kağan, et al.
Publicado: (2025)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
por: Shenaj, Donald, et al.
Publicado: (2025)
por: Shenaj, Donald, et al.
Publicado: (2025)
$γ-$MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models
por: Luo, Yaxin, et al.
Publicado: (2024)
por: Luo, Yaxin, et al.
Publicado: (2024)
RegMean++: Enhancing Effectiveness and Generalization of Regression Mean for Model Merging
por: Nguyen, The-Hai, et al.
Publicado: (2025)
por: Nguyen, The-Hai, et al.
Publicado: (2025)
MergePrint: Merge-Resistant Fingerprints for Robust Black-box Ownership Verification of Large Language Models
por: Yamabe, Shojiro, et al.
Publicado: (2024)
por: Yamabe, Shojiro, et al.
Publicado: (2024)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
por: Sun, Wenju, et al.
Publicado: (2025)
por: Sun, Wenju, et al.
Publicado: (2025)
Robust Transfer Learning for Active Level Set Estimation with Locally Adaptive Gaussian Process Prior
por: Ngo, Giang, et al.
Publicado: (2024)
por: Ngo, Giang, et al.
Publicado: (2024)
LLM Enhancer: Merged Approach using Vector Embedding for Reducing Large Language Model Hallucinations with External Knowledge
por: Rayhan, Naheed, et al.
Publicado: (2025)
por: Rayhan, Naheed, et al.
Publicado: (2025)
Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training
por: Zhou, Wenjie, et al.
Publicado: (2026)
por: Zhou, Wenjie, et al.
Publicado: (2026)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
por: Morrison, Jacob, et al.
Publicado: (2024)
por: Morrison, Jacob, et al.
Publicado: (2024)
wav2graph: A Framework for Supervised Learning Knowledge Graph from Speech
por: Le-Duc, Khai, et al.
Publicado: (2024)
por: Le-Duc, Khai, et al.
Publicado: (2024)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
por: Yang, Jinluan, et al.
Publicado: (2025)
por: Yang, Jinluan, et al.
Publicado: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
por: Schesch, Benedikt, et al.
Publicado: (2026)
por: Schesch, Benedikt, et al.
Publicado: (2026)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
por: Zhang, Kehao, et al.
Publicado: (2025)
por: Zhang, Kehao, et al.
Publicado: (2025)
EvoMerge: Neuroevolution for Large Language Models
por: Jiang, Yushu
Publicado: (2024)
por: Jiang, Yushu
Publicado: (2024)
Merging Methods for Multilingual Knowledge Editing for Large Language Models: An Empirical Odyssey
por: Lee, Kunil, et al.
Publicado: (2026)
por: Lee, Kunil, et al.
Publicado: (2026)
Retraining-Free Merging of Sparse MoE via Hierarchical Clustering
por: Chen, I-Chun, et al.
Publicado: (2024)
por: Chen, I-Chun, et al.
Publicado: (2024)
PRKAN: Parameter-Reduced Kolmogorov-Arnold Networks
por: Ta, Hoang-Thang, et al.
Publicado: (2025)
por: Ta, Hoang-Thang, et al.
Publicado: (2025)
From Task-Specific Models to Unified Systems: A Review of Model Merging Approaches
por: Ruan, Wei, et al.
Publicado: (2025)
por: Ruan, Wei, et al.
Publicado: (2025)
Confidence in the Reasoning of Large Language Models
por: Pawitan, Yudi, et al.
Publicado: (2024)
por: Pawitan, Yudi, et al.
Publicado: (2024)
Is In-Context Learning in Large Language Models Bayesian? A Martingale Perspective
por: Falck, Fabian, et al.
Publicado: (2024)
por: Falck, Fabian, et al.
Publicado: (2024)
MergeQuant: Accurate 4-bit Static Quantization of Large Language Models by Channel-wise Calibration
por: Wang, Jinguang, et al.
Publicado: (2025)
por: Wang, Jinguang, et al.
Publicado: (2025)
PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference
por: Zhao, Yushu, et al.
Publicado: (2025)
por: Zhao, Yushu, et al.
Publicado: (2025)
SSAM: Singular Subspace Alignment for Merging Multimodal Large Language Models
por: Reza, Md Kaykobad, et al.
Publicado: (2026)
por: Reza, Md Kaykobad, et al.
Publicado: (2026)
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
por: Bohdal, Ondrej, et al.
Publicado: (2026)
por: Bohdal, Ondrej, et al.
Publicado: (2026)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
por: Saha, Swarnadeep, et al.
Publicado: (2023)
por: Saha, Swarnadeep, et al.
Publicado: (2023)
Ejemplares similares
-
Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't
por: Dang, Quy-Anh, et al.
Publicado: (2025) -
Selective Steering: Norm-Preserving Control Through Discriminative Layer Selection
por: Dang, Quy-Anh, et al.
Publicado: (2026) -
RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models
por: Dang, Quy-Anh, et al.
Publicado: (2026) -
Polyglot-Lion: Efficient Multilingual ASR for Singapore via Balanced Fine-Tuning of Qwen3-ASR
por: Dang, Quy-Anh, et al.
Publicado: (2026) -
MoD-DPO: Towards Mitigating Cross-modal Hallucinations in Omni LLMs using Modality Decoupled Preference Optimization
por: Chaubey, Ashutosh, et al.
Publicado: (2026)