Merging Language and Domain Specific Models: The Impact on Technical Vocabulary Acquisition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rousset, Thibault, Kakibuchi, Taisei, Sasaki, Yusuke, Nomura, Yoshihide |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HUKUKBERT: Domain-Specific Language Model for Turkish Law
par: Öztürk, Mehmet Utku, et autres
Publié: (2026)
par: Öztürk, Mehmet Utku, et autres
Publié: (2026)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
par: Morrison, Jacob, et autres
Publié: (2024)
par: Morrison, Jacob, et autres
Publié: (2024)
Model Merging in Pre-training of Large Language Models
par: Li, Yunshui, et autres
Publié: (2025)
par: Li, Yunshui, et autres
Publié: (2025)
Cut Your Losses in Large-Vocabulary Language Models
par: Wijmans, Erik, et autres
Publié: (2024)
par: Wijmans, Erik, et autres
Publié: (2024)
Dataless Knowledge Fusion by Merging Weights of Language Models
par: Jin, Xisen, et autres
Publié: (2022)
par: Jin, Xisen, et autres
Publié: (2022)
EpilepsyLLM: Domain-Specific Large Language Model Fine-tuned with Epilepsy Medical Knowledge
par: Zhao, Xuyang, et autres
Publié: (2024)
par: Zhao, Xuyang, et autres
Publié: (2024)
Exploiting Vocabulary Frequency Imbalance in Language Model Pre-training
par: Chung, Woojin, et autres
Publié: (2025)
par: Chung, Woojin, et autres
Publié: (2025)
An Empirical Comparison of Vocabulary Expansion and Initialization Approaches for Language Models
par: Mundra, Nandini, et autres
Publié: (2024)
par: Mundra, Nandini, et autres
Publié: (2024)
A Systematic Study of In-the-Wild Model Merging for Large Language Models
par: Hitit, Oğuz Kağan, et autres
Publié: (2025)
par: Hitit, Oğuz Kağan, et autres
Publié: (2025)
A Comparative Analysis of LLM Memorization at Statistical and Internal Levels: Cross-Model Commonalities and Model-Specific Signatures
par: Chen, Bowen, et autres
Publié: (2026)
par: Chen, Bowen, et autres
Publié: (2026)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
par: Goddard, Charles, et autres
Publié: (2024)
par: Goddard, Charles, et autres
Publié: (2024)
Mortgage Language Model: Domain-Adaptive Pretraining with Residual Instruction, Alignment Tuning, and Task-Specific Routing
par: Jain, Manish, et autres
Publié: (2025)
par: Jain, Manish, et autres
Publié: (2025)
The Curious Language Model: Strategic Test-Time Information Acquisition
par: Cooper, Michael, et autres
Publié: (2025)
par: Cooper, Michael, et autres
Publié: (2025)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
par: Shenaj, Donald, et autres
Publié: (2025)
par: Shenaj, Donald, et autres
Publié: (2025)
Large Language Models in Fire Engineering: An Examination of Technical Questions Against Domain Knowledge
par: Hostetter, Haley, et autres
Publié: (2024)
par: Hostetter, Haley, et autres
Publié: (2024)
Fast Vocabulary Transfer for Language Model Compression
par: Gee, Leonidas, et autres
Publié: (2024)
par: Gee, Leonidas, et autres
Publié: (2024)
Enhancing Large Language Models with Domain-Specific Knowledge: The Case in Topological Materials
par: Xu, HuangChao, et autres
Publié: (2024)
par: Xu, HuangChao, et autres
Publié: (2024)
SeMe: Training-Free Language Model Merging via Semantic Alignment
par: Gu, Jian, et autres
Publié: (2025)
par: Gu, Jian, et autres
Publié: (2025)
Merging Methods for Multilingual Knowledge Editing for Large Language Models: An Empirical Odyssey
par: Lee, Kunil, et autres
Publié: (2026)
par: Lee, Kunil, et autres
Publié: (2026)
Scalable Data Ablation Approximations for Language Models through Modular Training and Merging
par: Na, Clara, et autres
Publié: (2024)
par: Na, Clara, et autres
Publié: (2024)
Fisher Mask Nodes for Language Model Merging
par: K, Thennal D, et autres
Publié: (2024)
par: K, Thennal D, et autres
Publié: (2024)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
par: Yang, Jinluan, et autres
Publié: (2025)
par: Yang, Jinluan, et autres
Publié: (2025)
Domain-Specific Pruning of Large Mixture-of-Experts Models with Few-shot Demonstrations
par: Dong, Zican, et autres
Publié: (2025)
par: Dong, Zican, et autres
Publié: (2025)
Lossless Vocabulary Reduction for Auto-Regressive Language Models
par: Chijiwa, Daiki, et autres
Publié: (2025)
par: Chijiwa, Daiki, et autres
Publié: (2025)
Evaluating the Performance of Large Language Models for SDG Mapping (Technical Report)
par: Yin, Hui, et autres
Publié: (2024)
par: Yin, Hui, et autres
Publié: (2024)
Merging by Matching Models in Task Parameter Subspaces
par: Tam, Derek, et autres
Publié: (2023)
par: Tam, Derek, et autres
Publié: (2023)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
par: Menschikov, Mikhail, et autres
Publié: (2025)
par: Menschikov, Mikhail, et autres
Publié: (2025)
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
par: Katz, Shahar, et autres
Publié: (2024)
par: Katz, Shahar, et autres
Publié: (2024)
Merge to Mix: Mixing Datasets via Model Merging
par: Tao, Zhixu Silvia, et autres
Publié: (2025)
par: Tao, Zhixu Silvia, et autres
Publié: (2025)
BanglaSTEM: A Parallel Corpus for Technical Domain Bangla-English Translation
par: Hasan, Kazi Reyazul, et autres
Publié: (2025)
par: Hasan, Kazi Reyazul, et autres
Publié: (2025)
Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models
par: Cao, Jinghan, et autres
Publié: (2026)
par: Cao, Jinghan, et autres
Publié: (2026)
EvoMerge: Neuroevolution for Large Language Models
par: Jiang, Yushu
Publié: (2024)
par: Jiang, Yushu
Publié: (2024)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
LLM Enhancer: Merged Approach using Vector Embedding for Reducing Large Language Model Hallucinations with External Knowledge
par: Rayhan, Naheed, et autres
Publié: (2025)
par: Rayhan, Naheed, et autres
Publié: (2025)
DIDS: Domain Impact-aware Data Sampling for Large Language Model Training
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Advancing Semantic Caching for LLMs with Domain-Specific Embeddings and Synthetic Data
par: Gill, Waris, et autres
Publié: (2025)
par: Gill, Waris, et autres
Publié: (2025)
Multi-Faceted Question Complexity Estimation Targeting Topic Domain-Specificity
par: R, Sujay, et autres
Publié: (2024)
par: R, Sujay, et autres
Publié: (2024)
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
par: Bohdal, Ondrej, et autres
Publié: (2026)
par: Bohdal, Ondrej, et autres
Publié: (2026)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
par: Saha, Swarnadeep, et autres
Publié: (2023)
par: Saha, Swarnadeep, et autres
Publié: (2023)
MrBERT: Modern Multilingual Encoders via Vocabulary, Domain, and Dimensional Adaptation
par: Tamayo, Daniel, et autres
Publié: (2026)
par: Tamayo, Daniel, et autres
Publié: (2026)
Documents similaires
-
HUKUKBERT: Domain-Specific Language Model for Turkish Law
par: Öztürk, Mehmet Utku, et autres
Publié: (2026) -
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
par: Morrison, Jacob, et autres
Publié: (2024) -
Model Merging in Pre-training of Large Language Models
par: Li, Yunshui, et autres
Publié: (2025) -
Cut Your Losses in Large-Vocabulary Language Models
par: Wijmans, Erik, et autres
Publié: (2024) -
Dataless Knowledge Fusion by Merging Weights of Language Models
par: Jin, Xisen, et autres
Publié: (2022)