Dataless Knowledge Fusion by Merging Weights of Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Jin, Xisen, Ren, Xiang, Preotiuc-Pietro, Daniel, Cheng, Pengxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
What Will My Model Forget? Forecasting Forgotten Examples in Language Model Refinement
por: Jin, Xisen, et al.
Publicado: (2024)
por: Jin, Xisen, et al.
Publicado: (2024)
Demystifying Language Model Forgetting with Low-rank Example Associations
por: Jin, Xisen, et al.
Publicado: (2024)
por: Jin, Xisen, et al.
Publicado: (2024)
Unsupervised Contrast-Consistent Ranking with Language Models
por: Stoehr, Niklas, et al.
Publicado: (2023)
por: Stoehr, Niklas, et al.
Publicado: (2023)
Improving Multimodal Classification of Social Media Posts by Leveraging Image-Text Auxiliary Tasks
por: Villegas, Danae Sánchez, et al.
Publicado: (2023)
por: Villegas, Danae Sánchez, et al.
Publicado: (2023)
Model Assembly Learning with Heterogeneous Layer Weight Merging
por: Zhang, Yi-Kai, et al.
Publicado: (2025)
por: Zhang, Yi-Kai, et al.
Publicado: (2025)
Calibrating LLMs for Text-to-SQL Parsing by Leveraging Sub-clause Frequencies
por: Liu, Terrance, et al.
Publicado: (2025)
por: Liu, Terrance, et al.
Publicado: (2025)
Modeling and Detecting Company Risks from News: A Case Study in Bloomberg News
por: Pei, Jiaxin, et al.
Publicado: (2025)
por: Pei, Jiaxin, et al.
Publicado: (2025)
Model Merging in Pre-training of Large Language Models
por: Li, Yunshui, et al.
Publicado: (2025)
por: Li, Yunshui, et al.
Publicado: (2025)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
por: Shenaj, Donald, et al.
Publicado: (2025)
por: Shenaj, Donald, et al.
Publicado: (2025)
Merging Methods for Multilingual Knowledge Editing for Large Language Models: An Empirical Odyssey
por: Lee, Kunil, et al.
Publicado: (2026)
por: Lee, Kunil, et al.
Publicado: (2026)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
por: Morrison, Jacob, et al.
Publicado: (2024)
por: Morrison, Jacob, et al.
Publicado: (2024)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
por: Bazaga, Adrián, et al.
Publicado: (2023)
por: Bazaga, Adrián, et al.
Publicado: (2023)
Model Merging for Knowledge Editing
por: Fu, Zichuan, et al.
Publicado: (2025)
por: Fu, Zichuan, et al.
Publicado: (2025)
Multi-Task Model Merging via Adaptive Weight Disentanglement
por: Xiong, Feng, et al.
Publicado: (2024)
por: Xiong, Feng, et al.
Publicado: (2024)
DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models
por: Hu, Xiaolin, et al.
Publicado: (2024)
por: Hu, Xiaolin, et al.
Publicado: (2024)
LLM Enhancer: Merged Approach using Vector Embedding for Reducing Large Language Model Hallucinations with External Knowledge
por: Rayhan, Naheed, et al.
Publicado: (2025)
por: Rayhan, Naheed, et al.
Publicado: (2025)
Improving Instruct Models for Free: A Study on Partial Adaptation
por: İrsoy, Ozan, et al.
Publicado: (2025)
por: İrsoy, Ozan, et al.
Publicado: (2025)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
por: Yang, Jinluan, et al.
Publicado: (2025)
por: Yang, Jinluan, et al.
Publicado: (2025)
A Systematic Study of In-the-Wild Model Merging for Large Language Models
por: Hitit, Oğuz Kağan, et al.
Publicado: (2025)
por: Hitit, Oğuz Kağan, et al.
Publicado: (2025)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
por: Goddard, Charles, et al.
Publicado: (2024)
por: Goddard, Charles, et al.
Publicado: (2024)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
por: Lu, Zhenyi, et al.
Publicado: (2024)
por: Lu, Zhenyi, et al.
Publicado: (2024)
Recurrent Knowledge Identification and Fusion for Language Model Continual Learning
por: Feng, Yujie, et al.
Publicado: (2025)
por: Feng, Yujie, et al.
Publicado: (2025)
Merging Language and Domain Specific Models: The Impact on Technical Vocabulary Acquisition
por: Rousset, Thibault, et al.
Publicado: (2025)
por: Rousset, Thibault, et al.
Publicado: (2025)
Towards Reversible Model Merging For Low-rank Weights
por: Alipour, Mohammadsajad, et al.
Publicado: (2025)
por: Alipour, Mohammadsajad, et al.
Publicado: (2025)
Scalable Data Ablation Approximations for Language Models through Modular Training and Merging
por: Na, Clara, et al.
Publicado: (2024)
por: Na, Clara, et al.
Publicado: (2024)
SeMe: Training-Free Language Model Merging via Semantic Alignment
por: Gu, Jian, et al.
Publicado: (2025)
por: Gu, Jian, et al.
Publicado: (2025)
Steering Language Models with Weight Arithmetic
por: Fierro, Constanza, et al.
Publicado: (2025)
por: Fierro, Constanza, et al.
Publicado: (2025)
Knowledge Fusion of Large Language Models Via Modular SkillPacks
por: Du, Guodong, et al.
Publicado: (2025)
por: Du, Guodong, et al.
Publicado: (2025)
Fisher Mask Nodes for Language Model Merging
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
por: Brahman, Faeze, et al.
Publicado: (2023)
por: Brahman, Faeze, et al.
Publicado: (2023)
Stability-Weighted Decoding for Diffusion Language Models
por: Wu, Yue, et al.
Publicado: (2026)
por: Wu, Yue, et al.
Publicado: (2026)
Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
por: Sharma, Kartik, et al.
Publicado: (2025)
por: Sharma, Kartik, et al.
Publicado: (2025)
Unsupervised Pretraining for Fact Verification by Language Model Distillation
por: Bazaga, Adrián, et al.
Publicado: (2023)
por: Bazaga, Adrián, et al.
Publicado: (2023)
Knowledge Graph Large Language Model (KG-LLM) for Link Prediction
por: Shu, Dong, et al.
Publicado: (2024)
por: Shu, Dong, et al.
Publicado: (2024)
FlexiGPT: Pruning and Extending Large Language Models with Low-Rank Weight Sharing
por: Smith, James Seale, et al.
Publicado: (2025)
por: Smith, James Seale, et al.
Publicado: (2025)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
por: Lan, Pengxiang, et al.
Publicado: (2024)
por: Lan, Pengxiang, et al.
Publicado: (2024)
Large Language Models Lack Temporal Awareness of Medical Knowledge
por: Guan, Zihan, et al.
Publicado: (2026)
por: Guan, Zihan, et al.
Publicado: (2026)
Merging by Matching Models in Task Parameter Subspaces
por: Tam, Derek, et al.
Publicado: (2023)
por: Tam, Derek, et al.
Publicado: (2023)
Merge to Mix: Mixing Datasets via Model Merging
por: Tao, Zhixu Silvia, et al.
Publicado: (2025)
por: Tao, Zhixu Silvia, et al.
Publicado: (2025)
From Data to Knowledge: Evaluating How Efficiently Language Models Learn Facts
por: Christoph, Daniel, et al.
Publicado: (2025)
por: Christoph, Daniel, et al.
Publicado: (2025)
Ejemplares similares
-
What Will My Model Forget? Forecasting Forgotten Examples in Language Model Refinement
por: Jin, Xisen, et al.
Publicado: (2024) -
Demystifying Language Model Forgetting with Low-rank Example Associations
por: Jin, Xisen, et al.
Publicado: (2024) -
Unsupervised Contrast-Consistent Ranking with Language Models
por: Stoehr, Niklas, et al.
Publicado: (2023) -
Improving Multimodal Classification of Social Media Posts by Leveraging Image-Text Auxiliary Tasks
por: Villegas, Danae Sánchez, et al.
Publicado: (2023) -
Model Assembly Learning with Heterogeneous Layer Weight Merging
por: Zhang, Yi-Kai, et al.
Publicado: (2025)