Leveraging Large Language Models for Enhanced NLP Task Performance through Knowledge Distillation and Optimized Training Strategies
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Yining, Tang, Keke, Chen, Meilian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry
por: Huang, Yining, et al.
Publicado: (2024)
por: Huang, Yining, et al.
Publicado: (2024)
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
por: Huang, Yining, et al.
Publicado: (2025)
por: Huang, Yining, et al.
Publicado: (2025)
A Post-Training Enhanced Optimization Approach for Small Language Models
por: Zhai, Keke
Publicado: (2024)
por: Zhai, Keke
Publicado: (2024)
KnowledgeNavigator: Leveraging Large Language Models for Enhanced Reasoning over Knowledge Graph
por: Guo, Tiezheng, et al.
Publicado: (2023)
por: Guo, Tiezheng, et al.
Publicado: (2023)
Graphusion: Leveraging Large Language Models for Scientific Knowledge Graph Fusion and Construction in NLP Education
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
por: Qi, Zhen, et al.
Publicado: (2024)
por: Qi, Zhen, et al.
Publicado: (2024)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
por: Peng, Tianyu, et al.
Publicado: (2024)
por: Peng, Tianyu, et al.
Publicado: (2024)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
por: Hu, Jiacheng, et al.
Publicado: (2024)
por: Hu, Jiacheng, et al.
Publicado: (2024)
MiniPLM: Knowledge Distillation for Pre-Training Language Models
por: Gu, Yuxian, et al.
Publicado: (2024)
por: Gu, Yuxian, et al.
Publicado: (2024)
Benchmarking Large Language Models on Multiple Tasks in Bioinformatics NLP with Prompting
por: Jiang, Jiyue, et al.
Publicado: (2025)
por: Jiang, Jiyue, et al.
Publicado: (2025)
Knowledge Distillation of Black-Box Large Language Models
por: Chen, Hongzhan, et al.
Publicado: (2024)
por: Chen, Hongzhan, et al.
Publicado: (2024)
Enhancing Romanian Offensive Language Detection through Knowledge Distillation, Multi-Task Learning, and Data Augmentation
por: Matei, Vlad-Cristian, et al.
Publicado: (2024)
por: Matei, Vlad-Cristian, et al.
Publicado: (2024)
Flipping Knowledge Distillation: Leveraging Small Models' Expertise to Enhance LLMs in Text Matching
por: Li, Mingzhe, et al.
Publicado: (2025)
por: Li, Mingzhe, et al.
Publicado: (2025)
Leveraging Large Language Models for Concept Graph Recovery and Question Answering in NLP Education
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
por: Xing, Wang, et al.
Publicado: (2026)
por: Xing, Wang, et al.
Publicado: (2026)
Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP Tasks
por: Li, Qintong, et al.
Publicado: (2023)
por: Li, Qintong, et al.
Publicado: (2023)
Leveraging Open Knowledge for Advancing Task Expertise in Large Language Models
por: Yang, Yuncheng, et al.
Publicado: (2024)
por: Yang, Yuncheng, et al.
Publicado: (2024)
Cross-Modal Knowledge Distillation for Speech Large Language Models
por: Wang, Enzhi, et al.
Publicado: (2025)
por: Wang, Enzhi, et al.
Publicado: (2025)
Improving Clinical NLP Performance through Language Model-Generated Synthetic Clinical Data
por: Chen, Shan, et al.
Publicado: (2024)
por: Chen, Shan, et al.
Publicado: (2024)
Training Task Experts through Retrieval Based Distillation
por: Ge, Jiaxin, et al.
Publicado: (2024)
por: Ge, Jiaxin, et al.
Publicado: (2024)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
por: Li, Jiahuan, et al.
Publicado: (2024)
por: Li, Jiahuan, et al.
Publicado: (2024)
CCNU at SemEval-2025 Task 3: Leveraging Internal and External Knowledge of Large Language Models for Multilingual Hallucination Annotation
por: Liu, Xu, et al.
Publicado: (2025)
por: Liu, Xu, et al.
Publicado: (2025)
Dual-Space Knowledge Distillation for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2024)
por: Zhang, Songming, et al.
Publicado: (2024)
Direct Preference Knowledge Distillation for Large Language Models
por: Li, Yixing, et al.
Publicado: (2024)
por: Li, Yixing, et al.
Publicado: (2024)
A Survey on Knowledge Distillation of Large Language Models
por: Xu, Xiaohan, et al.
Publicado: (2024)
por: Xu, Xiaohan, et al.
Publicado: (2024)
Distilling Rule-based Knowledge into Large Language Models
por: Yang, Wenkai, et al.
Publicado: (2023)
por: Yang, Wenkai, et al.
Publicado: (2023)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
por: Wang, Chengyu, et al.
Publicado: (2025)
por: Wang, Chengyu, et al.
Publicado: (2025)
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
por: Yue, Yuanhao, et al.
Publicado: (2024)
por: Yue, Yuanhao, et al.
Publicado: (2024)
Active Learning for NLP with Large Language Models
por: Wang, Xuesong
Publicado: (2024)
por: Wang, Xuesong
Publicado: (2024)
MMIDR: Teaching Large Language Model to Interpret Multimodal Misinformation via Knowledge Distillation
por: Wang, Longzheng, et al.
Publicado: (2024)
por: Wang, Longzheng, et al.
Publicado: (2024)
Leveraging Large Language Models for Identifying Knowledge Components
por: Wang, Canwen, et al.
Publicado: (2025)
por: Wang, Canwen, et al.
Publicado: (2025)
NLP Datasets for Idiom and Figurative Language Tasks
por: Matheny, Blake, et al.
Publicado: (2025)
por: Matheny, Blake, et al.
Publicado: (2025)
SWITCH: Studying with Teacher for Knowledge Distillation of Large Language Models
por: Koo, Jahyun, et al.
Publicado: (2024)
por: Koo, Jahyun, et al.
Publicado: (2024)
Evolving Knowledge Distillation with Large Language Models and Active Learning
por: Liu, Chengyuan, et al.
Publicado: (2024)
por: Liu, Chengyuan, et al.
Publicado: (2024)
DDK: Distilling Domain Knowledge for Efficient Large Language Models
por: Liu, Jiaheng, et al.
Publicado: (2024)
por: Liu, Jiaheng, et al.
Publicado: (2024)
Enhancing Multi-hop Reasoning through Knowledge Erasure in Large Language Model Editing
por: Zhang, Mengqi, et al.
Publicado: (2024)
por: Zhang, Mengqi, et al.
Publicado: (2024)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
por: Chen, Yuheng, et al.
Publicado: (2024)
por: Chen, Yuheng, et al.
Publicado: (2024)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
por: Zhang, Yuanchi, et al.
Publicado: (2024)
por: Zhang, Yuanchi, et al.
Publicado: (2024)
A Survey of Prompt Engineering Methods in Large Language Models for Different NLP Tasks
por: Vatsal, Shubham, et al.
Publicado: (2024)
por: Vatsal, Shubham, et al.
Publicado: (2024)
Search-in-the-Chain: Interactively Enhancing Large Language Models with Search for Knowledge-intensive Tasks
por: Xu, Shicheng, et al.
Publicado: (2023)
por: Xu, Shicheng, et al.
Publicado: (2023)
Ejemplares similares
-
A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry
por: Huang, Yining, et al.
Publicado: (2024) -
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
por: Huang, Yining, et al.
Publicado: (2025) -
A Post-Training Enhanced Optimization Approach for Small Language Models
por: Zhai, Keke
Publicado: (2024) -
KnowledgeNavigator: Leveraging Large Language Models for Enhanced Reasoning over Knowledge Graph
por: Guo, Tiezheng, et al.
Publicado: (2023) -
Graphusion: Leveraging Large Language Models for Scientific Knowledge Graph Fusion and Construction in NLP Education
por: Yang, Rui, et al.
Publicado: (2024)