Multi-Granularity Semantic Revision for Large Language Model Distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiaoyu, Zhang, Yun, Li, Wei, Li, Simiao, Huang, Xudong, Chen, Hanting, Tang, Yehui, Hu, Jie, Xiong, Zhiwei, Wang, Yunhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CBQ: Cross-Block Quantization for Large Language Models
di: Ding, Xin, et al.
Pubblicazione: (2023)
di: Ding, Xin, et al.
Pubblicazione: (2023)
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
di: Cai, Miaomiao, et al.
Pubblicazione: (2025)
di: Cai, Miaomiao, et al.
Pubblicazione: (2025)
Distilling Semantic Priors from SAM to Efficient Image Restoration Models
di: Zhang, Quan, et al.
Pubblicazione: (2024)
di: Zhang, Quan, et al.
Pubblicazione: (2024)
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025)
di: Tao, Yao, et al.
Pubblicazione: (2025)
EMS-SD: Efficient Multi-sample Speculative Decoding for Accelerating Large Language Models
di: Ni, Yunsheng, et al.
Pubblicazione: (2024)
di: Ni, Yunsheng, et al.
Pubblicazione: (2024)
Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
di: Tu, Zhijun, et al.
Pubblicazione: (2025)
di: Tu, Zhijun, et al.
Pubblicazione: (2025)
DiJiang: Efficient Large Language Models through Compact Kernelization
di: Chen, Hanting, et al.
Pubblicazione: (2024)
di: Chen, Hanting, et al.
Pubblicazione: (2024)
DenseMamba: State Space Models with Dense Hidden Connection for Efficient Large Language Models
di: He, Wei, et al.
Pubblicazione: (2024)
di: He, Wei, et al.
Pubblicazione: (2024)
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
di: Li, Simiao, et al.
Pubblicazione: (2024)
di: Li, Simiao, et al.
Pubblicazione: (2024)
MTA: Multi-Granular Trajectory Alignment for Large Language Model Distillation
di: Chi, Pham Khanh, et al.
Pubblicazione: (2026)
di: Chi, Pham Khanh, et al.
Pubblicazione: (2026)
Deferred Commitment Decoding for Diffusion Language Models
di: Shu, Yingte, et al.
Pubblicazione: (2026)
di: Shu, Yingte, et al.
Pubblicazione: (2026)
SLAB: Efficient Transformers with Simplified Linear Attention and Progressive Re-parameterized Batch Normalization
di: Guo, Jialong, et al.
Pubblicazione: (2024)
di: Guo, Jialong, et al.
Pubblicazione: (2024)
D2LLM: Decomposed and Distilled Large Language Models for Semantic Search
di: Liao, Zihan, et al.
Pubblicazione: (2024)
di: Liao, Zihan, et al.
Pubblicazione: (2024)
Mixture of Lookup Experts
di: Jie, Shibo, et al.
Pubblicazione: (2025)
di: Jie, Shibo, et al.
Pubblicazione: (2025)
Memory-Space Visual Prompting for Efficient Vision-Language Fine-Tuning
di: Jie, Shibo, et al.
Pubblicazione: (2024)
di: Jie, Shibo, et al.
Pubblicazione: (2024)
Trust Region On-Policy Distillation
di: Xing, Xingrun, et al.
Pubblicazione: (2026)
di: Xing, Xingrun, et al.
Pubblicazione: (2026)
EAQuant: Enhancing Post-Training Quantization for MoE Models via Expert-Aware Optimization
di: Fu, Zhongqian, et al.
Pubblicazione: (2025)
di: Fu, Zhongqian, et al.
Pubblicazione: (2025)
SlimLLM: Accurate Structured Pruning for Large Language Models
di: Guo, Jialong, et al.
Pubblicazione: (2025)
di: Guo, Jialong, et al.
Pubblicazione: (2025)
Data Upcycling Knowledge Distillation for Image Super-Resolution
di: Zhang, Yun, et al.
Pubblicazione: (2023)
di: Zhang, Yun, et al.
Pubblicazione: (2023)
MiniLLM: On-Policy Distillation of Large Language Models
di: Gu, Yuxian, et al.
Pubblicazione: (2023)
di: Gu, Yuxian, et al.
Pubblicazione: (2023)
Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing
di: Rang, Miao, et al.
Pubblicazione: (2026)
di: Rang, Miao, et al.
Pubblicazione: (2026)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
Unshackling Context Length: An Efficient Selective Attention Approach through Query-Key Compression
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
Direct Preference Knowledge Distillation for Large Language Models
di: Li, Yixing, et al.
Pubblicazione: (2024)
di: Li, Yixing, et al.
Pubblicazione: (2024)
Black-Box On-Policy Distillation of Large Language Models
di: Ye, Tianzhu, et al.
Pubblicazione: (2025)
di: Ye, Tianzhu, et al.
Pubblicazione: (2025)
PanGu-$π$: Enhancing Language Model Architectures via Nonlinearity Compensation
di: Wang, Yunhe, et al.
Pubblicazione: (2023)
di: Wang, Yunhe, et al.
Pubblicazione: (2023)
PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
di: Tian, Ye, et al.
Pubblicazione: (2025)
di: Tian, Ye, et al.
Pubblicazione: (2025)
Cross-Modal Knowledge Distillation for Speech Large Language Models
di: Wang, Enzhi, et al.
Pubblicazione: (2025)
di: Wang, Enzhi, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Enhanced NLP Task Performance through Knowledge Distillation and Optimized Training Strategies
di: Huang, Yining, et al.
Pubblicazione: (2024)
di: Huang, Yining, et al.
Pubblicazione: (2024)
Structured Agent Distillation for Large Language Model
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
C-MOP: Integrating Momentum and Boundary-Aware Clustering for Enhanced Prompt Evolution
di: Yan, Binwei, et al.
Pubblicazione: (2026)
di: Yan, Binwei, et al.
Pubblicazione: (2026)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
di: Xing, Wang, et al.
Pubblicazione: (2026)
di: Xing, Wang, et al.
Pubblicazione: (2026)
On-Policy Context Distillation for Language Models
di: Ye, Tianzhu, et al.
Pubblicazione: (2026)
di: Ye, Tianzhu, et al.
Pubblicazione: (2026)
PairDistill: Pairwise Relevance Distillation for Dense Retrieval
di: Huang, Chao-Wei, et al.
Pubblicazione: (2024)
di: Huang, Chao-Wei, et al.
Pubblicazione: (2024)
Unifying Text Semantics and Graph Structures for Temporal Text-attributed Graphs with Large Language Models
di: Zhang, Siwei, et al.
Pubblicazione: (2025)
di: Zhang, Siwei, et al.
Pubblicazione: (2025)
Kangaroo: Lossless Self-Speculative Decoding via Double Early Exiting
di: Liu, Fangcheng, et al.
Pubblicazione: (2024)
di: Liu, Fangcheng, et al.
Pubblicazione: (2024)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
di: Li, Jiahuan, et al.
Pubblicazione: (2024)
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
Knowledge Distillation of Black-Box Large Language Models
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training
di: Zhao, Han, et al.
Pubblicazione: (2025)
di: Zhao, Han, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CBQ: Cross-Block Quantization for Large Language Models
di: Ding, Xin, et al.
Pubblicazione: (2023) -
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
di: Cai, Miaomiao, et al.
Pubblicazione: (2025) -
Distilling Semantic Priors from SAM to Efficient Image Restoration Models
di: Zhang, Quan, et al.
Pubblicazione: (2024) -
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025) -
EMS-SD: Efficient Multi-sample Speculative Decoding for Accelerating Large Language Models
di: Ni, Yunsheng, et al.
Pubblicazione: (2024)