LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Siqing, Wang, Chuang, Lang, Yong, Yang, Yi, Zhang, Xu-Yao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Achieving binary weight and activation for LLMs using Post-Training Quantization
por: Song, Siqing, et al.
Publicado: (2025)
por: Song, Siqing, et al.
Publicado: (2025)
EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation
por: Zhang, Shu-Hao, et al.
Publicado: (2026)
por: Zhang, Shu-Hao, et al.
Publicado: (2026)
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
por: Xu, Zihuai, et al.
Publicado: (2025)
por: Xu, Zihuai, et al.
Publicado: (2025)
ARB-LLM: Alternating Refined Binarizations for Large Language Models
por: Li, Zhiteng, et al.
Publicado: (2024)
por: Li, Zhiteng, et al.
Publicado: (2024)
T-LLM: Teaching Large Language Models to Forecast Time Series via Temporal Distillation
por: Guo, Suhan, et al.
Publicado: (2026)
por: Guo, Suhan, et al.
Publicado: (2026)
FBI-LLM: Scaling Up Fully Binarized LLMs from Scratch via Autoregressive Distillation
por: Ma, Liqun, et al.
Publicado: (2024)
por: Ma, Liqun, et al.
Publicado: (2024)
Distillation of Large Language Models via Concrete Score Matching
por: Kim, Yeongmin, et al.
Publicado: (2025)
por: Kim, Yeongmin, et al.
Publicado: (2025)
OR-Toolformer: Modeling and Solving Operations Research Problems with Tool Augmented Large Language Models
por: Zhang, Jianzhang, et al.
Publicado: (2025)
por: Zhang, Jianzhang, et al.
Publicado: (2025)
LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation
por: Liu, Fangxin, et al.
Publicado: (2025)
por: Liu, Fangxin, et al.
Publicado: (2025)
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
por: Zhang, Yao, et al.
Publicado: (2025)
por: Zhang, Yao, et al.
Publicado: (2025)
Efficient Certified Reasoning for Binarized Neural Networks
por: Yang, Jiong, et al.
Publicado: (2025)
por: Yang, Jiong, et al.
Publicado: (2025)
Hamming Attention Distillation: Binarizing Keys and Queries for Efficient Long-Context Transformers
por: Horton, Mark, et al.
Publicado: (2025)
por: Horton, Mark, et al.
Publicado: (2025)
Lillama: Large Language Models Compression via Low-Rank Feature Distillation
por: Sy, Yaya, et al.
Publicado: (2024)
por: Sy, Yaya, et al.
Publicado: (2024)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
por: Park, Seonghyeon, et al.
Publicado: (2026)
por: Park, Seonghyeon, et al.
Publicado: (2026)
Structured Agent Distillation for Large Language Model
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
PPC-GPT: Federated Task-Specific Compression of Large Language Models via Pruning and Chain-of-Thought Distillation
por: Fan, Tao, et al.
Publicado: (2025)
por: Fan, Tao, et al.
Publicado: (2025)
Training Multimodal Large Reasoning Models Needs Better Thoughts: A Three-Stage Framework for Long Chain-of-Thought Synthesis and Selection
por: Wang, Yizhi, et al.
Publicado: (2025)
por: Wang, Yizhi, et al.
Publicado: (2025)
Integrating Knowledge Distillation Methods: A Sequential Multi-Stage Framework
por: Tian, Yinxi, et al.
Publicado: (2026)
por: Tian, Yinxi, et al.
Publicado: (2026)
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023)
por: Yao, Yuanshun, et al.
Publicado: (2023)
A Step Toward Federated Pretraining of Multimodal Large Language Models
por: Xiong, Baochen, et al.
Publicado: (2026)
por: Xiong, Baochen, et al.
Publicado: (2026)
Reasoning Language Model for Personalized Lung Cancer Screening
por: Niu, Chuang, et al.
Publicado: (2025)
por: Niu, Chuang, et al.
Publicado: (2025)
Rethinking the Role of Temperature in Large Language Model Distillation
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
Binarizing Physics-Inspired GNNs for Combinatorial Optimization
por: Krutský, Martin, et al.
Publicado: (2025)
por: Krutský, Martin, et al.
Publicado: (2025)
Inertial Confinement Fusion Forecasting via Large Language Models
por: Chen, Mingkai, et al.
Publicado: (2024)
por: Chen, Mingkai, et al.
Publicado: (2024)
Exploring the Potential of Large Language Models in Graph Generation
por: Yao, Yang, et al.
Publicado: (2024)
por: Yao, Yang, et al.
Publicado: (2024)
Oblivionis: A Lightweight Learning and Unlearning Framework for Federated Large Language Models
por: Zhang, Fuyao, et al.
Publicado: (2025)
por: Zhang, Fuyao, et al.
Publicado: (2025)
Enhancing Graph Neural Networks with Limited Labeled Data by Actively Distilling Knowledge from Large Language Models
por: Li, Quan, et al.
Publicado: (2024)
por: Li, Quan, et al.
Publicado: (2024)
Large Language Models Explore by Latent Distilling
por: Zeng, Yuanhao, et al.
Publicado: (2026)
por: Zeng, Yuanhao, et al.
Publicado: (2026)
Curriculum Learning-Guided Progressive Distillation in Large Language Models
por: Cao, Jincheng, et al.
Publicado: (2026)
por: Cao, Jincheng, et al.
Publicado: (2026)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
por: Yang, Runming, et al.
Publicado: (2024)
por: Yang, Runming, et al.
Publicado: (2024)
Large Language Model Distilling Medication Recommendation Model
por: Liu, Qidong, et al.
Publicado: (2024)
por: Liu, Qidong, et al.
Publicado: (2024)
Dist2ill: Distributional Distillation for One-Pass Uncertainty Estimation in Large Language Models
por: Zhao, Yicong, et al.
Publicado: (2025)
por: Zhao, Yicong, et al.
Publicado: (2025)
Mixture of Experts in Large Language Models
por: Zhang, Danyang, et al.
Publicado: (2025)
por: Zhang, Danyang, et al.
Publicado: (2025)
TaxDistill: Improving Metagenomic Taxonomic Annotation via Distilled Genomic Foundation Models
por: Ye, Rongye, et al.
Publicado: (2026)
por: Ye, Rongye, et al.
Publicado: (2026)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2026)
por: Zhang, Songming, et al.
Publicado: (2026)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Manifold-Aware Temporal Domain Generalization for Large Language Models
por: Yao, Yiheng, et al.
Publicado: (2026)
por: Yao, Yiheng, et al.
Publicado: (2026)
A Sugeno Integral View of Binarized Neural Network Inference
por: Baaj, Ismaïl, et al.
Publicado: (2026)
por: Baaj, Ismaïl, et al.
Publicado: (2026)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
por: Sun, Haotian, et al.
Publicado: (2024)
por: Sun, Haotian, et al.
Publicado: (2024)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
por: Zhang, Songming, et al.
Publicado: (2025)
por: Zhang, Songming, et al.
Publicado: (2025)
Ejemplares similares
-
Achieving binary weight and activation for LLMs using Post-Training Quantization
por: Song, Siqing, et al.
Publicado: (2025) -
EdgeRazor: A Lightweight Framework for Large Language Models via Mixed-Precision Quantization-Aware Distillation
por: Zhang, Shu-Hao, et al.
Publicado: (2026) -
Lightweight and Post-Training Structured Pruning for On-Device Large Lanaguage Models
por: Xu, Zihuai, et al.
Publicado: (2025) -
ARB-LLM: Alternating Refined Binarizations for Large Language Models
por: Li, Zhiteng, et al.
Publicado: (2024) -
T-LLM: Teaching Large Language Models to Forecast Time Series via Temporal Distillation
por: Guo, Suhan, et al.
Publicado: (2026)