LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Su, Yupeng, Guan, Ziyi, Liu, Xiaoqun, Jin, Tianlai, Wu, Dongkuan, Chen, Zhengfei, Chesi, Graziano, Wong, Ngai, Yu, Hao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
by: Guan, Ziyi, et al.
Published: (2024)
by: Guan, Ziyi, et al.
Published: (2024)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
by: Shao, Hang, et al.
Published: (2023)
by: Shao, Hang, et al.
Published: (2023)
Re-Activating Frozen Primitives for 3D Gaussian Splatting
by: Cheng, Yuxin, et al.
Published: (2025)
by: Cheng, Yuxin, et al.
Published: (2025)
Perspective-aware 3D Gaussian Inpainting with Multi-view Consistency
by: Cheng, Yuxin, et al.
Published: (2025)
by: Cheng, Yuxin, et al.
Published: (2025)
MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models
by: Fang, Gongfan, et al.
Published: (2024)
by: Fang, Gongfan, et al.
Published: (2024)
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
by: Xiao, He, et al.
Published: (2025)
by: Xiao, He, et al.
Published: (2025)
Large Language Models as Surrogate Models in Evolutionary Algorithms: A Preliminary Study
by: Hao, Hao, et al.
Published: (2024)
by: Hao, Hao, et al.
Published: (2024)
ProTrain: Efficient LLM Training via Memory-Aware Techniques
by: Yang, Hanmei, et al.
Published: (2024)
by: Yang, Hanmei, et al.
Published: (2024)
KG-RAG: Enhancing GUI Agent Decision-Making via Knowledge Graph-Driven Retrieval-Augmented Generation
by: Guan, Ziyi, et al.
Published: (2025)
by: Guan, Ziyi, et al.
Published: (2025)
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
by: Li, Zhen, et al.
Published: (2025)
by: Li, Zhen, et al.
Published: (2025)
Non-Overlap-Aware Egocentric Pose Estimation for Collaborative Perception in Connected Autonomy
by: Huang, Hong, et al.
Published: (2025)
by: Huang, Hong, et al.
Published: (2025)
Breaking through Deterministic Barriers: Randomized Pruning Mask Generation and Selection
by: Li, Jianwei, et al.
Published: (2023)
by: Li, Jianwei, et al.
Published: (2023)
Quantum second harmonic generation in terms of elementary processes
by: Chesi, Giovanni
Published: (2024)
by: Chesi, Giovanni
Published: (2024)
A conclusive remark on linguistic theorizing and language modeling
by: Chesi, Cristiano
Published: (2025)
by: Chesi, Cristiano
Published: (2025)
Is it the end of (generative) linguistics as we know it?
by: Chesi, Cristiano
Published: (2024)
by: Chesi, Cristiano
Published: (2024)
Adaptive Draft-Verification for Efficient Large Language Model Decoding
by: Liu, Xukun, et al.
Published: (2024)
by: Liu, Xukun, et al.
Published: (2024)
Revising the "One-Shot" through Lesson Study: Collaborating with Writing Faculty to Rebuild a Library Instruction Session
by: Watson, Shevaun E., et al.
Published: (2013)
by: Watson, Shevaun E., et al.
Published: (2013)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
by: Yang, Runming, et al.
Published: (2024)
by: Yang, Runming, et al.
Published: (2024)
Masked Spatial Propagation Network for Sparsity-Adaptive Depth Refinement
by: Jun, Jinyoung, et al.
Published: (2024)
by: Jun, Jinyoung, et al.
Published: (2024)
CATS: Contextually-Aware Thresholding for Sparsity in Large Language Models
by: Lee, Donghyun, et al.
Published: (2024)
by: Lee, Donghyun, et al.
Published: (2024)
ROSE: Reordered SparseGPT for More Accurate One-Shot Large Language Models Pruning
by: Su, Mingluo, et al.
Published: (2026)
by: Su, Mingluo, et al.
Published: (2026)
EdgeLLM: A Highly Efficient CPU-FPGA Heterogeneous Edge Accelerator for Large Language Models
by: Huang, Mingqiang, et al.
Published: (2024)
by: Huang, Mingqiang, et al.
Published: (2024)
Sparsity-Accelerated Training for Large Language Models
by: Ma, Da, et al.
Published: (2024)
by: Ma, Da, et al.
Published: (2024)
SAU: Sparsity-Aware Unlearning for LLMs via Gradient Masking and Importance Redistribution
by: Wang, Yuze, et al.
Published: (2026)
by: Wang, Yuze, et al.
Published: (2026)
Unveiling Super Experts in Mixture-of-Experts Large Language Models
by: Su, Zunhai, et al.
Published: (2025)
by: Su, Zunhai, et al.
Published: (2025)
UNComp: Can Matrix Entropy Uncover Sparsity? -- A Compressor Design from an Uncertainty-Aware Perspective
by: Xiong, Jing, et al.
Published: (2024)
by: Xiong, Jing, et al.
Published: (2024)
Rebuilding Syria
Published: (2019)
Published: (2019)
ShadowLLM: Predictor-based Contextual Sparsity for Large Language Models
by: Akhauri, Yash, et al.
Published: (2024)
by: Akhauri, Yash, et al.
Published: (2024)
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
by: Yang, Yifan, et al.
Published: (2024)
by: Yang, Yifan, et al.
Published: (2024)
Masked Matrix Multiplication for Emergent Sparsity
by: Wheatman, Brian, et al.
Published: (2024)
by: Wheatman, Brian, et al.
Published: (2024)
Frequency Masking for Universal Deepfake Detection
by: Doloriel, Chandler Timm, et al.
Published: (2024)
by: Doloriel, Chandler Timm, et al.
Published: (2024)
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
by: Lu, Guanxi, et al.
Published: (2025)
by: Lu, Guanxi, et al.
Published: (2025)
Dependency-Aware Semi-Structured Sparsity of GLU Variants in Large Language Models
by: Guo, Zhiyu, et al.
Published: (2024)
by: Guo, Zhiyu, et al.
Published: (2024)
One-Shot Learning as Instruction Data Prospector for Large Language Models
by: Li, Yunshui, et al.
Published: (2023)
by: Li, Yunshui, et al.
Published: (2023)
Quantum Uncertainty and Entropy
by: Chesi, Giovanni, et al.
Published: (2026)
by: Chesi, Giovanni, et al.
Published: (2026)
Timestep-Aware Block Masking for Efficient Diffusion Model Inference
by: He, Haodong, et al.
Published: (2026)
by: He, Haodong, et al.
Published: (2026)
Rebuilding broken hearts
Published: (2004)
Published: (2004)
Rebuilding the food pyramid
Published: (2003)
Published: (2003)
RaaS: Reasoning-Aware Attention Sparsity for Efficient LLM Reasoning
by: Hu, Junhao, et al.
Published: (2025)
by: Hu, Junhao, et al.
Published: (2025)
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
by: Xue, Yu, et al.
Published: (2026)
by: Xue, Yu, et al.
Published: (2026)
Similar Items
-
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
by: Guan, Ziyi, et al.
Published: (2024) -
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
by: Shao, Hang, et al.
Published: (2023) -
Re-Activating Frozen Primitives for 3D Gaussian Splatting
by: Cheng, Yuxin, et al.
Published: (2025) -
Perspective-aware 3D Gaussian Inpainting with Multi-view Consistency
by: Cheng, Yuxin, et al.
Published: (2025) -
MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models
by: Fang, Gongfan, et al.
Published: (2024)