LSAQ: Layer-Specific Adaptive Quantization for Large Language Model Deployment
Fuente:
arXiv
Saved in:
| Main Authors: | Zeng, Binrui, Ji, Bin, Liu, Xiaodong, Yu, Jie, Li, Shasha, Ma, Jun, Li, Xiaopeng, Wang, Shangwen, Hong, Xinran, Tang, Yongtao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SWSC: Shared Weight for Similar Channel in LLM
by: Zeng, Binrui, et al.
Published: (2025)
by: Zeng, Binrui, et al.
Published: (2025)
Identifying Knowledge Editing Types in Large Language Models
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
Model Editing for LLMs4Code: How Far are We?
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
EMSEdit: Efficient Multi-Step Meta-Learning-based Model Editing
by: Li, Xiaopeng, et al.
Published: (2025)
by: Li, Xiaopeng, et al.
Published: (2025)
Outlier Smoothing with Closed-Form Rotations for W4A4 Large Language Model Quantization
by: Xiao, Jinying, et al.
Published: (2025)
by: Xiao, Jinying, et al.
Published: (2025)
DIM: Dynamic Integration of Multimodal Entity Linking with Large Language Model
by: Song, Shezheng, et al.
Published: (2024)
by: Song, Shezheng, et al.
Published: (2024)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
Rethinking Residual Distribution in Locate-then-Edit Model Editing
by: Li, Xiaopeng, et al.
Published: (2025)
by: Li, Xiaopeng, et al.
Published: (2025)
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
by: Song, Shezheng, et al.
Published: (2023)
by: Song, Shezheng, et al.
Published: (2023)
PMET: Precise Model Editing in a Transformer
by: Li, Xiaopeng, et al.
Published: (2023)
by: Li, Xiaopeng, et al.
Published: (2023)
EMP: Enhance Memory in Data Pruning
by: Xiao, Jinying, et al.
Published: (2024)
by: Xiao, Jinying, et al.
Published: (2024)
How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization
by: Song, Shezheng, et al.
Published: (2025)
by: Song, Shezheng, et al.
Published: (2025)
Stand on The Shoulders of Giants: Building JailExpert from Previous Attack Experience
by: Wang, Xi, et al.
Published: (2025)
by: Wang, Xi, et al.
Published: (2025)
Seeing Right but Saying Wrong: Inter- and Intra-Layer Refinement in MLLMs without Training
by: Song, Shezheng, et al.
Published: (2026)
by: Song, Shezheng, et al.
Published: (2026)
JPU: Bridging Jailbreak Defense and Unlearning via On-Policy Path Rectification
by: Wang, Xi, et al.
Published: (2026)
by: Wang, Xi, et al.
Published: (2026)
DWE+: Dual-Way Matching Enhanced Framework for Multimodal Entity Linking
by: Song, Shezheng, et al.
Published: (2024)
by: Song, Shezheng, et al.
Published: (2024)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
by: Wang, Xinhao, et al.
Published: (2026)
by: Wang, Xinhao, et al.
Published: (2026)
FedQuad: Adaptive Layer-wise LoRA Deployment and Activation Quantization for Federated Fine-Tuning
by: Li, Rukuo, et al.
Published: (2025)
by: Li, Rukuo, et al.
Published: (2025)
SLMQuant:Benchmarking Small Language Model Quantization for Practical Deployment
by: Wang, Jiacheng, et al.
Published: (2025)
by: Wang, Jiacheng, et al.
Published: (2025)
Adaptive Softassign via Hadamard-Equipped Sinkhorn
by: Shen, Binrui, et al.
Published: (2023)
by: Shen, Binrui, et al.
Published: (2023)
Streamlining Redundant Layers to Compress Large Language Models
by: Chen, Xiaodong, et al.
Published: (2024)
by: Chen, Xiaodong, et al.
Published: (2024)
Where Does Vision Meet Language? Understanding and Refining Visual Fusion in MLLMs via Contrastive Attention
by: Song, Shezheng, et al.
Published: (2026)
by: Song, Shezheng, et al.
Published: (2026)
Adaptive Layer-Wise Transformations for Post-Training Quantization of Large Language Models
by: Pham, Cuong, et al.
Published: (2025)
by: Pham, Cuong, et al.
Published: (2025)
CSGO: Constrained-Softassign Gradient Optimization For Large Graph Matching
by: Shen, Binrui, et al.
Published: (2022)
by: Shen, Binrui, et al.
Published: (2022)
The A-R Behavioral Space: Execution-Level Profiling of Tool-Using Language Model Agents in Organizational Deployment
by: Yu, Shasha, et al.
Published: (2026)
by: Yu, Shasha, et al.
Published: (2026)
Camel: Energy-Aware LLM Inference on Resource-Constrained Devices
by: Xu, Hao, et al.
Published: (2025)
by: Xu, Hao, et al.
Published: (2025)
MuDPT: Multi-modal Deep-symphysis Prompt Tuning for Large Pre-trained Vision-Language Models
by: Miao, Yongzhu, et al.
Published: (2023)
by: Miao, Yongzhu, et al.
Published: (2023)
The forewing–hindwing coupling of a black cicada Cryptotympana atrata (Hemiptera: Cicadidae): Functional morphology and kinematics
by: Qian Li, et al.
Published: (2025)
by: Qian Li, et al.
Published: (2025)
Elevation, soil pH and calcium availability shape regional and local scale spatial patterns of PhoD gene abundance in tropical and subtropical forests
by: Sandhya Mishra, et al.
Published: (2026)
by: Sandhya Mishra, et al.
Published: (2026)
StableQuant: Layer Adaptive Post-Training Quantization for Speech Foundation Models
by: Hong, Yeona, et al.
Published: (2025)
by: Hong, Yeona, et al.
Published: (2025)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
by: Zhan, Zaifu, et al.
Published: (2025)
by: Zhan, Zaifu, et al.
Published: (2025)
Layer Control of Magneto-Optical Effects and Their Quantization in Spin-Valley Splitting Antiferromagnets
by: Feng, Jiaqi, et al.
Published: (2024)
by: Feng, Jiaqi, et al.
Published: (2024)
PTA: Enhancing Multimodal Sentiment Analysis through Pipelined Prediction and Translation-based Alignment
by: Song, Shezheng, et al.
Published: (2024)
by: Song, Shezheng, et al.
Published: (2024)
Thrust: Adaptively Propels Large Language Models with External Knowledge
by: Zhao, Xinran, et al.
Published: (2023)
by: Zhao, Xinran, et al.
Published: (2023)
CoLLM-NAS: Collaborative Large Language Models for Efficient Knowledge-Guided Neural Architecture Search
by: Li, Zhe, et al.
Published: (2025)
by: Li, Zhe, et al.
Published: (2025)
LCQ: Low-Rank Codebook based Quantization for Large Language Models
by: Cai, Wen-Pu, et al.
Published: (2024)
by: Cai, Wen-Pu, et al.
Published: (2024)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
by: Liu, Han, et al.
Published: (2026)
by: Liu, Han, et al.
Published: (2026)
SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models
by: Liu, Han, et al.
Published: (2026)
by: Liu, Han, et al.
Published: (2026)
Three Heads Are Better Than One: A Multi-perspective Reasoning Framework for Enhanced Vulnerability Detection
by: Peng, Xin, et al.
Published: (2026)
by: Peng, Xin, et al.
Published: (2026)
Large Language Models-Aided Program Debloating
by: Lin, Bo, et al.
Published: (2025)
by: Lin, Bo, et al.
Published: (2025)
Similar Items
-
SWSC: Shared Weight for Similar Channel in LLM
by: Zeng, Binrui, et al.
Published: (2025) -
Identifying Knowledge Editing Types in Large Language Models
by: Li, Xiaopeng, et al.
Published: (2024) -
Model Editing for LLMs4Code: How Far are We?
by: Li, Xiaopeng, et al.
Published: (2024) -
EMSEdit: Efficient Multi-Step Meta-Learning-based Model Editing
by: Li, Xiaopeng, et al.
Published: (2025) -
Outlier Smoothing with Closed-Form Rotations for W4A4 Large Language Model Quantization
by: Xiao, Jinying, et al.
Published: (2025)