Saliency-Aware Regularized Quantization Calibration for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Yanlong, Cheng, Xiaoyuan, Liu, Huihang, He, Baihua, Zhang, Xinyu, Zhu, Harrison Bo Hua, Chen, Wenlong, Zeng, Li, Sun, Zhuo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Representation Transfer Learning for Semiparametric Regression
by: He, Baihua, et al.
Published: (2024)
by: He, Baihua, et al.
Published: (2024)
ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models
by: Yoon, Junho, et al.
Published: (2025)
by: Yoon, Junho, et al.
Published: (2025)
Enhancing Ultra-Low-Bit Quantization of Large Language Models Through Saliency-Aware Partial Retraining
by: Cao, Deyu, et al.
Published: (2025)
by: Cao, Deyu, et al.
Published: (2025)
Estimation of Directed Acyclic Graphs by Frequentist Model Averaging
by: Liu, Huihang, et al.
Published: (2026)
by: Liu, Huihang, et al.
Published: (2026)
Sufficiency-principled Transfer Learning via Model Averaging
by: Zhang, Xiyuan, et al.
Published: (2025)
by: Zhang, Xiyuan, et al.
Published: (2025)
Refining Salience-Aware Sparse Fine-Tuning Strategies for Language Models
by: Liu, Xinxin, et al.
Published: (2024)
by: Liu, Xinxin, et al.
Published: (2024)
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
by: Shao, Wenqi, et al.
Published: (2023)
by: Shao, Wenqi, et al.
Published: (2023)
Fine-Grained Post-Training Quantization for Large Vision Language Models with Quantization-Aware Integrated Gradients
by: Xiang, Ziwei, et al.
Published: (2026)
by: Xiang, Ziwei, et al.
Published: (2026)
Saliency-Aware Regularized Graph Neural Network
by: Pei, Wenjie, et al.
Published: (2024)
by: Pei, Wenjie, et al.
Published: (2024)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
by: Huang, Wei, et al.
Published: (2024)
by: Huang, Wei, et al.
Published: (2024)
Deep Generative Demand Learning for Newsvendor and Pricing
by: Gong, Shijin, et al.
Published: (2024)
by: Gong, Shijin, et al.
Published: (2024)
Semi-supervised learning using copula-based regression and model averaging
by: Gao, Ziwen, et al.
Published: (2024)
by: Gao, Ziwen, et al.
Published: (2024)
Saliency-Aware Multi-Route Thinking: Revisiting Vision-Language Reasoning
by: Shi, Mingjia, et al.
Published: (2026)
by: Shi, Mingjia, et al.
Published: (2026)
Interdomain Attention: Beyond Token-Level Key-Value Memory
by: Kiyohara, Naoki, et al.
Published: (2026)
by: Kiyohara, Naoki, et al.
Published: (2026)
On Calibration of Large Language Models: From Response To Capability
by: Yang, Sin-Han, et al.
Published: (2026)
by: Yang, Sin-Han, et al.
Published: (2026)
Learning Spatio-Temporal Dynamics for Trajectory Recovery via Time-Aware Transformer
by: Sun, Tian, et al.
Published: (2025)
by: Sun, Tian, et al.
Published: (2025)
Saliency-Aware Quantized Imitation Learning for Efficient Robotic Control
by: Park, Seongmin, et al.
Published: (2025)
by: Park, Seongmin, et al.
Published: (2025)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
by: Hao, Sai, et al.
Published: (2026)
by: Hao, Sai, et al.
Published: (2026)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
by: Fang, Ke, et al.
Published: (2025)
by: Fang, Ke, et al.
Published: (2025)
SERQ: Saliency-Aware Low-Rank Error Reconstruction for LLM Quantization
by: Park, Yeonsik, et al.
Published: (2026)
by: Park, Yeonsik, et al.
Published: (2026)
GWQ: Gradient-Aware Weight Quantization for Large Language Models
by: Shao, Yihua, et al.
Published: (2024)
by: Shao, Yihua, et al.
Published: (2024)
Saliency-driven Dynamic Token Pruning for Large Language Models
by: Tao, Yao, et al.
Published: (2025)
by: Tao, Yao, et al.
Published: (2025)
Semantic Consistency Regularization with Large Language Models for Semi-supervised Sentiment Analysis
by: Li, Kunrong, et al.
Published: (2025)
by: Li, Kunrong, et al.
Published: (2025)
Saliency-Aware Model Merging
by: Park, Jungin, et al.
Published: (2026)
by: Park, Jungin, et al.
Published: (2026)
ASER: Activation Smoothing and Error Reconstruction for Large Language Model Quantization
by: Zhao, Weibo, et al.
Published: (2024)
by: Zhao, Weibo, et al.
Published: (2024)
WenyanGPT: A Large Language Model for Classical Chinese Tasks
by: Yao, Xinyu, et al.
Published: (2025)
by: Yao, Xinyu, et al.
Published: (2025)
Saliency Assisted Quantization for Neural Networks
by: Rezabeyk, Elmira Mousa, et al.
Published: (2024)
by: Rezabeyk, Elmira Mousa, et al.
Published: (2024)
Distribution-Aware Companding Quantization of Large Language Models
by: Radhakrishnan, Athul, et al.
Published: (2026)
by: Radhakrishnan, Athul, et al.
Published: (2026)
Intrinsic Structure as a Proxy for Saliency: SVD-Based Weight Preservation for Mixed-Precision Quantization in Large Language Models
by: Landge, Shashank, et al.
Published: (2025)
by: Landge, Shashank, et al.
Published: (2025)
VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models
by: Xue, Yufei, et al.
Published: (2025)
by: Xue, Yufei, et al.
Published: (2025)
Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models
by: Shoaeinaeini, Maryam, et al.
Published: (2024)
by: Shoaeinaeini, Maryam, et al.
Published: (2024)
Uncertainty Drives Social Bias Changes in Quantized Large Language Models
by: Hua, Stanley Z., et al.
Published: (2026)
by: Hua, Stanley Z., et al.
Published: (2026)
Mixed-Precision Graph Neural Quantization for Low Bit Large Language Models
by: Liu, Wanlong, et al.
Published: (2025)
by: Liu, Wanlong, et al.
Published: (2025)
Finding Visual Saliency in Continuous Spike Stream
by: Zhu, Lin, et al.
Published: (2024)
by: Zhu, Lin, et al.
Published: (2024)
AnTKV: Anchor Token-Aware Sub-Bit Vector Quantization for KV Cache in Large Language Models
by: Li, Zeyu, et al.
Published: (2025)
by: Li, Zeyu, et al.
Published: (2025)
Behavioral Analysis of Information Salience in Large Language Models
by: Trienes, Jan, et al.
Published: (2025)
by: Trienes, Jan, et al.
Published: (2025)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
by: Chen, Mengzhao, et al.
Published: (2024)
by: Chen, Mengzhao, et al.
Published: (2024)
MASQuant: Modality-Aware Smoothing Quantization for Multimodal Large Language Models
by: Hu, Lulu, et al.
Published: (2026)
by: Hu, Lulu, et al.
Published: (2026)
Multilevel Control Functional
by: Li, Kaiyu, et al.
Published: (2023)
by: Li, Kaiyu, et al.
Published: (2023)
HiVid: LLM-Guided Video Saliency For Content-Aware VOD And Live Streaming
by: Chen, Jiahui, et al.
Published: (2026)
by: Chen, Jiahui, et al.
Published: (2026)
Similar Items
-
Representation Transfer Learning for Semiparametric Regression
by: He, Baihua, et al.
Published: (2024) -
ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models
by: Yoon, Junho, et al.
Published: (2025) -
Enhancing Ultra-Low-Bit Quantization of Large Language Models Through Saliency-Aware Partial Retraining
by: Cao, Deyu, et al.
Published: (2025) -
Estimation of Directed Acyclic Graphs by Frequentist Model Averaging
by: Liu, Huihang, et al.
Published: (2026) -
Sufficiency-principled Transfer Learning via Model Averaging
by: Zhang, Xiyuan, et al.
Published: (2025)