Activation Outliers in Transformer Quantization: Reproduction, Statistical Analysis, and Deployment Tradeoffs
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Kaliaperumal, Pranav Kumar |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Astro: Activation-guided Structured Regularization for Outlier-Robust LLM Post-Training Quantization
par: Chen, Xi, et autres
Publié: (2026)
par: Chen, Xi, et autres
Publié: (2026)
Every Bit Counts: A Theoretical Study of Precision-Expressivity Tradeoffs in Quantized Transformers
par: Chakrabarti, Sayak, et autres
Publié: (2026)
par: Chakrabarti, Sayak, et autres
Publié: (2026)
Robust Statistical Scaling of Outlier Scores: Improving the Quality of Outlier Probabilities for Outliers (Extended Version)
par: Röchner, Philipp, et autres
Publié: (2024)
par: Röchner, Philipp, et autres
Publié: (2024)
Widening the Gap: Exploiting LLM Quantization via Outlier Injection
par: Zhan, Xiaohua, et autres
Publié: (2026)
par: Zhan, Xiaohua, et autres
Publié: (2026)
Memory-Statistics Tradeoff in Continual Learning with Structural Regularization
par: Li, Haoran, et autres
Publié: (2025)
par: Li, Haoran, et autres
Publié: (2025)
Rethinking RoPE Scaling in Quantized LLM: Theory, Outlier, and Channel-Band Analysis with Weight Rescaling
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
RoLoRA: Fine-tuning Rotated Outlier-free LLMs for Effective Weight-Activation Quantization
par: Huang, Xijie, et autres
Publié: (2024)
par: Huang, Xijie, et autres
Publié: (2024)
Matryoshka Quantization
par: Nair, Pranav, et autres
Publié: (2025)
par: Nair, Pranav, et autres
Publié: (2025)
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
par: Federici, Marco, et autres
Publié: (2025)
par: Federici, Marco, et autres
Publié: (2025)
Quaff: Quantized Parameter-Efficient Fine-Tuning under Outlier Spatial Stability Hypothesis
par: Huang, Hong, et autres
Publié: (2025)
par: Huang, Hong, et autres
Publié: (2025)
SLMQuant:Benchmarking Small Language Model Quantization for Practical Deployment
par: Wang, Jiacheng, et autres
Publié: (2025)
par: Wang, Jiacheng, et autres
Publié: (2025)
MUXQ: Mixed-to-Uniform Precision MatriX Quantization via Low-Rank Outlier Decomposition
par: Lee, Seoungsub, et autres
Publié: (2026)
par: Lee, Seoungsub, et autres
Publié: (2026)
Outlier-Efficient Hopfield Layers for Large Transformer-Based Models
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
OSC: Hardware Efficient W4A4 Quantization via Outlier Separation in Channel Dimension
par: Zhang, Zhiyuan, et autres
Publié: (2026)
par: Zhang, Zhiyuan, et autres
Publié: (2026)
Q-ROAR: Outlier-Aware Rescaling for RoPE Position Interpolation in Quantized Long-Context LLMs
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
Advancing Model Refinement: Muon-Optimized Distillation and Quantization for LLM Deployment
par: Sander, Jacob, et autres
Publié: (2026)
par: Sander, Jacob, et autres
Publié: (2026)
Q-realign: Piggybacking Realignment on Quantization for Safe and Efficient LLM Deployment
par: Tan, Qitao, et autres
Publié: (2026)
par: Tan, Qitao, et autres
Publié: (2026)
Outliers and Calibration Sets have Diminishing Effect on Quantization of Modern LLMs
par: Paglieri, Davide, et autres
Publié: (2024)
par: Paglieri, Davide, et autres
Publié: (2024)
Long-Term Outlier Prediction Through Outlier Score Modeling
par: Aoki, Yuma, et autres
Publié: (2026)
par: Aoki, Yuma, et autres
Publié: (2026)
Outlier Detection in Plantar Pressure: Human-Centered Comparison of Statistical Parametric Mapping and Explainable Machine Learning
par: Dindorf, Carlo, et autres
Publié: (2025)
par: Dindorf, Carlo, et autres
Publié: (2025)
CDQuant: Greedy Coordinate Descent for Accurate LLM Quantization
par: Nair, Pranav Ajit, et autres
Publié: (2024)
par: Nair, Pranav Ajit, et autres
Publié: (2024)
Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative
par: Zhang, Tuo, et autres
Publié: (2025)
par: Zhang, Tuo, et autres
Publié: (2025)
Post-Training Quantization of OpenPangu Models for Efficient Deployment on Atlas A2
par: Luo, Yilun, et autres
Publié: (2025)
par: Luo, Yilun, et autres
Publié: (2025)
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
par: Park, Jungwoo, et autres
Publié: (2025)
par: Park, Jungwoo, et autres
Publié: (2025)
MicroScopiQ: Accelerating Foundational Models through Outlier-Aware Microscaling Quantization
par: Ramachandran, Akshat, et autres
Publié: (2024)
par: Ramachandran, Akshat, et autres
Publié: (2024)
DMQ: Dissecting Outliers of Diffusion Models for Post-Training Quantization
par: Lee, Dongyeun, et autres
Publié: (2025)
par: Lee, Dongyeun, et autres
Publié: (2025)
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
par: Lee, Deokjae, et autres
Publié: (2025)
par: Lee, Deokjae, et autres
Publié: (2025)
LoopQ: Quantization for Recursive Transformers
par: Fang, Rui, et autres
Publié: (2026)
par: Fang, Rui, et autres
Publié: (2026)
Activation Sensitivity as a Unifying Principle for Post-Training Quantization
par: Xu, Bruce Changlong
Publié: (2026)
par: Xu, Bruce Changlong
Publié: (2026)
Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers
par: Ravindran, Santhosh Kumar
Publié: (2025)
par: Ravindran, Santhosh Kumar
Publié: (2025)
OptRot: Mitigating Weight Outliers via Data-Free Rotations for Post-Training Quantization
par: Gadhikar, Advait, et autres
Publié: (2025)
par: Gadhikar, Advait, et autres
Publié: (2025)
Taming Outlier Tokens in Diffusion Transformers
par: Wu, Xiaoyu, et autres
Publié: (2026)
par: Wu, Xiaoyu, et autres
Publié: (2026)
InfoQuant: Shaping Activation Distributions for Low-Bit LLM Quantization
par: Li, Ke, et autres
Publié: (2026)
par: Li, Ke, et autres
Publié: (2026)
ASER: Activation Smoothing and Error Reconstruction for Large Language Model Quantization
par: Zhao, Weibo, et autres
Publié: (2024)
par: Zhao, Weibo, et autres
Publié: (2024)
Turning LLM Activations Quantization-Friendly
par: Czakó, Patrik, et autres
Publié: (2025)
par: Czakó, Patrik, et autres
Publié: (2025)
Post-Training Statistical Calibration for Higher Activation Sparsity
par: Chua, Vui Seng, et autres
Publié: (2024)
par: Chua, Vui Seng, et autres
Publié: (2024)
Statistically-Guided Meta-Learning for Cross-Deployment Activity Recognition in Distributed Fiber-Optic Sensing
par: He, Yifan, et autres
Publié: (2025)
par: He, Yifan, et autres
Publié: (2025)
Attention Sinks and Outliers in Attention Residuals
par: Luo, Haozheng, et autres
Publié: (2026)
par: Luo, Haozheng, et autres
Publié: (2026)
Outlier Gradient Analysis: Efficiently Identifying Detrimental Training Samples for Deep Learning Models
par: Chhabra, Anshuman, et autres
Publié: (2024)
par: Chhabra, Anshuman, et autres
Publié: (2024)
Quantifying Empirical Compute-Supervision Tradeoffs in RLVR
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
Documents similaires
-
Astro: Activation-guided Structured Regularization for Outlier-Robust LLM Post-Training Quantization
par: Chen, Xi, et autres
Publié: (2026) -
Every Bit Counts: A Theoretical Study of Precision-Expressivity Tradeoffs in Quantized Transformers
par: Chakrabarti, Sayak, et autres
Publié: (2026) -
Robust Statistical Scaling of Outlier Scores: Improving the Quality of Outlier Probabilities for Outliers (Extended Version)
par: Röchner, Philipp, et autres
Publié: (2024) -
Widening the Gap: Exploiting LLM Quantization via Outlier Injection
par: Zhan, Xiaohua, et autres
Publié: (2026) -
Memory-Statistics Tradeoff in Continual Learning with Structural Regularization
par: Li, Haoran, et autres
Publié: (2025)