ADMM-Q: An Improved Hessian-based Weight Quantizer for Post-Training Quantization of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Lucas, Ryan, Makni, Mehdi, Meng, Xiang, Deng, Adam, Mazumder, Rahul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
3BASiL: An Algorithmic Framework for Sparse plus Low-Rank Compression of LLMs
di: Makni, Mehdi, et al.
Pubblicazione: (2026)
di: Makni, Mehdi, et al.
Pubblicazione: (2026)
TSENOR: Highly-Efficient Algorithm for Finding Transposable N:M Sparse Masks
di: Meng, Xiang, et al.
Pubblicazione: (2025)
di: Meng, Xiang, et al.
Pubblicazione: (2025)
Preserving Deep Representations In One-Shot Pruning: A Hessian-Free Second-Order Optimization Framework
di: Lucas, Ryan, et al.
Pubblicazione: (2024)
di: Lucas, Ryan, et al.
Pubblicazione: (2024)
HASSLE-free: A unified Framework for Sparse plus Low-Rank Matrix Decomposition for LLMs
di: Makni, Mehdi, et al.
Pubblicazione: (2025)
di: Makni, Mehdi, et al.
Pubblicazione: (2025)
Boost Post-Training Quantization via Null Space Optimization for Large Language Models
di: Zhao, Jiaqi, et al.
Pubblicazione: (2025)
di: Zhao, Jiaqi, et al.
Pubblicazione: (2025)
ALPS: Improved Optimization for Highly Sparse One-Shot Pruning for Large Language Models
di: Meng, Xiang, et al.
Pubblicazione: (2024)
di: Meng, Xiang, et al.
Pubblicazione: (2024)
Scaling Laws for Post Training Quantized Large Language Models
di: Xu, Zifei, et al.
Pubblicazione: (2024)
di: Xu, Zifei, et al.
Pubblicazione: (2024)
Post Training Quantization of Large Language Models with Microscaling Formats
di: Sharify, Sayeh, et al.
Pubblicazione: (2024)
di: Sharify, Sayeh, et al.
Pubblicazione: (2024)
MagR: Weight Magnitude Reduction for Enhancing Post-Training Quantization
di: Zhang, Aozhong, et al.
Pubblicazione: (2024)
di: Zhang, Aozhong, et al.
Pubblicazione: (2024)
Improving Quantization with Post-Training Model Expansion
di: Franco, Giuseppe, et al.
Pubblicazione: (2025)
di: Franco, Giuseppe, et al.
Pubblicazione: (2025)
Q-GADMM: Quantized Group ADMM for Communication Efficient Decentralized Machine Learning
di: Elgabli, Anis, et al.
Pubblicazione: (2019)
di: Elgabli, Anis, et al.
Pubblicazione: (2019)
Accumulator-Aware Post-Training Quantization for Large Language Models
di: Colbert, Ian, et al.
Pubblicazione: (2024)
di: Colbert, Ian, et al.
Pubblicazione: (2024)
Adaptive Layer-Wise Transformations for Post-Training Quantization of Large Language Models
di: Pham, Cuong, et al.
Pubblicazione: (2025)
di: Pham, Cuong, et al.
Pubblicazione: (2025)
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
di: Xiao, He, et al.
Pubblicazione: (2025)
di: Xiao, He, et al.
Pubblicazione: (2025)
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
Benford's Law as a Distributional Prior for Post-Training Quantization of Large Language Models
di: Negrão, Arthur, et al.
Pubblicazione: (2026)
di: Negrão, Arthur, et al.
Pubblicazione: (2026)
Rethinking Output Alignment For 1-bit Post-Training Quantization of Large Language Models
di: Hoang, Dung Anh, et al.
Pubblicazione: (2025)
di: Hoang, Dung Anh, et al.
Pubblicazione: (2025)
A2Q+: Improving Accumulator-Aware Weight Quantization
di: Colbert, Ian, et al.
Pubblicazione: (2024)
di: Colbert, Ian, et al.
Pubblicazione: (2024)
EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization
di: Gordon, Ofir, et al.
Pubblicazione: (2023)
di: Gordon, Ofir, et al.
Pubblicazione: (2023)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
di: Shabanovi, Khasmamad, et al.
Pubblicazione: (2024)
di: Shabanovi, Khasmamad, et al.
Pubblicazione: (2024)
CrossQuant: A Post-Training Quantization Method with Smaller Quantization Kernel for Precise Large Language Model Compression
di: Liu, Wenyuan, et al.
Pubblicazione: (2024)
di: Liu, Wenyuan, et al.
Pubblicazione: (2024)
MOONSHOT : A Framework for Multi-Objective Pruning of Vision and Large Language Models
di: Afriat, Gabriel, et al.
Pubblicazione: (2026)
di: Afriat, Gabriel, et al.
Pubblicazione: (2026)
SKIM: Any-bit Quantization Pushing The Limits of Post-Training Quantization
di: Bai, Runsheng, et al.
Pubblicazione: (2024)
di: Bai, Runsheng, et al.
Pubblicazione: (2024)
DAQ: Delta-Aware Quantization for Post-Training LLM Weight Compression
di: Yu, Xiaoming, et al.
Pubblicazione: (2026)
di: Yu, Xiaoming, et al.
Pubblicazione: (2026)
DAQ: Density-Aware Post-Training Weight-Only Quantization For LLMs
di: Luo, Yingsong, et al.
Pubblicazione: (2024)
di: Luo, Yingsong, et al.
Pubblicazione: (2024)
SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models
di: Xiao, Guangxuan, et al.
Pubblicazione: (2022)
di: Xiao, Guangxuan, et al.
Pubblicazione: (2022)
An Optimization Framework for Differentially Private Sparse Fine-Tuning
di: Makni, Mehdi, et al.
Pubblicazione: (2025)
di: Makni, Mehdi, et al.
Pubblicazione: (2025)
TesseraQ: Ultra Low-Bit LLM Post-Training Quantization with Block Reconstruction
di: Li, Yuhang, et al.
Pubblicazione: (2024)
di: Li, Yuhang, et al.
Pubblicazione: (2024)
Q-resafe: Assessing Safety Risks and Quantization-aware Safety Patching for Quantized Large Language Models
di: Chen, Kejia, et al.
Pubblicazione: (2025)
di: Chen, Kejia, et al.
Pubblicazione: (2025)
Layer-Wise High-Impact Parameter Ratio Optimization in Post-Training Quantization for Large Language Models
di: Pham, Cuong, et al.
Pubblicazione: (2025)
di: Pham, Cuong, et al.
Pubblicazione: (2025)
A Hardware-Aware, Per-Layer Methodology for Post-Training Quantization of Large Language Models
di: Killian, Earl
Pubblicazione: (2026)
di: Killian, Earl
Pubblicazione: (2026)
Training Dynamics Impact Post-Training Quantization Robustness
di: Catalan-Tatjer, Albert, et al.
Pubblicazione: (2025)
di: Catalan-Tatjer, Albert, et al.
Pubblicazione: (2025)
CPTQuant - A Novel Mixed Precision Post-Training Quantization Techniques for Large Language Models
di: Nanda, Amitash, et al.
Pubblicazione: (2024)
di: Nanda, Amitash, et al.
Pubblicazione: (2024)
A Quantized VAE-MLP Botnet Detection Model: A Systematic Evaluation of Quantization-Aware Training and Post-Training Quantization Strategies
di: Wasswa, Hassan, et al.
Pubblicazione: (2025)
di: Wasswa, Hassan, et al.
Pubblicazione: (2025)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
di: Zhou, Chenxi, et al.
Pubblicazione: (2025)
di: Zhou, Chenxi, et al.
Pubblicazione: (2025)
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
di: Guan, Ziyi, et al.
Pubblicazione: (2024)
di: Guan, Ziyi, et al.
Pubblicazione: (2024)
Quantization Error Propagation: Revisiting Layer-Wise Post-Training Quantization
di: Arai, Yamato, et al.
Pubblicazione: (2025)
di: Arai, Yamato, et al.
Pubblicazione: (2025)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
HBVLA: Pushing 1-Bit Post-Training Quantization for Vision-Language-Action Models
di: Yan, Xin, et al.
Pubblicazione: (2026)
di: Yan, Xin, et al.
Pubblicazione: (2026)
QuantVLA: Scale-Calibrated Post-Training Quantization for Vision-Language-Action Models
di: Zhang, Jingxuan, et al.
Pubblicazione: (2026)
di: Zhang, Jingxuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
3BASiL: An Algorithmic Framework for Sparse plus Low-Rank Compression of LLMs
di: Makni, Mehdi, et al.
Pubblicazione: (2026) -
TSENOR: Highly-Efficient Algorithm for Finding Transposable N:M Sparse Masks
di: Meng, Xiang, et al.
Pubblicazione: (2025) -
Preserving Deep Representations In One-Shot Pruning: A Hessian-Free Second-Order Optimization Framework
di: Lucas, Ryan, et al.
Pubblicazione: (2024) -
HASSLE-free: A unified Framework for Sparse plus Low-Rank Matrix Decomposition for LLMs
di: Makni, Mehdi, et al.
Pubblicazione: (2025) -
Boost Post-Training Quantization via Null Space Optimization for Large Language Models
di: Zhao, Jiaqi, et al.
Pubblicazione: (2025)