Regularization-based Framework for Quantization-, Fault- and Variability-Aware Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Biswas, Anmol, Singhal, Raghav, Elangovan, Sivakumar, Sabnis, Shreyas, Ganguly, Udayan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Temporal and Spatial Reservoir Ensembling Techniques for Liquid State Machines
par: Biswas, Anmol, et autres
Publié: (2024)
par: Biswas, Anmol, et autres
Publié: (2024)
What's the score? Automated Denoising Score Matching for Nonlinear Diffusions
par: Singhal, Raghav, et autres
Publié: (2024)
par: Singhal, Raghav, et autres
Publié: (2024)
EfQAT: An Efficient Framework for Quantization-Aware Training
par: Ashkboos, Saleh, et autres
Publié: (2024)
par: Ashkboos, Saleh, et autres
Publié: (2024)
QuRL: Efficient Reinforcement Learning with Quantized Rollout
par: Li, Yuhang, et autres
Publié: (2026)
par: Li, Yuhang, et autres
Publié: (2026)
Quantization-Aware Regularizers for Deep Neural Networks Compression
par: Malchiodi, Dario, et autres
Publié: (2026)
par: Malchiodi, Dario, et autres
Publié: (2026)
LO-BCQ: Block Clustered Quantization for 4-bit (W4A4) LLM Inference
par: Elangovan, Reena, et autres
Publié: (2025)
par: Elangovan, Reena, et autres
Publié: (2025)
Real-Time Risky Fault-Chain Search using Time-Varying Graph RNNs
par: Dwivedi, Anmol, et autres
Publié: (2025)
par: Dwivedi, Anmol, et autres
Publié: (2025)
Scaling Law for Quantization-Aware Training
par: Chen, Mengzhao, et autres
Publié: (2025)
par: Chen, Mengzhao, et autres
Publié: (2025)
Compute-Optimal Quantization-Aware Training
par: Dremov, Aleksandr, et autres
Publié: (2025)
par: Dremov, Aleksandr, et autres
Publié: (2025)
How to Parameterize Asymmetric Quantization Ranges for Quantization-Aware Training
par: You, Jaeseong, et autres
Publié: (2024)
par: You, Jaeseong, et autres
Publié: (2024)
CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training
par: Tabesh, Soroush, et autres
Publié: (2025)
par: Tabesh, Soroush, et autres
Publié: (2025)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
par: Zhao, Yanlong, et autres
Publié: (2026)
par: Zhao, Yanlong, et autres
Publié: (2026)
ABBA-Adapters: Efficient and Expressive Fine-Tuning of Foundation Models
par: Singhal, Raghav, et autres
Publié: (2025)
par: Singhal, Raghav, et autres
Publié: (2025)
Safety Subspaces are Not Linearly Distinct: A Fine-Tuning Case Study
par: Ponkshe, Kaustubh, et autres
Publié: (2025)
par: Ponkshe, Kaustubh, et autres
Publié: (2025)
A Quantized VAE-MLP Botnet Detection Model: A Systematic Evaluation of Quantization-Aware Training and Post-Training Quantization Strategies
par: Wasswa, Hassan, et autres
Publié: (2025)
par: Wasswa, Hassan, et autres
Publié: (2025)
Uncertainty-Aware Graph Self-Training with Expectation-Maximization Regularization
par: Wang, Emily, et autres
Publié: (2025)
par: Wang, Emily, et autres
Publié: (2025)
Memory Faults in Activation-sparse Quantized Deep Neural Networks: Analysis and Mitigation using Sharpness-aware Training
par: Malhotra, Akul, et autres
Publié: (2024)
par: Malhotra, Akul, et autres
Publié: (2024)
Extracting Usable Predictions from Quantized Networks through Uncertainty Quantification for OOD Detection
par: Singhal, Rishi, et autres
Publié: (2024)
par: Singhal, Rishi, et autres
Publié: (2024)
Hidden Synergy: $L_1$ Weight Normalization and 1-Path-Norm Regularization
par: Biswas, Aditya
Publié: (2024)
par: Biswas, Aditya
Publié: (2024)
Training-Free Imitation Learning with Closed-Form Diffusion Policies
par: Mishra, Raghav, et autres
Publié: (2026)
par: Mishra, Raghav, et autres
Publié: (2026)
QGen: On the Ability to Generalize in Quantization Aware Training
par: AskariHemmat, MohammadHossein, et autres
Publié: (2024)
par: AskariHemmat, MohammadHossein, et autres
Publié: (2024)
Low-Rank Quantization-Aware Training for LLMs
par: Bondarenko, Yelysei, et autres
Publié: (2024)
par: Bondarenko, Yelysei, et autres
Publié: (2024)
HESTIA: A Hessian-Guided Differentiable Quantization-Aware Training Framework for Extremely Low-Bit LLMs
par: Wang, Guoan, et autres
Publié: (2026)
par: Wang, Guoan, et autres
Publié: (2026)
FARe: Fault-Aware GNN Training on ReRAM-based PIM Accelerators
par: Dhingra, Pratyush, et autres
Publié: (2024)
par: Dhingra, Pratyush, et autres
Publié: (2024)
AdaQAT: Adaptive Bit-Width Quantization-Aware Training
par: Gernigon, Cédric, et autres
Publié: (2024)
par: Gernigon, Cédric, et autres
Publié: (2024)
Attn-QAT: 4-Bit Attention With Quantization-Aware Training
par: Zhang, Peiyuan, et autres
Publié: (2026)
par: Zhang, Peiyuan, et autres
Publié: (2026)
Astro: Activation-guided Structured Regularization for Outlier-Robust LLM Post-Training Quantization
par: Chen, Xi, et autres
Publié: (2026)
par: Chen, Xi, et autres
Publié: (2026)
JacQuant: STE-Free Quantization-Aware Training via Learned Jacobian Surrogates
par: Yi, Kai, et autres
Publié: (2026)
par: Yi, Kai, et autres
Publié: (2026)
One-Step Forward and Backtrack: Overcoming Zig-Zagging in Loss-Aware Quantization Training
par: Ma, Lianbo, et autres
Publié: (2024)
par: Ma, Lianbo, et autres
Publié: (2024)
QuATON: Quantization Aware Training of Optical Neurons
par: Kariyawasam, Hasindu, et autres
Publié: (2023)
par: Kariyawasam, Hasindu, et autres
Publié: (2023)
Continuous Approximations for Improving Quantization Aware Training of LLMs
par: Li, He, et autres
Publié: (2024)
par: Li, He, et autres
Publié: (2024)
ADMM-Q: An Improved Hessian-based Weight Quantizer for Post-Training Quantization of Large Language Models
par: Lucas, Ryan, et autres
Publié: (2026)
par: Lucas, Ryan, et autres
Publié: (2026)
End-to-End On-Device Quantization-Aware Training for LLMs at Inference Cost
par: Tan, Qitao, et autres
Publié: (2025)
par: Tan, Qitao, et autres
Publié: (2025)
DAQ: Density-Aware Post-Training Weight-Only Quantization For LLMs
par: Luo, Yingsong, et autres
Publié: (2024)
par: Luo, Yingsong, et autres
Publié: (2024)
StableQAT: Stable Quantization-Aware Training at Ultra-Low Bitwidths
par: Chen, Tianyi, et autres
Publié: (2026)
par: Chen, Tianyi, et autres
Publié: (2026)
DAQ: Delta-Aware Quantization for Post-Training LLM Weight Compression
par: Yu, Xiaoming, et autres
Publié: (2026)
par: Yu, Xiaoming, et autres
Publié: (2026)
MF-QAT: Multi-Format Quantization-Aware Training for Elastic Inference
par: Xu, Zifei, et autres
Publié: (2026)
par: Xu, Zifei, et autres
Publié: (2026)
PARQ: Piecewise-Affine Regularized Quantization
par: Jin, Lisa, et autres
Publié: (2025)
par: Jin, Lisa, et autres
Publié: (2025)
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
par: Basavatia, Shreyas, et autres
Publié: (2024)
par: Basavatia, Shreyas, et autres
Publié: (2024)
PromptWizard: Task-Aware Prompt Optimization Framework
par: Agarwal, Eshaan, et autres
Publié: (2024)
par: Agarwal, Eshaan, et autres
Publié: (2024)
Documents similaires
-
Temporal and Spatial Reservoir Ensembling Techniques for Liquid State Machines
par: Biswas, Anmol, et autres
Publié: (2024) -
What's the score? Automated Denoising Score Matching for Nonlinear Diffusions
par: Singhal, Raghav, et autres
Publié: (2024) -
EfQAT: An Efficient Framework for Quantization-Aware Training
par: Ashkboos, Saleh, et autres
Publié: (2024) -
QuRL: Efficient Reinforcement Learning with Quantized Rollout
par: Li, Yuhang, et autres
Publié: (2026) -
Quantization-Aware Regularizers for Deep Neural Networks Compression
par: Malchiodi, Dario, et autres
Publié: (2026)