AdaHOP: Fast and Accurate Low-Precision Training via Outlier-Pattern-Aware Rotation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Seonggon, Khodamoradi, Alireza, Vasireddy, Pranathi, Denolf, Kristof, Park, Eunhyeok |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Error Diffusion: Post Training Quantization with Block-Scaled Number Formats for Neural Networks
par: Khodamoradi, Alireza, et autres
Publié: (2024)
par: Khodamoradi, Alireza, et autres
Publié: (2024)
HLQ: Fast and Efficient Backpropagation via Hadamard Low-rank Quantization
par: Kim, Seonggon, et autres
Publié: (2024)
par: Kim, Seonggon, et autres
Publié: (2024)
LoRaQ: Optimized Low Rank Approximation for 4-bit Quantization
par: Bouquet, Yann, et autres
Publié: (2026)
par: Bouquet, Yann, et autres
Publié: (2026)
HOT: Hadamard-based Optimized Training
par: Kim, Seonggon, et autres
Publié: (2025)
par: Kim, Seonggon, et autres
Publié: (2025)
PTQ4VM: Post-Training Quantization for Visual Mamba
par: Cho, Younghyun, et autres
Publié: (2024)
par: Cho, Younghyun, et autres
Publié: (2024)
Merge-Friendly Post-Training Quantization for Multi-Target Domain Adaptation
par: Shin, Juncheol, et autres
Publié: (2025)
par: Shin, Juncheol, et autres
Publié: (2025)
Striking the Balance: GEMM Performance Optimization Across Generations of Ryzen AI NPUs
par: Taka, Endri, et autres
Publié: (2025)
par: Taka, Endri, et autres
Publié: (2025)
RotateKV: Accurate and Robust 2-Bit KV Cache Quantization for LLMs via Outlier-Aware Adaptive Rotations
par: Su, Zunhai, et autres
Publié: (2025)
par: Su, Zunhai, et autres
Publié: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Jung, Yeonjoon, et autres
Publié: (2025)
par: Jung, Yeonjoon, et autres
Publié: (2025)
MUXQ: Mixed-to-Uniform Precision MatriX Quantization via Low-Rank Outlier Decomposition
par: Lee, Seoungsub, et autres
Publié: (2026)
par: Lee, Seoungsub, et autres
Publié: (2026)
OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization
par: Li, Zhikai, et autres
Publié: (2026)
par: Li, Zhikai, et autres
Publié: (2026)
GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling
par: Dadgarnia, Alireza, et autres
Publié: (2026)
par: Dadgarnia, Alireza, et autres
Publié: (2026)
Fast and Low-Cost Genomic Foundation Models via Outlier Removal
par: Luo, Haozheng, et autres
Publié: (2025)
par: Luo, Haozheng, et autres
Publié: (2025)
The Oversmoothing Fallacy: A Misguided Narrative in GNN Research
par: Park, MoonJeong, et autres
Publié: (2025)
par: Park, MoonJeong, et autres
Publié: (2025)
Improving Generative Behavior Cloning via Self-Guidance and Adaptive Chunking
par: So, Junhyuk, et autres
Publié: (2025)
par: So, Junhyuk, et autres
Publié: (2025)
OptRot: Mitigating Weight Outliers via Data-Free Rotations for Post-Training Quantization
par: Gadhikar, Advait, et autres
Publié: (2025)
par: Gadhikar, Advait, et autres
Publié: (2025)
AdaQAT: Adaptive Bit-Width Quantization-Aware Training
par: Gernigon, Cédric, et autres
Publié: (2024)
par: Gernigon, Cédric, et autres
Publié: (2024)
BG-HOP: A Bimanual Generative Hand-Object Prior
par: Krishna, Sriram, et autres
Publié: (2025)
par: Krishna, Sriram, et autres
Publié: (2025)
Outlier-Aware Training for Low-Bit Quantization of Structural Re-Parameterized Networks
par: Niu, Muqun, et autres
Publié: (2024)
par: Niu, Muqun, et autres
Publié: (2024)
CodeQuant: Unified Clustering and Quantization for Enhanced Outlier Smoothing in Low-Precision Mixture-of-Experts
par: Yin, Xiangyang, et autres
Publié: (2026)
par: Yin, Xiangyang, et autres
Publié: (2026)
DFRot: Achieving Outlier-Free and Massive Activation-Free for Rotated LLMs with Refined Rotation
par: Xiang, Jingyang, et autres
Publié: (2024)
par: Xiang, Jingyang, et autres
Publié: (2024)
QMC: Efficient SLM Edge Inference via Outlier-Aware Quantization and Emergent Memories Co-Design
par: Pandey, Nilesh Prasad, et autres
Publié: (2026)
par: Pandey, Nilesh Prasad, et autres
Publié: (2026)
Memorize Early, Then Query: Inlier-Memorization-Guided Active Outlier Detection
par: Kang, Minseo, et autres
Publié: (2026)
par: Kang, Minseo, et autres
Publié: (2026)
From Loop Nests to Silicon: Mapping AI Workloads onto AMD NPUs with MLIR-AIR
par: Wang, Erwei, et autres
Publié: (2025)
par: Wang, Erwei, et autres
Publié: (2025)
Collage: Light-Weight Low-Precision Strategy for LLM Training
par: Yu, Tao, et autres
Publié: (2024)
par: Yu, Tao, et autres
Publié: (2024)
Bridging Training and Merging Through Momentum-Aware Optimization
par: Moayedikia, Alireza, et autres
Publié: (2025)
par: Moayedikia, Alireza, et autres
Publié: (2025)
OATS: Outlier-Aware Pruning Through Sparse and Low Rank Decomposition
par: Zhang, Stephen, et autres
Publié: (2024)
par: Zhang, Stephen, et autres
Publié: (2024)
Asynchronous Sharpness-Aware Minimization For Fast and Accurate Deep Learning
par: Jo, Junhyuk, et autres
Publié: (2025)
par: Jo, Junhyuk, et autres
Publié: (2025)
CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training
par: Tabesh, Soroush, et autres
Publié: (2025)
par: Tabesh, Soroush, et autres
Publié: (2025)
DelTriC: A Novel Clustering Method with Accurate Outlier
par: Javurek, Tomas, et autres
Publié: (2025)
par: Javurek, Tomas, et autres
Publié: (2025)
QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs
par: Ashkboos, Saleh, et autres
Publié: (2024)
par: Ashkboos, Saleh, et autres
Publié: (2024)
QEFT: Quantization for Efficient Fine-Tuning of LLMs
par: Lee, Changhun, et autres
Publié: (2024)
par: Lee, Changhun, et autres
Publié: (2024)
Rank-Aware Spectral Bounds on Attention Logits for Stable Low-Precision Training
par: Emadi, Seyed Morteza
Publié: (2026)
par: Emadi, Seyed Morteza
Publié: (2026)
Fast and Accurate Power Load Data Completion via Regularization-optimized Low-Rank Factorization
par: Xia, Yan, et autres
Publié: (2025)
par: Xia, Yan, et autres
Publié: (2025)
Improving Quantization-aware Training of Low-Precision Network via Block Replacement on Full-Precision Counterpart
par: Yu, Chengting, et autres
Publié: (2024)
par: Yu, Chengting, et autres
Publié: (2024)
Smart Profit-Aware Crop Advisory System: Kisan AI
par: Dwibedy, Debasis, et autres
Publié: (2026)
par: Dwibedy, Debasis, et autres
Publié: (2026)
The Computational Complexity of Almost Stable Clustering with Penalties
par: Khodamoradi, Kamyar, et autres
Publié: (2025)
par: Khodamoradi, Kamyar, et autres
Publié: (2025)
Fast and Accurate Probing of In-Training LLMs' Downstream Performances
par: Liu, Zhichen, et autres
Publié: (2026)
par: Liu, Zhichen, et autres
Publié: (2026)
Rethinking Channel Dimensions to Isolate Outliers for Low-bit Weight Quantization of Large Language Models
par: Heo, Jung Hwan, et autres
Publié: (2023)
par: Heo, Jung Hwan, et autres
Publié: (2023)
TetraJet-v2: Accurate NVFP4 Training for Large Language Models with Oscillation Suppression and Outlier Control
par: Chen, Yuxiang, et autres
Publié: (2025)
par: Chen, Yuxiang, et autres
Publié: (2025)
Documents similaires
-
Error Diffusion: Post Training Quantization with Block-Scaled Number Formats for Neural Networks
par: Khodamoradi, Alireza, et autres
Publié: (2024) -
HLQ: Fast and Efficient Backpropagation via Hadamard Low-rank Quantization
par: Kim, Seonggon, et autres
Publié: (2024) -
LoRaQ: Optimized Low Rank Approximation for 4-bit Quantization
par: Bouquet, Yann, et autres
Publié: (2026) -
HOT: Hadamard-based Optimized Training
par: Kim, Seonggon, et autres
Publié: (2025) -
PTQ4VM: Post-Training Quantization for Visual Mamba
par: Cho, Younghyun, et autres
Publié: (2024)