Revolutionizing Mixed Precision Quantization: Towards Training-free Automatic Proxy Discovery via Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Kang, Haidong, Du, Jun, Lin, Lihong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Automatic Pruning Discovery for Large Language Models
by: Kang, Haidong, et al.
Published: (2025)
by: Kang, Haidong, et al.
Published: (2025)
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
by: Chen, Jun, et al.
Published: (2023)
by: Chen, Jun, et al.
Published: (2023)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
by: Maruzzelli, Rocco Manz, et al.
Published: (2024)
by: Maruzzelli, Rocco Manz, et al.
Published: (2024)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
by: Kim, Han-Byul, et al.
Published: (2023)
by: Kim, Han-Byul, et al.
Published: (2023)
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
by: Tao, Wei, et al.
Published: (2024)
by: Tao, Wei, et al.
Published: (2024)
Efficient Multi-bit Quantization Network Training via Weight Bias Correction and Bit-wise Coreset Sampling
by: Kim, Jinhee, et al.
Published: (2025)
by: Kim, Jinhee, et al.
Published: (2025)
FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization Search
by: Dotzel, Jordan, et al.
Published: (2023)
by: Dotzel, Jordan, et al.
Published: (2023)
FairQuant: Fairness-Aware Mixed-Precision Quantization for Medical Image Classification
by: Woergaard, Thomas, et al.
Published: (2026)
by: Woergaard, Thomas, et al.
Published: (2026)
Efficient and Effective Methods for Mixed Precision Neural Network Quantization for Faster, Energy-efficient Inference
by: Bablani, Deepika, et al.
Published: (2023)
by: Bablani, Deepika, et al.
Published: (2023)
TMPDiff: Temporal Mixed-Precision for Diffusion Models
by: Lewandowski, Basile, et al.
Published: (2026)
by: Lewandowski, Basile, et al.
Published: (2026)
Training-Free Vector Quantization via Gaussian VAEs
by: Xu, Tongda, et al.
Published: (2025)
by: Xu, Tongda, et al.
Published: (2025)
ARQ: A Mixed-Precision Quantization Framework for Accurate and Certifiably Robust DNNs
by: Yang, Yuchen, et al.
Published: (2024)
by: Yang, Yuchen, et al.
Published: (2024)
ROSE: Revolutionizing Open-Set Dense Segmentation with Patch-Wise Perceptual Large Multimodal Model
by: Han, Kunyang, et al.
Published: (2024)
by: Han, Kunyang, et al.
Published: (2024)
Towards Large-Scale Training of Pathology Foundation Models
by: ai, kaiko., et al.
Published: (2024)
by: ai, kaiko., et al.
Published: (2024)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models
by: Ke, Wenjin, et al.
Published: (2025)
by: Ke, Wenjin, et al.
Published: (2025)
1-Bit FQT: Pushing the Limit of Fully Quantized Training to 1-bit
by: Gao, Chang, et al.
Published: (2024)
by: Gao, Chang, et al.
Published: (2024)
Automatic Joint Structured Pruning and Quantization for Efficient Neural Network Training and Compression
by: Qu, Xiaoyi, et al.
Published: (2025)
by: Qu, Xiaoyi, et al.
Published: (2025)
Quantization Variation: A New Perspective on Training Transformers with Low-Bit Precision
by: Huang, Xijie, et al.
Published: (2023)
by: Huang, Xijie, et al.
Published: (2023)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
by: Sun, Haojun, et al.
Published: (2024)
by: Sun, Haojun, et al.
Published: (2024)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
by: Hoang, Dung Anh, et al.
Published: (2026)
by: Hoang, Dung Anh, et al.
Published: (2026)
Towards Large-scale Chemical Reaction Image Parsing via a Multimodal Large Language Model
by: Chen, Yufan, et al.
Published: (2025)
by: Chen, Yufan, et al.
Published: (2025)
Revolutionizing Traffic Management with AI-Powered Machine Vision: A Step Toward Smart Cities
by: DolatAbadi, Seyed Hossein Hosseini, et al.
Published: (2025)
by: DolatAbadi, Seyed Hossein Hosseini, et al.
Published: (2025)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
by: Zhang, Dingkun, et al.
Published: (2026)
by: Zhang, Dingkun, et al.
Published: (2026)
Automatic Discovery of Disease Subgroups by Contrasting with Healthy Controls
by: Louiset, Robin, et al.
Published: (2026)
by: Louiset, Robin, et al.
Published: (2026)
Advancing Multimodal Large Language Models with Quantization-Aware Scale Learning for Efficient Adaptation
by: Xie, Jingjing, et al.
Published: (2024)
by: Xie, Jingjing, et al.
Published: (2024)
Proxy-FDA: Proxy-based Feature Distribution Alignment for Fine-tuning Vision Foundation Models without Forgetting
by: Huang, Chen, et al.
Published: (2025)
by: Huang, Chen, et al.
Published: (2025)
Training-free Editioning of Text-to-Image Models
by: Wang, Jinqi, et al.
Published: (2024)
by: Wang, Jinqi, et al.
Published: (2024)
Towards Large Model Feature Coding
by: Pang, Youwei, et al.
Published: (2026)
by: Pang, Youwei, et al.
Published: (2026)
TRIX- Trading Adversarial Fairness via Mixed Adversarial Training
by: Medi, Tejaswini, et al.
Published: (2025)
by: Medi, Tejaswini, et al.
Published: (2025)
ProxyFL: A Proxy-Guided Framework for Federated Semi-Supervised Learning
by: Chen, Duowen, et al.
Published: (2026)
by: Chen, Duowen, et al.
Published: (2026)
EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization
by: Gordon, Ofir, et al.
Published: (2023)
by: Gordon, Ofir, et al.
Published: (2023)
QGen: On the Ability to Generalize in Quantization Aware Training
by: AskariHemmat, MohammadHossein, et al.
Published: (2024)
by: AskariHemmat, MohammadHossein, et al.
Published: (2024)
Quantize-then-Rectify: Efficient VQ-VAE Training
by: Zhang, Borui, et al.
Published: (2025)
by: Zhang, Borui, et al.
Published: (2025)
EDA-DM: Enhanced Distribution Alignment for Post-Training Quantization of Diffusion Models
by: Liu, Xuewen, et al.
Published: (2024)
by: Liu, Xuewen, et al.
Published: (2024)
Knowledge Bridger: Towards Training-free Missing Modality Completion
by: Ke, Guanzhou, et al.
Published: (2025)
by: Ke, Guanzhou, et al.
Published: (2025)
AHCQ-SAM: Toward Accurate and Hardware-Compatible Post-Training Segment Anything Model Quantization
by: Zhang, Wenlun, et al.
Published: (2025)
by: Zhang, Wenlun, et al.
Published: (2025)
Probabilistic Precision and Recall Towards Reliable Evaluation of Generative Models
by: Park, Dogyun, et al.
Published: (2023)
by: Park, Dogyun, et al.
Published: (2023)
Revolutionizing Wildfire Detection with Convolutional Neural Networks: A VGG16 Model Approach
by: Malladi, Lakshmi Aishwarya, et al.
Published: (2025)
by: Malladi, Lakshmi Aishwarya, et al.
Published: (2025)
HPCR: Holistic Proxy-based Contrastive Replay for Online Continual Learning
by: Lin, Huiwei, et al.
Published: (2023)
by: Lin, Huiwei, et al.
Published: (2023)
Training-free Detection of Generated Videos via Spatial-Temporal Likelihoods
by: Hayun, Omer Ben, et al.
Published: (2026)
by: Hayun, Omer Ben, et al.
Published: (2026)
Similar Items
-
Automatic Pruning Discovery for Large Language Models
by: Kang, Haidong, et al.
Published: (2025) -
Data-Free Quantization via Mixed-Precision Compensation without Fine-Tuning
by: Chen, Jun, et al.
Published: (2023) -
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
by: Maruzzelli, Rocco Manz, et al.
Published: (2024) -
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
by: Kim, Han-Byul, et al.
Published: (2023) -
Value-Driven Mixed-Precision Quantization for Patch-Based Inference on Microcontrollers
by: Tao, Wei, et al.
Published: (2024)