AMQ: Enabling AutoML for Mixed-precision Weight-Only Quantization of Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Lee, Sangjun, Woo, Seung-taek, Jin, Jungyu, Lee, Changhun, Park, Eunhyeok |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models
by: Lee, Changhun, et al.
Published: (2023)
by: Lee, Changhun, et al.
Published: (2023)
PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality
by: Yu, Byeongho, et al.
Published: (2025)
by: Yu, Byeongho, et al.
Published: (2025)
QEFT: Quantization for Efficient Fine-Tuning of LLMs
by: Lee, Changhun, et al.
Published: (2024)
by: Lee, Changhun, et al.
Published: (2024)
ZeroML: A Next Generation AutoML Language
by: Mahmud, Monirul Islam
Published: (2025)
by: Mahmud, Monirul Islam
Published: (2025)
SEAL: Scaling to Emphasize Attention for Long-Context Retrieval
by: Lee, Changhun, et al.
Published: (2025)
by: Lee, Changhun, et al.
Published: (2025)
AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoML
by: Trirat, Patara, et al.
Published: (2024)
by: Trirat, Patara, et al.
Published: (2024)
UniAutoML: A Human-Centered Framework for Unified Discriminative and Generative AutoML with Large Language Models
by: Guo, Jiayi, et al.
Published: (2024)
by: Guo, Jiayi, et al.
Published: (2024)
ROSAQ: Rotation-based Saliency-Aware Weight Quantization for Efficiently Compressing Large Language Models
by: Yoon, Junho, et al.
Published: (2025)
by: Yoon, Junho, et al.
Published: (2025)
HOT: Hadamard-based Optimized Training
by: Kim, Seonggon, et al.
Published: (2025)
by: Kim, Seonggon, et al.
Published: (2025)
AutoML-guided Fusion of Entity and LLM-based Representations for Document Classification
by: Koloski, Boshko, et al.
Published: (2024)
by: Koloski, Boshko, et al.
Published: (2024)
NNGPT: Rethinking AutoML with Large Language Models
by: Kochnev, Roman, et al.
Published: (2025)
by: Kochnev, Roman, et al.
Published: (2025)
AutoIntent: AutoML for Text Classification
by: Alekseev, Ilya, et al.
Published: (2025)
by: Alekseev, Ilya, et al.
Published: (2025)
AutoML in the Age of Large Language Models: Current Challenges, Future Opportunities and Risks
by: Tornede, Alexander, et al.
Published: (2023)
by: Tornede, Alexander, et al.
Published: (2023)
ML2B: Multi-Lingual ML Benchmark For AutoML
by: Trofimova, Ekaterina, et al.
Published: (2025)
by: Trofimova, Ekaterina, et al.
Published: (2025)
PTQ4VM: Post-Training Quantization for Visual Mamba
by: Cho, Younghyun, et al.
Published: (2024)
by: Cho, Younghyun, et al.
Published: (2024)
AutoML Systems For Medical Imaging
by: Jidney, Tasmia Tahmida, et al.
Published: (2023)
by: Jidney, Tasmia Tahmida, et al.
Published: (2023)
Problem-oriented AutoML in Clustering
by: da Silva, Matheus Camilo, et al.
Published: (2024)
by: da Silva, Matheus Camilo, et al.
Published: (2024)
Finding Answers in Thought Matters: Revisiting Evaluation on Large Language Models with Reasoning
by: Jo, Hwiyeol, et al.
Published: (2025)
by: Jo, Hwiyeol, et al.
Published: (2025)
Enhancing Robustness of Retrieval-Augmented Language Models with In-Context Learning
by: Park, Seong-Il, et al.
Published: (2024)
by: Park, Seong-Il, et al.
Published: (2024)
Efficient Latent Semantic Clustering for Scaling Test-Time Computation of LLMs
by: Lee, Sungjae, et al.
Published: (2025)
by: Lee, Sungjae, et al.
Published: (2025)
OpenAutoNLU: Open Source AutoML Library for NLU
by: Arshinov, Grigory, et al.
Published: (2026)
by: Arshinov, Grigory, et al.
Published: (2026)
AutoMix: Automatically Mixing Language Models
by: Aggarwal, Pranjal, et al.
Published: (2023)
by: Aggarwal, Pranjal, et al.
Published: (2023)
Calibrating Large Language Models Using Their Generations Only
by: Ulmer, Dennis, et al.
Published: (2024)
by: Ulmer, Dennis, et al.
Published: (2024)
Channel-Wise Mixed-Precision Quantization for Large Language Models
by: Chen, Zihan, et al.
Published: (2024)
by: Chen, Zihan, et al.
Published: (2024)
Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant
by: Lee, Jemin, et al.
Published: (2024)
by: Lee, Jemin, et al.
Published: (2024)
Robustness of AutoML on Dirty Categorical Data
by: Bueno, Marcos L. P., et al.
Published: (2026)
by: Bueno, Marcos L. P., et al.
Published: (2026)
DREAM: Debugging and Repairing AutoML Pipelines
by: Zhang, Xiaoyu, et al.
Published: (2023)
by: Zhang, Xiaoyu, et al.
Published: (2023)
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
by: Park, Jungwoo, et al.
Published: (2025)
by: Park, Jungwoo, et al.
Published: (2025)
AutoGluon-Multimodal (AutoMM): Supercharging Multimodal AutoML with Foundation Models
by: Tang, Zhiqiang, et al.
Published: (2024)
by: Tang, Zhiqiang, et al.
Published: (2024)
AutoML in The Wild: Obstacles, Workarounds, and Expectations
by: Sun, Yuan, et al.
Published: (2023)
by: Sun, Yuan, et al.
Published: (2023)
AI-based Classification of Customer Support Tickets: State of the Art and Implementation with AutoML
by: Truss, Mario, et al.
Published: (2024)
by: Truss, Mario, et al.
Published: (2024)
GWQ: Gradient-Aware Weight Quantization for Large Language Models
by: Shao, Yihua, et al.
Published: (2024)
by: Shao, Yihua, et al.
Published: (2024)
Exploring the impact of fairness-aware criteria in AutoML
by: Simões, Joana, et al.
Published: (2026)
by: Simões, Joana, et al.
Published: (2026)
Hyperparameter Importance Analysis for Multi-Objective AutoML
by: Theodorakopoulos, Daphne, et al.
Published: (2024)
by: Theodorakopoulos, Daphne, et al.
Published: (2024)
Weighted Multi-Prompt Learning with Description-free Large Language Model Distillation
by: Lee, Sua, et al.
Published: (2025)
by: Lee, Sua, et al.
Published: (2025)
Budget-aware Query Tuning: An AutoML Perspective
by: Wu, Wentao, et al.
Published: (2024)
by: Wu, Wentao, et al.
Published: (2024)
FeRG-LLM : Feature Engineering by Reason Generation Large Language Models
by: Ko, Jeonghyun, et al.
Published: (2025)
by: Ko, Jeonghyun, et al.
Published: (2025)
Prompt-based Depth Pruning of Large Language Models
by: Wee, Juyun, et al.
Published: (2025)
by: Wee, Juyun, et al.
Published: (2025)
CPR: Mitigating Large Language Model Hallucinations with Curative Prompt Refinement
by: Shim, Jung-Woo, et al.
Published: (2025)
by: Shim, Jung-Woo, et al.
Published: (2025)
Multi-stage Prompt Refinement for Mitigating Hallucinations in Large Language Models
by: Shim, Jung-Woo, et al.
Published: (2025)
by: Shim, Jung-Woo, et al.
Published: (2025)
Similar Items
-
OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models
by: Lee, Changhun, et al.
Published: (2023) -
PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality
by: Yu, Byeongho, et al.
Published: (2025) -
QEFT: Quantization for Efficient Fine-Tuning of LLMs
by: Lee, Changhun, et al.
Published: (2024) -
ZeroML: A Next Generation AutoML Language
by: Mahmud, Monirul Islam
Published: (2025) -
SEAL: Scaling to Emphasize Attention for Long-Context Retrieval
by: Lee, Changhun, et al.
Published: (2025)