MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Hu, Xing, Chen, Zhixuan, Yang, Dawei, Xu, Zukang, Xu, Chen, Yuan, Zhihang, Zhou, Sifan, Yu, Jiangyong
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!