MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yu, JiangYong, Zhou, Sifan, Yang, Dawei, Wang, Shuo, Li, Shuoyu, Hu, Xing, Xu, Chen, Xu, Zukang, Shu, Changyong, Yuan, Zhihang
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!