FastMMoE: Accelerating Multimodal Large Language Models through Dynamic Expert Activation and Routing-Aware Token Pruning

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Xia, Guoyang, Ding, Yifeng, Li, Fengfa, Ren, Lei, Chen, Wei, Feng, Fangxiang, Wang, Xiaojie
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares