EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision Tokens

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Feng, Ze, Yang, Sen, Duan, Boqiang, Yang, Wankou, Wang, Jingdong
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!