MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Zhang, Kewei, Huang, Ye, Deng, Yufan, Yu, Jincheng, Chen, Junsong, Ling, Huan, Xie, Enze, Zhou, Daquan
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!