MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Zhang, Kewei, Huang, Ye, Deng, Yufan, Yu, Jincheng, Chen, Junsong, Ling, Huan, Xie, Enze, Zhou, Daquan
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires