Li, H., Wang, M., Zhang, S., Liu, S., & Chen, P. (2024). Learning on Transformers is Provable Low-Rank and Sparse: A One-layer Analysis.
Cita Chicago Style (17a ed.)Li, Hongkang, Meng Wang, Shuai Zhang, Sijia Liu, y Pin-Yu Chen. Learning on Transformers Is Provable Low-Rank and Sparse: A One-layer Analysis. 2024.
Cita MLA (9a ed.)Li, Hongkang, et al. Learning on Transformers Is Provable Low-Rank and Sparse: A One-layer Analysis. 2024.
Precaución: Estas citas no son 100% exactas.