Chelba, C., Chen, M., Bapna, A., & Shazeer, N. (2020). Faster Transformer Decoding: N-gram Masked Self-Attention.
Chicago-Zitierstil (17. Ausg.)Chelba, Ciprian, Mia Chen, Ankur Bapna, und Noam Shazeer. Faster Transformer Decoding: N-gram Masked Self-Attention. 2020.
MLA-Zitierstil (9. Ausg.)Chelba, Ciprian, et al. Faster Transformer Decoding: N-gram Masked Self-Attention. 2020.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.