EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Yang, Chaoqun, Lin, Xinyu, Wang, Wenjie, Li, Yongqi, Sun, Teng, Han, Xianjing, Chua, Tat-Seng
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!