Efficient Inference for Large Language Model-based Generative Recommendation
Fuente:
arXiv
Saved in:
| Main Authors: | Lin, Xinyu, Yang, Chaoqun, Wang, Wenjie, Li, Yongqi, Du, Cunxiao, Feng, Fuli, Ng, See-Kiong, Chua, Tat-Seng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Bridging Items and Language: A Transition Paradigm for Large Language Model-Based Recommendation
by: Lin, Xinyu, et al.
Published: (2023)
by: Lin, Xinyu, et al.
Published: (2023)
Order-agnostic Identifier for Large Language Model-based Generative Recommendation
by: Lin, Xinyu, et al.
Published: (2025)
by: Lin, Xinyu, et al.
Published: (2025)
Learnable Item Tokenization for Generative Recommendation
by: Wang, Wenjie, et al.
Published: (2024)
by: Wang, Wenjie, et al.
Published: (2024)
A Survey of Generative Search and Recommendation in the Era of Large Language Models
by: Li, Yongqi, et al.
Published: (2024)
by: Li, Yongqi, et al.
Published: (2024)
EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens
by: Yang, Chaoqun, et al.
Published: (2025)
by: Yang, Chaoqun, et al.
Published: (2025)
A Federated Framework for LLM-based Recommendation
by: Zhao, Jujia, et al.
Published: (2024)
by: Zhao, Jujia, et al.
Published: (2024)
Generative Recommendation: Towards Next-generation Recommender Paradigm
by: Wang, Wenjie, et al.
Published: (2023)
by: Wang, Wenjie, et al.
Published: (2023)
Temporally and Distributionally Robust Optimization for Cold-Start Recommendation
by: Lin, Xinyu, et al.
Published: (2023)
by: Lin, Xinyu, et al.
Published: (2023)
Data-efficient Fine-tuning for LLM-based Recommendation
by: Lin, Xinyu, et al.
Published: (2024)
by: Lin, Xinyu, et al.
Published: (2024)
Prospect Personalized Recommendation on Large Language Model-based Agent Platform
by: Zhang, Jizhi, et al.
Published: (2024)
by: Zhang, Jizhi, et al.
Published: (2024)
Exploring Training and Inference Scaling Laws in Generative Retrieval
by: Cai, Hongru, et al.
Published: (2025)
by: Cai, Hongru, et al.
Published: (2025)
Diffusion Recommender Model
by: Wang, Wenjie, et al.
Published: (2023)
by: Wang, Wenjie, et al.
Published: (2023)
Heterogeneous User Modeling for LLM-based Recommendation
by: Bao, Honghui, et al.
Published: (2025)
by: Bao, Honghui, et al.
Published: (2025)
NextQuill: Causal Preference Modeling for Enhancing LLM Personalization
by: Zhao, Xiaoyan, et al.
Published: (2025)
by: Zhao, Xiaoyan, et al.
Published: (2025)
Decoding in Latent Spaces for Efficient Inference in LLM-based Recommendation
by: Wang, Chengbing, et al.
Published: (2025)
by: Wang, Chengbing, et al.
Published: (2025)
SemCORE: A Semantic-Enhanced Generative Cross-Modal Retrieval Framework with MLLMs
by: Li, Haoxuan, et al.
Published: (2025)
by: Li, Haoxuan, et al.
Published: (2025)
Large Language Models Empowered Personalized Web Agents
by: Cai, Hongru, et al.
Published: (2024)
by: Cai, Hongru, et al.
Published: (2024)
Bringing Reasoning to Generative Recommendation Through the Lens of Cascaded Ranking
by: Lin, Xinyu, et al.
Published: (2026)
by: Lin, Xinyu, et al.
Published: (2026)
Distillation Enhanced Generative Retrieval
by: Li, Yongqi, et al.
Published: (2024)
by: Li, Yongqi, et al.
Published: (2024)
NExT-Search: Rebuilding User Feedback Ecosystem for Generative AI Search
by: Dai, Sunhao, et al.
Published: (2025)
by: Dai, Sunhao, et al.
Published: (2025)
Denoising Diffusion Recommender Model
by: Zhao, Jujia, et al.
Published: (2024)
by: Zhao, Jujia, et al.
Published: (2024)
Verifiable Reasoning for LLM-based Generative Recommendation
by: Lin, Xinyu, et al.
Published: (2026)
by: Lin, Xinyu, et al.
Published: (2026)
Uplift Modeling for Target User Attacks on Recommender Systems
by: Wang, Wenjie, et al.
Published: (2024)
by: Wang, Wenjie, et al.
Published: (2024)
Optimizing Knowledge Integration in Retrieval-Augmented Generation with Self-Selection
by: Weng, Yan, et al.
Published: (2025)
by: Weng, Yan, et al.
Published: (2025)
Generative Cross-Modal Retrieval: Memorizing Images in Multimodal Language Models for Retrieval and Beyond
by: Li, Yongqi, et al.
Published: (2024)
by: Li, Yongqi, et al.
Published: (2024)
Large Language Model Empowered Recommendation Meets All-domain Continual Pre-Training
by: Ma, Haokai, et al.
Published: (2025)
by: Ma, Haokai, et al.
Published: (2025)
R$^2$ec: Towards Large Recommender Models with Reasoning
by: You, Runyang, et al.
Published: (2025)
by: You, Runyang, et al.
Published: (2025)
Exact and Efficient Unlearning for Large Language Model-based Recommendation
by: Hu, Zhiyu, et al.
Published: (2024)
by: Hu, Zhiyu, et al.
Published: (2024)
Self-Calibrated Listwise Reranking with Large Language Models
by: Ren, Ruiyang, et al.
Published: (2024)
by: Ren, Ruiyang, et al.
Published: (2024)
Personalized Generation In Large Model Era: A Survey
by: Xu, Yiyan, et al.
Published: (2025)
by: Xu, Yiyan, et al.
Published: (2025)
Navigating Through Paper Flood: Advancing LLM-based Paper Evaluation through Domain-Aware Retrieval and Latent Reasoning
by: Zheng, Wuqiang, et al.
Published: (2025)
by: Zheng, Wuqiang, et al.
Published: (2025)
Brownian Bridge Diffusion for Sequential Recommendation
by: Bai, Yimeng, et al.
Published: (2025)
by: Bai, Yimeng, et al.
Published: (2025)
Mitigating Spurious Correlations for Self-supervised Recommendation
by: Lin, Xinyu, et al.
Published: (2022)
by: Lin, Xinyu, et al.
Published: (2022)
MiniRec: Data-Efficient Reinforcement Learning for LLM-based Recommendation
by: Wang, Lin, et al.
Published: (2026)
by: Wang, Lin, et al.
Published: (2026)
A Comprehensive Evaluation of Large Language Models on Temporal Event Forecasting
by: Chang, He, et al.
Published: (2024)
by: Chang, He, et al.
Published: (2024)
Mixture-of-Experts Knowledge Graph Retrieval-Augmented Generation for Multi-Agent LLM-based Recommendation
by: Wang, Shijie, et al.
Published: (2026)
by: Wang, Shijie, et al.
Published: (2026)
A Study of Implicit Ranking Unfairness in Large Language Models
by: Xu, Chen, et al.
Published: (2023)
by: Xu, Chen, et al.
Published: (2023)
Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking
by: Ren, Ruiyang, et al.
Published: (2025)
by: Ren, Ruiyang, et al.
Published: (2025)
LLM2Rec: Large Language Models Are Powerful Embedding Models for Sequential Recommendation
by: He, Yingzhi, et al.
Published: (2025)
by: He, Yingzhi, et al.
Published: (2025)
On Generative Agents in Recommendation
by: Zhang, An, et al.
Published: (2023)
by: Zhang, An, et al.
Published: (2023)
Similar Items
-
Bridging Items and Language: A Transition Paradigm for Large Language Model-Based Recommendation
by: Lin, Xinyu, et al.
Published: (2023) -
Order-agnostic Identifier for Large Language Model-based Generative Recommendation
by: Lin, Xinyu, et al.
Published: (2025) -
Learnable Item Tokenization for Generative Recommendation
by: Wang, Wenjie, et al.
Published: (2024) -
A Survey of Generative Search and Recommendation in the Era of Large Language Models
by: Li, Yongqi, et al.
Published: (2024) -
EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens
by: Yang, Chaoqun, et al.
Published: (2025)