Efficiency Unleashed: Inference Acceleration for LLM-based Recommender Systems with Speculative Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Xi, Yunjia, Wang, Hangyu, Chen, Bo, Lin, Jianghao, Zhu, Menghui, Liu, Weiwen, Tang, Ruiming, Wei, Zhewei, Zhang, Weinan, Yu, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MemoCRS: Memory-enhanced Sequential Conversational Recommender Systems with Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
Modular Representation Compression: Adapting LLMs for Efficient and Effective Recommendations
di: Xi, Yunjia, et al.
Pubblicazione: (2026)
di: Xi, Yunjia, et al.
Pubblicazione: (2026)
Play to Your Strengths: Collaborative Intelligence of Conventional Recommender Models and Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
Beyond Positive History: Re-ranking with List-level Hybrid Feedback
di: Weng, Muyan, et al.
Pubblicazione: (2024)
di: Weng, Muyan, et al.
Pubblicazione: (2024)
Efficient and Deployable Knowledge Infusion for Open-World Recommendations via Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
di: Xi, Yunjia, et al.
Pubblicazione: (2024)
DisCo: Towards Harmonious Disentanglement and Collaboration between Tabular and Semantic Space for Recommendation
di: Du, Kounianhua, et al.
Pubblicazione: (2024)
di: Du, Kounianhua, et al.
Pubblicazione: (2024)
Towards Efficient and Effective Unlearning of Large Language Models for Recommendation
di: Wang, Hangyu, et al.
Pubblicazione: (2024)
di: Wang, Hangyu, et al.
Pubblicazione: (2024)
An Automatic Graph Construction Framework based on Large Language Models for Recommendation
di: Shan, Rong, et al.
Pubblicazione: (2024)
di: Shan, Rong, et al.
Pubblicazione: (2024)
How Can Recommender Systems Benefit from Large Language Models: A Survey
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
InfoDeepSeek: Benchmarking Agentic Information Seeking for Retrieval-Augmented Generation
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
D2K: Turning Historical Data into Retrievable Knowledge for Recommender Systems
di: Qin, Jiarui, et al.
Pubblicazione: (2024)
di: Qin, Jiarui, et al.
Pubblicazione: (2024)
ClickPrompt: CTR Models are Strong Prompt Generators for Adapting Language Models to CTR Prediction
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
Large Language Models Make Sample-Efficient Recommender Systems
di: Lin, Jianghao, et al.
Pubblicazione: (2024)
di: Lin, Jianghao, et al.
Pubblicazione: (2024)
FLIP: Fine-grained Alignment between ID-based Models and Pretrained Language Models for CTR Prediction
di: Wang, Hangyu, et al.
Pubblicazione: (2023)
di: Wang, Hangyu, et al.
Pubblicazione: (2023)
Generative Representational Learning of Foundation Models for Recommendation
di: Zhou, Zheli, et al.
Pubblicazione: (2025)
di: Zhou, Zheli, et al.
Pubblicazione: (2025)
A Survey on Diffusion Models for Recommender Systems
di: Lin, Jianghao, et al.
Pubblicazione: (2024)
di: Lin, Jianghao, et al.
Pubblicazione: (2024)
MassTool: A Multi-Task Search-Based Tool Retrieval Framework for Large Language Models
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
Superplatforms Have to Attack AI Agents
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
ELCoRec: Enhance Language Understanding with Co-Propagation of Numerical and Categorical Features for Recommendation
di: Chen, Jizheng, et al.
Pubblicazione: (2024)
di: Chen, Jizheng, et al.
Pubblicazione: (2024)
Unleashing the Potential of Multi-Channel Fusion in Retrieval for Personalized Recommendations
di: Huang, Junjie, et al.
Pubblicazione: (2024)
di: Huang, Junjie, et al.
Pubblicazione: (2024)
M-scan: A Multi-Scenario Causal-driven Adaptive Network for Recommendation
di: Zhu, Jiachen, et al.
Pubblicazione: (2024)
di: Zhu, Jiachen, et al.
Pubblicazione: (2024)
A Survey of LLM-based Deep Search Agents: Paradigm, Optimization, Evaluation, and Challenges
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
Full-Stack Optimized Large Language Models for Lifelong Sequential Behavior Comprehension in Recommendation
di: Shan, Rong, et al.
Pubblicazione: (2025)
di: Shan, Rong, et al.
Pubblicazione: (2025)
Lifelong Personalized Low-Rank Adaptation of Large Language Models for Recommendation
di: Zhu, Jiachen, et al.
Pubblicazione: (2024)
di: Zhu, Jiachen, et al.
Pubblicazione: (2024)
LIBER: Lifelong User Behavior Modeling Based on Large Language Models
di: Zhu, Chenxu, et al.
Pubblicazione: (2024)
di: Zhu, Chenxu, et al.
Pubblicazione: (2024)
MuonRec: Shifting the Optimizer Paradigm Beyond Adam in Scalable Generative Recommendation
di: Shan, Rong, et al.
Pubblicazione: (2026)
di: Shan, Rong, et al.
Pubblicazione: (2026)
ReLLa: Retrieval-enhanced Large Language Models for Lifelong Sequential Behavior Comprehension in Recommendation
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
di: Lin, Jianghao, et al.
Pubblicazione: (2023)
Stop DDoS Attacking the Research Community with AI-Generated Survey Papers
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
LLM4Rerank: LLM-based Auto-Reranking Framework for Recommendations
di: Gao, Jingtong, et al.
Pubblicazione: (2024)
di: Gao, Jingtong, et al.
Pubblicazione: (2024)
LLM4Tag: Automatic Tagging System for Information Retrieval via Large Language Models
di: Tang, Ruiming, et al.
Pubblicazione: (2025)
di: Tang, Ruiming, et al.
Pubblicazione: (2025)
Retrieval-Oriented Knowledge for Click-Through Rate Prediction
di: Liu, Huanshuo, et al.
Pubblicazione: (2024)
di: Liu, Huanshuo, et al.
Pubblicazione: (2024)
FINED: Feed Instance-Wise Information Need with Essential and Disentangled Parametric Knowledge from the Past
di: Du, Kounianhua, et al.
Pubblicazione: (2024)
di: Du, Kounianhua, et al.
Pubblicazione: (2024)
Unleashing the Native Recommendation Potential: LLM-Based Generative Recommendation via Structured Term Identifiers
di: Zhang, Zhiyang, et al.
Pubblicazione: (2026)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2026)
A Comprehensive Survey on Retrieval Methods in Recommender Systems
di: Huang, Junjie, et al.
Pubblicazione: (2024)
di: Huang, Junjie, et al.
Pubblicazione: (2024)
All Roads Lead to Rome: Unveiling the Trajectory of Recommender Systems Across the LLM Era
di: Chen, Bo, et al.
Pubblicazione: (2024)
di: Chen, Bo, et al.
Pubblicazione: (2024)
Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
Learning ID-free Item Representation with Token Crossing for Multimodal Recommendation
di: Zhang, Kangning, et al.
Pubblicazione: (2024)
di: Zhang, Kangning, et al.
Pubblicazione: (2024)
RecCocktail: A Generalizable and Efficient Framework for LLM-Based Recommendation
di: Hou, Min, et al.
Pubblicazione: (2025)
di: Hou, Min, et al.
Pubblicazione: (2025)
Decoding in Latent Spaces for Efficient Inference in LLM-based Recommendation
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens
di: Yang, Chaoqun, et al.
Pubblicazione: (2025)
di: Yang, Chaoqun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MemoCRS: Memory-enhanced Sequential Conversational Recommender Systems with Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024) -
Modular Representation Compression: Adapting LLMs for Efficient and Effective Recommendations
di: Xi, Yunjia, et al.
Pubblicazione: (2026) -
Play to Your Strengths: Collaborative Intelligence of Conventional Recommender Models and Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024) -
Beyond Positive History: Re-ranking with List-level Hybrid Feedback
di: Weng, Muyan, et al.
Pubblicazione: (2024) -
Efficient and Deployable Knowledge Infusion for Open-World Recommendations via Large Language Models
di: Xi, Yunjia, et al.
Pubblicazione: (2024)