MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yusheng, Xu, Pengbo, Wang, Shen, Lao, Changxin, Cao, Jiangxia, Wen, Shuang, Yang, Shuang, Liu, Zhaojie, Li, Han, Gai, Kun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM-Alignment Live-Streaming Recommendation
di: Liu, Yueyang, et al.
Pubblicazione: (2025)
di: Liu, Yueyang, et al.
Pubblicazione: (2025)
Foresight Prediction Enhanced Live-Streaming Recommendation
di: Cao, Jiangxia, et al.
Pubblicazione: (2025)
di: Cao, Jiangxia, et al.
Pubblicazione: (2025)
OneLive: Dynamically Unified Generative Framework for Live-Streaming Recommendation
di: Wang, Shen, et al.
Pubblicazione: (2026)
di: Wang, Shen, et al.
Pubblicazione: (2026)
A Unified Framework for Cross-Domain Recommendation
di: Cao, Jiangxia, et al.
Pubblicazione: (2024)
di: Cao, Jiangxia, et al.
Pubblicazione: (2024)
SARM: LLM-Augmented Semantic Anchor for End-to-End Live-Streaming Ranking
di: Yang, Ruochen, et al.
Pubblicazione: (2026)
di: Yang, Ruochen, et al.
Pubblicazione: (2026)
On the Equivalence Between Auto-Regressive Next Token Prediction and Full-Item-Vocabulary Maximum Likelihood Estimation in Generative Recommendation--A Short Note
di: Huang, Yusheng, et al.
Pubblicazione: (2026)
di: Huang, Yusheng, et al.
Pubblicazione: (2026)
Harmonizing Generative Retrieval and Ranking in Chain-of-Recommendation
di: Liu, Yu, et al.
Pubblicazione: (2026)
di: Liu, Yu, et al.
Pubblicazione: (2026)
FARM: Frequency-Aware Model for Cross-Domain Live-Streaming Recommendation
di: Li, Xiaodong, et al.
Pubblicazione: (2025)
di: Li, Xiaodong, et al.
Pubblicazione: (2025)
Moment&Cross: Next-Generation Real-Time Cross-Domain CTR Prediction for Live-Streaming Recommendation at Kuaishou
di: Cao, Jiangxia, et al.
Pubblicazione: (2024)
di: Cao, Jiangxia, et al.
Pubblicazione: (2024)
From Agnostic to Specific: Latent Preference Diffusion for Multi-Behavior Sequential Recommendation
di: Yang, Ruochen, et al.
Pubblicazione: (2026)
di: Yang, Ruochen, et al.
Pubblicazione: (2026)
LiveForesighter: Generating Future Information for Live-Streaming Recommendations at Kuaishou
di: Lu, Yucheng, et al.
Pubblicazione: (2025)
di: Lu, Yucheng, et al.
Pubblicazione: (2025)
QARM V2: Quantitative Alignment Multi-Modal Recommendation for Reasoning User Sequence Modeling
di: Xia, Tian, et al.
Pubblicazione: (2026)
di: Xia, Tian, et al.
Pubblicazione: (2026)
MaRI: Material Retrieval Integration across Domains
di: Wang, Jianhui, et al.
Pubblicazione: (2025)
di: Wang, Jianhui, et al.
Pubblicazione: (2025)
Selection and Exploitation of High-Quality Knowledge from Large Language Models for Recommendation
di: Wang, Guanchen, et al.
Pubblicazione: (2025)
di: Wang, Guanchen, et al.
Pubblicazione: (2025)
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
di: Wang, Xu, et al.
Pubblicazione: (2024)
di: Wang, Xu, et al.
Pubblicazione: (2024)
Break the Inaccessible Boundary: Distilling Post-Conversion Content for User Retention Modeling
di: Ma, Tianbao, et al.
Pubblicazione: (2026)
di: Ma, Tianbao, et al.
Pubblicazione: (2026)
Enhancing Content-based Recommendation via Large Language Model
di: Xu, Wentao, et al.
Pubblicazione: (2024)
di: Xu, Wentao, et al.
Pubblicazione: (2024)
PushGen: Push Notifications Generation with LLM
di: Bie, Shifu, et al.
Pubblicazione: (2025)
di: Bie, Shifu, et al.
Pubblicazione: (2025)
MARM: Unlocking the Future of Recommendation Systems through Memory Augmentation and Scalable Complexity
di: Lv, Xiao, et al.
Pubblicazione: (2024)
di: Lv, Xiao, et al.
Pubblicazione: (2024)
OnePiece: The Great Route to Generative Recommendation -- A Case Study from Tencent Algorithm Competition
di: Cao, Jiangxia, et al.
Pubblicazione: (2025)
di: Cao, Jiangxia, et al.
Pubblicazione: (2025)
ChorusCVR: Chorus Supervision for Entire Space Post-Click Conversion Rate Modeling
di: Cheng, Wei, et al.
Pubblicazione: (2025)
di: Cheng, Wei, et al.
Pubblicazione: (2025)
GoalRank: Group-Relative Optimization for a Large Ranking Model
di: Zhang, Kaike, et al.
Pubblicazione: (2025)
di: Zhang, Kaike, et al.
Pubblicazione: (2025)
RecCoT: Enhancing Recommendation via Chain-of-Thought
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems
di: Ha, Mingming, et al.
Pubblicazione: (2026)
di: Ha, Mingming, et al.
Pubblicazione: (2026)
An End-to-End Multi-objective Ensemble Ranking Framework for Video Recommendation
di: He, Tiantian, et al.
Pubblicazione: (2025)
di: He, Tiantian, et al.
Pubblicazione: (2025)
KuaiFormer: Transformer-Based Retrieval at Kuaishou
di: Liu, Chi, et al.
Pubblicazione: (2024)
di: Liu, Chi, et al.
Pubblicazione: (2024)
QARM: Quantitative Alignment Multi-Modal Recommendation at Kuaishou
di: Luo, Xinchen, et al.
Pubblicazione: (2024)
di: Luo, Xinchen, et al.
Pubblicazione: (2024)
TokenMixer-Large: Scaling Up Large Ranking Models in Industrial Recommenders
di: Jiang, Yuchen, et al.
Pubblicazione: (2026)
di: Jiang, Yuchen, et al.
Pubblicazione: (2026)
CRM: Retrieval Model with Controllable Condition
di: Liu, Chi, et al.
Pubblicazione: (2024)
di: Liu, Chi, et al.
Pubblicazione: (2024)
RankGR: Rank-Enhanced Generative Retrieval with Listwise Direct Preference Optimization in Recommendation
di: Fu, Kairui, et al.
Pubblicazione: (2026)
di: Fu, Kairui, et al.
Pubblicazione: (2026)
RPAF: A Reinforcement Prediction-Allocation Framework for Cache Allocation in Large-Scale Recommender Systems
di: Su, Shuo, et al.
Pubblicazione: (2024)
di: Su, Shuo, et al.
Pubblicazione: (2024)
Cross-Domain Sequential Recommendation via Neural Process
di: Li, Haipeng, et al.
Pubblicazione: (2024)
di: Li, Haipeng, et al.
Pubblicazione: (2024)
RankMixer: Scaling Up Ranking Models in Industrial Recommenders
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
Federated Mixture-of-Expert for Non-Overlapped Cross-Domain Sequential Recommendation
di: Liu, Yu, et al.
Pubblicazione: (2025)
di: Liu, Yu, et al.
Pubblicazione: (2025)
PROMISE: Process Reward Models Unlock Test-Time Scaling Laws in Generative Recommendations
di: Guo, Chengcheng, et al.
Pubblicazione: (2026)
di: Guo, Chengcheng, et al.
Pubblicazione: (2026)
Measuring Fairness in Large-Scale Recommendation Systems with Missing Labels
di: Dong, Yulong, et al.
Pubblicazione: (2024)
di: Dong, Yulong, et al.
Pubblicazione: (2024)
Generative Recommendation for Large-Scale Advertising
di: Xue, Ben, et al.
Pubblicazione: (2026)
di: Xue, Ben, et al.
Pubblicazione: (2026)
Generative Pre-trained Ranking Model with Over-parameterization at Web-Scale (Extended Abstract)
di: Li, Yuchen, et al.
Pubblicazione: (2024)
di: Li, Yuchen, et al.
Pubblicazione: (2024)
RankUp: Towards High-rank Representations for Large Scale Advertising Recommender Systems
di: Chen, Jin, et al.
Pubblicazione: (2026)
di: Chen, Jin, et al.
Pubblicazione: (2026)
Unleashing the Native Recommendation Potential: LLM-Based Generative Recommendation via Structured Term Identifiers
di: Zhang, Zhiyang, et al.
Pubblicazione: (2026)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LLM-Alignment Live-Streaming Recommendation
di: Liu, Yueyang, et al.
Pubblicazione: (2025) -
Foresight Prediction Enhanced Live-Streaming Recommendation
di: Cao, Jiangxia, et al.
Pubblicazione: (2025) -
OneLive: Dynamically Unified Generative Framework for Live-Streaming Recommendation
di: Wang, Shen, et al.
Pubblicazione: (2026) -
A Unified Framework for Cross-Domain Recommendation
di: Cao, Jiangxia, et al.
Pubblicazione: (2024) -
SARM: LLM-Augmented Semantic Anchor for End-to-End Live-Streaming Ranking
di: Yang, Ruochen, et al.
Pubblicazione: (2026)