RPAF: A Reinforcement Prediction-Allocation Framework for Cache Allocation in Large-Scale Recommender Systems
Fuente:
arXiv
Guardado en:
| Autores principales: | Su, Shuo, Chen, Xiaoshuang, Wang, Yao, Wu, Yulin, Zhang, Ziqiang, Zhan, Kaiqiao, Wang, Ben, Gai, Kun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
por: Chen, Xiaoshuang, et al.
Publicado: (2024)
por: Chen, Xiaoshuang, et al.
Publicado: (2024)
Creator-Side Recommender System: Challenges, Designs, and Applications
por: Chen, Xiaoshuang, et al.
Publicado: (2025)
por: Chen, Xiaoshuang, et al.
Publicado: (2025)
UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
por: Zhang, Gengrui, et al.
Publicado: (2024)
por: Zhang, Gengrui, et al.
Publicado: (2024)
xMTF: A Formula-Free Model for Reinforcement-Learning-Based Multi-Task Fusion in Recommender Systems
por: Cao, Yang, et al.
Publicado: (2025)
por: Cao, Yang, et al.
Publicado: (2025)
CREAD: A Classification-Restoration Framework with Error Adaptive Discretization for Watch Time Prediction in Video Recommender Systems
por: Sun, Jie, et al.
Publicado: (2024)
por: Sun, Jie, et al.
Publicado: (2024)
Enhancing Playback Performance in Video Recommender Systems with an On-Device Gating and Ranking Framework
por: Yang, Yunfei, et al.
Publicado: (2024)
por: Yang, Yunfei, et al.
Publicado: (2024)
Item Level Exploration Traffic Allocation in Large-scale Recommendation Systems
por: Wang, Dong, et al.
Publicado: (2025)
por: Wang, Dong, et al.
Publicado: (2025)
Unleashing the Potential of Two-Tower Models: Diffusion-Based Cross-Interaction for Large-Scale Matching
por: Wang, Yihan, et al.
Publicado: (2025)
por: Wang, Yihan, et al.
Publicado: (2025)
Towards End-to-End Alignment of User Satisfaction via Questionnaire in Video Recommendation
por: Li, Na, et al.
Publicado: (2026)
por: Li, Na, et al.
Publicado: (2026)
MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
por: Huang, Yusheng, et al.
Publicado: (2026)
por: Huang, Yusheng, et al.
Publicado: (2026)
From Local Indices to Global Identifiers: Generative Reranking for Recommender Systems via Global Action Space
por: Jia, Pengyue, et al.
Publicado: (2026)
por: Jia, Pengyue, et al.
Publicado: (2026)
UniRank: Unified List-wise Reranking via Confidence-Ordered Denoising
por: Jia, Pengyue, et al.
Publicado: (2026)
por: Jia, Pengyue, et al.
Publicado: (2026)
R4ec: A Reasoning, Reflection, and Refinement Framework for Recommendation Systems
por: Gu, Hao, et al.
Publicado: (2025)
por: Gu, Hao, et al.
Publicado: (2025)
Reinforced Preference Optimization for Reasoning-Augmented Recommendations
por: Gao, Jingtong, et al.
Publicado: (2026)
por: Gao, Jingtong, et al.
Publicado: (2026)
RL-MPCA: A Reinforcement Learning Based Multi-Phase Computation Allocation Approach for Recommender Systems
por: Zhou, Jiahong, et al.
Publicado: (2023)
por: Zhou, Jiahong, et al.
Publicado: (2023)
Measuring Fairness in Large-Scale Recommendation Systems with Missing Labels
por: Dong, Yulong, et al.
Publicado: (2024)
por: Dong, Yulong, et al.
Publicado: (2024)
DADF: A Distribution-Aware Debiasing Framework for Watch-Time Regression in Recommender Systems
por: Yang, Yiqing, et al.
Publicado: (2026)
por: Yang, Yiqing, et al.
Publicado: (2026)
AURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems
por: Xue, Zhenghai, et al.
Publicado: (2023)
por: Xue, Zhenghai, et al.
Publicado: (2023)
Generative Recommendation for Large-Scale Advertising
por: Xue, Ben, et al.
Publicado: (2026)
por: Xue, Ben, et al.
Publicado: (2026)
A General Framework for Multimodal LLM-Based Multimedia Understanding in Large-Scale Recommendation Systems
por: Zhu, Yiming, et al.
Publicado: (2026)
por: Zhu, Yiming, et al.
Publicado: (2026)
S$^2$GR: Stepwise Semantic-Guided Reasoning in Latent Space for Generative Recommendation
por: Guo, Zihao, et al.
Publicado: (2026)
por: Guo, Zihao, et al.
Publicado: (2026)
Efficient Item ID Generation for Large-Scale LLM-based Recommendation
por: Subbiah, Anushya, et al.
Publicado: (2025)
por: Subbiah, Anushya, et al.
Publicado: (2025)
Denoising Neural Reranker for Recommender Systems
por: Mao, Wenyu, et al.
Publicado: (2025)
por: Mao, Wenyu, et al.
Publicado: (2025)
A Predict-Then-Optimize Customer Allocation Framework for Online Fund Recommendation
por: Tang, Xing, et al.
Publicado: (2025)
por: Tang, Xing, et al.
Publicado: (2025)
An End-to-End Multi-objective Ensemble Ranking Framework for Video Recommendation
por: He, Tiantian, et al.
Publicado: (2025)
por: He, Tiantian, et al.
Publicado: (2025)
MaRCA: Multi-Agent Reinforcement Learning for Dynamic Computation Allocation in Large-Scale Recommender Systems
por: Jiang, Wan, et al.
Publicado: (2025)
por: Jiang, Wan, et al.
Publicado: (2025)
Reinforce Lifelong Interaction Value of User-Author Pairs for Large-Scale Recommendation Systems
por: Li, Yisha, et al.
Publicado: (2025)
por: Li, Yisha, et al.
Publicado: (2025)
MODRL-TA:A Multi-Objective Deep Reinforcement Learning Framework for Traffic Allocation in E-Commerce Search
por: Cheng, Peng, et al.
Publicado: (2024)
por: Cheng, Peng, et al.
Publicado: (2024)
Energy-Guided Diffusion Sampling for Long-Term User Behavior Prediction in Reinforcement Learning-based Recommendation
por: Chen, Xiaocong, et al.
Publicado: (2025)
por: Chen, Xiaocong, et al.
Publicado: (2025)
Rec-R1: Bridging Generative Large Language Models and User-Centric Recommendation Systems via Reinforcement Learning
por: Lin, Jiacheng, et al.
Publicado: (2025)
por: Lin, Jiacheng, et al.
Publicado: (2025)
Reinforced Prompt Personalization for Recommendation with Large Language Models
por: Mao, Wenyu, et al.
Publicado: (2024)
por: Mao, Wenyu, et al.
Publicado: (2024)
UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems
por: Ha, Mingming, et al.
Publicado: (2026)
por: Ha, Mingming, et al.
Publicado: (2026)
PROMISE: Process Reward Models Unlock Test-Time Scaling Laws in Generative Recommendations
por: Guo, Chengcheng, et al.
Publicado: (2026)
por: Guo, Chengcheng, et al.
Publicado: (2026)
Causal Distillation for Alleviating Performance Heterogeneity in Recommender Systems
por: Zhang, Shengyu, et al.
Publicado: (2024)
por: Zhang, Shengyu, et al.
Publicado: (2024)
SOLAR: SVD-Optimized Lifelong Attention for Recommendation
por: Zhang, Chenghao, et al.
Publicado: (2026)
por: Zhang, Chenghao, et al.
Publicado: (2026)
Shapley Value-driven Data Pruning for Recommender Systems
por: Zhang, Yansen, et al.
Publicado: (2025)
por: Zhang, Yansen, et al.
Publicado: (2025)
From Principles to Applications: A Comprehensive Survey of Discrete Tokenizers in Generation, Comprehension, Recommendation, and Information Retrieval
por: Jia, Jian, et al.
Publicado: (2025)
por: Jia, Jian, et al.
Publicado: (2025)
Selection and Exploitation of High-Quality Knowledge from Large Language Models for Recommendation
por: Wang, Guanchen, et al.
Publicado: (2025)
por: Wang, Guanchen, et al.
Publicado: (2025)
Unlocking Scaling Law in Industrial Recommendation Systems with a Three-step Paradigm based Large User Model
por: Yan, Bencheng, et al.
Publicado: (2025)
por: Yan, Bencheng, et al.
Publicado: (2025)
MARM: Unlocking the Future of Recommendation Systems through Memory Augmentation and Scalable Complexity
por: Lv, Xiao, et al.
Publicado: (2024)
por: Lv, Xiao, et al.
Publicado: (2024)
Ejemplares similares
-
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
por: Chen, Xiaoshuang, et al.
Publicado: (2024) -
Creator-Side Recommender System: Challenges, Designs, and Applications
por: Chen, Xiaoshuang, et al.
Publicado: (2025) -
UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
por: Zhang, Gengrui, et al.
Publicado: (2024) -
xMTF: A Formula-Free Model for Reinforcement-Learning-Based Multi-Task Fusion in Recommender Systems
por: Cao, Yang, et al.
Publicado: (2025) -
CREAD: A Classification-Restoration Framework with Error Adaptive Discretization for Watch Time Prediction in Video Recommender Systems
por: Sun, Jie, et al.
Publicado: (2024)