UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Gengrui, Wang, Yao, Chen, Xiaoshuang, Qian, Hongyi, Zhan, Kaiqiao, Wang, Ben |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
by: Chen, Xiaoshuang, et al.
Published: (2024)
by: Chen, Xiaoshuang, et al.
Published: (2024)
xMTF: A Formula-Free Model for Reinforcement-Learning-Based Multi-Task Fusion in Recommender Systems
by: Cao, Yang, et al.
Published: (2025)
by: Cao, Yang, et al.
Published: (2025)
RPAF: A Reinforcement Prediction-Allocation Framework for Cache Allocation in Large-Scale Recommender Systems
by: Su, Shuo, et al.
Published: (2024)
by: Su, Shuo, et al.
Published: (2024)
Creator-Side Recommender System: Challenges, Designs, and Applications
by: Chen, Xiaoshuang, et al.
Published: (2025)
by: Chen, Xiaoshuang, et al.
Published: (2025)
CREAD: A Classification-Restoration Framework with Error Adaptive Discretization for Watch Time Prediction in Video Recommender Systems
by: Sun, Jie, et al.
Published: (2024)
by: Sun, Jie, et al.
Published: (2024)
Enhancing Playback Performance in Video Recommender Systems with an On-Device Gating and Ranking Framework
by: Yang, Yunfei, et al.
Published: (2024)
by: Yang, Yunfei, et al.
Published: (2024)
Energy-Guided Diffusion Sampling for Long-Term User Behavior Prediction in Reinforcement Learning-based Recommendation
by: Chen, Xiaocong, et al.
Published: (2025)
by: Chen, Xiaocong, et al.
Published: (2025)
DARLR: Dual-Agent Offline Reinforcement Learning for Recommender Systems with Dynamic Reward
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Maximum-Entropy Regularized Decision Transformer with Reward Relabelling for Dynamic Recommendation
by: Chen, Xiaocong, et al.
Published: (2024)
by: Chen, Xiaocong, et al.
Published: (2024)
EasyRL4Rec: An Easy-to-use Library for Reinforcement Learning Based Recommender Systems
by: Yu, Yuanqing, et al.
Published: (2024)
by: Yu, Yuanqing, et al.
Published: (2024)
EnhancedRL: An Enhanced-State Reinforcement Learning Algorithm for Multi-Task Fusion in Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
by: Zhang, Yi, et al.
Published: (2024)
by: Zhang, Yi, et al.
Published: (2024)
Enhancing Long-Term Welfare in Recommender Systems: An Information Revelation Approach
by: Zhao, Xu, et al.
Published: (2025)
by: Zhao, Xu, et al.
Published: (2025)
Unleashing the Potential of Two-Tower Models: Diffusion-Based Cross-Interaction for Large-Scale Matching
by: Wang, Yihan, et al.
Published: (2025)
by: Wang, Yihan, et al.
Published: (2025)
Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling
by: Wang, Jie, et al.
Published: (2024)
by: Wang, Jie, et al.
Published: (2024)
S$^2$GR: Stepwise Semantic-Guided Reasoning in Latent Space for Generative Recommendation
by: Guo, Zihao, et al.
Published: (2026)
by: Guo, Zihao, et al.
Published: (2026)
LLM-Enhanced Reinforcement Learning for Long-Term User Satisfaction in Interactive Recommendation
by: Xia, Chongjun, et al.
Published: (2026)
by: Xia, Chongjun, et al.
Published: (2026)
User Long-Term Multi-Interest Retrieval Model for Recommendation
by: Meng, Yue, et al.
Published: (2025)
by: Meng, Yue, et al.
Published: (2025)
Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems
by: Shu, Wenzheng, et al.
Published: (2025)
by: Shu, Wenzheng, et al.
Published: (2025)
UnifiedRL: A Reinforcement Learning Algorithm Tailored for Multi-Task Fusion in Large-Scale Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
Retentive Decision Transformer with Adaptive Masking for Reinforcement Learning based Recommendation Systems
by: Wang, Siyu, et al.
Published: (2024)
by: Wang, Siyu, et al.
Published: (2024)
On Causally Disentangled State Representation Learning for Reinforcement Learning based Recommender Systems
by: Wang, Siyu, et al.
Published: (2024)
by: Wang, Siyu, et al.
Published: (2024)
Towards End-to-End Alignment of User Satisfaction via Questionnaire in Video Recommendation
by: Li, Na, et al.
Published: (2026)
by: Li, Na, et al.
Published: (2026)
RL-MPCA: A Reinforcement Learning Based Multi-Phase Computation Allocation Approach for Recommender Systems
by: Zhou, Jiahong, et al.
Published: (2023)
by: Zhou, Jiahong, et al.
Published: (2023)
From Local Indices to Global Identifiers: Generative Reranking for Recommender Systems via Global Action Space
by: Jia, Pengyue, et al.
Published: (2026)
by: Jia, Pengyue, et al.
Published: (2026)
RecRM-Bench: Benchmarking Multidimensional Reward Modeling for Agentic Recommender Systems
by: Zeng, Wenwen, et al.
Published: (2026)
by: Zeng, Wenwen, et al.
Published: (2026)
Efficient Sequential Recommendation for Long Term User Interest Via Personalization
by: Zhang, Qiang, et al.
Published: (2026)
by: Zhang, Qiang, et al.
Published: (2026)
Long-Term Interest Clock: Fine-Grained Time Perception in Streaming Recommendation System
by: Zhu, Yongchun, et al.
Published: (2025)
by: Zhu, Yongchun, et al.
Published: (2025)
Distillation-based Scenario-Adaptive Mixture-of-Experts for the Matching Stage of Multi-scenario Recommendation
by: Wang, Ruibing, et al.
Published: (2025)
by: Wang, Ruibing, et al.
Published: (2025)
CEMG: Collaborative-Enhanced Multimodal Generative Recommendation
by: Lin, Yuzhen, et al.
Published: (2025)
by: Lin, Yuzhen, et al.
Published: (2025)
UOEP: User-Oriented Exploration Policy for Enhancing Long-Term User Experiences in Recommender Systems
by: Zhang, Changshuo, et al.
Published: (2024)
by: Zhang, Changshuo, et al.
Published: (2024)
SA-CAISR: Stage-Adaptive and Conflict-Aware Incremental Sequential Recommendation
by: Song, Xiaomeng, et al.
Published: (2026)
by: Song, Xiaomeng, et al.
Published: (2026)
Deep Pareto Reinforcement Learning for Multi-Objective Recommender Systems
by: Li, Pan, et al.
Published: (2024)
by: Li, Pan, et al.
Published: (2024)
Hierarchical Semantic RL: Tackling the Problem of Dynamic Action Space for RL-based Recommendations
by: Wang, Minmao, et al.
Published: (2025)
by: Wang, Minmao, et al.
Published: (2025)
Full Stage Learning to Rank: A Unified Framework for Multi-Stage Systems
by: Zheng, Kai, et al.
Published: (2024)
by: Zheng, Kai, et al.
Published: (2024)
FLEX: Expert-level False-Less EXecution Metric for Reliable Text-to-SQL Benchmark
by: Kim, Heegyu, et al.
Published: (2024)
by: Kim, Heegyu, et al.
Published: (2024)
Reinforced Preference Optimization for Recommendation
by: Tan, Junfei, et al.
Published: (2025)
by: Tan, Junfei, et al.
Published: (2025)
Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
by: Wang, Siyu, et al.
Published: (2025)
by: Wang, Siyu, et al.
Published: (2025)
Personalized Multi-task Training for Recommender System
by: Yang, Liangwei, et al.
Published: (2024)
by: Yang, Liangwei, et al.
Published: (2024)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
by: Liu, Langming, et al.
Published: (2025)
by: Liu, Langming, et al.
Published: (2025)
Similar Items
-
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
by: Chen, Xiaoshuang, et al.
Published: (2024) -
xMTF: A Formula-Free Model for Reinforcement-Learning-Based Multi-Task Fusion in Recommender Systems
by: Cao, Yang, et al.
Published: (2025) -
RPAF: A Reinforcement Prediction-Allocation Framework for Cache Allocation in Large-Scale Recommender Systems
by: Su, Shuo, et al.
Published: (2024) -
Creator-Side Recommender System: Challenges, Designs, and Applications
by: Chen, Xiaoshuang, et al.
Published: (2025) -
CREAD: A Classification-Restoration Framework with Error Adaptive Discretization for Watch Time Prediction in Video Recommender Systems
by: Sun, Jie, et al.
Published: (2024)