Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Siyu, Chen, Xiaocong, Yao, Lina |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Retentive Decision Transformer with Adaptive Masking for Reinforcement Learning based Recommendation Systems
by: Wang, Siyu, et al.
Published: (2024)
by: Wang, Siyu, et al.
Published: (2024)
On Causally Disentangled State Representation Learning for Reinforcement Learning based Recommender Systems
by: Wang, Siyu, et al.
Published: (2024)
by: Wang, Siyu, et al.
Published: (2024)
Energy-Guided Diffusion Sampling for Long-Term User Behavior Prediction in Reinforcement Learning-based Recommendation
by: Chen, Xiaocong, et al.
Published: (2025)
by: Chen, Xiaocong, et al.
Published: (2025)
Maximum In-Support Return Modeling for Dynamic Recommendation with Language Model Prior
by: Chen, Xiaocong, et al.
Published: (2025)
by: Chen, Xiaocong, et al.
Published: (2025)
Maximum-Entropy Regularized Decision Transformer with Reward Relabelling for Dynamic Recommendation
by: Chen, Xiaocong, et al.
Published: (2024)
by: Chen, Xiaocong, et al.
Published: (2024)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
by: Liu, Langming, et al.
Published: (2025)
by: Liu, Langming, et al.
Published: (2025)
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
by: Chen, Xiaoshuang, et al.
Published: (2024)
by: Chen, Xiaoshuang, et al.
Published: (2024)
CASP: Support-Aware Offline Policy Selection for Two-Stage Recommender Systems
by: Chapagain, Nilson
Published: (2026)
by: Chapagain, Nilson
Published: (2026)
Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning
by: Chen, Xiaocong, et al.
Published: (2024)
by: Chen, Xiaocong, et al.
Published: (2024)
On the Reliability of Sampling Strategies in Offline Recommender Evaluation
by: Pereira, Bruno L., et al.
Published: (2025)
by: Pereira, Bruno L., et al.
Published: (2025)
EnhancedRL: An Enhanced-State Reinforcement Learning Algorithm for Multi-Task Fusion in Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
Graph Representation Learning via Causal Diffusion for Out-of-Distribution Recommendation
by: Zhao, Chu, et al.
Published: (2024)
by: Zhao, Chu, et al.
Published: (2024)
Towards Scalable Semantic Representation for Recommendation
by: Zhang, Taolin, et al.
Published: (2024)
by: Zhang, Taolin, et al.
Published: (2024)
Causal Structure Representation Learning of Confounders in Latent Space for Recommendation
by: Xu, Hangtong, et al.
Published: (2023)
by: Xu, Hangtong, et al.
Published: (2023)
RPAF: A Reinforcement Prediction-Allocation Framework for Cache Allocation in Large-Scale Recommender Systems
by: Su, Shuo, et al.
Published: (2024)
by: Su, Shuo, et al.
Published: (2024)
Multi-Objective Recommendation via Multivariate Policy Learning
by: Jeunen, Olivier, et al.
Published: (2024)
by: Jeunen, Olivier, et al.
Published: (2024)
An Efficient Continuous Control Perspective for Reinforcement-Learning-based Sequential Recommendation
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
Optimizing Conversational Product Recommendation via Reinforcement Learning
by: Liu, Kang
Published: (2025)
by: Liu, Kang
Published: (2025)
Efficient Large-Scale Cross-Domain Sequential Recommendation with Dynamic State Representations
by: Loureiro, Manuel V., et al.
Published: (2025)
by: Loureiro, Manuel V., et al.
Published: (2025)
The Bandit's Blind Spot: The Critical Role of User State Representation in Recommender Systems
by: Pires, Pedro R., et al.
Published: (2026)
by: Pires, Pedro R., et al.
Published: (2026)
Evaluating Generative AI Tools for Personalized Offline Recommendations: A Comparative Study
by: Salinas-Buestan, Rafael, et al.
Published: (2025)
by: Salinas-Buestan, Rafael, et al.
Published: (2025)
Time to Split: Exploring Data Splitting Strategies for Offline Evaluation of Sequential Recommenders
by: Gusak, Danil, et al.
Published: (2025)
by: Gusak, Danil, et al.
Published: (2025)
Exploitation Over Exploration: Unmasking the Bias in Linear Bandit Recommender Offline Evaluation
by: Pires, Pedro R., et al.
Published: (2025)
by: Pires, Pedro R., et al.
Published: (2025)
Offline Reasoning for Efficient Recommendation: LLM-Empowered Persona-Profiled Item Indexing
by: Kim, Deogyong, et al.
Published: (2026)
by: Kim, Deogyong, et al.
Published: (2026)
STARS: Semantic Tokens with Augmented Representations for Recommendation at Scale
by: Chen, Han, et al.
Published: (2025)
by: Chen, Han, et al.
Published: (2025)
Taming Recommendation Bias with Causal Intervention on Evolving Personal Popularity
by: Tan, Shiyin, et al.
Published: (2025)
by: Tan, Shiyin, et al.
Published: (2025)
EasyRL4Rec: An Easy-to-use Library for Reinforcement Learning Based Recommender Systems
by: Yu, Yuanqing, et al.
Published: (2024)
by: Yu, Yuanqing, et al.
Published: (2024)
AURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems
by: Xue, Zhenghai, et al.
Published: (2023)
by: Xue, Zhenghai, et al.
Published: (2023)
Causality-aware Graph Aggregation Weight Estimator for Popularity Debiasing in Top-K Recommendation
by: Que, Yue, et al.
Published: (2025)
by: Que, Yue, et al.
Published: (2025)
Unified Representation Learning for Multi-Intent Diversity and Behavioral Uncertainty in Recommender Systems
by: Xu, Wei, et al.
Published: (2025)
by: Xu, Wei, et al.
Published: (2025)
Learning to Collaborate via Structures: Cluster-Guided Item Alignment for Federated Recommendation
by: Tu, Yuchun, et al.
Published: (2026)
by: Tu, Yuchun, et al.
Published: (2026)
CSRec: Rethinking Sequential Recommendation from A Causal Perspective
by: Liu, Xiaoyu, et al.
Published: (2024)
by: Liu, Xiaoyu, et al.
Published: (2024)
Creator-Side Recommender System: Challenges, Designs, and Applications
by: Chen, Xiaoshuang, et al.
Published: (2025)
by: Chen, Xiaoshuang, et al.
Published: (2025)
FedDCSR: Federated Cross-domain Sequential Recommendation via Disentangled Representation Learning
by: Zhang, Hongyu, et al.
Published: (2023)
by: Zhang, Hongyu, et al.
Published: (2023)
FELRec: Efficient Handling of Item Cold-Start With Dynamic Representation Learning in Recommender Systems
by: Weimann, Kuba, et al.
Published: (2022)
by: Weimann, Kuba, et al.
Published: (2022)
Optimizing Novelty of Top-k Recommendations using Large Language Models and Reinforcement Learning
by: Sharma, Amit, et al.
Published: (2024)
by: Sharma, Amit, et al.
Published: (2024)
UnifiedRL: A Reinforcement Learning Algorithm Tailored for Multi-Task Fusion in Large-Scale Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
A Unified Causal Framework for Auditing Recommender Systems for Ethical Concerns
by: Sharma, Vibhhu, et al.
Published: (2024)
by: Sharma, Vibhhu, et al.
Published: (2024)
General Item Representation Learning for Cold-start Content Recommendations
by: Kim, Jooeun, et al.
Published: (2024)
by: Kim, Jooeun, et al.
Published: (2024)
Efficient Pointwise-Pairwise Learning-to-Rank for News Recommendation
by: Kannen, Nithish, et al.
Published: (2024)
by: Kannen, Nithish, et al.
Published: (2024)
Similar Items
-
Retentive Decision Transformer with Adaptive Masking for Reinforcement Learning based Recommendation Systems
by: Wang, Siyu, et al.
Published: (2024) -
On Causally Disentangled State Representation Learning for Reinforcement Learning based Recommender Systems
by: Wang, Siyu, et al.
Published: (2024) -
Energy-Guided Diffusion Sampling for Long-Term User Behavior Prediction in Reinforcement Learning-based Recommendation
by: Chen, Xiaocong, et al.
Published: (2025) -
Maximum In-Support Return Modeling for Dynamic Recommendation with Language Model Prior
by: Chen, Xiaocong, et al.
Published: (2025) -
Maximum-Entropy Regularized Decision Transformer with Reward Relabelling for Dynamic Recommendation
by: Chen, Xiaocong, et al.
Published: (2024)