Reinforced Preference Optimization for Recommendation
Fuente:
arXiv
Saved in:
| Main Authors: | Tan, Junfei, Chen, Yuxin, Zhang, An, Jiang, Junguang, Liu, Bin, Xu, Ziru, Zhu, Han, Xu, Jian, Zheng, Bo, Wang, Xiang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Think before Recommendation: Autonomous Reasoning-enhanced Recommender
by: Kong, Xiaoyu, et al.
Published: (2025)
by: Kong, Xiaoyu, et al.
Published: (2025)
Large Language Model as Universal Retriever in Industrial-Scale Recommender System
by: Jiang, Junguang, et al.
Published: (2025)
by: Jiang, Junguang, et al.
Published: (2025)
On Softmax Direct Preference Optimization for Recommendation
by: Chen, Yuxin, et al.
Published: (2024)
by: Chen, Yuxin, et al.
Published: (2024)
Reinforced Preference Optimization for Reasoning-Augmented Recommendations
by: Gao, Jingtong, et al.
Published: (2026)
by: Gao, Jingtong, et al.
Published: (2026)
MiniOneRec: An Open-Source Framework for Scaling Generative Recommendation
by: Kong, Xiaoyu, et al.
Published: (2025)
by: Kong, Xiaoyu, et al.
Published: (2025)
Bidding-Aware Retrieval for Multi-Stage Consistency in Online Advertising
by: Liu, Bin, et al.
Published: (2025)
by: Liu, Bin, et al.
Published: (2025)
Parallel Latent Reasoning for Sequential Recommendation
by: Tang, Jiakai, et al.
Published: (2026)
by: Tang, Jiakai, et al.
Published: (2026)
DynamicPO: Dynamic Preference Optimization for Recommendation
by: Hu, Xingyu, et al.
Published: (2026)
by: Hu, Xingyu, et al.
Published: (2026)
Reasoning over Semantic IDs Enhances Generative Recommendation
by: He, Yingzhi, et al.
Published: (2026)
by: He, Yingzhi, et al.
Published: (2026)
Sequential Recommendation for Optimizing Both Immediate Feedback and Long-term Retention
by: Liu, Ziru, et al.
Published: (2024)
by: Liu, Ziru, et al.
Published: (2024)
On Negative-aware Preference Optimization for Recommendation
by: Ding, Chenlu, et al.
Published: (2025)
by: Ding, Chenlu, et al.
Published: (2025)
Fading to Grow: Growing Preference Ratios via Preference Fading Discrete Diffusion for Recommendation
by: Hu, Guoqing, et al.
Published: (2025)
by: Hu, Guoqing, et al.
Published: (2025)
Listwise Preference Alignment Optimization for Tail Item Recommendation
by: Li, Zihao, et al.
Published: (2025)
by: Li, Zihao, et al.
Published: (2025)
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
by: Sun, Chao, et al.
Published: (2024)
by: Sun, Chao, et al.
Published: (2024)
Recurrent Preference Memory for Efficient Long-Sequence Generative Recommendation
by: Chen, Yixiao, et al.
Published: (2026)
by: Chen, Yixiao, et al.
Published: (2026)
Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
AURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems
by: Xue, Zhenghai, et al.
Published: (2023)
by: Xue, Zhenghai, et al.
Published: (2023)
RankGR: Rank-Enhanced Generative Retrieval with Listwise Direct Preference Optimization in Recommendation
by: Fu, Kairui, et al.
Published: (2026)
by: Fu, Kairui, et al.
Published: (2026)
Federated User Preference Modeling for Privacy-Preserving Cross-Domain Recommendation
by: Wang, Li, et al.
Published: (2024)
by: Wang, Li, et al.
Published: (2024)
Preference-Consistent Knowledge Distillation for Recommender System
by: Zhu, Zhangchi, et al.
Published: (2023)
by: Zhu, Zhangchi, et al.
Published: (2023)
Multimodal Recommendation via Self-Corrective Preference Alignmen
by: Guan, Yalong, et al.
Published: (2025)
by: Guan, Yalong, et al.
Published: (2025)
EnhancedRL: An Enhanced-State Reinforcement Learning Algorithm for Multi-Task Fusion in Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
Tree of Preferences for Diversified Recommendation
by: Yuan, Hanyang, et al.
Published: (2025)
by: Yuan, Hanyang, et al.
Published: (2025)
Bridging Jensen Gap for Max-Min Group Fairness Optimization in Recommendation
by: Xu, Chen, et al.
Published: (2025)
by: Xu, Chen, et al.
Published: (2025)
Vague Preference Policy Learning for Conversational Recommendation
by: Zhang, Gangyi, et al.
Published: (2023)
by: Zhang, Gangyi, et al.
Published: (2023)
User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation
by: Xiang, Xingyuan, et al.
Published: (2026)
by: Xiang, Xingyuan, et al.
Published: (2026)
Disentangled Modeling of Preferences and Social Influence for Group Recommendation
by: Ye, Guangze, et al.
Published: (2025)
by: Ye, Guangze, et al.
Published: (2025)
Generate and Instantiate What You Prefer: Text-Guided Diffusion for Sequential Recommendation
by: Hu, Guoqing, et al.
Published: (2024)
by: Hu, Guoqing, et al.
Published: (2024)
DARLR: Dual-Agent Offline Reinforcement Learning for Recommender Systems with Dynamic Reward
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Coherence-guided Preference Disentanglement for Cross-domain Recommendations
by: Xiang, Zongyi, et al.
Published: (2024)
by: Xiang, Zongyi, et al.
Published: (2024)
On Generative Agents in Recommendation
by: Zhang, An, et al.
Published: (2023)
by: Zhang, An, et al.
Published: (2023)
Towards Robust Cross-Domain Recommendation with Joint Identifiability of User Preference
by: Du, Jing, et al.
Published: (2024)
by: Du, Jing, et al.
Published: (2024)
User Invariant Preference Learning for Multi-Behavior Recommendation
by: Yan, Mingshi, et al.
Published: (2025)
by: Yan, Mingshi, et al.
Published: (2025)
ICPO: Intrinsic Confidence-Driven Group Relative Preference Optimization for Efficient Reinforcement Learning
by: Wang, Jinpeng, et al.
Published: (2025)
by: Wang, Jinpeng, et al.
Published: (2025)
UnifiedRL: A Reinforcement Learning Algorithm Tailored for Multi-Task Fusion in Large-Scale Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
Enhancing Sequential Recommendation with World Knowledge from Large Language Models
by: Dai, Tianjie, et al.
Published: (2025)
by: Dai, Tianjie, et al.
Published: (2025)
Aligning Multimodal Sequential Recommendations via Robust Direct Preference Optimization with Sparse MoE
by: Huang, Hejin, et al.
Published: (2026)
by: Huang, Hejin, et al.
Published: (2026)
Denoising Neural Reranker for Recommender Systems
by: Mao, Wenyu, et al.
Published: (2025)
by: Mao, Wenyu, et al.
Published: (2025)
LLM-Powered User Simulator for Recommender System
by: Zhang, Zijian, et al.
Published: (2024)
by: Zhang, Zijian, et al.
Published: (2024)
LONGER: Scaling Up Long Sequence Modeling in Industrial Recommenders
by: Chai, Zheng, et al.
Published: (2025)
by: Chai, Zheng, et al.
Published: (2025)
Similar Items
-
Think before Recommendation: Autonomous Reasoning-enhanced Recommender
by: Kong, Xiaoyu, et al.
Published: (2025) -
Large Language Model as Universal Retriever in Industrial-Scale Recommender System
by: Jiang, Junguang, et al.
Published: (2025) -
On Softmax Direct Preference Optimization for Recommendation
by: Chen, Yuxin, et al.
Published: (2024) -
Reinforced Preference Optimization for Reasoning-Augmented Recommendations
by: Gao, Jingtong, et al.
Published: (2026) -
MiniOneRec: An Open-Source Framework for Scaling Generative Recommendation
by: Kong, Xiaoyu, et al.
Published: (2025)