RLPO: Residual Listwise Preference Optimization for Long-Context Review Ranking
Fuente:
arXiv
Saved in:
| Main Authors: | Jiang, Hao, Yang, Zhi, Wang, Annan, Zhang, Yichi, Lin, Weisi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ResRank: Unifying Retrieval and Listwise Reranking via End-to-End Joint Training with Residual Passage Compression
by: Ke, Xiaojie, et al.
Published: (2026)
by: Ke, Xiaojie, et al.
Published: (2026)
Contextual Dual Learning Algorithm with Listwise Distillation for Unbiased Learning to Rank
by: Yu, Lulu, et al.
Published: (2024)
by: Yu, Lulu, et al.
Published: (2024)
Rethinking the Necessity of Adaptive Retrieval-Augmented Generation through the Lens of Adaptive Listwise Ranking
by: Feng, Jun, et al.
Published: (2026)
by: Feng, Jun, et al.
Published: (2026)
Holistic Utility Preference Learning for Listwise Alignment
by: Zhou, Jiacong, et al.
Published: (2024)
by: Zhou, Jiacong, et al.
Published: (2024)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
by: Liu, Qi, et al.
Published: (2025)
by: Liu, Qi, et al.
Published: (2025)
Guiding Retrieval using LLM-based Listwise Rankers
by: Rathee, Mandeep, et al.
Published: (2025)
by: Rathee, Mandeep, et al.
Published: (2025)
RankGR: Rank-Enhanced Generative Retrieval with Listwise Direct Preference Optimization in Recommendation
by: Fu, Kairui, et al.
Published: (2026)
by: Fu, Kairui, et al.
Published: (2026)
Long Context Modeling with Ranked Memory-Augmented Retrieval
by: Alselwi, Ghadir, et al.
Published: (2025)
by: Alselwi, Ghadir, et al.
Published: (2025)
On Softmax Direct Preference Optimization for Recommendation
by: Chen, Yuxin, et al.
Published: (2024)
by: Chen, Yuxin, et al.
Published: (2024)
AcuRank: Uncertainty-Aware Adaptive Computation for Listwise Reranking
by: Yoon, Soyoung, et al.
Published: (2025)
by: Yoon, Soyoung, et al.
Published: (2025)
Zeroshot Listwise Learning to Rank Algorithm for Recommendation
by: Wang, Hao
Published: (2024)
by: Wang, Hao
Published: (2024)
TSPRank: Bridging Pairwise and Listwise Methods with a Bilinear Travelling Salesman Model
by: Li, Weixian Waylon, et al.
Published: (2024)
by: Li, Weixian Waylon, et al.
Published: (2024)
RankPO: Preference Optimization for Job-Talent Matching
by: Zhang, Yafei, et al.
Published: (2025)
by: Zhang, Yafei, et al.
Published: (2025)
Hierarchical Reinforcement Learning for Temporal Abstraction of Listwise Recommendation
by: Ji, Luo, et al.
Published: (2024)
by: Ji, Luo, et al.
Published: (2024)
DynamicPO: Dynamic Preference Optimization for Recommendation
by: Hu, Xingyu, et al.
Published: (2026)
by: Hu, Xingyu, et al.
Published: (2026)
RIA: A Ranking-Infused Approach for Optimized listwise CTR Prediction
by: Zhang, Guoxiao, et al.
Published: (2025)
by: Zhang, Guoxiao, et al.
Published: (2025)
On Negative-aware Preference Optimization for Recommendation
by: Ding, Chenlu, et al.
Published: (2025)
by: Ding, Chenlu, et al.
Published: (2025)
HyQE: Ranking Contexts with Hypothetical Query Embeddings
by: Zhou, Weichao, et al.
Published: (2024)
by: Zhou, Weichao, et al.
Published: (2024)
Generative Retrieval with Preference Optimization for E-commerce Search
by: Li, Mingming, et al.
Published: (2024)
by: Li, Mingming, et al.
Published: (2024)
HeadRank: Decoding-Free Passage Reranking via Preference-Aligned Attention Heads
by: Wang, Juyuan, et al.
Published: (2026)
by: Wang, Juyuan, et al.
Published: (2026)
Very Efficient Listwise Multimodal Reranking for Long Documents
by: Sun, Yiqun, et al.
Published: (2026)
by: Sun, Yiqun, et al.
Published: (2026)
Temporal User Profiling with LLMs: Balancing Short-Term and Long-Term Preferences for Recommendations
by: Sabouri, Milad, et al.
Published: (2025)
by: Sabouri, Milad, et al.
Published: (2025)
Causal Direct Preference Optimization for Distributionally Robust Generative Recommendation
by: Zhao, Chu, et al.
Published: (2026)
by: Zhao, Chu, et al.
Published: (2026)
The Ranking Blind Spot: Decision Hijacking in LLM-based Text Ranking
by: Qian, Yaoyao, et al.
Published: (2025)
by: Qian, Yaoyao, et al.
Published: (2025)
Listwise Preference Alignment Optimization for Tail Item Recommendation
by: Li, Zihao, et al.
Published: (2025)
by: Li, Zihao, et al.
Published: (2025)
ICPO: Intrinsic Confidence-Driven Group Relative Preference Optimization for Efficient Reinforcement Learning
by: Wang, Jinpeng, et al.
Published: (2025)
by: Wang, Jinpeng, et al.
Published: (2025)
Precise Zero-Shot Pointwise Ranking with LLMs through Post-Aggregated Global Context Information
by: Long, Kehan, et al.
Published: (2025)
by: Long, Kehan, et al.
Published: (2025)
UniRank: End-to-End Domain-Specific Reranking of Hybrid Text-Image Candidates
by: Yang, Yupei, et al.
Published: (2026)
by: Yang, Yupei, et al.
Published: (2026)
Optimizing Generative Ranking Relevance via Reinforcement Learning in Xiaohongshu Search
by: Zeng, Ziyang, et al.
Published: (2025)
by: Zeng, Ziyang, et al.
Published: (2025)
Optimizing Keyphrase Ranking for Relevance and Diversity Using Submodular Function Optimization (SFO)
by: Umair, Muhammad, et al.
Published: (2024)
by: Umair, Muhammad, et al.
Published: (2024)
DenoiseRank: Learning to Rank by Diffusion Models
by: Wang, Ying, et al.
Published: (2026)
by: Wang, Ying, et al.
Published: (2026)
Optimizing LLMs with Direct Preferences: A Data Efficiency Perspective
by: Bernardelle, Pietro, et al.
Published: (2024)
by: Bernardelle, Pietro, et al.
Published: (2024)
Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
by: Huang, Hongtao, et al.
Published: (2025)
by: Huang, Hongtao, et al.
Published: (2025)
Action is All You Need: Dual-Flow Generative Ranking Network for Recommendation
by: Guo, Hao, et al.
Published: (2025)
by: Guo, Hao, et al.
Published: (2025)
SumRank: Aligning Summarization Models for Long-Document Listwise Reranking
by: Feng, Jincheng, et al.
Published: (2026)
by: Feng, Jincheng, et al.
Published: (2026)
SP-Rank: A Dataset for Ranked Preferences with Secondary Information
by: Hosseini, Hadi, et al.
Published: (2025)
by: Hosseini, Hadi, et al.
Published: (2025)
AgenticRec: End-to-End Tool-Integrated Policy Optimization for Ranking-Oriented Recommender Agents
by: Li, Tianyi, et al.
Published: (2026)
by: Li, Tianyi, et al.
Published: (2026)
ICICLE: Expanding Retrieval with In-Context Documents
by: Den, Yu-Chen, et al.
Published: (2026)
by: Den, Yu-Chen, et al.
Published: (2026)
Breaking the Hourglass Phenomenon of Residual Quantization: Enhancing the Upper Bound of Generative Retrieval
by: Kuai, Zhirui, et al.
Published: (2024)
by: Kuai, Zhirui, et al.
Published: (2024)
Preference Diffusion for Recommendation
by: Liu, Shuo, et al.
Published: (2024)
by: Liu, Shuo, et al.
Published: (2024)
Similar Items
-
ResRank: Unifying Retrieval and Listwise Reranking via End-to-End Joint Training with Residual Passage Compression
by: Ke, Xiaojie, et al.
Published: (2026) -
Contextual Dual Learning Algorithm with Listwise Distillation for Unbiased Learning to Rank
by: Yu, Lulu, et al.
Published: (2024) -
Rethinking the Necessity of Adaptive Retrieval-Augmented Generation through the Lens of Adaptive Listwise Ranking
by: Feng, Jun, et al.
Published: (2026) -
Holistic Utility Preference Learning for Listwise Alignment
by: Zhou, Jiacong, et al.
Published: (2024) -
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
by: Liu, Qi, et al.
Published: (2025)