Optimizing Generative Ranking Relevance via Reinforcement Learning in Xiaohongshu Search
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Ziyang, Jing, Heming, Chen, Jindong, Li, Xiangli, Liu, Hongyu, He, Yixuan, Li, Zhengyu, Sun, Yige, Xie, Zheyong, Yang, Yuqing, Cao, Shaosheng, Fan, Jun, Wu, Yi, Hu, Yao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QP-OneModel: A Unified Generative LLM for Multi-Task Query Understanding in Xiaohongshu Search
par: Huang, Jianzhao, et autres
Publié: (2026)
par: Huang, Jianzhao, et autres
Publié: (2026)
A Zero-shot Explainable Doctor Ranking Framework with Large Language Models
par: Zeng, Ziyang, et autres
Publié: (2025)
par: Zeng, Ziyang, et autres
Publié: (2025)
IDProxy: Cold-Start CTR Prediction for Ads and Recommendation at Xiaohongshu with Multimodal LLMs
par: Zhang, Yubin, et autres
Publié: (2026)
par: Zhang, Yubin, et autres
Publié: (2026)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
par: Li, Yupeng, et autres
Publié: (2026)
par: Li, Yupeng, et autres
Publié: (2026)
An automatic patent literature retrieval system based on LLM-RAG
par: Ding, Yao, et autres
Publié: (2025)
par: Ding, Yao, et autres
Publié: (2025)
MERIT: A Merchant Incentive Ranking Model for Hotel Search & Ranking
par: Quan, Shigang, et autres
Publié: (2025)
par: Quan, Shigang, et autres
Publié: (2025)
An Empirical Study of Position Bias in Modern Information Retrieval
par: Zeng, Ziyang, et autres
Publié: (2025)
par: Zeng, Ziyang, et autres
Publié: (2025)
Towards More Relevant Product Search Ranking Via Large Language Models: An Empirical Study
par: Liu, Qi, et autres
Publié: (2024)
par: Liu, Qi, et autres
Publié: (2024)
GoalRank: Group-Relative Optimization for a Large Ranking Model
par: Zhang, Kaike, et autres
Publié: (2025)
par: Zhang, Kaike, et autres
Publié: (2025)
Optimizing Keyphrase Ranking for Relevance and Diversity Using Submodular Function Optimization (SFO)
par: Umair, Muhammad, et autres
Publié: (2024)
par: Umair, Muhammad, et autres
Publié: (2024)
R3A: Reinforced Reasoning for Relevance Assessment for RAG in User-Generated Content Platforms
par: Yuan, Xiaowei, et autres
Publié: (2025)
par: Yuan, Xiaowei, et autres
Publié: (2025)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
par: Zeng, Hansi, et autres
Publié: (2026)
par: Zeng, Hansi, et autres
Publié: (2026)
Middleman Bias in Advertising: Aligning Relevance of Keyphrase Recommendations with Search
par: Dey, Soumik, et autres
Publié: (2025)
par: Dey, Soumik, et autres
Publié: (2025)
Joint Optimization of Relevance and Engagement in Multi-Task Ranking for E-Commerce with Efficient LLM Supervision
par: Chen, Luming, et autres
Publié: (2026)
par: Chen, Luming, et autres
Publié: (2026)
Are LLMs Reliable Rankers? Rank Manipulation via Two-Stage Token Optimization
par: Xing, Tiancheng, et autres
Publié: (2025)
par: Xing, Tiancheng, et autres
Publié: (2025)
HCMRM: A High-Consistency Multimodal Relevance Model for Search Ads
par: Gan, Guobing, et autres
Publié: (2025)
par: Gan, Guobing, et autres
Publié: (2025)
Hashtag Re-Appropriation for Audience Control on Recommendation-Driven Social Media Xiaohongshu (rednote)
par: Wan, Ruyuan, et autres
Publié: (2025)
par: Wan, Ruyuan, et autres
Publié: (2025)
Scaling Search Relevance: Augmenting App Store Ranking with LLM-Generated Judgments
par: Christakopoulou, Evangelia, et autres
Publié: (2026)
par: Christakopoulou, Evangelia, et autres
Publié: (2026)
Mine and Refine: Optimizing Graded Relevance in E-commerce Search Retrieval
par: Xi, Jiaqi, et autres
Publié: (2026)
par: Xi, Jiaqi, et autres
Publié: (2026)
Batched Self-Consistency Improves LLM Relevance Assessment and Ranking
par: Korikov, Anton, et autres
Publié: (2025)
par: Korikov, Anton, et autres
Publié: (2025)
Migrating a Job Search Relevance Function
par: Mountain, Bennett, et autres
Publié: (2025)
par: Mountain, Bennett, et autres
Publié: (2025)
TaoSR-AGRL: Adaptive Guided Reinforcement Learning Framework for E-commerce Search Relevance
par: Yang, Jianhui, et autres
Publié: (2025)
par: Yang, Jianhui, et autres
Publié: (2025)
STORE: Semantic Tokenization, Orthogonal Rotation and Efficient Attention for Scaling Up Ranking Models
par: Xu, Yi, et autres
Publié: (2025)
par: Xu, Yi, et autres
Publié: (2025)
Learning to Trust: Dynamic Utilization of Retrieval-Augmented Generation for E-commerce Search Relevance
par: Xu, Tingqiao, et autres
Publié: (2025)
par: Xu, Tingqiao, et autres
Publié: (2025)
REALM: Recursive Relevance Modeling for LLM-based Document Re-Ranking
par: Wang, Pinhuan, et autres
Publié: (2025)
par: Wang, Pinhuan, et autres
Publié: (2025)
OrdRankBen: A Novel Ranking Benchmark for Ordinal Relevance in NLP
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
A Topology-Aware Positive Sample Set Construction and Feature Optimization Method in Implicit Collaborative Filtering
par: Wu, Jiayi, et autres
Publié: (2026)
par: Wu, Jiayi, et autres
Publié: (2026)
Jasper and Stella: distillation of SOTA embedding models
par: Zhang, Dun, et autres
Publié: (2024)
par: Zhang, Dun, et autres
Publié: (2024)
DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search
par: Li, Zhanli, et autres
Publié: (2026)
par: Li, Zhanli, et autres
Publié: (2026)
Consolidating Ranking and Relevance Predictions of Large Language Models through Post-Processing
par: Yan, Le, et autres
Publié: (2024)
par: Yan, Le, et autres
Publié: (2024)
ProRank: Prompt Warmup via Reinforcement Learning for Small Language Models Reranking
par: Li, Xianming, et autres
Publié: (2025)
par: Li, Xianming, et autres
Publié: (2025)
When Relevance Meets Novelty: Dual-Stable Periodic Optimization for Serendipitous Recommendation
par: Lin, Hongxiang, et autres
Publié: (2025)
par: Lin, Hongxiang, et autres
Publié: (2025)
Validating LLM-Generated Relevance Labels for Educational Resource Search
par: Sebastian, Ratan J., et autres
Publié: (2025)
par: Sebastian, Ratan J., et autres
Publié: (2025)
A Unified Search and Recommendation Framework Based on Multi-Scenario Learning for Ranking in E-commerce
par: Liu, Jinhan, et autres
Publié: (2024)
par: Liu, Jinhan, et autres
Publié: (2024)
PRECTR: A Synergistic Framework for Integrating Personalized Search Relevance Matching and CTR Prediction
par: Chen, Rong, et autres
Publié: (2025)
par: Chen, Rong, et autres
Publié: (2025)
Unified Supervision for Walmart's Sponsored Search Retrieval via Joint Semantic Relevance and Behavioral Engagement Modeling
par: Desai, Shasvat, et autres
Publié: (2026)
par: Desai, Shasvat, et autres
Publié: (2026)
SPFresh: Incremental In-Place Update for Billion-Scale Vector Search
par: Xu, Yuming, et autres
Publié: (2024)
par: Xu, Yuming, et autres
Publié: (2024)
Optimizing E-commerce Search: Toward a Generalizable and Rank-Consistent Pre-Ranking Model
par: Xu, Enqiang, et autres
Publié: (2024)
par: Xu, Enqiang, et autres
Publié: (2024)
RankGR: Rank-Enhanced Generative Retrieval with Listwise Direct Preference Optimization in Recommendation
par: Fu, Kairui, et autres
Publié: (2026)
par: Fu, Kairui, et autres
Publié: (2026)
Agentic Conversational Search with Contextualized Reasoning via Reinforcement Learning
par: Mo, Fengran, et autres
Publié: (2026)
par: Mo, Fengran, et autres
Publié: (2026)
Documents similaires
-
QP-OneModel: A Unified Generative LLM for Multi-Task Query Understanding in Xiaohongshu Search
par: Huang, Jianzhao, et autres
Publié: (2026) -
A Zero-shot Explainable Doctor Ranking Framework with Large Language Models
par: Zeng, Ziyang, et autres
Publié: (2025) -
IDProxy: Cold-Start CTR Prediction for Ads and Recommendation at Xiaohongshu with Multimodal LLMs
par: Zhang, Yubin, et autres
Publié: (2026) -
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
par: Li, Yupeng, et autres
Publié: (2026) -
An automatic patent literature retrieval system based on LLM-RAG
par: Ding, Yao, et autres
Publié: (2025)