Reinforcement Learning to Rank Using Coarse-grained Rewards
Fuente:
arXiv
Salvato in:
| Autori principali: | Tu, Yiteng, Xu, Zhichao, Yang, Tao, Su, Weihang, Zhou, Yujia, Liu, Yiqun, Lin, Fen, Liu, Qin, Ai, Qingyao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalized Pseudo-Relevance Feedback
di: Tu, Yiteng, et al.
Pubblicazione: (2025)
di: Tu, Yiteng, et al.
Pubblicazione: (2025)
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
di: Tu, Yiteng, et al.
Pubblicazione: (2025)
di: Tu, Yiteng, et al.
Pubblicazione: (2025)
Equity vs. Equality: Optimizing Ranking Fairness for Tailored Provider Needs
di: Tu, Yiteng, et al.
Pubblicazione: (2026)
di: Tu, Yiteng, et al.
Pubblicazione: (2026)
Analytical Search
di: Tu, Yiteng, et al.
Pubblicazione: (2026)
di: Tu, Yiteng, et al.
Pubblicazione: (2026)
Beyond Exposure: Optimizing Ranking Fairness with Non-linear Time-Income Functions
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
PRE: A Peer Review Based Large Language Model Evaluator
di: Chu, Zhumin, et al.
Pubblicazione: (2024)
di: Chu, Zhumin, et al.
Pubblicazione: (2024)
Multi-Field Tool Retrieval
di: Tang, Yichen, et al.
Pubblicazione: (2026)
di: Tang, Yichen, et al.
Pubblicazione: (2026)
Unsupervised dense retrieval with conterfactual contrastive learning
di: Chen, Haitian, et al.
Pubblicazione: (2024)
di: Chen, Haitian, et al.
Pubblicazione: (2024)
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Dynamic and Parametric Retrieval-Augmented Generation
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
di: Su, Weihang, et al.
Pubblicazione: (2026)
di: Su, Weihang, et al.
Pubblicazione: (2026)
Mitigating Entity-Level Hallucination in Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
MemoryBench: A Benchmark for Memory and Continual Learning in LLM Systems
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
Parametric Retrieval Augmented Generation
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
Caseformer: Pre-training for Legal Case Retrieval Based on Inter-Case Distinctions
di: Su, Weihang, et al.
Pubblicazione: (2023)
di: Su, Weihang, et al.
Pubblicazione: (2023)
Wikiformer: Pre-training with Structured Information of Wikipedia for Ad-hoc Retrieval
di: Su, Weihang, et al.
Pubblicazione: (2023)
di: Su, Weihang, et al.
Pubblicazione: (2023)
Scaling Laws For Dense Retrieval
di: Fang, Yan, et al.
Pubblicazione: (2024)
di: Fang, Yan, et al.
Pubblicazione: (2024)
Foundations of GenIR
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
An In-depth Investigation of User Response Simulation for Conversational Search
di: Wang, Zhenduo, et al.
Pubblicazione: (2023)
di: Wang, Zhenduo, et al.
Pubblicazione: (2023)
STARD: A Chinese Statute Retrieval Dataset with Real Queries Issued by Non-professionals
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
SurGE: A Benchmark and Evaluation Framework for Scientific Survey Generation
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
CrossPT-EEG: A Benchmark for Cross-Participant and Cross-Time Generalization of EEG-based Visual Decoding
di: Zhu, Shuqi, et al.
Pubblicazione: (2024)
di: Zhu, Shuqi, et al.
Pubblicazione: (2024)
Counterfactual Editing for Search Result Explanation
di: Xu, Zhichao, et al.
Pubblicazione: (2023)
di: Xu, Zhichao, et al.
Pubblicazione: (2023)
Improving Legal Case Retrieval with Brain Signals
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
Towards an In-Depth Comprehension of Case Relevance for Better Legal Retrieval
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
JuDGE: Benchmarking Judgment Document Generation for Chinese Legal System
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
Common Sense Enhanced Knowledge-based Recommendation with Large Language Model
di: Yang, Shenghao, et al.
Pubblicazione: (2024)
di: Yang, Shenghao, et al.
Pubblicazione: (2024)
Sequential Recommendation with Latent Relations based on Large Language Model
di: Yang, Shenghao, et al.
Pubblicazione: (2024)
di: Yang, Shenghao, et al.
Pubblicazione: (2024)
EEG-SVRec: An EEG Dataset with User Multidimensional Affective Engagement Labels in Short Video Recommendation
di: Zhang, Shaorun, et al.
Pubblicazione: (2024)
di: Zhang, Shaorun, et al.
Pubblicazione: (2024)
I^3 Retriever: Incorporating Implicit Interaction in Pre-trained Language Models for Passage Retrieval
di: Dong, Qian, et al.
Pubblicazione: (2023)
di: Dong, Qian, et al.
Pubblicazione: (2023)
Towards Better Understanding of User Satisfaction in Open-Domain Conversational Search
di: Chu, Zhumin, et al.
Pubblicazione: (2022)
di: Chu, Zhumin, et al.
Pubblicazione: (2022)
RankMamba: Benchmarking Mamba's Document Ranking Performance in the Era of Transformers
di: Xu, Zhichao
Pubblicazione: (2024)
di: Xu, Zhichao
Pubblicazione: (2024)
Unsupervised Large Language Model Alignment for Information Retrieval via Contrastive Feedback
di: Dong, Qian, et al.
Pubblicazione: (2023)
di: Dong, Qian, et al.
Pubblicazione: (2023)
Gender Biased Legal Case Retrieval System on Users' Decision Process
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
Multi-Source Retrieval and Reasoning for Legal Sentencing Prediction
di: Chen, Junjie, et al.
Pubblicazione: (2026)
di: Chen, Junjie, et al.
Pubblicazione: (2026)
Improving GenIR Systems Based on User Feedback
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
di: Ai, Qingyao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generalized Pseudo-Relevance Feedback
di: Tu, Yiteng, et al.
Pubblicazione: (2025) -
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
di: Tu, Yiteng, et al.
Pubblicazione: (2025) -
Equity vs. Equality: Optimizing Ranking Fairness for Tailored Provider Needs
di: Tu, Yiteng, et al.
Pubblicazione: (2026) -
Analytical Search
di: Tu, Yiteng, et al.
Pubblicazione: (2026) -
Beyond Exposure: Optimizing Ranking Fairness with Non-linear Time-Income Functions
di: Li, Xuancheng, et al.
Pubblicazione: (2026)