Towards Fair Rankings: Leveraging LLMs for Gender Bias Detection and Measurement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mousavian, Maryam, Abbasiantaeb, Zahra, Aliannejadi, Mohammad, Crestani, Fabio |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IRLab@iKAT24: Learned Sparse Retrieval with Multi-aspect LLM Query Generation for Conversational Search
par: Lupart, Simon, et autres
Publié: (2024)
par: Lupart, Simon, et autres
Publié: (2024)
Can We Use Large Language Models to Fill Relevance Judgment Holes?
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
TREC iKAT 2023: A Test Collection for Evaluating Conversational and Interactive Knowledge Assistants
par: Aliannejadi, Mohammad, et autres
Publié: (2024)
par: Aliannejadi, Mohammad, et autres
Publié: (2024)
TREC iKAT 2023: The Interactive Knowledge Assistance Track Overview
par: Aliannejadi, Mohammad, et autres
Publié: (2024)
par: Aliannejadi, Mohammad, et autres
Publié: (2024)
Do Images Clarify? A Study on the Effect of Images on Clarifying Questions in Conversational Search
par: Siro, Clemencia, et autres
Publié: (2026)
par: Siro, Clemencia, et autres
Publié: (2026)
Generating Multi-Aspect Queries for Conversational Search
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
Improving the Reusability of Conversational Search Test Collections
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
Towards Self-Contained Answers: Entity-Based Answer Rewriting in Conversational Search
par: Sekulić, Ivan, et autres
Publié: (2024)
par: Sekulić, Ivan, et autres
Publié: (2024)
Rethinking the Evaluation of Dialogue Systems: Effects of User Feedback on Crowdworkers and LLMs
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
Conversational Gold: Evaluating Personalized Conversational Search System using Gold Nuggets
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
Zero-Shot and Efficient Clarification Need Prediction in Conversational Search
par: Lu, Lili, et autres
Publié: (2025)
par: Lu, Lili, et autres
Publié: (2025)
Analyzing Coherency in Facet-based Clarification Prompt Generation for Search
par: Litvinov, Oleg, et autres
Publié: (2024)
par: Litvinov, Oleg, et autres
Publié: (2024)
ChatR1: Reinforcement Learning for Conversational Reasoning and Retrieval Augmented Question Answering
par: Lupart, Simon, et autres
Publié: (2025)
par: Lupart, Simon, et autres
Publié: (2025)
DiSCo: LLM Knowledge Distillation for Efficient Sparse Retrieval in Conversational Search
par: Lupart, Simon, et autres
Publié: (2024)
par: Lupart, Simon, et autres
Publié: (2024)
Total Recall QA: A Verifiable Evaluation Suite for Deep Research Agents
par: Rafiee, Mahta, et autres
Publié: (2026)
par: Rafiee, Mahta, et autres
Publié: (2026)
Do Large Language Models Rank Fairly? An Empirical Study on the Fairness of LLMs as Rankers
par: Wang, Yuan, et autres
Publié: (2024)
par: Wang, Yuan, et autres
Publié: (2024)
Estimating the Usefulness of Clarifying Questions and Answers for Conversational Search
par: Sekulić, Ivan, et autres
Publié: (2024)
par: Sekulić, Ivan, et autres
Publié: (2024)
AGENT-CQ: Automatic Generation and Evaluation of Clarifying Questions for Conversational Search with LLMs
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
Towards Fine-Grained Citation Evaluation in Generated Text: A Comparative Analysis of Faithfulness Metrics
par: Zhang, Weijia, et autres
Publié: (2024)
par: Zhang, Weijia, et autres
Publié: (2024)
Conversational Search: From Fundamentals to Frontiers in the LLM Era
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
Hypencoder Revisited: Reproducibility and Analysis of Non-Linear Scoring for First-Stage Retrieval
par: Eichholtz, Arne, et autres
Publié: (2026)
par: Eichholtz, Arne, et autres
Publié: (2026)
Towards Fair RAG: On the Impact of Fair Ranking in Retrieval-Augmented Generation
par: Kim, To Eun, et autres
Publié: (2024)
par: Kim, To Eun, et autres
Publié: (2024)
Context Does Matter: Implications for Crowdsourced Evaluation Labels in Task-Oriented Dialogue Systems
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
Investigating LLM Variability in Personalized Conversational Information Retrieval
par: Lupart, Simon, et autres
Publié: (2025)
par: Lupart, Simon, et autres
Publié: (2025)
A Comparative Analysis of Faithfulness Metrics and Humans in Citation Evaluation
par: Zhang, Weijia, et autres
Publié: (2024)
par: Zhang, Weijia, et autres
Publié: (2024)
Positional Bias in Long-Document Ranking: Impact, Assessment, and Mitigation
par: Boytsov, Leonid, et autres
Publié: (2022)
par: Boytsov, Leonid, et autres
Publié: (2022)
Controlling Gender Bias in Retrieval via a Backpack Architecture
par: Afzali, Amirabbas, et autres
Publié: (2025)
par: Afzali, Amirabbas, et autres
Publié: (2025)
LTRR: Learning To Rank Retrievers for LLMs
par: Kim, To Eun, et autres
Publié: (2025)
par: Kim, To Eun, et autres
Publié: (2025)
Ranked List Truncation for Large Language Model-based Re-Ranking
par: Meng, Chuan, et autres
Publié: (2024)
par: Meng, Chuan, et autres
Publié: (2024)
Evaluating LLMs for Gender Disparities in Notable Persons
par: Rhue, Lauren, et autres
Publié: (2024)
par: Rhue, Lauren, et autres
Publié: (2024)
Generative Pseudo-Labeling for Pre-Ranking with LLMs
par: Bi, Junyu, et autres
Publié: (2026)
par: Bi, Junyu, et autres
Publié: (2026)
Improving Stance Detection by Leveraging Measurement Knowledge from Social Sciences: A Case Study of Dutch Political Tweets and Traditional Gender Role Division
par: Fang, Qixiang, et autres
Publié: (2022)
par: Fang, Qixiang, et autres
Publié: (2022)
Measuring and Addressing Indexical Bias in Information Retrieval
par: Ziems, Caleb, et autres
Publié: (2024)
par: Ziems, Caleb, et autres
Publié: (2024)
Prompt-Based LLMs for Position Bias-Aware Reranking in Personalized Recommendations
par: Islam, Md Aminul, et autres
Publié: (2025)
par: Islam, Md Aminul, et autres
Publié: (2025)
No Free Lunch: Retrieval-Augmented Generation Undermines Fairness in LLMs, Even for Vigilant Users
par: Hu, Mengxuan, et autres
Publié: (2024)
par: Hu, Mengxuan, et autres
Publié: (2024)
Unveiling the Hidden: Movie Genre and User Bias in Spoiler Detection
par: Zhang, Haokai, et autres
Publié: (2025)
par: Zhang, Haokai, et autres
Publié: (2025)
CoRanking: Collaborative Ranking with Small and Large Ranking Agents
par: Liu, Wenhan, et autres
Publié: (2025)
par: Liu, Wenhan, et autres
Publié: (2025)
Bias-Aware Agent: Enhancing Fairness in AI-Driven Knowledge Retrieval
par: Singh, Karanbir, et autres
Publié: (2025)
par: Singh, Karanbir, et autres
Publié: (2025)
RankRAG: Unifying Context Ranking with Retrieval-Augmented Generation in LLMs
par: Yu, Yue, et autres
Publié: (2024)
par: Yu, Yue, et autres
Publié: (2024)
DistRAG: Towards Distance-Based Spatial Reasoning in LLMs
par: Schneider, Nicole R, et autres
Publié: (2025)
par: Schneider, Nicole R, et autres
Publié: (2025)
Documents similaires
-
IRLab@iKAT24: Learned Sparse Retrieval with Multi-aspect LLM Query Generation for Conversational Search
par: Lupart, Simon, et autres
Publié: (2024) -
Can We Use Large Language Models to Fill Relevance Judgment Holes?
par: Abbasiantaeb, Zahra, et autres
Publié: (2024) -
TREC iKAT 2023: A Test Collection for Evaluating Conversational and Interactive Knowledge Assistants
par: Aliannejadi, Mohammad, et autres
Publié: (2024) -
TREC iKAT 2023: The Interactive Knowledge Assistance Track Overview
par: Aliannejadi, Mohammad, et autres
Publié: (2024) -
Do Images Clarify? A Study on the Effect of Images on Clarifying Questions in Conversational Search
par: Siro, Clemencia, et autres
Publié: (2026)