Do Large Language Models Rank Fairly? An Empirical Study on the Fairness of LLMs as Rankers
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Yuan, Wu, Xuyang, Wu, Hsin-Tai, Tao, Zhiqiang, Fang, Yi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Passage-specific Prompt Tuning for Passage Reranking in Question Answering with Large Language Models
by: Wu, Xuyang, et al.
Published: (2024)
by: Wu, Xuyang, et al.
Published: (2024)
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
by: Qin, Zhen, et al.
Published: (2023)
by: Qin, Zhen, et al.
Published: (2023)
Evaluating Fairness in Large Vision-Language Models Across Diverse Demographic Attributes and Prompts
by: Wu, Xuyang, et al.
Published: (2024)
by: Wu, Xuyang, et al.
Published: (2024)
Towards Fair Rankings: Leveraging LLMs for Gender Bias Detection and Measurement
by: Mousavian, Maryam, et al.
Published: (2025)
by: Mousavian, Maryam, et al.
Published: (2025)
Large Language Models are Zero-Shot Rankers for Recommender Systems
by: Hou, Yupeng, et al.
Published: (2023)
by: Hou, Yupeng, et al.
Published: (2023)
RaCT: Ranking-aware Chain-of-Thought Optimization for LLMs
by: Liu, Haowei, et al.
Published: (2024)
by: Liu, Haowei, et al.
Published: (2024)
Soft Prompt Tuning for Augmenting Dense Retrieval with Large Language Models
by: Peng, Zhiyuan, et al.
Published: (2023)
by: Peng, Zhiyuan, et al.
Published: (2023)
Attention in Large Language Models Yields Efficient Zero-Shot Re-Rankers
by: Chen, Shijie, et al.
Published: (2024)
by: Chen, Shijie, et al.
Published: (2024)
Does RAG Introduce Unfairness in LLMs? Evaluating Fairness in Retrieval-Augmented Generation Systems
by: Wu, Xuyang, et al.
Published: (2024)
by: Wu, Xuyang, et al.
Published: (2024)
Make Large Language Model a Better Ranker
by: Chao, Wen-Shuo, et al.
Published: (2024)
by: Chao, Wen-Shuo, et al.
Published: (2024)
Are LLMs Reliable Rankers? Rank Manipulation via Two-Stage Token Optimization
by: Xing, Tiancheng, et al.
Published: (2025)
by: Xing, Tiancheng, et al.
Published: (2025)
Generative Pseudo-Labeling for Pre-Ranking with LLMs
by: Bi, Junyu, et al.
Published: (2026)
by: Bi, Junyu, et al.
Published: (2026)
Towards Fair RAG: On the Impact of Fair Ranking in Retrieval-Augmented Generation
by: Kim, To Eun, et al.
Published: (2024)
by: Kim, To Eun, et al.
Published: (2024)
No Free Lunch: Retrieval-Augmented Generation Undermines Fairness in LLMs, Even for Vigilant Users
by: Hu, Mengxuan, et al.
Published: (2024)
by: Hu, Mengxuan, et al.
Published: (2024)
Q-PEFT: Query-dependent Parameter Efficient Fine-tuning for Text Reranking with Large Language Models
by: Peng, Zhiyuan, et al.
Published: (2024)
by: Peng, Zhiyuan, et al.
Published: (2024)
Language Fairness in Multilingual Information Retrieval
by: Yang, Eugene, et al.
Published: (2024)
by: Yang, Eugene, et al.
Published: (2024)
Can Large Language Models Detect Rumors on Social Media?
by: Liu, Qiang, et al.
Published: (2024)
by: Liu, Qiang, et al.
Published: (2024)
Do We Need Domain-Specific Embedding Models? An Empirical Investigation
by: Tang, Yixuan, et al.
Published: (2024)
by: Tang, Yixuan, et al.
Published: (2024)
TourRank: Utilizing Large Language Models for Documents Ranking with a Tournament-Inspired Strategy
by: Chen, Yiqun, et al.
Published: (2024)
by: Chen, Yiqun, et al.
Published: (2024)
An Investigation of Prompt Variations for Zero-shot LLM-based Rankers
by: Sun, Shuoqi, et al.
Published: (2024)
by: Sun, Shuoqi, et al.
Published: (2024)
DemoRank: Selecting Effective Demonstrations for Large Language Models in Ranking Task
by: Liu, Wenhan, et al.
Published: (2024)
by: Liu, Wenhan, et al.
Published: (2024)
Text2Cypher Across Languages: Evaluating and Finetuning LLMs
by: Ozsoy, Makbule Gulcin, et al.
Published: (2025)
by: Ozsoy, Makbule Gulcin, et al.
Published: (2025)
ExaRanker-Open: Synthetic Explanation for IR using Open-Source LLMs
by: Ferraretto, Fernando, et al.
Published: (2024)
by: Ferraretto, Fernando, et al.
Published: (2024)
Rankers, Judges, and Assistants: Towards Understanding the Interplay of LLMs in Information Retrieval Evaluation
by: Balog, Krisztian, et al.
Published: (2025)
by: Balog, Krisztian, et al.
Published: (2025)
Re-Ranking Step by Step: Investigating Pre-Filtering for Re-Ranking with Large Language Models
by: Nouriinanloo, Baharan, et al.
Published: (2024)
by: Nouriinanloo, Baharan, et al.
Published: (2024)
Collaborative Cross-modal Fusion with Large Language Model for Recommendation
by: Liu, Zhongzhou, et al.
Published: (2024)
by: Liu, Zhongzhou, et al.
Published: (2024)
ListConRanker: A Contrastive Text Reranker with Listwise Encoding
by: Liu, Junlong, et al.
Published: (2025)
by: Liu, Junlong, et al.
Published: (2025)
Why Multi-Interest Fairness Matters: Hypergraph Contrastive Multi-Interest Learning for Fair Conversational Recommender System
by: Zheng, Yongsen, et al.
Published: (2025)
by: Zheng, Yongsen, et al.
Published: (2025)
Multi-Layer Ranking with Large Language Models for News Source Recommendation
by: Zhang, Wenjia, et al.
Published: (2024)
by: Zhang, Wenjia, et al.
Published: (2024)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
by: Liu, Wenhan, et al.
Published: (2024)
by: Liu, Wenhan, et al.
Published: (2024)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
by: Sun, Weiwei, et al.
Published: (2023)
by: Sun, Weiwei, et al.
Published: (2023)
Understanding Fairness-Accuracy Trade-offs in Machine Learning Models: Does Promoting Fairness Undermine Performance?
by: Liu, Junhua, et al.
Published: (2024)
by: Liu, Junhua, et al.
Published: (2024)
CoRanking: Collaborative Ranking with Small and Large Ranking Agents
by: Liu, Wenhan, et al.
Published: (2025)
by: Liu, Wenhan, et al.
Published: (2025)
Stairway to Fairness: Connecting Group and Individual Fairness
by: Rampisela, Theresia Veronika, et al.
Published: (2025)
by: Rampisela, Theresia Veronika, et al.
Published: (2025)
DUQGen: Effective Unsupervised Domain Adaptation of Neural Rankers by Diversifying Synthetic Query Generation
by: Chandradevan, Ramraj, et al.
Published: (2024)
by: Chandradevan, Ramraj, et al.
Published: (2024)
Best Practices for Distilling Large Language Models into BERT for Web Search Ranking
by: Ye, Dezhi, et al.
Published: (2024)
by: Ye, Dezhi, et al.
Published: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
A Comprehensive Evaluation of Large Language Models on Temporal Event Forecasting
by: Chang, He, et al.
Published: (2024)
by: Chang, He, et al.
Published: (2024)
FairSort: Learning to Fair Rank for Personalized Recommendations in Two-Sided Platforms
by: Wu, Guoli, et al.
Published: (2024)
by: Wu, Guoli, et al.
Published: (2024)
Mitigating the Threshold Priming Effect in Large Language Model-Based Relevance Judgments via Personality Infusing
by: Chen, Nuo, et al.
Published: (2025)
by: Chen, Nuo, et al.
Published: (2025)
Similar Items
-
Passage-specific Prompt Tuning for Passage Reranking in Question Answering with Large Language Models
by: Wu, Xuyang, et al.
Published: (2024) -
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
by: Qin, Zhen, et al.
Published: (2023) -
Evaluating Fairness in Large Vision-Language Models Across Diverse Demographic Attributes and Prompts
by: Wu, Xuyang, et al.
Published: (2024) -
Towards Fair Rankings: Leveraging LLMs for Gender Bias Detection and Measurement
by: Mousavian, Maryam, et al.
Published: (2025) -
Large Language Models are Zero-Shot Rankers for Recommender Systems
by: Hou, Yupeng, et al.
Published: (2023)