Explanation Fairness in Large Language Models: An Empirical Analysis of Disparities in How LLMs Justify Decisions Across Demographic Groups
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Veldanda, Gautam |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective
par: Zhou, Yue, et autres
Publié: (2024)
par: Zhou, Yue, et autres
Publié: (2024)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
par: Veldanda, Akshaj Kumar, et autres
Publié: (2024)
par: Veldanda, Akshaj Kumar, et autres
Publié: (2024)
MArgE: Meshing Argumentative Evidence from Multiple Large Language Models for Justifiable Claim Verification
par: Ng, Ming Pok, et autres
Publié: (2025)
par: Ng, Ming Pok, et autres
Publié: (2025)
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
par: Xie, Qiujie, et autres
Publié: (2025)
par: Xie, Qiujie, et autres
Publié: (2025)
An Empirical Analysis on Large Language Models in Debate Evaluation
par: Liu, Xinyi, et autres
Publié: (2024)
par: Liu, Xinyi, et autres
Publié: (2024)
Empirical Analysis of Dialogue Relation Extraction with Large Language Models
par: Li, Guozheng, et autres
Publié: (2024)
par: Li, Guozheng, et autres
Publié: (2024)
The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs
par: Calderon, Nitay, et autres
Publié: (2025)
par: Calderon, Nitay, et autres
Publié: (2025)
Learning the Topic, Not the Language: How LLMs Classify Online Immigration Discourse Across Languages
par: Nasuto, Andrea, et autres
Publié: (2025)
par: Nasuto, Andrea, et autres
Publié: (2025)
AXOLOTL: Fairness through Assisted Self-Debiasing of Large Language Model Outputs
par: Ebrahimi, Sana, et autres
Publié: (2024)
par: Ebrahimi, Sana, et autres
Publié: (2024)
A Survey on Fairness in Large Language Models
par: Li, Yingji, et autres
Publié: (2023)
par: Li, Yingji, et autres
Publié: (2023)
Large Language Models for Predictive Analysis: How Far Are They?
par: Chen, Qin, et autres
Publié: (2025)
par: Chen, Qin, et autres
Publié: (2025)
Natural Language Counterfactual Explanations for Graphs Using Large Language Models
par: Giorgi, Flavio, et autres
Publié: (2024)
par: Giorgi, Flavio, et autres
Publié: (2024)
ELAD: Explanation-Guided Large Language Models Active Distillation
par: Zhang, Yifei, et autres
Publié: (2024)
par: Zhang, Yifei, et autres
Publié: (2024)
Test-Time Fairness and Robustness in Large Language Models
par: Cotta, Leonardo, et autres
Publié: (2024)
par: Cotta, Leonardo, et autres
Publié: (2024)
Fairness in Large Language Models: A Taxonomic Survey
par: Chu, Zhibo, et autres
Publié: (2024)
par: Chu, Zhibo, et autres
Publié: (2024)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
par: Song, Kefan, et autres
Publié: (2025)
par: Song, Kefan, et autres
Publié: (2025)
Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution
par: Khan, Falaah Arif, et autres
Publié: (2025)
par: Khan, Falaah Arif, et autres
Publié: (2025)
An Empirical Study on Prompt Compression for Large Language Models
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
Cross-Examiner: Evaluating Consistency of Large Language Model-Generated Explanations
par: Villa, Danielle, et autres
Publié: (2025)
par: Villa, Danielle, et autres
Publié: (2025)
Benchmarking Concept-Spilling Across Languages in LLMs
par: Badanin, Ilia, et autres
Publié: (2026)
par: Badanin, Ilia, et autres
Publié: (2026)
Cognitive LLMs: Towards Integrating Cognitive Architectures and Large Language Models for Manufacturing Decision-making
par: Wu, Siyu, et autres
Publié: (2024)
par: Wu, Siyu, et autres
Publié: (2024)
Disparities in LLM Reasoning Accuracy and Explanations: A Case Study on African American English
par: Zhou, Runtao, et autres
Publié: (2025)
par: Zhou, Runtao, et autres
Publié: (2025)
On Fairness of Unified Multimodal Large Language Model for Image Generation
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
Uncovering Hidden Violent Tendencies in LLMs: A Demographic Analysis via Behavioral Vignettes
par: Myers, Quintin, et autres
Publié: (2025)
par: Myers, Quintin, et autres
Publié: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
An Empirical Evaluation of Large Language Models on Consumer Health Questions
par: Abrar, Moaiz, et autres
Publié: (2024)
par: Abrar, Moaiz, et autres
Publié: (2024)
LANTERN: Scalable Distillation of Large Language Models for Job-Person Fit and Explanation
par: Fu, Zhoutong, et autres
Publié: (2025)
par: Fu, Zhoutong, et autres
Publié: (2025)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
par: Das, Rocktim Jyoti, et autres
Publié: (2023)
par: Das, Rocktim Jyoti, et autres
Publié: (2023)
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
par: Liu, Shuodi, et autres
Publié: (2025)
par: Liu, Shuodi, et autres
Publié: (2025)
Bridging Fairness and Explainability: Can Input-Based Explanations Promote Fairness in Hate Speech Detection?
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
STRUX: An LLM for Decision-Making with Structured Explanations
par: Lu, Yiming, et autres
Publié: (2024)
par: Lu, Yiming, et autres
Publié: (2024)
The Unequal Opportunities of Large Language Models: Revealing Demographic Bias through Job Recommendations
par: Salinas, Abel, et autres
Publié: (2023)
par: Salinas, Abel, et autres
Publié: (2023)
Explanations of Large Language Models Explain Language Representations in the Brain
par: Rahimi, Maryam, et autres
Publié: (2025)
par: Rahimi, Maryam, et autres
Publié: (2025)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
par: Jung, Dahyun, et autres
Publié: (2025)
par: Jung, Dahyun, et autres
Publié: (2025)
Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages
par: Tamang, S., et autres
Publié: (2024)
par: Tamang, S., et autres
Publié: (2024)
Local Explanations and Self-Explanations for Assessing Faithfulness in black-box LLMs
par: Fragkathoulas, Christos, et autres
Publié: (2024)
par: Fragkathoulas, Christos, et autres
Publié: (2024)
Can LLM-Generated Textual Explanations Enhance Model Classification Performance? An Empirical Study
par: Dhaini, Mahdi, et autres
Publié: (2025)
par: Dhaini, Mahdi, et autres
Publié: (2025)
Evaluating Large Language Models for Abstract Evaluation Tasks: An Empirical Study
par: Liu, Yinuo, et autres
Publié: (2026)
par: Liu, Yinuo, et autres
Publié: (2026)
Assessing Large Language Models for Online Extremism Research: Identification, Explanation, and New Knowledge
par: Dong, Beidi, et autres
Publié: (2024)
par: Dong, Beidi, et autres
Publié: (2024)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
par: Yang, Xinqi, et autres
Publié: (2024)
par: Yang, Xinqi, et autres
Publié: (2024)
Documents similaires
-
Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective
par: Zhou, Yue, et autres
Publié: (2024) -
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
par: Veldanda, Akshaj Kumar, et autres
Publié: (2024) -
MArgE: Meshing Argumentative Evidence from Multiple Large Language Models for Justifiable Claim Verification
par: Ng, Ming Pok, et autres
Publié: (2025) -
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
par: Xie, Qiujie, et autres
Publié: (2025) -
An Empirical Analysis on Large Language Models in Debate Evaluation
par: Liu, Xinyi, et autres
Publié: (2024)