Explanation Fairness in Large Language Models: An Empirical Analysis of Disparities in How LLMs Justify Decisions Across Demographic Groups
Fuente:
arXiv
Guardado en:
| Autor principal: | Veldanda, Gautam |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
MArgE: Meshing Argumentative Evidence from Multiple Large Language Models for Justifiable Claim Verification
por: Ng, Ming Pok, et al.
Publicado: (2025)
por: Ng, Ming Pok, et al.
Publicado: (2025)
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
por: Xie, Qiujie, et al.
Publicado: (2025)
por: Xie, Qiujie, et al.
Publicado: (2025)
An Empirical Analysis on Large Language Models in Debate Evaluation
por: Liu, Xinyi, et al.
Publicado: (2024)
por: Liu, Xinyi, et al.
Publicado: (2024)
Empirical Analysis of Dialogue Relation Extraction with Large Language Models
por: Li, Guozheng, et al.
Publicado: (2024)
por: Li, Guozheng, et al.
Publicado: (2024)
The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs
por: Calderon, Nitay, et al.
Publicado: (2025)
por: Calderon, Nitay, et al.
Publicado: (2025)
Learning the Topic, Not the Language: How LLMs Classify Online Immigration Discourse Across Languages
por: Nasuto, Andrea, et al.
Publicado: (2025)
por: Nasuto, Andrea, et al.
Publicado: (2025)
AXOLOTL: Fairness through Assisted Self-Debiasing of Large Language Model Outputs
por: Ebrahimi, Sana, et al.
Publicado: (2024)
por: Ebrahimi, Sana, et al.
Publicado: (2024)
A Survey on Fairness in Large Language Models
por: Li, Yingji, et al.
Publicado: (2023)
por: Li, Yingji, et al.
Publicado: (2023)
Large Language Models for Predictive Analysis: How Far Are They?
por: Chen, Qin, et al.
Publicado: (2025)
por: Chen, Qin, et al.
Publicado: (2025)
Natural Language Counterfactual Explanations for Graphs Using Large Language Models
por: Giorgi, Flavio, et al.
Publicado: (2024)
por: Giorgi, Flavio, et al.
Publicado: (2024)
ELAD: Explanation-Guided Large Language Models Active Distillation
por: Zhang, Yifei, et al.
Publicado: (2024)
por: Zhang, Yifei, et al.
Publicado: (2024)
Test-Time Fairness and Robustness in Large Language Models
por: Cotta, Leonardo, et al.
Publicado: (2024)
por: Cotta, Leonardo, et al.
Publicado: (2024)
Fairness in Large Language Models: A Taxonomic Survey
por: Chu, Zhibo, et al.
Publicado: (2024)
por: Chu, Zhibo, et al.
Publicado: (2024)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
por: Song, Kefan, et al.
Publicado: (2025)
por: Song, Kefan, et al.
Publicado: (2025)
Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution
por: Khan, Falaah Arif, et al.
Publicado: (2025)
por: Khan, Falaah Arif, et al.
Publicado: (2025)
An Empirical Study on Prompt Compression for Large Language Models
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
Cross-Examiner: Evaluating Consistency of Large Language Model-Generated Explanations
por: Villa, Danielle, et al.
Publicado: (2025)
por: Villa, Danielle, et al.
Publicado: (2025)
Benchmarking Concept-Spilling Across Languages in LLMs
por: Badanin, Ilia, et al.
Publicado: (2026)
por: Badanin, Ilia, et al.
Publicado: (2026)
Cognitive LLMs: Towards Integrating Cognitive Architectures and Large Language Models for Manufacturing Decision-making
por: Wu, Siyu, et al.
Publicado: (2024)
por: Wu, Siyu, et al.
Publicado: (2024)
Disparities in LLM Reasoning Accuracy and Explanations: A Case Study on African American English
por: Zhou, Runtao, et al.
Publicado: (2025)
por: Zhou, Runtao, et al.
Publicado: (2025)
On Fairness of Unified Multimodal Large Language Model for Image Generation
por: Liu, Ming, et al.
Publicado: (2025)
por: Liu, Ming, et al.
Publicado: (2025)
Uncovering Hidden Violent Tendencies in LLMs: A Demographic Analysis via Behavioral Vignettes
por: Myers, Quintin, et al.
Publicado: (2025)
por: Myers, Quintin, et al.
Publicado: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
por: Wang, Jiaan, et al.
Publicado: (2025)
por: Wang, Jiaan, et al.
Publicado: (2025)
An Empirical Evaluation of Large Language Models on Consumer Health Questions
por: Abrar, Moaiz, et al.
Publicado: (2024)
por: Abrar, Moaiz, et al.
Publicado: (2024)
LANTERN: Scalable Distillation of Large Language Models for Job-Person Fit and Explanation
por: Fu, Zhoutong, et al.
Publicado: (2025)
por: Fu, Zhoutong, et al.
Publicado: (2025)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
por: Liu, Shuodi, et al.
Publicado: (2025)
por: Liu, Shuodi, et al.
Publicado: (2025)
Bridging Fairness and Explainability: Can Input-Based Explanations Promote Fairness in Hate Speech Detection?
por: Wang, Yifan, et al.
Publicado: (2025)
por: Wang, Yifan, et al.
Publicado: (2025)
STRUX: An LLM for Decision-Making with Structured Explanations
por: Lu, Yiming, et al.
Publicado: (2024)
por: Lu, Yiming, et al.
Publicado: (2024)
The Unequal Opportunities of Large Language Models: Revealing Demographic Bias through Job Recommendations
por: Salinas, Abel, et al.
Publicado: (2023)
por: Salinas, Abel, et al.
Publicado: (2023)
Explanations of Large Language Models Explain Language Representations in the Brain
por: Rahimi, Maryam, et al.
Publicado: (2025)
por: Rahimi, Maryam, et al.
Publicado: (2025)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
por: Jung, Dahyun, et al.
Publicado: (2025)
por: Jung, Dahyun, et al.
Publicado: (2025)
Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages
por: Tamang, S., et al.
Publicado: (2024)
por: Tamang, S., et al.
Publicado: (2024)
Local Explanations and Self-Explanations for Assessing Faithfulness in black-box LLMs
por: Fragkathoulas, Christos, et al.
Publicado: (2024)
por: Fragkathoulas, Christos, et al.
Publicado: (2024)
Can LLM-Generated Textual Explanations Enhance Model Classification Performance? An Empirical Study
por: Dhaini, Mahdi, et al.
Publicado: (2025)
por: Dhaini, Mahdi, et al.
Publicado: (2025)
Evaluating Large Language Models for Abstract Evaluation Tasks: An Empirical Study
por: Liu, Yinuo, et al.
Publicado: (2026)
por: Liu, Yinuo, et al.
Publicado: (2026)
Assessing Large Language Models for Online Extremism Research: Identification, Explanation, and New Knowledge
por: Dong, Beidi, et al.
Publicado: (2024)
por: Dong, Beidi, et al.
Publicado: (2024)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
por: Yang, Xinqi, et al.
Publicado: (2024)
por: Yang, Xinqi, et al.
Publicado: (2024)
Ejemplares similares
-
Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness Perspective
por: Zhou, Yue, et al.
Publicado: (2024) -
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024) -
MArgE: Meshing Argumentative Evidence from Multiple Large Language Models for Justifiable Claim Verification
por: Ng, Ming Pok, et al.
Publicado: (2025) -
An Empirical Analysis of Uncertainty in Large Language Model Evaluations
por: Xie, Qiujie, et al.
Publicado: (2025) -
An Empirical Analysis on Large Language Models in Debate Evaluation
por: Liu, Xinyi, et al.
Publicado: (2024)