Obscured but Not Erased: Evaluating Nationality Bias in LLMs via Name-Based Bias Benchmarks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pelosio, Giulio, Batra, Devesh, Bovey, Noémie, Hankache, Robert, Iglesias, Cristovao, Cowan, Greig, Khraishi, Raad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating the Sensitivity of LLMs to Prior Context
par: Hankache, Robert, et autres
Publié: (2025)
par: Hankache, Robert, et autres
Publié: (2025)
Helping Customers in Distress: An LLM-powered Agent that Converses, Probes, and Routes
par: Atreya, Alankar, et autres
Publié: (2026)
par: Atreya, Alankar, et autres
Publié: (2026)
Evaluating Performance Drift from Model Switching in Multi-Turn LLM Systems
par: Khraishi, Raad, et autres
Publié: (2026)
par: Khraishi, Raad, et autres
Publié: (2026)
How Personality Traits Shape LLM Risk-Taking Behaviour
par: Hartley, John, et autres
Publié: (2025)
par: Hartley, John, et autres
Publié: (2025)
Measuring Mechanistic Independence: Can Bias Be Removed Without Erasing Demographics?
par: Shan, Zhengyang, et autres
Publié: (2025)
par: Shan, Zhengyang, et autres
Publié: (2025)
IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages
par: Hanif, Ikhlasul Akmal, et autres
Publié: (2026)
par: Hanif, Ikhlasul Akmal, et autres
Publié: (2026)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
par: Xu, Wenda, et autres
Publié: (2025)
par: Xu, Wenda, et autres
Publié: (2025)
Do Bias Benchmarks Generalise? Evidence from Voice-based Evaluation of Gender Bias in SpeechLLMs
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
The Bias is in the Details: An Assessment of Cognitive Bias in LLMs
par: Knipper, R. Alexander, et autres
Publié: (2025)
par: Knipper, R. Alexander, et autres
Publié: (2025)
A Study of Nationality Bias in Names and Perplexity using Off-the-Shelf Affect-related Tweet Classifiers
par: Barriere, Valentin, et autres
Publié: (2024)
par: Barriere, Valentin, et autres
Publié: (2024)
DIF: A Framework for Benchmarking and Verifying Implicit Bias in LLMs
par: Yin, Lake, et autres
Publié: (2025)
par: Yin, Lake, et autres
Publié: (2025)
Evaluating Gender Bias of LLMs in Making Morality Judgements
par: Bajaj, Divij, et autres
Publié: (2024)
par: Bajaj, Divij, et autres
Publié: (2024)
Language Bias under Conflicting Information in Multilingual LLMs
par: Östling, Robert, et autres
Publié: (2026)
par: Östling, Robert, et autres
Publié: (2026)
A Japanese Benchmark for Evaluating Social Bias in Reasoning Based on Attribution Theory
par: Shiotani, Taihei, et autres
Publié: (2026)
par: Shiotani, Taihei, et autres
Publié: (2026)
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2026)
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2026)
I Am Aligned, But With Whom? MENA Values Benchmark for Evaluating Cultural Alignment and Multilingual Bias in LLMs
par: Zahraei, Pardis Sadat, et autres
Publié: (2025)
par: Zahraei, Pardis Sadat, et autres
Publié: (2025)
Evaluating LLMs for Demographic-Targeted Social Bias Detection: A Comprehensive Benchmark Study
par: Majumdar, Ayan, et autres
Publié: (2025)
par: Majumdar, Ayan, et autres
Publié: (2025)
Enabling Scalable Evaluation of Bias Patterns in Medical LLMs
par: Fayyaz, Hamed, et autres
Publié: (2024)
par: Fayyaz, Hamed, et autres
Publié: (2024)
Evaluating the Bias in LLMs for Surveying Opinion and Decision Making in Healthcare
par: Khaokaew, Yonchanok, et autres
Publié: (2025)
par: Khaokaew, Yonchanok, et autres
Publié: (2025)
A Dual-Layered Evaluation of Geopolitical and Cultural Bias in LLMs
par: Kim, Sean, et autres
Publié: (2025)
par: Kim, Sean, et autres
Publié: (2025)
The power of Prompts: Evaluating and Mitigating Gender Bias in MT with LLMs
par: Sant, Aleix, et autres
Publié: (2024)
par: Sant, Aleix, et autres
Publié: (2024)
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
par: Jin, Jiho, et autres
Publié: (2025)
par: Jin, Jiho, et autres
Publié: (2025)
What is in a name? Mitigating Name Bias in Text Embeddings via Anonymization
par: Manchanda, Sahil, et autres
Publié: (2025)
par: Manchanda, Sahil, et autres
Publié: (2025)
Evaluating Metrics for Bias in Word Embeddings
par: Schröder, Sarah, et autres
Publié: (2021)
par: Schröder, Sarah, et autres
Publié: (2021)
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs
par: Fan, Zhiting, et autres
Publié: (2024)
par: Fan, Zhiting, et autres
Publié: (2024)
Investigating Subtler Biases in LLMs: Ageism, Beauty, Institutional, and Nationality Bias in Generative Models
par: Kamruzzaman, Mahammed, et autres
Publié: (2023)
par: Kamruzzaman, Mahammed, et autres
Publié: (2023)
Template-Based Probes Are Imperfect Lenses for Counterfactual Bias Evaluation in LLMs
par: Kohankhaki, Farnaz, et autres
Publié: (2024)
par: Kohankhaki, Farnaz, et autres
Publié: (2024)
Breaking Bias, Building Bridges: Evaluation and Mitigation of Social Biases in LLMs via Contact Hypothesis
par: Raj, Chahat, et autres
Publié: (2024)
par: Raj, Chahat, et autres
Publié: (2024)
Capturing Bias Diversity in LLMs
par: Gosavi, Purva Prasad, et autres
Publié: (2024)
par: Gosavi, Purva Prasad, et autres
Publié: (2024)
Bias Mitigation or Cultural Commonsense? Evaluating LLMs with a Japanese Dataset
par: Yamamoto, Taisei, et autres
Publié: (2025)
par: Yamamoto, Taisei, et autres
Publié: (2025)
Evaluating Bias in LLMs for Job-Resume Matching: Gender, Race, and Education
par: Iso, Hayate, et autres
Publié: (2025)
par: Iso, Hayate, et autres
Publié: (2025)
FairCoder: Evaluating Social Bias of LLMs in Code Generation
par: Du, Yongkang, et autres
Publié: (2025)
par: Du, Yongkang, et autres
Publié: (2025)
LLMs are Biased Teachers: Evaluating LLM Bias in Personalized Education
par: Weissburg, Iain, et autres
Publié: (2024)
par: Weissburg, Iain, et autres
Publié: (2024)
Relative Bias: A Comparative Framework for Quantifying Bias in LLMs
par: Arbabi, Alireza, et autres
Publié: (2025)
par: Arbabi, Alireza, et autres
Publié: (2025)
Disclosure and Mitigation of Gender Bias in LLMs
par: Dong, Xiangjue, et autres
Publié: (2024)
par: Dong, Xiangjue, et autres
Publié: (2024)
A Comprehensive Study of Gender Bias in Chemical Named Entity Recognition Models
par: Zhao, Xingmeng, et autres
Publié: (2022)
par: Zhao, Xingmeng, et autres
Publié: (2022)
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
par: Ko, Changgeon, et autres
Publié: (2024)
par: Ko, Changgeon, et autres
Publié: (2024)
Causally Testing Gender Bias in LLMs: A Case Study on Occupational Bias
par: Chen, Yuen, et autres
Publié: (2022)
par: Chen, Yuen, et autres
Publié: (2022)
LLMs Are Biased Towards Output Formats! Systematically Evaluating and Mitigating Output Format Bias of LLMs
par: Long, Do Xuan, et autres
Publié: (2024)
par: Long, Do Xuan, et autres
Publié: (2024)
What's Not Said Still Hurts: A Description-Based Evaluation Framework for Measuring Social Bias in LLMs
par: Pan, Jinhao, et autres
Publié: (2025)
par: Pan, Jinhao, et autres
Publié: (2025)
Documents similaires
-
Evaluating the Sensitivity of LLMs to Prior Context
par: Hankache, Robert, et autres
Publié: (2025) -
Helping Customers in Distress: An LLM-powered Agent that Converses, Probes, and Routes
par: Atreya, Alankar, et autres
Publié: (2026) -
Evaluating Performance Drift from Model Switching in Multi-Turn LLM Systems
par: Khraishi, Raad, et autres
Publié: (2026) -
How Personality Traits Shape LLM Risk-Taking Behaviour
par: Hartley, John, et autres
Publié: (2025) -
Measuring Mechanistic Independence: Can Bias Be Removed Without Erasing Demographics?
par: Shan, Zhengyang, et autres
Publié: (2025)