WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Felkner, Virginia K., Chang, Ho-Chun Herbert, Jang, Eugene, May, Jonathan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Textual Entailment is not a Better Bias Metric than Token Probability
di: Felkner, Virginia K., et al.
Pubblicazione: (2025)
di: Felkner, Virginia K., et al.
Pubblicazione: (2025)
GPT is Not an Annotator: The Necessity of Human Annotation in Fairness Benchmark Construction
di: Felkner, Virginia K., et al.
Pubblicazione: (2024)
di: Felkner, Virginia K., et al.
Pubblicazione: (2024)
Gender Bias in Emotion Recognition by Large Language Models
di: Herbert, Maureen, et al.
Pubblicazione: (2025)
di: Herbert, Maureen, et al.
Pubblicazione: (2025)
Harmful Speech Detection by Language Models Exhibits Gender-Queer Dialect Bias
di: Dorn, Rebecca, et al.
Pubblicazione: (2024)
di: Dorn, Rebecca, et al.
Pubblicazione: (2024)
Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese
di: Lyu, Hanjia, et al.
Pubblicazione: (2025)
di: Lyu, Hanjia, et al.
Pubblicazione: (2025)
AccessEval: Benchmarking Disability Bias in Large Language Models
di: Panda, Srikant, et al.
Pubblicazione: (2025)
di: Panda, Srikant, et al.
Pubblicazione: (2025)
QueerBench: Quantifying Discrimination in Language Models Toward Queer Identities
di: Sosto, Mae, et al.
Pubblicazione: (2024)
di: Sosto, Mae, et al.
Pubblicazione: (2024)
Exploring LGBTQ+ Bias in Generative AI Answers across Different Country and Religious Contexts
di: Vicsek, Lilla, et al.
Pubblicazione: (2024)
di: Vicsek, Lilla, et al.
Pubblicazione: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Characterizing Selective Refusal Bias in Large Language Models
di: Khorramrouz, Adel, et al.
Pubblicazione: (2025)
di: Khorramrouz, Adel, et al.
Pubblicazione: (2025)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
Measuring Implicit Bias in Explicitly Unbiased Large Language Models
di: Bai, Xuechunzi, et al.
Pubblicazione: (2024)
di: Bai, Xuechunzi, et al.
Pubblicazione: (2024)
Leveraging Large Language Models to Measure Gender Representation Bias in Gendered Language Corpora
di: Derner, Erik, et al.
Pubblicazione: (2024)
di: Derner, Erik, et al.
Pubblicazione: (2024)
On Classification with Large Language Models in Cultural Analytics
di: Bamman, David, et al.
Pubblicazione: (2024)
di: Bamman, David, et al.
Pubblicazione: (2024)
Cross-Language Bias Examination in Large Language Models
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
Towards Equitable AI: Detecting Bias in Using Large Language Models for Marketing
di: Yilmaz, Berk, et al.
Pubblicazione: (2025)
di: Yilmaz, Berk, et al.
Pubblicazione: (2025)
From Individuals to Interactions: Benchmarking Gender Bias in Multimodal Large Language Models from the Lens of Social Relationship
di: Xu, Yue, et al.
Pubblicazione: (2025)
di: Xu, Yue, et al.
Pubblicazione: (2025)
Online Anti-sexist Speech: Identifying Resistance to Gender Bias in Political Discourse
di: Dutta, Aditi, et al.
Pubblicazione: (2025)
di: Dutta, Aditi, et al.
Pubblicazione: (2025)
Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models
di: Apsel, Molly, et al.
Pubblicazione: (2026)
di: Apsel, Molly, et al.
Pubblicazione: (2026)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
di: Zahraei, Pardis Sadat, et al.
Pubblicazione: (2025)
di: Zahraei, Pardis Sadat, et al.
Pubblicazione: (2025)
MALIBU Benchmark: Multi-Agent LLM Implicit Bias Uncovered
di: Mirza, Imran, et al.
Pubblicazione: (2025)
di: Mirza, Imran, et al.
Pubblicazione: (2025)
JiraiBench: A Bilingual Benchmark for Evaluating Large Language Models' Detection of Human Self-Destructive Behavior Content in Jirai Community
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
Down the Toxicity Rabbit Hole: A Novel Framework to Bias Audit Large Language Models
di: Dutta, Arka, et al.
Pubblicazione: (2023)
di: Dutta, Arka, et al.
Pubblicazione: (2023)
Divine LLaMAs: Bias, Stereotypes, Stigmatization, and Emotion Representation of Religion in Large Language Models
di: Plaza-del-Arco, Flor Miriam, et al.
Pubblicazione: (2024)
di: Plaza-del-Arco, Flor Miriam, et al.
Pubblicazione: (2024)
DECASTE: Unveiling Caste Stereotypes in Large Language Models through Multi-Dimensional Bias Analysis
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2025)
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2025)
Research Community Perspectives on "Intelligence" and Large Language Models
di: Højer, Bertram, et al.
Pubblicazione: (2025)
di: Højer, Bertram, et al.
Pubblicazione: (2025)
Bilingual Bias in Large Language Models: A Taiwan Sovereignty Benchmark Study
di: Ko, Ju-Chun
Pubblicazione: (2026)
di: Ko, Ju-Chun
Pubblicazione: (2026)
Only a Little to the Left: A Theory-grounded Measure of Political Bias in Large Language Models
di: Faulborn, Mats, et al.
Pubblicazione: (2025)
di: Faulborn, Mats, et al.
Pubblicazione: (2025)
Bias and Volatility: A Statistical Framework for Evaluating Large Language Model's Stereotypes and the Associated Generation Inconsistency
di: Liu, Yiran, et al.
Pubblicazione: (2024)
di: Liu, Yiran, et al.
Pubblicazione: (2024)
Benchmarking Political Persuasion Risks Across Frontier Large Language Models
di: Chen, Zhongren, et al.
Pubblicazione: (2026)
di: Chen, Zhongren, et al.
Pubblicazione: (2026)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
Gender Bias in Machine Translation and The Era of Large Language Models
di: Vanmassenhove, Eva
Pubblicazione: (2024)
di: Vanmassenhove, Eva
Pubblicazione: (2024)
Do Large Language Models Get Caught in Hofstadter-Mobius Loops?
di: Hryszko, Jaroslaw
Pubblicazione: (2026)
di: Hryszko, Jaroslaw
Pubblicazione: (2026)
Bias and Fairness in Large Language Models: A Survey
di: Gallegos, Isabel O., et al.
Pubblicazione: (2023)
di: Gallegos, Isabel O., et al.
Pubblicazione: (2023)
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
di: Li, Kun, et al.
Pubblicazione: (2025)
di: Li, Kun, et al.
Pubblicazione: (2025)
Sycophancy Claims about Language Models: The Missing Human-in-the-Loop
di: Batzner, Jan, et al.
Pubblicazione: (2025)
di: Batzner, Jan, et al.
Pubblicazione: (2025)
Listen and Speak Fairly: A Study on Semantic Gender Bias in Speech Integrated Large Language Models
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
Hope vs. Hate: Understanding User Interactions with LGBTQ+ News Content in Mainstream US News Media through the Lens of Hope Speech
di: Pofcher, Jonathan, et al.
Pubblicazione: (2025)
di: Pofcher, Jonathan, et al.
Pubblicazione: (2025)
Social Bias in Popular Question-Answering Benchmarks
di: Kraft, Angelie, et al.
Pubblicazione: (2025)
di: Kraft, Angelie, et al.
Pubblicazione: (2025)
Theories of "Sexuality" in Natural Language Processing Bias Research
di: Hobbs, Jacob
Pubblicazione: (2025)
di: Hobbs, Jacob
Pubblicazione: (2025)
Documenti analoghi
-
Textual Entailment is not a Better Bias Metric than Token Probability
di: Felkner, Virginia K., et al.
Pubblicazione: (2025) -
GPT is Not an Annotator: The Necessity of Human Annotation in Fairness Benchmark Construction
di: Felkner, Virginia K., et al.
Pubblicazione: (2024) -
Gender Bias in Emotion Recognition by Large Language Models
di: Herbert, Maureen, et al.
Pubblicazione: (2025) -
Harmful Speech Detection by Language Models Exhibits Gender-Queer Dialect Bias
di: Dorn, Rebecca, et al.
Pubblicazione: (2024) -
Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese
di: Lyu, Hanjia, et al.
Pubblicazione: (2025)