Harmful Speech Detection by Language Models Exhibits Gender-Queer Dialect Bias
Fuente:
arXiv
Saved in:
| Main Authors: | Dorn, Rebecca, Kezar, Lee, Morstatter, Fred, Lerman, Kristina |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reinforcing Stereotypes of Anger: Emotion AI on African American Vernacular English
by: Dorn, Rebecca, et al.
Published: (2025)
by: Dorn, Rebecca, et al.
Published: (2025)
Don't Blame the Data, Blame the Model: Understanding Noise and Bias When Learning from Subjective Annotations
by: Anand, Abhishek, et al.
Published: (2024)
by: Anand, Abhishek, et al.
Published: (2024)
Improving and Assessing the Fidelity of Large Language Models Alignment to Online Communities
by: Chu, Minh Duc, et al.
Published: (2024)
by: Chu, Minh Duc, et al.
Published: (2024)
Large Language Models Help Reveal Unhealthy Diet and Body Concerns in Online Eating Disorders Communities
by: Chu, Minh Duc, et al.
Published: (2024)
by: Chu, Minh Duc, et al.
Published: (2024)
Leveraging Machine Learning to Identify Gendered Stereotypes and Body Image Concerns on Diet and Fitness Online Forums
by: Chu, Minh Duc, et al.
Published: (2024)
by: Chu, Minh Duc, et al.
Published: (2024)
The Unequal Opportunities of Large Language Models: Revealing Demographic Bias through Job Recommendations
by: Salinas, Abel, et al.
Published: (2023)
by: Salinas, Abel, et al.
Published: (2023)
Gendered Divides in Online Discussions about Reproductive Rights
by: Rao, Ashwin, et al.
Published: (2025)
by: Rao, Ashwin, et al.
Published: (2025)
Characterizing Network Structure of Anti-Trans Actors on TikTok
by: Leitner, Maxyn, et al.
Published: (2025)
by: Leitner, Maxyn, et al.
Published: (2025)
Navigating Dialectal Bias and Ethical Complexities in Levantine Arabic Hate Speech Detection
by: Ahmed, Ahmed Haj, et al.
Published: (2024)
by: Ahmed, Ahmed Haj, et al.
Published: (2024)
Linguistic Bias in ChatGPT: Language Models Reinforce Dialect Discrimination
by: Fleisig, Eve, et al.
Published: (2024)
by: Fleisig, Eve, et al.
Published: (2024)
Estimating Causal Effects of Text Interventions Leveraging LLMs
by: Guo, Siyi, et al.
Published: (2024)
by: Guo, Siyi, et al.
Published: (2024)
WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models
by: Felkner, Virginia K., et al.
Published: (2023)
by: Felkner, Virginia K., et al.
Published: (2023)
Leveraging Large Language Models to Measure Gender Representation Bias in Gendered Language Corpora
by: Derner, Erik, et al.
Published: (2024)
by: Derner, Erik, et al.
Published: (2024)
A Capabilities Approach to Studying Bias and Harm in Language Technologies
by: Nigatu, Hellina Hailu, et al.
Published: (2024)
by: Nigatu, Hellina Hailu, et al.
Published: (2024)
Gender Bias in Emotion Recognition by Large Language Models
by: Herbert, Maureen, et al.
Published: (2025)
by: Herbert, Maureen, et al.
Published: (2025)
Whose Emotions and Moral Sentiments Do Language Models Reflect?
by: He, Zihao, et al.
Published: (2024)
by: He, Zihao, et al.
Published: (2024)
How Susceptible are Large Language Models to Ideological Manipulation?
by: Chen, Kai, et al.
Published: (2024)
by: Chen, Kai, et al.
Published: (2024)
COMMUNITY-CROSS-INSTRUCT: Unsupervised Instruction Generation for Aligning Large Language Models to Online Communities
by: He, Zihao, et al.
Published: (2024)
by: He, Zihao, et al.
Published: (2024)
Listen and Speak Fairly: A Study on Semantic Gender Bias in Speech Integrated Large Language Models
by: Lin, Yi-Cheng, et al.
Published: (2024)
by: Lin, Yi-Cheng, et al.
Published: (2024)
Online Anti-sexist Speech: Identifying Resistance to Gender Bias in Political Discourse
by: Dutta, Aditi, et al.
Published: (2025)
by: Dutta, Aditi, et al.
Published: (2025)
QueerBench: Quantifying Discrimination in Language Models Toward Queer Identities
by: Sosto, Mae, et al.
Published: (2024)
by: Sosto, Mae, et al.
Published: (2024)
Assessing the Impact of Conspiracy Theories Using Large Language Models
by: Jiang, Bohan, et al.
Published: (2024)
by: Jiang, Bohan, et al.
Published: (2024)
Diverse, but Divisive: LLMs Can Exaggerate Gender Differences in Opinion Related to Harms of Misinformation
by: Neumann, Terrence, et al.
Published: (2024)
by: Neumann, Terrence, et al.
Published: (2024)
Careless Whisper: Speech-to-Text Hallucination Harms
by: Koenecke, Allison, et al.
Published: (2024)
by: Koenecke, Allison, et al.
Published: (2024)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
by: Zahraei, Pardis Sadat, et al.
Published: (2025)
by: Zahraei, Pardis Sadat, et al.
Published: (2025)
Do Methods to Jailbreak and Defend LLMs Generalize Across Languages?
by: Atil, Berk, et al.
Published: (2025)
by: Atil, Berk, et al.
Published: (2025)
Gender Bias Detection in Court Decisions: A Brazilian Case Study
by: Benatti, Raysa, et al.
Published: (2024)
by: Benatti, Raysa, et al.
Published: (2024)
Taxonomizing Representational Harms using Speech Act Theory
by: Corvi, Emily, et al.
Published: (2025)
by: Corvi, Emily, et al.
Published: (2025)
Gender Bias in Machine Translation and The Era of Large Language Models
by: Vanmassenhove, Eva
Published: (2024)
by: Vanmassenhove, Eva
Published: (2024)
Generative Language Models Exhibit Social Identity Biases
by: Hu, Tiancheng, et al.
Published: (2023)
by: Hu, Tiancheng, et al.
Published: (2023)
Do Prevalent Bias Metrics Capture Allocational Harms from LLMs?
by: Cyberey, Hannah, et al.
Published: (2024)
by: Cyberey, Hannah, et al.
Published: (2024)
Polarized Online Discourse on Abortion: Frames and Hostile Expressions among Liberals and Conservatives
by: Rao, Ashwin, et al.
Published: (2023)
by: Rao, Ashwin, et al.
Published: (2023)
The Butterfly Effect of Altering Prompts: How Small Changes and Jailbreaks Affect Large Language Model Performance
by: Salinas, Abel, et al.
Published: (2024)
by: Salinas, Abel, et al.
Published: (2024)
"Define Your Terms" : Enhancing Efficient Offensive Speech Classification with Definition
by: Nghiem, Huy, et al.
Published: (2024)
by: Nghiem, Huy, et al.
Published: (2024)
Capturing Perspectives of Crowdsourced Annotators in Subjective Learning Tasks
by: Mokhberian, Negar, et al.
Published: (2023)
by: Mokhberian, Negar, et al.
Published: (2023)
Risk and Response in Large Language Models: Evaluating Key Threat Categories
by: Harandizadeh, Bahareh, et al.
Published: (2024)
by: Harandizadeh, Bahareh, et al.
Published: (2024)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
by: Wang, Ze, et al.
Published: (2024)
by: Wang, Ze, et al.
Published: (2024)
Towards Equitable AI: Detecting Bias in Using Large Language Models for Marketing
by: Yilmaz, Berk, et al.
Published: (2025)
by: Yilmaz, Berk, et al.
Published: (2025)
Functional Misalignment in Human-AI Interactions on Digital Platforms
by: Lerman, Kristina
Published: (2026)
by: Lerman, Kristina
Published: (2026)
LLM-based Semantic Augmentation for Harmful Content Detection
by: Meguellati, Elyas, et al.
Published: (2025)
by: Meguellati, Elyas, et al.
Published: (2025)
Similar Items
-
Reinforcing Stereotypes of Anger: Emotion AI on African American Vernacular English
by: Dorn, Rebecca, et al.
Published: (2025) -
Don't Blame the Data, Blame the Model: Understanding Noise and Bias When Learning from Subjective Annotations
by: Anand, Abhishek, et al.
Published: (2024) -
Improving and Assessing the Fidelity of Large Language Models Alignment to Online Communities
by: Chu, Minh Duc, et al.
Published: (2024) -
Large Language Models Help Reveal Unhealthy Diet and Body Concerns in Online Eating Disorders Communities
by: Chu, Minh Duc, et al.
Published: (2024) -
Leveraging Machine Learning to Identify Gendered Stereotypes and Body Image Concerns on Diet and Fitness Online Forums
by: Chu, Minh Duc, et al.
Published: (2024)