FairMonitor: A Dual-framework for Detecting Stereotypes and Biases in Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Yanhong, Zhao, Jiabao, Shi, Jinxin, Xie, Zhentao, Wu, Xingjiao, He, Liang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MindScope: Exploring cognitive biases in large language models through Multi-Agent Systems
by: Xie, Zhentao, et al.
Published: (2024)
by: Xie, Zhentao, et al.
Published: (2024)
A Survey on the Optimization of Large Language Model-based Agents
by: Du, Shangheng, et al.
Published: (2025)
by: Du, Shangheng, et al.
Published: (2025)
Measuring Stereotype and Deviation Biases in Large Language Models
by: Wang, Daniel, et al.
Published: (2025)
by: Wang, Daniel, et al.
Published: (2025)
A Survey of Explainable Knowledge Tracing
by: Bai, Yanhong, et al.
Published: (2024)
by: Bai, Yanhong, et al.
Published: (2024)
RMoA: Optimizing Mixture-of-Agents through Diversity Maximization and Residual Compensation
by: Xie, Zhentao, et al.
Published: (2025)
by: Xie, Zhentao, et al.
Published: (2025)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
by: Limisiewicz, Tomasz, et al.
Published: (2025)
by: Limisiewicz, Tomasz, et al.
Published: (2025)
Mitigating Biases of Large Language Models in Stance Detection with Counterfactual Augmented Calibration
by: Li, Ang, et al.
Published: (2024)
by: Li, Ang, et al.
Published: (2024)
A Trip Towards Fairness: Bias and De-Biasing in Large Language Models
by: Ranaldi, Leonardo, et al.
Published: (2023)
by: Ranaldi, Leonardo, et al.
Published: (2023)
Detecting Linguistic Indicators for Stereotype Assessment with Large Language Models
by: Görge, Rebekka, et al.
Published: (2025)
by: Görge, Rebekka, et al.
Published: (2025)
Biased or Flawed? Mitigating Stereotypes in Generative Language Models by Addressing Task-Specific Flaws
by: Jha, Akshita, et al.
Published: (2024)
by: Jha, Akshita, et al.
Published: (2024)
Stereotype or Personalization? User Identity Biases Chatbot Recommendations
by: Kantharuban, Anjali, et al.
Published: (2024)
by: Kantharuban, Anjali, et al.
Published: (2024)
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
by: Wu, Addison J., et al.
Published: (2025)
by: Wu, Addison J., et al.
Published: (2025)
More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models
by: Chen, Evan, et al.
Published: (2025)
by: Chen, Evan, et al.
Published: (2025)
Do Multilingual Large Language Models Mitigate Stereotype Bias?
by: Nie, Shangrui, et al.
Published: (2024)
by: Nie, Shangrui, et al.
Published: (2024)
Mitigating Strategy Preference Bias in Emotional Support Conversation via Uncertainty Estimations
by: Zhou, Yougen, et al.
Published: (2025)
by: Zhou, Yougen, et al.
Published: (2025)
Detecting Offensive Memes with Social Biases in Singapore Context Using Multimodal Large Language Models
by: Yuxuan, Cao, et al.
Published: (2025)
by: Yuxuan, Cao, et al.
Published: (2025)
A Group Fairness Lens for Large Language Models
by: Bi, Guanqun, et al.
Published: (2023)
by: Bi, Guanqun, et al.
Published: (2023)
Analyzing the Safety of Japanese Large Language Models in Stereotype-Triggering Prompts
by: Nakanishi, Akito, et al.
Published: (2025)
by: Nakanishi, Akito, et al.
Published: (2025)
Towards Evaluating and Building Versatile Large Language Models for Medicine
by: Wu, Chaoyi, et al.
Published: (2024)
by: Wu, Chaoyi, et al.
Published: (2024)
A Survey on Stereotype Detection in Natural Language Processing
by: Cignarella, Alessandra Teresa, et al.
Published: (2025)
by: Cignarella, Alessandra Teresa, et al.
Published: (2025)
A Taxonomy of Stereotype Content in Large Language Models
by: Nicolas, Gandalf, et al.
Published: (2024)
by: Nicolas, Gandalf, et al.
Published: (2024)
FairPy: A Toolkit for Evaluation of Prediction Biases and their Mitigation in Large Language Models
by: Viswanath, Hrishikesh, et al.
Published: (2023)
by: Viswanath, Hrishikesh, et al.
Published: (2023)
FairI Tales: Evaluation of Fairness in Indian Contexts with a Focus on Bias and Stereotypes
by: Nawale, Janki Atul, et al.
Published: (2025)
by: Nawale, Janki Atul, et al.
Published: (2025)
Evaluation of Large Language Models: STEM education and Gender Stereotypes
by: Due, Smilla, et al.
Published: (2024)
by: Due, Smilla, et al.
Published: (2024)
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
by: Xie, Tian, et al.
Published: (2025)
by: Xie, Tian, et al.
Published: (2025)
Who is better at math, Jenny or Jingzhen? Uncovering Stereotypes in Large Language Models
by: Siddique, Zara, et al.
Published: (2024)
by: Siddique, Zara, et al.
Published: (2024)
Quantifying Stereotypes in Language
by: Liu, Yang
Published: (2024)
by: Liu, Yang
Published: (2024)
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
by: Shieh, Evan, et al.
Published: (2024)
by: Shieh, Evan, et al.
Published: (2024)
Large Language Models are Biased Because They Are Large Language Models
by: Resnik, Philip
Published: (2024)
by: Resnik, Philip
Published: (2024)
CL-MoE: Enhancing Multimodal Large Language Model with Dual Momentum Mixture-of-Experts for Continual Visual Question Answering
by: Huai, Tianyu, et al.
Published: (2025)
by: Huai, Tianyu, et al.
Published: (2025)
BanStereoSet: A Dataset to Measure Stereotypical Social Biases in LLMs for Bangla
by: Kamruzzaman, Mahammed, et al.
Published: (2024)
by: Kamruzzaman, Mahammed, et al.
Published: (2024)
Addressing Stereotypes in Large Language Models: A Critical Examination and Mitigation
by: Kazi, Fatima
Published: (2025)
by: Kazi, Fatima
Published: (2025)
Continual Learning Using Only Large Language Model Prompting
by: Qiu, Jiabao, et al.
Published: (2024)
by: Qiu, Jiabao, et al.
Published: (2024)
An Empirical Study of Gendered Stereotypes in Emotional Attributes for Bangla in Multilingual Large Language Models
by: Sadhu, Jayanta, et al.
Published: (2024)
by: Sadhu, Jayanta, et al.
Published: (2024)
Evolution without Large Models: Training Language Model with Task Principles
by: Zhu, Minghang, et al.
Published: (2025)
by: Zhu, Minghang, et al.
Published: (2025)
Systematic Offensive Stereotyping (SOS) Bias in Language Models
by: Elsafoury, Fatma
Published: (2023)
by: Elsafoury, Fatma
Published: (2023)
Intersectional Fairness in Large Language Models
by: Boufaied, Chaima, et al.
Published: (2026)
by: Boufaied, Chaima, et al.
Published: (2026)
Large Language Models are Geographically Biased
by: Manvi, Rohin, et al.
Published: (2024)
by: Manvi, Rohin, et al.
Published: (2024)
LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models
by: Zhang, Ming, et al.
Published: (2025)
by: Zhang, Ming, et al.
Published: (2025)
When Hindsight is Not 20/20: Testing Limits on Reflective Thinking in Large Language Models
by: Li, Yanhong, et al.
Published: (2024)
by: Li, Yanhong, et al.
Published: (2024)
Similar Items
-
MindScope: Exploring cognitive biases in large language models through Multi-Agent Systems
by: Xie, Zhentao, et al.
Published: (2024) -
A Survey on the Optimization of Large Language Model-based Agents
by: Du, Shangheng, et al.
Published: (2025) -
Measuring Stereotype and Deviation Biases in Large Language Models
by: Wang, Daniel, et al.
Published: (2025) -
A Survey of Explainable Knowledge Tracing
by: Bai, Yanhong, et al.
Published: (2024) -
RMoA: Optimizing Mixture-of-Agents through Diversity Maximization and Residual Compensation
by: Xie, Zhentao, et al.
Published: (2025)