Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Zhao, Xie, Tian, Zhang, Xueru |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
par: Xie, Tian, et autres
Publié: (2025)
par: Xie, Tian, et autres
Publié: (2025)
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
par: Rani, Arti, et autres
Publié: (2025)
par: Rani, Arti, et autres
Publié: (2025)
Mitigating the Bias of Large Language Model Evaluation
par: Zhou, Hongli, et autres
Publié: (2024)
par: Zhou, Hongli, et autres
Publié: (2024)
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
par: Wang, Yaxuan, et autres
Publié: (2026)
par: Wang, Yaxuan, et autres
Publié: (2026)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
par: Guo, Yufei, et autres
Publié: (2024)
par: Guo, Yufei, et autres
Publié: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025)
par: Liu, Siqi, et autres
Publié: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
par: Oi, Masanari, et autres
Publié: (2024)
par: Oi, Masanari, et autres
Publié: (2024)
Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling
par: Liu, Shuliang, et autres
Publié: (2025)
par: Liu, Shuliang, et autres
Publié: (2025)
Identifying and Mitigating Social Bias Knowledge in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Decomposing and Steering Functional Metacognition in Large Language Models
par: Li, Yanshi, et autres
Publié: (2026)
par: Li, Yanshi, et autres
Publié: (2026)
Mitigating Label Length Bias in Large Language Models
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Locating and Mitigating Gender Bias in Large Language Models
par: Cai, Yuchen, et autres
Publié: (2024)
par: Cai, Yuchen, et autres
Publié: (2024)
Unveiling and Mitigating Bias in Mental Health Analysis with Large Language Models
par: Wang, Yuqing, et autres
Publié: (2024)
par: Wang, Yuqing, et autres
Publié: (2024)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
par: Hida, Rem, et autres
Publié: (2024)
par: Hida, Rem, et autres
Publié: (2024)
The Ability of Large Language Models to Evaluate Constraint-satisfaction in Agent Responses to Open-ended Requests
par: Madmoni, Lior, et autres
Publié: (2024)
par: Madmoni, Lior, et autres
Publié: (2024)
Do Multilingual Large Language Models Mitigate Stereotype Bias?
par: Nie, Shangrui, et autres
Publié: (2024)
par: Nie, Shangrui, et autres
Publié: (2024)
Detection, Classification, and Mitigation of Gender Bias in Large Language Models
par: Cheng, Xiaoqing, et autres
Publié: (2025)
par: Cheng, Xiaoqing, et autres
Publié: (2025)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
par: Liu, Jiaxiang, et autres
Publié: (2024)
par: Liu, Jiaxiang, et autres
Publié: (2024)
Mitigating Biases in Language Models via Bias Unlearning
par: Liu, Dianqing, et autres
Publié: (2025)
par: Liu, Dianqing, et autres
Publié: (2025)
ODE: Open-Set Evaluation of Hallucinations in Multimodal Large Language Models
par: Tu, Yahan, et autres
Publié: (2024)
par: Tu, Yahan, et autres
Publié: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
par: Lan, Tian, et autres
Publié: (2025)
par: Lan, Tian, et autres
Publié: (2025)
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
par: Tong, Schrasing, et autres
Publié: (2024)
par: Tong, Schrasing, et autres
Publié: (2024)
MBIAS: Mitigating Bias in Large Language Models While Retaining Context
par: Raza, Shaina, et autres
Publié: (2024)
par: Raza, Shaina, et autres
Publié: (2024)
Evaluating Gender Bias in Large Language Models
par: Döll, Michael, et autres
Publié: (2024)
par: Döll, Michael, et autres
Publié: (2024)
Mitigating Gender Bias in Code Large Language Models via Model Editing
par: Qin, Zhanyue, et autres
Publié: (2024)
par: Qin, Zhanyue, et autres
Publié: (2024)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
Failing to Falsify: Evaluating and Mitigating Confirmation Bias in Language Models
par: Jhaveri, Ayush Rajesh, et autres
Publié: (2026)
par: Jhaveri, Ayush Rajesh, et autres
Publié: (2026)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
par: Chen, Yuxing, et autres
Publié: (2026)
par: Chen, Yuxing, et autres
Publié: (2026)
Exploring Causal Effect of Social Bias on Faithfulness Hallucinations in Large Language Models
par: Zhang, Zhenliang, et autres
Publié: (2025)
par: Zhang, Zhenliang, et autres
Publié: (2025)
Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework
par: Xu, Zhenjie, et autres
Publié: (2024)
par: Xu, Zhenjie, et autres
Publié: (2024)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
Bias Beyond English: Evaluating Social Bias and Debiasing Methods in a Low-Resource Setting
par: Zhou, Ej, et autres
Publié: (2025)
par: Zhou, Ej, et autres
Publié: (2025)
Explicit vs. Implicit: Investigating Social Bias in Large Language Models through Self-Reflection
par: Zhao, Yachao, et autres
Publié: (2025)
par: Zhao, Yachao, et autres
Publié: (2025)
Social Bias in Large Language Models For Bangla: An Empirical Study on Gender and Religious Bias
par: Sadhu, Jayanta, et autres
Publié: (2024)
par: Sadhu, Jayanta, et autres
Publié: (2024)
VIGNETTE: Socially Grounded Bias Evaluation for Vision-Language Models
par: Raj, Chahat, et autres
Publié: (2025)
par: Raj, Chahat, et autres
Publié: (2025)
Learning Personalized Alignment for Evaluating Open-ended Text Generation
par: Wang, Danqing, et autres
Publié: (2023)
par: Wang, Danqing, et autres
Publié: (2023)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
par: Qin, Zhanyue, et autres
Publié: (2025)
par: Qin, Zhanyue, et autres
Publié: (2025)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations
par: Nam, Hyunji, et autres
Publié: (2025)
par: Nam, Hyunji, et autres
Publié: (2025)
Documents similaires
-
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
par: Xie, Tian, et autres
Publié: (2025) -
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
par: Rani, Arti, et autres
Publié: (2025) -
Mitigating the Bias of Large Language Model Evaluation
par: Zhou, Hongli, et autres
Publié: (2024) -
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
par: Wang, Yaxuan, et autres
Publié: (2026) -
Bias in Large Language Models: Origin, Evaluation, and Mitigation
par: Guo, Yufei, et autres
Publié: (2024)