Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Zhao, Xie, Tian, Zhang, Xueru |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
di: Xie, Tian, et al.
Pubblicazione: (2025)
di: Xie, Tian, et al.
Pubblicazione: (2025)
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
di: Rani, Arti, et al.
Pubblicazione: (2025)
di: Rani, Arti, et al.
Pubblicazione: (2025)
Mitigating the Bias of Large Language Model Evaluation
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
di: Wang, Yaxuan, et al.
Pubblicazione: (2026)
di: Wang, Yaxuan, et al.
Pubblicazione: (2026)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
di: Guo, Yufei, et al.
Pubblicazione: (2024)
di: Guo, Yufei, et al.
Pubblicazione: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
di: Liu, Siqi, et al.
Pubblicazione: (2025)
di: Liu, Siqi, et al.
Pubblicazione: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
Identifying and Mitigating Social Bias Knowledge in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
Decomposing and Steering Functional Metacognition in Large Language Models
di: Li, Yanshi, et al.
Pubblicazione: (2026)
di: Li, Yanshi, et al.
Pubblicazione: (2026)
Mitigating Label Length Bias in Large Language Models
di: Sanz-Guerrero, Mario, et al.
Pubblicazione: (2025)
di: Sanz-Guerrero, Mario, et al.
Pubblicazione: (2025)
Locating and Mitigating Gender Bias in Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
Unveiling and Mitigating Bias in Mental Health Analysis with Large Language Models
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
di: Hida, Rem, et al.
Pubblicazione: (2024)
di: Hida, Rem, et al.
Pubblicazione: (2024)
The Ability of Large Language Models to Evaluate Constraint-satisfaction in Agent Responses to Open-ended Requests
di: Madmoni, Lior, et al.
Pubblicazione: (2024)
di: Madmoni, Lior, et al.
Pubblicazione: (2024)
Do Multilingual Large Language Models Mitigate Stereotype Bias?
di: Nie, Shangrui, et al.
Pubblicazione: (2024)
di: Nie, Shangrui, et al.
Pubblicazione: (2024)
Detection, Classification, and Mitigation of Gender Bias in Large Language Models
di: Cheng, Xiaoqing, et al.
Pubblicazione: (2025)
di: Cheng, Xiaoqing, et al.
Pubblicazione: (2025)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
di: Liu, Jiaxiang, et al.
Pubblicazione: (2024)
di: Liu, Jiaxiang, et al.
Pubblicazione: (2024)
Mitigating Biases in Language Models via Bias Unlearning
di: Liu, Dianqing, et al.
Pubblicazione: (2025)
di: Liu, Dianqing, et al.
Pubblicazione: (2025)
ODE: Open-Set Evaluation of Hallucinations in Multimodal Large Language Models
di: Tu, Yahan, et al.
Pubblicazione: (2024)
di: Tu, Yahan, et al.
Pubblicazione: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
di: Lan, Tian, et al.
Pubblicazione: (2025)
di: Lan, Tian, et al.
Pubblicazione: (2025)
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
di: Tong, Schrasing, et al.
Pubblicazione: (2024)
di: Tong, Schrasing, et al.
Pubblicazione: (2024)
MBIAS: Mitigating Bias in Large Language Models While Retaining Context
di: Raza, Shaina, et al.
Pubblicazione: (2024)
di: Raza, Shaina, et al.
Pubblicazione: (2024)
Evaluating Gender Bias in Large Language Models
di: Döll, Michael, et al.
Pubblicazione: (2024)
di: Döll, Michael, et al.
Pubblicazione: (2024)
Mitigating Gender Bias in Code Large Language Models via Model Editing
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
Failing to Falsify: Evaluating and Mitigating Confirmation Bias in Language Models
di: Jhaveri, Ayush Rajesh, et al.
Pubblicazione: (2026)
di: Jhaveri, Ayush Rajesh, et al.
Pubblicazione: (2026)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
Exploring Causal Effect of Social Bias on Faithfulness Hallucinations in Large Language Models
di: Zhang, Zhenliang, et al.
Pubblicazione: (2025)
di: Zhang, Zhenliang, et al.
Pubblicazione: (2025)
Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework
di: Xu, Zhenjie, et al.
Pubblicazione: (2024)
di: Xu, Zhenjie, et al.
Pubblicazione: (2024)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
di: Zhang, Tao, et al.
Pubblicazione: (2024)
di: Zhang, Tao, et al.
Pubblicazione: (2024)
Bias Beyond English: Evaluating Social Bias and Debiasing Methods in a Low-Resource Setting
di: Zhou, Ej, et al.
Pubblicazione: (2025)
di: Zhou, Ej, et al.
Pubblicazione: (2025)
Explicit vs. Implicit: Investigating Social Bias in Large Language Models through Self-Reflection
di: Zhao, Yachao, et al.
Pubblicazione: (2025)
di: Zhao, Yachao, et al.
Pubblicazione: (2025)
Social Bias in Large Language Models For Bangla: An Empirical Study on Gender and Religious Bias
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
VIGNETTE: Socially Grounded Bias Evaluation for Vision-Language Models
di: Raj, Chahat, et al.
Pubblicazione: (2025)
di: Raj, Chahat, et al.
Pubblicazione: (2025)
Learning Personalized Alignment for Evaluating Open-ended Text Generation
di: Wang, Danqing, et al.
Pubblicazione: (2023)
di: Wang, Danqing, et al.
Pubblicazione: (2023)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
di: Qin, Zhanyue, et al.
Pubblicazione: (2025)
di: Qin, Zhanyue, et al.
Pubblicazione: (2025)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations
di: Nam, Hyunji, et al.
Pubblicazione: (2025)
di: Nam, Hyunji, et al.
Pubblicazione: (2025)
Documenti analoghi
-
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
di: Xie, Tian, et al.
Pubblicazione: (2025) -
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
di: Rani, Arti, et al.
Pubblicazione: (2025) -
Mitigating the Bias of Large Language Model Evaluation
di: Zhou, Hongli, et al.
Pubblicazione: (2024) -
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
di: Wang, Yaxuan, et al.
Pubblicazione: (2026) -
Bias in Large Language Models: Origin, Evaluation, and Mitigation
di: Guo, Yufei, et al.
Pubblicazione: (2024)