Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Yue, Fu, Chengyan, Xiong, Li, Yang, Sibei, Wang, Wenjie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DR.GAP: Mitigating Bias in Large Language Models using Gender-Aware Prompting with Demonstration and Reasoning
di: Qiu, Hongye, et al.
Pubblicazione: (2025)
di: Qiu, Hongye, et al.
Pubblicazione: (2025)
From Individuals to Interactions: Benchmarking Gender Bias in Multimodal Large Language Models from the Lens of Social Relationship
di: Xu, Yue, et al.
Pubblicazione: (2025)
di: Xu, Yue, et al.
Pubblicazione: (2025)
Locating and Mitigating Gender Bias in Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
di: Zhang, Tao, et al.
Pubblicazione: (2024)
di: Zhang, Tao, et al.
Pubblicazione: (2024)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
di: Qin, Zhanyue, et al.
Pubblicazione: (2025)
di: Qin, Zhanyue, et al.
Pubblicazione: (2025)
Mitigating Gender Bias in Code Large Language Models via Model Editing
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
GenderCARE: A Comprehensive Framework for Assessing and Reducing Gender Bias in Large Language Models
di: Tang, Kunsheng, et al.
Pubblicazione: (2024)
di: Tang, Kunsheng, et al.
Pubblicazione: (2024)
Context-Aware Counterfactual Data Augmentation for Gender Bias Mitigation in Language Models
di: Parihar, Shweta, et al.
Pubblicazione: (2026)
di: Parihar, Shweta, et al.
Pubblicazione: (2026)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
$\textit{LinkPrompt}$: Natural and Universal Adversarial Attacks on Prompt-based Language Models
di: Xu, Yue, et al.
Pubblicazione: (2024)
di: Xu, Yue, et al.
Pubblicazione: (2024)
AutoFlow: Automated Workflow Generation for Large Language Model Agents
di: Li, Zelong, et al.
Pubblicazione: (2024)
di: Li, Zelong, et al.
Pubblicazione: (2024)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
Decoding Biases: Automated Methods and LLM Judges for Gender Bias Detection in Language Models
di: Kumar, Shachi H, et al.
Pubblicazione: (2024)
di: Kumar, Shachi H, et al.
Pubblicazione: (2024)
Identifying and Mitigating Social Bias Knowledge in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
Gender Bias in Machine Translation and The Era of Large Language Models
di: Vanmassenhove, Eva
Pubblicazione: (2024)
di: Vanmassenhove, Eva
Pubblicazione: (2024)
Benchmarking Gender and Political Bias in Large Language Models
di: Yang, Jinrui, et al.
Pubblicazione: (2025)
di: Yang, Jinrui, et al.
Pubblicazione: (2025)
ClaimBrush: A Novel Framework for Automated Patent Claim Refinement Based on Large Language Models
di: Kawano, Seiya, et al.
Pubblicazione: (2024)
di: Kawano, Seiya, et al.
Pubblicazione: (2024)
Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
Inclusivity in Large Language Models: Personality Traits and Gender Bias in Scientific Abstracts
di: Pervez, Naseela, et al.
Pubblicazione: (2024)
di: Pervez, Naseela, et al.
Pubblicazione: (2024)
Mitigating Extrinsic Gender Bias for Bangla Classification Tasks
di: Joy, Sajib Kumar Saha, et al.
Pubblicazione: (2024)
di: Joy, Sajib Kumar Saha, et al.
Pubblicazione: (2024)
AutoDetect: Towards a Unified Framework for Automated Weakness Detection in Large Language Models
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
Mitigation of Gender and Ethnicity Bias in AI-Generated Stories through Model Explanations
di: Dimgba, Martha O., et al.
Pubblicazione: (2025)
di: Dimgba, Martha O., et al.
Pubblicazione: (2025)
ParlAI Vote: A Web Platform for Analyzing Gender and Political Bias in Large Language Models
di: Lin, Wenjie, et al.
Pubblicazione: (2025)
di: Lin, Wenjie, et al.
Pubblicazione: (2025)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
di: Liang, Haijian, et al.
Pubblicazione: (2026)
di: Liang, Haijian, et al.
Pubblicazione: (2026)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Promoting Equality in Large Language Models: Identifying and Mitigating the Implicit Bias based on Bayesian Theory
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
Equilibrium Dynamics and Mitigation of Gender Bias in Synthetically Generated Data
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models
di: Chen, Evan, et al.
Pubblicazione: (2025)
di: Chen, Evan, et al.
Pubblicazione: (2025)
TInR: Exploring Tool-Internalized Reasoning in Large Language Models
di: Xu, Qiancheng, et al.
Pubblicazione: (2026)
di: Xu, Qiancheng, et al.
Pubblicazione: (2026)
Pride and Prejudice: LLM Amplifies Self-Bias in Self-Refinement
di: Xu, Wenda, et al.
Pubblicazione: (2024)
di: Xu, Wenda, et al.
Pubblicazione: (2024)
Mitigating Hidden Confounding by Progressive Confounder Imputation via Large Language Models
di: Yang, Hao, et al.
Pubblicazione: (2025)
di: Yang, Hao, et al.
Pubblicazione: (2025)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
di: Wang, Xinyuan, et al.
Pubblicazione: (2025)
di: Wang, Xinyuan, et al.
Pubblicazione: (2025)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
AutoGEEval: A Multimodal and Automated Framework for Geospatial Code Generation on GEE with Large Language Models
di: Hou, Shuyang, et al.
Pubblicazione: (2025)
di: Hou, Shuyang, et al.
Pubblicazione: (2025)
Simulating a Bias Mitigation Scenario in Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models
di: Lan, Jian, et al.
Pubblicazione: (2025)
di: Lan, Jian, et al.
Pubblicazione: (2025)
Enhancing Tool Retrieval with Iterative Feedback from Large Language Models
di: Xu, Qiancheng, et al.
Pubblicazione: (2024)
di: Xu, Qiancheng, et al.
Pubblicazione: (2024)
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
di: Wei, Kangda, et al.
Pubblicazione: (2025)
di: Wei, Kangda, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DR.GAP: Mitigating Bias in Large Language Models using Gender-Aware Prompting with Demonstration and Reasoning
di: Qiu, Hongye, et al.
Pubblicazione: (2025) -
From Individuals to Interactions: Benchmarking Gender Bias in Multimodal Large Language Models from the Lens of Social Relationship
di: Xu, Yue, et al.
Pubblicazione: (2025) -
Locating and Mitigating Gender Bias in Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2024) -
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
di: Zhang, Tao, et al.
Pubblicazione: (2024) -
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
di: Qin, Zhanyue, et al.
Pubblicazione: (2025)