Context-Aware Counterfactual Data Augmentation for Gender Bias Mitigation in Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Parihar, Shweta, Guangliang, Liu, Parde, Natalie, Cheng, Lu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Social Bias in RAG Systems: When External Context Helps and Reasoning Hurts
par: Parihar, Shweta, et autres
Publié: (2026)
par: Parihar, Shweta, et autres
Publié: (2026)
Locating and Mitigating Gender Bias in Large Language Models
par: Cai, Yuchen, et autres
Publié: (2024)
par: Cai, Yuchen, et autres
Publié: (2024)
What Do LLMs Know About Alzheimer's Disease? Multi-loss Fine-Tuning and Probing for AD Detection
par: Jiang, Lei, et autres
Publié: (2026)
par: Jiang, Lei, et autres
Publié: (2026)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
DR.GAP: Mitigating Bias in Large Language Models using Gender-Aware Prompting with Demonstration and Reasoning
par: Qiu, Hongye, et autres
Publié: (2025)
par: Qiu, Hongye, et autres
Publié: (2025)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
par: Qin, Zhanyue, et autres
Publié: (2025)
par: Qin, Zhanyue, et autres
Publié: (2025)
Equilibrium Dynamics and Mitigation of Gender Bias in Synthetically Generated Data
par: Kattamuri, Ashish, et autres
Publié: (2025)
par: Kattamuri, Ashish, et autres
Publié: (2025)
Mitigating Gender Bias in Code Large Language Models via Model Editing
par: Qin, Zhanyue, et autres
Publié: (2024)
par: Qin, Zhanyue, et autres
Publié: (2024)
Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
par: Xu, Yue, et autres
Publié: (2025)
par: Xu, Yue, et autres
Publié: (2025)
BRIDGE the Gap: Mitigating Bias Amplification in Automated Scoring of English Language Learners via Inter-group Data Augmentation
par: Wang, Yun, et autres
Publié: (2026)
par: Wang, Yun, et autres
Publié: (2026)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
par: Feng, Yijun
Publié: (2025)
par: Feng, Yijun
Publié: (2025)
Mitigation of Gender and Ethnicity Bias in AI-Generated Stories through Model Explanations
par: Dimgba, Martha O., et autres
Publié: (2025)
par: Dimgba, Martha O., et autres
Publié: (2025)
Identifying and Mitigating Social Bias Knowledge in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Relation-based Counterfactual Data Augmentation and Contrastive Learning for Robustifying Natural Language Inference Models
par: Yang, Heerin, et autres
Publié: (2024)
par: Yang, Heerin, et autres
Publié: (2024)
GenderCARE: A Comprehensive Framework for Assessing and Reducing Gender Bias in Large Language Models
par: Tang, Kunsheng, et autres
Publié: (2024)
par: Tang, Kunsheng, et autres
Publié: (2024)
Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models
par: Lan, Jian, et autres
Publié: (2025)
par: Lan, Jian, et autres
Publié: (2025)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Untie the Knots: An Efficient Data Augmentation Strategy for Long-Context Pre-Training in Language Models
par: Tian, Junfeng, et autres
Publié: (2024)
par: Tian, Junfeng, et autres
Publié: (2024)
Evaluating Gender Bias Transfer between Pre-trained and Prompt-Adapted Language Models
par: Mackraz, Natalie, et autres
Publié: (2024)
par: Mackraz, Natalie, et autres
Publié: (2024)
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
par: Wei, Kangda, et autres
Publié: (2025)
par: Wei, Kangda, et autres
Publié: (2025)
Explainable AI: XAI-Guided Context-Aware Data Augmentation
par: Mersha, Melkamu Abay, et autres
Publié: (2025)
par: Mersha, Melkamu Abay, et autres
Publié: (2025)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
par: Zheng, Jinquan, et autres
Publié: (2026)
par: Zheng, Jinquan, et autres
Publié: (2026)
Significance of Chain of Thought in Gender Bias Mitigation for English-Dravidian Machine Translation
par: Prahallad, Lavanya, et autres
Publié: (2024)
par: Prahallad, Lavanya, et autres
Publié: (2024)
Mitigating Extrinsic Gender Bias for Bangla Classification Tasks
par: Joy, Sajib Kumar Saha, et autres
Publié: (2024)
par: Joy, Sajib Kumar Saha, et autres
Publié: (2024)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
par: Chen, Yuxing, et autres
Publié: (2026)
par: Chen, Yuxing, et autres
Publié: (2026)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
par: Oi, Masanari, et autres
Publié: (2024)
par: Oi, Masanari, et autres
Publié: (2024)
CORI: CJKV Benchmark with Romanization Integration -- A step towards Cross-lingual Transfer Beyond Textual Scripts
par: Nguyen, Hoang H., et autres
Publié: (2024)
par: Nguyen, Hoang H., et autres
Publié: (2024)
Detecting and Mitigating Bias in LLMs through Knowledge Graph-Augmented Training
par: Kumar, Rajeev, et autres
Publié: (2025)
par: Kumar, Rajeev, et autres
Publié: (2025)
LLM-Guided Synthetic Augmentation (LGSA) for Mitigating Bias in AI Systems
par: Karri, Sai Suhruth Reddy, et autres
Publié: (2025)
par: Karri, Sai Suhruth Reddy, et autres
Publié: (2025)
Gender Bias in Machine Translation and The Era of Large Language Models
par: Vanmassenhove, Eva
Publié: (2024)
par: Vanmassenhove, Eva
Publié: (2024)
GenderBias-\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing
par: Xiao, Yisong, et autres
Publié: (2024)
par: Xiao, Yisong, et autres
Publié: (2024)
Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks
par: Li, Miaomiao, et autres
Publié: (2025)
par: Li, Miaomiao, et autres
Publié: (2025)
Mitigating Gender Bias in Depression Detection via Counterfactual Inference
par: Hu, Mingxuan, et autres
Publié: (2025)
par: Hu, Mingxuan, et autres
Publié: (2025)
Bias Vector: Mitigating Biases in Language Models with Task Arithmetic Approach
par: Shirafuji, Daiki, et autres
Publié: (2024)
par: Shirafuji, Daiki, et autres
Publié: (2024)
Large Language Models as Theory of Mind Aware Generative Agents with Counterfactual Reflection
par: Yang, Bo, et autres
Publié: (2025)
par: Yang, Bo, et autres
Publié: (2025)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
par: Wang, Ze, et autres
Publié: (2024)
par: Wang, Ze, et autres
Publié: (2024)
Inclusivity in Large Language Models: Personality Traits and Gender Bias in Scientific Abstracts
par: Pervez, Naseela, et autres
Publié: (2024)
par: Pervez, Naseela, et autres
Publié: (2024)
Layer-wise Positional Bias in Short-Context Language Modeling
par: Rahimi, Maryam, et autres
Publié: (2026)
par: Rahimi, Maryam, et autres
Publié: (2026)
Understanding and Mitigating Tokenization Bias in Language Models
par: Phan, Buu, et autres
Publié: (2024)
par: Phan, Buu, et autres
Publié: (2024)
Documents similaires
-
Evaluating Social Bias in RAG Systems: When External Context Helps and Reasoning Hurts
par: Parihar, Shweta, et autres
Publié: (2026) -
Locating and Mitigating Gender Bias in Large Language Models
par: Cai, Yuchen, et autres
Publié: (2024) -
What Do LLMs Know About Alzheimer's Disease? Multi-loss Fine-Tuning and Probing for AD Detection
par: Jiang, Lei, et autres
Publié: (2026) -
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
par: Zhang, Tao, et autres
Publié: (2024) -
DR.GAP: Mitigating Bias in Large Language Models using Gender-Aware Prompting with Demonstration and Reasoning
par: Qiu, Hongye, et autres
Publié: (2025)