Fairness Mediator: Neutralize Stereotype Associations to Mitigate Bias in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiao, Yisong, Liu, Aishan, Liang, Siyuan, Liu, Xianglong, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Latent Imitator: Generating Natural Individual Discriminatory Instances for Black-Box Fairness Testing
par: Xiao, Yisong, et autres
Publié: (2023)
par: Xiao, Yisong, et autres
Publié: (2023)
BDefects4NN: A Backdoor Defect Database for Controlled Localization Studies in Neural Networks
par: Xiao, Yisong, et autres
Publié: (2024)
par: Xiao, Yisong, et autres
Publié: (2024)
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing
par: Xiao, Yisong, et autres
Publié: (2025)
par: Xiao, Yisong, et autres
Publié: (2025)
Bias Ahead: Sensitive Prompts as Early Warnings for Fairness in Large Language Models
par: Voria, Gianmario, et autres
Publié: (2026)
par: Voria, Gianmario, et autres
Publié: (2026)
From Context to Intent: Reasoning-Guided Function-Level Code Completion
par: Li, Yanzhou, et autres
Publié: (2025)
par: Li, Yanzhou, et autres
Publié: (2025)
Fairness Is Not Just Ethical: Performance Trade-Off via Data Correlation Tuning to Mitigate Bias in ML Software
par: Xiao, Ying, et autres
Publié: (2025)
par: Xiao, Ying, et autres
Publié: (2025)
CodeChemist: Functional Knowledge Transfer for Low-Resource Code Generation via Test-Time Scaling
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
SCOPE: A Dataset of Stereotyped Prompts for Counterfactual Fairness Assessment of LLMs
par: Parziale, Alessandra, et autres
Publié: (2026)
par: Parziale, Alessandra, et autres
Publié: (2026)
Mitigating Gender Bias in Code Large Language Models via Model Editing
par: Qin, Zhanyue, et autres
Publié: (2024)
par: Qin, Zhanyue, et autres
Publié: (2024)
Meta-Fair: AI-Assisted Fairness Testing of Large Language Models
par: Romero-Arjona, Miguel, et autres
Publié: (2025)
par: Romero-Arjona, Miguel, et autres
Publié: (2025)
Investigating Training Data Detection in AI Coders
par: Li, Tianlin, et autres
Publié: (2025)
par: Li, Tianlin, et autres
Publié: (2025)
CodeMorph: Mitigating Data Leakage in Large Language Model Assessment
par: Rao, Hongzhou, et autres
Publié: (2025)
par: Rao, Hongzhou, et autres
Publié: (2025)
GenFair: Systematic Test Generation for Fairness Fault Detection in Large Language Models
par: Srinivasan, Madhusudan, et autres
Publié: (2025)
par: Srinivasan, Madhusudan, et autres
Publié: (2025)
Identifying and Mitigating API Misuse in Large Language Models
par: Zhuo, Terry Yue, et autres
Publié: (2025)
par: Zhuo, Terry Yue, et autres
Publié: (2025)
Generating Mitigations for Downstream Projects to Neutralize Upstream Library Vulnerability
par: Chen, Zirui, et autres
Publié: (2025)
par: Chen, Zirui, et autres
Publié: (2025)
From Bias To Improved Prompts: A Case Study of Bias Mitigation of Clone Detection Models
par: Chen, QiHong, et autres
Publié: (2025)
par: Chen, QiHong, et autres
Publié: (2025)
Where Is Self-admitted Code Generated by Large Language Models on GitHub?
par: Yu, Xiao, et autres
Publié: (2024)
par: Yu, Xiao, et autres
Publié: (2024)
Efficient Fairness Testing in Large Language Models: Prioritizing Metamorphic Relations for Bias Detection
par: Giramata, Suavis, et autres
Publié: (2025)
par: Giramata, Suavis, et autres
Publié: (2025)
Toward Systematic Counterfactual Fairness Evaluation of Large Language Models: The CAFFE Framework
par: Parziale, Alessandra, et autres
Publié: (2025)
par: Parziale, Alessandra, et autres
Publié: (2025)
Lifting the Veil on Composition, Risks, and Mitigations of the Large Language Model Supply Chain
par: Huang, Kaifeng, et autres
Publié: (2024)
par: Huang, Kaifeng, et autres
Publié: (2024)
Analyzing and Mitigating Surface Bias in Code Evaluation Metrics
par: Dristi, Simantika Bhattacharjee, et autres
Publié: (2025)
par: Dristi, Simantika Bhattacharjee, et autres
Publié: (2025)
Mitigating Omitted Variable Bias in Empirical Software Engineering
par: Furia, Carlo A., et autres
Publié: (2025)
par: Furia, Carlo A., et autres
Publié: (2025)
Large Language Models for Unit Testing: A Systematic Literature Review
par: Zhang, Quanjun, et autres
Publié: (2025)
par: Zhang, Quanjun, et autres
Publié: (2025)
FlexFL: Flexible and Effective Fault Localization with Open-Source Large Language Models
par: Xu, Chuyang, et autres
Publié: (2024)
par: Xu, Chuyang, et autres
Publié: (2024)
GenderBias-\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing
par: Xiao, Yisong, et autres
Publié: (2024)
par: Xiao, Yisong, et autres
Publié: (2024)
ROCODE: Integrating Backtracking Mechanism and Program Analysis in Large Language Models for Code Generation
par: Jiang, Xue, et autres
Publié: (2024)
par: Jiang, Xue, et autres
Publié: (2024)
TickIt: Leveraging Large Language Models for Automated Ticket Escalation
par: Liu, Fengrui, et autres
Publié: (2025)
par: Liu, Fengrui, et autres
Publié: (2025)
Optimizing Case-Based Reasoning System for Functional Test Script Generation with Large Language Models
par: Guo, Siyuan, et autres
Publié: (2025)
par: Guo, Siyuan, et autres
Publié: (2025)
Narrowing the Complexity Gap in the Evaluation of Large Language Models
par: Chen, Yang, et autres
Publié: (2026)
par: Chen, Yang, et autres
Publié: (2026)
Instructive Code Retriever: Learn from Large Language Model's Feedback for Code Intelligence Tasks
par: Lu, Jiawei, et autres
Publié: (2024)
par: Lu, Jiawei, et autres
Publié: (2024)
On the Evaluation of Large Language Models in Unit Test Generation
par: Yang, Lin, et autres
Publié: (2024)
par: Yang, Lin, et autres
Publié: (2024)
Evolution of Kernels: Automated RISC-V Kernel Optimization with Large Language Models
par: Chen, Siyuan, et autres
Publié: (2025)
par: Chen, Siyuan, et autres
Publié: (2025)
Nigerian Software Engineer or American Data Scientist? GitHub Profile Recruitment Bias in Large Language Models
par: Nakano, Takashi, et autres
Publié: (2024)
par: Nakano, Takashi, et autres
Publié: (2024)
Efficient Function Orchestration for Large Language Models
par: Liu, Xiaoxia, et autres
Publié: (2025)
par: Liu, Xiaoxia, et autres
Publié: (2025)
Code2Bench: Scaling Source and Rigor for Dynamic Benchmark Construction
par: Zhang, Zhe, et autres
Publié: (2025)
par: Zhang, Zhe, et autres
Publié: (2025)
A Tool for In-depth Analysis of Code Execution Reasoning of Large Language Models
par: Liu, Changshu, et autres
Publié: (2025)
par: Liu, Changshu, et autres
Publié: (2025)
Unveiling Bias in Fairness Evaluations of Large Language Models: A Critical Literature Review of Music and Movie Recommendation Systems
par: Sah, Chandan Kumar, et autres
Publié: (2024)
par: Sah, Chandan Kumar, et autres
Publié: (2024)
Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models
par: Liu, Changshu, et autres
Publié: (2025)
par: Liu, Changshu, et autres
Publié: (2025)
Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization
par: Xu, Hexiang, et autres
Publié: (2025)
par: Xu, Hexiang, et autres
Publié: (2025)
Documents similaires
-
Latent Imitator: Generating Natural Individual Discriminatory Instances for Black-Box Fairness Testing
par: Xiao, Yisong, et autres
Publié: (2023) -
BDefects4NN: A Backdoor Defect Database for Controlled Localization Studies in Neural Networks
par: Xiao, Yisong, et autres
Publié: (2024) -
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
par: Wang, Kaixin, et autres
Publié: (2025) -
Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing
par: Xiao, Yisong, et autres
Publié: (2025) -
Bias Ahead: Sensitive Prompts as Early Warnings for Fairness in Large Language Models
par: Voria, Gianmario, et autres
Publié: (2026)