Group Fairness Meets the Black Box: Enabling Fair Algorithms on Closed LLMs via Post-Processing
Fuente:
arXiv
Saved in:
| Main Authors: | Xian, Ruicheng, Wan, Yuxuan, Zhao, Han |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Unified Post-Processing Framework for Group Fairness in Classification
by: Xian, Ruicheng, et al.
Published: (2024)
by: Xian, Ruicheng, et al.
Published: (2024)
Differentially Private Post-Processing for Fair Regression
by: Xian, Ruicheng, et al.
Published: (2024)
by: Xian, Ruicheng, et al.
Published: (2024)
Audit Me If You Can: Query-Efficient Active Fairness Auditing of Black-Box LLMs
by: Hartmann, David, et al.
Published: (2026)
by: Hartmann, David, et al.
Published: (2026)
FFB: A Fair Fairness Benchmark for In-Processing Group Fairness Methods
by: Han, Xiaotian, et al.
Published: (2023)
by: Han, Xiaotian, et al.
Published: (2023)
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
by: Xue, Jiaqi, et al.
Published: (2024)
by: Xue, Jiaqi, et al.
Published: (2024)
Post-Fair Federated Learning: Achieving Group and Community Fairness in Federated Learning via Post-processing
by: Duan, Yuying, et al.
Published: (2024)
by: Duan, Yuying, et al.
Published: (2024)
FRAPPE: A Group Fairness Framework for Post-Processing Everything
by: Tifrea, Alexandru, et al.
Published: (2023)
by: Tifrea, Alexandru, et al.
Published: (2023)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
by: Arzaghi', 'Mina, et al.
Published: (2025)
by: Arzaghi', 'Mina, et al.
Published: (2025)
Algorithmic Fairness in Performative Policy Learning: Escaping the Impossibility of Group Fairness
by: Somerstep, Seamus, et al.
Published: (2024)
by: Somerstep, Seamus, et al.
Published: (2024)
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
by: Shieh, Evan, et al.
Published: (2024)
by: Shieh, Evan, et al.
Published: (2024)
Datasets for Fairness in Language Models: An In-Depth Survey
by: Zhang, Jiale, et al.
Published: (2025)
by: Zhang, Jiale, et al.
Published: (2025)
Balancing the Scales: Reinforcement Learning for Fair Classification
by: Eshuijs, Leon, et al.
Published: (2024)
by: Eshuijs, Leon, et al.
Published: (2024)
Multi-Output Distributional Fairness via Post-Processing
by: Li, Gang, et al.
Published: (2024)
by: Li, Gang, et al.
Published: (2024)
Fairness of ChatGPT
by: Li, Yunqi, et al.
Published: (2023)
by: Li, Yunqi, et al.
Published: (2023)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
by: Song, Kefan, et al.
Published: (2025)
by: Song, Kefan, et al.
Published: (2025)
Fair Representation in Parliamentary Summaries: Measuring and Mitigating Inclusion Bias
by: Cunningham, Eoghan, et al.
Published: (2025)
by: Cunningham, Eoghan, et al.
Published: (2025)
Strategic Demonstration Selection for Improved Fairness in LLM In-Context Learning
by: Hu, Jingyu, et al.
Published: (2024)
by: Hu, Jingyu, et al.
Published: (2024)
Addressing Both Statistical and Causal Gender Fairness in NLP Models
by: Chen, Hannah, et al.
Published: (2024)
by: Chen, Hannah, et al.
Published: (2024)
Whose Preferences? Differences in Fairness Preferences and Their Impact on the Fairness of AI Utilizing Human Feedback
by: Lerner, Emilia Agis, et al.
Published: (2024)
by: Lerner, Emilia Agis, et al.
Published: (2024)
Bias Similarity Measurement: A Black-Box Audit of Fairness Across LLMs
by: Jeong, Hyejun, et al.
Published: (2024)
by: Jeong, Hyejun, et al.
Published: (2024)
Auditing LLMs for Algorithmic Fairness in Casenote-Augmented Tabular Prediction
by: Lee, Xiao Qi, et al.
Published: (2026)
by: Lee, Xiao Qi, et al.
Published: (2026)
LangFair: A Python Package for Assessing Bias and Fairness in Large Language Model Use Cases
by: Bouchard, Dylan, et al.
Published: (2025)
by: Bouchard, Dylan, et al.
Published: (2025)
LLM-Assisted Content Conditional Debiasing for Fair Text Embedding
by: Deng, Wenlong, et al.
Published: (2024)
by: Deng, Wenlong, et al.
Published: (2024)
FairPair: A Robust Evaluation of Biases in Language Models through Paired Perturbations
by: Dwivedi-Yu, Jane, et al.
Published: (2024)
by: Dwivedi-Yu, Jane, et al.
Published: (2024)
On the (In)Compatibility between Group Fairness and Individual Fairness
by: Xu, Shizhou, et al.
Published: (2024)
by: Xu, Shizhou, et al.
Published: (2024)
Accept or Deny? Evaluating LLM Fairness and Performance in Loan Approval across Table-to-Text Serialization Approaches
by: Azime, Israel Abebe, et al.
Published: (2025)
by: Azime, Israel Abebe, et al.
Published: (2025)
Migrate Demographic Group For Fair GNNs
by: Hu, YanMing, et al.
Published: (2023)
by: Hu, YanMing, et al.
Published: (2023)
Bias and Fairness in Large Language Models: A Survey
by: Gallegos, Isabel O., et al.
Published: (2023)
by: Gallegos, Isabel O., et al.
Published: (2023)
Why Don't Prompt-Based Fairness Metrics Correlate?
by: Zayed, Abdelrahman, et al.
Published: (2024)
by: Zayed, Abdelrahman, et al.
Published: (2024)
In the Name of Fairness: Assessing the Bias in Clinical Record De-identification
by: Xiao, Yuxin, et al.
Published: (2023)
by: Xiao, Yuxin, et al.
Published: (2023)
Should We Attend More or Less? Modulating Attention for Fairness
by: Zayed, Abdelrahman, et al.
Published: (2023)
by: Zayed, Abdelrahman, et al.
Published: (2023)
Exploring Accuracy-Fairness Trade-off in Large Language Models
by: Zhang, Qingquan, et al.
Published: (2024)
by: Zhang, Qingquan, et al.
Published: (2024)
Unprocessing Seven Years of Algorithmic Fairness
by: Cruz, André F., et al.
Published: (2023)
by: Cruz, André F., et al.
Published: (2023)
Bias Begins with Data: The FairGround Corpus for Robust and Reproducible Research on Algorithmic Fairness
by: Simson, Jan, et al.
Published: (2025)
by: Simson, Jan, et al.
Published: (2025)
A Post-Processing-Based Fair Federated Learning Framework
by: Zhou, Yi, et al.
Published: (2025)
by: Zhou, Yi, et al.
Published: (2025)
Fairness Risks for Group-conditionally Missing Demographics
by: Jiang, Kaiqi, et al.
Published: (2024)
by: Jiang, Kaiqi, et al.
Published: (2024)
On Demographic Group Fairness Guarantees in Deep Learning
by: Luo, Yan, et al.
Published: (2024)
by: Luo, Yan, et al.
Published: (2024)
FairFedMed: Benchmarking Group Fairness in Federated Medical Imaging with FairLoRA
by: Li, Minghan, et al.
Published: (2025)
by: Li, Minghan, et al.
Published: (2025)
Procedural Fairness via Group Counterfactual Explanation
by: Popoola, Gideon, et al.
Published: (2026)
by: Popoola, Gideon, et al.
Published: (2026)
OxonFair: A Flexible Toolkit for Algorithmic Fairness
by: Delaney, Eoin, et al.
Published: (2024)
by: Delaney, Eoin, et al.
Published: (2024)
Similar Items
-
A Unified Post-Processing Framework for Group Fairness in Classification
by: Xian, Ruicheng, et al.
Published: (2024) -
Differentially Private Post-Processing for Fair Regression
by: Xian, Ruicheng, et al.
Published: (2024) -
Audit Me If You Can: Query-Efficient Active Fairness Auditing of Black-Box LLMs
by: Hartmann, David, et al.
Published: (2026) -
FFB: A Fair Fairness Benchmark for In-Processing Group Fairness Methods
by: Han, Xiaotian, et al.
Published: (2023) -
BadFair: Backdoored Fairness Attacks with Group-conditioned Triggers
by: Xue, Jiaqi, et al.
Published: (2024)