LLMs Are Not a Silver Bullet: A Case Study on Software Fairness
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Xinyue, Li, Sixuan, Xiao, Ying, Zhang, Jie M., Yang, Zhou, Liu, Xuanzhe, Chen, Zhenpeng |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Diversity Drives Fairness: Ensemble of Higher Order Mutants for Intersectional Fairness of Machine Learning Software
by: Chen, Zhenpeng, et al.
Published: (2024)
by: Chen, Zhenpeng, et al.
Published: (2024)
Bias Behind the Wheel: Fairness Testing of Autonomous Driving Systems
by: Li, Xinyue, et al.
Published: (2023)
by: Li, Xinyue, et al.
Published: (2023)
Promptware Engineering: Software Engineering for Prompt-Enabled Systems
by: Chen, Zhenpeng, et al.
Published: (2025)
by: Chen, Zhenpeng, et al.
Published: (2025)
No Silver Bullets: Why Understanding Software Cycle Time is Messy, Not Magic
by: Flournoy, John C., et al.
Published: (2025)
by: Flournoy, John C., et al.
Published: (2025)
GenAI Is No Silver Bullet for Qualitative Research in Software Engineering
by: Ernst, Neil A., et al.
Published: (2026)
by: Ernst, Neil A., et al.
Published: (2026)
EET: Experience-Driven Early Termination for Cost-Efficient Software Engineering Agents
by: Guo, Yaoqi, et al.
Published: (2026)
by: Guo, Yaoqi, et al.
Published: (2026)
Fairness Testing: A Comprehensive Survey and Analysis of Trends
by: Chen, Zhenpeng, et al.
Published: (2022)
by: Chen, Zhenpeng, et al.
Published: (2022)
SCOPE: Performance Testing for Serverless Computing
by: Wen, Jinfeng, et al.
Published: (2023)
by: Wen, Jinfeng, et al.
Published: (2023)
Is Multi-Agent Debate (MAD) the Silver Bullet? An Empirical Analysis of MAD in Code Summarization and Translation
by: Chun, Jina, et al.
Published: (2025)
by: Chun, Jina, et al.
Published: (2025)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
by: Chen, Yuxuan, et al.
Published: (2024)
by: Chen, Yuxuan, et al.
Published: (2024)
A First Look at Bugs in LLM Inference Engines
by: Liu, Mugeng, et al.
Published: (2025)
by: Liu, Mugeng, et al.
Published: (2025)
Towards Trustworthy LLMs for Code: A Data-Centric Synergistic Auditing Framework
by: Wang, Chong, et al.
Published: (2024)
by: Wang, Chong, et al.
Published: (2024)
Enhancing Code Generation for Low-Resource Languages: No Silver Bullet
by: Giagnorio, Alessandro, et al.
Published: (2025)
by: Giagnorio, Alessandro, et al.
Published: (2025)
Research Artifacts in Software Engineering Publications: Status and Trends
by: Liu, Mugeng, et al.
Published: (2024)
by: Liu, Mugeng, et al.
Published: (2024)
An Empirical Study on the Potential of LLMs in Automated Software Refactoring
by: Liu, Bo, et al.
Published: (2024)
by: Liu, Bo, et al.
Published: (2024)
REprompt: Prompt Generation for Intelligent Software Development Guided by Requirements Engineering
by: Shi, Junjie, et al.
Published: (2026)
by: Shi, Junjie, et al.
Published: (2026)
Agent-Based Software Artifact Evaluation
by: Wu, Zhaonan, et al.
Published: (2026)
by: Wu, Zhaonan, et al.
Published: (2026)
Fairness Is Not Just Ethical: Performance Trade-Off via Data Correlation Tuning to Mitigate Bias in ML Software
by: Xiao, Ying, et al.
Published: (2025)
by: Xiao, Ying, et al.
Published: (2025)
Fairness Improvement with Multiple Protected Attributes: How Far Are We?
by: Chen, Zhenpeng, et al.
Published: (2023)
by: Chen, Zhenpeng, et al.
Published: (2023)
UCRBench: Benchmarking LLMs on Use Case Recovery
by: Xiao, Shuyuan, et al.
Published: (2025)
by: Xiao, Shuyuan, et al.
Published: (2025)
How Fair is Software Fairness Testing?
by: Barcomb, Ann, et al.
Published: (2026)
by: Barcomb, Ann, et al.
Published: (2026)
Using LLMs in Generating Design Rationale for Software Architecture Decisions
by: Zhou, Xiyu, et al.
Published: (2025)
by: Zhou, Xiyu, et al.
Published: (2025)
LLMs are Bug Replicators: An Empirical Study on LLMs' Capability in Completing Bug-prone Code
by: Guo, Liwei, et al.
Published: (2025)
by: Guo, Liwei, et al.
Published: (2025)
Personality-Guided Code Generation Using Large Language Models
by: Guo, Yaoqi, et al.
Published: (2024)
by: Guo, Yaoqi, et al.
Published: (2024)
Software Fairness Debt
by: Santos, Ronnie de Souza, et al.
Published: (2024)
by: Santos, Ronnie de Souza, et al.
Published: (2024)
Is Self-Repair a Silver Bullet for Code Generation?
by: Olausson, Theo X., et al.
Published: (2023)
by: Olausson, Theo X., et al.
Published: (2023)
Large Language Model-Based Agents for Software Engineering: A Survey
by: Liu, Junwei, et al.
Published: (2024)
by: Liu, Junwei, et al.
Published: (2024)
No Silver Bullet: Towards Demonstrating Secure Software Development for Danish Small and Medium Enterprises in a Business-to-Business Model
by: Asadi, Raha, et al.
Published: (2025)
by: Asadi, Raha, et al.
Published: (2025)
Software Fairness: An Analysis and Survey
by: Soremekun, Ezekiel, et al.
Published: (2022)
by: Soremekun, Ezekiel, et al.
Published: (2022)
Software Fairness Testing in Practice
by: Santos, Ronnie de Souza, et al.
Published: (2025)
by: Santos, Ronnie de Souza, et al.
Published: (2025)
LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs
by: Liu, Kaibo, et al.
Published: (2024)
by: Liu, Kaibo, et al.
Published: (2024)
A Study on Thinking Patterns of Large Reasoning Models in Code Generation
by: Halim, Kevin, et al.
Published: (2025)
by: Halim, Kevin, et al.
Published: (2025)
Investigating Code Reuse in Software Redesign: A Case Study
by: Zhang, Xiaowen, et al.
Published: (2026)
by: Zhang, Xiaowen, et al.
Published: (2026)
FairRF: Multi-Objective Search for Single and Intersectional Software Fairness
by: d'Alosio, Giordano, et al.
Published: (2026)
by: d'Alosio, Giordano, et al.
Published: (2026)
Research on WebAssembly Runtimes: A Survey
by: Zhang, Yixuan, et al.
Published: (2024)
by: Zhang, Yixuan, et al.
Published: (2024)
When Automated Program Repair Meets Regression Testing -- An Extensive Study on 2 Million Patches
by: Lou, Yiling, et al.
Published: (2021)
by: Lou, Yiling, et al.
Published: (2021)
Team Diversity Promotes Software Fairness: An Experiment on Fairness-Aware Requirements Prioritization
by: Magalhes, Cleyton, et al.
Published: (2026)
by: Magalhes, Cleyton, et al.
Published: (2026)
Fairness-First Design Thinking for Software Architecture
by: Fatima, Iffat, et al.
Published: (2026)
by: Fatima, Iffat, et al.
Published: (2026)
Exploring the Landscape of Fairness Interventions in Software Engineering
by: Mim, Sadia Afrin
Published: (2025)
by: Mim, Sadia Afrin
Published: (2025)
Software development in the age of LLMs and XR
by: Gonzalez-Barahona, Jesus M.
Published: (2024)
by: Gonzalez-Barahona, Jesus M.
Published: (2024)
Similar Items
-
Diversity Drives Fairness: Ensemble of Higher Order Mutants for Intersectional Fairness of Machine Learning Software
by: Chen, Zhenpeng, et al.
Published: (2024) -
Bias Behind the Wheel: Fairness Testing of Autonomous Driving Systems
by: Li, Xinyue, et al.
Published: (2023) -
Promptware Engineering: Software Engineering for Prompt-Enabled Systems
by: Chen, Zhenpeng, et al.
Published: (2025) -
No Silver Bullets: Why Understanding Software Cycle Time is Messy, Not Magic
by: Flournoy, John C., et al.
Published: (2025) -
GenAI Is No Silver Bullet for Qualitative Research in Software Engineering
by: Ernst, Neil A., et al.
Published: (2026)