Collapsed Language Models Promote Fairness
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xu, Jingxuan, Chen, Wuyang, Li, Linyi, Zhao, Yao, Wei, Yunchao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Transferable and Principled Efficiency for Open-Vocabulary Segmentation
von: Xu, Jingxuan, et al.
Veröffentlicht: (2024)
von: Xu, Jingxuan, et al.
Veröffentlicht: (2024)
AI Safety in Generative AI Large Language Models: A Survey
von: Chua, Jaymari, et al.
Veröffentlicht: (2024)
von: Chua, Jaymari, et al.
Veröffentlicht: (2024)
Datasets for Fairness in Language Models: An In-Depth Survey
von: Zhang, Jiale, et al.
Veröffentlicht: (2025)
von: Zhang, Jiale, et al.
Veröffentlicht: (2025)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
von: Song, Kefan, et al.
Veröffentlicht: (2025)
von: Song, Kefan, et al.
Veröffentlicht: (2025)
Are Models Trained on Indian Legal Data Fair?
von: Girhepuje, Sahil, et al.
Veröffentlicht: (2023)
von: Girhepuje, Sahil, et al.
Veröffentlicht: (2023)
Urban Computing in the Era of Large Language Models
von: Li, Zhonghang, et al.
Veröffentlicht: (2025)
von: Li, Zhonghang, et al.
Veröffentlicht: (2025)
Evaluating Proactive Risk Awareness of Large Language Models
von: Luo, Xuan, et al.
Veröffentlicht: (2026)
von: Luo, Xuan, et al.
Veröffentlicht: (2026)
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
von: Li, Kun, et al.
Veröffentlicht: (2025)
von: Li, Kun, et al.
Veröffentlicht: (2025)
Listen and Speak Fairly: A Study on Semantic Gender Bias in Speech Integrated Large Language Models
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2024)
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2024)
Language of Thought Shapes Output Diversity in Large Language Models
von: Xu, Shaoyang, et al.
Veröffentlicht: (2026)
von: Xu, Shaoyang, et al.
Veröffentlicht: (2026)
Walking in Others' Shoes: How Perspective-Taking Guides Large Language Models in Reducing Toxicity and Bias
von: Xu, Rongwu, et al.
Veröffentlicht: (2024)
von: Xu, Rongwu, et al.
Veröffentlicht: (2024)
Evaluating Large Language Models on Spatial Tasks: A Multi-Task Benchmarking Study
von: Xu, Liuchang, et al.
Veröffentlicht: (2024)
von: Xu, Liuchang, et al.
Veröffentlicht: (2024)
Addressing Both Statistical and Causal Gender Fairness in NLP Models
von: Chen, Hannah, et al.
Veröffentlicht: (2024)
von: Chen, Hannah, et al.
Veröffentlicht: (2024)
FairPair: A Robust Evaluation of Biases in Language Models through Paired Perturbations
von: Dwivedi-Yu, Jane, et al.
Veröffentlicht: (2024)
von: Dwivedi-Yu, Jane, et al.
Veröffentlicht: (2024)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
von: Wang, Ze, et al.
Veröffentlicht: (2024)
von: Wang, Ze, et al.
Veröffentlicht: (2024)
Group Fairness Meets the Black Box: Enabling Fair Algorithms on Closed LLMs via Post-Processing
von: Xian, Ruicheng, et al.
Veröffentlicht: (2025)
von: Xian, Ruicheng, et al.
Veröffentlicht: (2025)
Can Large Language Models Understand You Better? An MBTI Personality Detection Dataset Aligned with Population Traits
von: Li, Bohan, et al.
Veröffentlicht: (2024)
von: Li, Bohan, et al.
Veröffentlicht: (2024)
AXOLOTL: Fairness through Assisted Self-Debiasing of Large Language Model Outputs
von: Ebrahimi, Sana, et al.
Veröffentlicht: (2024)
von: Ebrahimi, Sana, et al.
Veröffentlicht: (2024)
Bias and Fairness in Large Language Models: A Survey
von: Gallegos, Isabel O., et al.
Veröffentlicht: (2023)
von: Gallegos, Isabel O., et al.
Veröffentlicht: (2023)
Leveraging Large Language Models for Career Mobility Analysis: A Study of Gender, Race, and Job Change Using U.S. Online Resume Profiles
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
Human-Level and Beyond: Benchmarking Large Language Models Against Clinical Pharmacists in Prescription Review
von: Yang, Yan, et al.
Veröffentlicht: (2025)
von: Yang, Yan, et al.
Veröffentlicht: (2025)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
von: Arzaghi', 'Mina, et al.
Veröffentlicht: (2025)
von: Arzaghi', 'Mina, et al.
Veröffentlicht: (2025)
LangFair: A Python Package for Assessing Bias and Fairness in Large Language Model Use Cases
von: Bouchard, Dylan, et al.
Veröffentlicht: (2025)
von: Bouchard, Dylan, et al.
Veröffentlicht: (2025)
Epistemic Diversity and Knowledge Collapse in Large Language Models
von: Wright, Dustin, et al.
Veröffentlicht: (2025)
von: Wright, Dustin, et al.
Veröffentlicht: (2025)
The Collapse of Heterogeneity in Silicon Philosophers
von: Shi, Yuanming, et al.
Veröffentlicht: (2026)
von: Shi, Yuanming, et al.
Veröffentlicht: (2026)
Promotional Language and the Adoption of Innovative Ideas in Science
von: Peng, Hao, et al.
Veröffentlicht: (2024)
von: Peng, Hao, et al.
Veröffentlicht: (2024)
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
von: Shieh, Evan, et al.
Veröffentlicht: (2024)
von: Shieh, Evan, et al.
Veröffentlicht: (2024)
Exploring Accuracy-Fairness Trade-off in Large Language Models
von: Zhang, Qingquan, et al.
Veröffentlicht: (2024)
von: Zhang, Qingquan, et al.
Veröffentlicht: (2024)
EcoLANG: Efficient and Effective Agent Communication Language Induction for Social Simulation
von: Mou, Xinyi, et al.
Veröffentlicht: (2025)
von: Mou, Xinyi, et al.
Veröffentlicht: (2025)
Whose Journey Matters? Investigating Identity Biases in Large Language Models (LLMs) for Travel Planning Assistance
von: Ren, Ruiping, et al.
Veröffentlicht: (2024)
von: Ren, Ruiping, et al.
Veröffentlicht: (2024)
On Classification with Large Language Models in Cultural Analytics
von: Bamman, David, et al.
Veröffentlicht: (2024)
von: Bamman, David, et al.
Veröffentlicht: (2024)
LLM-Assisted Content Conditional Debiasing for Fair Text Embedding
von: Deng, Wenlong, et al.
Veröffentlicht: (2024)
von: Deng, Wenlong, et al.
Veröffentlicht: (2024)
Benchmarking Political Persuasion Risks Across Frontier Large Language Models
von: Chen, Zhongren, et al.
Veröffentlicht: (2026)
von: Chen, Zhongren, et al.
Veröffentlicht: (2026)
From Imitation to Introspection: Probing Self-Consciousness in Language Models
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
von: Wang, Yuhang, et al.
Veröffentlicht: (2023)
von: Wang, Yuhang, et al.
Veröffentlicht: (2023)
Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMs
von: Wang, Angelina, et al.
Veröffentlicht: (2025)
von: Wang, Angelina, et al.
Veröffentlicht: (2025)
Position: the Stochastic Parrot in the Coal Mine. Model Collapse is a Threat to Low-Resource Communities
von: Jarvis, Devon, et al.
Veröffentlicht: (2026)
von: Jarvis, Devon, et al.
Veröffentlicht: (2026)
"Mirror" Language AI Models of Depression are Criterion-Contaminated
von: Li, Tong, et al.
Veröffentlicht: (2025)
von: Li, Tong, et al.
Veröffentlicht: (2025)
Data-Efficient Inference of Neural Fluid Fields via SciML Foundation Model
von: Liu, Yuqiu, et al.
Veröffentlicht: (2024)
von: Liu, Yuqiu, et al.
Veröffentlicht: (2024)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
von: Chen, Yihang, et al.
Veröffentlicht: (2025)
von: Chen, Yihang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Transferable and Principled Efficiency for Open-Vocabulary Segmentation
von: Xu, Jingxuan, et al.
Veröffentlicht: (2024) -
AI Safety in Generative AI Large Language Models: A Survey
von: Chua, Jaymari, et al.
Veröffentlicht: (2024) -
Datasets for Fairness in Language Models: An In-Depth Survey
von: Zhang, Jiale, et al.
Veröffentlicht: (2025) -
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
von: Song, Kefan, et al.
Veröffentlicht: (2025) -
Are Models Trained on Indian Legal Data Fair?
von: Girhepuje, Sahil, et al.
Veröffentlicht: (2023)