Bias in Large Language Models: Origin, Evaluation, and Mitigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Yufei, Guo, Muzhe, Su, Juntao, Yang, Zhou, Zhu, Mengqiu, Li, Hongfei, Qiu, Mengyang, Liu, Shuo Shuo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
par: Yu, Yijiong, et autres
Publié: (2024)
par: Yu, Yijiong, et autres
Publié: (2024)
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
par: Liu, Shuo, et autres
Publié: (2026)
par: Liu, Shuo, et autres
Publié: (2026)
Make Large Language Model a Better Ranker
par: Chao, Wen-Shuo, et autres
Publié: (2024)
par: Chao, Wen-Shuo, et autres
Publié: (2024)
Failing to Falsify: Evaluating and Mitigating Confirmation Bias in Language Models
par: Jhaveri, Ayush Rajesh, et autres
Publié: (2026)
par: Jhaveri, Ayush Rajesh, et autres
Publié: (2026)
RAZOR: Sharpening Knowledge by Cutting Bias with Unsupervised Text Rewriting
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
par: Kocak, Aysenur, et autres
Publié: (2025)
par: Kocak, Aysenur, et autres
Publié: (2025)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
par: Qiao, Boyu, et autres
Publié: (2026)
par: Qiao, Boyu, et autres
Publié: (2026)
Uncertainty Awareness of Large Language Models Under Code Distribution Shifts: A Benchmark Study
par: Li, Yufei, et autres
Publié: (2024)
par: Li, Yufei, et autres
Publié: (2024)
How Can Large Language Models Understand Spatial-Temporal Data?
par: Liu, Lei, et autres
Publié: (2024)
par: Liu, Lei, et autres
Publié: (2024)
Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
par: Guo, Qingyan, et autres
Publié: (2024)
par: Guo, Qingyan, et autres
Publié: (2024)
How Attention Sinks Emerge in Large Language Models: An Interpretability Perspective
par: Peng, Runyu, et autres
Publié: (2026)
par: Peng, Runyu, et autres
Publié: (2026)
BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models
par: He, Liulu, et autres
Publié: (2025)
par: He, Liulu, et autres
Publié: (2025)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
par: Qi, Zhen, et autres
Publié: (2024)
par: Qi, Zhen, et autres
Publié: (2024)
Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning
par: Zhang, Hanlu, et autres
Publié: (2025)
par: Zhang, Hanlu, et autres
Publié: (2025)
Quantifying and Mitigating Self-Preference Bias of LLM Judges
par: Yang, Jinming, et autres
Publié: (2026)
par: Yang, Jinming, et autres
Publié: (2026)
Bias Amplification in Language Model Evolution: An Iterated Learning Perspective
par: Ren, Yi, et autres
Publié: (2024)
par: Ren, Yi, et autres
Publié: (2024)
Mitigating Gender Bias in Contextual Word Embeddings
par: Yarrabelly, Navya, et autres
Publié: (2024)
par: Yarrabelly, Navya, et autres
Publié: (2024)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
par: Wang, Peng-Yuan, et autres
Publié: (2026)
par: Wang, Peng-Yuan, et autres
Publié: (2026)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
par: Zheng, Jinquan, et autres
Publié: (2026)
par: Zheng, Jinquan, et autres
Publié: (2026)
Understanding and Mitigating Tokenization Bias in Language Models
par: Phan, Buu, et autres
Publié: (2024)
par: Phan, Buu, et autres
Publié: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
Embedding Enhancement via Fine-Tuned Language Models for Learner-Item Cognitive Modeling
par: Liu, Yuanhao, et autres
Publié: (2026)
par: Liu, Yuanhao, et autres
Publié: (2026)
CrossTrafficLLM: A Human-Centric Framework for Interpretable Traffic Intelligence via Large Language Model
par: Du, Zeming, et autres
Publié: (2025)
par: Du, Zeming, et autres
Publié: (2025)
Race, Ethnicity and Their Implication on Bias in Large Language Models
par: Hu, Shiyue, et autres
Publié: (2026)
par: Hu, Shiyue, et autres
Publié: (2026)
LLM-PS: Empowering Large Language Models for Time Series Forecasting with Temporal Patterns and Semantics
par: Tang, Jialiang, et autres
Publié: (2025)
par: Tang, Jialiang, et autres
Publié: (2025)
On the Origins of Linear Representations in Large Language Models
par: Jiang, Yibo, et autres
Publié: (2024)
par: Jiang, Yibo, et autres
Publié: (2024)
Not All Features Deserve Attention: Graph-Guided Dependency Learning for Tabular Data Generation with Language Models
par: Zhang, Zheyu, et autres
Publié: (2025)
par: Zhang, Zheyu, et autres
Publié: (2025)
BA-LoRA: Bias-Alleviating Low-Rank Adaptation to Mitigate Catastrophic Inheritance in Large Language Models
par: Chang, Yupeng, et autres
Publié: (2024)
par: Chang, Yupeng, et autres
Publié: (2024)
Red-Teaming for Inducing Societal Bias in Large Language Models
par: Luo, Chu Fei, et autres
Publié: (2024)
par: Luo, Chu Fei, et autres
Publié: (2024)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
par: Li, Xiaoyuan, et autres
Publié: (2024)
par: Li, Xiaoyuan, et autres
Publié: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
par: Arzaghi', 'Mina, et autres
Publié: (2025)
par: Arzaghi', 'Mina, et autres
Publié: (2025)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
par: Yang, Nakyeong, et autres
Publié: (2023)
par: Yang, Nakyeong, et autres
Publié: (2023)
Solving Situation Puzzles with Large Language Model and External Reformulation
par: Li, Kun, et autres
Publié: (2025)
par: Li, Kun, et autres
Publié: (2025)
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
SparseEval: Efficient Evaluation of Large Language Models by Sparse Optimization
par: Zhang, Taolin, et autres
Publié: (2026)
par: Zhang, Taolin, et autres
Publié: (2026)
How Quantization Shapes Bias in Large Language Models
par: Marcuzzi, Federico, et autres
Publié: (2025)
par: Marcuzzi, Federico, et autres
Publié: (2025)
Beware of Calibration Data for Pruning Large Language Models
par: Ji, Yixin, et autres
Publié: (2024)
par: Ji, Yixin, et autres
Publié: (2024)
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
par: Guo, Yiran, et autres
Publié: (2025)
par: Guo, Yiran, et autres
Publié: (2025)
Documents similaires
-
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
par: Yu, Yijiong, et autres
Publié: (2024) -
Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning
par: Liu, Shuo, et autres
Publié: (2026) -
Make Large Language Model a Better Ranker
par: Chao, Wen-Shuo, et autres
Publié: (2024) -
Failing to Falsify: Evaluating and Mitigating Confirmation Bias in Language Models
par: Jhaveri, Ayush Rajesh, et autres
Publié: (2026) -
RAZOR: Sharpening Knowledge by Cutting Bias with Unsupervised Text Rewriting
par: Yang, Shuo, et autres
Publié: (2024)