Enregistré dans:
| Auteurs principaux: | Lin, Xinru, Li, Luyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.02776 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs
par: Kumar, Divyanshu, et autres
Publié: (2024)
par: Kumar, Divyanshu, et autres
Publié: (2024)
'Since Lawyers are Males..': Examining Implicit Gender Bias in Hindi Language Generation by LLMs
par: Joshi, Ishika, et autres
Publié: (2024)
par: Joshi, Ishika, et autres
Publié: (2024)
Implicit Reasoning in Large Language Models: A Comprehensive Survey
par: Li, Jindong, et autres
Publié: (2025)
par: Li, Jindong, et autres
Publié: (2025)
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026)
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026)
LLMs for Explainable AI: A Comprehensive Survey
par: Bilal, Ahsan, et autres
Publié: (2025)
par: Bilal, Ahsan, et autres
Publié: (2025)
Empowering LLMs with Logical Reasoning: A Comprehensive Survey
par: Cheng, Fengxiang, et autres
Publié: (2025)
par: Cheng, Fengxiang, et autres
Publié: (2025)
A Comprehensive Survey of Bias in LLMs: Current Landscape and Future Directions
par: Ranjan, Rajesh, et autres
Publié: (2024)
par: Ranjan, Rajesh, et autres
Publié: (2024)
Capturing Bias Diversity in LLMs
par: Gosavi, Purva Prasad, et autres
Publié: (2024)
par: Gosavi, Purva Prasad, et autres
Publié: (2024)
Uncovering Implicit Bias in Large Language Models with Concept Learning Dataset
par: Wang, Leroy Z.
Publié: (2025)
par: Wang, Leroy Z.
Publié: (2025)
A Survey on Human-Centric LLMs
par: Wang, Jing Yi, et autres
Publié: (2024)
par: Wang, Jing Yi, et autres
Publié: (2024)
Cognitive Bias in Decision-Making with LLMs
par: Echterhoff, Jessica, et autres
Publié: (2024)
par: Echterhoff, Jessica, et autres
Publié: (2024)
Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race
par: Sun, Lihao, et autres
Publié: (2025)
par: Sun, Lihao, et autres
Publié: (2025)
Dissecting Bias in LLMs: A Mechanistic Interpretability Perspective
par: Chandna, Bhavik, et autres
Publié: (2025)
par: Chandna, Bhavik, et autres
Publié: (2025)
Distance between Relevant Information Pieces Causes Bias in Long-Context LLMs
par: Tian, Runchu, et autres
Publié: (2024)
par: Tian, Runchu, et autres
Publié: (2024)
Evaluating Implicit Bias in Large Language Models by Attacking From a Psychometric Perspective
par: Wen, Yuchen, et autres
Publié: (2024)
par: Wen, Yuchen, et autres
Publié: (2024)
Relative Bias: A Comparative Framework for Quantifying Bias in LLMs
par: Arbabi, Alireza, et autres
Publié: (2025)
par: Arbabi, Alireza, et autres
Publié: (2025)
IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages
par: Hanif, Ikhlasul Akmal, et autres
Publié: (2026)
par: Hanif, Ikhlasul Akmal, et autres
Publié: (2026)
Assessing the potential of LLM-assisted annotation for corpus-based pragmatics and discourse analysis: The case of apology
par: Yu, Danni, et autres
Publié: (2023)
par: Yu, Danni, et autres
Publié: (2023)
Do LLMs Really Think Step-by-step In Implicit Reasoning?
par: Yu, Yijiong
Publié: (2024)
par: Yu, Yijiong
Publié: (2024)
A Scalable Entity-Based Framework for Auditing Bias in LLMs
par: Elbouanani, Akram, et autres
Publié: (2026)
par: Elbouanani, Akram, et autres
Publié: (2026)
Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs
par: Pearman, Edie, et autres
Publié: (2026)
par: Pearman, Edie, et autres
Publié: (2026)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
par: Liu, Yilong, et autres
Publié: (2026)
par: Liu, Yilong, et autres
Publié: (2026)
Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
par: Wen, Xumeng, et autres
Publié: (2025)
par: Wen, Xumeng, et autres
Publié: (2025)
User-Assistant Bias in LLMs
par: Pan, Xu, et autres
Publié: (2025)
par: Pan, Xu, et autres
Publié: (2025)
Promoting Equality in Large Language Models: Identifying and Mitigating the Implicit Bias based on Bayesian Theory
par: Deng, Yongxin, et autres
Publié: (2024)
par: Deng, Yongxin, et autres
Publié: (2024)
A Survey on Prompting Techniques in LLMs
par: Bhandari, Prabin
Publié: (2023)
par: Bhandari, Prabin
Publié: (2023)
Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey
par: Li, Jindong, et autres
Publié: (2025)
par: Li, Jindong, et autres
Publié: (2025)
A Survey of Calibration Process for Black-Box LLMs
par: Xie, Liangru, et autres
Publié: (2024)
par: Xie, Liangru, et autres
Publié: (2024)
Steering Towards Fairness: Mitigating Political Bias in LLMs
par: Nadeem, Afrozah, et autres
Publié: (2025)
par: Nadeem, Afrozah, et autres
Publié: (2025)
Enabling Scalable Evaluation of Bias Patterns in Medical LLMs
par: Fayyaz, Hamed, et autres
Publié: (2024)
par: Fayyaz, Hamed, et autres
Publié: (2024)
A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias
par: Xu, Yuemei, et autres
Publié: (2024)
par: Xu, Yuemei, et autres
Publié: (2024)
Location Not Found: Exposing Implicit Local and Global Biases in Multilingual LLMs
par: Mor-Lan, Guy, et autres
Publié: (2026)
par: Mor-Lan, Guy, et autres
Publié: (2026)
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
"I know myself better, but not really greatly": How Well Can LLMs Detect and Explain LLM-Generated Texts?
par: Ji, Jiazhou, et autres
Publié: (2025)
par: Ji, Jiazhou, et autres
Publié: (2025)
The Lifecycle of "Facts": A Survey of Social Bias in Knowledge Graphs
par: Kraft, Angelie, et autres
Publié: (2022)
par: Kraft, Angelie, et autres
Publié: (2022)
From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test
par: Dai, Xunlian, et autres
Publié: (2025)
par: Dai, Xunlian, et autres
Publié: (2025)
Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
From Oracle to Noisy Context: Mitigating Contextual Exposure Bias in Speech-LLMs
par: Guo, Xiaoyong, et autres
Publié: (2026)
par: Guo, Xiaoyong, et autres
Publié: (2026)
An Empirical Survey of Model Merging Algorithms for Social Bias Mitigation
par: Shirafuji, Daiki, et autres
Publié: (2025)
par: Shirafuji, Daiki, et autres
Publié: (2025)
Leveraging Implicit Sentiments: Enhancing Reliability and Validity in Psychological Trait Evaluation of LLMs
par: Ma, Huanhuan, et autres
Publié: (2025)
par: Ma, Huanhuan, et autres
Publié: (2025)
Documents similaires
-
Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs
par: Kumar, Divyanshu, et autres
Publié: (2024) -
'Since Lawyers are Males..': Examining Implicit Gender Bias in Hindi Language Generation by LLMs
par: Joshi, Ishika, et autres
Publié: (2024) -
Implicit Reasoning in Large Language Models: A Comprehensive Survey
par: Li, Jindong, et autres
Publié: (2025) -
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026) -
LLMs for Explainable AI: A Comprehensive Survey
par: Bilal, Ahsan, et autres
Publié: (2025)