Cultural Bias in Large Language Models: Evaluating AI Agents through Moral Questionnaires
Fuente:
arXiv
Salvato in:
| Autore principale: | Münker, Simon |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Political Bias in LLMs: Unaligned Moral Values in Agent-centric Simulations
di: Münker, Simon
Pubblicazione: (2024)
di: Münker, Simon
Pubblicazione: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
di: Tao, Yan, et al.
Pubblicazione: (2023)
di: Tao, Yan, et al.
Pubblicazione: (2023)
Whose Morality Do They Speak? Unraveling Cultural Bias in Multilingual Language Models
di: Aksoy, Meltem
Pubblicazione: (2024)
di: Aksoy, Meltem
Pubblicazione: (2024)
Towards Simulating Social Media Users with LLMs: Evaluating the Operational Validity of Conditioned Comment Prediction
di: Schwager, Nils, et al.
Pubblicazione: (2026)
di: Schwager, Nils, et al.
Pubblicazione: (2026)
Zero-shot prompt-based classification: topic labeling in times of foundation models in German Tweets
di: Münker, Simon, et al.
Pubblicazione: (2024)
di: Münker, Simon, et al.
Pubblicazione: (2024)
Exploring Cultural Variations in Moral Judgments with Large Language Models
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models
di: Rao, Pooja S. B., et al.
Pubblicazione: (2025)
di: Rao, Pooja S. B., et al.
Pubblicazione: (2025)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
di: Eren, Maksim, et al.
Pubblicazione: (2026)
di: Eren, Maksim, et al.
Pubblicazione: (2026)
SaGE: Evaluating Moral Consistency in Large Language Models
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
Enhancing Diagnostic Accuracy through Multi-Agent Conversations: Using Large Language Models to Mitigate Cognitive Bias
di: Ke, Yu He, et al.
Pubblicazione: (2024)
di: Ke, Yu He, et al.
Pubblicazione: (2024)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
The Moral Consistency Pipeline: Continuous Ethical Evaluation for Large Language Models
di: Jamshidi, Saeid, et al.
Pubblicazione: (2025)
di: Jamshidi, Saeid, et al.
Pubblicazione: (2025)
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
di: Huang, Allison, et al.
Pubblicazione: (2024)
di: Huang, Allison, et al.
Pubblicazione: (2024)
Dual-Metric Evaluation of Social Bias in Large Language Models: Evidence from an Underrepresented Nepali Cultural Context
di: Pandey, Ashish, et al.
Pubblicazione: (2026)
di: Pandey, Ashish, et al.
Pubblicazione: (2026)
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
Self-Preference Bias in Rubric-Based Evaluation of Large Language Models
di: Pombal, José, et al.
Pubblicazione: (2026)
di: Pombal, José, et al.
Pubblicazione: (2026)
Analysing Moral Bias in Finetuned LLMs through Mechanistic Interpretability
di: Raimondi, Bianca, et al.
Pubblicazione: (2025)
di: Raimondi, Bianca, et al.
Pubblicazione: (2025)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages
di: Hanif, Ikhlasul Akmal, et al.
Pubblicazione: (2026)
di: Hanif, Ikhlasul Akmal, et al.
Pubblicazione: (2026)
Next Reply Prediction X Dataset: Linguistic Discrepancies in Naively Generated Content
di: Münker, Simon, et al.
Pubblicazione: (2026)
di: Münker, Simon, et al.
Pubblicazione: (2026)
Regional Bias in Large Language Models
di: Gopinadh, M P V S, et al.
Pubblicazione: (2026)
di: Gopinadh, M P V S, et al.
Pubblicazione: (2026)
Quantifying Label-Induced Bias in Large Language Model Self- and Cross-Evaluations
di: Saraf, Muskan, et al.
Pubblicazione: (2025)
di: Saraf, Muskan, et al.
Pubblicazione: (2025)
Tracing Moral Foundations in Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2026)
di: Yu, Chenxiao, et al.
Pubblicazione: (2026)
Characteristic AI Agents via Large Language Models
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
Are Large Language Models Moral Hypocrites? A Study Based on Moral Foundations
di: Nunes, José Luiz, et al.
Pubblicazione: (2024)
di: Nunes, José Luiz, et al.
Pubblicazione: (2024)
Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment
di: Yu, Sangwon, et al.
Pubblicazione: (2024)
di: Yu, Sangwon, et al.
Pubblicazione: (2024)
When AI Speaks, Whose Values Does It Express? A Cross-Cultural Audit of Individualism-Collectivism Bias in Large Language Models
di: Venkata, Pruthvinath Jeripity
Pubblicazione: (2026)
di: Venkata, Pruthvinath Jeripity
Pubblicazione: (2026)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
di: Naous, Tarek, et al.
Pubblicazione: (2023)
di: Naous, Tarek, et al.
Pubblicazione: (2023)
Evaluating Implicit Bias in Large Language Models by Attacking From a Psychometric Perspective
di: Wen, Yuchen, et al.
Pubblicazione: (2024)
di: Wen, Yuchen, et al.
Pubblicazione: (2024)
Empowering Large Language Model Agents through Action Learning
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
Assessing Political Bias in Large Language Models
di: Rettenberger, Luca, et al.
Pubblicazione: (2024)
di: Rettenberger, Luca, et al.
Pubblicazione: (2024)
A Multifaceted Analysis of Negative Bias in Large Language Models through the Lens of Parametric Knowledge
di: Song, Jongyoon, et al.
Pubblicazione: (2025)
di: Song, Jongyoon, et al.
Pubblicazione: (2025)
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
SaudiCulture: A Benchmark for Evaluating Large Language Models Cultural Competence within Saudi Arabia
di: Ayash, Lama, et al.
Pubblicazione: (2025)
di: Ayash, Lama, et al.
Pubblicazione: (2025)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
di: Tian, Jacob-Junqi, et al.
Pubblicazione: (2023)
di: Tian, Jacob-Junqi, et al.
Pubblicazione: (2023)
Beyond Questions: Evaluating What Large Language Models (Actually) Know
di: Giordano, Luca, et al.
Pubblicazione: (2026)
di: Giordano, Luca, et al.
Pubblicazione: (2026)
EvalMORAAL: Interpretable Chain-of-Thought and LLM-as-Judge Evaluation for Moral Alignment in Large Language Models
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
di: Mohammadi, Hadi, et al.
Pubblicazione: (2025)
The Unequal Opportunities of Large Language Models: Revealing Demographic Bias through Job Recommendations
di: Salinas, Abel, et al.
Pubblicazione: (2023)
di: Salinas, Abel, et al.
Pubblicazione: (2023)
Locating and Mitigating Gender Bias in Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Political Bias in LLMs: Unaligned Moral Values in Agent-centric Simulations
di: Münker, Simon
Pubblicazione: (2024) -
Cultural Bias and Cultural Alignment of Large Language Models
di: Tao, Yan, et al.
Pubblicazione: (2023) -
Whose Morality Do They Speak? Unraveling Cultural Bias in Multilingual Language Models
di: Aksoy, Meltem
Pubblicazione: (2024) -
Towards Simulating Social Media Users with LLMs: Evaluating the Operational Validity of Conditioned Comment Prediction
di: Schwager, Nils, et al.
Pubblicazione: (2026) -
Zero-shot prompt-based classification: topic labeling in times of foundation models in German Tweets
di: Münker, Simon, et al.
Pubblicazione: (2024)