Sometimes the Model doth Preach: Quantifying Religious Bias in Open LLMs through Demographic Analysis in Asian Nations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shankar, Hari, P, Vedanta S, Cavale, Tejas, Kumaraguru, Ponnurangam, Chakraborty, Abhijnan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mind the Gap: Pitfalls of LLM Alignment with Asian Public Opinion
par: Shankar, Hari, et autres
Publié: (2026)
par: Shankar, Hari, et autres
Publié: (2026)
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026)
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026)
Rethinking Hate Speech Detection on Social Media: Can LLMs Replace Traditional Models?
par: Singh, Daman Deep, et autres
Publié: (2025)
par: Singh, Daman Deep, et autres
Publié: (2025)
Are Models Trained on Indian Legal Data Fair?
par: Girhepuje, Sahil, et autres
Publié: (2023)
par: Girhepuje, Sahil, et autres
Publié: (2023)
Representation Surgery: Theory and Practice of Affine Steering
par: Singh, Shashwat, et autres
Publié: (2024)
par: Singh, Shashwat, et autres
Publié: (2024)
Evaluating LLMs for Demographic-Targeted Social Bias Detection: A Comprehensive Benchmark Study
par: Majumdar, Ayan, et autres
Publié: (2025)
par: Majumdar, Ayan, et autres
Publié: (2025)
I Can't Believe It's Corrupt: Evaluating Corruption in Multi-Agent Governance Systems
par: P, Vedanta S, et autres
Publié: (2026)
par: P, Vedanta S, et autres
Publié: (2026)
Multilingual Coreference Resolution in Low-resource South Asian Languages
par: Mishra, Ritwik, et autres
Publié: (2024)
par: Mishra, Ritwik, et autres
Publié: (2024)
SMITE: Enhancing Fairness in LLMs through Optimal In-Context Example Selection via Dynamic Validation
par: Chhikara, Garima, et autres
Publié: (2025)
par: Chhikara, Garima, et autres
Publié: (2025)
The Unequal Opportunities of Large Language Models: Revealing Demographic Bias through Job Recommendations
par: Salinas, Abel, et autres
Publié: (2023)
par: Salinas, Abel, et autres
Publié: (2023)
Different Demographic Cues Yield Inconsistent Conclusions About LLM Personalization and Bias
par: Tonneau, Manuel, et autres
Publié: (2026)
par: Tonneau, Manuel, et autres
Publié: (2026)
Robustness and Confounders in the Demographic Alignment of LLMs with Human Perceptions of Offensiveness
par: Alipour, Shayan, et autres
Publié: (2024)
par: Alipour, Shayan, et autres
Publié: (2024)
Dialect vs Demographics: Quantifying LLM Bias from Implicit Linguistic Signals vs. Explicit User Profiles
par: Haq, Irti, et autres
Publié: (2026)
par: Haq, Irti, et autres
Publié: (2026)
Leveraging Prototypical Representations for Mitigating Social Bias without Demographic Information
par: Iskander, Shadi, et autres
Publié: (2024)
par: Iskander, Shadi, et autres
Publié: (2024)
Exploring LGBTQ+ Bias in Generative AI Answers across Different Country and Religious Contexts
par: Vicsek, Lilla, et autres
Publié: (2024)
par: Vicsek, Lilla, et autres
Publié: (2024)
Through the Prism of Culture: Evaluating LLMs' Understanding of Indian Subcultures and Traditions
par: Chhikara, Garima, et autres
Publié: (2025)
par: Chhikara, Garima, et autres
Publié: (2025)
Long-context Non-factoid Question Answering in Indic Languages
par: Mishra, Ritwik, et autres
Publié: (2025)
par: Mishra, Ritwik, et autres
Publié: (2025)
Quantifying Risk Propensities of Large Language Models: Ethical Focus and Bias Detection through Role-Play
par: Zeng, Yifan, et autres
Publié: (2024)
par: Zeng, Yifan, et autres
Publié: (2024)
Structured Definitions and Segmentations for Legal Reasoning in LLMs: A Study on Indian Legal Data
par: Khatri, Mann, et autres
Publié: (2025)
par: Khatri, Mann, et autres
Publié: (2025)
Unsupervised Concept Vector Extraction for Bias Control in LLMs
par: Cyberey, Hannah, et autres
Publié: (2025)
par: Cyberey, Hannah, et autres
Publié: (2025)
DECASTE: Unveiling Caste Stereotypes in Large Language Models through Multi-Dimensional Bias Analysis
par: Vijayaraghavan, Prashanth, et autres
Publié: (2025)
par: Vijayaraghavan, Prashanth, et autres
Publié: (2025)
LLMs are Biased Teachers: Evaluating LLM Bias in Personalized Education
par: Weissburg, Iain, et autres
Publié: (2024)
par: Weissburg, Iain, et autres
Publié: (2024)
Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs
par: Wachter, Jasmin, et autres
Publié: (2025)
par: Wachter, Jasmin, et autres
Publié: (2025)
Do Prevalent Bias Metrics Capture Allocational Harms from LLMs?
par: Cyberey, Hannah, et autres
Publié: (2024)
par: Cyberey, Hannah, et autres
Publié: (2024)
Analyzing Patterns and Influence of Advertising in Print Newspapers
par: Vardhan, N Harsha, et autres
Publié: (2025)
par: Vardhan, N Harsha, et autres
Publié: (2025)
Hate Personified: Investigating the role of LLMs in content moderation
par: Masud, Sarah, et autres
Publié: (2024)
par: Masud, Sarah, et autres
Publié: (2024)
Intrinsic Guardrails: How Semantic Geometry of Personality Interacts with Emergent Misalignment in LLMs
par: Aneja, Krishak, et autres
Publié: (2026)
par: Aneja, Krishak, et autres
Publié: (2026)
Privacy Policy Analysis through Prompt Engineering for LLMs
par: Goknil, Arda, et autres
Publié: (2024)
par: Goknil, Arda, et autres
Publié: (2024)
Counter Turing Test ($CT^2$): Investigating AI-Generated Text Detection for Hindi -- Ranking LLMs based on Hindi AI Detectability Index ($ADI_{hi}$)
par: Kavathekar, Ishan, et autres
Publié: (2024)
par: Kavathekar, Ishan, et autres
Publié: (2024)
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
par: Ko, Changgeon, et autres
Publié: (2024)
par: Ko, Changgeon, et autres
Publié: (2024)
Who Gets Which Message? Auditing Demographic Bias in LLM-Generated Targeted Text
par: Islam, Tunazzina
Publié: (2026)
par: Islam, Tunazzina
Publié: (2026)
Perceived Political Bias in LLMs Reduces Persuasive Abilities
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
EtiCor++: Towards Understanding Etiquettical Bias in LLMs
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
par: Wei, Kangda, et autres
Publié: (2025)
par: Wei, Kangda, et autres
Publié: (2025)
Widespread Gender and Pronoun Bias in Moral Judgments Across LLMs
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
Contextual StereoSet: Stress-Testing Bias Alignment Robustness in Large Language Models
par: Basu, Abhinaba, et autres
Publié: (2026)
par: Basu, Abhinaba, et autres
Publié: (2026)
Using LLMs for Knowledge Component-level Correctness Labeling in Open-ended Coding Problems
par: Duan, Zhangqi, et autres
Publié: (2026)
par: Duan, Zhangqi, et autres
Publié: (2026)
COBIAS: Assessing the Contextual Reliability of Bias Benchmarks for Language Models
par: Govil, Priyanshul, et autres
Publié: (2024)
par: Govil, Priyanshul, et autres
Publié: (2024)
MAGPIE: Multi-Task Media-Bias Analysis Generalization for Pre-Trained Identification of Expressions
par: Horych, Tomáš, et autres
Publié: (2024)
par: Horych, Tomáš, et autres
Publié: (2024)
Quantifying the Persona Effect in LLM Simulations
par: Hu, Tiancheng, et autres
Publié: (2024)
par: Hu, Tiancheng, et autres
Publié: (2024)
Documents similaires
-
Mind the Gap: Pitfalls of LLM Alignment with Asian Public Opinion
par: Shankar, Hari, et autres
Publié: (2026) -
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
par: Vedula, Bhaskara Hanuma, et autres
Publié: (2026) -
Rethinking Hate Speech Detection on Social Media: Can LLMs Replace Traditional Models?
par: Singh, Daman Deep, et autres
Publié: (2025) -
Are Models Trained on Indian Legal Data Fair?
par: Girhepuje, Sahil, et autres
Publié: (2023) -
Representation Surgery: Theory and Practice of Affine Steering
par: Singh, Shashwat, et autres
Publié: (2024)