Indian-BhED: A Dataset for Measuring India-Centric Biases in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khandelwal, Khyati, Tonneau, Manuel, Bean, Andrew M., Kirk, Hannah Rose, Hale, Scott A. |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
DoDo Learning: DOmain-DemOgraphic Transfer in Language Models for Detecting Abuse Targeted at Public Figures
par: Williams, Angus R., et autres
Publié: (2023)
par: Williams, Angus R., et autres
Publié: (2023)
From Languages to Geographies: Towards Evaluating Cultural Bias in Hate Speech Datasets
par: Tonneau, Manuel, et autres
Publié: (2024)
par: Tonneau, Manuel, et autres
Publié: (2024)
The Enforcement and Feasibility of Hate Speech Moderation on Twitter
par: Tonneau, Manuel, et autres
Publié: (2026)
par: Tonneau, Manuel, et autres
Publié: (2026)
A Multilingual Similarity Dataset for News Article Frame
par: Chen, Xi, et autres
Publié: (2024)
par: Chen, Xi, et autres
Publié: (2024)
Reward Models Inherit Value Biases from Pretraining
par: Christian, Brian, et autres
Publié: (2026)
par: Christian, Brian, et autres
Publié: (2026)
The PRISM Alignment Dataset: What Participatory, Representative and Individualised Human Feedback Reveals About the Subjective and Multicultural Alignment of Large Language Models
par: Kirk, Hannah Rose, et autres
Publié: (2024)
par: Kirk, Hannah Rose, et autres
Publié: (2024)
Reducing Biases towards Minoritized Populations in Medical Curricular Content via Artificial Intelligence for Fairer Health Outcomes
par: Salavati, Chiman, et autres
Publié: (2024)
par: Salavati, Chiman, et autres
Publié: (2024)
LINGOLY: A Benchmark of Olympiad-Level Linguistic Reasoning Puzzles in Low-Resource and Extinct Languages
par: Bean, Andrew M., et autres
Publié: (2024)
par: Bean, Andrew M., et autres
Publié: (2024)
The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models
par: Boisnard, Philippe
Publié: (2026)
par: Boisnard, Philippe
Publié: (2026)
The Life Cycle of Large Language Models: A Review of Biases in Education
par: Lee, Jinsook, et autres
Publié: (2024)
par: Lee, Jinsook, et autres
Publié: (2024)
A Systematic Analysis of Biases in Large Language Models
par: Zhang, Xulang, et autres
Publié: (2025)
par: Zhang, Xulang, et autres
Publié: (2025)
Understanding Intrinsic Socioeconomic Biases in Large Language Models
par: Arzaghi, Mina, et autres
Publié: (2024)
par: Arzaghi, Mina, et autres
Publié: (2024)
SimpleSafetyTests: a Test Suite for Identifying Critical Safety Risks in Large Language Models
par: Vidgen, Bertie, et autres
Publié: (2023)
par: Vidgen, Bertie, et autres
Publié: (2023)
Large Language Models are Geographically Biased
par: Manvi, Rohin, et autres
Publié: (2024)
par: Manvi, Rohin, et autres
Publié: (2024)
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)
par: Azzopardi, Leif, et autres
Publié: (2024)
SynDy: Synthetic Dynamic Dataset Generation Framework for Misinformation Tasks
par: Shliselberg, Michael, et autres
Publié: (2024)
par: Shliselberg, Michael, et autres
Publié: (2024)
IndRegBias: A Dataset for Studying Indian Regional Biases in English and Code-Mixed Social Media Comments
par: Panda, Debasmita, et autres
Publié: (2026)
par: Panda, Debasmita, et autres
Publié: (2026)
Generative Language Models Exhibit Social Identity Biases
par: Hu, Tiancheng, et autres
Publié: (2023)
par: Hu, Tiancheng, et autres
Publié: (2023)
Revealing and Reducing Gender Biases in Vision and Language Assistants (VLAs)
par: Girrbach, Leander, et autres
Publié: (2024)
par: Girrbach, Leander, et autres
Publié: (2024)
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
par: Wu, Addison J., et autres
Publié: (2025)
par: Wu, Addison J., et autres
Publié: (2025)
A Toolbox for Surfacing Health Equity Harms and Biases in Large Language Models
par: Pfohl, Stephen R., et autres
Publié: (2024)
par: Pfohl, Stephen R., et autres
Publié: (2024)
Subtle Biases Need Subtler Measures: Dual Metrics for Evaluating Representative and Affinity Bias in Large Language Models
par: Kumar, Abhishek, et autres
Publié: (2024)
par: Kumar, Abhishek, et autres
Publié: (2024)
WhatsApp Tiplines and Multilingual Claims in the 2021 Indian Assembly Elections
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
Self-Blinding and Counterfactual Self-Simulation Mitigate Biases and Sycophancy in Large Language Models
par: Christian, Brian, et autres
Publié: (2026)
par: Christian, Brian, et autres
Publié: (2026)
Measuring Implicit Bias in Explicitly Unbiased Large Language Models
par: Bai, Xuechunzi, et autres
Publié: (2024)
par: Bai, Xuechunzi, et autres
Publié: (2024)
Measuring Large Language Models Capacity to Annotate Journalistic Sourcing
par: Vincent, Subramaniam, et autres
Publié: (2024)
par: Vincent, Subramaniam, et autres
Publié: (2024)
Leveraging Large Language Models to Measure Gender Representation Bias in Gendered Language Corpora
par: Derner, Erik, et autres
Publié: (2024)
par: Derner, Erik, et autres
Publié: (2024)
DOSA: A Dataset of Social Artifacts from Different Indian Geographical Subcultures
par: Seth, Agrima, et autres
Publié: (2024)
par: Seth, Agrima, et autres
Publié: (2024)
AGGA: A Dataset of Academic Guidelines for Generative AI and Large Language Models
par: Jiao, Junfeng, et autres
Publié: (2025)
par: Jiao, Junfeng, et autres
Publié: (2025)
"Pull or Not to Pull?'': Investigating Moral Biases in Leading Large Language Models Across Ethical Dilemmas
par: Ding, Junchen, et autres
Publié: (2025)
par: Ding, Junchen, et autres
Publié: (2025)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
par: Wang, Yuhang, et autres
Publié: (2023)
par: Wang, Yuhang, et autres
Publié: (2023)
HateDay: Insights from a Global Hate Speech Dataset Representative of a Day on Twitter
par: Tonneau, Manuel, et autres
Publié: (2024)
par: Tonneau, Manuel, et autres
Publié: (2024)
When Claims Evolve: Evaluating and Enhancing the Robustness of Embedding Models Against Misinformation Edits
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
Whose Journey Matters? Investigating Identity Biases in Large Language Models (LLMs) for Travel Planning Assistance
par: Ren, Ruiping, et autres
Publié: (2024)
par: Ren, Ruiping, et autres
Publié: (2024)
Decoding the Mind of Large Language Models: A Quantitative Evaluation of Ideology and Biases
par: Hirose, Manari, et autres
Publié: (2025)
par: Hirose, Manari, et autres
Publié: (2025)
Towards High-Fidelity Synthetic Multi-platform Social Media Datasets via Large Language Models
par: Tari, Henry, et autres
Publié: (2025)
par: Tari, Henry, et autres
Publié: (2025)
The Biased Samaritan: LLM biases in Perceived Kindness
par: Fagan, Jack H, et autres
Publié: (2025)
par: Fagan, Jack H, et autres
Publié: (2025)
Quantifying Gender Biases Towards Politicians on Reddit
par: Marjanovic, Sara, et autres
Publié: (2021)
par: Marjanovic, Sara, et autres
Publié: (2021)
Large Language Models Show Human-like Social Desirability Biases in Survey Responses
par: Salecha, Aadesh, et autres
Publié: (2024)
par: Salecha, Aadesh, et autres
Publié: (2024)
Documents similaires
-
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025) -
DoDo Learning: DOmain-DemOgraphic Transfer in Language Models for Detecting Abuse Targeted at Public Figures
par: Williams, Angus R., et autres
Publié: (2023) -
From Languages to Geographies: Towards Evaluating Cultural Bias in Hate Speech Datasets
par: Tonneau, Manuel, et autres
Publié: (2024) -
The Enforcement and Feasibility of Hate Speech Moderation on Twitter
par: Tonneau, Manuel, et autres
Publié: (2026) -
A Multilingual Similarity Dataset for News Article Frame
par: Chen, Xi, et autres
Publié: (2024)