Hire Your Anthropologist! Rethinking Culture Benchmarks Through an Anthropological Lens
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | AlKhamissi, Mai, Xiao, Yunze, AlKhamissi, Badr, Diab, Mona |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Investigating Cultural Alignment of Large Language Models
par: AlKhamissi, Badr, et autres
Publié: (2024)
par: AlKhamissi, Badr, et autres
Publié: (2024)
Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient Classification
par: ElNokrashy, Muhammad, et autres
Publié: (2022)
par: ElNokrashy, Muhammad, et autres
Publié: (2022)
A Context-Contrastive Inference Approach To Partial Diacritization
par: ElNokrashy, Muhammad, et autres
Publié: (2024)
par: ElNokrashy, Muhammad, et autres
Publié: (2024)
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
par: Jamaa, Yassine, et autres
Publié: (2025)
par: Jamaa, Yassine, et autres
Publié: (2025)
The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units
par: AlKhamissi, Badr, et autres
Publié: (2024)
par: AlKhamissi, Badr, et autres
Publié: (2024)
Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network
par: AlKhamissi, Badr, et autres
Publié: (2024)
par: AlKhamissi, Badr, et autres
Publié: (2024)
"Flex Tape Can't Fix That": Bias and Misinformation in Edited Language Models
par: Halevy, Karina, et autres
Publié: (2024)
par: Halevy, Karina, et autres
Publié: (2024)
Inducing Dyslexia in Vision Language Models
par: Honarmand, Melika, et autres
Publié: (2025)
par: Honarmand, Melika, et autres
Publié: (2025)
Rosetta Stone at KSAA-RD Shared Task: A Hop From Language Modeling To Word--Definition Alignment
par: ElBakry, Ahmed, et autres
Publié: (2023)
par: ElBakry, Ahmed, et autres
Publié: (2023)
Instruction-tuning Aligns LLMs to the Human Brain
par: Aw, Khai Loong, et autres
Publié: (2023)
par: Aw, Khai Loong, et autres
Publié: (2023)
From Language to Cognition: How LLMs Outgrow the Human Language Network
par: AlKhamissi, Badr, et autres
Publié: (2025)
par: AlKhamissi, Badr, et autres
Publié: (2025)
Khattat: Enhancing Readability and Concept Representation of Semantic Typography
par: Hussein, Ahmed, et autres
Publié: (2024)
par: Hussein, Ahmed, et autres
Publié: (2024)
TopoLM: brain-like spatio-functional organization in a topographic language model
par: Rathi, Neil, et autres
Publié: (2024)
par: Rathi, Neil, et autres
Publié: (2024)
MIRAGE: Adaptive Multimodal Gating for Whole-Brain fMRI Encoding
par: Gokce, Abdulkadir, et autres
Publié: (2026)
par: Gokce, Abdulkadir, et autres
Publié: (2026)
Dreaming Out Loud: A Self-Synthesis Approach For Training Vision-Language Models With Developmentally Plausible Data
par: AlKhamissi, Badr, et autres
Publié: (2024)
par: AlKhamissi, Badr, et autres
Publié: (2024)
Rational Metareasoning for Large Language Models
par: De Sabbata, C. Nicolò, et autres
Publié: (2024)
par: De Sabbata, C. Nicolò, et autres
Publié: (2024)
Large Language Models Align with the Human Brain during Creative Thinking
par: Ismayilzada, Mete, et autres
Publié: (2026)
par: Ismayilzada, Mete, et autres
Publié: (2026)
Humanizing Machines: Rethinking LLM Anthropomorphism Through a Multi-Level Framework of Design
par: Xiao, Yunze, et autres
Publié: (2025)
par: Xiao, Yunze, et autres
Publié: (2025)
JiraiBench: A Bilingual Benchmark for Evaluating Large Language Models' Detection of Human Self-Destructive Behavior Content in Jirai Community
par: Xiao, Yunze, et autres
Publié: (2025)
par: Xiao, Yunze, et autres
Publié: (2025)
Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
par: AlKhamissi, Badr, et autres
Publié: (2025)
par: AlKhamissi, Badr, et autres
Publié: (2025)
Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models
par: Rao, Pooja S. B., et autres
Publié: (2025)
par: Rao, Pooja S. B., et autres
Publié: (2025)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
par: Wang, Ze, et autres
Publié: (2024)
par: Wang, Ze, et autres
Publié: (2024)
The Silicon Ceiling: Auditing GPT's Race and Gender Biases in Hiring
par: Armstrong, Lena, et autres
Publié: (2024)
par: Armstrong, Lena, et autres
Publié: (2024)
ArabLegalEval: A Multitask Benchmark for Assessing Arabic Legal Knowledge in Large Language Models
par: Hijazi, Faris, et autres
Publié: (2024)
par: Hijazi, Faris, et autres
Publié: (2024)
Beyond Understanding: Evaluating the Pragmatic Gap in LLMs' Cultural Processing of Figurative Language
par: Attia, Mena, et autres
Publié: (2025)
par: Attia, Mena, et autres
Publié: (2025)
Evaluating the Promise and Pitfalls of LLMs in Hiring Decisions
par: Anzenberg, Eitan, et autres
Publié: (2025)
par: Anzenberg, Eitan, et autres
Publié: (2025)
ToxiCloakCN: Evaluating Robustness of Offensive Language Detection in Chinese with Cloaking Perturbations
par: Xiao, Yunze, et autres
Publié: (2024)
par: Xiao, Yunze, et autres
Publié: (2024)
Benchmarking the Legal Reasoning of LLMs in Arabic Islamic Inheritance Cases
par: AlDahoul, Nouar, et autres
Publié: (2025)
par: AlDahoul, Nouar, et autres
Publié: (2025)
How Gender Interacts with Political Values: A Case Study on Czech BERT Models
par: Ali, Adnan Al, et autres
Publié: (2024)
par: Ali, Adnan Al, et autres
Publié: (2024)
Are Vision Language Models Cross-Cultural Theory of Mind Reasoners?
par: Nazi, Zabir Al, et autres
Publié: (2025)
par: Nazi, Zabir Al, et autres
Publié: (2025)
Meet Your New Client: Writing Reports for AI -- Benchmarking Information Loss in Market Research Deliverables
par: Simmering, Paul F., et autres
Publié: (2025)
par: Simmering, Paul F., et autres
Publié: (2025)
Beyond the Rubric: Cultural Misalignment in LLM Benchmarks for Sexual and Reproductive Health
par: Dey, Sumon Kanti, et autres
Publié: (2025)
par: Dey, Sumon Kanti, et autres
Publié: (2025)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
par: Wang, Yuhang, et autres
Publié: (2023)
par: Wang, Yuhang, et autres
Publié: (2023)
GT-HarmBench: Benchmarking AI Safety Risks Through the Lens of Game Theory
par: Cobben, Pepijn, et autres
Publié: (2026)
par: Cobben, Pepijn, et autres
Publié: (2026)
Sentipolis: Emotion-Aware Agents for Social Simulations
par: Fu, Chiyuan, et autres
Publié: (2026)
par: Fu, Chiyuan, et autres
Publié: (2026)
Toward Cultural Interpretability: A Linguistic Anthropological Framework for Describing and Evaluating Large Language Models (LLMs)
par: Jones, Graham M., et autres
Publié: (2024)
par: Jones, Graham M., et autres
Publié: (2024)
Prompt Engineering Techniques for Mitigating Cultural Bias Against Arabs and Muslims in Large Language Models: A Systematic Review
par: Asseri, Bushra, et autres
Publié: (2025)
par: Asseri, Bushra, et autres
Publié: (2025)
Towards Valid Student Simulation with Large Language Models
par: Yuan, Zhihao, et autres
Publié: (2026)
par: Yuan, Zhihao, et autres
Publié: (2026)
LAGAN: Deep Semi-Supervised Linguistic-Anthropology Classification with Conditional Generative Adversarial Neural Network
par: Kamal, Rossi
Publié: (2023)
par: Kamal, Rossi
Publié: (2023)
Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Documents similaires
-
Investigating Cultural Alignment of Large Language Models
par: AlKhamissi, Badr, et autres
Publié: (2024) -
Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient Classification
par: ElNokrashy, Muhammad, et autres
Publié: (2022) -
A Context-Contrastive Inference Approach To Partial Diacritization
par: ElNokrashy, Muhammad, et autres
Publié: (2024) -
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
par: Jamaa, Yassine, et autres
Publié: (2025) -
The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units
par: AlKhamissi, Badr, et autres
Publié: (2024)