I Am Aligned, But With Whom? MENA Values Benchmark for Evaluating Cultural Alignment and Multilingual Bias in LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Zahraei, Pardis Sadat, Asgari, Ehsaneddin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TuringQ: Benchmarking AI Comprehension in Theory of Computation
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
Detecting Bias and Enhancing Diagnostic Accuracy in Large Language Models for Healthcare
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
WSC+: Enhancing The Winograd Schema Challenge Using Tree-of-Experts
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024)
CLASP: Contrastive Language-Speech Pretraining for Multilingual Multimodal Information Retrieval
por: Abootorabi, Mohammad Mahdi, et al.
Publicado: (2024)
por: Abootorabi, Mohammad Mahdi, et al.
Publicado: (2024)
EICAP: Deep Dive in Assessment and Enhancement of Large Language Models in Emotional Intelligence through Multi-Turn Conversations
por: Nazar, Nizi, et al.
Publicado: (2025)
por: Nazar, Nizi, et al.
Publicado: (2025)
M$^3$Face: A Unified Multi-Modal Multilingual Framework for Human Face Generation and Editing
por: Mofayezi, Mohammadreza, et al.
Publicado: (2024)
por: Mofayezi, Mohammadreza, et al.
Publicado: (2024)
Taxi1500: A Multilingual Dataset for Text Classification in 1500 Languages
por: Ma, Chunlan, et al.
Publicado: (2023)
por: Ma, Chunlan, et al.
Publicado: (2023)
Common to Whom? Regional Cultural Commonsense and LLM Bias in India
por: Madhusudan, Sangmitra, et al.
Publicado: (2026)
por: Madhusudan, Sangmitra, et al.
Publicado: (2026)
ADAM: A Diverse Archive of Mankind for Evaluating and Enhancing LLMs in Biographical Reasoning
por: Cekinmez, Jasin, et al.
Publicado: (2025)
por: Cekinmez, Jasin, et al.
Publicado: (2025)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
por: Rystrøm, Jonathan, et al.
Publicado: (2025)
por: Rystrøm, Jonathan, et al.
Publicado: (2025)
The Judge Who Never Admits: Hidden Shortcuts in LLM-based Evaluation
por: Marioriyad, Arash, et al.
Publicado: (2026)
por: Marioriyad, Arash, et al.
Publicado: (2026)
MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies
por: Asgari, Ehsaneddin, et al.
Publicado: (2025)
por: Asgari, Ehsaneddin, et al.
Publicado: (2025)
Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning
por: Choenni, Rochelle, et al.
Publicado: (2024)
por: Choenni, Rochelle, et al.
Publicado: (2024)
Lessons Without Borders? Evaluating Cultural Alignment of LLMs Using Multilingual Story Moral Generation
por: Wu, Sophie, et al.
Publicado: (2026)
por: Wu, Sophie, et al.
Publicado: (2026)
IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages
por: Hanif, Ikhlasul Akmal, et al.
Publicado: (2026)
por: Hanif, Ikhlasul Akmal, et al.
Publicado: (2026)
"Be My Cheese?": Cultural Nuance Benchmarking for Machine Translation in Multilingual LLMs
por: Van Doren, Madison, et al.
Publicado: (2026)
por: Van Doren, Madison, et al.
Publicado: (2026)
Flames: Benchmarking Value Alignment of LLMs in Chinese
por: Huang, Kexin, et al.
Publicado: (2023)
por: Huang, Kexin, et al.
Publicado: (2023)
Can LLMs Grasp Implicit Cultural Values? Benchmarking LLMs' Cultural Intelligence with CQ-Bench
por: Liu, Ziyi, et al.
Publicado: (2025)
por: Liu, Ziyi, et al.
Publicado: (2025)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
por: Bu, Mengyu, et al.
Publicado: (2025)
por: Bu, Mengyu, et al.
Publicado: (2025)
I Think, Therefore I Am Under-Qualified? A Benchmark for Evaluating Linguistic Shibboleth Detection in LLM Hiring Evaluations
por: Kharchenko, Julia, et al.
Publicado: (2025)
por: Kharchenko, Julia, et al.
Publicado: (2025)
Concept Space Alignment in Multilingual LLMs
por: Peng, Qiwei, et al.
Publicado: (2024)
por: Peng, Qiwei, et al.
Publicado: (2024)
Rethinking Cross-lingual Alignment: Balancing Transfer and Cultural Erasure in Multilingual LLMs
por: Han, HyoJung, et al.
Publicado: (2025)
por: Han, HyoJung, et al.
Publicado: (2025)
A Dual-Layered Evaluation of Geopolitical and Cultural Bias in LLMs
por: Kim, Sean, et al.
Publicado: (2025)
por: Kim, Sean, et al.
Publicado: (2025)
MCEval: A Dynamic Framework for Fair Multilingual Cultural Evaluation of LLMs
por: Huang, Shulin, et al.
Publicado: (2025)
por: Huang, Shulin, et al.
Publicado: (2025)
CulturALL: Benchmarking Multilingual and Multicultural Competence of LLMs on Grounded Tasks
por: Lin, Peiqin, et al.
Publicado: (2026)
por: Lin, Peiqin, et al.
Publicado: (2026)
BanglaSocialBench: A Benchmark for Evaluating Sociopragmatic and Cultural Alignment of LLMs in Bangladeshi Social Interaction
por: Sijan, Tanvir Ahmed, et al.
Publicado: (2026)
por: Sijan, Tanvir Ahmed, et al.
Publicado: (2026)
Cross-Lingual Consensus: Aligning Multilingual Cultural Knowledge via Multilingual Self-Consistency
por: Soegeng, Andrew Ivan, et al.
Publicado: (2026)
por: Soegeng, Andrew Ivan, et al.
Publicado: (2026)
More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
por: Nadeem, Afrozah, et al.
Publicado: (2026)
por: Nadeem, Afrozah, et al.
Publicado: (2026)
Obscured but Not Erased: Evaluating Nationality Bias in LLMs via Name-Based Bias Benchmarks
por: Pelosio, Giulio, et al.
Publicado: (2025)
por: Pelosio, Giulio, et al.
Publicado: (2025)
Language Bias under Conflicting Information in Multilingual LLMs
por: Östling, Robert, et al.
Publicado: (2026)
por: Östling, Robert, et al.
Publicado: (2026)
Bias Mitigation or Cultural Commonsense? Evaluating LLMs with a Japanese Dataset
por: Yamamoto, Taisei, et al.
Publicado: (2025)
por: Yamamoto, Taisei, et al.
Publicado: (2025)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Align to the Pivot: Dual Alignment with Self-Feedback for Multilingual Math Reasoning
por: Zhao, Chunxu, et al.
Publicado: (2026)
por: Zhao, Chunxu, et al.
Publicado: (2026)
NativQA: Multilingual Culturally-Aligned Natural Query for LLMs
por: Hasan, Md. Arid, et al.
Publicado: (2024)
por: Hasan, Md. Arid, et al.
Publicado: (2024)
I Am Not Them: Fluid Identities and Persistent Out-group Bias in Large Language Models
por: Dong, Wenchao, et al.
Publicado: (2024)
por: Dong, Wenchao, et al.
Publicado: (2024)
How Language Directions Align with Token Geometry in Multilingual LLMs
por: Kim, JaeSeong, et al.
Publicado: (2025)
por: Kim, JaeSeong, et al.
Publicado: (2025)
SuperPos-Prompt: Enhancing Soft Prompt Tuning of Language Models with Superposition of Multi Token Embeddings
por: SadraeiJavaeri, MohammadAli, et al.
Publicado: (2024)
por: SadraeiJavaeri, MohammadAli, et al.
Publicado: (2024)
CURE: Cultural Understanding and Reasoning Evaluation - A Framework for "Thick" Culture Alignment Evaluation in LLMs
por: Vo, Truong, et al.
Publicado: (2025)
por: Vo, Truong, et al.
Publicado: (2025)
Ejemplares similares
-
TuringQ: Benchmarking AI Comprehension in Theory of Computation
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024) -
Detecting Bias and Enhancing Diagnostic Accuracy in Large Language Models for Healthcare
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024) -
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025) -
WSC+: Enhancing The Winograd Schema Challenge Using Tree-of-Experts
por: Zahraei, Pardis Sadat, et al.
Publicado: (2024) -
CLASP: Contrastive Language-Speech Pretraining for Multilingual Multimodal Information Retrieval
por: Abootorabi, Mohammad Mahdi, et al.
Publicado: (2024)