Extrinsic Evaluation of Cultural Competence in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Bhatt, Shaily, Diaz, Fernando |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TALES: A Taxonomy and Analysis of Cultural Representations in LLM-generated Stories
di: Bhagat, Kirti, et al.
Pubblicazione: (2025)
di: Bhagat, Kirti, et al.
Pubblicazione: (2025)
Toward Socially Aware Vision-Language Models: Evaluating Cultural Competence Through Multimodal Story Generation
di: Mukherjee, Arka, et al.
Pubblicazione: (2025)
di: Mukherjee, Arka, et al.
Pubblicazione: (2025)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025)
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025)
Research Borderlands: Analysing Writing Across Research Cultures
di: Bhatt, Shaily, et al.
Pubblicazione: (2025)
di: Bhatt, Shaily, et al.
Pubblicazione: (2025)
Investigating Cultural Alignment of Large Language Models
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
On Classification with Large Language Models in Cultural Analytics
di: Bamman, David, et al.
Pubblicazione: (2024)
di: Bamman, David, et al.
Pubblicazione: (2024)
Culture is Everywhere: A Call for Intentionally Cultural Evaluation
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models
di: Rao, Pooja S. B., et al.
Pubblicazione: (2025)
di: Rao, Pooja S. B., et al.
Pubblicazione: (2025)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
Meta-Cultural Competence: Climbing the Right Hill of Cultural Awareness
di: Saha, Sougata, et al.
Pubblicazione: (2025)
di: Saha, Sougata, et al.
Pubblicazione: (2025)
Evaluating Proactive Risk Awareness of Large Language Models
di: Luo, Xuan, et al.
Pubblicazione: (2026)
di: Luo, Xuan, et al.
Pubblicazione: (2026)
Cultural Alignment in Large Language Models: An Explanatory Analysis Based on Hofstede's Cultural Dimensions
di: Masoud, Reem I., et al.
Pubblicazione: (2023)
di: Masoud, Reem I., et al.
Pubblicazione: (2023)
Dual-Metric Evaluation of Social Bias in Large Language Models: Evidence from an Underrepresented Nepali Cultural Context
di: Pandey, Ashish, et al.
Pubblicazione: (2026)
di: Pandey, Ashish, et al.
Pubblicazione: (2026)
Speciesism in AI: Evaluating Discrimination Against Animals in Large Language Models
di: Jotautaitė, Monika, et al.
Pubblicazione: (2025)
di: Jotautaitė, Monika, et al.
Pubblicazione: (2025)
Evaluating open-source Large Language Models for automated fact-checking
di: Fontana, Nicolo', et al.
Pubblicazione: (2025)
di: Fontana, Nicolo', et al.
Pubblicazione: (2025)
WorldValuesBench: A Large-Scale Benchmark Dataset for Multi-Cultural Value Awareness of Language Models
di: Zhao, Wenlong, et al.
Pubblicazione: (2024)
di: Zhao, Wenlong, et al.
Pubblicazione: (2024)
Leveraging Large Language Models for Actionable Course Evaluation Student Feedback to Lecturers
di: Zhang, Mike, et al.
Pubblicazione: (2024)
di: Zhang, Mike, et al.
Pubblicazione: (2024)
Cancer-Myth: Evaluating Large Language Models on Patient Questions with False Presuppositions
di: Zhu, Wang Bill, et al.
Pubblicazione: (2025)
di: Zhu, Wang Bill, et al.
Pubblicazione: (2025)
Not All Jokes Land: Evaluating Large Language Models Understanding of Workplace Humor
di: Shafiei, Mohammadamin, et al.
Pubblicazione: (2025)
di: Shafiei, Mohammadamin, et al.
Pubblicazione: (2025)
DaKultur: Evaluating the Cultural Awareness of Language Models for Danish with Native Speakers
di: Müller-Eberstein, Max, et al.
Pubblicazione: (2025)
di: Müller-Eberstein, Max, et al.
Pubblicazione: (2025)
Evaluating Large Language Models on Spatial Tasks: A Multi-Task Benchmarking Study
di: Xu, Liuchang, et al.
Pubblicazione: (2024)
di: Xu, Liuchang, et al.
Pubblicazione: (2024)
Evaluating Large Language Models for Detecting Antisemitism
di: Patel, Jay, et al.
Pubblicazione: (2025)
di: Patel, Jay, et al.
Pubblicazione: (2025)
Evaluating Psychological Safety of Large Language Models
di: Li, Xingxuan, et al.
Pubblicazione: (2022)
di: Li, Xingxuan, et al.
Pubblicazione: (2022)
Cultural Value Differences of LLMs: Prompt, Language, and Model Size
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
Navigating the Cultural Kaleidoscope: A Hitchhiker's Guide to Sensitivity in Large Language Models
di: Banerjee, Somnath, et al.
Pubblicazione: (2024)
di: Banerjee, Somnath, et al.
Pubblicazione: (2024)
Training-Free Cultural Alignment of Large Language Models via Persona Disagreement
di: Kiet, Huynh Trung, et al.
Pubblicazione: (2026)
di: Kiet, Huynh Trung, et al.
Pubblicazione: (2026)
WorldView-Bench: A Benchmark for Evaluating Global Cultural Perspectives in Large Language Models
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
Toward Cultural Interpretability: A Linguistic Anthropological Framework for Describing and Evaluating Large Language Models (LLMs)
di: Jones, Graham M., et al.
Pubblicazione: (2024)
di: Jones, Graham M., et al.
Pubblicazione: (2024)
Evaluating Large Language Models in Theory of Mind Tasks
di: Kosinski, Michal
Pubblicazione: (2023)
di: Kosinski, Michal
Pubblicazione: (2023)
UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
Motivation in Large Language Models
di: Nahum, Omer, et al.
Pubblicazione: (2026)
di: Nahum, Omer, et al.
Pubblicazione: (2026)
Scalable Identification and Prioritization of Requisition-Specific Personal Competencies Using Large Language Models
di: Li, Wanxin, et al.
Pubblicazione: (2026)
di: Li, Wanxin, et al.
Pubblicazione: (2026)
Bias and Volatility: A Statistical Framework for Evaluating Large Language Model's Stereotypes and the Associated Generation Inconsistency
di: Liu, Yiran, et al.
Pubblicazione: (2024)
di: Liu, Yiran, et al.
Pubblicazione: (2024)
MalAlgoQA: Pedagogical Evaluation of Counterfactual Reasoning in Large Language Models and Implications for AI in Education
di: Liu, Naiming, et al.
Pubblicazione: (2024)
di: Liu, Naiming, et al.
Pubblicazione: (2024)
Culturally Grounded Personas in Large Language Models: Characterization and Alignment with Socio-Psychological Value Frameworks
di: Greco, Candida M., et al.
Pubblicazione: (2026)
di: Greco, Candida M., et al.
Pubblicazione: (2026)
Multi-turn Evaluation of Anthropomorphic Behaviours in Large Language Models
di: Ibrahim, Lujain, et al.
Pubblicazione: (2025)
di: Ibrahim, Lujain, et al.
Pubblicazione: (2025)
Beyond Instrumental and Substitutive Paradigms: Introducing Machine Culture as an Emergent Phenomenon in Large Language Models
di: Hu, Yueqing, et al.
Pubblicazione: (2026)
di: Hu, Yueqing, et al.
Pubblicazione: (2026)
An Exploration of Higher Education Course Evaluation by Large Language Models
di: Yuan, Bo, et al.
Pubblicazione: (2024)
di: Yuan, Bo, et al.
Pubblicazione: (2024)
Language of Thought Shapes Output Diversity in Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
Evaluating Digital Inclusiveness of Digital Agri-Food Tools Using Large Language Models: A Comparative Analysis Between Human and AI-Based Evaluations
di: Pewinya, Githma, et al.
Pubblicazione: (2026)
di: Pewinya, Githma, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TALES: A Taxonomy and Analysis of Cultural Representations in LLM-generated Stories
di: Bhagat, Kirti, et al.
Pubblicazione: (2025) -
Toward Socially Aware Vision-Language Models: Evaluating Cultural Competence Through Multimodal Story Generation
di: Mukherjee, Arka, et al.
Pubblicazione: (2025) -
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
di: Arzaghi', 'Mina, et al.
Pubblicazione: (2025) -
Research Borderlands: Analysing Writing Across Research Cultures
di: Bhatt, Shaily, et al.
Pubblicazione: (2025) -
Investigating Cultural Alignment of Large Language Models
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)