Can LLM Generate Culturally Relevant Commonsense QA Data? Case Study in Indonesian and Sundanese
Fuente:
arXiv
Salvato in:
| Autori principali: | Putri, Rifki Afina, Haznitrama, Faiz Ghifari, Adhista, Dea, Oh, Alice |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
di: Putri, Rifki Afina
Pubblicazione: (2025)
di: Putri, Rifki Afina
Pubblicazione: (2025)
OLA: Output Language Alignment in Code-Switched LLM Interactions
di: Oh, Juhyun, et al.
Pubblicazione: (2026)
di: Oh, Juhyun, et al.
Pubblicazione: (2026)
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
di: Jin, Jiho, et al.
Pubblicazione: (2026)
di: Jin, Jiho, et al.
Pubblicazione: (2026)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
A Neuropsychologically Grounded Evaluation of LLM Cognitive Abilities
di: Haznitrama, Faiz Ghifari, et al.
Pubblicazione: (2026)
di: Haznitrama, Faiz Ghifari, et al.
Pubblicazione: (2026)
Survey of Cultural Awareness in Language Models: Text and Beyond
di: Pawar, Siddhesh, et al.
Pubblicazione: (2024)
di: Pawar, Siddhesh, et al.
Pubblicazione: (2024)
Cendol: Open Instruction-tuned Generative Large Language Models for Indonesian Languages
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
Culturally-Nuanced Story Generation for Reasoning in Low-Resource Languages: The Case of Javanese and Sundanese
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
IndoCulture: Exploring Geographically-Influenced Cultural Commonsense Reasoning Across Eleven Indonesian Provinces
di: Koto, Fajri, et al.
Pubblicazione: (2024)
di: Koto, Fajri, et al.
Pubblicazione: (2024)
XLS-R Deep Learning Model for Multilingual ASR on Low- Resource Languages: Indonesian, Javanese, and Sundanese
di: Arisaputra, Panji, et al.
Pubblicazione: (2024)
di: Arisaputra, Panji, et al.
Pubblicazione: (2024)
ASR Under Noise: Exploring Robustness for Sundanese and Javanese
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
Developing a Comprehensive Framework for Sentiment Analysis in Turkish
di: Aydin, Cem Rifki
Pubblicazione: (2025)
di: Aydin, Cem Rifki
Pubblicazione: (2025)
Common to Whom? Regional Cultural Commonsense and LLM Bias in India
di: Madhusudan, Sangmitra, et al.
Pubblicazione: (2026)
di: Madhusudan, Sangmitra, et al.
Pubblicazione: (2026)
TComQA: Extracting Temporal Commonsense from Text
di: Nair, Lekshmi R, et al.
Pubblicazione: (2025)
di: Nair, Lekshmi R, et al.
Pubblicazione: (2025)
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
di: Jin, Jiho, et al.
Pubblicazione: (2025)
di: Jin, Jiho, et al.
Pubblicazione: (2025)
Commonsense Reasoning in Arab Culture
di: Sadallah, Abdelrahman, et al.
Pubblicazione: (2025)
di: Sadallah, Abdelrahman, et al.
Pubblicazione: (2025)
Risks and NLP Design: A Case Study on Procedural Document QA
di: Haduong, Nikita, et al.
Pubblicazione: (2024)
di: Haduong, Nikita, et al.
Pubblicazione: (2024)
Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
Cultural Commonsense Knowledge for Intercultural Dialogues
di: Nguyen, Tuan-Phong, et al.
Pubblicazione: (2024)
di: Nguyen, Tuan-Phong, et al.
Pubblicazione: (2024)
BLEnD: A Benchmark for LLMs on Everyday Knowledge in Diverse Cultures and Languages
di: Myung, Junho, et al.
Pubblicazione: (2024)
di: Myung, Junho, et al.
Pubblicazione: (2024)
LLMs as Cultural Archives: Cultural Commonsense Knowledge Graph Extraction
di: Tonga, Junior Cedric, et al.
Pubblicazione: (2026)
di: Tonga, Junior Cedric, et al.
Pubblicazione: (2026)
The Generative AI Paradox on Evaluation: What It Can Solve, It May Not Evaluate
di: Oh, Juhyun, et al.
Pubblicazione: (2024)
di: Oh, Juhyun, et al.
Pubblicazione: (2024)
AcTED: Automatic Acquisition of Typical Event Duration for Semi-supervised Temporal Commonsense QA
di: Virgo, Felix, et al.
Pubblicazione: (2024)
di: Virgo, Felix, et al.
Pubblicazione: (2024)
ReTraceQA: Evaluating Reasoning Traces of Small Language Models in Commonsense Question Answering
di: Molfese, Francesco Maria, et al.
Pubblicazione: (2025)
di: Molfese, Francesco Maria, et al.
Pubblicazione: (2025)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
di: Zhang, Tianhui, et al.
Pubblicazione: (2026)
di: Zhang, Tianhui, et al.
Pubblicazione: (2026)
Culture is Everywhere: A Call for Intentionally Cultural Evaluation
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
di: Shen, Siqi, et al.
Pubblicazione: (2024)
di: Shen, Siqi, et al.
Pubblicazione: (2024)
LLM-C3MOD: A Human-LLM Collaborative System for Cross-Cultural Hate Speech Moderation
di: Park, Junyeong, et al.
Pubblicazione: (2025)
di: Park, Junyeong, et al.
Pubblicazione: (2025)
Evaluating the Evaluation of Diversity in Commonsense Generation
di: Zhang, Tianhui, et al.
Pubblicazione: (2025)
di: Zhang, Tianhui, et al.
Pubblicazione: (2025)
Bias Mitigation or Cultural Commonsense? Evaluating LLMs with a Japanese Dataset
di: Yamamoto, Taisei, et al.
Pubblicazione: (2025)
di: Yamamoto, Taisei, et al.
Pubblicazione: (2025)
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures
di: Chang, Tyler A., et al.
Pubblicazione: (2025)
di: Chang, Tyler A., et al.
Pubblicazione: (2025)
Ko-PIQA: A Korean Physical Commonsense Reasoning Dataset with Cultural Context
di: Choi, Dasol, et al.
Pubblicazione: (2025)
di: Choi, Dasol, et al.
Pubblicazione: (2025)
No Shortcuts to Culture: Indonesian Multi-hop Question Answering for Complex Cultural Understanding
di: Permadi, Vynska Amalia, et al.
Pubblicazione: (2026)
di: Permadi, Vynska Amalia, et al.
Pubblicazione: (2026)
BabyBabelLM: A Multilingual Benchmark of Developmentally Plausible Training Data
di: Jumelet, Jaap, et al.
Pubblicazione: (2025)
di: Jumelet, Jaap, et al.
Pubblicazione: (2025)
SynCPKL: Harnessing LLMs to Generate Synthetic Data for Commonsense Persona Knowledge Linking
di: Lin, Kuan-Yen
Pubblicazione: (2024)
di: Lin, Kuan-Yen
Pubblicazione: (2024)
CLIcK: A Benchmark Dataset of Cultural and Linguistic Intelligence in Korean
di: Kim, Eunsu, et al.
Pubblicazione: (2024)
di: Kim, Eunsu, et al.
Pubblicazione: (2024)
The Mystery of Compositional Generalization in Graph-based Generative Commonsense Reasoning
di: Fu, Xiyan, et al.
Pubblicazione: (2024)
di: Fu, Xiyan, et al.
Pubblicazione: (2024)
Susu Box or Piggy Bank: Assessing Cultural Commonsense Knowledge between Ghana and the U.S
di: Acquaye, Christabel, et al.
Pubblicazione: (2024)
di: Acquaye, Christabel, et al.
Pubblicazione: (2024)
IndoSafety: Culturally Grounded Safety for LLMs in Indonesian Languages
di: Azmi, Muhammad Falensi, et al.
Pubblicazione: (2025)
di: Azmi, Muhammad Falensi, et al.
Pubblicazione: (2025)
AI Can Be Cognitively Biased: An Exploratory Study on Threshold Priming in LLM-Based Batch Relevance Assessment
di: Chen, Nuo, et al.
Pubblicazione: (2024)
di: Chen, Nuo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
di: Putri, Rifki Afina
Pubblicazione: (2025) -
OLA: Output Language Alignment in Code-Switched LLM Interactions
di: Oh, Juhyun, et al.
Pubblicazione: (2026) -
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
di: Jin, Jiho, et al.
Pubblicazione: (2026) -
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024) -
A Neuropsychologically Grounded Evaluation of LLM Cognitive Abilities
di: Haznitrama, Faiz Ghifari, et al.
Pubblicazione: (2026)