Towards Geo-Culturally Grounded LLM Generations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lertvittayakumjorn, Piyawat, Kinney, David, Prabhakaran, Vinodkumar, Martin Jr., Donald, Dev, Sunipa |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
par: Jin, Jiho, et autres
Publié: (2026)
par: Jin, Jiho, et autres
Publié: (2026)
A Unified Framework to Quantify Cultural Intelligence of AI
par: Dev, Sunipa, et autres
Publié: (2026)
par: Dev, Sunipa, et autres
Publié: (2026)
SeeGULL Multilingual: a Dataset of Geo-Culturally Situated Stereotypes
par: Bhutani, Mukul, et autres
Publié: (2024)
par: Bhutani, Mukul, et autres
Publié: (2024)
Cultural Compass: A Framework for Organizing Societal Norms to Detect Violations in Human-AI Conversations
par: Cheng, Myra, et autres
Publié: (2026)
par: Cheng, Myra, et autres
Publié: (2026)
Risks of Cultural Erasure in Large Language Models
par: Qadri, Rida, et autres
Publié: (2025)
par: Qadri, Rida, et autres
Publié: (2025)
GeniL: A Multilingual Dataset on Generalizing Language
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
SAFARI: A Community-Engaged Approach and Dataset of Stereotype Resources in the Sub-Saharan African Context
par: Verma, Aishwarya, et autres
Publié: (2026)
par: Verma, Aishwarya, et autres
Publié: (2026)
A Comprehensive Framework to Operationalize Social Stereotypes for Responsible AI Evaluations
par: Davani, Aida, et autres
Publié: (2025)
par: Davani, Aida, et autres
Publié: (2025)
ViSAGe: A Global-Scale Analysis of Visual Stereotypes in Text-to-Image Generation
par: Jha, Akshita, et autres
Publié: (2024)
par: Jha, Akshita, et autres
Publié: (2024)
Towards Explainable Evaluation Metrics for Machine Translation
par: Leiter, Christoph, et autres
Publié: (2023)
par: Leiter, Christoph, et autres
Publié: (2023)
LLM-Human Pipeline for Cultural Context Grounding of Conversations
par: Pujari, Rajkumar, et autres
Publié: (2024)
par: Pujari, Rajkumar, et autres
Publié: (2024)
GRASP: A Disagreement Analysis Framework to Assess Group Associations in Perspectives
par: Prabhakaran, Vinodkumar, et autres
Publié: (2023)
par: Prabhakaran, Vinodkumar, et autres
Publié: (2023)
XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
par: Choi, Dasol, et autres
Publié: (2026)
par: Choi, Dasol, et autres
Publié: (2026)
Cultural Authenticity: Comparing LLM Cultural Representations to Native Human Expectations
par: van Liemt, Erin MacMurray, et autres
Publié: (2026)
par: van Liemt, Erin MacMurray, et autres
Publié: (2026)
AdaCultureSafe: Adaptive Cultural Safety Grounded by Cultural Knowledge in Large Language Models
par: Kang, Hankun, et autres
Publié: (2026)
par: Kang, Hankun, et autres
Publié: (2026)
TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages
par: Akinode, Victor, et autres
Publié: (2026)
par: Akinode, Victor, et autres
Publié: (2026)
An Investigation into Value Misalignment in LLM-Generated Texts for Cultural Heritage
par: Bu, Fan, et autres
Publié: (2025)
par: Bu, Fan, et autres
Publié: (2025)
IRLBench: A Multi-modal, Culturally Grounded, Parallel Irish-English Benchmark for Open-Ended LLM Reasoning Evaluation
par: Tran, Khanh-Tung, et autres
Publié: (2025)
par: Tran, Khanh-Tung, et autres
Publié: (2025)
LLM-BABYBENCH: Understanding and Evaluating Grounded Planning and Reasoning in LLMs
par: Choukrani, Omar, et autres
Publié: (2025)
par: Choukrani, Omar, et autres
Publié: (2025)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
par: Wang, Zixuan, et autres
Publié: (2025)
par: Wang, Zixuan, et autres
Publié: (2025)
The Path of Least Resistance: Guiding LLM Reasoning Trajectories with Prefix Consensus
par: Jindal, Ishan, et autres
Publié: (2026)
par: Jindal, Ishan, et autres
Publié: (2026)
D3CODE: Disentangling Disagreements in Data across Cultures on Offensiveness Detection and Evaluation
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
Code Execution as Grounded Supervision for LLM Reasoning
par: Jung, Dongwon, et autres
Publié: (2025)
par: Jung, Dongwon, et autres
Publié: (2025)
CulturALL: Benchmarking Multilingual and Multicultural Competence of LLMs on Grounded Tasks
par: Lin, Peiqin, et autres
Publié: (2026)
par: Lin, Peiqin, et autres
Publié: (2026)
MisgenderMender: A Community-Informed Approach to Interventions for Misgendering
par: Hossain, Tamanna, et autres
Publié: (2024)
par: Hossain, Tamanna, et autres
Publié: (2024)
SIFT: Grounding LLM Reasoning in Contexts via Stickers
par: Zeng, Zihao, et autres
Publié: (2025)
par: Zeng, Zihao, et autres
Publié: (2025)
Polypersona: Persona-Grounded LLM for Synthetic Survey Responses
par: Dash, Tejaswani, et autres
Publié: (2025)
par: Dash, Tejaswani, et autres
Publié: (2025)
Visualizing and Benchmarking LLM Factual Hallucination Tendencies via Internal State Analysis and Clustering
par: Mao, Nathan, et autres
Publié: (2026)
par: Mao, Nathan, et autres
Publié: (2026)
MMA-ASIA: A Multilingual and Multimodal Alignment Framework for Culturally-Grounded Evaluation
par: Zheng, Weihua, et autres
Publié: (2025)
par: Zheng, Weihua, et autres
Publié: (2025)
SurveyEval: Towards Comprehensive Evaluation of LLM-Generated Academic Surveys
par: Zhao, Jiahao, et autres
Publié: (2025)
par: Zhao, Jiahao, et autres
Publié: (2025)
Towards Cross-Cultural Machine Translation with Retrieval-Augmented Generation from Multilingual Knowledge Graphs
par: Conia, Simone, et autres
Publié: (2024)
par: Conia, Simone, et autres
Publié: (2024)
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
par: Ke, Pei, et autres
Publié: (2023)
par: Ke, Pei, et autres
Publié: (2023)
BengaliFig: A Low-Resource Challenge for Figurative and Culturally Grounded Reasoning in Bengali
par: Sefat, Abdullah Al
Publié: (2025)
par: Sefat, Abdullah Al
Publié: (2025)
Taxonomy of User Needs and Actions
par: Shelby, Renee, et autres
Publié: (2025)
par: Shelby, Renee, et autres
Publié: (2025)
Multiple LLM Agents Debate for Equitable Cultural Alignment
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
par: Eren, Maksim, et autres
Publié: (2026)
par: Eren, Maksim, et autres
Publié: (2026)
Towards a Neurosymbolic Reasoning System Grounded in Schematic Representations
par: Olivier, François, et autres
Publié: (2025)
par: Olivier, François, et autres
Publié: (2025)
CultureBank: An Online Community-Driven Knowledge Base Towards Culturally Aware Language Technologies
par: Shi, Weiyan, et autres
Publié: (2024)
par: Shi, Weiyan, et autres
Publié: (2024)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
Culturally-Grounded Governance for Multilingual Language Models: Rights, Data Boundaries, and Accountable AI Design
par: Shi, Hanjing, et autres
Publié: (2026)
par: Shi, Hanjing, et autres
Publié: (2026)
Documents similaires
-
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
par: Jin, Jiho, et autres
Publié: (2026) -
A Unified Framework to Quantify Cultural Intelligence of AI
par: Dev, Sunipa, et autres
Publié: (2026) -
SeeGULL Multilingual: a Dataset of Geo-Culturally Situated Stereotypes
par: Bhutani, Mukul, et autres
Publié: (2024) -
Cultural Compass: A Framework for Organizing Societal Norms to Detect Violations in Human-AI Conversations
par: Cheng, Myra, et autres
Publié: (2026) -
Risks of Cultural Erasure in Large Language Models
par: Qadri, Rida, et autres
Publié: (2025)