CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Shudong, Jin, Yiqiao, Li, Cheng, Wong, Derek F., Wen, Qingsong, Sun, Lichao, Chen, Haipeng, Xie, Xing, Wang, Jindong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CulturePark: Boosting Cross-cultural Understanding in Large Language Models
par: Li, Cheng, et autres
Publié: (2024)
par: Li, Cheng, et autres
Publié: (2024)
CultureLLM: Incorporating Cultural Differences into Large Language Models
par: Li, Cheng, et autres
Publié: (2024)
par: Li, Cheng, et autres
Publié: (2024)
CompeteAI: Understanding the Competition Dynamics in Large Language Model-based Agents
par: Zhao, Qinlin, et autres
Publié: (2023)
par: Zhao, Qinlin, et autres
Publié: (2023)
Learning from "Silly" Questions Improves Large Language Models, But Only Slightly
par: Zhu, Tingyuan, et autres
Publié: (2024)
par: Zhu, Tingyuan, et autres
Publié: (2024)
Rice-VL: Evaluating Vision-Language Models for Cultural Understanding Across ASEAN Countries
par: Pranav, Tushar, et autres
Publié: (2025)
par: Pranav, Tushar, et autres
Publié: (2025)
Cultural Awareness in Vision-Language Models: A Cross-Country Exploration
par: Madasu, Avinash, et autres
Publié: (2025)
par: Madasu, Avinash, et autres
Publié: (2025)
Benchmarking Vision Language Models for Cultural Understanding
par: Nayak, Shravan, et autres
Publié: (2024)
par: Nayak, Shravan, et autres
Publié: (2024)
Time-VLM: Exploring Multimodal Vision-Language Models for Augmented Time Series Forecasting
par: Zhong, Siru, et autres
Publié: (2025)
par: Zhong, Siru, et autres
Publié: (2025)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
CAReDiO: Cultural Alignment via Representativeness and Distinctiveness Guided Data Optimization
par: Yao, Jing, et autres
Publié: (2025)
par: Yao, Jing, et autres
Publié: (2025)
ARM2: Adaptive Reasoning Model with Vision Understanding and Executable Code
par: Xie, Jian, et autres
Publié: (2025)
par: Xie, Jian, et autres
Publié: (2025)
VULCA-Bench: A Multicultural Vision-Language Benchmark for Evaluating Cultural Understanding
par: Yu, Haorui, et autres
Publié: (2026)
par: Yu, Haorui, et autres
Publié: (2026)
BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
par: Tan, Bryan Chen Zhengyu, et autres
Publié: (2025)
par: Tan, Bryan Chen Zhengyu, et autres
Publié: (2025)
SciEvo: A 2 Million, 30-Year Cross-disciplinary Dataset for Temporal Scientometric Analysis
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
HKCanto-Eval: A Benchmark for Evaluating Cantonese Language Understanding and Cultural Comprehension in LLMs
par: Cheng, Tsz Chung, et autres
Publié: (2025)
par: Cheng, Tsz Chung, et autres
Publié: (2025)
All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages
par: Vayani, Ashmal, et autres
Publié: (2024)
par: Vayani, Ashmal, et autres
Publié: (2024)
Evaluation of Cultural Competence of Vision-Language Models
par: Yadav, Srishti, et autres
Publié: (2025)
par: Yadav, Srishti, et autres
Publié: (2025)
UniEDU: A Unified Language and Vision Assistant for Education Applications
par: Chu, Zhendong, et autres
Publié: (2025)
par: Chu, Zhendong, et autres
Publié: (2025)
Language over Content: Tracing Cultural Understanding in Multilingual Large Language Models
par: Cho, Seungho, et autres
Publié: (2025)
par: Cho, Seungho, et autres
Publié: (2025)
RoRA-VLM: Robust Retrieval-Augmented Vision Language Models
par: Qi, Jingyuan, et autres
Publié: (2024)
par: Qi, Jingyuan, et autres
Publié: (2024)
World in a Frame: Understanding Culture Mixing as a New Challenge for Vision-Language Models
par: Kim, Eunsu, et autres
Publié: (2025)
par: Kim, Eunsu, et autres
Publié: (2025)
Vision-Language Models under Cultural and Inclusive Considerations
par: Karamolegkou, Antonia, et autres
Publié: (2024)
par: Karamolegkou, Antonia, et autres
Publié: (2024)
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation
par: Zhou, Li, et autres
Publié: (2025)
par: Zhou, Li, et autres
Publié: (2025)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
par: Wang, Yuhang, et autres
Publié: (2023)
par: Wang, Yuhang, et autres
Publié: (2023)
AlignVLM: Bridging Vision and Language Latent Spaces for Multimodal Document Understanding
par: Masry, Ahmed, et autres
Publié: (2025)
par: Masry, Ahmed, et autres
Publié: (2025)
Cross-Cultural Expert-Level Art Critique Evaluation with Vision-Language Models
par: Yu, Haorui, et autres
Publié: (2026)
par: Yu, Haorui, et autres
Publié: (2026)
Are Vision Language Models Cross-Cultural Theory of Mind Reasoners?
par: Nazi, Zabir Al, et autres
Publié: (2025)
par: Nazi, Zabir Al, et autres
Publié: (2025)
CultiVerse: Towards Cross-Cultural Understanding for Paintings with Large Language Model
par: Zhang, Wei, et autres
Publié: (2024)
par: Zhang, Wei, et autres
Publié: (2024)
How Culturally Aware are Vision-Language Models?
par: Burda-Lassen, Olena, et autres
Publié: (2024)
par: Burda-Lassen, Olena, et autres
Publié: (2024)
Evaluating Visual and Cultural Interpretation: The K-Viscuit Benchmark with Human-VLM Collaboration
par: Park, ChaeHun, et autres
Publié: (2024)
par: Park, ChaeHun, et autres
Publié: (2024)
OViP: Online Vision-Language Preference Learning for VLM Hallucination
par: Liu, Shujun, et autres
Publié: (2025)
par: Liu, Shujun, et autres
Publié: (2025)
Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist
par: Zhou, Zihao, et autres
Publié: (2024)
par: Zhou, Zihao, et autres
Publié: (2024)
LLM4Brain: Training a Large Language Model for Brain Video Understanding
par: Zheng, Ruizhe, et autres
Publié: (2024)
par: Zheng, Ruizhe, et autres
Publié: (2024)
On the Cultural Anachronism and Temporal Reasoning in Vision Language Models
par: Ranjan, Mukul, et autres
Publié: (2026)
par: Ranjan, Mukul, et autres
Publié: (2026)
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures
par: Chang, Tyler A., et autres
Publié: (2025)
par: Chang, Tyler A., et autres
Publié: (2025)
RelationVLM: Making Large Vision-Language Models Understand Visual Relations
par: Huang, Zhipeng, et autres
Publié: (2024)
par: Huang, Zhipeng, et autres
Publié: (2024)
ScVLM: Enhancing Vision-Language Model for Safety-Critical Event Understanding
par: Shi, Liang, et autres
Publié: (2024)
par: Shi, Liang, et autres
Publié: (2024)
Do LLMs Understand Wine Descriptors Across Cultures? A Benchmark for Cultural Adaptations of Wine Reviews
par: Zou, Chenye, et autres
Publié: (2025)
par: Zou, Chenye, et autres
Publié: (2025)
RE-VLM: Event-Augmented Vision-Language Model for Scene Understanding
par: Liu, Hanqing, et autres
Publié: (2026)
par: Liu, Hanqing, et autres
Publié: (2026)
Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Documents similaires
-
CulturePark: Boosting Cross-cultural Understanding in Large Language Models
par: Li, Cheng, et autres
Publié: (2024) -
CultureLLM: Incorporating Cultural Differences into Large Language Models
par: Li, Cheng, et autres
Publié: (2024) -
CompeteAI: Understanding the Competition Dynamics in Large Language Model-based Agents
par: Zhao, Qinlin, et autres
Publié: (2023) -
Learning from "Silly" Questions Improves Large Language Models, But Only Slightly
par: Zhu, Tingyuan, et autres
Publié: (2024) -
Rice-VL: Evaluating Vision-Language Models for Cultural Understanding Across ASEAN Countries
par: Pranav, Tushar, et autres
Publié: (2025)