CultureScope: A Dimensional Lens for Probing Cultural Understanding in LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Jinghao, Jiang, Sihang, Guo, Shiwei, Chen, Shisong, Xiao, Yanghua, Feng, Hongwei, Liang, Jiaqing, HE, Minggui, Tao, Shimin, Ma, Hongxia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Do Large Language Models Truly Understand Cross-cultural Differences?
por: Guo, Shiwei, et al.
Publicado: (2025)
por: Guo, Shiwei, et al.
Publicado: (2025)
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
por: Jiang, Sihang, et al.
Publicado: (2026)
por: Jiang, Sihang, et al.
Publicado: (2026)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
por: Huang, Yuncheng, et al.
Publicado: (2023)
por: Huang, Yuncheng, et al.
Publicado: (2023)
VCEval: Rethinking What is a Good Educational Video and How to Automatically Evaluate It
por: Zhu, Xiaoxuan, et al.
Publicado: (2024)
por: Zhu, Xiaoxuan, et al.
Publicado: (2024)
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
por: Jiang, Zishang, et al.
Publicado: (2025)
por: Jiang, Zishang, et al.
Publicado: (2025)
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
por: Liu, Yilun, et al.
Publicado: (2025)
por: Liu, Yilun, et al.
Publicado: (2025)
EDGE: Enhanced Grounded GUI Understanding with Enriched Multi-Granularity Synthetic Data
por: Chen, Xuetian, et al.
Publicado: (2024)
por: Chen, Xuetian, et al.
Publicado: (2024)
Enhancing Confidence Expression in Large Language Models Through Learning from Past Experience
por: Han, Haixia, et al.
Publicado: (2024)
por: Han, Haixia, et al.
Publicado: (2024)
Can Pre-trained Language Models Understand Chinese Humor?
por: Chen, Yuyan, et al.
Publicado: (2024)
por: Chen, Yuyan, et al.
Publicado: (2024)
C-Mining: Unsupervised Discovery of Seeds for Cultural Data Synthesis via Geometric Misalignment
por: Zeng, Pufan, et al.
Publicado: (2026)
por: Zeng, Pufan, et al.
Publicado: (2026)
CultureForest: Understanding and Evaluating Cultural Norm Grounded Reasoning in LLMs
por: Ye, Yangfan, et al.
Publicado: (2026)
por: Ye, Yangfan, et al.
Publicado: (2026)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
por: Li, Yanda, et al.
Publicado: (2024)
por: Li, Yanda, et al.
Publicado: (2024)
MultiLingPoT: Enhancing Mathematical Reasoning with Multilingual Program Fine-tuning
por: Li, Nianqi, et al.
Publicado: (2024)
por: Li, Nianqi, et al.
Publicado: (2024)
HINT: Helping Ineffective Rollouts Navigate Towards Effectiveness
por: Wang, Xinyi, et al.
Publicado: (2025)
por: Wang, Xinyi, et al.
Publicado: (2025)
Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
por: He, Qianxi, et al.
Publicado: (2025)
por: He, Qianxi, et al.
Publicado: (2025)
Laying the Foundation First? Investigating the Generalization from Atomic Skills to Complex Reasoning Tasks
por: Huang, Yuncheng, et al.
Publicado: (2024)
por: Huang, Yuncheng, et al.
Publicado: (2024)
Adaptive Ordered Information Extraction with Deep Reinforcement Learning
por: Huang, Wenhao, et al.
Publicado: (2023)
por: Huang, Wenhao, et al.
Publicado: (2023)
Small Language Model Can Self-correct
por: Han, Haixia, et al.
Publicado: (2024)
por: Han, Haixia, et al.
Publicado: (2024)
From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
por: He, Qianyu, et al.
Publicado: (2024)
por: He, Qianyu, et al.
Publicado: (2024)
Is There a One-Model-Fits-All Approach to Information Extraction? Revisiting Task Definition Biases
por: Huang, Wenhao, et al.
Publicado: (2024)
por: Huang, Wenhao, et al.
Publicado: (2024)
Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple Extraction
por: Ding, Zepeng, et al.
Publicado: (2024)
por: Ding, Zepeng, et al.
Publicado: (2024)
Probing Cultural Awareness in LLMs: A Case Study of Cross-Culture Aesthetic Stylistics
por: Wang, Jiashuo, et al.
Publicado: (2026)
por: Wang, Jiashuo, et al.
Publicado: (2026)
R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning
por: He, Minggui, et al.
Publicado: (2025)
por: He, Minggui, et al.
Publicado: (2025)
AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
por: Huang, Wenhao, et al.
Publicado: (2024)
por: Huang, Wenhao, et al.
Publicado: (2024)
Mind the Generation Process: Fine-Grained Confidence Estimation During LLM Generation
por: Han, Jinyi, et al.
Publicado: (2025)
por: Han, Jinyi, et al.
Publicado: (2025)
Ground Every Sentence: Improving Retrieval-Augmented LLMs with Interleaved Reference-Claim Generation
por: Xia, Sirui, et al.
Publicado: (2024)
por: Xia, Sirui, et al.
Publicado: (2024)
CULEMO: Cultural Lenses on Emotion -- Benchmarking LLMs for Cross-Cultural Emotion Understanding
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
por: Zhao, Haiquan, et al.
Publicado: (2024)
por: Zhao, Haiquan, et al.
Publicado: (2024)
RubricEval: A Rubric-Level Meta-Evaluation Benchmark for LLM Judges in Instruction Following
por: Pan, Tianjun, et al.
Publicado: (2026)
por: Pan, Tianjun, et al.
Publicado: (2026)
A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
por: Han, Jinyi, et al.
Publicado: (2025)
por: Han, Jinyi, et al.
Publicado: (2025)
LUK: Empowering Log Understanding with Expert Knowledge from Large Language Models
por: Ma, Lipeng, et al.
Publicado: (2024)
por: Ma, Lipeng, et al.
Publicado: (2024)
Can Large Language Models Understand Real-World Complex Instructions?
por: He, Qianyu, et al.
Publicado: (2023)
por: He, Qianyu, et al.
Publicado: (2023)
The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
por: Liu, Yilun, et al.
Publicado: (2026)
por: Liu, Yilun, et al.
Publicado: (2026)
Structured Reasoning for Large Language Models
por: Han, Jinyi, et al.
Publicado: (2026)
por: Han, Jinyi, et al.
Publicado: (2026)
Human Cultures through the Scientific Lens
por: Boyer, Pascal
Publicado: (2021)
por: Boyer, Pascal
Publicado: (2021)
Creating a Lens of Chinese Culture: A Multimodal Dataset for Chinese Pun Rebus Art Understanding
por: Zhang, Tuo, et al.
Publicado: (2024)
por: Zhang, Tuo, et al.
Publicado: (2024)
Light Up the Shadows: Enhance Long-Tailed Entity Grounding with Concept-Guided Vision-Language Models
por: Zhang, Yikai, et al.
Publicado: (2024)
por: Zhang, Yikai, et al.
Publicado: (2024)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
por: Zhang, Yifei, et al.
Publicado: (2024)
por: Zhang, Yifei, et al.
Publicado: (2024)
BookWorld: From Novels to Interactive Agent Societies for Creative Story Generation
por: Ran, Yiting, et al.
Publicado: (2025)
por: Ran, Yiting, et al.
Publicado: (2025)
CDS: Knowledge Component-Driven Data Synthesis Guided by Cognitive Diagnosis Theory
por: Zhao, Haokun, et al.
Publicado: (2025)
por: Zhao, Haokun, et al.
Publicado: (2025)
Ejemplares similares
-
Do Large Language Models Truly Understand Cross-cultural Differences?
por: Guo, Shiwei, et al.
Publicado: (2025) -
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
por: Jiang, Sihang, et al.
Publicado: (2026) -
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
por: Huang, Yuncheng, et al.
Publicado: (2023) -
VCEval: Rethinking What is a Good Educational Video and How to Automatically Evaluate It
por: Zhu, Xiaoxuan, et al.
Publicado: (2024) -
Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs
por: Jiang, Zishang, et al.
Publicado: (2025)