WorldValuesBench: A Large-Scale Benchmark Dataset for Multi-Cultural Value Awareness of Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Wenlong, Mondal, Debanjan, Tandon, Niket, Dillion, Danica, Gray, Kurt, Gu, Yuling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LocalValueBench: A Collaboratively Built and Extensible Benchmark for Evaluating Localized Value Alignment and Ethical Safety in Large Language Models
di: Meadows, Gwenyth Isobel, et al.
Pubblicazione: (2024)
di: Meadows, Gwenyth Isobel, et al.
Pubblicazione: (2024)
WorldView-Bench: A Benchmark for Evaluating Global Cultural Perspectives in Large Language Models
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
Culturally Grounded Personas in Large Language Models: Characterization and Alignment with Socio-Psychological Value Frameworks
di: Greco, Candida M., et al.
Pubblicazione: (2026)
di: Greco, Candida M., et al.
Pubblicazione: (2026)
Cultural Value Differences of LLMs: Prompt, Language, and Model Size
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
Beyond Demographics: Enhancing Cultural Value Survey Simulation with Multi-Stage Personality-Driven Cognitive Reasoning
di: Liu, Haijiang, et al.
Pubblicazione: (2025)
di: Liu, Haijiang, et al.
Pubblicazione: (2025)
The Ethics of AI Value Chains
di: Attard-Frost, Blair, et al.
Pubblicazione: (2023)
di: Attard-Frost, Blair, et al.
Pubblicazione: (2023)
Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions
di: Huang, Saffron, et al.
Pubblicazione: (2025)
di: Huang, Saffron, et al.
Pubblicazione: (2025)
XCR-Bench: A Multi-Task Benchmark for Evaluating Cultural Reasoning in LLMs
di: Kabir, Mohsinul, et al.
Pubblicazione: (2026)
di: Kabir, Mohsinul, et al.
Pubblicazione: (2026)
Denevil: Towards Deciphering and Navigating the Ethical Values of Large Language Models via Instruction Learning
di: Duan, Shitong, et al.
Pubblicazione: (2023)
di: Duan, Shitong, et al.
Pubblicazione: (2023)
Improving Cross-Cultural Survey Simulation with Calibrated Value Personas
di: Abels, Axel, et al.
Pubblicazione: (2026)
di: Abels, Axel, et al.
Pubblicazione: (2026)
DarkBench: Benchmarking Dark Patterns in Large Language Models
di: Kran, Esben, et al.
Pubblicazione: (2025)
di: Kran, Esben, et al.
Pubblicazione: (2025)
Seeking Human Security Consensus: A Unified Value Scale for Generative AI Value Safety
di: He, Ying, et al.
Pubblicazione: (2026)
di: He, Ying, et al.
Pubblicazione: (2026)
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
An Evaluation of Cultural Value Alignment in LLM
di: Sukiennik, Nicholas, et al.
Pubblicazione: (2025)
di: Sukiennik, Nicholas, et al.
Pubblicazione: (2025)
Deep Value Benchmark: Measuring Whether Models Generalize Deep Values or Shallow Preferences
di: Ashkinaze, Joshua, et al.
Pubblicazione: (2025)
di: Ashkinaze, Joshua, et al.
Pubblicazione: (2025)
Revealing Fine-Grained Values and Opinions in Large Language Models
di: Wright, Dustin, et al.
Pubblicazione: (2024)
di: Wright, Dustin, et al.
Pubblicazione: (2024)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
Distributional Open-Ended Evaluation of LLM Cultural Value Alignment Based on Value Codebook
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
EigenBench: A Comparative Behavioral Measure of Value Alignment
di: Chang, Jonathn, et al.
Pubblicazione: (2025)
di: Chang, Jonathn, et al.
Pubblicazione: (2025)
When AI Speaks, Whose Values Does It Express? A Cross-Cultural Audit of Individualism-Collectivism Bias in Large Language Models
di: Venkata, Pruthvinath Jeripity
Pubblicazione: (2026)
di: Venkata, Pruthvinath Jeripity
Pubblicazione: (2026)
VideoNorms: Benchmarking Cultural Awareness of Video Language Models
di: Varimalla, Nikhil Reddy, et al.
Pubblicazione: (2025)
di: Varimalla, Nikhil Reddy, et al.
Pubblicazione: (2025)
Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing
di: Jiang, Han, et al.
Pubblicazione: (2024)
di: Jiang, Han, et al.
Pubblicazione: (2024)
LLMs Homogenize Values in Constructive Arguments on Value-Laden Topics
di: Shahid, Farhana, et al.
Pubblicazione: (2025)
di: Shahid, Farhana, et al.
Pubblicazione: (2025)
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
ACE-Align: Attribute Causal Effect Alignment for Cultural Values under Varying Persona Granularities
di: Luo, Jiatang, et al.
Pubblicazione: (2026)
di: Luo, Jiatang, et al.
Pubblicazione: (2026)
How Immersiveness Shapes the Link Between Anthropocentric Values and Resource Exploitation in Virtual Worlds
di: Vuong, Quan-Hoang, et al.
Pubblicazione: (2025)
di: Vuong, Quan-Hoang, et al.
Pubblicazione: (2025)
DeliberationBench: A Normative Benchmark for the Influence of Large Language Models on Users' Views
di: Hewitt, Luke, et al.
Pubblicazione: (2026)
di: Hewitt, Luke, et al.
Pubblicazione: (2026)
The Values of Value in AI Adoption: Rethinking Efficiency in UX Designers' Workplaces
di: Cha, Inha, et al.
Pubblicazione: (2026)
di: Cha, Inha, et al.
Pubblicazione: (2026)
Can Persona-Prompted LLMs Emulate Subgroup Values? An Empirical Analysis of Generalisability and Fairness in Cultural Alignment
di: Tan, Bryan Chen Zhengyu, et al.
Pubblicazione: (2026)
di: Tan, Bryan Chen Zhengyu, et al.
Pubblicazione: (2026)
JiraiBench: A Bilingual Benchmark for Evaluating Large Language Models' Detection of Human Self-Destructive Behavior Content in Jirai Community
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Beyond Single-Sentence Prompts: Upgrading Value Alignment Benchmarks with Dialogues and Stories
di: Zhang, Yazhou, et al.
Pubblicazione: (2025)
di: Zhang, Yazhou, et al.
Pubblicazione: (2025)
Value Lens: Using Large Language Models to Understand Human Values
di: Fernández, Eduardo de la Cruz, et al.
Pubblicazione: (2025)
di: Fernández, Eduardo de la Cruz, et al.
Pubblicazione: (2025)
TCC-Bench: Benchmarking the Traditional Chinese Culture Understanding Capabilities of MLLMs
di: Xu, Pengju, et al.
Pubblicazione: (2025)
di: Xu, Pengju, et al.
Pubblicazione: (2025)
Automating the Identification of High-Value Datasets in Open Government Data Portals
di: Quarati, Alfonso, et al.
Pubblicazione: (2024)
di: Quarati, Alfonso, et al.
Pubblicazione: (2024)
Value Drifts: Tracing Value Alignment During LLM Post-Training
di: Bhatia, Mehar, et al.
Pubblicazione: (2025)
di: Bhatia, Mehar, et al.
Pubblicazione: (2025)
From Descriptive to Prescriptive: Uncover the Social Value Alignment of LLM-based Agents
di: Qu, Jinxian, et al.
Pubblicazione: (2026)
di: Qu, Jinxian, et al.
Pubblicazione: (2026)
Investigating Cultural Alignment of Large Language Models
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
On Classification with Large Language Models in Cultural Analytics
di: Bamman, David, et al.
Pubblicazione: (2024)
di: Bamman, David, et al.
Pubblicazione: (2024)
PLawBench: A Rubric-Based Benchmark for Evaluating LLMs in Real-World Legal Practice
di: Shi, Yuzhen, et al.
Pubblicazione: (2026)
di: Shi, Yuzhen, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LocalValueBench: A Collaboratively Built and Extensible Benchmark for Evaluating Localized Value Alignment and Ethical Safety in Large Language Models
di: Meadows, Gwenyth Isobel, et al.
Pubblicazione: (2024) -
WorldView-Bench: A Benchmark for Evaluating Global Cultural Perspectives in Large Language Models
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025) -
Culturally Grounded Personas in Large Language Models: Characterization and Alignment with Socio-Psychological Value Frameworks
di: Greco, Candida M., et al.
Pubblicazione: (2026) -
Cultural Value Differences of LLMs: Prompt, Language, and Model Size
di: Zhong, Qishuai, et al.
Pubblicazione: (2024) -
Beyond Demographics: Enhancing Cultural Value Survey Simulation with Multi-Stage Personality-Driven Cognitive Reasoning
di: Liu, Haijiang, et al.
Pubblicazione: (2025)