CULTURE-GEN: Revealing Global Cultural Perception in Language Models through Natural Language Prompting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Huihan, Jiang, Liwei, Hwang, Jena D., Kim, Hyunwoo, Santy, Sebastin, Sorensen, Taylor, Lin, Bill Yuchen, Dziri, Nouha, Ren, Xiang, Choi, Yejin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semantic and Expressive Variation in Image Captions Across Languages
par: Ye, Andre, et autres
Publié: (2023)
par: Ye, Andre, et autres
Publié: (2023)
WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs
par: Han, Seungju, et autres
Publié: (2024)
par: Han, Seungju, et autres
Publié: (2024)
Can Language Models Reason about Individualistic Human Values and Preferences?
par: Jiang, Liwei, et autres
Publié: (2024)
par: Jiang, Liwei, et autres
Publié: (2024)
Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties
par: Sorensen, Taylor, et autres
Publié: (2023)
par: Sorensen, Taylor, et autres
Publié: (2023)
Rel-A.I.: An Interaction-Centered Approach To Measuring Human-LM Reliance
par: Zhou, Kaitlyn, et autres
Publié: (2024)
par: Zhou, Kaitlyn, et autres
Publié: (2024)
Artificial Hivemind: The Open-Ended Homogeneity of Language Models (and Beyond)
par: Jiang, Liwei, et autres
Publié: (2025)
par: Jiang, Liwei, et autres
Publié: (2025)
Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement
par: Qiu, Linlu, et autres
Publié: (2023)
par: Qiu, Linlu, et autres
Publié: (2023)
What Makes it Ok to Set a Fire? Iterative Self-distillation of Contexts and Rationales for Disambiguating Defeasible Social and Moral Situations
par: Rao, Kavel, et autres
Publié: (2023)
par: Rao, Kavel, et autres
Publié: (2023)
RewardBench: Evaluating Reward Models for Language Modeling
par: Lambert, Nathan, et autres
Publié: (2024)
par: Lambert, Nathan, et autres
Publié: (2024)
BLIP: Facilitating the Exploration of Undesirable Consequences of Digital Technologies
par: Pang, Rock Yuren, et autres
Publié: (2024)
par: Pang, Rock Yuren, et autres
Publié: (2024)
WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models
par: Jiang, Liwei, et autres
Publié: (2024)
par: Jiang, Liwei, et autres
Publié: (2024)
Opt-ICL at LeWiDi-2025: Maximizing In-Context Signal from Rater Examples via Meta-Learning
par: Sorensen, Taylor, et autres
Publié: (2025)
par: Sorensen, Taylor, et autres
Publié: (2025)
WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild
par: Lin, Bill Yuchen, et autres
Publié: (2024)
par: Lin, Bill Yuchen, et autres
Publié: (2024)
AI as Humanity's Salieri: Quantifying Linguistic Creativity of Language Models via Systematic Attribution of Machine Text against Web Text
par: Lu, Ximing, et autres
Publié: (2024)
par: Lu, Ximing, et autres
Publié: (2024)
A Roadmap to Pluralistic Alignment
par: Sorensen, Taylor, et autres
Publié: (2024)
par: Sorensen, Taylor, et autres
Publié: (2024)
Multi-Attribute Constraint Satisfaction via Language Model Rewriting
par: Baheti, Ashutosh, et autres
Publié: (2024)
par: Baheti, Ashutosh, et autres
Publié: (2024)
When Incentives Backfire, Data Stops Being Human
par: Santy, Sebastin, et autres
Publié: (2025)
par: Santy, Sebastin, et autres
Publié: (2025)
TurnWise: The Gap between Single- and Multi-turn Language Model Capabilities
par: Graf, Victoria, et autres
Publié: (2026)
par: Graf, Victoria, et autres
Publié: (2026)
Multilingual Diversity Improves Vision-Language Representations
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
DailyDilemmas: Revealing Value Preferences of LLMs with Quandaries of Daily Life
par: Chiu, Yu Ying, et autres
Publié: (2024)
par: Chiu, Yu Ying, et autres
Publié: (2024)
Surfacing Semantic Orthogonality Across Model Safety Benchmarks: A Multi-Dimensional Analysis
par: Bennion, Jonathan, et autres
Publié: (2025)
par: Bennion, Jonathan, et autres
Publié: (2025)
Perceptions to Beliefs: Exploring Precursory Inferences for Theory of Mind in Large Language Models
par: Jung, Chani, et autres
Publié: (2024)
par: Jung, Chani, et autres
Publié: (2024)
Information-Guided Identification of Training Data Imprint in (Proprietary) Large Language Models
par: Ravichander, Abhilasha, et autres
Publié: (2025)
par: Ravichander, Abhilasha, et autres
Publié: (2025)
HALoGEN: Fantastic LLM Hallucinations and Where to Find Them
par: Ravichander, Abhilasha, et autres
Publié: (2025)
par: Ravichander, Abhilasha, et autres
Publié: (2025)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
par: Lu, Yujie, et autres
Publié: (2024)
par: Lu, Yujie, et autres
Publié: (2024)
Attributing Culture-Conditioned Generations to Pretraining Corpora
par: Li, Huihan, et autres
Publié: (2024)
par: Li, Huihan, et autres
Publié: (2024)
The Art of Saying No: Contextual Noncompliance in Language Models
par: Brahman, Faeze, et autres
Publié: (2024)
par: Brahman, Faeze, et autres
Publié: (2024)
SafetyAnalyst: Interpretable, Transparent, and Steerable Safety Moderation for AI Behavior
par: Li, Jing-Jing, et autres
Publié: (2024)
par: Li, Jing-Jing, et autres
Publié: (2024)
CulturalBench: A Robust, Diverse, and Challenging Cultural Benchmark by Human-AI CulturalTeaming
par: Chiu, Yu Ying, et autres
Publié: (2024)
par: Chiu, Yu Ying, et autres
Publié: (2024)
Interpretaciones no intencionadas e intencionadas y usos de los resultados de PISA: Una perspectiva de validez consecuencial
par: Santy Taut
Publié: (2016)
par: Santy Taut
Publié: (2016)
Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing
par: Xu, Zhangchen, et autres
Publié: (2024)
par: Xu, Zhangchen, et autres
Publié: (2024)
Agent Lumos: Unified and Modular Training for Open-Source Language Agents
par: Yin, Da, et autres
Publié: (2023)
par: Yin, Da, et autres
Publié: (2023)
Selective "Selective Prediction": Reducing Unnecessary Abstention in Vision-Language Reasoning
par: Srinivasan, Tejas, et autres
Publié: (2024)
par: Srinivasan, Tejas, et autres
Publié: (2024)
Natural Language Declarative Prompting (NLD-P): A Modular Governance Method for Prompt Design Under Model Drift
par: Kim, Hyunwoo, et autres
Publié: (2026)
par: Kim, Hyunwoo, et autres
Publié: (2026)
Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing
par: Jung, Jaehun, et autres
Publié: (2023)
par: Jung, Jaehun, et autres
Publié: (2023)
Spectrum Tuning: Post-Training for Distributional Coverage and In-Context Steerability
par: Sorensen, Taylor, et autres
Publié: (2025)
par: Sorensen, Taylor, et autres
Publié: (2025)
Relying on the Unreliable: The Impact of Language Models' Reluctance to Express Uncertainty
par: Zhou, Kaitlyn, et autres
Publié: (2024)
par: Zhou, Kaitlyn, et autres
Publié: (2024)
JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models
par: Fisher, Jillian, et autres
Publié: (2024)
par: Fisher, Jillian, et autres
Publié: (2024)
Symbolic Working Memory Enhances Language Models for Complex Rule Application
par: Wang, Siyuan, et autres
Publié: (2024)
par: Wang, Siyuan, et autres
Publié: (2024)
PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning
par: Brahman, Faeze, et autres
Publié: (2023)
par: Brahman, Faeze, et autres
Publié: (2023)
Documents similaires
-
Semantic and Expressive Variation in Image Captions Across Languages
par: Ye, Andre, et autres
Publié: (2023) -
WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs
par: Han, Seungju, et autres
Publié: (2024) -
Can Language Models Reason about Individualistic Human Values and Preferences?
par: Jiang, Liwei, et autres
Publié: (2024) -
Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties
par: Sorensen, Taylor, et autres
Publié: (2023) -
Rel-A.I.: An Interaction-Centered Approach To Measuring Human-LM Reliance
par: Zhou, Kaitlyn, et autres
Publié: (2024)