Cultural Compass: A Framework for Organizing Societal Norms to Detect Violations in Human-AI Conversations
Fuente:
arXiv
Salvato in:
| Autori principali: | Cheng, Myra, Prabhakaran, Vinodkumar, Oh, Alice, Stepanyan, Hayk, Verma, Aishwarya, Kalia, Charu, van Liemt, Erin MacMurray, Dev, Sunipa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Cultural Resources for Improving Generative Models
di: Stepanyan, Hayk, et al.
Pubblicazione: (2025)
di: Stepanyan, Hayk, et al.
Pubblicazione: (2025)
Cultural Authenticity: Comparing LLM Cultural Representations to Native Human Expectations
di: van Liemt, Erin MacMurray, et al.
Pubblicazione: (2026)
di: van Liemt, Erin MacMurray, et al.
Pubblicazione: (2026)
A Unified Framework to Quantify Cultural Intelligence of AI
di: Dev, Sunipa, et al.
Pubblicazione: (2026)
di: Dev, Sunipa, et al.
Pubblicazione: (2026)
SAFARI: A Community-Engaged Approach and Dataset of Stereotype Resources in the Sub-Saharan African Context
di: Verma, Aishwarya, et al.
Pubblicazione: (2026)
di: Verma, Aishwarya, et al.
Pubblicazione: (2026)
A Comprehensive Framework to Operationalize Social Stereotypes for Responsible AI Evaluations
di: Davani, Aida, et al.
Pubblicazione: (2025)
di: Davani, Aida, et al.
Pubblicazione: (2025)
SeeGULL Multilingual: a Dataset of Geo-Culturally Situated Stereotypes
di: Bhutani, Mukul, et al.
Pubblicazione: (2024)
di: Bhutani, Mukul, et al.
Pubblicazione: (2024)
GeniL: A Multilingual Dataset on Generalizing Language
di: Davani, Aida Mostafazadeh, et al.
Pubblicazione: (2024)
di: Davani, Aida Mostafazadeh, et al.
Pubblicazione: (2024)
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
di: Jin, Jiho, et al.
Pubblicazione: (2026)
di: Jin, Jiho, et al.
Pubblicazione: (2026)
Towards Geo-Culturally Grounded LLM Generations
di: Lertvittayakumjorn, Piyawat, et al.
Pubblicazione: (2025)
di: Lertvittayakumjorn, Piyawat, et al.
Pubblicazione: (2025)
ViSAGe: A Global-Scale Analysis of Visual Stereotypes in Text-to-Image Generation
di: Jha, Akshita, et al.
Pubblicazione: (2024)
di: Jha, Akshita, et al.
Pubblicazione: (2024)
Adaptive Data Collection for Latin-American Community-sourced Evaluation of Stereotypes (LACES)
di: Ivetta, Guido, et al.
Pubblicazione: (2025)
di: Ivetta, Guido, et al.
Pubblicazione: (2025)
Taxonomy of User Needs and Actions
di: Shelby, Renee, et al.
Pubblicazione: (2025)
di: Shelby, Renee, et al.
Pubblicazione: (2025)
MisgenderMender: A Community-Informed Approach to Interventions for Misgendering
di: Hossain, Tamanna, et al.
Pubblicazione: (2024)
di: Hossain, Tamanna, et al.
Pubblicazione: (2024)
Rethinking Privatization. Wholesale divestiture is not the only -- or necessarily the best -- means of transforming state enterprises in Asia / Trevor MacMurray
di: MacMurray, Trevor
Pubblicazione: (1993)
di: MacMurray, Trevor
Pubblicazione: (1993)
(Unfair) Norms in Fairness Research: A Meta-Analysis
di: Chien, Jennifer, et al.
Pubblicazione: (2024)
di: Chien, Jennifer, et al.
Pubblicazione: (2024)
MiTTenS: A Dataset for Evaluating Gender Mistranslation
di: Robinson, Kevin, et al.
Pubblicazione: (2024)
di: Robinson, Kevin, et al.
Pubblicazione: (2024)
D3CODE: Disentangling Disagreements in Data across Cultures on Offensiveness Detection and Evaluation
di: Davani, Aida Mostafazadeh, et al.
Pubblicazione: (2024)
di: Davani, Aida Mostafazadeh, et al.
Pubblicazione: (2024)
Risks of Cultural Erasure in Large Language Models
di: Qadri, Rida, et al.
Pubblicazione: (2025)
di: Qadri, Rida, et al.
Pubblicazione: (2025)
RENOVI: A Benchmark Towards Remediating Norm Violations in Socio-Cultural Conversations
di: Zhan, Haolan, et al.
Pubblicazione: (2024)
di: Zhan, Haolan, et al.
Pubblicazione: (2024)
Ontology of Belief Diversity: A Community-Based Epistemological Approach
di: Fischella, Tyler, et al.
Pubblicazione: (2024)
di: Fischella, Tyler, et al.
Pubblicazione: (2024)
A Systematic Study of Biomedical Retrieval Pipeline Trade-offs in Performance and Efficiency
di: Stepanyan, Hayk, et al.
Pubblicazione: (2026)
di: Stepanyan, Hayk, et al.
Pubblicazione: (2026)
QueerGen: How LLMs Reflect Societal Norms on Gender and Sexuality in Sentence Completion Tasks
di: Sosto, Mae, et al.
Pubblicazione: (2026)
di: Sosto, Mae, et al.
Pubblicazione: (2026)
NormGenesis: Multicultural Dialogue Generation via Exemplar-Guided Social Norm Modeling and Violation Recovery
di: Hong, Minki, et al.
Pubblicazione: (2025)
di: Hong, Minki, et al.
Pubblicazione: (2025)
SADAS: A Dialogue Assistant System Towards Remediating Norm Violations in Bilingual Socio-Cultural Conversations
di: Hua, Yuncheng, et al.
Pubblicazione: (2024)
di: Hua, Yuncheng, et al.
Pubblicazione: (2024)
Modeling Prejudice and Its Effect on Societal Prosperity
di: Mohan, Deep Inder, et al.
Pubblicazione: (2021)
di: Mohan, Deep Inder, et al.
Pubblicazione: (2021)
Amplify Initiative: Building A Localized Data Platform for Globalized AI
di: Rashid, Qazi Mamunur, et al.
Pubblicazione: (2025)
di: Rashid, Qazi Mamunur, et al.
Pubblicazione: (2025)
Going PLACES: Participatory Localized Red Teaming for Text-to-Image Safety in the Global South
di: Rastogi, Charvi, et al.
Pubblicazione: (2026)
di: Rastogi, Charvi, et al.
Pubblicazione: (2026)
Is Conversational XAI All You Need? Human-AI Decision Making With a Conversational XAI Assistant
di: He, Gaole, et al.
Pubblicazione: (2025)
di: He, Gaole, et al.
Pubblicazione: (2025)
When Does Removing LayerNorm Help? Activation Bounding as a Regime-Dependent Implicit Regularizer
di: Verma, Lucky
Pubblicazione: (2026)
di: Verma, Lucky
Pubblicazione: (2026)
Beyond Aesthetics: Cultural Competence in Text-to-Image Models
di: Kannen, Nithish, et al.
Pubblicazione: (2024)
di: Kannen, Nithish, et al.
Pubblicazione: (2024)
CoBia: Constructed Conversations Can Trigger Otherwise Concealed Societal Biases in LLMs
di: Nikeghbal, Nafiseh, et al.
Pubblicazione: (2025)
di: Nikeghbal, Nafiseh, et al.
Pubblicazione: (2025)
NormSAGE: Multi-Lingual Multi-Cultural Norm Discovery from Conversations On-the-Fly
di: Fung, Yi R., et al.
Pubblicazione: (2022)
di: Fung, Yi R., et al.
Pubblicazione: (2022)
How the Stroop Effect Arises from Optimal Response Times in Laterally Connected Self-Organizing Maps
di: Prabhakaran, Divya, et al.
Pubblicazione: (2025)
di: Prabhakaran, Divya, et al.
Pubblicazione: (2025)
Managing Organizational and Societal Challenges of AI
di: Klonowska, Iwona, et al.
Pubblicazione: (2026)
di: Klonowska, Iwona, et al.
Pubblicazione: (2026)
GeoNorm: Unify Pre-Norm and Post-Norm with Geodesic Optimization
di: Zheng, Chuanyang, et al.
Pubblicazione: (2026)
di: Zheng, Chuanyang, et al.
Pubblicazione: (2026)
Societal Adaptation to Advanced AI
di: Bernardi, Jamie, et al.
Pubblicazione: (2024)
di: Bernardi, Jamie, et al.
Pubblicazione: (2024)
Deplatforming Norm-Violating Influencers on Social Media Reduces Overall Online Attention Toward Them
di: Ribeiro, Manoel Horta, et al.
Pubblicazione: (2024)
di: Ribeiro, Manoel Horta, et al.
Pubblicazione: (2024)
Flex-TravelPlanner: A Benchmark for Flexible Planning with Language Agents
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
di: Oh, Juhyun, et al.
Pubblicazione: (2025)
On The Conceptualization and Societal Impact of Cross-Cultural Bias
di: Bhandari, Vitthal
Pubblicazione: (2025)
di: Bhandari, Vitthal
Pubblicazione: (2025)
GRASP: A Disagreement Analysis Framework to Assess Group Associations in Perspectives
di: Prabhakaran, Vinodkumar, et al.
Pubblicazione: (2023)
di: Prabhakaran, Vinodkumar, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Scaling Cultural Resources for Improving Generative Models
di: Stepanyan, Hayk, et al.
Pubblicazione: (2025) -
Cultural Authenticity: Comparing LLM Cultural Representations to Native Human Expectations
di: van Liemt, Erin MacMurray, et al.
Pubblicazione: (2026) -
A Unified Framework to Quantify Cultural Intelligence of AI
di: Dev, Sunipa, et al.
Pubblicazione: (2026) -
SAFARI: A Community-Engaged Approach and Dataset of Stereotype Resources in the Sub-Saharan African Context
di: Verma, Aishwarya, et al.
Pubblicazione: (2026) -
A Comprehensive Framework to Operationalize Social Stereotypes for Responsible AI Evaluations
di: Davani, Aida, et al.
Pubblicazione: (2025)