Can I introduce my boyfriend to my grandmother? Evaluating Large Language Models Capabilities on Iranian Social Norm Classification
Fuente:
arXiv
Guardado en:
| Autores principales: | Saffari, Hamidreza, Shafiei, Mohammadamin, Rooein, Donya, Pierri, Francesco, Nozza, Debora |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Not All Jokes Land: Evaluating Large Language Models Understanding of Workplace Humor
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
por: Rooein, Donya, et al.
Publicado: (2025)
por: Rooein, Donya, et al.
Publicado: (2025)
MultiHoax: A Dataset of Multi-hop False-Premise Questions
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
Exploring Subjective Tasks in Farsi: A Survey Analysis and Evaluation of Language Models
por: Rooein, Donya, et al.
Publicado: (2025)
por: Rooein, Donya, et al.
Publicado: (2025)
Beyond Hate Speech: NLP's Challenges and Opportunities in Uncovering Dehumanizing Language
por: Saffari, Hamidreza, et al.
Publicado: (2024)
por: Saffari, Hamidreza, et al.
Publicado: (2024)
PATS: Personality-Aware Teaching Strategies with Large Language Model Tutors
por: Rooein, Donya, et al.
Publicado: (2026)
por: Rooein, Donya, et al.
Publicado: (2026)
Conversations as a Source for Teaching Scientific Concepts at Different Education Levels
por: Rooein, Donya, et al.
Publicado: (2024)
por: Rooein, Donya, et al.
Publicado: (2024)
How segmented is my network?
por: Dube, Rohit
Publicado: (2026)
por: Dube, Rohit
Publicado: (2026)
Beyond Flesch-Kincaid: Prompt-based Metrics Improve Difficulty Classification of Educational Texts
por: Rooein, Donya, et al.
Publicado: (2024)
por: Rooein, Donya, et al.
Publicado: (2024)
Simulating Online Social Media Conversations on Controversial Topics Using AI Agents Calibrated on Real-World Data
por: Composta, Elisa, et al.
Publicado: (2025)
por: Composta, Elisa, et al.
Publicado: (2025)
"Can you be my mum?": Manipulating Social Robots in the Large Language Models Era
por: Abbo, Giulio Antonio, et al.
Publicado: (2025)
por: Abbo, Giulio Antonio, et al.
Publicado: (2025)
Evaluating AI capabilities in detecting conspiracy theories on YouTube
por: La Rocca, Leonardo, et al.
Publicado: (2025)
por: La Rocca, Leonardo, et al.
Publicado: (2025)
Are my Children Old Enough to Read these Books? Age Suitability Analysis
por: Franz Wanner
Publicado: (2011)
por: Franz Wanner
Publicado: (2011)
Static and Dynamic Strategies for Influencing Opinions in Social Networks
por: Tarantino, Paolo, et al.
Publicado: (2026)
por: Tarantino, Paolo, et al.
Publicado: (2026)
Multilingual Performance Biases of Large Language Models in Education
por: Gupta, Vansh, et al.
Publicado: (2025)
por: Gupta, Vansh, et al.
Publicado: (2025)
A Longitudinal Study of Italian and French Reddit Conversations Around the Russian Invasion of Ukraine
por: Corso, Francesco, et al.
Publicado: (2024)
por: Corso, Francesco, et al.
Publicado: (2024)
Among Us: Language of Conspiracy Theorists on Mainstream Reddit
por: Corso, Francesco, et al.
Publicado: (2025)
por: Corso, Francesco, et al.
Publicado: (2025)
myAURA: Personalized health library for epilepsy management via knowledge graph sparsification and visualization
por: Correia, Rion Brattig, et al.
Publicado: (2024)
por: Correia, Rion Brattig, et al.
Publicado: (2024)
"What's my model inside of?": Exploring the role of environments for grounded natural language understanding
por: Tamari, Ronen
Publicado: (2024)
por: Tamari, Ronen
Publicado: (2024)
Can Invisible Psychological Traits Organize Visible Network Structure? A Complex Network Analysis of Myers-Briggs Type Indicator-Based Interaction Patterns in Anonymous Social Networks
por: Ayyoubzadeh, Seyed Moein, et al.
Publicado: (2025)
por: Ayyoubzadeh, Seyed Moein, et al.
Publicado: (2025)
Evaluating Reliability Asymmetries in Chinese Factual Search and AI Answers
por: Liu, Geng, et al.
Publicado: (2025)
por: Liu, Geng, et al.
Publicado: (2025)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
por: Ni, Jingwei, et al.
Publicado: (2025)
por: Ni, Jingwei, et al.
Publicado: (2025)
Conspiracy theories and where to find them on TikTok
por: Corso, Francesco, et al.
Publicado: (2024)
por: Corso, Francesco, et al.
Publicado: (2024)
What we can learn from TikTok through its Research API
por: Corso, Francesco, et al.
Publicado: (2024)
por: Corso, Francesco, et al.
Publicado: (2024)
my-cv
por: Yao, Yuan
Publicado: (2025)
por: Yao, Yuan
Publicado: (2025)
myTodo
por: Qu, Edison
Publicado: (2026)
por: Qu, Edison
Publicado: (2026)
Self-moderation in the decentralized era: decoding blocking behavior on Bluesky
por: Bono, Carlo, et al.
Publicado: (2025)
por: Bono, Carlo, et al.
Publicado: (2025)
Discovering my teaching features and their relation with my students ́ learning: An autoethnography
por: Andrea André Arenas
Publicado: (2015)
por: Andrea André Arenas
Publicado: (2015)
At my limit" - I climbed Everest alone
Publicado: (1981)
Publicado: (1981)
Can LLMs Model Incorrect Student Reasoning? A Case Study on Distractor Generation
por: Zengaffinen, Yanick, et al.
Publicado: (2026)
por: Zengaffinen, Yanick, et al.
Publicado: (2026)
AI Ethics and Social Norms: Exploring ChatGPT's Capabilities From What to How
por: Veisi, Omid, et al.
Publicado: (2025)
por: Veisi, Omid, et al.
Publicado: (2025)
Can Large Language Models Detect Rumors on Social Media?
por: Liu, Qiang, et al.
Publicado: (2024)
por: Liu, Qiang, et al.
Publicado: (2024)
aiondra my love
por: Dennis, Ceccaroli
Publicado: (2025)
por: Dennis, Ceccaroli
Publicado: (2025)
Comments on my papers
por: Lusztig, G.
Publicado: (2017)
por: Lusztig, G.
Publicado: (2017)
Take my pixel
Publicado: (2005)
Publicado: (2005)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
por: Russo, Giuseppe, et al.
Publicado: (2025)
por: Russo, Giuseppe, et al.
Publicado: (2025)
Are my wife's recovery activities related to my subsequent recovery activities at work?
por: Mansik Yun, et al.
Publicado: (2024)
por: Mansik Yun, et al.
Publicado: (2024)
Mixed practice was my plan…then cattle health specialisation caught my attention
por: Nicola Gladden
Publicado: (2024)
por: Nicola Gladden
Publicado: (2024)
Supervising surgeries on my volunteer experience helped improve my own skills
por: Alice Watson
Publicado: (2025)
por: Alice Watson
Publicado: (2025)
Ejemplares similares
-
Not All Jokes Land: Evaluating Large Language Models Understanding of Workplace Humor
por: Shafiei, Mohammadamin, et al.
Publicado: (2025) -
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
por: Rooein, Donya, et al.
Publicado: (2025) -
MultiHoax: A Dataset of Multi-hop False-Premise Questions
por: Shafiei, Mohammadamin, et al.
Publicado: (2025) -
More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning
por: Shafiei, Mohammadamin, et al.
Publicado: (2025) -
Exploring Subjective Tasks in Farsi: A Survey Analysis and Evaluation of Language Models
por: Rooein, Donya, et al.
Publicado: (2025)