Multilingual large language models leak human stereotypes across language boundaries
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Yang Trista, Sotnikova, Anna, Zhao, Jieyu, Zou, Linda X., Rudinger, Rachel, Daume III, Hal |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Natural Language Inference Improves Compositionality in Vision-Language Models
por: Cascante-Bonilla, Paola, et al.
Publicado: (2024)
por: Cascante-Bonilla, Paola, et al.
Publicado: (2024)
Language Models Predict Empathy Gaps Between Social In-groups and Out-groups
por: Hou, Yu, et al.
Publicado: (2025)
por: Hou, Yu, et al.
Publicado: (2025)
"You Gotta be a Doctor, Lin": An Investigation of Name-Based Bias of Large Language Models in Employment Recommendations
por: Nghiem, Huy, et al.
Publicado: (2024)
por: Nghiem, Huy, et al.
Publicado: (2024)
Reheat Nachos for Dinner? Evaluating AI Support for Cross-Cultural Communication of Neologisms
por: Ki, Dayeon, et al.
Publicado: (2026)
por: Ki, Dayeon, et al.
Publicado: (2026)
A Necessary Step toward Faithfulness: Measuring and Improving Consistency in Free-Text Explanations
por: Zhao, Lingjun, et al.
Publicado: (2025)
por: Zhao, Lingjun, et al.
Publicado: (2025)
'Rich Dad, Poor Lad': How do Large Language Models Contextualize Socioeconomic Factors in College Admission ?
por: Nghiem, Huy, et al.
Publicado: (2025)
por: Nghiem, Huy, et al.
Publicado: (2025)
When Stereotypes GTG: The Impact of Predictive Text Suggestions on Gender Bias in Human-AI Co-Writing
por: Baumler, Connor, et al.
Publicado: (2024)
por: Baumler, Connor, et al.
Publicado: (2024)
Steering Safely or Off a Cliff? Rethinking Specificity and Robustness in Inference-Time Interventions
por: Goyal, Navita, et al.
Publicado: (2026)
por: Goyal, Navita, et al.
Publicado: (2026)
HateCOT: An Explanation-Enhanced Dataset for Generalizable Offensive Speech Detection via Large Language Models
por: Nghiem, Huy, et al.
Publicado: (2024)
por: Nghiem, Huy, et al.
Publicado: (2024)
Toxicity Detection is NOT all you Need: Measuring the Gaps to Supporting Volunteer Content Moderators
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
Successfully Guiding Humans with Imperfect Instructions by Highlighting Potential Errors and Suggesting Corrections
por: Zhao, Lingjun, et al.
Publicado: (2024)
por: Zhao, Lingjun, et al.
Publicado: (2024)
How often are errors in natural language reasoning due to paraphrastic variability?
por: Srikanth, Neha, et al.
Publicado: (2024)
por: Srikanth, Neha, et al.
Publicado: (2024)
SMARTER: A Data-efficient Framework to Improve Toxicity Detection with Explanation via Self-augmenting Large Language Models
por: Nghiem, Huy, et al.
Publicado: (2025)
por: Nghiem, Huy, et al.
Publicado: (2025)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Pragmatics Meets Culture: Culturally-adapted Artwork Description Generation and Evaluation
por: Zhao, Lingjun, et al.
Publicado: (2026)
por: Zhao, Lingjun, et al.
Publicado: (2026)
EuroGEST: Investigating gender stereotypes in multilingual language models
por: Rowe, Jacqueline, et al.
Publicado: (2025)
por: Rowe, Jacqueline, et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
Say It My Way: Exploring Control in Conversational Visual Question Answering with Blind Users
por: Zeraati, Farnaz Zamiri, et al.
Publicado: (2026)
por: Zeraati, Farnaz Zamiri, et al.
Publicado: (2026)
Causal Effect of Group Diversity on Redundancy and Coverage in Peer-Reviewing
por: Goyal, Navita, et al.
Publicado: (2024)
por: Goyal, Navita, et al.
Publicado: (2024)
Uncovering inequalities in new knowledge learning by large language models across different languages
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Are they human? Detecting large language models by probing human memory constraints
por: Schug, Simon, et al.
Publicado: (2026)
por: Schug, Simon, et al.
Publicado: (2026)
Do great minds think alike? Investigating Human-AI Complementarity in Question Answering with CAIMIRA
por: Gor, Maharshi, et al.
Publicado: (2024)
por: Gor, Maharshi, et al.
Publicado: (2024)
Comparing large language models and human programmers for generating programming code
por: Hou, Wenpin, et al.
Publicado: (2024)
por: Hou, Wenpin, et al.
Publicado: (2024)
Strong and weak alignment of large language models with human values
por: Khamassi, Mehdi, et al.
Publicado: (2024)
por: Khamassi, Mehdi, et al.
Publicado: (2024)
Can You Make It Sound Like You? Post-Editing LLM-Generated Text for Personal Style
por: Baumler, Connor, et al.
Publicado: (2026)
por: Baumler, Connor, et al.
Publicado: (2026)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
Studies with impossible languages falsify LMs as models of human language
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
AI shares emotion with humans across languages and cultures
por: Wu, Xiuwen, et al.
Publicado: (2025)
por: Wu, Xiuwen, et al.
Publicado: (2025)
Can Hallucination Correction Improve Video-Language Alignment?
por: Zhao, Lingjun, et al.
Publicado: (2025)
por: Zhao, Lingjun, et al.
Publicado: (2025)
Owls are wise and foxes are unfaithful: Uncovering animal stereotypes in vision-language models
por: Aman, Tabinda, et al.
Publicado: (2025)
por: Aman, Tabinda, et al.
Publicado: (2025)
Correcting misinformation on social media with a large language model
por: Zhou, Xinyi, et al.
Publicado: (2024)
por: Zhou, Xinyi, et al.
Publicado: (2024)
My LLM might Mimic AAE -- But When Should it?
por: Sandoval, Sandra C., et al.
Publicado: (2025)
por: Sandoval, Sandra C., et al.
Publicado: (2025)
Post-training makes large language models less human-like
por: Binz, Marcel, et al.
Publicado: (2026)
por: Binz, Marcel, et al.
Publicado: (2026)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
Alignment faking in large language models
por: Greenblatt, Ryan, et al.
Publicado: (2024)
por: Greenblatt, Ryan, et al.
Publicado: (2024)
Humans overrely on overconfident language models, across languages
por: Rathi, Neil, et al.
Publicado: (2025)
por: Rathi, Neil, et al.
Publicado: (2025)
Bias in the Tails: How Name-conditioned Evaluative Framing in Resume Summaries Destabilizes LLM-based Hiring
por: Nghiem, Huy, et al.
Publicado: (2026)
por: Nghiem, Huy, et al.
Publicado: (2026)
Representation in large language models
por: Yetman, Cameron
Publicado: (2025)
por: Yetman, Cameron
Publicado: (2025)
Aligning language models with human preferences
por: Korbak, Tomasz
Publicado: (2024)
por: Korbak, Tomasz
Publicado: (2024)
Ejemplares similares
-
Natural Language Inference Improves Compositionality in Vision-Language Models
por: Cascante-Bonilla, Paola, et al.
Publicado: (2024) -
Language Models Predict Empathy Gaps Between Social In-groups and Out-groups
por: Hou, Yu, et al.
Publicado: (2025) -
"You Gotta be a Doctor, Lin": An Investigation of Name-Based Bias of Large Language Models in Employment Recommendations
por: Nghiem, Huy, et al.
Publicado: (2024) -
Reheat Nachos for Dinner? Evaluating AI Support for Cross-Cultural Communication of Neologisms
por: Ki, Dayeon, et al.
Publicado: (2026) -
A Necessary Step toward Faithfulness: Measuring and Improving Consistency in Free-Text Explanations
por: Zhao, Lingjun, et al.
Publicado: (2025)