Saved in:
| Main Authors: | Huang, Jen-tse, Zhou, Didi, Kamau, Faith, Oh, Amy, Links, Anne R., Dredze, Mark, Beach, Mary Catherine, Saha, Somnath |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2605.17228 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
On the Failure of Latent State Persistence in Large Language Models
by: Huang, Jen-tse, et al.
Published: (2025)
by: Huang, Jen-tse, et al.
Published: (2025)
Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation
by: Huang, Jen-tse, et al.
Published: (2026)
by: Huang, Jen-tse, et al.
Published: (2026)
Characterizing Stigmatizing and Biased Language in Clinical Pharmacist Documentation
by: Caitlin M. Gordon, et al.
Published: (2025)
by: Caitlin M. Gordon, et al.
Published: (2025)
Knowing But Not Doing: Convergent Morality and Divergent Action in LLMs
by: Huang, Jen-tse, et al.
Published: (2026)
by: Huang, Jen-tse, et al.
Published: (2026)
Gender Bias in Decision-Making with Large Language Models: A Study of Relationship Conflicts
by: Levy, Sharon, et al.
Published: (2024)
by: Levy, Sharon, et al.
Published: (2024)
Amuro and Char: Analyzing the Relationship between Pre-Training and Fine-Tuning of Large Language Models
by: Sun, Kaiser, et al.
Published: (2024)
by: Sun, Kaiser, et al.
Published: (2024)
RAG LLMs are Not Safer: A Safety Analysis of Retrieval-Augmented Generation for Large Language Models
by: An, Bang, et al.
Published: (2025)
by: An, Bang, et al.
Published: (2025)
Understanding Stigmatizing Language Lexicons: A Comparative Analysis in Clinical Contexts
by: Zhou, Yiliang, et al.
Published: (2025)
by: Zhou, Yiliang, et al.
Published: (2025)
Can one size fit all?: Measuring Failure in Multi-Document Summarization Domain Transfer
by: DeLucia, Alexandra, et al.
Published: (2025)
by: DeLucia, Alexandra, et al.
Published: (2025)
Are Clinical T5 Models Better for Clinical Text?
by: Li, Yahan, et al.
Published: (2024)
by: Li, Yahan, et al.
Published: (2024)
Understanding Stigmatizing Language in Clinical Documentation: A Paired Comparison of Ambient AI Drafts and Clinician Finalized Notes
by: Zhou, Yiliang, et al.
Published: (2026)
by: Zhou, Yiliang, et al.
Published: (2026)
CodeCrash: Exposing LLM Fragility to Misleading Natural Language in Code Reasoning
by: Lam, Man Ho, et al.
Published: (2025)
by: Lam, Man Ho, et al.
Published: (2025)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
by: Chen, Hanjie, et al.
Published: (2024)
by: Chen, Hanjie, et al.
Published: (2024)
Chapter 1 Stigmatization as a Tool of Cultural Violence
by: Burke, Danita Catherine
Published: (2023)
by: Burke, Danita Catherine
Published: (2023)
Transferring Fairness using Multi-Task Learning with Limited Demographic Information
by: Aguirre, Carlos, et al.
Published: (2023)
by: Aguirre, Carlos, et al.
Published: (2023)
All Languages Matter: On the Multilingual Safety of Large Language Models
by: Wang, Wenxuan, et al.
Published: (2023)
by: Wang, Wenxuan, et al.
Published: (2023)
Integrable 3-Site, Tilted, Extended Bose-Hubbard Model with Nearest-Neighbour Interactions
by: Links, Jon
Published: (2025)
by: Links, Jon
Published: (2025)
Bethe Ansatz solution for a model of global-range interacting bosons on the square lattice
by: Links, Jon
Published: (2025)
by: Links, Jon
Published: (2025)
VisBias: Measuring Explicit and Implicit Social Biases in Vision Language Models
by: Huang, Jen-tse, et al.
Published: (2025)
by: Huang, Jen-tse, et al.
Published: (2025)
How to Interpret Agent Behavior
by: Gao, Jie, et al.
Published: (2026)
by: Gao, Jie, et al.
Published: (2026)
The Chameleon's Limit: Investigating Persona Collapse and Homogenization in Large Language Models
by: Xiao, Yunze, et al.
Published: (2026)
by: Xiao, Yunze, et al.
Published: (2026)
Making FETCH! Happen: Finding Emergent Dog Whistles Through Common Habitats
by: Sasse, Kuleen, et al.
Published: (2024)
by: Sasse, Kuleen, et al.
Published: (2024)
Intolerable Risk Threshold Recommendations for Artificial Intelligence
by: Raman, Deepika, et al.
Published: (2025)
by: Raman, Deepika, et al.
Published: (2025)
What do Language Models Learn and When? The Implicit Curriculum Hypothesis
by: Liu, Emmy, et al.
Published: (2026)
by: Liu, Emmy, et al.
Published: (2026)
Revisiting the Reliability of Psychological Scales on Large Language Models
by: Huang, Jen-tse, et al.
Published: (2023)
by: Huang, Jen-tse, et al.
Published: (2023)
How Far Are We on the Decision-Making of LLMs? Evaluating LLMs' Gaming Ability in Multi-Agent Environments
by: Huang, Jen-tse, et al.
Published: (2024)
by: Huang, Jen-tse, et al.
Published: (2024)
Autonomous Artificial Intelligence Agents for Clinical Decision Making in Oncology
by: Ferber, Dyke, et al.
Published: (2024)
by: Ferber, Dyke, et al.
Published: (2024)
Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models
by: Wang, Wenxuan, et al.
Published: (2023)
by: Wang, Wenxuan, et al.
Published: (2023)
Stigmatization, discrimination and illness
by: Bohle, Leah Franziska,
Published: (2016)
by: Bohle, Leah Franziska,
Published: (2016)
Stigmatized for Seeking Help
by: David Bahry
Published: (2026)
by: David Bahry
Published: (2026)
Towards Evaluating Proactive Risk Awareness of Multimodal Language Models
by: Yuan, Youliang, et al.
Published: (2025)
by: Yuan, Youliang, et al.
Published: (2025)
Language Agents for Hypothesis-driven Clinical Decision Making with Reinforcement Learning
by: Bani-Harouni, David, et al.
Published: (2025)
by: Bani-Harouni, David, et al.
Published: (2025)
MedGUIDE: Benchmarking Clinical Decision-Making in Large Language Models
by: Li, Xiaomin, et al.
Published: (2025)
by: Li, Xiaomin, et al.
Published: (2025)
FairCoder: Evaluating Social Bias of LLMs in Code Generation
by: Du, Yongkang, et al.
Published: (2025)
by: Du, Yongkang, et al.
Published: (2025)
Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict
by: Sun, Kaiser, et al.
Published: (2025)
by: Sun, Kaiser, et al.
Published: (2025)
Can Optimization Trajectories Explain Multi-Task Transfer?
by: Mueller, David, et al.
Published: (2024)
by: Mueller, David, et al.
Published: (2024)
Evaluating the Evaluators: Are readability metrics good measures of readability?
by: Cachola, Isabel, et al.
Published: (2025)
by: Cachola, Isabel, et al.
Published: (2025)
Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles
by: Jahara, Fatima, et al.
Published: (2025)
by: Jahara, Fatima, et al.
Published: (2025)
Extending the Entropic Potential of Events for Uncertainty Quantification and Decision-Making in Artificial Intelligence
by: Zilberman, Mark
Published: (2025)
by: Zilberman, Mark
Published: (2025)
The peculiar case of the Viaggiu holographic dark energy
by: Saha, Somnath, et al.
Published: (2026)
by: Saha, Somnath, et al.
Published: (2026)
Similar Items
-
On the Failure of Latent State Persistence in Large Language Models
by: Huang, Jen-tse, et al.
Published: (2025) -
Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation
by: Huang, Jen-tse, et al.
Published: (2026) -
Characterizing Stigmatizing and Biased Language in Clinical Pharmacist Documentation
by: Caitlin M. Gordon, et al.
Published: (2025) -
Knowing But Not Doing: Convergent Morality and Divergent Action in LLMs
by: Huang, Jen-tse, et al.
Published: (2026) -
Gender Bias in Decision-Making with Large Language Models: A Study of Relationship Conflicts
by: Levy, Sharon, et al.
Published: (2024)