The Chameleon's Limit: Investigating Persona Collapse and Homogenization in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiao, Yunze, Zhang, Vivienne J., Yang, Chenghao, Ma, Ningshan, Xuan, Weihao, Huang, Jen-tse |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Say Something Else: Rethinking Contextual Privacy as Information Sufficiency
par: Xiao, Yunze, et autres
Publié: (2026)
par: Xiao, Yunze, et autres
Publié: (2026)
On the Failure of Latent State Persistence in Large Language Models
par: Huang, Jen-tse, et autres
Publié: (2025)
par: Huang, Jen-tse, et autres
Publié: (2025)
Towards Valid Student Simulation with Large Language Models
par: Yuan, Zhihao, et autres
Publié: (2026)
par: Yuan, Zhihao, et autres
Publié: (2026)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024)
par: Lv, Huijie, et autres
Publié: (2024)
Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation
par: Huang, Jen-tse, et autres
Publié: (2026)
par: Huang, Jen-tse, et autres
Publié: (2026)
Revisiting the Reliability of Psychological Scales on Large Language Models
par: Huang, Jen-tse, et autres
Publié: (2023)
par: Huang, Jen-tse, et autres
Publié: (2023)
When Hindsight is Not 20/20: Testing Limits on Reflective Thinking in Large Language Models
par: Li, Yanhong, et autres
Publié: (2024)
par: Li, Yanhong, et autres
Publié: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
VisBias: Measuring Explicit and Implicit Social Biases in Vision Language Models
par: Huang, Jen-tse, et autres
Publié: (2025)
par: Huang, Jen-tse, et autres
Publié: (2025)
Artificial Intolerance: Stigmatizing Language in Clinical Documentation Skews Large Language Model Decision-Making
par: Huang, Jen-tse, et autres
Publié: (2026)
par: Huang, Jen-tse, et autres
Publié: (2026)
The Confidence Dichotomy: Analyzing and Mitigating Miscalibration in Tool-Use Agents
par: Xuan, Weihao, et autres
Publié: (2026)
par: Xuan, Weihao, et autres
Publié: (2026)
What do Language Models Learn and When? The Implicit Curriculum Hypothesis
par: Liu, Emmy, et autres
Publié: (2026)
par: Liu, Emmy, et autres
Publié: (2026)
Recognizing Limits: Investigating Infeasibility in Large Language Models
par: Zhang, Wenbo, et autres
Publié: (2024)
par: Zhang, Wenbo, et autres
Publié: (2024)
LogicAsker: Evaluating and Improving the Logical Reasoning Ability of Large Language Models
par: Wan, Yuxuan, et autres
Publié: (2024)
par: Wan, Yuxuan, et autres
Publié: (2024)
Saving the legacy of Hero Ibash: Evaluating Four Language Models for Aminoacian
par: Xiao, Yunze, et autres
Publié: (2024)
par: Xiao, Yunze, et autres
Publié: (2024)
Sentipolis: Emotion-Aware Agents for Social Simulations
par: Fu, Chiyuan, et autres
Publié: (2026)
par: Fu, Chiyuan, et autres
Publié: (2026)
Are Large Language Models Chameleons? An Attempt to Simulate Social Surveys
par: Geng, Mingmeng, et autres
Publié: (2024)
par: Geng, Mingmeng, et autres
Publié: (2024)
FairCoder: Evaluating Social Bias of LLMs in Code Generation
par: Du, Yongkang, et autres
Publié: (2025)
par: Du, Yongkang, et autres
Publié: (2025)
PersonaLLM: Investigating the Ability of Large Language Models to Express Personality Traits
par: Jiang, Hang, et autres
Publié: (2023)
par: Jiang, Hang, et autres
Publié: (2023)
Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
par: Xie, Jian, et autres
Publié: (2023)
par: Xie, Jian, et autres
Publié: (2023)
CoSER: A Comprehensive Literary Dataset and Framework for Training and Evaluating LLM Role-Playing and Persona Simulation
par: Wang, Xintao, et autres
Publié: (2025)
par: Wang, Xintao, et autres
Publié: (2025)
Persona Jailbreaking in Large Language Models
par: Sandhan, Jivnesh, et autres
Publié: (2026)
par: Sandhan, Jivnesh, et autres
Publié: (2026)
Catching Chameleons: Detecting Evolving Disinformation Generated using Large Language Models
par: Jiang, Bohan, et autres
Publié: (2024)
par: Jiang, Bohan, et autres
Publié: (2024)
Internal Safety Collapse in Frontier Large Language Models
par: Wu, Yutao, et autres
Publié: (2026)
par: Wu, Yutao, et autres
Publié: (2026)
Hateful Person or Hateful Model? Investigating the Role of Personas in Hate Speech Detection by Large Language Models
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
Towards Evaluating Proactive Risk Awareness of Multimodal Language Models
par: Yuan, Youliang, et autres
Publié: (2025)
par: Yuan, Youliang, et autres
Publié: (2025)
InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews
par: Wang, Xintao, et autres
Publié: (2023)
par: Wang, Xintao, et autres
Publié: (2023)
Diversity-Enhanced Reasoning for Subjective Questions
par: Wang, Yumeng, et autres
Publié: (2025)
par: Wang, Yumeng, et autres
Publié: (2025)
PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization
par: Tao, Meiling, et autres
Publié: (2025)
par: Tao, Meiling, et autres
Publié: (2025)
The Pragmatic Mind of Machines: Tracing the Emergence of Pragmatic Competence in Large Language Models
par: Yu, Kefan, et autres
Publié: (2025)
par: Yu, Kefan, et autres
Publié: (2025)
Aligning Large Language Models with Human Opinions through Persona Selection and Value--Belief--Norm Reasoning
par: Long, Do Xuan, et autres
Publié: (2023)
par: Long, Do Xuan, et autres
Publié: (2023)
Exploring the Limits of Pruning: Task-Specific Neurons, Model Collapse, and Recovery in Task-Specific Large Language Models
par: Siam, M. K. Khalidi, et autres
Publié: (2026)
par: Siam, M. K. Khalidi, et autres
Publié: (2026)
Beyond Static Personas: Situational Personality Steering for Large Language Models
par: Wei, Zesheng, et autres
Publié: (2026)
par: Wei, Zesheng, et autres
Publié: (2026)
Persona-Model Collapse in Emergent Misalignment
par: Costa, Davi Bastos, et autres
Publié: (2026)
par: Costa, Davi Bastos, et autres
Publié: (2026)
Identifying the Achilles' Heel: An Iterative Method for Dynamically Uncovering Factual Errors in Large Language Models
par: Wang, Wenxuan, et autres
Publié: (2024)
par: Wang, Wenxuan, et autres
Publié: (2024)
Invisible Influences: Investigating Implicit Intersectional Biases through Persona Engineering in Large Language Models
par: Arimanda, Nandini, et autres
Publié: (2026)
par: Arimanda, Nandini, et autres
Publié: (2026)
Dialogue Language Model with Large-Scale Persona Data Engineering
par: Hong, Mengze, et autres
Publié: (2024)
par: Hong, Mengze, et autres
Publié: (2024)
AI Sees Your Location, But With A Bias Toward The Wealthy World
par: Huang, Jingyuan, et autres
Publié: (2025)
par: Huang, Jingyuan, et autres
Publié: (2025)
Confidence in Large Language Model Evaluation: A Bayesian Approach to Limited-Sample Challenges
par: Xiao, Xiao, et autres
Publié: (2025)
par: Xiao, Xiao, et autres
Publié: (2025)
Documents similaires
-
Say Something Else: Rethinking Contextual Privacy as Information Sufficiency
par: Xiao, Yunze, et autres
Publié: (2026) -
On the Failure of Latent State Persistence in Large Language Models
par: Huang, Jen-tse, et autres
Publié: (2025) -
Towards Valid Student Simulation with Large Language Models
par: Yuan, Zhihao, et autres
Publié: (2026) -
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024) -
Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation
par: Huang, Jen-tse, et autres
Publié: (2026)