Assessing Social Alignment: Do Personality-Prompted Large Language Models Behave Like Humans?
Fuente:
arXiv
Guardado en:
| Autores principales: | Zakazov, Ivan, Boronski, Mikolaj, Drudi, Lorenzo, West, Robert |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GRAD: Generative Retrieval-Aligned Demonstration Sampler for Efficient Few-Shot Reasoning
por: Gabouj, Oussama, et al.
Publicado: (2025)
por: Gabouj, Oussama, et al.
Publicado: (2025)
Cmprsr: Abstractive Token-Level Question-Agnostic Prompt Compressor
por: Zakazov, Ivan, et al.
Publicado: (2025)
por: Zakazov, Ivan, et al.
Publicado: (2025)
Assessing Large Language Models on Climate Information
por: Bulian, Jannis, et al.
Publicado: (2023)
por: Bulian, Jannis, et al.
Publicado: (2023)
Machine Learners Should Acknowledge the Legal Implications of Large Language Models as Personal Data
por: Nolte, Henrik, et al.
Publicado: (2025)
por: Nolte, Henrik, et al.
Publicado: (2025)
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
por: Hu, Tiancheng, et al.
Publicado: (2025)
por: Hu, Tiancheng, et al.
Publicado: (2025)
From Model Training to Model Raising
por: Aydin, Roland, et al.
Publicado: (2025)
por: Aydin, Roland, et al.
Publicado: (2025)
Surveying Attitudinal Alignment Between Large Language Models Vs. Humans Towards 17 Sustainable Development Goals
por: Wu, Qingyang, et al.
Publicado: (2024)
por: Wu, Qingyang, et al.
Publicado: (2024)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
por: Zhou, Han, et al.
Publicado: (2024)
por: Zhou, Han, et al.
Publicado: (2024)
Foundational Challenges in Assuring Alignment and Safety of Large Language Models
por: Anwar, Usman, et al.
Publicado: (2024)
por: Anwar, Usman, et al.
Publicado: (2024)
Inducing Group Fairness in Prompt-Based Language Model Decisions
por: Atwood, James, et al.
Publicado: (2024)
por: Atwood, James, et al.
Publicado: (2024)
Regulation of Language Models With Interpretability Will Likely Result In A Performance Trade-Off
por: Kenny, Eoin M., et al.
Publicado: (2024)
por: Kenny, Eoin M., et al.
Publicado: (2024)
Editing Personality for Large Language Models
por: Mao, Shengyu, et al.
Publicado: (2023)
por: Mao, Shengyu, et al.
Publicado: (2023)
Contextual StereoSet: Stress-Testing Bias Alignment Robustness in Large Language Models
por: Basu, Abhinaba, et al.
Publicado: (2026)
por: Basu, Abhinaba, et al.
Publicado: (2026)
Large Language Models as Urban Residents: An LLM Agent Framework for Personal Mobility Generation
por: Wang, Jiawei, et al.
Publicado: (2024)
por: Wang, Jiawei, et al.
Publicado: (2024)
Nicer Than Humans: How do Large Language Models Behave in the Prisoner's Dilemma?
por: Fontana, Nicoló, et al.
Publicado: (2024)
por: Fontana, Nicoló, et al.
Publicado: (2024)
Are Large Language Models Chameleons? An Attempt to Simulate Social Surveys
por: Geng, Mingmeng, et al.
Publicado: (2024)
por: Geng, Mingmeng, et al.
Publicado: (2024)
Inducing Human-like Biases in Moral Reasoning Language Models
por: Karpov, Artem, et al.
Publicado: (2024)
por: Karpov, Artem, et al.
Publicado: (2024)
LangFair: A Python Package for Assessing Bias and Fairness in Large Language Model Use Cases
por: Bouchard, Dylan, et al.
Publicado: (2025)
por: Bouchard, Dylan, et al.
Publicado: (2025)
Defining and Evaluating Physical Safety for Large Language Models
por: Tang, Yung-Chen, et al.
Publicado: (2024)
por: Tang, Yung-Chen, et al.
Publicado: (2024)
When "A Helpful Assistant" Is Not Really Helpful: Personas in System Prompts Do Not Improve Performances of Large Language Models
por: Zheng, Mingqian, et al.
Publicado: (2023)
por: Zheng, Mingqian, et al.
Publicado: (2023)
AI Meets the Classroom: When Do Large Language Models Harm Learning?
por: Lehmann, Matthias, et al.
Publicado: (2024)
por: Lehmann, Matthias, et al.
Publicado: (2024)
Existential Conversations with Large Language Models: Content, Community, and Culture
por: Shanahan, Murray, et al.
Publicado: (2024)
por: Shanahan, Murray, et al.
Publicado: (2024)
Evaluating Large Language Models for Fair and Reliable Organ Allocation
por: Kim, Brian Hyeongseok, et al.
Publicado: (2025)
por: Kim, Brian Hyeongseok, et al.
Publicado: (2025)
Deliberative Alignment: Reasoning Enables Safer Language Models
por: Guan, Melody Y., et al.
Publicado: (2024)
por: Guan, Melody Y., et al.
Publicado: (2024)
Do Large Language Models Reason Causally Like Us? Even Better?
por: Dettki, Hanna M., et al.
Publicado: (2025)
por: Dettki, Hanna M., et al.
Publicado: (2025)
Participatory Assessment of Large Language Model Applications in an Academic Medical Center
por: Carra, Giorgia, et al.
Publicado: (2024)
por: Carra, Giorgia, et al.
Publicado: (2024)
Leveraging Large Language Models for Tacit Knowledge Discovery in Organizational Contexts
por: Zuin, Gianlucca, et al.
Publicado: (2025)
por: Zuin, Gianlucca, et al.
Publicado: (2025)
Context-Adaptive Multi-Prompt Embedding with Large Language Models for Vision-Language Alignment
por: Kim, Dahun, et al.
Publicado: (2025)
por: Kim, Dahun, et al.
Publicado: (2025)
Do Large Language Models Walk Their Talk? Measuring the Gap Between Implicit Associations, Self-Report, and Behavioral Altruism
por: Andric, Sandro
Publicado: (2025)
por: Andric, Sandro
Publicado: (2025)
The LLM Has Left The Chat: Evidence of Bail Preferences in Large Language Models
por: Ensign, Danielle, et al.
Publicado: (2025)
por: Ensign, Danielle, et al.
Publicado: (2025)
Harnessing Large Language Models for Mental Health: Opportunities, Challenges, and Ethical Considerations
por: Pandey, Hari Mohan
Publicado: (2024)
por: Pandey, Hari Mohan
Publicado: (2024)
Mechanistic Interpretability with SAEs: Probing Religion, Violence, and Geography in Large Language Models
por: Simbeck, Katharina, et al.
Publicado: (2025)
por: Simbeck, Katharina, et al.
Publicado: (2025)
Alignment as Jurisprudence
por: Caputo, Nicholas
Publicado: (2026)
por: Caputo, Nicholas
Publicado: (2026)
Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?
por: Jinnai, Yuu
Publicado: (2024)
por: Jinnai, Yuu
Publicado: (2024)
PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an Agentic Approach
por: Sehwag, Udari Madhushani, et al.
Publicado: (2025)
por: Sehwag, Udari Madhushani, et al.
Publicado: (2025)
Survey on Plagiarism Detection in Large Language Models: The Impact of ChatGPT and Gemini on Academic Integrity
por: Pudasaini, Shushanta, et al.
Publicado: (2024)
por: Pudasaini, Shushanta, et al.
Publicado: (2024)
Evaluating Retrieval-Augmented Generation Strategies for Large Language Models in Travel Mode Choice Prediction
por: Xu, Yiming, et al.
Publicado: (2025)
por: Xu, Yiming, et al.
Publicado: (2025)
Enhancing Deep Knowledge Tracing via Diffusion Models for Personalized Adaptive Learning
por: Kuo, Ming, et al.
Publicado: (2024)
por: Kuo, Ming, et al.
Publicado: (2024)
I Prefer not to Say: Protecting User Consent in Models with Optional Personal Data
por: Leemann, Tobias, et al.
Publicado: (2022)
por: Leemann, Tobias, et al.
Publicado: (2022)
The AI Alignment Paradox
por: West, Robert, et al.
Publicado: (2024)
por: West, Robert, et al.
Publicado: (2024)
Ejemplares similares
-
GRAD: Generative Retrieval-Aligned Demonstration Sampler for Efficient Few-Shot Reasoning
por: Gabouj, Oussama, et al.
Publicado: (2025) -
Cmprsr: Abstractive Token-Level Question-Agnostic Prompt Compressor
por: Zakazov, Ivan, et al.
Publicado: (2025) -
Assessing Large Language Models on Climate Information
por: Bulian, Jannis, et al.
Publicado: (2023) -
Machine Learners Should Acknowledge the Legal Implications of Large Language Models as Personal Data
por: Nolte, Henrik, et al.
Publicado: (2025) -
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
por: Hu, Tiancheng, et al.
Publicado: (2025)