Eliciting Personality Traits in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hilliard, Airlie, Munoz, Cristian, Wu, Zekun, Koshiyama, Adriano Soares |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Text to Emoji: How PEFT-Driven Personality Manipulation Unleashes the Emoji Potential in LLMs
di: Jain, Navya, et al.
Pubblicazione: (2024)
di: Jain, Navya, et al.
Pubblicazione: (2024)
Stereotype Detection in LLMs: A Multiclass, Explainable, and Benchmark-Driven Approach
di: Wu, Zekun, et al.
Pubblicazione: (2024)
di: Wu, Zekun, et al.
Pubblicazione: (2024)
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
HyPA-RAG: A Hybrid Parameter Adaptive Retrieval-Augmented Generation System for AI Legal and Policy Applications
di: Kalra, Rishi, et al.
Pubblicazione: (2024)
di: Kalra, Rishi, et al.
Pubblicazione: (2024)
Assessing Bias in Metric Models for LLM Open-Ended Generation Bias Benchmarks
di: Demchak, Nathaniel, et al.
Pubblicazione: (2024)
di: Demchak, Nathaniel, et al.
Pubblicazione: (2024)
MPF: Aligning and Debiasing Language Models post Deployment via Multi Perspective Fusion
di: Guan, Xin, et al.
Pubblicazione: (2025)
di: Guan, Xin, et al.
Pubblicazione: (2025)
Control Reinforcement Learning: Interpretable Token-Level Steering of LLMs via Sparse Autoencoder Features
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
di: Cho, Seonglae, et al.
Pubblicazione: (2026)
CorrSteer: Generation-Time LLM Steering via Correlated Sparse Autoencoder Features
di: Cho, Seonglae, et al.
Pubblicazione: (2025)
di: Cho, Seonglae, et al.
Pubblicazione: (2025)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
Tool Calling is Linearly Readable and Steerable in Language Models
di: Wu, Zekun, et al.
Pubblicazione: (2026)
di: Wu, Zekun, et al.
Pubblicazione: (2026)
A Comparative Study of Large Language Models and Human Personality Traits
di: Jiaqi, Wang, et al.
Pubblicazione: (2025)
di: Jiaqi, Wang, et al.
Pubblicazione: (2025)
IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective Optimization
di: Bai, Yuzhuo, et al.
Pubblicazione: (2025)
di: Bai, Yuzhuo, et al.
Pubblicazione: (2025)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
Inclusivity in Large Language Models: Personality Traits and Gender Bias in Scientific Abstracts
di: Pervez, Naseela, et al.
Pubblicazione: (2024)
di: Pervez, Naseela, et al.
Pubblicazione: (2024)
Orca: Enhancing Role-Playing Abilities of Large Language Models by Integrating Personality Traits
di: Huang, Yuxuan
Pubblicazione: (2024)
di: Huang, Yuxuan
Pubblicazione: (2024)
Personality as a Probe for LLM Evaluation: Method Trade-offs and Downstream Effects
di: Handa, Gunmay, et al.
Pubblicazione: (2025)
di: Handa, Gunmay, et al.
Pubblicazione: (2025)
Predicting the Big Five Personality Traits in Chinese Counselling Dialogues Using Large Language Models
di: Yan, Yang, et al.
Pubblicazione: (2024)
di: Yan, Yang, et al.
Pubblicazione: (2024)
How Personality Traits Influence Negotiation Outcomes? A Simulation based on Large Language Models
di: Huang, Yin Jou, et al.
Pubblicazione: (2024)
di: Huang, Yin Jou, et al.
Pubblicazione: (2024)
THaMES: An End-to-End Tool for Hallucination Mitigation and Evaluation in Large Language Models
di: Liang, Mengfei, et al.
Pubblicazione: (2024)
di: Liang, Mengfei, et al.
Pubblicazione: (2024)
PersonaLLM: Investigating the Ability of Large Language Models to Express Personality Traits
di: Jiang, Hang, et al.
Pubblicazione: (2023)
di: Jiang, Hang, et al.
Pubblicazione: (2023)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
di: Wang, Yajing, et al.
Pubblicazione: (2024)
di: Wang, Yajing, et al.
Pubblicazione: (2024)
Personality Traits in Large Language Models
di: Serapio-García, Greg, et al.
Pubblicazione: (2023)
di: Serapio-García, Greg, et al.
Pubblicazione: (2023)
The Dark Patterns of Personalized Persuasion in Large Language Models: Exposing Persuasive Linguistic Features for Big Five Personality Traits in LLMs Responses
di: Mieleszczenko-Kowszewicz, Wiktoria, et al.
Pubblicazione: (2024)
di: Mieleszczenko-Kowszewicz, Wiktoria, et al.
Pubblicazione: (2024)
Unsupervised Elicitation of Language Models
di: Wen, Jiaxin, et al.
Pubblicazione: (2025)
di: Wen, Jiaxin, et al.
Pubblicazione: (2025)
A Novel Self-Evolution Framework for Large Language Models
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
di: He, Wei, et al.
Pubblicazione: (2024)
di: He, Wei, et al.
Pubblicazione: (2024)
Eliciting Trustworthiness Priors of Large Language Models via Economic Games
di: Yan, Siyu, et al.
Pubblicazione: (2026)
di: Yan, Siyu, et al.
Pubblicazione: (2026)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
di: Li, Jiachun, et al.
Pubblicazione: (2024)
di: Li, Jiachun, et al.
Pubblicazione: (2024)
Dynamic Generation of Personalities with Large Language Models
di: Liu, Jianzhi, et al.
Pubblicazione: (2024)
di: Liu, Jianzhi, et al.
Pubblicazione: (2024)
Causality Elicitation from Large Language Models
di: Kameyama, Takashi, et al.
Pubblicazione: (2026)
di: Kameyama, Takashi, et al.
Pubblicazione: (2026)
Personalized Large Language Models
di: Woźniak, Stanisław, et al.
Pubblicazione: (2024)
di: Woźniak, Stanisław, et al.
Pubblicazione: (2024)
Eliciting Reasoning in Language Models with Cognitive Tools
di: Ebouky, Brown, et al.
Pubblicazione: (2025)
di: Ebouky, Brown, et al.
Pubblicazione: (2025)
Dual Traits in Probabilistic Reasoning of Large Language Models
di: Li, Shenxiong, et al.
Pubblicazione: (2024)
di: Li, Shenxiong, et al.
Pubblicazione: (2024)
PICLe: Eliciting Diverse Behaviors from Large Language Models with Persona In-Context Learning
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2024)
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2024)
Eliciting Informative Text Evaluations with Large Language Models
di: Lu, Yuxuan, et al.
Pubblicazione: (2024)
di: Lu, Yuxuan, et al.
Pubblicazione: (2024)
Self-Training Elicits Concise Reasoning in Large Language Models
di: Munkhbat, Tergel, et al.
Pubblicazione: (2025)
di: Munkhbat, Tergel, et al.
Pubblicazione: (2025)
Language Models Benefit from Preparation with Elicited Knowledge
di: Yu, Jiacan, et al.
Pubblicazione: (2024)
di: Yu, Jiacan, et al.
Pubblicazione: (2024)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation
di: Cantini, Riccardo, et al.
Pubblicazione: (2024)
di: Cantini, Riccardo, et al.
Pubblicazione: (2024)
Eliciting and Analyzing Emergent Misalignment in State-of-the-Art Large Language Models
di: Panpatil, Siddhant, et al.
Pubblicazione: (2025)
di: Panpatil, Siddhant, et al.
Pubblicazione: (2025)
Documenti analoghi
-
From Text to Emoji: How PEFT-Driven Personality Manipulation Unleashes the Emoji Potential in LLMs
di: Jain, Navya, et al.
Pubblicazione: (2024) -
Stereotype Detection in LLMs: A Multiclass, Explainable, and Benchmark-Driven Approach
di: Wu, Zekun, et al.
Pubblicazione: (2024) -
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
di: Cho, Seonglae, et al.
Pubblicazione: (2026) -
HyPA-RAG: A Hybrid Parameter Adaptive Retrieval-Augmented Generation System for AI Legal and Policy Applications
di: Kalra, Rishi, et al.
Pubblicazione: (2024) -
Assessing Bias in Metric Models for LLM Open-Ended Generation Bias Benchmarks
di: Demchak, Nathaniel, et al.
Pubblicazione: (2024)