Evaluating Language Model Character Traits
Fuente:
arXiv
Saved in:
| Main Authors: | Ward, Francis Rhys, Yang, Zejia, Jackson, Alex, Brown, Randy, Smith, Chandler, Colverd, Grace, Thomson, Louis, Douglas, Raymond, Bartak, Patrik, Rowan, Andrew |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AI Sandbagging: Language Models can Strategically Underperform on Evaluations
by: van der Weij, Teun, et al.
Published: (2024)
by: van der Weij, Teun, et al.
Published: (2024)
Persona Vectors: Monitoring and Controlling Character Traits in Language Models
by: Chen, Runjin, et al.
Published: (2025)
by: Chen, Runjin, et al.
Published: (2025)
Towards a Theory of AI Personhood
by: Ward, Francis Rhys
Published: (2025)
by: Ward, Francis Rhys
Published: (2025)
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
by: You, Zejia, et al.
Published: (2026)
by: You, Zejia, et al.
Published: (2026)
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
by: Yuan, Xinfeng, et al.
Published: (2024)
by: Yuan, Xinfeng, et al.
Published: (2024)
Large Language Models Lack Understanding of Character Composition of Words
by: Shin, Andrew, et al.
Published: (2024)
by: Shin, Andrew, et al.
Published: (2024)
Evaluating Computational Representations of Character: An Austen Character Similarity Benchmark
by: Yang, Funing, et al.
Published: (2024)
by: Yang, Funing, et al.
Published: (2024)
NEBULA: A National Scale Dataset for Neighbourhood-Level Urban Building Energy Modelling for England and Wales
by: Colverd, Grace, et al.
Published: (2025)
by: Colverd, Grace, et al.
Published: (2025)
CharacterBench: Benchmarking Character Customization of Large Language Models
by: Zhou, Jinfeng, et al.
Published: (2024)
by: Zhou, Jinfeng, et al.
Published: (2024)
Evaluating Prompt-Based and Fine-Tuned Approaches to Czech Anaphora Resolution
by: Stano, Patrik, et al.
Published: (2025)
by: Stano, Patrik, et al.
Published: (2025)
AA-Omniscience: Evaluating Cross-Domain Knowledge Reliability in Large Language Models
by: Jackson, Declan, et al.
Published: (2025)
by: Jackson, Declan, et al.
Published: (2025)
Domain-Specific Tensor Languages
by: Bernardy, Jean-Philippe, et al.
Published: (2023)
by: Bernardy, Jean-Philippe, et al.
Published: (2023)
Detecting Errors through Ensembling Prompts (DEEP): An End-to-End LLM Framework for Detecting Factual Errors
by: Chandler, Alex, et al.
Published: (2024)
by: Chandler, Alex, et al.
Published: (2024)
Single Character Perturbations Break LLM Alignment
by: Lin, Leon, et al.
Published: (2024)
by: Lin, Leon, et al.
Published: (2024)
Stable and Explainable Personality Trait Evaluation in Large Language Models with Internal Activations
by: Ma, Xiaoxu, et al.
Published: (2026)
by: Ma, Xiaoxu, et al.
Published: (2026)
Artificial Impressions: Evaluating Large Language Model Behavior Through the Lens of Trait Impressions
by: Deas, Nicholas, et al.
Published: (2025)
by: Deas, Nicholas, et al.
Published: (2025)
TimeChara: Evaluating Point-in-Time Character Hallucination of Role-Playing Large Language Models
by: Ahn, Jaewoo, et al.
Published: (2024)
by: Ahn, Jaewoo, et al.
Published: (2024)
Robust Bias Detection in MLMs and its Application to Human Trait Ratings
by: Shrestha, Ingroj, et al.
Published: (2025)
by: Shrestha, Ingroj, et al.
Published: (2025)
Programming of Cellular Automata in C and C++
by: Christen, Patrik
Published: (2024)
by: Christen, Patrik
Published: (2024)
MET-Bench: Multimodal Entity Tracking for Evaluating the Limitations of Vision-Language and Reasoning Models
by: Cohen, Vanya, et al.
Published: (2025)
by: Cohen, Vanya, et al.
Published: (2025)
ChainNet: Structured Metaphor and Metonymy in WordNet
by: Maudslay, Rowan Hall, et al.
Published: (2024)
by: Maudslay, Rowan Hall, et al.
Published: (2024)
Generation, Distillation and Evaluation of Motivational Interviewing-Style Reflections with a Foundational Language Model
by: Brown, Andrew, et al.
Published: (2024)
by: Brown, Andrew, et al.
Published: (2024)
CharBench: Evaluating the Role of Tokenization in Character-Level Tasks
by: Uzan, Omri, et al.
Published: (2025)
by: Uzan, Omri, et al.
Published: (2025)
Incorporating Different Verbal Cues to Improve Text-Based Computer-Delivered Health Messaging
by: Cox, Samuel Rhys
Published: (2024)
by: Cox, Samuel Rhys
Published: (2024)
Theory of Mind and Self-Disclosure to CUIs
by: Cox, Samuel Rhys
Published: (2025)
by: Cox, Samuel Rhys
Published: (2025)
HEDS 3.0: The Human Evaluation Data Sheet Version 3.0
by: Belz, Anya, et al.
Published: (2024)
by: Belz, Anya, et al.
Published: (2024)
How Do Language Models Acquire Character-Level Information?
by: Sato, Soma, et al.
Published: (2026)
by: Sato, Soma, et al.
Published: (2026)
Improving Language and Modality Transfer in Translation by Character-level Modeling
by: Tsiamas, Ioannis, et al.
Published: (2025)
by: Tsiamas, Ioannis, et al.
Published: (2025)
Evaluating The Impact of Stimulus Quality in Investigations of LLM Language Performance
by: Pistotti, Timothy, et al.
Published: (2025)
by: Pistotti, Timothy, et al.
Published: (2025)
BenchCLAMP: A Benchmark for Evaluating Language Models on Syntactic and Semantic Parsing
by: Roy, Subhro, et al.
Published: (2022)
by: Roy, Subhro, et al.
Published: (2022)
LLM-as-a-Grader: Practical Insights from Large Language Model for Short-Answer and Report Evaluation
by: Byun, Grace, et al.
Published: (2025)
by: Byun, Grace, et al.
Published: (2025)
Eliciting Personality Traits in Large Language Models
by: Hilliard, Airlie, et al.
Published: (2024)
by: Hilliard, Airlie, et al.
Published: (2024)
From Language Models over Tokens to Language Models over Characters
by: Vieira, Tim, et al.
Published: (2024)
by: Vieira, Tim, et al.
Published: (2024)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
by: Meaney, JA, et al.
Published: (2024)
by: Meaney, JA, et al.
Published: (2024)
Hypothesis-only Biases in Large Language Model-Elicited Natural Language Inference
by: Proebsting, Grace, et al.
Published: (2024)
by: Proebsting, Grace, et al.
Published: (2024)
C-LLM: Learn to Check Chinese Spelling Errors Character by Character
by: Li, Kunting, et al.
Published: (2024)
by: Li, Kunting, et al.
Published: (2024)
The Strawberry Problem: Emergence of Character-level Understanding in Tokenized Language Models
by: Cosma, Adrian, et al.
Published: (2025)
by: Cosma, Adrian, et al.
Published: (2025)
Mitigating the Influence of Distractor Tasks in LMs with Prior-Aware Decoding
by: Douglas, Raymond, et al.
Published: (2024)
by: Douglas, Raymond, et al.
Published: (2024)
Neuron-based Personality Trait Induction in Large Language Models
by: Deng, Jia, et al.
Published: (2024)
by: Deng, Jia, et al.
Published: (2024)
CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation
by: Tu, Quan, et al.
Published: (2024)
by: Tu, Quan, et al.
Published: (2024)
Similar Items
-
AI Sandbagging: Language Models can Strategically Underperform on Evaluations
by: van der Weij, Teun, et al.
Published: (2024) -
Persona Vectors: Monitoring and Controlling Character Traits in Language Models
by: Chen, Runjin, et al.
Published: (2025) -
Towards a Theory of AI Personhood
by: Ward, Francis Rhys
Published: (2025) -
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
by: You, Zejia, et al.
Published: (2026) -
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
by: Yuan, Xinfeng, et al.
Published: (2024)