PHAnToM: Persona-based Prompting Has An Effect on Theory-of-Mind Reasoning in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tan, Fiona Anting, Yeo, Gerard Christopher, Jaidka, Kokil, Wu, Fanyou, Xu, Weijie, Jain, Vinija, Chadha, Aman, Liu, Yang, Ng, See-Kiong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Context to Cognitive Appraisal: Emotion Reasoning as a Theory of Mind Benchmark for Large Language Models
par: Yeo, Gerard Christopher, et autres
Publié: (2025)
par: Yeo, Gerard Christopher, et autres
Publié: (2025)
Beyond Text: Leveraging Multi-Task Learning and Cognitive Appraisal Theory for Post-Purchase Intention Analysis
par: Yeo, Gerard Christopher, et autres
Publié: (2024)
par: Yeo, Gerard Christopher, et autres
Publié: (2024)
On the Limitations of Steering in Language Model Alignment
par: Niranjan, Chebrolu, et autres
Publié: (2025)
par: Niranjan, Chebrolu, et autres
Publié: (2025)
Conversations: Love Them, Hate Them, Steer Them
par: Chebrolu, Niranjan, et autres
Publié: (2025)
par: Chebrolu, Niranjan, et autres
Publié: (2025)
Learning Through Dialogue: Engagement and Efficacy Matter More Than Explanations
par: Furniturewala, Shaz, et autres
Publié: (2026)
par: Furniturewala, Shaz, et autres
Publié: (2026)
From Passive to Persuasive: Localized Activation Injection for Empathy and Negotiation
par: Chebrolu, Niranjan, et autres
Publié: (2025)
par: Chebrolu, Niranjan, et autres
Publié: (2025)
Do You Trust Me? Cognitive-Affective Signatures of Trustworthiness in Large Language Models
par: Yeo, Gerard, et autres
Publié: (2025)
par: Yeo, Gerard, et autres
Publié: (2025)
The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
Reasoning or Rhetoric? An Empirical Analysis of Moral Reasoning Explanations in Large Language Models
par: Kasat, Aryan, et autres
Publié: (2026)
par: Kasat, Aryan, et autres
Publié: (2026)
TRACEALIGN -- Tracing the Drift: Attributing Alignment Failures to Training-Time Belief Sources in LLMs
par: Das, Amitava, et autres
Publié: (2025)
par: Das, Amitava, et autres
Publié: (2025)
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
par: Sinha, Neelabh, et autres
Publié: (2024)
par: Sinha, Neelabh, et autres
Publié: (2024)
Are Small Language Models Ready to Compete with Large Language Models for Practical Applications?
par: Sinha, Neelabh, et autres
Publié: (2024)
par: Sinha, Neelabh, et autres
Publié: (2024)
When Shallow Wins: Silent Failures and the Depth-Accuracy Paradox in Latent Reasoning
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
Personality Shapes Gender Bias in Persona-Conditioned LLM Narratives Across English and Hindi: An Empirical Investigation
par: Kumar, Tanay, et autres
Publié: (2026)
par: Kumar, Tanay, et autres
Publié: (2026)
Reading Between the Lines: How Electronic Nonverbal Cues shape Emotion Decoding
par: Kumar, Taara, et autres
Publié: (2026)
par: Kumar, Taara, et autres
Publié: (2026)
Incivility and Rigidity: Evaluating the Risks of Fine-Tuning LLMs for Political Argumentation
par: Churina, Svetlana, et autres
Publié: (2024)
par: Churina, Svetlana, et autres
Publié: (2024)
Turn-Level Empathy Prediction Using Psychological Indicators
par: Furniturewala, Shaz, et autres
Publié: (2024)
par: Furniturewala, Shaz, et autres
Publié: (2024)
The MediaSpin Dataset: Post-Publication News Headline Edits Annotated for Media Bias
par: Verma, Preetika, et autres
Publié: (2024)
par: Verma, Preetika, et autres
Publié: (2024)
"Reasoning" with Rhetoric: On the Style-Evidence Tradeoff in LLM-Generated Counter-Arguments
par: Verma, Preetika, et autres
Publié: (2024)
par: Verma, Preetika, et autres
Publié: (2024)
Dial E for Ethical Enforcement: institutional VETO power as a governance primitive
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
Born With a Silver Spoon? Investigating Socioeconomic Bias in Large Language Models
par: Singh, Smriti, et autres
Publié: (2024)
par: Singh, Smriti, et autres
Publié: (2024)
AlignGuard-LoRA: Alignment-Preserving Fine-Tuning via Fisher-Guided Decomposition and Riemannian-Geodesic Collision Regularization
par: Das, Amitava, et autres
Publié: (2025)
par: Das, Amitava, et autres
Publié: (2025)
SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
I Can't Believe It's Not Robust: Catastrophic Collapse of Safety Classifiers under Embedding Drift
par: Sahoo, Subramanyam, et autres
Publié: (2026)
par: Sahoo, Subramanyam, et autres
Publié: (2026)
Position: The Complexity of Perfect AI Alignment -- Formalizing the RLHF Trilemma
par: Sahoo, Subramanyam, et autres
Publié: (2025)
par: Sahoo, Subramanyam, et autres
Publié: (2025)
Exploring the Impact of Large Language Models on Recommender Systems: An Extensive Review
par: Vats, Arpita, et autres
Publié: (2024)
par: Vats, Arpita, et autres
Publié: (2024)
Hateful Meme Detection through Context-Sensitive Prompting and Fine-Grained Labeling
par: Ouyang, Rongxin, et autres
Publié: (2024)
par: Ouyang, Rongxin, et autres
Publié: (2024)
Hierarchical Prompting Taxonomy: A Universal Evaluation Framework for Large Language Models Aligned with Human Cognitive Principles
par: Budagam, Devichand, et autres
Publié: (2024)
par: Budagam, Devichand, et autres
Publié: (2024)
How Culturally Aware are Vision-Language Models?
par: Burda-Lassen, Olena, et autres
Publié: (2024)
par: Burda-Lassen, Olena, et autres
Publié: (2024)
A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications
par: Sahoo, Pranab, et autres
Publié: (2024)
par: Sahoo, Pranab, et autres
Publié: (2024)
Labels or Input? Rethinking Augmentation in Multimodal Hate Detection
par: Singh, Sahajpreet, et autres
Publié: (2025)
par: Singh, Sahajpreet, et autres
Publié: (2025)
Layer of Truth: Probing Belief Shifts under Continual Pre-Training Poisoning
par: Churina, Svetlana, et autres
Publié: (2025)
par: Churina, Svetlana, et autres
Publié: (2025)
Impact of Decoding Methods on Human Alignment of Conversational LLMs
par: Furniturewala, Shaz, et autres
Publié: (2024)
par: Furniturewala, Shaz, et autres
Publié: (2024)
Catch Me If You Can: How Smaller Reasoning Models Pretend to Reason with Mathematical Fidelity
par: Sahoo, Subramanyam, et autres
Publié: (2025)
par: Sahoo, Subramanyam, et autres
Publié: (2025)
Exploring the Frontier of Vision-Language Models: A Survey of Current Methodologies and Future Directions
par: Ghosh, Akash, et autres
Publié: (2024)
par: Ghosh, Akash, et autres
Publié: (2024)
D-STEER - Preference Alignment Techniques Learn to Behave, not to Believe -- Beneath the Surface, DPO as Steering Vector Perturbation in Activation Space
par: Raina, Samarth, et autres
Publié: (2025)
par: Raina, Samarth, et autres
Publié: (2025)
AlignMerge - Alignment-Preserving Large Language Model Merging via Fisher-Guided Geometric Constraints
par: Roy, Aniruddha, et autres
Publié: (2025)
par: Roy, Aniruddha, et autres
Publié: (2025)
A Comprehensive Survey of Accelerated Generation Techniques in Large Language Models
par: Khoshnoodi, Mahsa, et autres
Publié: (2024)
par: Khoshnoodi, Mahsa, et autres
Publié: (2024)
Assessing LLM Reliability on Temporally Recent Open-Domain Questions
par: Krishnappa, Pushwitha, et autres
Publié: (2026)
par: Krishnappa, Pushwitha, et autres
Publié: (2026)
Neural FOXP2 -- Language Specific Neuron Steering for Targeted Language Improvement in LLMs
par: Saha, Anusa, et autres
Publié: (2026)
par: Saha, Anusa, et autres
Publié: (2026)
Documents similaires
-
Beyond Context to Cognitive Appraisal: Emotion Reasoning as a Theory of Mind Benchmark for Large Language Models
par: Yeo, Gerard Christopher, et autres
Publié: (2025) -
Beyond Text: Leveraging Multi-Task Learning and Cognitive Appraisal Theory for Post-Purchase Intention Analysis
par: Yeo, Gerard Christopher, et autres
Publié: (2024) -
On the Limitations of Steering in Language Model Alignment
par: Niranjan, Chebrolu, et autres
Publié: (2025) -
Conversations: Love Them, Hate Them, Steer Them
par: Chebrolu, Niranjan, et autres
Publié: (2025) -
Learning Through Dialogue: Engagement and Efficacy Matter More Than Explanations
par: Furniturewala, Shaz, et autres
Publié: (2026)