EnigmaToM: Improve LLMs' Theory-of-Mind Reasoning Capabilities with Neural Knowledge Base of Entity States
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Hainiu, Qi, Siya, Li, Jiazheng, Zhou, Yuxiang, Du, Jinhua, Catmur, Caroline, He, Yulan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
di: Xu, Hainiu, et al.
Pubblicazione: (2024)
di: Xu, Hainiu, et al.
Pubblicazione: (2024)
EvolvTrip: Enhancing Literary Character Understanding with Temporal Theory-of-Mind Graphs
di: Yang, Bohao, et al.
Pubblicazione: (2025)
di: Yang, Bohao, et al.
Pubblicazione: (2025)
When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
Calibrating LLMs with Preference Optimization on Thought Trees for Generating Rationale in Science Question Scoring
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives
di: Zhao, Runcong, et al.
Pubblicazione: (2024)
di: Zhao, Runcong, et al.
Pubblicazione: (2024)
Evaluating LLMs' Assessment of Mixed-Context Hallucination Through the Lens of Summarization
di: Qi, Siya, et al.
Pubblicazione: (2025)
di: Qi, Siya, et al.
Pubblicazione: (2025)
CAREBench: Evaluating LLMs' Emotion Understanding by Assessing Cognitive Appraisal Reasoning
di: Sun, Zhaoyue, et al.
Pubblicazione: (2026)
di: Sun, Zhaoyue, et al.
Pubblicazione: (2026)
Self-Play Only Evolves When Self-Synthetic Pipeline Ensures Learnable Information Gain
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
Modeling Subjectivity in Cognitive Appraisal with Language Models
di: Zhou, Yuxiang, et al.
Pubblicazione: (2025)
di: Zhou, Yuxiang, et al.
Pubblicazione: (2025)
Anti‐social learning: The impact of language on mentalizing
di: Bryony Payne, et al.
Pubblicazione: (2025)
di: Bryony Payne, et al.
Pubblicazione: (2025)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
A Survey of Automatic Hallucination Evaluation on Natural Language Generation
di: Qi, Siya, et al.
Pubblicazione: (2024)
di: Qi, Siya, et al.
Pubblicazione: (2024)
SymbolicThought: Integrating Language Models and Symbolic Reasoning for Consistent and Interpretable Human Relationship Understanding
di: Zhao, Runcong, et al.
Pubblicazione: (2025)
di: Zhao, Runcong, et al.
Pubblicazione: (2025)
OpenPI2.0: An Improved Dataset for Entity Tracking in Texts
di: Zhang, Li, et al.
Pubblicazione: (2023)
di: Zhang, Li, et al.
Pubblicazione: (2023)
The Mystery of In-Context Learning: A Comprehensive Survey on Interpretation and Analysis
di: Zhou, Yuxiang, et al.
Pubblicazione: (2023)
di: Zhou, Yuxiang, et al.
Pubblicazione: (2023)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
di: Liu, Wei, et al.
Pubblicazione: (2025)
di: Liu, Wei, et al.
Pubblicazione: (2025)
An Automated Explainable Educational Assessment System Built on LLMs
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
Assessing the Reasoning Capabilities of LLMs in the context of Evidence-based Claim Verification
di: Dougrez-Lewis, John, et al.
Pubblicazione: (2024)
di: Dougrez-Lewis, John, et al.
Pubblicazione: (2024)
Two Heads Are Better Than One: Dual-Model Verbal Reflection at Inference-Time
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
Detecting Contextual Hallucinations in LLMs with Frequency-Aware Attention
di: Qi, Siya, et al.
Pubblicazione: (2026)
di: Qi, Siya, et al.
Pubblicazione: (2026)
Beyond Meta-Reasoning: Metacognitive Consolidation for Self-Improving LLM Reasoning
di: Zhuang, Ziqing, et al.
Pubblicazione: (2026)
di: Zhuang, Ziqing, et al.
Pubblicazione: (2026)
Beyond Perplexity: Let the Reader Select Retrieval Summaries via Spectrum Projection Score
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
Graph Neural Network-Based Entity Extraction and Relationship Reasoning in Complex Knowledge Graphs
di: Du, Junliang, et al.
Pubblicazione: (2024)
di: Du, Junliang, et al.
Pubblicazione: (2024)
ExDDI: Explaining Drug-Drug Interaction Predictions with Natural Language
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
di: Sun, Zhaoyue, et al.
Pubblicazione: (2024)
Inductive Reasoning for Temporal Knowledge Graphs with Emerging Entities
di: Zhao, Ze, et al.
Pubblicazione: (2026)
di: Zhao, Ze, et al.
Pubblicazione: (2026)
Can Pruning Improve Reasoning? Revisiting Long-CoT Compression with Capability in Mind for Better Reasoning
di: Zhao, Shangziqi, et al.
Pubblicazione: (2025)
di: Zhao, Shangziqi, et al.
Pubblicazione: (2025)
MultiMind: Enhancing Werewolf Agents with Multimodal Reasoning and Theory of Mind
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
Cascading Large Language Models for Salient Event Graph Generation
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
Set-Aligning Framework for Auto-Regressive Event Temporal Graph Generation
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
di: Tan, Xingwei, et al.
Pubblicazione: (2024)
EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context
di: Koo, Hamin, et al.
Pubblicazione: (2025)
di: Koo, Hamin, et al.
Pubblicazione: (2025)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
di: Zhu, Wang Bill, et al.
Pubblicazione: (2026)
UniToMBench: Integrating Perspective-Taking to Improve Theory of Mind in LLMs
di: Thiyagarajan, Prameshwar, et al.
Pubblicazione: (2025)
di: Thiyagarajan, Prameshwar, et al.
Pubblicazione: (2025)
BizCompass: Benchmarking the Reasoning Capabilities of LLMs in Business Knowledge and Applications
di: Hao, Jianing, et al.
Pubblicazione: (2026)
di: Hao, Jianing, et al.
Pubblicazione: (2026)
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
AERA Chat: An Interactive Platform for Automated Explainable Student Answer Assessment
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
di: Li, Jiazheng, et al.
Pubblicazione: (2024)
LearnLens: LLM-Enabled Personalised, Curriculum-Grounded Feedback with Educators in the Loop
di: Zhao, Runcong, et al.
Pubblicazione: (2025)
di: Zhao, Runcong, et al.
Pubblicazione: (2025)
Multi-ToM: Evaluating Multilingual Theory of Mind Capabilities in Large Language Models
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
PLAYER*: Enhancing LLM-based Multi-Agent Communication and Interaction in Murder Mystery Games
di: Zhu, Qinglin, et al.
Pubblicazione: (2024)
di: Zhu, Qinglin, et al.
Pubblicazione: (2024)
Mind Your Theory: Theory of Mind Goes Deeper Than Reasoning
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
di: Wagner, Eitan, et al.
Pubblicazione: (2024)
Format-Adapter: Improving Reasoning Capability of LLMs by Adapting Suitable Format
di: Wang, Dingzirui, et al.
Pubblicazione: (2025)
di: Wang, Dingzirui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
di: Xu, Hainiu, et al.
Pubblicazione: (2024) -
EvolvTrip: Enhancing Literary Character Understanding with Temporal Theory-of-Mind Graphs
di: Yang, Bohao, et al.
Pubblicazione: (2025) -
When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment
di: Yan, Hanqi, et al.
Pubblicazione: (2025) -
Calibrating LLMs with Preference Optimization on Thought Trees for Generating Rationale in Science Question Scoring
di: Li, Jiazheng, et al.
Pubblicazione: (2024) -
Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives
di: Zhao, Runcong, et al.
Pubblicazione: (2024)