Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Runcong, Zhu, Qinglin, Xu, Hainiu, Li, Jiazheng, Zhou, Yuxiang, He, Yulan, Gui, Lin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SymbolicThought: Integrating Language Models and Symbolic Reasoning for Consistent and Interpretable Human Relationship Understanding
por: Zhao, Runcong, et al.
Publicado: (2025)
por: Zhao, Runcong, et al.
Publicado: (2025)
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
por: Xu, Hainiu, et al.
Publicado: (2024)
por: Xu, Hainiu, et al.
Publicado: (2024)
Are NLP Models Good at Tracing Thoughts: An Overview of Narrative Understanding
por: Zhu, Lixing, et al.
Publicado: (2023)
por: Zhu, Lixing, et al.
Publicado: (2023)
Sparse Activation Editing for Reliable Instruction Following in Narratives
por: Zhao, Runcong, et al.
Publicado: (2025)
por: Zhao, Runcong, et al.
Publicado: (2025)
Soft Reasoning: Navigating Solution Spaces in Large Language Models through Controlled Embedding Exploration
por: Zhu, Qinglin, et al.
Publicado: (2025)
por: Zhu, Qinglin, et al.
Publicado: (2025)
Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation
por: Hu, Zhanghao, et al.
Publicado: (2026)
por: Hu, Zhanghao, et al.
Publicado: (2026)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
por: Wang, Xinyu, et al.
Publicado: (2024)
por: Wang, Xinyu, et al.
Publicado: (2024)
PLAYER*: Enhancing LLM-based Multi-Agent Communication and Interaction in Murder Mystery Games
por: Zhu, Qinglin, et al.
Publicado: (2024)
por: Zhu, Qinglin, et al.
Publicado: (2024)
LearnLens: LLM-Enabled Personalised, Curriculum-Grounded Feedback with Educators in the Loop
por: Zhao, Runcong, et al.
Publicado: (2025)
por: Zhao, Runcong, et al.
Publicado: (2025)
Calibrating LLMs with Preference Optimization on Thought Trees for Generating Rationale in Science Question Scoring
por: Li, Jiazheng, et al.
Publicado: (2024)
por: Li, Jiazheng, et al.
Publicado: (2024)
EnigmaToM: Improve LLMs' Theory-of-Mind Reasoning Capabilities with Neural Knowledge Base of Entity States
por: Xu, Hainiu, et al.
Publicado: (2025)
por: Xu, Hainiu, et al.
Publicado: (2025)
Cascading Large Language Models for Salient Event Graph Generation
por: Tan, Xingwei, et al.
Publicado: (2024)
por: Tan, Xingwei, et al.
Publicado: (2024)
Mirror: A Multiple-perspective Self-Reflection Method for Knowledge-rich Reasoning
por: Yan, Hanqi, et al.
Publicado: (2024)
por: Yan, Hanqi, et al.
Publicado: (2024)
Modeling Subjectivity in Cognitive Appraisal with Language Models
por: Zhou, Yuxiang, et al.
Publicado: (2025)
por: Zhou, Yuxiang, et al.
Publicado: (2025)
Detecting Contextual Hallucinations in LLMs with Frequency-Aware Attention
por: Qi, Siya, et al.
Publicado: (2026)
por: Qi, Siya, et al.
Publicado: (2026)
AERA Chat: An Interactive Platform for Automated Explainable Student Answer Assessment
por: Li, Jiazheng, et al.
Publicado: (2024)
por: Li, Jiazheng, et al.
Publicado: (2024)
Pull Requests as a Training Signal for Repo-Level Code Editing
por: Zhu, Qinglin, et al.
Publicado: (2026)
por: Zhu, Qinglin, et al.
Publicado: (2026)
Latent Refinement Decoding: Enhancing Diffusion-Based Language Models by Refining Belief States
por: Zhu, Qinglin, et al.
Publicado: (2025)
por: Zhu, Qinglin, et al.
Publicado: (2025)
ExDDI: Explaining Drug-Drug Interaction Predictions with Natural Language
por: Sun, Zhaoyue, et al.
Publicado: (2024)
por: Sun, Zhaoyue, et al.
Publicado: (2024)
The Mystery of In-Context Learning: A Comprehensive Survey on Interpretation and Analysis
por: Zhou, Yuxiang, et al.
Publicado: (2023)
por: Zhou, Yuxiang, et al.
Publicado: (2023)
Beyond Prompting: An Efficient Embedding Framework for Open-Domain Question Answering
por: Hu, Zhanghao, et al.
Publicado: (2025)
por: Hu, Zhanghao, et al.
Publicado: (2025)
Two Heads Are Better Than One: Dual-Model Verbal Reflection at Inference-Time
por: Li, Jiazheng, et al.
Publicado: (2025)
por: Li, Jiazheng, et al.
Publicado: (2025)
EvolvTrip: Enhancing Literary Character Understanding with Temporal Theory-of-Mind Graphs
por: Yang, Bohao, et al.
Publicado: (2025)
por: Yang, Bohao, et al.
Publicado: (2025)
A Survey of Automatic Hallucination Evaluation on Natural Language Generation
por: Qi, Siya, et al.
Publicado: (2024)
por: Qi, Siya, et al.
Publicado: (2024)
Rehearse With User: Personalized Opinion Summarization via Role-Playing based on Large Language Models
por: Zhang, Yanyue, et al.
Publicado: (2025)
por: Zhang, Yanyue, et al.
Publicado: (2025)
GUNDAM: Aligning Large Language Models with Graph Understanding
por: Ouyang, Sheng, et al.
Publicado: (2024)
por: Ouyang, Sheng, et al.
Publicado: (2024)
Variation in Verification: Understanding Verification Dynamics in Large Language Models
por: Zhou, Yefan, et al.
Publicado: (2025)
por: Zhou, Yefan, et al.
Publicado: (2025)
Beyond Static Cropping: Layer-Adaptive Visual Localization and Decoding Enhancement
por: Zhu, Zipeng, et al.
Publicado: (2026)
por: Zhu, Zipeng, et al.
Publicado: (2026)
Improving Natural Language Understanding for LLMs via Large-Scale Instruction Synthesis
por: Yuan, Lin, et al.
Publicado: (2025)
por: Yuan, Lin, et al.
Publicado: (2025)
Can Large Language Models Understand Real-World Complex Instructions?
por: He, Qianyu, et al.
Publicado: (2023)
por: He, Qianyu, et al.
Publicado: (2023)
Multi-Layer Ranking with Large Language Models for News Source Recommendation
por: Zhang, Wenjia, et al.
Publicado: (2024)
por: Zhang, Wenjia, et al.
Publicado: (2024)
When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment
por: Yan, Hanqi, et al.
Publicado: (2025)
por: Yan, Hanqi, et al.
Publicado: (2025)
Large, Small or Both: A Novel Data Augmentation Framework Based on Language Models for Debiasing Opinion Summarization
por: Zhang, Yanyue, et al.
Publicado: (2024)
por: Zhang, Yanyue, et al.
Publicado: (2024)
Linear Ensembles Wash Away Watermarks: On the Fragility of Distributional Perturbations in LLMs
por: Wu, Zhihao, et al.
Publicado: (2026)
por: Wu, Zhihao, et al.
Publicado: (2026)
Beyond Perplexity: Let the Reader Select Retrieval Summaries via Spectrum Projection Score
por: Hu, Zhanghao, et al.
Publicado: (2025)
por: Hu, Zhanghao, et al.
Publicado: (2025)
CAREBench: Evaluating LLMs' Emotion Understanding by Assessing Cognitive Appraisal Reasoning
por: Sun, Zhaoyue, et al.
Publicado: (2026)
por: Sun, Zhaoyue, et al.
Publicado: (2026)
Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding
por: Xiang, Yanzheng, et al.
Publicado: (2026)
por: Xiang, Yanzheng, et al.
Publicado: (2026)
Detecting HIV-Related Stigma in Clinical Narratives Using Large Language Models
por: Chen, Ziyi, et al.
Publicado: (2026)
por: Chen, Ziyi, et al.
Publicado: (2026)
Addressing Order Sensitivity of In-Context Demonstration Examples in Causal Language Models
por: Xiang, Yanzheng, et al.
Publicado: (2024)
por: Xiang, Yanzheng, et al.
Publicado: (2024)
Encourage or Inhibit Monosemanticity? Revisit Monosemanticity from a Feature Decorrelation Perspective
por: Yan, Hanqi, et al.
Publicado: (2024)
por: Yan, Hanqi, et al.
Publicado: (2024)
Ejemplares similares
-
SymbolicThought: Integrating Language Models and Symbolic Reasoning for Consistent and Interpretable Human Relationship Understanding
por: Zhao, Runcong, et al.
Publicado: (2025) -
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
por: Xu, Hainiu, et al.
Publicado: (2024) -
Are NLP Models Good at Tracing Thoughts: An Overview of Narrative Understanding
por: Zhu, Lixing, et al.
Publicado: (2023) -
Sparse Activation Editing for Reliable Instruction Following in Narratives
por: Zhao, Runcong, et al.
Publicado: (2025) -
Soft Reasoning: Navigating Solution Spaces in Large Language Models through Controlled Embedding Exploration
por: Zhu, Qinglin, et al.
Publicado: (2025)