PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Wang Bill, Yi, Qiutong Tony, Jia, Robin, Thomason, Jesse |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Language Models can Infer Action Semantics for Symbolic Planners from Environment Feedback
di: Zhu, Wang, et al.
Pubblicazione: (2024)
di: Zhu, Wang, et al.
Pubblicazione: (2024)
Zero, Finite, and Infinite Belief History of Theory of Mind Reasoning in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
di: Xu, Hainiu, et al.
Pubblicazione: (2024)
di: Xu, Hainiu, et al.
Pubblicazione: (2024)
An Extensive Evaluation of PDDL Capabilities in off-the-shelf LLMs
di: Vyas, Kaustubh, et al.
Pubblicazione: (2025)
di: Vyas, Kaustubh, et al.
Pubblicazione: (2025)
PSALM-V: Automating Symbolic Planning in Interactive Visual Environments with Large Language Models
di: Zhu, Wang Bill, et al.
Pubblicazione: (2025)
di: Zhu, Wang Bill, et al.
Pubblicazione: (2025)
Iterative Formalization and Planning in Partially Observable Environments
di: Gong, Liancheng, et al.
Pubblicazione: (2025)
di: Gong, Liancheng, et al.
Pubblicazione: (2025)
TwoStep: Multi-agent Task Planning using Classical Planners and Large Language Models
di: Bai, David, et al.
Pubblicazione: (2024)
di: Bai, David, et al.
Pubblicazione: (2024)
Adjust for Trust: Mitigating Trust-Induced Inappropriate Reliance on AI Assistance
di: Srinivasan, Tejas, et al.
Pubblicazione: (2025)
di: Srinivasan, Tejas, et al.
Pubblicazione: (2025)
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
di: Xu, Haoming, et al.
Pubblicazione: (2026)
di: Xu, Haoming, et al.
Pubblicazione: (2026)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
di: Zhang, Yadong, et al.
Pubblicazione: (2024)
di: Zhang, Yadong, et al.
Pubblicazione: (2024)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
di: Wong, Annie, et al.
Pubblicazione: (2025)
di: Wong, Annie, et al.
Pubblicazione: (2025)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
di: Saxena, Yash, et al.
Pubblicazione: (2024)
di: Saxena, Yash, et al.
Pubblicazione: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
di: Jiang, Fengqing, et al.
Pubblicazione: (2025)
di: Jiang, Fengqing, et al.
Pubblicazione: (2025)
Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
Brittle Minds, Fixable Activations: Understanding Belief Representations in Language Models
di: Bortoletto, Matteo, et al.
Pubblicazione: (2024)
di: Bortoletto, Matteo, et al.
Pubblicazione: (2024)
Beyond Single-User Dialogue: Assessing Multi-User Dialogue State Tracking Capabilities of Large Language Models
di: Song, Sangmin, et al.
Pubblicazione: (2025)
di: Song, Sangmin, et al.
Pubblicazione: (2025)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
di: Rajaee, Sara, et al.
Pubblicazione: (2026)
Words that make SENSE: Sensorimotor Norms in Learned Lexical Token Representations
di: Gupta, Abhinav, et al.
Pubblicazione: (2026)
di: Gupta, Abhinav, et al.
Pubblicazione: (2026)
Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models
di: Hu, Xucong, et al.
Pubblicazione: (2026)
di: Hu, Xucong, et al.
Pubblicazione: (2026)
Grounding Language about Belief in a Bayesian Theory-of-Mind
di: Ying, Lance, et al.
Pubblicazione: (2024)
di: Ying, Lance, et al.
Pubblicazione: (2024)
Language Models Represent Beliefs of Self and Others
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
Understanding Artificial Theory of Mind: Perturbed Tasks and Reasoning in Large Language Models
di: Nickel, Christian, et al.
Pubblicazione: (2026)
di: Nickel, Christian, et al.
Pubblicazione: (2026)
Do Theory of Mind Benchmarks Need Explicit Human-like Reasoning in Language Models?
di: Lu, Yi-Long, et al.
Pubblicazione: (2025)
di: Lu, Yi-Long, et al.
Pubblicazione: (2025)
A Survey on Large Language Models for Mathematical Reasoning
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
Can Large Language Models Integrate Spatial Data? Empirical Insights into Reasoning Strengths and Computational Weaknesses
di: Han, Bin, et al.
Pubblicazione: (2025)
di: Han, Bin, et al.
Pubblicazione: (2025)
GraphInstruct: Empowering Large Language Models with Graph Understanding and Reasoning Capability
di: Luo, Zihan, et al.
Pubblicazione: (2024)
di: Luo, Zihan, et al.
Pubblicazione: (2024)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
di: Li, Ce, et al.
Pubblicazione: (2025)
di: Li, Ce, et al.
Pubblicazione: (2025)
Survey on Reasoning Capabilities and Accessibility of Large Language Models Using Biology-related Questions
di: Ackerman, Michael
Pubblicazione: (2024)
di: Ackerman, Michael
Pubblicazione: (2024)
Lost in the Logic: An Evaluation of Large Language Models' Reasoning Capabilities on LSAT Logic Games
di: Malik, Saumya
Pubblicazione: (2024)
di: Malik, Saumya
Pubblicazione: (2024)
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
di: Qin, Zining, et al.
Pubblicazione: (2024)
di: Qin, Zining, et al.
Pubblicazione: (2024)
Evaluating Interventional Reasoning Capabilities of Large Language Models
di: Kasetty, Tejas, et al.
Pubblicazione: (2024)
di: Kasetty, Tejas, et al.
Pubblicazione: (2024)
ToM-LM: Delegating Theory of Mind Reasoning to External Symbolic Executors in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
di: Tang, Weizhi, et al.
Pubblicazione: (2024)
Exploring the System 1 Thinking Capability of Large Reasoning Models
di: Zhang, Wenyuan, et al.
Pubblicazione: (2025)
di: Zhang, Wenyuan, et al.
Pubblicazione: (2025)
MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models
di: Wang, Wentian, et al.
Pubblicazione: (2024)
di: Wang, Wentian, et al.
Pubblicazione: (2024)
MindMerger: Efficient Boosting LLM Reasoning in non-English Languages
di: Huang, Zixian, et al.
Pubblicazione: (2024)
di: Huang, Zixian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Language Models can Infer Action Semantics for Symbolic Planners from Environment Feedback
di: Zhu, Wang, et al.
Pubblicazione: (2024) -
Zero, Finite, and Infinite Belief History of Theory of Mind Reasoning in Large Language Models
di: Tang, Weizhi, et al.
Pubblicazione: (2024) -
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
di: Xu, Hainiu, et al.
Pubblicazione: (2024) -
An Extensive Evaluation of PDDL Capabilities in off-the-shelf LLMs
di: Vyas, Kaustubh, et al.
Pubblicazione: (2025) -
PSALM-V: Automating Symbolic Planning in Interactive Visual Environments with Large Language Models
di: Zhu, Wang Bill, et al.
Pubblicazione: (2025)