Comparing Inferential Strategies of Humans and Large Language Models in Deductive Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Mondorf, Philipp, Plank, Barbara |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
LogicSkills: A Structured Benchmark for Formal Reasoning in Large Language Models
di: Rabern, Brian, et al.
Pubblicazione: (2026)
di: Rabern, Brian, et al.
Pubblicazione: (2026)
The Validation Gap: A Mechanistic Analysis of How Language Models Compute Arithmetic but Fail to Validate It
di: Bertolazzi, Leonardo, et al.
Pubblicazione: (2025)
di: Bertolazzi, Leonardo, et al.
Pubblicazione: (2025)
Liar, Liar, Logical Mire: A Benchmark for Suppositional Reasoning in Large Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Tracing Uncertainty in Language Model "Reasoning"
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
If Probable, Then Acceptable? Understanding Conditional Acceptability Judgments in Large Language Models
di: Orth, Jasmin, et al.
Pubblicazione: (2025)
di: Orth, Jasmin, et al.
Pubblicazione: (2025)
Investigating the Robustness of Deductive Reasoning with Large Language Models
di: Hoppe, Fabian, et al.
Pubblicazione: (2025)
di: Hoppe, Fabian, et al.
Pubblicazione: (2025)
Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models
di: Li, Yitian, et al.
Pubblicazione: (2024)
di: Li, Yitian, et al.
Pubblicazione: (2024)
Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
The Role of Deductive and Inductive Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Reasoning that Travels: Dissecting How Chain-of-Thought Transfers Across Models
di: Cheng, Xinyuan, et al.
Pubblicazione: (2026)
di: Cheng, Xinyuan, et al.
Pubblicazione: (2026)
Toward Mechanistic Explanation of Deductive Reasoning in Language Models
di: Maltoni, Davide, et al.
Pubblicazione: (2025)
di: Maltoni, Davide, et al.
Pubblicazione: (2025)
Compositional-ARC: Assessing Systematic Generalization in Abstract Spatial Reasoning
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
Theorem-of-Thought: A Multi-Agent Framework for Abductive, Deductive, and Inductive Reasoning in Language Models
di: Abdaljalil, Samir, et al.
Pubblicazione: (2025)
di: Abdaljalil, Samir, et al.
Pubblicazione: (2025)
Mind the Uncertainty in Human Disagreement: Evaluating Discrepancies between Model Predictions and Human Responses in VQA
di: Lan, Jian, et al.
Pubblicazione: (2024)
di: Lan, Jian, et al.
Pubblicazione: (2024)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
di: Wu, Da, et al.
Pubblicazione: (2023)
di: Wu, Da, et al.
Pubblicazione: (2023)
Revealing Algorithmic Deductive Circuits for Logical Reasoning
di: Nguyen, Phuong Minh, et al.
Pubblicazione: (2026)
di: Nguyen, Phuong Minh, et al.
Pubblicazione: (2026)
JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models
di: Chen, Michael K., et al.
Pubblicazione: (2025)
di: Chen, Michael K., et al.
Pubblicazione: (2025)
ItD: Large Language Models Can Teach Themselves Induction through Deduction
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
From Noise to Signal to Selbstzweck: Reframing Human Label Variation in the Era of Post-training in NLP
di: Xu, Shanshan, et al.
Pubblicazione: (2025)
di: Xu, Shanshan, et al.
Pubblicazione: (2025)
IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction
di: He, Kaiyu, et al.
Pubblicazione: (2024)
di: He, Kaiyu, et al.
Pubblicazione: (2024)
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
di: Ou, Jiao, et al.
Pubblicazione: (2024)
di: Ou, Jiao, et al.
Pubblicazione: (2024)
Comparing Human and Large Language Model Interpretation of Implicit Information
di: De Santis, Antonio, et al.
Pubblicazione: (2026)
di: De Santis, Antonio, et al.
Pubblicazione: (2026)
Dissecting Clinical Reasoning in Language Models: A Comparative Study of Prompts and Model Adaptation Strategies
di: Jullien, Mael, et al.
Pubblicazione: (2025)
di: Jullien, Mael, et al.
Pubblicazione: (2025)
Breaking the Barrier: Utilizing Large Language Models for Industrial Recommendation Systems through an Inferential Knowledge Graph
di: Zhao, Qian, et al.
Pubblicazione: (2024)
di: Zhao, Qian, et al.
Pubblicazione: (2024)
Is It Thinking or Cheating? Detecting Implicit Reward Hacking by Measuring Reasoning Effort
di: Wang, Xinpeng, et al.
Pubblicazione: (2025)
di: Wang, Xinpeng, et al.
Pubblicazione: (2025)
A Comparative Study of Large Language Models and Human Personality Traits
di: Jiaqi, Wang, et al.
Pubblicazione: (2025)
di: Jiaqi, Wang, et al.
Pubblicazione: (2025)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
di: Jing, Huihao, et al.
Pubblicazione: (2025)
di: Jing, Huihao, et al.
Pubblicazione: (2025)
Look at the Text: Instruction-Tuned Language Models are More Robust Multiple Choice Selectors than You Think
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
Plausibility as Commonsense Reasoning: Humans Succeed, Large Language Models Do not
di: Karakaş, Sercan
Pubblicazione: (2026)
di: Karakaş, Sercan
Pubblicazione: (2026)
Divergent Creativity in Humans and Large Language Models
di: Bellemare-Pepin, Antoine, et al.
Pubblicazione: (2024)
di: Bellemare-Pepin, Antoine, et al.
Pubblicazione: (2024)
Reason to Rote: Rethinking Memorization in Reasoning
di: Du, Yupei, et al.
Pubblicazione: (2025)
di: Du, Yupei, et al.
Pubblicazione: (2025)
Injecting Salesperson's Dialogue Strategies in Large Language Models with Chain-of-Thought Reasoning
di: Chang, Wen-Yu, et al.
Pubblicazione: (2024)
di: Chang, Wen-Yu, et al.
Pubblicazione: (2024)
Adaptive-Solver Framework for Dynamic Strategy Selection in Large Language Model Reasoning
di: Zhou, Jianpeng, et al.
Pubblicazione: (2023)
di: Zhou, Jianpeng, et al.
Pubblicazione: (2023)
Persona-Assigned Large Language Models Exhibit Human-Like Motivated Reasoning
di: Dash, Saloni, et al.
Pubblicazione: (2025)
di: Dash, Saloni, et al.
Pubblicazione: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
LogicSkills: A Structured Benchmark for Formal Reasoning in Large Language Models
di: Rabern, Brian, et al.
Pubblicazione: (2026) -
The Validation Gap: A Mechanistic Analysis of How Language Models Compute Arithmetic but Fail to Validate It
di: Bertolazzi, Leonardo, et al.
Pubblicazione: (2025) -
Liar, Liar, Logical Mire: A Benchmark for Suppositional Reasoning in Large Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
Tracing Uncertainty in Language Model "Reasoning"
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)