Reasoning or a Semblance of it? A Diagnostic Study of Transitive Reasoning in LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Mehrafarin, Houman, Eshghi, Arash, Konstas, Ioannis |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
When Chain-of-Thought Fails, the Solution Hides in the Hidden States
di: Mehrafarin, Houman, et al.
Pubblicazione: (2026)
di: Mehrafarin, Houman, et al.
Pubblicazione: (2026)
AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding
di: Suglia, Alessandro, et al.
Pubblicazione: (2024)
di: Suglia, Alessandro, et al.
Pubblicazione: (2024)
Voices in a Crowd: Searching for Clusters of Unique Perspectives
di: Vitsakis, Nikolas, et al.
Pubblicazione: (2024)
di: Vitsakis, Nikolas, et al.
Pubblicazione: (2024)
Repairs in a Block World: A New Benchmark for Handling User Corrections with Multi-Modal Language Models
di: Chiyah-Garcia, Javier, et al.
Pubblicazione: (2024)
di: Chiyah-Garcia, Javier, et al.
Pubblicazione: (2024)
MoRFI: Monotonic Sparse Autoencoder Feature Identification
di: Dimakopoulos, Dimitris, et al.
Pubblicazione: (2026)
di: Dimakopoulos, Dimitris, et al.
Pubblicazione: (2026)
Erasing 'Ugly' from the Internet: Propagation of the Beauty Myth in Text-Image Models
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks
di: Parekh, Amit, et al.
Pubblicazione: (2024)
di: Parekh, Amit, et al.
Pubblicazione: (2024)
Re-examining Sexism and Misogyny Classification with Annotator Attitudes
di: Jiang, Aiqi, et al.
Pubblicazione: (2024)
di: Jiang, Aiqi, et al.
Pubblicazione: (2024)
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
Kwai-STaR: Transform LLMs into State-Transition Reasoners
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
On Code-Induced Reasoning in LLMs
di: Waheed, Abdul, et al.
Pubblicazione: (2025)
di: Waheed, Abdul, et al.
Pubblicazione: (2025)
ProtoReasoning: Prototypes as the Foundation for Generalizable Reasoning in LLMs
di: He, Feng, et al.
Pubblicazione: (2025)
di: He, Feng, et al.
Pubblicazione: (2025)
Learning Diagnostic Reasoning for Decision Support in Toxicology
di: Oberländer, Nico, et al.
Pubblicazione: (2026)
di: Oberländer, Nico, et al.
Pubblicazione: (2026)
Presupposition and Reasoning in Conditionals: A Theory-Based Study of Humans and LLMs
di: Azin, Tara, et al.
Pubblicazione: (2026)
di: Azin, Tara, et al.
Pubblicazione: (2026)
Exploring the Potential of Offline RL for Reasoning in LLMs: A Preliminary Study
di: Tian, Xiaoyu, et al.
Pubblicazione: (2025)
di: Tian, Xiaoyu, et al.
Pubblicazione: (2025)
Reasoning Under Uncertainty: Exploring Probabilistic Reasoning Capabilities of LLMs
di: Pournemat, Mobina, et al.
Pubblicazione: (2025)
di: Pournemat, Mobina, et al.
Pubblicazione: (2025)
Reasoning with Graphs: Structuring Implicit Knowledge to Enhance LLMs Reasoning
di: Han, Haoyu, et al.
Pubblicazione: (2025)
di: Han, Haoyu, et al.
Pubblicazione: (2025)
AraReasoner: Evaluating Reasoning-Based LLMs for Arabic NLP
di: Hasanaath, Ahmed, et al.
Pubblicazione: (2025)
di: Hasanaath, Ahmed, et al.
Pubblicazione: (2025)
Reasoning as State Transition: A Representational Analysis of Reasoning Evolution in Large Language Models
di: Zhang, Siyuan, et al.
Pubblicazione: (2026)
di: Zhang, Siyuan, et al.
Pubblicazione: (2026)
LLMs as Models for Analogical Reasoning
di: Musker, Sam, et al.
Pubblicazione: (2024)
di: Musker, Sam, et al.
Pubblicazione: (2024)
Can NLP Tackle Hate Speech in the Real World? Stakeholder-Informed Feedback and Survey on Counterspeech
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
Reasoning or Not? A Comprehensive Evaluation of Reasoning LLMs for Dialogue Summarization
di: Jin, Keyan, et al.
Pubblicazione: (2025)
di: Jin, Keyan, et al.
Pubblicazione: (2025)
Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning
di: Ahmadi, Arash, et al.
Pubblicazione: (2026)
di: Ahmadi, Arash, et al.
Pubblicazione: (2026)
CSCBench: A PVC Diagnostic Benchmark for Commodity Supply Chain Reasoning
di: Cui, Yaxin, et al.
Pubblicazione: (2026)
di: Cui, Yaxin, et al.
Pubblicazione: (2026)
Reasoning about Affordances: Causal and Compositional Reasoning in LLMs
di: Gjerde, Magnus F., et al.
Pubblicazione: (2025)
di: Gjerde, Magnus F., et al.
Pubblicazione: (2025)
Untangling Input Language from Reasoning Language: A Diagnostic Framework for Cross-Lingual Moral Alignment in LLMs
di: Li, Nan, et al.
Pubblicazione: (2026)
di: Li, Nan, et al.
Pubblicazione: (2026)
Understanding and Patching Compositional Reasoning in LLMs
di: Li, Zhaoyi, et al.
Pubblicazione: (2024)
di: Li, Zhaoyi, et al.
Pubblicazione: (2024)
Can LLMs Reason in the Wild with Programs?
di: Yang, Yuan, et al.
Pubblicazione: (2024)
di: Yang, Yuan, et al.
Pubblicazione: (2024)
Speech LLMs are Contextual Reasoning Transcribers
di: Deng, Keqi, et al.
Pubblicazione: (2026)
di: Deng, Keqi, et al.
Pubblicazione: (2026)
Can LLMs Reason About Trust?: A Pilot Study
di: Debnath, Anushka, et al.
Pubblicazione: (2025)
di: Debnath, Anushka, et al.
Pubblicazione: (2025)
The Multi-Round Diagnostic RAG Framework for Emulating Clinical Reasoning
di: Sun, Penglei, et al.
Pubblicazione: (2025)
di: Sun, Penglei, et al.
Pubblicazione: (2025)
Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning
di: Wang, Zezhong, et al.
Pubblicazione: (2025)
di: Wang, Zezhong, et al.
Pubblicazione: (2025)
ALFA: Aligning LLMs to Ask Good Questions A Case Study in Clinical Reasoning
di: Li, Shuyue Stella, et al.
Pubblicazione: (2025)
di: Li, Shuyue Stella, et al.
Pubblicazione: (2025)
GDS Agent for Graph Algorithmic Reasoning
di: Shi, Borun, et al.
Pubblicazione: (2025)
di: Shi, Borun, et al.
Pubblicazione: (2025)
Can LLMs Learn by Teaching for Better Reasoning? A Preliminary Study
di: Ning, Xuefei, et al.
Pubblicazione: (2024)
di: Ning, Xuefei, et al.
Pubblicazione: (2024)
Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits
di: Zhang, Xiang, et al.
Pubblicazione: (2025)
di: Zhang, Xiang, et al.
Pubblicazione: (2025)
Reasoning Like a Doctor: Improving Medical Dialogue Systems via Diagnostic Reasoning Process Alignment
di: Xu, Kaishuai, et al.
Pubblicazione: (2024)
di: Xu, Kaishuai, et al.
Pubblicazione: (2024)
Slot Filling as a Reasoning Task for SpeechLLMs
di: Hacioglu, Kadri, et al.
Pubblicazione: (2025)
di: Hacioglu, Kadri, et al.
Pubblicazione: (2025)
Reasoning Gets Harder for LLMs Inside A Dialogue
di: Kartáč, Ivan, et al.
Pubblicazione: (2026)
di: Kartáč, Ivan, et al.
Pubblicazione: (2026)
Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal Examples
di: Yu, Fangxu, et al.
Pubblicazione: (2024)
di: Yu, Fangxu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
When Chain-of-Thought Fails, the Solution Hides in the Hidden States
di: Mehrafarin, Houman, et al.
Pubblicazione: (2026) -
AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding
di: Suglia, Alessandro, et al.
Pubblicazione: (2024) -
Voices in a Crowd: Searching for Clusters of Unique Perspectives
di: Vitsakis, Nikolas, et al.
Pubblicazione: (2024) -
Repairs in a Block World: A New Benchmark for Handling User Corrections with Multi-Modal Language Models
di: Chiyah-Garcia, Javier, et al.
Pubblicazione: (2024) -
MoRFI: Monotonic Sparse Autoencoder Feature Identification
di: Dimakopoulos, Dimitris, et al.
Pubblicazione: (2026)