Hop, Skip, and Overthink: Diagnosing Why Reasoning Models Fumble during Multi-Hop Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Yadav, Anushka, Nalawade, Isha, Pillarichety, Srujana, Babu, Yashwanth, Ghosh, Reshmi, Basu, Samyadeep, Zhao, Wenlong, Nasaeh, Ali, Balasubramanian, Sriram, Srinivasan, Soundararajan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
From RAGs to rich parameters: Probing how language models utilize external knowledge over parametric information for factual queries
by: Wadhwa, Hitesh, et al.
Published: (2024)
by: Wadhwa, Hitesh, et al.
Published: (2024)
Quantifying reliance on external information over parametric knowledge during Retrieval Augmented Generation (RAG) using mechanistic analysis
by: Ghosh, Reshmi, et al.
Published: (2024)
by: Ghosh, Reshmi, et al.
Published: (2024)
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
by: Balasubramanian, Sriram, et al.
Published: (2025)
by: Balasubramanian, Sriram, et al.
Published: (2025)
Decomposing and Interpreting Image Representations via Text in ViTs Beyond CLIP
by: Balasubramanian, Sriram, et al.
Published: (2024)
by: Balasubramanian, Sriram, et al.
Published: (2024)
NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts
by: Gupta, Abhay, et al.
Published: (2025)
by: Gupta, Abhay, et al.
Published: (2025)
Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models
by: Srivastava, Gaurav, et al.
Published: (2025)
by: Srivastava, Gaurav, et al.
Published: (2025)
The Reasoning Bottleneck in Graph-RAG: Structured Prompting and Context Compression for Multi-Hop QA
by: Zarrinkia, Yasaman, et al.
Published: (2026)
by: Zarrinkia, Yasaman, et al.
Published: (2026)
Rethinking Artistic Copyright Infringements in the Era of Text-to-Image Generative Models
by: Moayeri, Mazda, et al.
Published: (2024)
by: Moayeri, Mazda, et al.
Published: (2024)
HopRAG: Multi-Hop Reasoning for Logic-Aware Retrieval-Augmented Generation
by: Liu, Hao, et al.
Published: (2025)
by: Liu, Hao, et al.
Published: (2025)
HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning
by: Wang, Shenzhi, et al.
Published: (2026)
by: Wang, Shenzhi, et al.
Published: (2026)
DocHop-QA: Towards Multi-Hop Reasoning over Multimodal Document Collections
by: Park, Jiwon, et al.
Published: (2025)
by: Park, Jiwon, et al.
Published: (2025)
BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain
by: Kim, Yunsoo, et al.
Published: (2025)
by: Kim, Yunsoo, et al.
Published: (2025)
Scaling Reasoning Hop Exposes Weaknesses: Demystifying and Improving Hop Generalization in Large Language Models
by: Li, Zhaoyi, et al.
Published: (2026)
by: Li, Zhaoyi, et al.
Published: (2026)
AgenticRAGTracer: A Hop-Aware Benchmark for Diagnosing Multi-Step Retrieval Reasoning in Agentic RAG
by: You, Qijie, et al.
Published: (2026)
by: You, Qijie, et al.
Published: (2026)
HipHop
Published: (2020)
Published: (2020)
Reasoning Court: Combining Reasoning, Action, and Judgment for Multi-Hop Reasoning
by: Wu, Jingtian, et al.
Published: (2025)
by: Wu, Jingtian, et al.
Published: (2025)
SpecHop: Continuous Speculation for Accelerating Multi-Hop Retrieval Agents
by: Saberi, Mehrdad, et al.
Published: (2026)
by: Saberi, Mehrdad, et al.
Published: (2026)
Lessons from Studying Two-Hop Latent Reasoning
by: Balesni, Mikita, et al.
Published: (2024)
by: Balesni, Mikita, et al.
Published: (2024)
Multi-Hop Reasoning for Question Answering with Hyperbolic Representations
by: Welz, Simon, et al.
Published: (2025)
by: Welz, Simon, et al.
Published: (2025)
Design Insights into Partition Placement and Routing for DNN Inference in Multi-Hop Edge Networks
by: Zhang, Jinkun, et al.
Published: (2026)
by: Zhang, Jinkun, et al.
Published: (2026)
Decomposition-Enhanced Training for Post-Hoc Attributions In Language Models
by: Balasubramanian, Sriram, et al.
Published: (2025)
by: Balasubramanian, Sriram, et al.
Published: (2025)
The Rap on Hip-Hop
by: Piekarski, Bill
Published: (2004)
by: Piekarski, Bill
Published: (2004)
Task-Aware LoRA Adapter Composition via Similarity Retrieval in Vector Databases
by: Adsul, Riya, et al.
Published: (2026)
by: Adsul, Riya, et al.
Published: (2026)
MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries
by: Tang, Yixuan, et al.
Published: (2024)
by: Tang, Yixuan, et al.
Published: (2024)
High-Accuracy and Efficient DV-Hop Localization for IoT Using Hop Loss
by: Shen, Zhengdi, et al.
Published: (2024)
by: Shen, Zhengdi, et al.
Published: (2024)
Bunny Hops and Blockchain Stops: Cross-Chain MEV Detection With N-Hops
by: Mancino, Davide, et al.
Published: (2025)
by: Mancino, Davide, et al.
Published: (2025)
Parameterized complexity of $r$-Hop, $r$-Step, and $r$-Hop Roman Domination
by: Das, Sandip, et al.
Published: (2026)
by: Das, Sandip, et al.
Published: (2026)
Toward Chaotic Group Velocity Hopping of an On-Chip Dissipative Kerr Soliton
by: Moille, Gregory, et al.
Published: (2025)
by: Moille, Gregory, et al.
Published: (2025)
Auto-Patching: Enhancing Multi-Hop Reasoning in Language Models
by: Jan, Aviv, et al.
Published: (2025)
by: Jan, Aviv, et al.
Published: (2025)
Examining Two Hop Reasoning Through Information Content Scaling
by: Johnston, David, et al.
Published: (2025)
by: Johnston, David, et al.
Published: (2025)
How Do LLMs Perform Two-Hop Reasoning in Context?
by: Guo, Tianyu, et al.
Published: (2025)
by: Guo, Tianyu, et al.
Published: (2025)
MoreHopQA: More Than Multi-hop Reasoning
by: Schnitzler, Julian, et al.
Published: (2024)
by: Schnitzler, Julian, et al.
Published: (2024)
MedHopQA: A Disease-Centered Multi-Hop Reasoning Benchmark and Evaluation Framework for LLM-Based Biomedical Question Answering
by: Islamaj, Rezarta, et al.
Published: (2026)
by: Islamaj, Rezarta, et al.
Published: (2026)
HopWeaver: Cross-Document Synthesis of High-Quality and Authentic Multi-Hop Questions
by: Shen, Zhiyu, et al.
Published: (2025)
by: Shen, Zhiyu, et al.
Published: (2025)
Hopping Too Late: Exploring the Limitations of Large Language Models on Multi-Hop Queries
by: Biran, Eden, et al.
Published: (2024)
by: Biran, Eden, et al.
Published: (2024)
DV-Hop localization based on Distance Estimation using Multinode and Hop Loss in WSNs
by: Wang, Penghong, et al.
Published: (2024)
by: Wang, Penghong, et al.
Published: (2024)
Similar Items
-
From RAGs to rich parameters: Probing how language models utilize external knowledge over parametric information for factual queries
by: Wadhwa, Hitesh, et al.
Published: (2024) -
Quantifying reliance on external information over parametric knowledge during Retrieval Augmented Generation (RAG) using mechanistic analysis
by: Ghosh, Reshmi, et al.
Published: (2024) -
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
by: Balasubramanian, Sriram, et al.
Published: (2025) -
Decomposing and Interpreting Image Representations via Text in ViTs Beyond CLIP
by: Balasubramanian, Sriram, et al.
Published: (2024) -
NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts
by: Gupta, Abhay, et al.
Published: (2025)