Kinship Data Benchmark for Multi-hop Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Tianda, Kazakov, Dimitar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tool-Call Dependency Structure is Linearly Decodable in LLM Agent Residual Streams
por: Sun, Tianda, et al.
Publicado: (2026)
por: Sun, Tianda, et al.
Publicado: (2026)
Peak-Then-Collapse and the Four Interface Channels of Knowledge-Graph Tool Use
por: Sun, Tianda, et al.
Publicado: (2026)
por: Sun, Tianda, et al.
Publicado: (2026)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
por: You, Wangjie, et al.
Publicado: (2025)
por: You, Wangjie, et al.
Publicado: (2025)
Shattering the Shortcut: A Topology-Regularized Benchmark for Multi-hop Medical Reasoning in LLMs
por: Zi, Xing, et al.
Publicado: (2026)
por: Zi, Xing, et al.
Publicado: (2026)
Learning from Synthetic Data Improves Multi-hop Reasoning
por: Kabra, Anmol, et al.
Publicado: (2026)
por: Kabra, Anmol, et al.
Publicado: (2026)
DEEPAMBIGQA: Ambiguous Multi-hop Questions for Benchmarking LLM Answer Completeness
por: Ji, Jiabao, et al.
Publicado: (2025)
por: Ji, Jiabao, et al.
Publicado: (2025)
FamilyTool: A Multi-hop Personalized Tool Use Benchmark
por: Wang, Yuxin, et al.
Publicado: (2025)
por: Wang, Yuxin, et al.
Publicado: (2025)
SAFE: Stepwise Atomic Feedback for Error correction in Multi-hop Reasoning
por: Kwon, Daeyong, et al.
Publicado: (2026)
por: Kwon, Daeyong, et al.
Publicado: (2026)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
por: Kim, Subin, et al.
Publicado: (2025)
por: Kim, Subin, et al.
Publicado: (2025)
Omne-R1: Learning to Reason with Memory for Multi-hop Question Answering
por: Liu, Boyuan, et al.
Publicado: (2025)
por: Liu, Boyuan, et al.
Publicado: (2025)
BeamAggR: Beam Aggregation Reasoning over Multi-source Knowledge for Multi-hop Question Answering
por: Chu, Zheng, et al.
Publicado: (2024)
por: Chu, Zheng, et al.
Publicado: (2024)
Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning
por: Kim, Jeonghoon, et al.
Publicado: (2024)
por: Kim, Jeonghoon, et al.
Publicado: (2024)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
por: Luo, Jinchang, et al.
Publicado: (2025)
por: Luo, Jinchang, et al.
Publicado: (2025)
Retrieve, Summarize, Plan: Advancing Multi-hop Question Answering with an Iterative Approach
por: Jiang, Zhouyu, et al.
Publicado: (2024)
por: Jiang, Zhouyu, et al.
Publicado: (2024)
DepWiGNN: A Depth-wise Graph Neural Network for Multi-hop Spatial Reasoning in Text
por: Li, Shuaiyi, et al.
Publicado: (2023)
por: Li, Shuaiyi, et al.
Publicado: (2023)
On the Optimality of Discrete Object Naming: a Kinship Case Study
por: Le, Phong, et al.
Publicado: (2025)
por: Le, Phong, et al.
Publicado: (2025)
Multi-hop Question Answering
por: Mavi, Vaibhav, et al.
Publicado: (2022)
por: Mavi, Vaibhav, et al.
Publicado: (2022)
Omanic: Towards Step-wise Evaluation of Multi-hop Reasoning in Large Language Models
por: Gu, Xiaojie, et al.
Publicado: (2026)
por: Gu, Xiaojie, et al.
Publicado: (2026)
Enhancing Transformer-Based Rerankers with Synthetic Data and LLM-Based Supervision
por: Peshevski, Dimitar, et al.
Publicado: (2025)
por: Peshevski, Dimitar, et al.
Publicado: (2025)
PRIMO: Progressive Induction for Multi-hop Open Rule Generation
por: Liu, Jianyu, et al.
Publicado: (2024)
por: Liu, Jianyu, et al.
Publicado: (2024)
MARCH: Evaluating the Intersection of Ambiguity Interpretation and Multi-hop Inference
por: Park, Jeonghyun, et al.
Publicado: (2025)
por: Park, Jeonghyun, et al.
Publicado: (2025)
HANRAG: Heuristic Accurate Noise-resistant Retrieval-Augmented Generation for Multi-hop Question Answering
por: Sun, Duolin, et al.
Publicado: (2025)
por: Sun, Duolin, et al.
Publicado: (2025)
Explicit v.s. Implicit Memory: Exploring Multi-hop Complex Reasoning Over Personalized Information
por: Zhang, Zeyu, et al.
Publicado: (2025)
por: Zhang, Zeyu, et al.
Publicado: (2025)
Are LLMs Capable of Data-based Statistical and Causal Reasoning? Benchmarking Advanced Quantitative Reasoning with Data
por: Liu, Xiao, et al.
Publicado: (2024)
por: Liu, Xiao, et al.
Publicado: (2024)
On the Limitations of Rank-One Model Editing in Answering Multi-hop Questions
por: He, Zhiyuan, et al.
Publicado: (2026)
por: He, Zhiyuan, et al.
Publicado: (2026)
OlympicArena: Benchmarking Multi-discipline Cognitive Reasoning for Superintelligent AI
por: Huang, Zhen, et al.
Publicado: (2024)
por: Huang, Zhen, et al.
Publicado: (2024)
CIRAG: Construction-Integration Retrieval and Adaptive Generation for Multi-hop Question Answering
por: Wei, Zili, et al.
Publicado: (2026)
por: Wei, Zili, et al.
Publicado: (2026)
Cross-Granularity Hypergraph Retrieval-Augmented Generation for Multi-hop Question Answering
por: Wang, Changjian, et al.
Publicado: (2025)
por: Wang, Changjian, et al.
Publicado: (2025)
Avoiding Knowledge Edit Skipping in Multi-hop Question Answering with Guided Decomposition
por: Liu, Yi, et al.
Publicado: (2025)
por: Liu, Yi, et al.
Publicado: (2025)
Benchmarking Contextual and Paralinguistic Reasoning in Speech-LLMs: A Case Study with In-the-Wild Data
por: Wang, Qiongqiong, et al.
Publicado: (2025)
por: Wang, Qiongqiong, et al.
Publicado: (2025)
Learning Fairer Representations with FairVIC
por: Barker, Charmaine, et al.
Publicado: (2024)
por: Barker, Charmaine, et al.
Publicado: (2024)
MultiZebraLogic: A Multilingual Logical Reasoning Benchmark
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
Polymath: A Challenging Multi-modal Mathematical Reasoning Benchmark
por: Gupta, Himanshu, et al.
Publicado: (2024)
por: Gupta, Himanshu, et al.
Publicado: (2024)
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026)
por: Wang, Yilin, et al.
Publicado: (2026)
SentGraph: Hierarchical Sentence Graph for Multi-hop Retrieval-Augmented Question Answering
por: Liang, Junli, et al.
Publicado: (2026)
por: Liang, Junli, et al.
Publicado: (2026)
MFORT-QA: Multi-hop Few-shot Open Rich Table Question Answering
por: Guan, Che, et al.
Publicado: (2024)
por: Guan, Che, et al.
Publicado: (2024)
Bactrainus: Optimizing Large Language Models for Multi-hop Complex Question Answering Tasks
por: Barati, Iman, et al.
Publicado: (2025)
por: Barati, Iman, et al.
Publicado: (2025)
Mitigating Bias in Text Classification via Prompt-Based Text Transformation
por: Barker, Charmaine, et al.
Publicado: (2023)
por: Barker, Charmaine, et al.
Publicado: (2023)
AraTable: Benchmarking LLMs' Reasoning and Understanding of Arabic Tabular Data
por: Alshaikh, Rana, et al.
Publicado: (2025)
por: Alshaikh, Rana, et al.
Publicado: (2025)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
por: Jing, Huihao, et al.
Publicado: (2025)
por: Jing, Huihao, et al.
Publicado: (2025)
Ejemplares similares
-
Tool-Call Dependency Structure is Linearly Decodable in LLM Agent Residual Streams
por: Sun, Tianda, et al.
Publicado: (2026) -
Peak-Then-Collapse and the Four Interface Channels of Knowledge-Graph Tool Use
por: Sun, Tianda, et al.
Publicado: (2026) -
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
por: You, Wangjie, et al.
Publicado: (2025) -
Shattering the Shortcut: A Topology-Regularized Benchmark for Multi-hop Medical Reasoning in LLMs
por: Zi, Xing, et al.
Publicado: (2026) -
Learning from Synthetic Data Improves Multi-hop Reasoning
por: Kabra, Anmol, et al.
Publicado: (2026)