Can David Beat Goliath? On Multi-Hop Reasoning with Resource-Constrained Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Han, Hojae, Jung, Heeyun, Kim, Jongyoon, Hwang, Seung-won |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Benchmarking Testing in Automated Theorem Proving
por: Kim, Jongyoon, et al.
Publicado: (2026)
por: Kim, Jongyoon, et al.
Publicado: (2026)
ConvCodeWorld: Benchmarking Conversational Code Generation in Reproducible Feedback Environments
por: Han, Hojae, et al.
Publicado: (2025)
por: Han, Hojae, et al.
Publicado: (2025)
DuET: Dual Execution for Test Output Prediction with Generated Code and Pseudocode
por: Han, Hojae, et al.
Publicado: (2026)
por: Han, Hojae, et al.
Publicado: (2026)
PERC: Plan-As-Query Example Retrieval for Underrepresented Code Generation
por: Yoo, Jaeseok, et al.
Publicado: (2024)
por: Yoo, Jaeseok, et al.
Publicado: (2024)
ArchCode: Incorporating Software Requirements in Code Generation with Large Language Models
por: Han, Hojae, et al.
Publicado: (2024)
por: Han, Hojae, et al.
Publicado: (2024)
Dual-Scale World Models for LLM Agents Towards Hard-Exploration Problems
por: Kim, Minsoo, et al.
Publicado: (2025)
por: Kim, Minsoo, et al.
Publicado: (2025)
R$^3$-SQL: Ranking Reward and Resampling for Text-to-SQL
por: Han, Hojae, et al.
Publicado: (2026)
por: Han, Hojae, et al.
Publicado: (2026)
SAFE: Stepwise Atomic Feedback for Error correction in Multi-hop Reasoning
por: Kwon, Daeyong, et al.
Publicado: (2026)
por: Kwon, Daeyong, et al.
Publicado: (2026)
CREFT: Sequential Multi-Agent LLM for Character Relation Extraction
por: Chun, Ye Eun, et al.
Publicado: (2025)
por: Chun, Ye Eun, et al.
Publicado: (2025)
Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models
por: Kim, Jongho, et al.
Publicado: (2025)
por: Kim, Jongho, et al.
Publicado: (2025)
CoEx -- Co-evolving World-model and Exploration
por: Kim, Minsoo, et al.
Publicado: (2025)
por: Kim, Minsoo, et al.
Publicado: (2025)
Agent-as-Judge for Factual Summarization of Long Narratives
por: Jeong, Yeonseok, et al.
Publicado: (2025)
por: Jeong, Yeonseok, et al.
Publicado: (2025)
Unleashing Multi-Hop Reasoning Potential in Large Language Models through Repetition of Misordered Context
por: Yu, Sangwon, et al.
Publicado: (2024)
por: Yu, Sangwon, et al.
Publicado: (2024)
UnIte: Uncertainty-based Iterative Document Sampling for Domain Adaptation in Information Retrieval
por: Kim, Jongyoon, et al.
Publicado: (2026)
por: Kim, Jongyoon, et al.
Publicado: (2026)
Intended Target Identification for Anomia Patients with Gradient-based Selective Augmentation
por: Kim, Jongho, et al.
Publicado: (2025)
por: Kim, Jongho, et al.
Publicado: (2025)
Disentangling Questions from Query Generation for Task-Adaptive Retrieval
por: Lee, Yoonsang, et al.
Publicado: (2024)
por: Lee, Yoonsang, et al.
Publicado: (2024)
ComposeRAG: A Modular and Composable RAG for Corpus-Grounded Multi-Hop Question Answering
por: Wu, Ruofan, et al.
Publicado: (2025)
por: Wu, Ruofan, et al.
Publicado: (2025)
Chaining Event Spans for Temporal Relation Grounding
por: Kim, Jongho, et al.
Publicado: (2025)
por: Kim, Jongho, et al.
Publicado: (2025)
Analyzing the Effectiveness of Listwise Reranking with Positional Invariance on Temporal Generalizability
por: Yoon, Soyoung, et al.
Publicado: (2024)
por: Yoon, Soyoung, et al.
Publicado: (2024)
HARP: Hesitation-Aware Reframing in Transformer Inference Pass
por: Storaï, Romain, et al.
Publicado: (2024)
por: Storaï, Romain, et al.
Publicado: (2024)
Mentor-KD: Making Small Language Models Better Multi-step Reasoners
por: Lee, Hojae, et al.
Publicado: (2024)
por: Lee, Hojae, et al.
Publicado: (2024)
Chain of Grounded Objectives: Bridging Process and Goal-oriented Prompting for Code Generation
por: Yeo, Sangyeop, et al.
Publicado: (2025)
por: Yeo, Sangyeop, et al.
Publicado: (2025)
DocHop-QA: Towards Multi-Hop Reasoning over Multimodal Document Collections
por: Park, Jiwon, et al.
Publicado: (2025)
por: Park, Jiwon, et al.
Publicado: (2025)
ECoRAG: Evidentiality-guided Compression for Long Context RAG
por: Jeong, Yeonseok, et al.
Publicado: (2025)
por: Jeong, Yeonseok, et al.
Publicado: (2025)
Relevance to Utility: Process-Supervised Rewrite for RAG
por: Kim, Jaeyoung, et al.
Publicado: (2025)
por: Kim, Jaeyoung, et al.
Publicado: (2025)
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
por: Han, Xiaochuang, et al.
Publicado: (2023)
por: Han, Xiaochuang, et al.
Publicado: (2023)
BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain
por: Kim, Yunsoo, et al.
Publicado: (2025)
por: Kim, Yunsoo, et al.
Publicado: (2025)
Interventional Speech Noise Injection for ASR Generalizable Spoken Language Understanding
por: Jung, Yeonjoon, et al.
Publicado: (2024)
por: Jung, Yeonjoon, et al.
Publicado: (2024)
FCMR: Robust Evaluation of Financial Cross-Modal Multi-Hop Reasoning
por: Kim, Seunghee, et al.
Publicado: (2024)
por: Kim, Seunghee, et al.
Publicado: (2024)
LLM Agents at the Roundtable: A Multi-Perspective and Dialectical Reasoning Framework for Essay Scoring
por: Jang, Jinhee, et al.
Publicado: (2025)
por: Jang, Jinhee, et al.
Publicado: (2025)
AcuRank: Uncertainty-Aware Adaptive Computation for Listwise Reranking
por: Yoon, Soyoung, et al.
Publicado: (2025)
por: Yoon, Soyoung, et al.
Publicado: (2025)
OMHBench: Benchmarking Balanced and Grounded Omni-Modal Multi-Hop Reasoning
por: Kim, Seunghee, et al.
Publicado: (2025)
por: Kim, Seunghee, et al.
Publicado: (2025)
RoToR: Towards More Reliable Responses for Order-Invariant Inputs
por: Yoon, Soyoung, et al.
Publicado: (2025)
por: Yoon, Soyoung, et al.
Publicado: (2025)
Towards Lifelong Dialogue Agents via Timeline-based Memory Management
por: Ong, Kai Tzu-iunn, et al.
Publicado: (2024)
por: Ong, Kai Tzu-iunn, et al.
Publicado: (2024)
SpecHop: Continuous Speculation for Accelerating Multi-Hop Retrieval Agents
por: Saberi, Mehrdad, et al.
Publicado: (2026)
por: Saberi, Mehrdad, et al.
Publicado: (2026)
BELLE: A Bi-Level Multi-Agent Reasoning Framework for Multi-Hop Question Answering
por: Zhang, Taolin, et al.
Publicado: (2025)
por: Zhang, Taolin, et al.
Publicado: (2025)
A Multi-Agent Framework for Feature-Constrained Difficulty Control in Reading Comprehension Item Generation
por: Hwang, Seonjeong, et al.
Publicado: (2026)
por: Hwang, Seonjeong, et al.
Publicado: (2026)
Can Hallucinations Be Useful? Solving Multi-Hop Questions With SLMs By Chaining System-I/II Reasoning
por: Sengupta, Saptarshi, et al.
Publicado: (2026)
por: Sengupta, Saptarshi, et al.
Publicado: (2026)
Inference Scaling for Bridging Retrieval and Augmented Generation
por: Lee, Youngwon, et al.
Publicado: (2024)
por: Lee, Youngwon, et al.
Publicado: (2024)
CORD: Balancing COnsistency and Rank Distillation for Robust Retrieval-Augmented Generation
por: Lee, Youngwon, et al.
Publicado: (2024)
por: Lee, Youngwon, et al.
Publicado: (2024)
Ejemplares similares
-
Benchmarking Testing in Automated Theorem Proving
por: Kim, Jongyoon, et al.
Publicado: (2026) -
ConvCodeWorld: Benchmarking Conversational Code Generation in Reproducible Feedback Environments
por: Han, Hojae, et al.
Publicado: (2025) -
DuET: Dual Execution for Test Output Prediction with Generated Code and Pseudocode
por: Han, Hojae, et al.
Publicado: (2026) -
PERC: Plan-As-Query Example Retrieval for Underrepresented Code Generation
por: Yoo, Jaeseok, et al.
Publicado: (2024) -
ArchCode: Incorporating Software Requirements in Code Generation with Large Language Models
por: Han, Hojae, et al.
Publicado: (2024)