Retrieval and Multi-Hop Reasoning in 1M-Token Context Windows: Evaluating LLMs on Classical Chinese Text
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Chow, Eric H. C. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LongCodeBench: Evaluating Coding LLMs at 1M Context Windows
par: Rando, Stefano, et autres
Publié: (2025)
par: Rando, Stefano, et autres
Publié: (2025)
How Do LLMs Perform Two-Hop Reasoning in Context?
par: Guo, Tianyu, et autres
Publié: (2025)
par: Guo, Tianyu, et autres
Publié: (2025)
Evaluating Multi-Hop Reasoning in RAG Systems: A Comparison of LLM-Based Retriever Evaluation Strategies
par: Brehme, Lorenz, et autres
Publié: (2026)
par: Brehme, Lorenz, et autres
Publié: (2026)
Retrieval is Cheap, Show Me the Code: Executable Multi-Hop Reasoning for Retrieval-Augmented Generation
par: Sun, Jiashuo, et autres
Publié: (2026)
par: Sun, Jiashuo, et autres
Publié: (2026)
RELOOP: Recursive Retrieval with Multi-Hop Reasoner and Planners for Heterogeneous QA
par: Yang, Ruiyi, et autres
Publié: (2025)
par: Yang, Ruiyi, et autres
Publié: (2025)
PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
PAR$^2$-RAG: Planned Active Retrieval and Reasoning for Multi-Hop Question Answering
par: Li, Xingyu, et autres
Publié: (2026)
par: Li, Xingyu, et autres
Publié: (2026)
From Query to Logic: Ontology-Driven Multi-Hop Reasoning in LLMs
par: Bian, Haonan, et autres
Publié: (2025)
par: Bian, Haonan, et autres
Publié: (2025)
StratRAG: A Multi-Hop Retrieval Evaluation Dataset for Retrieval-Augmented Generation Systems
par: Patodiya, Aryan
Publié: (2026)
par: Patodiya, Aryan
Publié: (2026)
A Skill-Based AI Agentic Pipeline for Library of Congress Subject Indexing
par: Chow, Eric H. C.
Publié: (2026)
par: Chow, Eric H. C.
Publié: (2026)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
par: Liu, Xinyu, et autres
Publié: (2026)
par: Liu, Xinyu, et autres
Publié: (2026)
Retrieval Meets Reasoning: Dynamic In-Context Editing for Long-Text Understanding
par: Fei, Weizhi, et autres
Publié: (2024)
par: Fei, Weizhi, et autres
Publié: (2024)
Reasoning Court: Combining Reasoning, Action, and Judgment for Multi-Hop Reasoning
par: Wu, Jingtian, et autres
Publié: (2025)
par: Wu, Jingtian, et autres
Publié: (2025)
ReasonAudio: A Benchmark for Evaluating Reasoning Beyond Matching in Text-Audio Retrieval
par: Zhang, Honglei, et autres
Publié: (2026)
par: Zhang, Honglei, et autres
Publié: (2026)
Geometric Analysis of Reasoning Trajectories: A Phase Space Approach to Understanding Valid and Invalid Multi-Hop Reasoning in LLMs
par: Marin, Javier
Publié: (2024)
par: Marin, Javier
Publié: (2024)
What External Knowledge is Preferred by LLMs? Characterizing and Exploring Chain of Evidence in Imperfect Context for Multi-Hop QA
par: Chang, Zhiyuan, et autres
Publié: (2024)
par: Chang, Zhiyuan, et autres
Publié: (2024)
Hop, Skip, and Overthink: Diagnosing Why Reasoning Models Fumble during Multi-Hop Analysis
par: Yadav, Anushka, et autres
Publié: (2025)
par: Yadav, Anushka, et autres
Publié: (2025)
OPERA: A Reinforcement Learning--Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024)
par: Zhuang, Ziyuan, et autres
Publié: (2024)
CodeAgents: A Token-Efficient Framework for Codified Multi-Agent Reasoning in LLMs
par: Yang, Bruce, et autres
Publié: (2025)
par: Yang, Bruce, et autres
Publié: (2025)
Multi-Hop Reasoning for Question Answering with Hyperbolic Representations
par: Welz, Simon, et autres
Publié: (2025)
par: Welz, Simon, et autres
Publié: (2025)
The Quantization Trap: Breaking Linear Scaling Laws in Multi-Hop Reasoning
par: Han, Henry, et autres
Publié: (2026)
par: Han, Henry, et autres
Publié: (2026)
ReAgent: Reversible Multi-Agent Reasoning for Knowledge-Enhanced Multi-Hop QA
par: Zhao, Xinjie, et autres
Publié: (2025)
par: Zhao, Xinjie, et autres
Publié: (2025)
CDTP: A Large-Scale Chinese Data-Text Pair Dataset for Comprehensive Evaluation of Chinese LLMs
par: Wu, Chengwei, et autres
Publié: (2025)
par: Wu, Chengwei, et autres
Publié: (2025)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
par: Wu, Jiaxin, et autres
Publié: (2025)
par: Wu, Jiaxin, et autres
Publié: (2025)
Hierarchical Lexical Graph for Enhanced Multi-Hop Retrieval
par: Ghassel, Abdellah, et autres
Publié: (2025)
par: Ghassel, Abdellah, et autres
Publié: (2025)
Reasoner-Executor-Synthesizer: Scalable Agentic Architecture with Static O(1) Context Window
par: Dobrovolskyi, Ivan
Publié: (2026)
par: Dobrovolskyi, Ivan
Publié: (2026)
STRIDE: Strategic Iterative Decision-Making for Retrieval-Augmented Multi-Hop Question Answering
par: Chen, Wei, et autres
Publié: (2026)
par: Chen, Wei, et autres
Publié: (2026)
ConTextual: Improving Clinical Text Summarization in LLMs with Context-preserving Token Filtering and Knowledge Graphs
par: Piya, Fahmida Liza, et autres
Publié: (2025)
par: Piya, Fahmida Liza, et autres
Publié: (2025)
MTCMB: A Multi-Task Benchmark Framework for Evaluating LLMs on Knowledge, Reasoning, and Safety in Traditional Chinese Medicine
par: Kong, Shufeng, et autres
Publié: (2025)
par: Kong, Shufeng, et autres
Publié: (2025)
Agentic Active Omni-Modal Perception for Multi-Hop Audio-Visual Reasoning
par: Xu, Ke, et autres
Publié: (2026)
par: Xu, Ke, et autres
Publié: (2026)
Enhancing Multi-Hop Knowledge Graph Reasoning through Reward Shaping Techniques
par: Li, Chen, et autres
Publié: (2024)
par: Li, Chen, et autres
Publié: (2024)
CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
MedHopQA: A Disease-Centered Multi-Hop Reasoning Benchmark and Evaluation Framework for LLM-Based Biomedical Question Answering
par: Islamaj, Rezarta, et autres
Publié: (2026)
par: Islamaj, Rezarta, et autres
Publié: (2026)
Training Text-to-Molecule Models with Context-Aware Tokenization
par: Kim, Seojin, et autres
Publié: (2025)
par: Kim, Seojin, et autres
Publié: (2025)
Lost in Tokenization: Context as the Key to Unlocking Biomolecular Understanding in Scientific LLMs
par: Zhuang, Kai, et autres
Publié: (2025)
par: Zhuang, Kai, et autres
Publié: (2025)
HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning
par: Wang, Shenzhi, et autres
Publié: (2026)
par: Wang, Shenzhi, et autres
Publié: (2026)
CURIE: Evaluating LLMs On Multitask Scientific Long Context Understanding and Reasoning
par: Cui, Hao, et autres
Publié: (2025)
par: Cui, Hao, et autres
Publié: (2025)
Optimizing Multi-Hop Document Retrieval Through Intermediate Representations
par: Lin, Jiaen, et autres
Publié: (2025)
par: Lin, Jiaen, et autres
Publié: (2025)
MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts
par: Wang, Peijie, et autres
Publié: (2025)
par: Wang, Peijie, et autres
Publié: (2025)
Documents similaires
-
LongCodeBench: Evaluating Coding LLMs at 1M Context Windows
par: Rando, Stefano, et autres
Publié: (2025) -
How Do LLMs Perform Two-Hop Reasoning in Context?
par: Guo, Tianyu, et autres
Publié: (2025) -
Evaluating Multi-Hop Reasoning in RAG Systems: A Comparison of LLM-Based Retriever Evaluation Strategies
par: Brehme, Lorenz, et autres
Publié: (2026) -
Retrieval is Cheap, Show Me the Code: Executable Multi-Hop Reasoning for Retrieval-Augmented Generation
par: Sun, Jiashuo, et autres
Publié: (2026) -
RELOOP: Recursive Retrieval with Multi-Hop Reasoner and Planners for Heterogeneous QA
par: Yang, Ruiyi, et autres
Publié: (2025)