RECOR: Reasoning-focused Multi-turn Conversational Retrieval Benchmark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ali, Mohammed, Abdallah, Abdelrahman, Agarwal, Amit, Patel, Hitesh Laxmichand, Jatowt, Adam |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TEMPO: A Realistic Multi-Domain Benchmark for Temporal Reasoning-Intensive Retrieval
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
Are LLM-Based Retrievers Worth Their Cost? An Empirical Study of Efficiency, Robustness, and Reasoning Overhead
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
SustainableQA: A Comprehensive Question Answering Dataset for Corporate Sustainability and EU Taxonomy Reporting
par: Ali, Mohammed, et autres
Publié: (2025)
par: Ali, Mohammed, et autres
Publié: (2025)
BracketRank: Large Language Model Document Ranking via Reasoning-based Competitive Elimination
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
Negative Sampling Techniques in Information Retrieval: A Survey
par: Wischounig, Laurin, et autres
Publié: (2026)
par: Wischounig, Laurin, et autres
Publié: (2026)
Rankify: A Comprehensive Python Toolkit for Retrieval, Re-Ranking, and Retrieval-Augmented Generation
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
MM-BRIGHT: A Multi-Task Multimodal Benchmark for Reasoning-Intensive Retrieval
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
RankArena: A Unified Platform for Evaluating Retrieval, Reranking and RAG with Human and LLM Feedback
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
How Good are LLM-based Rerankers? An Empirical Analysis of State-of-the-Art Reranking Models
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
DeAR: Dual-Stage Document Reranking with Reasoning Agents via LLM Distillation
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
TempRetriever: Fusion-based Temporal Dense Passage Retrieval for Time-Sensitive Questions
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
par: Abdallah, Abdelrahman, et autres
Publié: (2025)
Wrong Answers Can Also Be Useful: PlausibleQA -- A Large-Scale QA Dataset with Answer Plausibility Scores
par: Mozafari, Jamshid, et autres
Publié: (2025)
par: Mozafari, Jamshid, et autres
Publié: (2025)
HintEval: A Comprehensive Framework for Hint Generation and Evaluation for Questions
par: Mozafari, Jamshid, et autres
Publié: (2025)
par: Mozafari, Jamshid, et autres
Publié: (2025)
Exploring Hint Generation Approaches in Open-Domain Question Answering
par: Mozafari, Jamshid, et autres
Publié: (2024)
par: Mozafari, Jamshid, et autres
Publié: (2024)
Hard Negative Mining for Domain-Specific Retrieval in Enterprise Systems
par: Meghwani, Hansa, et autres
Publié: (2025)
par: Meghwani, Hansa, et autres
Publié: (2025)
It's High Time: A Survey of Temporal Question Answering
par: Piryani, Bhawna, et autres
Publié: (2025)
par: Piryani, Bhawna, et autres
Publié: (2025)
CORAL: Benchmarking Multi-turn Conversational Retrieval-Augmentation Generation
par: Cheng, Yiruo, et autres
Publié: (2024)
par: Cheng, Yiruo, et autres
Publié: (2024)
A Study into Investigating Temporal Robustness of LLMs
par: Wallat, Jonas, et autres
Publié: (2025)
par: Wallat, Jonas, et autres
Publié: (2025)
PARSE: An Open-Domain Reasoning Question Answering Benchmark for Persian
par: Mozafari, Jamshid, et autres
Publié: (2026)
par: Mozafari, Jamshid, et autres
Publié: (2026)
ArabicaQA: A Comprehensive Dataset for Arabic Question Answering
par: Abdallah, Abdelrahman, et autres
Publié: (2024)
par: Abdallah, Abdelrahman, et autres
Publié: (2024)
HIVE: Query, Hypothesize, Verify An LLM Framework for Multimodal Reasoning-Intensive Retrieval
par: Abdalla, Mahmoud, et autres
Publié: (2026)
par: Abdalla, Mahmoud, et autres
Publié: (2026)
LLMTemporalComparator: A Tool for Analysing Differences in Temporal Adaptations of Large Language Models
par: Fritsch, Reinhard Friedrich, et autres
Publié: (2024)
par: Fritsch, Reinhard Friedrich, et autres
Publié: (2024)
Analyzing the Role of Context in Forecasting with Large Language Models
par: Mutschlechner, Gerrit, et autres
Publié: (2025)
par: Mutschlechner, Gerrit, et autres
Publié: (2025)
Navigating Tomorrow: Reliably Assessing Large Language Models Performance on Future Event Prediction
par: Nako, Petraq, et autres
Publié: (2025)
par: Nako, Petraq, et autres
Publié: (2025)
Enhancing Knowledge Retrieval with In-Context Learning and Semantic Search through Generative AI
par: Ghali, Mohammed-Khalil, et autres
Publié: (2024)
par: Ghali, Mohammed-Khalil, et autres
Publié: (2024)
The Impact of International Collaborations with Highly Publishing Countries in Computer Science
par: Espes, Alberto Gomez, et autres
Publié: (2025)
par: Espes, Alberto Gomez, et autres
Publié: (2025)
Multi-hop Question Answering
par: Mavi, Vaibhav, et autres
Publié: (2022)
par: Mavi, Vaibhav, et autres
Publié: (2022)
ProCIS: A Benchmark for Proactive Retrieval in Conversations
par: Samarinas, Chris, et autres
Publié: (2024)
par: Samarinas, Chris, et autres
Publié: (2024)
Wisdom of the Crowds in Forecasting: Forecast Summarization for Supporting Future Event Prediction
par: Saha, Anisha, et autres
Publié: (2025)
par: Saha, Anisha, et autres
Publié: (2025)
Context Convergence Improves Answering Inferential Questions
par: Mozafari, Jamshid, et autres
Publié: (2026)
par: Mozafari, Jamshid, et autres
Publié: (2026)
Question Difficulty Estimation for Large Language Models via Answer Plausibility Scoring
par: Mozafari, Jamshid, et autres
Publié: (2026)
par: Mozafari, Jamshid, et autres
Publié: (2026)
WikiHint: A Human-Annotated Dataset for Hint Ranking and Generation
par: Mozafari, Jamshid, et autres
Publié: (2024)
par: Mozafari, Jamshid, et autres
Publié: (2024)
Evaluating Answer Reranking Strategies in Time-sensitive Question Answering
par: Kardan, Mehmet, et autres
Publié: (2025)
par: Kardan, Mehmet, et autres
Publié: (2025)
MARVEL: Multimodal Adaptive Reasoning-intensiVe Expand-rerank and retrievaL
par: Kasem, Mahmoud SalahEldin, et autres
Publié: (2026)
par: Kasem, Mahmoud SalahEldin, et autres
Publié: (2026)
Detecting Future-related Contexts of Entity Mentions
par: Prashar, Puneet, et autres
Publié: (2025)
par: Prashar, Puneet, et autres
Publié: (2025)
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
par: Li, Haitao, et autres
Publié: (2025)
par: Li, Haitao, et autres
Publié: (2025)
Finding Interest Needle in Popularity Haystack: Improving Retrieval by Modeling Item Exposure
par: Agarwal, Rahul, et autres
Publié: (2025)
par: Agarwal, Rahul, et autres
Publié: (2025)
Inferential Question Answering
par: Mozafari, Jamshid, et autres
Publié: (2026)
par: Mozafari, Jamshid, et autres
Publié: (2026)
R2MED: A Benchmark for Reasoning-Driven Medical Retrieval
par: Zhang, Xiangxu, et autres
Publié: (2025)
par: Zhang, Xiangxu, et autres
Publié: (2025)
RAR-b: Reasoning as Retrieval Benchmark
par: Xiao, Chenghao, et autres
Publié: (2024)
par: Xiao, Chenghao, et autres
Publié: (2024)
Documents similaires
-
TEMPO: A Realistic Multi-Domain Benchmark for Temporal Reasoning-Intensive Retrieval
par: Abdallah, Abdelrahman, et autres
Publié: (2026) -
Are LLM-Based Retrievers Worth Their Cost? An Empirical Study of Efficiency, Robustness, and Reasoning Overhead
par: Abdallah, Abdelrahman, et autres
Publié: (2026) -
SustainableQA: A Comprehensive Question Answering Dataset for Corporate Sustainability and EU Taxonomy Reporting
par: Ali, Mohammed, et autres
Publié: (2025) -
BracketRank: Large Language Model Document Ranking via Reasoning-based Competitive Elimination
par: Abdallah, Abdelrahman, et autres
Publié: (2026) -
Negative Sampling Techniques in Information Retrieval: A Survey
par: Wischounig, Laurin, et autres
Publié: (2026)