Benchmarking Information Retrieval Models on Complex Retrieval Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Killingback, Julian, Zamani, Hamed |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ExPerT: Effective and Explainable Evaluation of Personalized Long-Form Text Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
Hypencoder: Hypernetworks for Information Retrieval
di: Killingback, Julian, et al.
Pubblicazione: (2025)
di: Killingback, Julian, et al.
Pubblicazione: (2025)
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
di: Amirizaniani, Maryam, et al.
Pubblicazione: (2026)
di: Amirizaniani, Maryam, et al.
Pubblicazione: (2026)
Scaling Sparse and Dense Retrieval in Decoder-Only LLMs
di: Zeng, Hansi, et al.
Pubblicazione: (2025)
di: Zeng, Hansi, et al.
Pubblicazione: (2025)
Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations
di: Salemi, Alireza, et al.
Pubblicazione: (2026)
di: Salemi, Alireza, et al.
Pubblicazione: (2026)
BIRCO: A Benchmark of Information Retrieval Tasks with Complex Objectives
di: Wang, Xiaoyue, et al.
Pubblicazione: (2024)
di: Wang, Xiaoyue, et al.
Pubblicazione: (2024)
Scaling Laws for Embedding Dimension in Information Retrieval
di: Killingback, Julian, et al.
Pubblicazione: (2026)
di: Killingback, Julian, et al.
Pubblicazione: (2026)
Evaluating Retrieval Quality in Retrieval-Augmented Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
Learning from Natural Language Feedback for Personalized Question Answering
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
TARGET: Benchmarking Table Retrieval for Generative Tasks
di: Ji, Xingyu, et al.
Pubblicazione: (2025)
di: Ji, Xingyu, et al.
Pubblicazione: (2025)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
Learning to Rank for Multiple Retrieval-Augmented Models through Iterative Utility Maximization
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
A Unified Model and Document Representation for On-Device Retrieval-Augmented Generation
di: Killingback, Julian, et al.
Pubblicazione: (2026)
di: Killingback, Julian, et al.
Pubblicazione: (2026)
FinRetrieval: A Benchmark for Financial Data Retrieval by AI Agents
di: Kim, Eric Y., et al.
Pubblicazione: (2026)
di: Kim, Eric Y., et al.
Pubblicazione: (2026)
Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
di: Tang, Qiaoyu, et al.
Pubblicazione: (2024)
di: Tang, Qiaoyu, et al.
Pubblicazione: (2024)
BEIR-PL: Zero Shot Information Retrieval Benchmark for the Polish Language
di: Wojtasik, Konrad, et al.
Pubblicazione: (2023)
di: Wojtasik, Konrad, et al.
Pubblicazione: (2023)
LLM Alignment as Retriever Optimization: An Information Retrieval Perspective
di: Jin, Bowen, et al.
Pubblicazione: (2025)
di: Jin, Bowen, et al.
Pubblicazione: (2025)
TurkColBERT: A Benchmark of Dense and Late-Interaction Models for Turkish Information Retrieval
di: Ezerceli, Özay, et al.
Pubblicazione: (2025)
di: Ezerceli, Özay, et al.
Pubblicazione: (2025)
Benchmarking Retrieval-Augmented Generation for Chemistry
di: Zhong, Xianrui, et al.
Pubblicazione: (2025)
di: Zhong, Xianrui, et al.
Pubblicazione: (2025)
Towards a Search Engine for Machines: Unified Ranking for Multiple Retrieval-Augmented Large Language Models
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
Beyond a Million Tokens: Benchmarking and Enhancing Long-Term Memory in LLMs
di: Tavakoli, Mohammad, et al.
Pubblicazione: (2025)
di: Tavakoli, Mohammad, et al.
Pubblicazione: (2025)
Future of Information Retrieval Research in the Age of Generative AI
di: Allan, James, et al.
Pubblicazione: (2024)
di: Allan, James, et al.
Pubblicazione: (2024)
Optimization Methods for Personalizing Large Language Models through Retrieval Augmentation
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
di: Salemi, Alireza, et al.
Pubblicazione: (2024)
R^2AG: Incorporating Retrieval Information into Retrieval Augmented Generation
di: Ye, Fuda, et al.
Pubblicazione: (2024)
di: Ye, Fuda, et al.
Pubblicazione: (2024)
URAG: A Benchmark for Uncertainty Quantification in Retrieval-Augmented Large Language Models
di: Nguyen, Vinh, et al.
Pubblicazione: (2026)
di: Nguyen, Vinh, et al.
Pubblicazione: (2026)
Still Fresh? Evaluating Temporal Drift in Retrieval Benchmarks
di: Kuissi, Nathan, et al.
Pubblicazione: (2026)
di: Kuissi, Nathan, et al.
Pubblicazione: (2026)
HIRO: Hierarchical Information Retrieval Optimization
di: Goel, Krish, et al.
Pubblicazione: (2024)
di: Goel, Krish, et al.
Pubblicazione: (2024)
Plan-and-Refine: Diverse and Comprehensive Retrieval-Augmented Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval
di: Su, Hongjin, et al.
Pubblicazione: (2024)
di: Su, Hongjin, et al.
Pubblicazione: (2024)
Generative Retrieval and Alignment Model: A New Paradigm for E-commerce Retrieval
di: Pang, Ming, et al.
Pubblicazione: (2025)
di: Pang, Ming, et al.
Pubblicazione: (2025)
Database-Augmented Query Representation for Information Retrieval
di: Jeong, Soyeong, et al.
Pubblicazione: (2024)
di: Jeong, Soyeong, et al.
Pubblicazione: (2024)
RARe: Retrieval Augmented Retrieval with In-Context Examples
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
FreshStack: Building Realistic Benchmarks for Evaluating Retrieval on Technical Documents
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
di: Petcu, Roxana, et al.
Pubblicazione: (2026)
di: Petcu, Roxana, et al.
Pubblicazione: (2026)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Accelerating Retrieval-Augmented Generation
di: Quinn, Derrick, et al.
Pubblicazione: (2024)
di: Quinn, Derrick, et al.
Pubblicazione: (2024)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
di: Zeng, Hansi, et al.
Pubblicazione: (2026)
di: Zeng, Hansi, et al.
Pubblicazione: (2026)
Planning Ahead in Generative Retrieval: Guiding Autoregressive Generation through Simultaneous Decoding
di: Zeng, Hansi, et al.
Pubblicazione: (2024)
di: Zeng, Hansi, et al.
Pubblicazione: (2024)
Improving Medical Reasoning through Retrieval and Self-Reflection with Retrieval-Augmented Large Language Models
di: Jeong, Minbyul, et al.
Pubblicazione: (2024)
di: Jeong, Minbyul, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ExPerT: Effective and Explainable Evaluation of Personalized Long-Form Text Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025) -
Hypencoder: Hypernetworks for Information Retrieval
di: Killingback, Julian, et al.
Pubblicazione: (2025) -
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
di: Amirizaniani, Maryam, et al.
Pubblicazione: (2026) -
Scaling Sparse and Dense Retrieval in Decoder-Only LLMs
di: Zeng, Hansi, et al.
Pubblicazione: (2025) -
Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations
di: Salemi, Alireza, et al.
Pubblicazione: (2026)