Recall, Robustness, and Lexicographic Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Diaz, Fernando, Ekstrand, Michael D., Mitra, Bhaskar |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Search and Society: Reimagining Information Access for Radical Futures
par: Mitra, Bhaskar
Publié: (2024)
par: Mitra, Bhaskar
Publié: (2024)
It's Not You, It's Me: The Impact of Choice Models and Ranking Strategies on Gender Imbalance in Music Recommendation
par: Ferraro, Andres, et autres
Publié: (2024)
par: Ferraro, Andres, et autres
Publié: (2024)
Overview of the TREC 2025 Tip-of-the-Tongue track
par: Arguello, Jaime, et autres
Publié: (2026)
par: Arguello, Jaime, et autres
Publié: (2026)
User and Recommender Behavior Over Time: Contextualizing Activity, Effectiveness, Diversity, and Fairness in Book Recommendation
par: Barenji, Samira Vaez, et autres
Publié: (2025)
par: Barenji, Samira Vaez, et autres
Publié: (2025)
Emancipatory Information Retrieval
par: Mitra, Bhaskar
Publié: (2025)
par: Mitra, Bhaskar
Publié: (2025)
Multilingual and Domain-Agnostic Tip-of-the-Tongue Query Generation for Simulated Evaluation
par: He, Xuhong, et autres
Publié: (2026)
par: He, Xuhong, et autres
Publié: (2026)
Tip of the Tongue Query Elicitation for Simulated Evaluation
par: He, Yifan, et autres
Publié: (2025)
par: He, Yifan, et autres
Publié: (2025)
Towards Group-aware Search Success
par: Wu, Haolun, et autres
Publié: (2024)
par: Wu, Haolun, et autres
Publié: (2024)
Open, to What End? A Capability-Theoretic Perspective on Open Search
par: Neophytou, Nicola, et autres
Publié: (2026)
par: Neophytou, Nicola, et autres
Publié: (2026)
We're Still Doing It (All) Wrong: Recommender Systems, Fifteen Years Later
par: Said, Alan, et autres
Publié: (2025)
par: Said, Alan, et autres
Publié: (2025)
JudgeBlender: Ensembling Judgments for Automatic Relevance Assessment
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Synthetic Test Collections for Retrieval Evaluation
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Sociotechnical Implications of Generative Artificial Intelligence for Information Access
par: Mitra, Bhaskar, et autres
Publié: (2024)
par: Mitra, Bhaskar, et autres
Publié: (2024)
Towards Understanding Bias in Synthetic Data for Evaluation
par: Rahmani, Hossein A., et autres
Publié: (2025)
par: Rahmani, Hossein A., et autres
Publié: (2025)
Pessimistic Evaluation
par: Diaz, Fernando
Publié: (2024)
par: Diaz, Fernando
Publié: (2024)
LongRecall: A Structured Approach for Robust Recall Evaluation in Long-Form Text
par: Ardestani, MohamamdJavad, et autres
Publié: (2025)
par: Ardestani, MohamamdJavad, et autres
Publié: (2025)
Total Recall QA: A Verifiable Evaluation Suite for Deep Research Agents
par: Rafiee, Mahta, et autres
Publié: (2026)
par: Rafiee, Mahta, et autres
Publié: (2026)
Contextualization with SPLADE for High Recall Retrieval
par: Yang, Eugene
Publié: (2024)
par: Yang, Eugene
Publié: (2024)
High Recall, Small Data: The Challenges of Within-System Evaluation in a Live Legal Search System
par: Wiggers, Gineke, et autres
Publié: (2024)
par: Wiggers, Gineke, et autres
Publié: (2024)
SynDL: A Large-Scale Synthetic Test Collection for Passage Retrieval
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Report on the 1st Workshop on Large Language Model for Evaluation in Information Retrieval (LLM4Eval 2024) at SIGIR 2024
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Result Diversification in Search and Recommendation: A Survey
par: Wu, Haolun, et autres
Publié: (2022)
par: Wu, Haolun, et autres
Publié: (2022)
What News Recommendation Research Did (But Mostly Didn't) Teach Us About Building A News Recommender
par: Higley, Karl, et autres
Publié: (2025)
par: Higley, Karl, et autres
Publié: (2025)
Semantic Recall for Vector Search
par: Kuffo, Leonardo, et autres
Publié: (2026)
par: Kuffo, Leonardo, et autres
Publié: (2026)
FullRecall: A Semantic Search-Based Ranking Approach for Maximizing Recall in Patent Retrieval
par: Ali, Amna, et autres
Publié: (2025)
par: Ali, Amna, et autres
Publié: (2025)
GRIT: Graph-based Recall Improvement for Task-oriented E-commerce Queries
par: Kulkarni, Hrishikesh, et autres
Publié: (2025)
par: Kulkarni, Hrishikesh, et autres
Publié: (2025)
The Impacts of Data, Ordering, and Intrinsic Dimensionality on Recall in Hierarchical Navigable Small Worlds
par: Elliott, Owen Pendrigh, et autres
Publié: (2024)
par: Elliott, Owen Pendrigh, et autres
Publié: (2024)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
par: Pradeep, Ronak, et autres
Publié: (2025)
par: Pradeep, Ronak, et autres
Publié: (2025)
Recall-Augmented Ranking: Enhancing Click-Through Rate Prediction Accuracy with Cross-Stage Data
par: Huang, Junjie, et autres
Publié: (2024)
par: Huang, Junjie, et autres
Publié: (2024)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
par: Li, Yupeng, et autres
Publié: (2026)
par: Li, Yupeng, et autres
Publié: (2026)
How important is Recall for Measuring Retrieval Quality?
par: Schwartz, Shelly, et autres
Publié: (2025)
par: Schwartz, Shelly, et autres
Publié: (2025)
Optimizing Recall or Relevance? A Multi-Task Multi-Head Approach for Item-to-Item Retrieval in Recommendation
par: Zhang, Jiang, et autres
Publié: (2025)
par: Zhang, Jiang, et autres
Publié: (2025)
RADAR: Recall Augmentation through Deferred Asynchronous Retrieval
par: Jaspal, Amit, et autres
Publié: (2025)
par: Jaspal, Amit, et autres
Publié: (2025)
Information Access of the Oppressed: Freirean Design for Emancipatory Information Access
par: Mitra, Bhaskar, et autres
Publié: (2026)
par: Mitra, Bhaskar, et autres
Publié: (2026)
LLMJudge: LLMs for Relevance Judgments
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Judging the Judges: A Collection of LLM-Generated Relevance Judgements
par: Rahmani, Hossein A., et autres
Publié: (2025)
par: Rahmani, Hossein A., et autres
Publié: (2025)
Towards Robust Recommendation: A Review and an Adversarial Robustness Evaluation Library
par: Cheng, Lei, et autres
Publié: (2024)
par: Cheng, Lei, et autres
Publié: (2024)
Overview of the TREC 2021 deep learning track
par: Craswell, Nick, et autres
Publié: (2025)
par: Craswell, Nick, et autres
Publié: (2025)
Large language models can accurately predict searcher preferences
par: Thomas, Paul, et autres
Publié: (2023)
par: Thomas, Paul, et autres
Publié: (2023)
Fact or Facsimile? Evaluating the Factual Robustness of Modern Retrievers
par: Wu, Haoyu, et autres
Publié: (2025)
par: Wu, Haoyu, et autres
Publié: (2025)
Documents similaires
-
Search and Society: Reimagining Information Access for Radical Futures
par: Mitra, Bhaskar
Publié: (2024) -
It's Not You, It's Me: The Impact of Choice Models and Ranking Strategies on Gender Imbalance in Music Recommendation
par: Ferraro, Andres, et autres
Publié: (2024) -
Overview of the TREC 2025 Tip-of-the-Tongue track
par: Arguello, Jaime, et autres
Publié: (2026) -
User and Recommender Behavior Over Time: Contextualizing Activity, Effectiveness, Diversity, and Fairness in Book Recommendation
par: Barenji, Samira Vaez, et autres
Publié: (2025) -
Emancipatory Information Retrieval
par: Mitra, Bhaskar
Publié: (2025)