Spacerini: Plug-and-play Search Engines with Pyserini and Hugging Face
Fuente:
arXiv
Saved in:
| Main Authors: | Akiki, Christopher, Ogundepo, Odunayo, Piktus, Aleksandra, Zhang, Xinyu, Oladipo, Akintunde, Lin, Jimmy, Potthast, Martin |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
"Knowing When You Don't Know": A Multilingual Relevance Assessment Dataset for Robust Retrieval-Augmented Generation
by: Thakur, Nandan, et al.
Published: (2023)
by: Thakur, Nandan, et al.
Published: (2023)
Lighting the Way for BRIGHT: Reproducible Baselines with Anserini, Pyserini, and RankLLM
by: Sharifymoghaddam, Sahel, et al.
Published: (2025)
by: Sharifymoghaddam, Sahel, et al.
Published: (2025)
Improving Multilingual Math Reasoning for African Languages
by: Ogundepo, Odunayo, et al.
Published: (2025)
by: Ogundepo, Odunayo, et al.
Published: (2025)
Detecting Generated Native Ads in Conversational Search
by: Schmidt, Sebastian, et al.
Published: (2024)
by: Schmidt, Sebastian, et al.
Published: (2024)
CURE: A Dataset for Clinical Understanding & Retrieval Evaluation
by: Sheikh, Nadia Athar, et al.
Published: (2024)
by: Sheikh, Nadia Athar, et al.
Published: (2024)
AfroBench: How Good are Large Language Models on African Languages?
by: Ojo, Jessica, et al.
Published: (2023)
by: Ojo, Jessica, et al.
Published: (2023)
A Large-Scale, Cross-Disciplinary Corpus of Systematic Reviews
by: Achkar, Pierre, et al.
Published: (2026)
by: Achkar, Pierre, et al.
Published: (2026)
Zero-shot Generative Large Language Models for Systematic Review Screening Automation
by: Wang, Shuai, et al.
Published: (2024)
by: Wang, Shuai, et al.
Published: (2024)
Benchmarking Recommendation, Classification, and Tracing Based on Hugging Face Knowledge Graph
by: Chen, Qiaosheng, et al.
Published: (2025)
by: Chen, Qiaosheng, et al.
Published: (2025)
A Systematic Study of Pseudo-Relevance Feedback with LLMs
by: Jedidi, Nour, et al.
Published: (2026)
by: Jedidi, Nour, et al.
Published: (2026)
From Relevance to Authority: Authority-aware Generative Retrieval in Web Search Engines
by: Lee, Sunkyung, et al.
Published: (2026)
by: Lee, Sunkyung, et al.
Published: (2026)
Khmer Semantic Search Engine (KSE): Digital Information Access and Document Retrieval
by: Thuon, Nimol
Published: (2024)
by: Thuon, Nimol
Published: (2024)
Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?
by: Hsu, Tz-Huan, et al.
Published: (2026)
by: Hsu, Tz-Huan, et al.
Published: (2026)
TakeLab Retriever: AI-Driven Search Engine for Articles from Croatian News Outlets
by: Dukić, David, et al.
Published: (2024)
by: Dukić, David, et al.
Published: (2024)
ORBIT: Scalable and Verifiable Data Generation for Search Agents on a Tight Budget
by: Thakur, Nandan, et al.
Published: (2026)
by: Thakur, Nandan, et al.
Published: (2026)
Overview of the Plagiarism Detection Task at PAN 2025
by: Greiner-Petter, André, et al.
Published: (2025)
by: Greiner-Petter, André, et al.
Published: (2025)
Towards a Search Engine for Machines: Unified Ranking for Multiple Retrieval-Augmented Large Language Models
by: Salemi, Alireza, et al.
Published: (2024)
by: Salemi, Alireza, et al.
Published: (2024)
Study on LLMs for Promptagator-Style Dense Retriever Training
by: Gwon, Daniel, et al.
Published: (2025)
by: Gwon, Daniel, et al.
Published: (2025)
An Early FIRST Reproduction and Improvements to Single-Token Decoding for Fast Listwise Reranking
by: Chen, Zijian, et al.
Published: (2024)
by: Chen, Zijian, et al.
Published: (2024)
SearchRAG: Can Search Engines Be Helpful for LLM-based Medical Question Answering?
by: Shi, Yucheng, et al.
Published: (2025)
by: Shi, Yucheng, et al.
Published: (2025)
AiReview: An Open Platform for Accelerating Systematic Reviews with LLMs
by: Mao, Xinyu, et al.
Published: (2025)
by: Mao, Xinyu, et al.
Published: (2025)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
Evaluating Robustness of Generative Search Engine on Adversarial Factual Questions
by: Hu, Xuming, et al.
Published: (2024)
by: Hu, Xuming, et al.
Published: (2024)
Controlling Output Rankings in Generative Engines for LLM-based Search
by: Jin, Haibo, et al.
Published: (2026)
by: Jin, Haibo, et al.
Published: (2026)
Unifying Adversarial Robustness and Training Across Text Scoring Models
by: Tamber, Manveer Singh, et al.
Published: (2026)
by: Tamber, Manveer Singh, et al.
Published: (2026)
A Survey of Generative Search and Recommendation in the Era of Large Language Models
by: Li, Yongqi, et al.
Published: (2024)
by: Li, Yongqi, et al.
Published: (2024)
A Plug-and-play Model-agnostic Embedding Enhancement Approach for Explainable Recommendation
by: Mi, Yunqi, et al.
Published: (2025)
by: Mi, Yunqi, et al.
Published: (2025)
Systematic Evaluation of Neural Retrieval Models on the Touché 2020 Argument Retrieval Subset of BEIR
by: Thakur, Nandan, et al.
Published: (2024)
by: Thakur, Nandan, et al.
Published: (2024)
Agentic-R: Learning to Retrieve for Agentic Search
by: Liu, Wenhan, et al.
Published: (2026)
by: Liu, Wenhan, et al.
Published: (2026)
QUPID: Quantified Understanding for Enhanced Performance, Insights, and Decisions in Korean Search Engines
by: Kwon, Ohjoon, et al.
Published: (2025)
by: Kwon, Ohjoon, et al.
Published: (2025)
Learning to Ask: Conversational Product Search via Representation Learning
by: Zou, Jie, et al.
Published: (2024)
by: Zou, Jie, et al.
Published: (2024)
VerifAI: A Verifiable Open-Source Search Engine for Biomedical Question Answering
by: Košprdić, Miloš, et al.
Published: (2026)
by: Košprdić, Miloš, et al.
Published: (2026)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
by: Zhuang, Shengyao, et al.
Published: (2025)
by: Zhuang, Shengyao, et al.
Published: (2025)
Navigating the Post-API Dilemma | Search Engine Results Pages Present a Biased View of Social Media Data
by: Poudel, Amrit, et al.
Published: (2024)
by: Poudel, Amrit, et al.
Published: (2024)
Diagnosing and Repairing Citation Failures in Generative Engine Optimization
by: Tian, Zhihua, et al.
Published: (2026)
by: Tian, Zhihua, et al.
Published: (2026)
Evaluating Generative Ad Hoc Information Retrieval
by: Gienapp, Lukas, et al.
Published: (2023)
by: Gienapp, Lukas, et al.
Published: (2023)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
by: Ma, Xueguang, et al.
Published: (2025)
by: Ma, Xueguang, et al.
Published: (2025)
Rerank Before You Reason: Analyzing Reranking Tradeoffs through Effective Token Cost in Deep Search Agents
by: Sharifymoghaddam, Sahel, et al.
Published: (2026)
by: Sharifymoghaddam, Sahel, et al.
Published: (2026)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
by: Sun, Weiwei, et al.
Published: (2023)
by: Sun, Weiwei, et al.
Published: (2023)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
by: Pradeep, Ronak, et al.
Published: (2025)
by: Pradeep, Ronak, et al.
Published: (2025)
Similar Items
-
"Knowing When You Don't Know": A Multilingual Relevance Assessment Dataset for Robust Retrieval-Augmented Generation
by: Thakur, Nandan, et al.
Published: (2023) -
Lighting the Way for BRIGHT: Reproducible Baselines with Anserini, Pyserini, and RankLLM
by: Sharifymoghaddam, Sahel, et al.
Published: (2025) -
Improving Multilingual Math Reasoning for African Languages
by: Ogundepo, Odunayo, et al.
Published: (2025) -
Detecting Generated Native Ads in Conversational Search
by: Schmidt, Sebastian, et al.
Published: (2024) -
CURE: A Dataset for Clinical Understanding & Retrieval Evaluation
by: Sheikh, Nadia Athar, et al.
Published: (2024)