BM25S: Orders of magnitude faster lexical search via eager sparse scoring
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Lù, Xing Han |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Computational lexical analysis of Flamenco genres
par: Rosillo-Rodes, Pablo, et autres
Publié: (2024)
par: Rosillo-Rodes, Pablo, et autres
Publié: (2024)
Latent Terms: Dense Retrievers Contain Trivially Extractable BM25-ready Zipfian Vocabularies
par: Clavié, Benjamin, et autres
Publié: (2026)
par: Clavié, Benjamin, et autres
Publié: (2026)
InsertRank: LLMs can reason over BM25 scores to Improve Listwise Reranking
par: Seetharaman, Rahul, et autres
Publié: (2025)
par: Seetharaman, Rahul, et autres
Publié: (2025)
Analysing Calls to Order in German Parliamentary Debates
par: Smirnova, Nina, et autres
Publié: (2026)
par: Smirnova, Nina, et autres
Publié: (2026)
PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
par: Li, Zhuoqun, et autres
Publié: (2025)
par: Li, Zhuoqun, et autres
Publié: (2025)
OASIS: Order-Augmented Strategy for Improved Code Search
par: Gao, Zuchen, et autres
Publié: (2025)
par: Gao, Zuchen, et autres
Publié: (2025)
Principled and Scalable Diversity-Aware Retrieval via Cardinality-Constrained Binary Quadratic Programming
par: Lu, Qiheng, et autres
Publié: (2026)
par: Lu, Qiheng, et autres
Publié: (2026)
Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach
par: Zeng, Shenglai, et autres
Publié: (2025)
par: Zeng, Shenglai, et autres
Publié: (2025)
From BM25 to Corrective RAG: Benchmarking Retrieval Strategies for Text-and-Table Documents
par: Akarsu, Meftun, et autres
Publié: (2026)
par: Akarsu, Meftun, et autres
Publié: (2026)
Query as Anchor: Scenario-Adaptive User Representation via Large Language Model
par: Yuan, Jiahao, et autres
Publié: (2026)
par: Yuan, Jiahao, et autres
Publié: (2026)
Exploring LLM biases to manipulate AI search overview
par: Smirnov, Roman
Publié: (2026)
par: Smirnov, Roman
Publié: (2026)
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
par: Li, Haitao, et autres
Publié: (2024)
par: Li, Haitao, et autres
Publié: (2024)
Drop your Decoder: Pre-training with Bag-of-Word Prediction for Dense Passage Retrieval
par: Ma, Guangyuan, et autres
Publié: (2024)
par: Ma, Guangyuan, et autres
Publié: (2024)
Survey of Query-based Text Summarization
par: Yu, Hang, et autres
Publié: (2022)
par: Yu, Hang, et autres
Publié: (2022)
BBK: a simpler, faster algorithm for enumerating maximal bicliques in large sparse bipartite graphs
par: Baudin, Alexis, et autres
Publié: (2024)
par: Baudin, Alexis, et autres
Publié: (2024)
GLTW: Joint Improved Graph Transformer and LLM via Three-Word Language for Knowledge Graph Completion
par: Luo, Kangyang, et autres
Publié: (2025)
par: Luo, Kangyang, et autres
Publié: (2025)
ILCiteR: Evidence-grounded Interpretable Local Citation Recommendation
par: Roy, Sayar Ghosh, et autres
Publié: (2024)
par: Roy, Sayar Ghosh, et autres
Publié: (2024)
Beyond Static Dialogues: Benchmarking Realistic, Heterogeneous, and Evolving Long-Term Memory
par: Zhang, Han, et autres
Publié: (2026)
par: Zhang, Han, et autres
Publié: (2026)
Adapting General-Purpose Embedding Models to Private Datasets Using Keyword-based Retrieval
par: Wei, Yubai, et autres
Publié: (2025)
par: Wei, Yubai, et autres
Publié: (2025)
Beyond True or False: Retrieval-Augmented Hierarchical Analysis of Nuanced Claims
par: Kargupta, Priyanka, et autres
Publié: (2025)
par: Kargupta, Priyanka, et autres
Publié: (2025)
ReaSeq: Unleashing World Knowledge via Reasoning for Sequential Modeling
par: Tang, Jiakai, et autres
Publié: (2025)
par: Tang, Jiakai, et autres
Publié: (2025)
Improve Dense Passage Retrieval with Entailment Tuning
par: Dai, Lu, et autres
Publié: (2024)
par: Dai, Lu, et autres
Publié: (2024)
Dissecting Judicial Reasoning in U.S. Copyright Damage Awards
par: Lo, Pei-Chi, et autres
Publié: (2026)
par: Lo, Pei-Chi, et autres
Publié: (2026)
LADER: Log-Augmented DEnse Retrieval for Biomedical Literature Search
par: Jin, Qiao, et autres
Publié: (2023)
par: Jin, Qiao, et autres
Publié: (2023)
Rethinking LLM-Based Recommendations: A Personalized Query-Driven Parallel Integration
par: Han, Donghee, et autres
Publié: (2025)
par: Han, Donghee, et autres
Publié: (2025)
Are LLMs Reliable Rankers? Rank Manipulation via Two-Stage Token Optimization
par: Xing, Tiancheng, et autres
Publié: (2025)
par: Xing, Tiancheng, et autres
Publié: (2025)
TabEmbed: Benchmarking and Learning Generalist Embeddings for Tabular Understanding
par: Qiang, Minjie, et autres
Publié: (2026)
par: Qiang, Minjie, et autres
Publié: (2026)
WebExpert: domain-aware web agents with critic-guided expert experience for high-precision search
par: Hu, Yuelin, et autres
Publié: (2026)
par: Hu, Yuelin, et autres
Publié: (2026)
Entity Disambiguation via Fusion Entity Decoding
par: Wang, Junxiong, et autres
Publié: (2024)
par: Wang, Junxiong, et autres
Publié: (2024)
Optimizing Retrieval for RAG via Reinforcement Learning
par: Zhou, Jiawei, et autres
Publié: (2025)
par: Zhou, Jiawei, et autres
Publié: (2025)
Harnessing PubMed User Query Logs for Post Hoc Explanations of Recommended Similar Articles
par: Shin, Ashley, et autres
Publié: (2024)
par: Shin, Ashley, et autres
Publié: (2024)
QuCo-RAG: Quantifying Uncertainty from the Pre-training Corpus for Dynamic Retrieval-Augmented Generation
par: Min, Dehai, et autres
Publié: (2025)
par: Min, Dehai, et autres
Publié: (2025)
OkraLong: A Flexible Retrieval-Augmented Framework for Long-Text Query Processing
par: Hui, Yulong, et autres
Publié: (2025)
par: Hui, Yulong, et autres
Publié: (2025)
DBCopilot: Natural Language Querying over Massive Databases via Schema Routing
par: Wang, Tianshu, et autres
Publié: (2023)
par: Wang, Tianshu, et autres
Publié: (2023)
Decomposed Opinion Summarization with Verified Aspect-Aware Modules
par: Li, Miao, et autres
Publié: (2025)
par: Li, Miao, et autres
Publié: (2025)
GLEN: Generative Retrieval via Lexical Index Learning
par: Lee, Sunkyung, et autres
Publié: (2023)
par: Lee, Sunkyung, et autres
Publié: (2023)
Revela: Dense Retriever Learning via Language Modeling
par: Cai, Fengyu, et autres
Publié: (2025)
par: Cai, Fengyu, et autres
Publié: (2025)
RecDCL: Dual Contrastive Learning for Recommendation
par: Zhang, Dan, et autres
Publié: (2024)
par: Zhang, Dan, et autres
Publié: (2024)
Enhancing Content-based Recommendation via Large Language Model
par: Xu, Wentao, et autres
Publié: (2024)
par: Xu, Wentao, et autres
Publié: (2024)
Unsupervised Multilingual Dense Retrieval via Generative Pseudo Labeling
par: Huang, Chao-Wei, et autres
Publié: (2024)
par: Huang, Chao-Wei, et autres
Publié: (2024)
Documents similaires
-
Computational lexical analysis of Flamenco genres
par: Rosillo-Rodes, Pablo, et autres
Publié: (2024) -
Latent Terms: Dense Retrievers Contain Trivially Extractable BM25-ready Zipfian Vocabularies
par: Clavié, Benjamin, et autres
Publié: (2026) -
InsertRank: LLMs can reason over BM25 scores to Improve Listwise Reranking
par: Seetharaman, Rahul, et autres
Publié: (2025) -
Analysing Calls to Order in German Parliamentary Debates
par: Smirnova, Nina, et autres
Publié: (2026) -
PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
par: Li, Zhuoqun, et autres
Publié: (2025)