GleanVec: Accelerating vector search with minimalist nonlinear dimensionality reduction
Fuente:
arXiv
Salvato in:
| Autori principali: | Tepper, Mariano, Bhati, Ishwar Singh, Aguerrebere, Cecilia, Willke, Ted |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Locally-Adaptive Quantization for Streaming Vector Search
di: Aguerrebere, Cecilia, et al.
Pubblicazione: (2024)
di: Aguerrebere, Cecilia, et al.
Pubblicazione: (2024)
Individualized non-uniform quantization for vector search
di: Tepper, Mariano, et al.
Pubblicazione: (2025)
di: Tepper, Mariano, et al.
Pubblicazione: (2025)
LeanVec: Searching vectors faster by making them fit
di: Tepper, Mariano, et al.
Pubblicazione: (2023)
di: Tepper, Mariano, et al.
Pubblicazione: (2023)
The kernel of graph indices for vector search
di: Tepper, Mariano, et al.
Pubblicazione: (2025)
di: Tepper, Mariano, et al.
Pubblicazione: (2025)
Toward Optimal Search and Retrieval for RAG
di: Leto, Alexandria, et al.
Pubblicazione: (2024)
di: Leto, Alexandria, et al.
Pubblicazione: (2024)
Interact2Vec -- An efficient neural network-based model for simultaneously learning users and items embeddings in recommender systems
di: Pires, Pedro R., et al.
Pubblicazione: (2025)
di: Pires, Pedro R., et al.
Pubblicazione: (2025)
Multimodal semantic retrieval for product search
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
AI Guided Accelerator For Search Experience
di: Yetukuri, Jayanth, et al.
Pubblicazione: (2025)
di: Yetukuri, Jayanth, et al.
Pubblicazione: (2025)
Accelerating Matrix Factorization by Dynamic Pruning for Fast Recommendation
di: Wu, Yining, et al.
Pubblicazione: (2024)
di: Wu, Yining, et al.
Pubblicazione: (2024)
Accelerating Recommender Model Training by Dynamically Skipping Stale Embeddings
di: Maboud, Yassaman Ebrahimzadeh, et al.
Pubblicazione: (2024)
di: Maboud, Yassaman Ebrahimzadeh, et al.
Pubblicazione: (2024)
Building a privacy-preserving Federated Recommender system for mobile devices
di: Singh, Aasheesh
Pubblicazione: (2026)
di: Singh, Aasheesh
Pubblicazione: (2026)
MST-R: Multi-Stage Tuning for Retrieval Systems and Metric Evaluation
di: Malviya, Yash, et al.
Pubblicazione: (2024)
di: Malviya, Yash, et al.
Pubblicazione: (2024)
Guarding Digital Privacy: Exploring User Profiling and Security Enhancements
di: Kohli, Rishika, et al.
Pubblicazione: (2025)
di: Kohli, Rishika, et al.
Pubblicazione: (2025)
Learning Metrics that Maximise Power for Accelerated A/B-Tests
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
di: Jeunen, Olivier, et al.
Pubblicazione: (2024)
Retrieval Mechanisms Surpass Long-Context Scaling in Time Series Forecasting
di: Ahuja, Rishi, et al.
Pubblicazione: (2026)
di: Ahuja, Rishi, et al.
Pubblicazione: (2026)
AMES: Approximate Multi-modal Enterprise Search via Late Interaction Retrieval
di: Joseph, Tony, et al.
Pubblicazione: (2026)
di: Joseph, Tony, et al.
Pubblicazione: (2026)
Segment Discovery: Enhancing E-commerce Targeting
di: Li, Qiqi, et al.
Pubblicazione: (2024)
di: Li, Qiqi, et al.
Pubblicazione: (2024)
MS2MetGAN: Latent-space adversarial training for metabolite-spectrum matching in MS/MS database search
di: Tsai, Meng, et al.
Pubblicazione: (2026)
di: Tsai, Meng, et al.
Pubblicazione: (2026)
Accelerating Retrieval-Augmented Language Model Serving with Speculation
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
Better Generalization with Semantic IDs: A Case Study in Ranking for Recommendations
di: Singh, Anima, et al.
Pubblicazione: (2023)
di: Singh, Anima, et al.
Pubblicazione: (2023)
DV365: Extremely Long User History Modeling at Instagram
di: Lyu, Wenhan, et al.
Pubblicazione: (2025)
di: Lyu, Wenhan, et al.
Pubblicazione: (2025)
Embedding-based search in JetBrains IDEs
di: Abramov, Evgeny, et al.
Pubblicazione: (2024)
di: Abramov, Evgeny, et al.
Pubblicazione: (2024)
Graph Regularized Encoder Training for Extreme Classification
di: Mittal, Anshul, et al.
Pubblicazione: (2024)
di: Mittal, Anshul, et al.
Pubblicazione: (2024)
Deep Learning Model Acceleration and Optimization Strategies for Real-Time Recommendation Systems
di: Shao, Junli, et al.
Pubblicazione: (2025)
di: Shao, Junli, et al.
Pubblicazione: (2025)
Vectorizing the Trie: Efficient Constrained Decoding for LLM-based Generative Retrieval on Accelerators
di: Su, Zhengyang, et al.
Pubblicazione: (2026)
di: Su, Zhengyang, et al.
Pubblicazione: (2026)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
di: Zhao, Yao, et al.
Pubblicazione: (2023)
di: Zhao, Yao, et al.
Pubblicazione: (2023)
Sequential Recommendation via Adaptive Robust Attention with Multi-dimensional Embeddings
di: Pang, Linsey, et al.
Pubblicazione: (2024)
di: Pang, Linsey, et al.
Pubblicazione: (2024)
Intelligent Elastic Feature Fading: Enabling Model Retrain-Free Feature Efficiency Rollouts at Scale
di: Di, Jieming, et al.
Pubblicazione: (2026)
di: Di, Jieming, et al.
Pubblicazione: (2026)
A case study of Generative AI in MSX Sales Copilot: Improving seller productivity with a real-time question-answering system for content recommendation
di: Singh, Manpreet, et al.
Pubblicazione: (2024)
di: Singh, Manpreet, et al.
Pubblicazione: (2024)
Query Attribute Modeling: Improving search relevance with Semantic Search and Meta Data Filtering
di: Menon, Karthik, et al.
Pubblicazione: (2025)
di: Menon, Karthik, et al.
Pubblicazione: (2025)
Fine-grained large-scale content recommendations for MSX sellers
di: Singh, Manpreet, et al.
Pubblicazione: (2024)
di: Singh, Manpreet, et al.
Pubblicazione: (2024)
How Many Tools Should an LLM Agent See? A Chance-Corrected Answer
di: Repantis, Vyzantinos, et al.
Pubblicazione: (2026)
di: Repantis, Vyzantinos, et al.
Pubblicazione: (2026)
Improving Few-Shot Cross-Domain Named Entity Recognition by Instruction Tuning a Word-Embedding based Retrieval Augmented Large Language Model
di: Nandi, Subhadip, et al.
Pubblicazione: (2024)
di: Nandi, Subhadip, et al.
Pubblicazione: (2024)
Autoregressive Generation Strategies for Top-K Sequential Recommendations
di: Volodkevich, Anna, et al.
Pubblicazione: (2024)
di: Volodkevich, Anna, et al.
Pubblicazione: (2024)
Revisiting Bi-Encoder Neural Search: An Encoding--Searching Separation Perspective
di: Tran, Hung-Nghiep, et al.
Pubblicazione: (2024)
di: Tran, Hung-Nghiep, et al.
Pubblicazione: (2024)
RDSA: A Robust Deep Graph Clustering Framework via Dual Soft Assignment
di: Xiang, Yang, et al.
Pubblicazione: (2024)
di: Xiang, Yang, et al.
Pubblicazione: (2024)
Against Filter Bubbles: Diversified Music Recommendation via Weighted Hypergraph Embedding Learning
di: Luo, Chaoguang, et al.
Pubblicazione: (2024)
di: Luo, Chaoguang, et al.
Pubblicazione: (2024)
Let's Get It Started: Fostering the Discoverability of New Releases on Deezer
di: Briand, Léa, et al.
Pubblicazione: (2024)
di: Briand, Léa, et al.
Pubblicazione: (2024)
Model-Free Approximate Bayesian Learning for Large-Scale Conversion Funnel Optimization
di: Iyengar, Garud, et al.
Pubblicazione: (2024)
di: Iyengar, Garud, et al.
Pubblicazione: (2024)
Domain Adaptation of Multilingual Semantic Search -- Literature Review
di: Bringmann, Anna, et al.
Pubblicazione: (2024)
di: Bringmann, Anna, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Locally-Adaptive Quantization for Streaming Vector Search
di: Aguerrebere, Cecilia, et al.
Pubblicazione: (2024) -
Individualized non-uniform quantization for vector search
di: Tepper, Mariano, et al.
Pubblicazione: (2025) -
LeanVec: Searching vectors faster by making them fit
di: Tepper, Mariano, et al.
Pubblicazione: (2023) -
The kernel of graph indices for vector search
di: Tepper, Mariano, et al.
Pubblicazione: (2025) -
Toward Optimal Search and Retrieval for RAG
di: Leto, Alexandria, et al.
Pubblicazione: (2024)