Locally-Adaptive Quantization for Streaming Vector Search
Fuente:
arXiv
Guardado en:
| Autores principales: | Aguerrebere, Cecilia, Hildebrand, Mark, Bhati, Ishwar Singh, Willke, Theodore, Tepper, Mariano |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GleanVec: Accelerating vector search with minimalist nonlinear dimensionality reduction
por: Tepper, Mariano, et al.
Publicado: (2024)
por: Tepper, Mariano, et al.
Publicado: (2024)
LeanVec: Searching vectors faster by making them fit
por: Tepper, Mariano, et al.
Publicado: (2023)
por: Tepper, Mariano, et al.
Publicado: (2023)
Individualized non-uniform quantization for vector search
por: Tepper, Mariano, et al.
Publicado: (2025)
por: Tepper, Mariano, et al.
Publicado: (2025)
Toward Optimal Search and Retrieval for RAG
por: Leto, Alexandria, et al.
Publicado: (2024)
por: Leto, Alexandria, et al.
Publicado: (2024)
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
por: Zhang, Tianqi, et al.
Publicado: (2026)
por: Zhang, Tianqi, et al.
Publicado: (2026)
IVF-TQ: Calibration-Free Streaming Vector Search via a Codebook-Free Residual Layer
por: Sharma, Tarun
Publicado: (2026)
por: Sharma, Tarun
Publicado: (2026)
LLM-assisted Vector Similarity Search
por: Riyadh, Md, et al.
Publicado: (2024)
por: Riyadh, Md, et al.
Publicado: (2024)
Lossless Compression of Vector IDs for Approximate Nearest Neighbor Search
por: Severo, Daniel, et al.
Publicado: (2025)
por: Severo, Daniel, et al.
Publicado: (2025)
Efficient Vector Search in the Wild: One Model for Multi-K Queries
por: Peng, Yifan, et al.
Publicado: (2026)
por: Peng, Yifan, et al.
Publicado: (2026)
Adaptive Retrieval and Scalable Indexing for k-NN Search with Cross-Encoders
por: Yadav, Nishant, et al.
Publicado: (2024)
por: Yadav, Nishant, et al.
Publicado: (2024)
Countering Mainstream Bias via End-to-End Adaptive Local Learning
por: Pan, Jinhao, et al.
Publicado: (2024)
por: Pan, Jinhao, et al.
Publicado: (2024)
AMES: Approximate Multi-modal Enterprise Search via Late Interaction Retrieval
por: Joseph, Tony, et al.
Publicado: (2026)
por: Joseph, Tony, et al.
Publicado: (2026)
VIBE: Vector Index Benchmark for Embeddings
por: Jääsaari, Elias, et al.
Publicado: (2025)
por: Jääsaari, Elias, et al.
Publicado: (2025)
LEMUR: Learned Multi-Vector Retrieval
por: Jääsaari, Elias, et al.
Publicado: (2026)
por: Jääsaari, Elias, et al.
Publicado: (2026)
Content-based Recommendation Engine for Video Streaming Platform
por: Khadka, Puskal, et al.
Publicado: (2023)
por: Khadka, Puskal, et al.
Publicado: (2023)
Sequential Regression for Continuous Value Prediction using Residual Quantization
por: Cui, Runpeng, et al.
Publicado: (2026)
por: Cui, Runpeng, et al.
Publicado: (2026)
The kernel of graph indices for vector search
por: Tepper, Mariano, et al.
Publicado: (2025)
por: Tepper, Mariano, et al.
Publicado: (2025)
Optimization of Latent-Space Compression using Game-Theoretic Techniques for Transformer-Based Vector Search
por: Agrawal, Kushagra, et al.
Publicado: (2025)
por: Agrawal, Kushagra, et al.
Publicado: (2025)
Vectorized Context-Aware Embeddings for GAT-Based Collaborative Filtering
por: Ebrat, Danial, et al.
Publicado: (2025)
por: Ebrat, Danial, et al.
Publicado: (2025)
Revisiting Bi-Encoder Neural Search: An Encoding--Searching Separation Perspective
por: Tran, Hung-Nghiep, et al.
Publicado: (2024)
por: Tran, Hung-Nghiep, et al.
Publicado: (2024)
VectorSearch: Enhancing Document Retrieval with Semantic Embeddings and Optimized Search
por: Monir, Solmaz Seyed, et al.
Publicado: (2024)
por: Monir, Solmaz Seyed, et al.
Publicado: (2024)
Infinity Search: Approximate Vector Search with Projections on q-Metric Spaces
por: Pariente, Antonio, et al.
Publicado: (2025)
por: Pariente, Antonio, et al.
Publicado: (2025)
Temporal Streaming Batch Principal Component Analysis for Time Series Classification
por: Yan, Enshuo, et al.
Publicado: (2024)
por: Yan, Enshuo, et al.
Publicado: (2024)
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
por: Tian, Zhen, et al.
Publicado: (2024)
por: Tian, Zhen, et al.
Publicado: (2024)
Efficient Sketching and Nearest Neighbor Search Algorithms for Sparse Vector Sets
por: Bruch, Sebastian, et al.
Publicado: (2025)
por: Bruch, Sebastian, et al.
Publicado: (2025)
Reinforcement-Learned Unequal Error Protection for Quantized Semantic Embeddings
por: Singh, Moirangthem Tiken, et al.
Publicado: (2026)
por: Singh, Moirangthem Tiken, et al.
Publicado: (2026)
Geodesic Semantic Search: Cartographic Navigation of Citation Graphs with Learned Local Riemannian Maps
por: Yee, Brandon, et al.
Publicado: (2026)
por: Yee, Brandon, et al.
Publicado: (2026)
Recommendation System in Advertising and Streaming Media: Unsupervised Data Enhancement Sequence Suggestions
por: Shih, Kowei, et al.
Publicado: (2025)
por: Shih, Kowei, et al.
Publicado: (2025)
Theoretical and Empirical Analysis of Adaptive Entry Point Selection for Graph-based Approximate Nearest Neighbor Search
por: Oguri, Yutaro, et al.
Publicado: (2024)
por: Oguri, Yutaro, et al.
Publicado: (2024)
MMQ: Multimodal Mixture-of-Quantization Tokenization for Semantic ID Generation and User Behavioral Adaptation
por: Xu, Yi, et al.
Publicado: (2025)
por: Xu, Yi, et al.
Publicado: (2025)
Compressing Search with Language Models
por: Mulc, Thomas, et al.
Publicado: (2024)
por: Mulc, Thomas, et al.
Publicado: (2024)
LLM-VPRF: Large Language Model Based Vector Pseudo Relevance Feedback
por: Li, Hang, et al.
Publicado: (2025)
por: Li, Hang, et al.
Publicado: (2025)
A Unified Language Model for Large Scale Search, Recommendation, and Reasoning
por: De Nadai, Marco, et al.
Publicado: (2026)
por: De Nadai, Marco, et al.
Publicado: (2026)
AI Guided Accelerator For Search Experience
por: Yetukuri, Jayanth, et al.
Publicado: (2025)
por: Yetukuri, Jayanth, et al.
Publicado: (2025)
Dynamic User Interest Augmentation via Stream Clustering and Memory Networks in Large-Scale Recommender Systems
por: Liu, Peng, et al.
Publicado: (2024)
por: Liu, Peng, et al.
Publicado: (2024)
Hierarchical Query Classification in E-commerce Search
por: He, Bing, et al.
Publicado: (2024)
por: He, Bing, et al.
Publicado: (2024)
Applying Embedding-Based Retrieval to Airbnb Search
por: Abdool, Mustafa, et al.
Publicado: (2026)
por: Abdool, Mustafa, et al.
Publicado: (2026)
Semantic Retrieval for Product Search in E-Commerce
por: Kothari, Nikhil, et al.
Publicado: (2026)
por: Kothari, Nikhil, et al.
Publicado: (2026)
Matlas: A Semantic Search Engine for Mathematics
por: Ju, Haocheng, et al.
Publicado: (2026)
por: Ju, Haocheng, et al.
Publicado: (2026)
Drift-Adapter: A Practical Approach to Near Zero-Downtime Embedding Model Upgrades in Vector Databases
por: Vejendla, Harshil
Publicado: (2025)
por: Vejendla, Harshil
Publicado: (2025)
Ejemplares similares
-
GleanVec: Accelerating vector search with minimalist nonlinear dimensionality reduction
por: Tepper, Mariano, et al.
Publicado: (2024) -
LeanVec: Searching vectors faster by making them fit
por: Tepper, Mariano, et al.
Publicado: (2023) -
Individualized non-uniform quantization for vector search
por: Tepper, Mariano, et al.
Publicado: (2025) -
Toward Optimal Search and Retrieval for RAG
por: Leto, Alexandria, et al.
Publicado: (2024) -
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
por: Zhang, Tianqi, et al.
Publicado: (2026)