GPU-Accelerated ANNS: Quantized for Speed, Built for Change
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | McCoy, Hunter, Wang, Zikun, Pandey, Prashant |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WarpSpeed: A High-Performance Library for Concurrent GPU Hash Tables
par: McCoy, Hunter, et autres
Publié: (2025)
par: McCoy, Hunter, et autres
Publié: (2025)
GPU-Accelerated Algorithms for Graph Vector Search: Taxonomy, Empirical Study, and Research Directions
par: Liu, Yaowen, et autres
Publié: (2026)
par: Liu, Yaowen, et autres
Publié: (2026)
Accelerating Graph Indexing for ANNS on Modern CPUs
par: Wang, Mengzhao, et autres
Publié: (2025)
par: Wang, Mengzhao, et autres
Publié: (2025)
Xling: A Learned Filter Framework for Accelerating High-Dimensional Approximate Similarity Join
par: Wang, Yifan, et autres
Publié: (2024)
par: Wang, Yifan, et autres
Publié: (2024)
EPIC: Generative AI Platform for Accelerating HPC Operational Data Analytics
par: Karimi, Ahmad Maroof, et autres
Publié: (2025)
par: Karimi, Ahmad Maroof, et autres
Publié: (2025)
CS-PQ: Cache-Friendly SIMD Product Quantization for Large-Scale ANNS Index Construction
par: Ma, Y. T., et autres
Publié: (2026)
par: Ma, Y. T., et autres
Publié: (2026)
Breaking the Storage-Compute Bottleneck in Billion-Scale ANNS: A GPU-Driven Asynchronous I/O Framework
par: Xiao, Yang, et autres
Publié: (2025)
par: Xiao, Yang, et autres
Publié: (2025)
GRAB-ANNS: High-Throughput Indexing and Hybrid Search via GPU-Native Bucketing
par: Zhao, Xinkui, et autres
Publié: (2026)
par: Zhao, Xinkui, et autres
Publié: (2026)
Not-So-Strange Love: Language Models and Generative Linguistic Theories are More Compatible than They Appear
par: McCoy, R. Thomas
Publié: (2026)
par: McCoy, R. Thomas
Publié: (2026)
Database Entity Recognition with Data Augmentation and Deep Learning
par: Fu, Zikun, et autres
Publié: (2025)
par: Fu, Zikun, et autres
Publié: (2025)
Accelerating Storage-Based Training for Graph Neural Networks
par: Jang, Myung-Hwan, et autres
Publié: (2026)
par: Jang, Myung-Hwan, et autres
Publié: (2026)
Leveraging I/O Stalls for Efficient Scheduling in ANNS
par: Zhang, Juncheng, et autres
Publié: (2026)
par: Zhang, Juncheng, et autres
Publié: (2026)
Graph Query Generation with Constraint-guided Large Language Agents
par: Wang, Mengying, et autres
Publié: (2026)
par: Wang, Mengying, et autres
Publié: (2026)
The Climate Change Knowledge Graph: Supporting Climate Services
par: Ceriani, Miguel, et autres
Publié: (2026)
par: Ceriani, Miguel, et autres
Publié: (2026)
Collocational bootstrapping: A hypothesis about the learning of subject-verb agreement in humans and neural networks
par: Hobbs, Claire, et autres
Publié: (2026)
par: Hobbs, Claire, et autres
Publié: (2026)
PrepBench: How Far Are We from Natural-Language-Driven Data Preparation?
par: Xu, Jingzhe, et autres
Publié: (2026)
par: Xu, Jingzhe, et autres
Publié: (2026)
AutoIndexer: A Reinforcement Learning-Enhanced Index Advisor Towards Scaling Workloads
par: Wang, Taiyi, et autres
Publié: (2025)
par: Wang, Taiyi, et autres
Publié: (2025)
IA2: Leveraging Instance-Aware Index Advisor with Reinforcement Learning for Diverse Workloads
par: Wang, Taiyi, et autres
Publié: (2024)
par: Wang, Taiyi, et autres
Publié: (2024)
Beyond Single-Modal Analytics: A Framework for Integrating Heterogeneous LLM-Based Query Systems for Multi-Modal Data
par: Li, Ruyu, et autres
Publié: (2026)
par: Li, Ruyu, et autres
Publié: (2026)
Library Networking: Current Problems and Future Prospects!
par: McCoy, Richard
Publié: (1983)
par: McCoy, Richard
Publié: (1983)
FusionANNS: An Efficient CPU/GPU Cooperative Processing Architecture for Billion-scale Approximate Nearest Neighbor Search
par: Tian, Bing, et autres
Publié: (2024)
par: Tian, Bing, et autres
Publié: (2024)
LLM-assisted Labeling Function Generation for Semantic Type Detection
par: Li, Chenjie, et autres
Publié: (2024)
par: Li, Chenjie, et autres
Publié: (2024)
SciIF: Benchmarking Scientific Instruction Following Towards Rigorous Scientific Intelligence
par: Su, Encheng, et autres
Publié: (2026)
par: Su, Encheng, et autres
Publié: (2026)
QUITE: A Query Rewrite System Beyond Rules with LLM Agents
par: Song, Yuyang, et autres
Publié: (2025)
par: Song, Yuyang, et autres
Publié: (2025)
Toward Real-World Table Agents: Capabilities, Workflows, and Design Principles for LLM-based Table Intelligence
par: Tian, Jiaming, et autres
Publié: (2025)
par: Tian, Jiaming, et autres
Publié: (2025)
Aixel: A Unified, Adaptive and Extensible System for AI-powered Data Analysis
par: Zhang, Meihui, et autres
Publié: (2025)
par: Zhang, Meihui, et autres
Publié: (2025)
A Comprehensive Survey on Vector Database: Storage and Retrieval Technique, Challenge
par: Ma, Le, et autres
Publié: (2023)
par: Ma, Le, et autres
Publié: (2023)
CardOOD: Robust Query-driven Cardinality Estimation under Out-of-Distribution
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
LLM+Graph@VLDB'2025 Workshop Summary
par: Fang, Yixiang, et autres
Publié: (2026)
par: Fang, Yixiang, et autres
Publié: (2026)
From Lossy to Verified: A Provenance-Aware Tiered Memory for Agents
par: Zhu, Qiming, et autres
Publié: (2026)
par: Zhu, Qiming, et autres
Publié: (2026)
Generating Skyline Datasets for Data Science Models
par: Wang, Mengying, et autres
Publié: (2025)
par: Wang, Mengying, et autres
Publié: (2025)
BQSched: A Non-intrusive Scheduler for Batch Concurrent Queries via Reinforcement Learning
par: Xu, Chenhao, et autres
Publié: (2025)
par: Xu, Chenhao, et autres
Publié: (2025)
Urban Traffic Accident Risk Prediction Revisited: Regionality, Proximity, Similarity and Sparsity
par: Chen, Minxiao, et autres
Publié: (2024)
par: Chen, Minxiao, et autres
Publié: (2024)
Serving Deep Learning Model in Relational Databases
par: Zhou, Lixi, et autres
Publié: (2023)
par: Zhou, Lixi, et autres
Publié: (2023)
LEDD: Large Language Model-Empowered Data Discovery in Data Lakes
par: An, Qi, et autres
Publié: (2025)
par: An, Qi, et autres
Publié: (2025)
LLM/Agent-as-Data-Analyst: A Survey
par: Tang, Zirui, et autres
Publié: (2025)
par: Tang, Zirui, et autres
Publié: (2025)
OVT-MLCS: An Online Visual Tool for MLCS Mining from Long or Big Sequences
par: Wang, Zhi, et autres
Publié: (2026)
par: Wang, Zhi, et autres
Publié: (2026)
Efficient Dynamic Attributed Graph Generation
par: Li, Fan, et autres
Publié: (2024)
par: Li, Fan, et autres
Publié: (2024)
MINT: Multi-Vector Search Index Tuning
par: Zhu, Jiongli, et autres
Publié: (2025)
par: Zhu, Jiongli, et autres
Publié: (2025)
VISTA: Knowledge-Driven Vessel Trajectory Imputation with Repair Provenance
par: Liu, Hengyu, et autres
Publié: (2026)
par: Liu, Hengyu, et autres
Publié: (2026)
Documents similaires
-
WarpSpeed: A High-Performance Library for Concurrent GPU Hash Tables
par: McCoy, Hunter, et autres
Publié: (2025) -
GPU-Accelerated Algorithms for Graph Vector Search: Taxonomy, Empirical Study, and Research Directions
par: Liu, Yaowen, et autres
Publié: (2026) -
Accelerating Graph Indexing for ANNS on Modern CPUs
par: Wang, Mengzhao, et autres
Publié: (2025) -
Xling: A Learned Filter Framework for Accelerating High-Dimensional Approximate Similarity Join
par: Wang, Yifan, et autres
Publié: (2024) -
EPIC: Generative AI Platform for Accelerating HPC Operational Data Analytics
par: Karimi, Ahmad Maroof, et autres
Publié: (2025)