SVFusion: A CPU-GPU Co-Processing Architecture for Large-Scale Real-Time Vector Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Peng, Yuchen, Yang, Dingyu, Xie, Zhongle, Sun, Ji, Shou, Lidan, Chen, Ke, Chen, Gang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Comprehensive Study of Shapley Value in Data Analytics
di: Lin, Hong, et al.
Pubblicazione: (2024)
di: Lin, Hong, et al.
Pubblicazione: (2024)
SafeLoad: Efficient Admission Control Framework for Identifying Memory-Overloading Queries in Cloud Data Warehouses
di: Wu, Yifan, et al.
Pubblicazione: (2026)
di: Wu, Yifan, et al.
Pubblicazione: (2026)
CHASe: Client Heterogeneity-Aware Data Selection for Effective Federated Active Learning
di: Zhang, Jun, et al.
Pubblicazione: (2025)
di: Zhang, Jun, et al.
Pubblicazione: (2025)
HAKES: Scalable Vector Database for Embedding Search Service
di: Hu, Guoyu, et al.
Pubblicazione: (2025)
di: Hu, Guoyu, et al.
Pubblicazione: (2025)
DeXOR: Enabling XOR in Decimal Space for Streaming Lossless Compression of Floating-point Data
di: Lv, Chuanyi, et al.
Pubblicazione: (2026)
di: Lv, Chuanyi, et al.
Pubblicazione: (2026)
TableCopilot: A Table Assistant Empowered by Natural Language Conditional Table Discovery
di: Cui, Lingxi, et al.
Pubblicazione: (2025)
di: Cui, Lingxi, et al.
Pubblicazione: (2025)
Tabular Data Augmentation for Machine Learning: Progress and Prospects of Embracing Generative AI
di: Cui, Lingxi, et al.
Pubblicazione: (2024)
di: Cui, Lingxi, et al.
Pubblicazione: (2024)
FusionANNS: An Efficient CPU/GPU Cooperative Processing Architecture for Billion-scale Approximate Nearest Neighbor Search
di: Tian, Bing, et al.
Pubblicazione: (2024)
di: Tian, Bing, et al.
Pubblicazione: (2024)
To GPU or Not to GPU: Vector Search in Relational Engines
di: Mageirakos, Vasilis, et al.
Pubblicazione: (2026)
di: Mageirakos, Vasilis, et al.
Pubblicazione: (2026)
Approximate Nearest Neighbor Search of Large Scale Vectors on Distributed Storage
di: Yu, Kun, et al.
Pubblicazione: (2025)
di: Yu, Kun, et al.
Pubblicazione: (2025)
MorphingDB: A Task-Centric AI-Native DBMS for Model Management and Inference
di: Sai, Wu, et al.
Pubblicazione: (2025)
di: Sai, Wu, et al.
Pubblicazione: (2025)
KcMF: A Knowledge-compliant Framework for Schema and Entity Matching with Fine-tuning-free LLMs
di: Xu, Yongqin, et al.
Pubblicazione: (2024)
di: Xu, Yongqin, et al.
Pubblicazione: (2024)
GPU-Accelerated Algorithms for Graph Vector Search: Taxonomy, Empirical Study, and Research Directions
di: Liu, Yaowen, et al.
Pubblicazione: (2026)
di: Liu, Yaowen, et al.
Pubblicazione: (2026)
GTS: GPU-based Tree Index for Fast Similarity Search
di: Zhu, Yifan, et al.
Pubblicazione: (2024)
di: Zhu, Yifan, et al.
Pubblicazione: (2024)
Preventing the Popular Item Embedding Based Attack in Federated Recommendations
di: Zhang, Jun, et al.
Pubblicazione: (2025)
di: Zhang, Jun, et al.
Pubblicazione: (2025)
Approximate Vector Set Search Inspired by Fly Olfactory Neural System
di: Li, Yiqi, et al.
Pubblicazione: (2024)
di: Li, Yiqi, et al.
Pubblicazione: (2024)
LSM-VEC: A Large-Scale Disk-Based System for Dynamic Vector Search
di: Zhong, Shurui, et al.
Pubblicazione: (2025)
di: Zhong, Shurui, et al.
Pubblicazione: (2025)
Cloud-Native Vector Search: A Comprehensive Performance Analysis
di: Li, Zhaoheng, et al.
Pubblicazione: (2025)
di: Li, Zhaoheng, et al.
Pubblicazione: (2025)
Characterizing the Dilemma of Performance and Index Size in Billion-Scale Vector Search and Breaking It with Second-Tier Memory
di: Cheng, Rongxin, et al.
Pubblicazione: (2024)
di: Cheng, Rongxin, et al.
Pubblicazione: (2024)
VectorMaton: Efficient Vector Search with Pattern Constraints via an Enhanced Suffix Automaton
di: Xie, Haoxuan, et al.
Pubblicazione: (2026)
di: Xie, Haoxuan, et al.
Pubblicazione: (2026)
Updatable Balanced Index for Stable Streaming Similarity Search over Large-Scale Fresh Vectors
di: Lai, Yuhui, et al.
Pubblicazione: (2026)
di: Lai, Yuhui, et al.
Pubblicazione: (2026)
TokenTiming: A Dynamic Alignment Method for Universal Speculative Decoding Model Pairs
di: Xiao, Sibo, et al.
Pubblicazione: (2025)
di: Xiao, Sibo, et al.
Pubblicazione: (2025)
Updatable Balanced Index for Fast On-device Search with Auto-selection Model
di: Ji, Yushuai, et al.
Pubblicazione: (2025)
di: Ji, Yushuai, et al.
Pubblicazione: (2025)
Efficient Vector Search on Disaggregated Memory with d-HNSW
di: Liu, Yi, et al.
Pubblicazione: (2025)
di: Liu, Yi, et al.
Pubblicazione: (2025)
Unified and Efficient Approach for Multi-Vector Similarity Search
di: Yang, Binhan, et al.
Pubblicazione: (2026)
di: Yang, Binhan, et al.
Pubblicazione: (2026)
Write-Read Decoupling in Modern Large-Scale Search Engines: Architectures, Techniques, and Emerging Approaches
di: Liang, Xin, et al.
Pubblicazione: (2026)
di: Liang, Xin, et al.
Pubblicazione: (2026)
SIVF: GPU-Resident IVF Index for Streaming Vector Search
di: Zhao, Dongfang
Pubblicazione: (2026)
di: Zhao, Dongfang
Pubblicazione: (2026)
FloE: On-the-Fly MoE Inference on Memory-constrained GPU
di: Zhou, Yuxin, et al.
Pubblicazione: (2025)
di: Zhou, Yuxin, et al.
Pubblicazione: (2025)
TigerVector: Supporting Vector Search in Graph Databases for Advanced RAGs
di: Liu, Shige, et al.
Pubblicazione: (2025)
di: Liu, Shige, et al.
Pubblicazione: (2025)
Trinity: Disaggregating Vector Search from Prefill-Decode Disaggregation in LLM Serving
di: Liu, Yi, et al.
Pubblicazione: (2025)
di: Liu, Yi, et al.
Pubblicazione: (2025)
The Virtuous Cycle: AI-Powered Vector Search and Vector Search-Augmented AI
di: Wei, Jiuqi, et al.
Pubblicazione: (2026)
di: Wei, Jiuqi, et al.
Pubblicazione: (2026)
Vector Search for the Future: From Memory-Resident, Static Heterogeneous Storage, to Cloud-Native Architectures
di: Song, Yitong, et al.
Pubblicazione: (2026)
di: Song, Yitong, et al.
Pubblicazione: (2026)
AlayaLaser: Efficient Index Layout and Search Strategy for Large-scale High-dimensional Vector Similarity Search
di: Chen, Weijian, et al.
Pubblicazione: (2026)
di: Chen, Weijian, et al.
Pubblicazione: (2026)
d-HNSW: A High-performance Vector Search Engine on Disaggregated Memory
di: Fang, Fei, et al.
Pubblicazione: (2026)
di: Fang, Fei, et al.
Pubblicazione: (2026)
Frequency-Aware Graph Construction and Search for Dynamic Vector Databases
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
Cracking Vector Search Indexes
di: Mageirakos, Vasilis, et al.
Pubblicazione: (2025)
di: Mageirakos, Vasilis, et al.
Pubblicazione: (2025)
Rethinking Analytical Processing in the GPU Era
di: Yogatama, Bobbi, et al.
Pubblicazione: (2025)
di: Yogatama, Bobbi, et al.
Pubblicazione: (2025)
From Schema to Signal: Retrieval-Augmented Modeling for Relational Data Analytics
di: Zeng, Lingze, et al.
Pubblicazione: (2026)
di: Zeng, Lingze, et al.
Pubblicazione: (2026)
OrchANN: A Unified I/O Orchestration Framework for Skewed Out-of-Core Vector Search
di: Huan, Chengying, et al.
Pubblicazione: (2025)
di: Huan, Chengying, et al.
Pubblicazione: (2025)
Starling: An I/O-Efficient Disk-Resident Graph Index Framework for High-Dimensional Vector Similarity Search on Data Segment
di: Wang, Mengzhao, et al.
Pubblicazione: (2024)
di: Wang, Mengzhao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Comprehensive Study of Shapley Value in Data Analytics
di: Lin, Hong, et al.
Pubblicazione: (2024) -
SafeLoad: Efficient Admission Control Framework for Identifying Memory-Overloading Queries in Cloud Data Warehouses
di: Wu, Yifan, et al.
Pubblicazione: (2026) -
CHASe: Client Heterogeneity-Aware Data Selection for Effective Federated Active Learning
di: Zhang, Jun, et al.
Pubblicazione: (2025) -
HAKES: Scalable Vector Database for Embedding Search Service
di: Hu, Guoyu, et al.
Pubblicazione: (2025) -
DeXOR: Enabling XOR in Decimal Space for Streaming Lossless Compression of Floating-point Data
di: Lv, Chuanyi, et al.
Pubblicazione: (2026)