CCD-Level and Load-Aware Thread Orchestration for In-Memory Vector ANNS on Multi-Core CPUs
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yuchen, Ma, Baiteng, Sun, Yiping, Shi, Yang, Chen, Xiao, Zhong, Xiaocheng, Wang, Zhiyong, Hu, Yao, Weng, Chuliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scalable Overload-Aware Graph-Based Index Construction for 10-Billion-Scale Vector Similarity Search
di: Shi, Yang, et al.
Pubblicazione: (2025)
di: Shi, Yang, et al.
Pubblicazione: (2025)
FAVOR: Efficient Filter-Agnostic Vector ANNS Based on Selectivity-Aware Exclusion Distances
di: Song, Junjie, et al.
Pubblicazione: (2026)
di: Song, Junjie, et al.
Pubblicazione: (2026)
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
di: Zhang, Tianqi, et al.
Pubblicazione: (2026)
di: Zhang, Tianqi, et al.
Pubblicazione: (2026)
WebANNS: Fast and Efficient Approximate Nearest Neighbor Search in Web Browsers
di: Liu, Mugeng, et al.
Pubblicazione: (2025)
di: Liu, Mugeng, et al.
Pubblicazione: (2025)
OrchANN: A Unified I/O Orchestration Framework for Skewed Out-of-Core Vector Search
di: Huan, Chengying, et al.
Pubblicazione: (2025)
di: Huan, Chengying, et al.
Pubblicazione: (2025)
LASER: An Efficient Target-Aware Segmented Attention Framework for End-to-End Long Sequence Modeling
di: Lin, Tianhe, et al.
Pubblicazione: (2026)
di: Lin, Tianhe, et al.
Pubblicazione: (2026)
ASTRA: Accurate and Scalable ANNS-based Training of Extreme Classifiers
di: Mehta, Sonu, et al.
Pubblicazione: (2024)
di: Mehta, Sonu, et al.
Pubblicazione: (2024)
GRAB-ANNS: High-Throughput Indexing and Hybrid Search via GPU-Native Bucketing
di: Zhao, Xinkui, et al.
Pubblicazione: (2026)
di: Zhao, Xinkui, et al.
Pubblicazione: (2026)
FusionANNS: An Efficient CPU/GPU Cooperative Processing Architecture for Billion-scale Approximate Nearest Neighbor Search
di: Tian, Bing, et al.
Pubblicazione: (2024)
di: Tian, Bing, et al.
Pubblicazione: (2024)
Accelerating Graph Indexing for ANNS on Modern CPUs
di: Wang, Mengzhao, et al.
Pubblicazione: (2025)
di: Wang, Mengzhao, et al.
Pubblicazione: (2025)
AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents
di: Zhu, Wenhui, et al.
Pubblicazione: (2026)
di: Zhu, Wenhui, et al.
Pubblicazione: (2026)
AiSAQ: All-in-Storage ANNS with Product Quantization for DRAM-free Information Retrieval
di: Tatsuno, Kento, et al.
Pubblicazione: (2024)
di: Tatsuno, Kento, et al.
Pubblicazione: (2024)
A Real-Time Adaptive Multi-Stream GPU System for Online Approximate Nearest Neighborhood Search
di: Sun, Yiping, et al.
Pubblicazione: (2024)
di: Sun, Yiping, et al.
Pubblicazione: (2024)
Structured Linked Data as a Memory Layer for Agent-Orchestrated Retrieval
di: Volpini, Andrea, et al.
Pubblicazione: (2026)
di: Volpini, Andrea, et al.
Pubblicazione: (2026)
Vector Quantization for Recommender Systems: A Review and Outlook
di: Liu, Qijiong, et al.
Pubblicazione: (2024)
di: Liu, Qijiong, et al.
Pubblicazione: (2024)
SpatCode: Rotary-based Unified Encoding Framework for Efficient Spatiotemporal Vector Retrieval
di: Hu, Bingde, et al.
Pubblicazione: (2026)
di: Hu, Bingde, et al.
Pubblicazione: (2026)
KBest: Efficient Vector Search on Kunpeng CPU
di: Ma, Kaihao, et al.
Pubblicazione: (2025)
di: Ma, Kaihao, et al.
Pubblicazione: (2025)
TransTARec: Time-Adaptive Translating Embedding Model for Next POI Recommendation
di: Sun, Yiping
Pubblicazione: (2024)
di: Sun, Yiping
Pubblicazione: (2024)
A Global-Local Attention Mechanism for Relation Classification
di: Sun, Yiping
Pubblicazione: (2024)
di: Sun, Yiping
Pubblicazione: (2024)
Multi-Level Graph Attention Network Contrastive Learning for Knowledge-Aware Recommendation
di: Hu, Zhifei, et al.
Pubblicazione: (2026)
di: Hu, Zhifei, et al.
Pubblicazione: (2026)
Structural Anchor Pruning: Training-Free Multi-Vector Compression for Visual Document Retrieval
di: Liu, Zhuchenyang, et al.
Pubblicazione: (2026)
di: Liu, Zhuchenyang, et al.
Pubblicazione: (2026)
Curator: Efficient Vector Search with Low-Selectivity Filters
di: Jin, Yicheng, et al.
Pubblicazione: (2026)
di: Jin, Yicheng, et al.
Pubblicazione: (2026)
Orchestrating Specialized Agents for Trustworthy Enterprise RAG
di: You, Xincheng, et al.
Pubblicazione: (2026)
di: You, Xincheng, et al.
Pubblicazione: (2026)
A Reduction-Driven Local Search for the Generalized Independent Set Problem
di: Liu, Yiping, et al.
Pubblicazione: (2025)
di: Liu, Yiping, et al.
Pubblicazione: (2025)
Learning Category Trees for ID-Based Recommendation: Exploring the Power of Differentiable Vector Quantization
di: Liu, Qijiong, et al.
Pubblicazione: (2023)
di: Liu, Qijiong, et al.
Pubblicazione: (2023)
Adaptive Orchestration of Modular Generative Information Access Systems
di: Hoveyda, Mohanna, et al.
Pubblicazione: (2025)
di: Hoveyda, Mohanna, et al.
Pubblicazione: (2025)
Vectorized Context-Aware Embeddings for GAT-Based Collaborative Filtering
di: Ebrat, Danial, et al.
Pubblicazione: (2025)
di: Ebrat, Danial, et al.
Pubblicazione: (2025)
Solution for Meta KDD Cup'25: A Comprehensive Three-Step Framework for Vision Question Answering
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
VQL: An End-to-End Context-Aware Vector Quantization Attention for Ultra-Long User Behavior Modeling
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
di: Li, Kaiyuan, et al.
Pubblicazione: (2025)
DocPruner: A Storage-Efficient Framework for Multi-Vector Visual Document Retrieval via Adaptive Patch-Level Embedding Pruning
di: Yan, Yibo, et al.
Pubblicazione: (2025)
di: Yan, Yibo, et al.
Pubblicazione: (2025)
Compass: General Filtered Search across Vector and Structured Data
di: Ye, Chunxiao, et al.
Pubblicazione: (2025)
di: Ye, Chunxiao, et al.
Pubblicazione: (2025)
Efficient Multi-Vector Dense Retrieval Using Bit Vectors
di: Nardini, Franco Maria, et al.
Pubblicazione: (2024)
di: Nardini, Franco Maria, et al.
Pubblicazione: (2024)
All-Mem: Agentic Lifelong Memory via Dynamic Topology Evolution
di: Lv, Can, et al.
Pubblicazione: (2026)
di: Lv, Can, et al.
Pubblicazione: (2026)
SelRoute: Query-Type-Aware Routing for Long-Term Conversational Memory Retrieval
di: McKee, Matthew
Pubblicazione: (2026)
di: McKee, Matthew
Pubblicazione: (2026)
Autonomous Agent-Orchestrated Digital Twins (AADT): Leveraging the OpenClaw Framework for State Synchronization in Rare Genetic Disorders
di: Chen, Hongzhuo, et al.
Pubblicazione: (2026)
di: Chen, Hongzhuo, et al.
Pubblicazione: (2026)
REGENT: Relevance-Guided Attention for Entity-Aware Multi-Vector Neural Re-Ranking
di: Chatterjee, Shubham
Pubblicazione: (2025)
di: Chatterjee, Shubham
Pubblicazione: (2025)
RAG without Forgetting: Continual Query-Infused Key Memory
di: Hu, Yuntong, et al.
Pubblicazione: (2026)
di: Hu, Yuntong, et al.
Pubblicazione: (2026)
From Entity Reliability to Clean Feedback: An Entity-Aware Denoising Framework Beyond Interaction-Level Signals
di: Liu, Ze, et al.
Pubblicazione: (2025)
di: Liu, Ze, et al.
Pubblicazione: (2025)
DivNet: Diversity-Aware Self-Correcting Sequential Recommendation Networks
di: Xiao, Shuai, et al.
Pubblicazione: (2024)
di: Xiao, Shuai, et al.
Pubblicazione: (2024)
Leveraging Memory Retrieval to Enhance LLM-based Generative Recommendation
di: Wang, Chengbing, et al.
Pubblicazione: (2024)
di: Wang, Chengbing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scalable Overload-Aware Graph-Based Index Construction for 10-Billion-Scale Vector Similarity Search
di: Shi, Yang, et al.
Pubblicazione: (2025) -
FAVOR: Efficient Filter-Agnostic Vector ANNS Based on Selectivity-Aware Exclusion Distances
di: Song, Junjie, et al.
Pubblicazione: (2026) -
FaTRQ: Tiered Residual Quantization for LLM Vector Search in Far-Memory-Aware ANNS Systems
di: Zhang, Tianqi, et al.
Pubblicazione: (2026) -
WebANNS: Fast and Efficient Approximate Nearest Neighbor Search in Web Browsers
di: Liu, Mugeng, et al.
Pubblicazione: (2025) -
OrchANN: A Unified I/O Orchestration Framework for Skewed Out-of-Core Vector Search
di: Huan, Chengying, et al.
Pubblicazione: (2025)