ZipCache: A DRAM/SSD Cache with Built-in Transparent Compression
Fuente:
arXiv
Saved in:
| Main Authors: | Xie, Rui, Ma, Linsen, Zhong, Alex, Chen, Feng, Zhang, Tong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification
by: He, Yefei, et al.
Published: (2024)
by: He, Yefei, et al.
Published: (2024)
Analysis and Evaluation of Using Microsecond-Latency Memory for In-Memory Indices and Caches in SSD-Based Key-Value Stores
by: Bando, Yosuke, et al.
Published: (2025)
by: Bando, Yosuke, et al.
Published: (2025)
Memory Hierarchy — DRAM, HBM, and SSD-Backed Caches
by: Ivchenko, Oleh
Published: (2026)
by: Ivchenko, Oleh
Published: (2026)
Optimizing Intensive Database Tasks Through Caching Proxy Mechanisms
by: Moise, Ionut-Alex, et al.
Published: (2024)
by: Moise, Ionut-Alex, et al.
Published: (2024)
KVzip: Query-Agnostic KV Cache Compression with Context Reconstruction
by: Kim, Jang-Hyun, et al.
Published: (2025)
by: Kim, Jang-Hyun, et al.
Published: (2025)
Adaptive KV-Cache Compression without Manually Setting Budget
by: Tang, Chenxia, et al.
Published: (2025)
by: Tang, Chenxia, et al.
Published: (2025)
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
by: Yan, Jianxin, et al.
Published: (2025)
by: Yan, Jianxin, et al.
Published: (2025)
RAC: Relation-Aware Cache Replacement for Large Language Models
by: Wu, Yuchong, et al.
Published: (2026)
by: Wu, Yuchong, et al.
Published: (2026)
CS-PQ: Cache-Friendly SIMD Product Quantization for Large-Scale ANNS Index Construction
by: Ma, Y. T., et al.
Published: (2026)
by: Ma, Y. T., et al.
Published: (2026)
Learning-Augmented Online Caching: New Upper Bounds
by: Skachkov, Daniel, et al.
Published: (2024)
by: Skachkov, Daniel, et al.
Published: (2024)
Deuteronomy 2.0: Record Caching and Latch Freedom
by: Lomet, David
Published: (2025)
by: Lomet, David
Published: (2025)
Data Caching for Enterprise-Grade Petabyte-Scale OLAP
by: Tang, Chunxu, et al.
Published: (2024)
by: Tang, Chunxu, et al.
Published: (2024)
Harnessing Your DRAM and SSD for Sustainable and Accessible LLM Inference with Mixed-Precision and Multi-level Caching
by: Peng, Jie, et al.
Published: (2024)
by: Peng, Jie, et al.
Published: (2024)
DCMF: A Dynamic Context Monitoring and Caching Framework for Context Management Platforms
by: Manchanda, Ashish, et al.
Published: (2025)
by: Manchanda, Ashish, et al.
Published: (2025)
Category-Aware Semantic Caching for Heterogeneous LLM Workloads
by: Wang, Chen, et al.
Published: (2025)
by: Wang, Chen, et al.
Published: (2025)
PUL: Pre-load in Software for Caches Wouldn't Always Play Along
by: Bernhardt, Arthur, et al.
Published: (2025)
by: Bernhardt, Arthur, et al.
Published: (2025)
QCFuse: Query-Centric Cache Fusion for Efficient RAG Inference
by: Yan, Jianxin, et al.
Published: (2026)
by: Yan, Jianxin, et al.
Published: (2026)
FIER: Fine-Grained and Efficient KV Cache Retrieval for Long-context LLM Inference
by: Wang, Dongwei, et al.
Published: (2025)
by: Wang, Dongwei, et al.
Published: (2025)
Leveraging Approximate Caching for Faster Retrieval-Augmented Generation
by: Bergman, Shai, et al.
Published: (2025)
by: Bergman, Shai, et al.
Published: (2025)
DiskJoin: Large-scale Vector Similarity Join with SSD
by: Chen, Yanqi, et al.
Published: (2025)
by: Chen, Yanqi, et al.
Published: (2025)
On 10x Better Scalability: KV Stores Scale Up KV Cache
by: Yu, Weiping, et al.
Published: (2025)
by: Yu, Weiping, et al.
Published: (2025)
MetaHive: A Cache-Optimized Metadata Management for Heterogeneous Key-Value Stores
by: Heidari, Alireza, et al.
Published: (2024)
by: Heidari, Alireza, et al.
Published: (2024)
One-Hop Sub-Query Result Caches for Graph Database Systems
by: Nguyen, Hieu, et al.
Published: (2024)
by: Nguyen, Hieu, et al.
Published: (2024)
Rethinking Caching for LLM Serving Systems: Beyond Traditional Heuristics
by: Kim, Jungwoo, et al.
Published: (2025)
by: Kim, Jungwoo, et al.
Published: (2025)
GoVector: An I/O-Efficient Caching Strategy for High-Dimensional Vector Nearest Neighbor Search
by: Zhou, Yijie, et al.
Published: (2025)
by: Zhou, Yijie, et al.
Published: (2025)
Optimizing SSD-Resident Graph Indexing for High-Throughput Vector Search
by: Zhao, Weichen, et al.
Published: (2026)
by: Zhao, Weichen, et al.
Published: (2026)
QVCache: A Query-Aware Vector Cache
by: Göçer, Anıl Eren, et al.
Published: (2026)
by: Göçer, Anıl Eren, et al.
Published: (2026)
ZipLLM: Efficient LLM Storage via Model-Aware Synergistic Data Deduplication and Compression
by: Wang, Zirui, et al.
Published: (2025)
by: Wang, Zirui, et al.
Published: (2025)
Cache Coherence Over Disaggregated Memory
by: Wang, Ruihong, et al.
Published: (2024)
by: Wang, Ruihong, et al.
Published: (2024)
ZipFlow: a Compiler-based Framework to Unleash Compressed Data Movement for Modern GPUs
by: Yeo, Gwangoo, et al.
Published: (2026)
by: Yeo, Gwangoo, et al.
Published: (2026)
PFCS: Prime Factorization Cache System for Deterministic Data Relationship Discovery
by: Le, Duy
Published: (2025)
by: Le, Duy
Published: (2025)
Memory Hierarchy Design for Caching Middleware in the Age of NVM
by: Ghandeharizadeh, Shahram, et al.
Published: (2025)
by: Ghandeharizadeh, Shahram, et al.
Published: (2025)
Efficient Distributed Exact Subgraph Matching via GNN-PE: Load Balancing, Cache Optimization, and Query Plan Ranking
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
SAM: A Stability-Aware Cache Manager for Multi-Tenant Embedded Databases
by: Zhang, Haoran, et al.
Published: (2025)
by: Zhang, Haoran, et al.
Published: (2025)
ParisKV: Fast and Drift-Robust KV-Cache Retrieval for Long-Context LLMs
by: Qi, Yanlin, et al.
Published: (2026)
by: Qi, Yanlin, et al.
Published: (2026)
Towards Efficient Flash Caches with Emerging NVMe Flexible Data Placement SSDs
by: Allison, Michael, et al.
Published: (2025)
by: Allison, Michael, et al.
Published: (2025)
A Generative Caching System for Large Language Models
by: Iyengar, Arun, et al.
Published: (2025)
by: Iyengar, Arun, et al.
Published: (2025)
PipeANN-Filter: An Efficient Filtered Vector Search System on SSD
by: Guo, Hao, et al.
Published: (2026)
by: Guo, Hao, et al.
Published: (2026)
Quota management in dCache or making a perfectly normal file system normal
by: Litvintsev, Dmitry, et al.
Published: (2024)
by: Litvintsev, Dmitry, et al.
Published: (2024)
MVR-cache: Optimizing Semantic Caching via Multi-Vector Retrieval and Learned Prompt Segmentation
by: Noshad, Ali, et al.
Published: (2026)
by: Noshad, Ali, et al.
Published: (2026)
Similar Items
-
ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification
by: He, Yefei, et al.
Published: (2024) -
Analysis and Evaluation of Using Microsecond-Latency Memory for In-Memory Indices and Caches in SSD-Based Key-Value Stores
by: Bando, Yosuke, et al.
Published: (2025) -
Memory Hierarchy — DRAM, HBM, and SSD-Backed Caches
by: Ivchenko, Oleh
Published: (2026) -
Optimizing Intensive Database Tasks Through Caching Proxy Mechanisms
by: Moise, Ionut-Alex, et al.
Published: (2024) -
KVzip: Query-Agnostic KV Cache Compression with Context Reconstruction
by: Kim, Jang-Hyun, et al.
Published: (2025)