Adaptive K-PackCache: Cost-Centric Data Caching in Cloud
Fuente:
arXiv
Salvato in:
| Autori principali: | Sarkar, Suvarthi, Sah, Aadarshraj, Reddy, Poddutoori Sweeya, Sahu, Aryabartta |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Minimizing Energy in Reliability and Deadline-Ensured Workflow Scheduling in Cloud
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
Efficient Profit Maximization in Reliability Concerned Static Vehicular Cloud System
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2023)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2023)
Scientific Workflow Scheduling in Cloud Considering Cold Start and Variable Pricing Model
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
Power Aware Container Placement in Cloud Computing with Affinity and Cubic Power Model
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
DSPE: Profit Maximization in Edge-Cloud Storage System using Dynamic Space Partitioning with Erasure Code
di: Roy, Shubhradeep, et al.
Pubblicazione: (2025)
di: Roy, Shubhradeep, et al.
Pubblicazione: (2025)
Efficient Scheduling of Vehicular Tasks on Edge Systems with Green Energy and Battery Storage
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
QoS Aware Mixed-Criticality Task Scheduling in Vehicular Edge Cloud System
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024)
Cost-Effective Edge Data Distribution with End-To-End Delay Guarantees in Edge Computing
di: Shankar, Ravi, et al.
Pubblicazione: (2025)
di: Shankar, Ravi, et al.
Pubblicazione: (2025)
EDD-NSTE: Edge Data Distribution as a Network Steiner Tree Estimation in Edge Computing
di: Shankar, Ravi, et al.
Pubblicazione: (2025)
di: Shankar, Ravi, et al.
Pubblicazione: (2025)
PerCache: Predictive Hierarchical Cache for RAG Applications on Mobile Devices
di: Liu, Kaiwei, et al.
Pubblicazione: (2025)
di: Liu, Kaiwei, et al.
Pubblicazione: (2025)
Cost-Efficient LLM Serving in the Cloud: VM Selection with KV Cache Offloading
di: Kim, Kihyun, et al.
Pubblicazione: (2025)
di: Kim, Kihyun, et al.
Pubblicazione: (2025)
KVCache Cache in the Wild: Characterizing and Optimizing KVCache Cache at a Large Cloud Provider
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
ESS: An Offload-Centric Latent-Cache Management Architecture for DeepSeek-V3.2-Exp
di: Chen, Xinhang, et al.
Pubblicazione: (2025)
di: Chen, Xinhang, et al.
Pubblicazione: (2025)
CacheFlow: Efficient LLM Serving with 3D-Parallel KV Cache Restoration
di: Nian, Sean, et al.
Pubblicazione: (2026)
di: Nian, Sean, et al.
Pubblicazione: (2026)
Cortex: Achieving Low-Latency, Cost-Efficient Remote Data Access For LLM via Semantic-Aware Knowledge Caching
di: Ruan, Chaoyi, et al.
Pubblicazione: (2025)
di: Ruan, Chaoyi, et al.
Pubblicazione: (2025)
FedCache: A Knowledge Cache-driven Federated Learning Architecture for Personalized Edge Intelligence
di: Wu, Zhiyuan, et al.
Pubblicazione: (2023)
di: Wu, Zhiyuan, et al.
Pubblicazione: (2023)
Optimizing CPU Cache Utilization in Cloud VMs with Accurate Cache Abstraction
di: Tofigh, Mani, et al.
Pubblicazione: (2025)
di: Tofigh, Mani, et al.
Pubblicazione: (2025)
CacheFL: Privacy-Preserving and Efficient Federated Cache Model Fine-Tuning for Vision-Language Models
di: Yi, Mengjun, et al.
Pubblicazione: (2025)
di: Yi, Mengjun, et al.
Pubblicazione: (2025)
InstCache: A Predictive Cache for LLM Serving
di: Zou, Longwei, et al.
Pubblicazione: (2024)
di: Zou, Longwei, et al.
Pubblicazione: (2024)
LLM-dCache: Improving Tool-Augmented LLMs with GPT-Driven Localized Data Caching
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
di: Singh, Simranjit, et al.
Pubblicazione: (2024)
Caching Aided Multi-Tenant Serverless Computing
di: Qiao, Chu, et al.
Pubblicazione: (2024)
di: Qiao, Chu, et al.
Pubblicazione: (2024)
Adaptive Cache Management for Complex Storage Systems Using CNN-LSTM-Based Spatiotemporal Prediction
di: Wang, Xiaoye, et al.
Pubblicazione: (2024)
di: Wang, Xiaoye, et al.
Pubblicazione: (2024)
Data Caching for Enterprise-Grade Petabyte-Scale OLAP
di: Tang, Chunxu, et al.
Pubblicazione: (2024)
di: Tang, Chunxu, et al.
Pubblicazione: (2024)
Efficient LLM Inference with Activation Checkpointing and Hybrid Caching
di: Lee, Sanghyeon, et al.
Pubblicazione: (2025)
di: Lee, Sanghyeon, et al.
Pubblicazione: (2025)
Experimental Analysis of Server-Side Caching for Web Performance
di: Umar, Mohammad, et al.
Pubblicazione: (2026)
di: Umar, Mohammad, et al.
Pubblicazione: (2026)
PackKV: Reducing KV Cache Memory Footprint through LLM-Aware Lossy Compression
di: Jiang, Bo, et al.
Pubblicazione: (2025)
di: Jiang, Bo, et al.
Pubblicazione: (2025)
FastCache: Optimizing Multimodal LLM Serving through Lightweight KV-Cache Compression Framework
di: Zhu, Jianian, et al.
Pubblicazione: (2025)
di: Zhu, Jianian, et al.
Pubblicazione: (2025)
KV Cache Compression for Inference Efficiency in LLMs: A Review
di: Liu, Yanyu, et al.
Pubblicazione: (2025)
di: Liu, Yanyu, et al.
Pubblicazione: (2025)
FLeeC: a Fast Lock-Free Application Cache
di: Costa, André J., et al.
Pubblicazione: (2024)
di: Costa, André J., et al.
Pubblicazione: (2024)
CARAT: Client-Side Adaptive RPC and Cache Co-Tuning for Parallel File Systems
di: Rashid, Md Hasanur, et al.
Pubblicazione: (2026)
di: Rashid, Md Hasanur, et al.
Pubblicazione: (2026)
Strata: Hierarchical Context Caching for Long Context Language Model Serving
di: Xie, Zhiqiang, et al.
Pubblicazione: (2025)
di: Xie, Zhiqiang, et al.
Pubblicazione: (2025)
Comparative Analysis of Distributed Caching Algorithms: Performance Metrics and Implementation Considerations
di: Mayer, Helen, et al.
Pubblicazione: (2025)
di: Mayer, Helen, et al.
Pubblicazione: (2025)
10Cache: Heterogeneous Resource-Aware Tensor Caching and Migration for LLM Training
di: Afroz, Sabiha, et al.
Pubblicazione: (2025)
di: Afroz, Sabiha, et al.
Pubblicazione: (2025)
Bridging Cache-Friendliness and Concurrency: A Locality-Optimized In-Memory B-Skiplist
di: Luo, Yicong, et al.
Pubblicazione: (2025)
di: Luo, Yicong, et al.
Pubblicazione: (2025)
DiFache: Efficient and Scalable Caching on Disaggregated Memory using Decentralized Coherence
di: Zhang, Hanze, et al.
Pubblicazione: (2025)
di: Zhang, Hanze, et al.
Pubblicazione: (2025)
CARM Tool: Cache-Aware Roofline Model Automatic Benchmarking and Application Analysis
di: Morgado, José, et al.
Pubblicazione: (2026)
di: Morgado, José, et al.
Pubblicazione: (2026)
MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool
di: Hu, Cunchen, et al.
Pubblicazione: (2024)
di: Hu, Cunchen, et al.
Pubblicazione: (2024)
RcLLM: Accelerating Generative Recommendation via Beyond-Prefix KV Caching
di: Zhao, Zhan, et al.
Pubblicazione: (2026)
di: Zhao, Zhan, et al.
Pubblicazione: (2026)
Fine-Grained Vectorized Merge Sorting on RISC-V: From Register to Cache
di: Zhang, Jin, et al.
Pubblicazione: (2024)
di: Zhang, Jin, et al.
Pubblicazione: (2024)
CB-SpMV:A Data Aggregating and Balance Algorithm for Cache-Friendly Block-Based SpMV on GPUs
di: Cong, Xing, et al.
Pubblicazione: (2026)
di: Cong, Xing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Minimizing Energy in Reliability and Deadline-Ensured Workflow Scheduling in Cloud
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025) -
Efficient Profit Maximization in Reliability Concerned Static Vehicular Cloud System
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2023) -
Scientific Workflow Scheduling in Cloud Considering Cold Start and Variable Pricing Model
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025) -
Power Aware Container Placement in Cloud Computing with Affinity and Cubic Power Model
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2024) -
DSPE: Profit Maximization in Edge-Cloud Storage System using Dynamic Space Partitioning with Erasure Code
di: Roy, Shubhradeep, et al.
Pubblicazione: (2025)