Optimizing SSD Caches for Cloud Block Storage Systems Using Machine Learning Approaches
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Chiyu, Zhou, Chang, Zhao, Yang, Cao, Jin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dynamic Optimization of Storage Systems Using Reinforcement Learning Techniques
par: Cheng, Chiyu, et autres
Publié: (2024)
par: Cheng, Chiyu, et autres
Publié: (2024)
Dynamic Adaptation in Data Storage: Real-Time Machine Learning for Enhanced Prefetching
par: Cheng, Chiyu, et autres
Publié: (2024)
par: Cheng, Chiyu, et autres
Publié: (2024)
TIDAL: Recovering Temporal Phase for Cloud Block Storage Placement from LLM-Derived Semantics
par: Tan, Difan, et autres
Publié: (2026)
par: Tan, Difan, et autres
Publié: (2026)
Optimizing CPU Cache Utilization in Cloud VMs with Accurate Cache Abstraction
par: Tofigh, Mani, et autres
Publié: (2025)
par: Tofigh, Mani, et autres
Publié: (2025)
"Range as a Key" is the Key! Fast and Compact Cloud Block Store Index with RASK
par: Zhao, Haoru, et autres
Publié: (2026)
par: Zhao, Haoru, et autres
Publié: (2026)
Evaluating Serverless Machine Learning Performance on Google Cloud Run
par: Khatiwada, Prerana, et autres
Publié: (2024)
par: Khatiwada, Prerana, et autres
Publié: (2024)
DPC: A Distributed Page Cache over CXL
par: Bergman, Shai, et autres
Publié: (2026)
par: Bergman, Shai, et autres
Publié: (2026)
Idiosyncrasies of Programmable Caching Engines
par: Peixoto, José, et autres
Publié: (2026)
par: Peixoto, José, et autres
Publié: (2026)
BLITZSCALE: Fast and Live Large Model Autoscaling with O(1) Host Caching
par: Zhang, Dingyan, et autres
Publié: (2024)
par: Zhang, Dingyan, et autres
Publié: (2024)
Why iCloud Fails: The Category Mistake of Cloud Synchronization
par: Borrill, Paul
Publié: (2026)
par: Borrill, Paul
Publié: (2026)
ContiguousKV: Accelerating LLM Prefill with Granularity-Aligned KV Cache Management
par: Zou, Jing, et autres
Publié: (2026)
par: Zou, Jing, et autres
Publié: (2026)
Funky: Cloud-Native FPGA Virtualization and Orchestration
par: Koshiba, Atsushi, et autres
Publié: (2025)
par: Koshiba, Atsushi, et autres
Publié: (2025)
LEFT-RS: A Lock-Free Fault-Tolerant Resource Sharing Protocol for Multicore Real-Time Systems
par: Chen, Nan, et autres
Publié: (2025)
par: Chen, Nan, et autres
Publié: (2025)
Unlocking True Elasticity for the Cloud-Native Era with Dandelion
par: Kuchler, Tom, et autres
Publié: (2025)
par: Kuchler, Tom, et autres
Publié: (2025)
HybridTier: an Adaptive and Lightweight CXL-Memory Tiering System
par: Song, Kevin, et autres
Publié: (2023)
par: Song, Kevin, et autres
Publié: (2023)
GPUOS: A GPU Operating System Primitive for Transparent Operation Fusion
par: Yang, Yiwei, et autres
Publié: (2026)
par: Yang, Yiwei, et autres
Publié: (2026)
Toward Systems Foundations for Agentic Exploration
par: Xu, Jiakai, et autres
Publié: (2025)
par: Xu, Jiakai, et autres
Publié: (2025)
EdgeWeaver: Accelerating IoT Application Development Across Edge-Cloud Continuum
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2026)
par: Lertpongrujikorn, Pawissanutt, et autres
Publié: (2026)
FastMig: Leveraging FastFreeze to Establish Robust Service Liquidity in Cloud 2.0
par: Manatura, Sorawit, et autres
Publié: (2024)
par: Manatura, Sorawit, et autres
Publié: (2024)
Optimizing Task Scheduling in Heterogeneous Computing Environments: A Comparative Analysis of CPU, GPU, and ASIC Platforms Using E2C Simulator
par: Mohammadjafari, Ali, et autres
Publié: (2024)
par: Mohammadjafari, Ali, et autres
Publié: (2024)
EROICA: Online Performance Troubleshooting for Large-scale Model Training
par: Guan, Yu, et autres
Publié: (2025)
par: Guan, Yu, et autres
Publié: (2025)
Agent Centric Operating System -- a Comprehensive Review and Outlook for Operating System
par: Jia, Shian, et autres
Publié: (2024)
par: Jia, Shian, et autres
Publié: (2024)
LatencyPrism: Online Non-intrusive Latency Sculpting for SLO-Guaranteed LLM Inference
par: Du, Yin, et autres
Publié: (2026)
par: Du, Yin, et autres
Publié: (2026)
Learning Semantics, Not Addresses: Runtime Neural Prefetching for Far Memory
par: Huang, Yutong, et autres
Publié: (2025)
par: Huang, Yutong, et autres
Publié: (2025)
Mercury: QoS-Aware Tiered Memory System
par: Lu, Jiaheng, et autres
Publié: (2024)
par: Lu, Jiaheng, et autres
Publié: (2024)
xNVMe: Unleashing Storage Hardware-Software Co-design
par: Lund, Simon A. F., et autres
Publié: (2024)
par: Lund, Simon A. F., et autres
Publié: (2024)
Peformance Isolation for Inference Processes in Edge GPU Systems
par: Martín, Juan José, et autres
Publié: (2026)
par: Martín, Juan José, et autres
Publié: (2026)
The Hitchhiker's Guide to Programming and Optimizing Cache Coherent Heterogeneous Systems: CXL, NVLink-C2C, and AMD Infinity Fabric
par: Wang, Zixuan, et autres
Publié: (2024)
par: Wang, Zixuan, et autres
Publié: (2024)
Formal Definitions and Performance Comparison of Consistency Models for Parallel File Systems
par: Wang, Chen, et autres
Publié: (2024)
par: Wang, Chen, et autres
Publié: (2024)
Towards Efficient and Practical GPU Multitasking in the Era of LLM
par: Xing, Jiarong, et autres
Publié: (2025)
par: Xing, Jiarong, et autres
Publié: (2025)
RAGDoll: Efficient Offloading-based Online RAG System on a Single GPU
par: Yu, Weiping, et autres
Publié: (2025)
par: Yu, Weiping, et autres
Publié: (2025)
SteelDB: Diagnosing Kernel-Space Bottlenecks in Cloud OLTP Databases
par: Kondo, Mitsumasa
Publié: (2026)
par: Kondo, Mitsumasa
Publié: (2026)
EdgeFlow: Fast Cold Starts for LLMs on Mobile Devices
par: Yan, Yongsheng, et autres
Publié: (2026)
par: Yan, Yongsheng, et autres
Publié: (2026)
ONCache: A Cache-Based Low-Overhead Container Overlay Network
par: Lin, Shengkai, et autres
Publié: (2023)
par: Lin, Shengkai, et autres
Publié: (2023)
Performance Isolation and Semantic Determinism in Efficient GPU Spatial Sharing
par: Yang, Zhenyuan, et autres
Publié: (2026)
par: Yang, Zhenyuan, et autres
Publié: (2026)
FALCON: Pinpointing and Mitigating Stragglers for Large-Scale Hybrid-Parallel Training
par: Wu, Tianyuan, et autres
Publié: (2024)
par: Wu, Tianyuan, et autres
Publié: (2024)
LMetric: Simple is Better - Multiplication May Be All You Need for LLM Request Scheduling
par: Zhang, Dingyan, et autres
Publié: (2026)
par: Zhang, Dingyan, et autres
Publié: (2026)
Equilibria: Fair Multi-Tenant CXL Memory Tiering At Scale
par: Zhao, Kaiyang, et autres
Publié: (2026)
par: Zhao, Kaiyang, et autres
Publié: (2026)
Imaginary Machines: A Serverless Model for Cloud Applications
par: Wawrzoniak, Michael, et autres
Publié: (2024)
par: Wawrzoniak, Michael, et autres
Publié: (2024)
Token Management in Multi-Tenant AI Inference Platforms
par: Cunningham, William J.
Publié: (2026)
par: Cunningham, William J.
Publié: (2026)
Documents similaires
-
Dynamic Optimization of Storage Systems Using Reinforcement Learning Techniques
par: Cheng, Chiyu, et autres
Publié: (2024) -
Dynamic Adaptation in Data Storage: Real-Time Machine Learning for Enhanced Prefetching
par: Cheng, Chiyu, et autres
Publié: (2024) -
TIDAL: Recovering Temporal Phase for Cloud Block Storage Placement from LLM-Derived Semantics
par: Tan, Difan, et autres
Publié: (2026) -
Optimizing CPU Cache Utilization in Cloud VMs with Accurate Cache Abstraction
par: Tofigh, Mani, et autres
Publié: (2025) -
"Range as a Key" is the Key! Fast and Compact Cloud Block Store Index with RASK
par: Zhao, Haoru, et autres
Publié: (2026)