A Bring-Your-Own-Model Approach for ML-Driven Storage Placement in Warehouse-Scale Computers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Chenxi, Li, Yan, Maas, Martin, Uysal, Mustafa, Hafeez, Ubaid Ullah, Merchant, Arif, McDougall, Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mao: Machine learning approach for NUMA optimization in Warehouse Scale Computers
par: Liu, Yueji, et autres
Publié: (2024)
par: Liu, Yueji, et autres
Publié: (2024)
Agora: Bridging the GPU Cloud Resource-Price Disconnect
par: McDougall, Ian, et autres
Publié: (2025)
par: McDougall, Ian, et autres
Publié: (2025)
ML-based Adaptive Prefetching and Data Placement for US HEP Systems
par: Karanam, Venkat Sai Suman Lamba, et autres
Publié: (2025)
par: Karanam, Venkat Sai Suman Lamba, et autres
Publié: (2025)
NL-CPS: Reinforcement Learning-Based Kubernetes Control Plane Placement in Multi-Region Clusters
par: Alam, Sajid, et autres
Publié: (2026)
par: Alam, Sajid, et autres
Publié: (2026)
Aladdin: Joint Placement and Scaling for SLO-Aware LLM Serving
par: Nie, Chengyi, et autres
Publié: (2024)
par: Nie, Chengyi, et autres
Publié: (2024)
Performance and Security Aware Distributed Service Placement in Fog Computing
par: Goudarzi, Mohammad, et autres
Publié: (2026)
par: Goudarzi, Mohammad, et autres
Publié: (2026)
ML-based Modeling to Predict I/O Performance on Different Storage Sub-systems
par: Xu, Yiheng, et autres
Publié: (2023)
par: Xu, Yiheng, et autres
Publié: (2023)
Declarative Data Pipeline for Large Scale ML Services
par: Yang, Yunzhao, et autres
Publié: (2025)
par: Yang, Yunzhao, et autres
Publié: (2025)
Power Aware Container Placement in Cloud Computing with Affinity and Cubic Power Model
par: Sarkar, Suvarthi, et autres
Publié: (2024)
par: Sarkar, Suvarthi, et autres
Publié: (2024)
Placement of Microservices-based IoT Applications in Fog Computing: A Taxonomy and Future Directions
par: Pallewatta, Samodha, et autres
Publié: (2022)
par: Pallewatta, Samodha, et autres
Publié: (2022)
DualScale: Energy-Efficient Disaggregated LLM Serving via Phase-Aware Placement and DVFS
par: Basit, Omar, et autres
Publié: (2026)
par: Basit, Omar, et autres
Publié: (2026)
Loki: A System for Serving ML Inference Pipelines with Hardware and Accuracy Scaling
par: Ahmad, Sohaib, et autres
Publié: (2024)
par: Ahmad, Sohaib, et autres
Publié: (2024)
Snowpark: Performant, Secure, User-Friendly Data Engineering and AI/ML Next To Your Data
par: Baker, Brandon, et autres
Publié: (2025)
par: Baker, Brandon, et autres
Publié: (2025)
Frosty: Bringing strong liveness guarantees to the Snow family of consensus protocols
par: Buchwald, Aaron, et autres
Publié: (2024)
par: Buchwald, Aaron, et autres
Publié: (2024)
Generalized Data Placement Strategies for Racetrack Memories
par: Khan, Asif Ali, et autres
Publié: (2019)
par: Khan, Asif Ali, et autres
Publié: (2019)
Optimal Workload Placement on Multi-Instance GPUs
par: Turkkan, Bekir, et autres
Publié: (2024)
par: Turkkan, Bekir, et autres
Publié: (2024)
Overview and Prospects of Using Integer Surrogate Keys for Data Warehouse Performance Optimization
par: Stumpf, Sviatoslav, et autres
Publié: (2025)
par: Stumpf, Sviatoslav, et autres
Publié: (2025)
HPAC-ML: A Programming Model for Embedding ML Surrogates in Scientific Applications
par: Fink, Zane, et autres
Publié: (2024)
par: Fink, Zane, et autres
Publié: (2024)
Understanding Inference Scaling for LLMs: Bottlenecks, Trade-offs, and Performance Principles
par: Arif, Moiz, et autres
Publié: (2026)
par: Arif, Moiz, et autres
Publié: (2026)
Offloading Artificial Intelligence Workloads across the Computing Continuum by means of Active Storage Systems
par: Barceló, Alex, et autres
Publié: (2025)
par: Barceló, Alex, et autres
Publié: (2025)
Energy-aware Distributed Microservice Request Placement at the Edge
par: Toczé, Klervie, et autres
Publié: (2024)
par: Toczé, Klervie, et autres
Publié: (2024)
Energy Metrics for Edge Microservice Request Placement Strategies
par: Toczé, Klervie, et autres
Publié: (2025)
par: Toczé, Klervie, et autres
Publié: (2025)
It's the People, Not the Placement: Rethinking Allocations in Post-Moore Clouds
par: Harith, Tejas, et autres
Publié: (2025)
par: Harith, Tejas, et autres
Publié: (2025)
Deterministic Parallel High-Quality Hypergraph Partitioning
par: Krause, Robert, et autres
Publié: (2025)
par: Krause, Robert, et autres
Publié: (2025)
Exploring Uncore Frequency Scaling for Heterogeneous Computing
par: Zheng, Zhong, et autres
Publié: (2025)
par: Zheng, Zhong, et autres
Publié: (2025)
The SAP Cloud Infrastructure Dataset: A Reality Check of Scheduling and Placement of VMs in Cloud Computing
par: Uhlig, Arno, et autres
Publié: (2025)
par: Uhlig, Arno, et autres
Publié: (2025)
OffloadFS: Leveraging Disaggregated Storage for Computation Offloading
par: Moon, Sungho, et autres
Publié: (2026)
par: Moon, Sungho, et autres
Publié: (2026)
POSEIDON : Efficient Function Placement at the Edge using Deep Reinforcement Learning
par: Jain, Prakhar, et autres
Publié: (2024)
par: Jain, Prakhar, et autres
Publié: (2024)
TIDAL: Recovering Temporal Phase for Cloud Block Storage Placement from LLM-Derived Semantics
par: Tan, Difan, et autres
Publié: (2026)
par: Tan, Difan, et autres
Publié: (2026)
Bringing computation to the data: A MOEA-driven approach for optimising data processing in the context of the SKA and SRCNet
par: Parra-Royón, Manuel, et autres
Publié: (2026)
par: Parra-Royón, Manuel, et autres
Publié: (2026)
Large-Scale Metric Computation in Online Controlled Experiment Platform
par: Xiong, Tao, et autres
Publié: (2024)
par: Xiong, Tao, et autres
Publié: (2024)
SLICE: SLO-Driven Scheduling for LLM Inference on Edge Computing Devices
par: Chow, Will
Publié: (2025)
par: Chow, Will
Publié: (2025)
Kubernetes in the Cloud vs. Bare Metal: A Comparative Study of Network Costs
par: Redoli, Rodrigo Mompo, et autres
Publié: (2025)
par: Redoli, Rodrigo Mompo, et autres
Publié: (2025)
Driving Computational Efficiency in Large-Scale Platforms using HPC Technologies
par: Mendez, Alexander Martinez, et autres
Publié: (2026)
par: Mendez, Alexander Martinez, et autres
Publié: (2026)
Scale: Deep Reinforcement Learning for Container Scheduling in Serverless Edge Computing
par: Chen, Chen, et autres
Publié: (2026)
par: Chen, Chen, et autres
Publié: (2026)
Octopus: Experiences with a Hybrid Event-Driven Architecture for Distributed Scientific Computing
par: Pan, Haochen, et autres
Publié: (2024)
par: Pan, Haochen, et autres
Publié: (2024)
Accelerating Edge Inference for Distributed MoE Models with Latency-Optimized Expert Placement
par: Wu, Tian, et autres
Publié: (2025)
par: Wu, Tian, et autres
Publié: (2025)
Pollen: High-throughput Federated Learning Simulation via Resource-Aware Client Placement
par: Sani, Lorenzo, et autres
Publié: (2023)
par: Sani, Lorenzo, et autres
Publié: (2023)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
par: Renau, Quentin, et autres
Publié: (2025)
par: Renau, Quentin, et autres
Publié: (2025)
Beyond Microservices: Testing Web-Scale RCA Methods on GPU-Driven LLM Workloads
par: Scheinert, Dominik, et autres
Publié: (2026)
par: Scheinert, Dominik, et autres
Publié: (2026)
Documents similaires
-
Mao: Machine learning approach for NUMA optimization in Warehouse Scale Computers
par: Liu, Yueji, et autres
Publié: (2024) -
Agora: Bridging the GPU Cloud Resource-Price Disconnect
par: McDougall, Ian, et autres
Publié: (2025) -
ML-based Adaptive Prefetching and Data Placement for US HEP Systems
par: Karanam, Venkat Sai Suman Lamba, et autres
Publié: (2025) -
NL-CPS: Reinforcement Learning-Based Kubernetes Control Plane Placement in Multi-Region Clusters
par: Alam, Sajid, et autres
Publié: (2026) -
Aladdin: Joint Placement and Scaling for SLO-Aware LLM Serving
par: Nie, Chengyi, et autres
Publié: (2024)