Guardian: Safe GPU Sharing in Multi-Tenant Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pavlidakis, Manos, Vasiliadis, Giorgos, Mavridis, Stelios, Argyros, Anargyros, Chazapis, Antony, Bilas, Angelos |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Optimizing the Longhorn Cloud-native Software Defined Storage Engine for High Performance
par: Kampadais, Konstantinos, et autres
Publié: (2025)
par: Kampadais, Konstantinos, et autres
Publié: (2025)
Running Cloud-native Workloads on HPC with High-Performance Kubernetes
par: Chazapis, Antony, et autres
Publié: (2024)
par: Chazapis, Antony, et autres
Publié: (2024)
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
par: Luo, Yizhou, et autres
Publié: (2024)
par: Luo, Yizhou, et autres
Publié: (2024)
Delta Fair Sharing: Performance Isolation for Multi-Tenant Storage Systems
par: Griggs, Tyler, et autres
Publié: (2026)
par: Griggs, Tyler, et autres
Publié: (2026)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
par: Lee, Munkyu, et autres
Publié: (2024)
par: Lee, Munkyu, et autres
Publié: (2024)
Caching Aided Multi-Tenant Serverless Computing
par: Qiao, Chu, et autres
Publié: (2024)
par: Qiao, Chu, et autres
Publié: (2024)
GPU Sharing with Triples Mode
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
The National Research Platform: Stretched, Multi-Tenant, Scientific Kubernetes Cluster
par: Weitzel, Derek, et autres
Publié: (2025)
par: Weitzel, Derek, et autres
Publié: (2025)
Trabant: A Serverless Architecture for Multi-Tenant Orbital Edge Computing
par: Pfandzelter, Tobias, et autres
Publié: (2025)
par: Pfandzelter, Tobias, et autres
Publié: (2025)
An Online Fragmentation-Aware GPU Scheduler for Multi-Tenant MIG-based Clouds
par: Zambianco, Marco, et autres
Publié: (2025)
par: Zambianco, Marco, et autres
Publié: (2025)
An Online Fragmentation-Aware Scheduler for Managing GPU-Sharing Workloads on Multi-Instance GPUs
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
par: Zhang, Xiaopei, et autres
Publié: (2025)
par: Zhang, Xiaopei, et autres
Publié: (2025)
Multi Armed Bandit Algorithms Based Virtual Machine Allocation Policy for Security in Multi-Tenant Distributed Systems
par: Patil, Pravin, et autres
Publié: (2024)
par: Patil, Pravin, et autres
Publié: (2024)
Byzantine-Tolerant Consensus in GPU-Inspired Shared Memory
par: Georgiou, Chryssis, et autres
Publié: (2025)
par: Georgiou, Chryssis, et autres
Publié: (2025)
Private Virtual Tree Networks for Secure Multi-Tenant Environments Based on the VIRGO Overlay Network
par: Huang, Lican
Publié: (2025)
par: Huang, Lican
Publié: (2025)
MuxTune: Efficient Multi-Task LLM Fine-Tuning in Multi-Tenant Datacenters via Spatial-Temporal Backbone Multiplexing
par: Xue, Chunyu, et autres
Publié: (2026)
par: Xue, Chunyu, et autres
Publié: (2026)
Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs
par: Ng, Nathan, et autres
Publié: (2026)
par: Ng, Nathan, et autres
Publié: (2026)
Boosting LLM Serving through Spatial-Temporal GPU Resource Sharing
par: Lin, Zejia, et autres
Publié: (2025)
par: Lin, Zejia, et autres
Publié: (2025)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
Causal Inference for Quantifying Noisy Neighbor Effects in Multi-Tenant Cloud Environments
par: Schiavo, Philipe S., et autres
Publié: (2026)
par: Schiavo, Philipe S., et autres
Publié: (2026)
Equilibria: Fair Multi-Tenant CXL Memory Tiering At Scale
par: Zhao, Kaiyang, et autres
Publié: (2026)
par: Zhao, Kaiyang, et autres
Publié: (2026)
MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service
par: Yu, Timothy Tin Long, et autres
Publié: (2026)
par: Yu, Timothy Tin Long, et autres
Publié: (2026)
MUSE: Multi-Tenant Model Serving With Seamless Model Updates
par: Correia, Cláudio, et autres
Publié: (2026)
par: Correia, Cláudio, et autres
Publié: (2026)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
Adaptive Multidimensional Quadrature on Multi-GPU Systems
par: Tonarelli, Melanie, et autres
Publié: (2025)
par: Tonarelli, Melanie, et autres
Publié: (2025)
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025)
par: Siavashi, Ahmad, et autres
Publié: (2025)
Understanding Data Movement in AMD Multi-GPU Systems with Infinity Fabric
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
Concurrent Scheduling of High-Level Parallel Programs on Multi-GPU Systems
par: Knorr, Fabian, et autres
Publié: (2025)
par: Knorr, Fabian, et autres
Publié: (2025)
Improving Multi-Instance GPU Efficiency via Sub-Entry Sharing TLB Design
par: Li, Bingyao, et autres
Publié: (2024)
par: Li, Bingyao, et autres
Publié: (2024)
THEMIS: Time, Heterogeneity, and Energy Minded Scheduling for Fair Multi-Tenant Use in FPGAs
par: Karabulut, Emre, et autres
Publié: (2024)
par: Karabulut, Emre, et autres
Publié: (2024)
FaaSMoE: A Serverless Framework for Multi-Tenant Mixture-of-Experts Serving
par: Wang, Minghe, et autres
Publié: (2026)
par: Wang, Minghe, et autres
Publié: (2026)
Advancing Polyglot Big Data Processing using the Hadoop ecosystem
par: Seabra, Antony, et autres
Publié: (2025)
par: Seabra, Antony, et autres
Publié: (2025)
Towards Polyglot Data Processing in Social Networks using the Hadoop-Spark ecosystem
par: Seabra, Antony, et autres
Publié: (2025)
par: Seabra, Antony, et autres
Publié: (2025)
HarMoEny: Efficient Multi-GPU Inference of MoE Models
par: Doucet, Zachary, et autres
Publié: (2025)
par: Doucet, Zachary, et autres
Publié: (2025)
Multi-GPU Acceleration of PALABOS Fluid Solver using C++ Standard Parallelism
par: Latt, Jonas, et autres
Publié: (2025)
par: Latt, Jonas, et autres
Publié: (2025)
Multi-core & GPU-based Balanced Butterfly Counting in Signed Bipartite Graphs
par: Kiran, Mekala, et autres
Publié: (2026)
par: Kiran, Mekala, et autres
Publié: (2026)
Enabling Disaggregated Multi-Stage MLLM Inference via GPU-Internal Scheduling and Resource Sharing
par: Zhao, Lingxiao, et autres
Publié: (2025)
par: Zhao, Lingxiao, et autres
Publié: (2025)
Accelerating Biclique Counting on GPU
par: Qiu, Linshan, et autres
Publié: (2024)
par: Qiu, Linshan, et autres
Publié: (2024)
Large Scale Multi-GPU Based Parallel Traffic Simulation for Accelerated Traffic Assignment and Propagation
par: Jiang, Xuan, et autres
Publié: (2024)
par: Jiang, Xuan, et autres
Publié: (2024)
Neutron particle transport 3D method of characteristic Multi GPU platform Parallel Computing
par: Zhou, Faguo, et autres
Publié: (2025)
par: Zhou, Faguo, et autres
Publié: (2025)
Documents similaires
-
Optimizing the Longhorn Cloud-native Software Defined Storage Engine for High Performance
par: Kampadais, Konstantinos, et autres
Publié: (2025) -
Running Cloud-native Workloads on HPC with High-Performance Kubernetes
par: Chazapis, Antony, et autres
Publié: (2024) -
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
par: Luo, Yizhou, et autres
Publié: (2024) -
Delta Fair Sharing: Performance Isolation for Multi-Tenant Storage Systems
par: Griggs, Tyler, et autres
Publié: (2026) -
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
par: Lee, Munkyu, et autres
Publié: (2024)