Palladium: A DPU-enabled Multi-Tenant Serverless Cloud over Zero-copy Multi-node RDMA Fabrics
Fuente:
arXiv
Salvato in:
| Autori principali: | Qi, Shixiong, Zhang, Songyu, Ramakrishnan, K. K., Tootaghaj, Diman Z., Soni, Hardik, Sharma, Puneet |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Closing the HPC-Cloud Convergence Gap: Multi-Tenant Slingshot RDMA for Kubernetes
di: Friese, Philipp A., et al.
Pubblicazione: (2025)
di: Friese, Philipp A., et al.
Pubblicazione: (2025)
LIFL: A Lightweight, Event-driven Serverless Platform for Federated Learning
di: Qi, Shixiong, et al.
Pubblicazione: (2024)
di: Qi, Shixiong, et al.
Pubblicazione: (2024)
Caching Aided Multi-Tenant Serverless Computing
di: Qiao, Chu, et al.
Pubblicazione: (2024)
di: Qiao, Chu, et al.
Pubblicazione: (2024)
Making MoE-based LLM Inference Resilient with Tarragon
di: Zhang, Songyu, et al.
Pubblicazione: (2026)
di: Zhang, Songyu, et al.
Pubblicazione: (2026)
Trabant: A Serverless Architecture for Multi-Tenant Orbital Edge Computing
di: Pfandzelter, Tobias, et al.
Pubblicazione: (2025)
di: Pfandzelter, Tobias, et al.
Pubblicazione: (2025)
FaaSMoE: A Serverless Framework for Multi-Tenant Mixture-of-Experts Serving
di: Wang, Minghe, et al.
Pubblicazione: (2026)
di: Wang, Minghe, et al.
Pubblicazione: (2026)
An Online Fragmentation-Aware GPU Scheduler for Multi-Tenant MIG-based Clouds
di: Zambianco, Marco, et al.
Pubblicazione: (2025)
di: Zambianco, Marco, et al.
Pubblicazione: (2025)
Causal Inference for Quantifying Noisy Neighbor Effects in Multi-Tenant Cloud Environments
di: Schiavo, Philipe S., et al.
Pubblicazione: (2026)
di: Schiavo, Philipe S., et al.
Pubblicazione: (2026)
Guardian: Safe GPU Sharing in Multi-Tenant Environments
di: Pavlidakis, Manos, et al.
Pubblicazione: (2024)
di: Pavlidakis, Manos, et al.
Pubblicazione: (2024)
Multi-Event Triggers for Serverless Computing
di: Carl, Natalie, et al.
Pubblicazione: (2025)
di: Carl, Natalie, et al.
Pubblicazione: (2025)
The National Research Platform: Stretched, Multi-Tenant, Scientific Kubernetes Cluster
di: Weitzel, Derek, et al.
Pubblicazione: (2025)
di: Weitzel, Derek, et al.
Pubblicazione: (2025)
Orchestrating the Execution of Serverless Functions in Hybrid Clouds
di: Peri, Aristotelis, et al.
Pubblicazione: (2024)
di: Peri, Aristotelis, et al.
Pubblicazione: (2024)
Equilibria: Fair Multi-Tenant CXL Memory Tiering At Scale
di: Zhao, Kaiyang, et al.
Pubblicazione: (2026)
di: Zhao, Kaiyang, et al.
Pubblicazione: (2026)
MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service
di: Yu, Timothy Tin Long, et al.
Pubblicazione: (2026)
di: Yu, Timothy Tin Long, et al.
Pubblicazione: (2026)
MUSE: Multi-Tenant Model Serving With Seamless Model Updates
di: Correia, Cláudio, et al.
Pubblicazione: (2026)
di: Correia, Cláudio, et al.
Pubblicazione: (2026)
Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs
di: Ng, Nathan, et al.
Pubblicazione: (2026)
di: Ng, Nathan, et al.
Pubblicazione: (2026)
Delta Fair Sharing: Performance Isolation for Multi-Tenant Storage Systems
di: Griggs, Tyler, et al.
Pubblicazione: (2026)
di: Griggs, Tyler, et al.
Pubblicazione: (2026)
Multi Armed Bandit Algorithms Based Virtual Machine Allocation Policy for Security in Multi-Tenant Distributed Systems
di: Patil, Pravin, et al.
Pubblicazione: (2024)
di: Patil, Pravin, et al.
Pubblicazione: (2024)
ALock: Asymmetric Lock Primitive for RDMA Systems
di: Baran, Amanda, et al.
Pubblicazione: (2024)
di: Baran, Amanda, et al.
Pubblicazione: (2024)
Token Management in Multi-Tenant AI Inference Platforms
di: Cunningham, William J.
Pubblicazione: (2026)
di: Cunningham, William J.
Pubblicazione: (2026)
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
di: Pathak, Prashant Kumar, et al.
Pubblicazione: (2026)
di: Pathak, Prashant Kumar, et al.
Pubblicazione: (2026)
Curator: Efficient Indexing for Multi-Tenant Vector Databases
di: Jin, Yicheng, et al.
Pubblicazione: (2024)
di: Jin, Yicheng, et al.
Pubblicazione: (2024)
Towards Seamless Serverless Computing Across an Edge-Cloud Continuum
di: Simion, Emilian, et al.
Pubblicazione: (2024)
di: Simion, Emilian, et al.
Pubblicazione: (2024)
FaasMeter: Energy-First Serverless Computing
di: Rehman, Abdul, et al.
Pubblicazione: (2024)
di: Rehman, Abdul, et al.
Pubblicazione: (2024)
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
di: Luo, Yizhou, et al.
Pubblicazione: (2024)
di: Luo, Yizhou, et al.
Pubblicazione: (2024)
Towards Efficient and Scalable Distributed Vector Search with RDMA
di: Zhi, Xiangyu, et al.
Pubblicazione: (2025)
di: Zhi, Xiangyu, et al.
Pubblicazione: (2025)
RDMA-Based Algorithms for Sparse Matrix Multiplication on GPUs
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
MuxTune: Efficient Multi-Task LLM Fine-Tuning in Multi-Tenant Datacenters via Spatial-Temporal Backbone Multiplexing
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
Tutorial: Object as a Service (OaaS) Serverless Cloud Computing Paradigm
di: Lertpongrujikorn, Pawissanutt, et al.
Pubblicazione: (2024)
di: Lertpongrujikorn, Pawissanutt, et al.
Pubblicazione: (2024)
Reimagining RDMA Through the Lens of ML
di: Warraich, Ertza, et al.
Pubblicazione: (2025)
di: Warraich, Ertza, et al.
Pubblicazione: (2025)
Kumo: A Security-Focused Serverless Cloud Simulator
di: Shao, Wei, et al.
Pubblicazione: (2026)
di: Shao, Wei, et al.
Pubblicazione: (2026)
fabric-lib: RDMA Point-to-Point Communication for LLM Systems
di: Licker, Nandor, et al.
Pubblicazione: (2025)
di: Licker, Nandor, et al.
Pubblicazione: (2025)
The Semantic Arrow of Time, Part III: RDMA and the Completion Fallacy
di: Borrill, Paul
Pubblicazione: (2026)
di: Borrill, Paul
Pubblicazione: (2026)
DDS: DPU-optimized Disaggregated Storage [Extended Report]
di: Zhang, Qizhen, et al.
Pubblicazione: (2024)
di: Zhang, Qizhen, et al.
Pubblicazione: (2024)
THEMIS: Time, Heterogeneity, and Energy Minded Scheduling for Fair Multi-Tenant Use in FPGAs
di: Karabulut, Emre, et al.
Pubblicazione: (2024)
di: Karabulut, Emre, et al.
Pubblicazione: (2024)
Ecomap: Sustainability-Driven Optimization of Multi-Tenant DNN Execution on Edge Servers
di: Paramanayakam, Varatheepan, et al.
Pubblicazione: (2025)
di: Paramanayakam, Varatheepan, et al.
Pubblicazione: (2025)
FedRDMA: Communication-Efficient Cross-Silo Federated LLM via Chunked RDMA Transmission
di: Zhang, Zeling, et al.
Pubblicazione: (2024)
di: Zhang, Zeling, et al.
Pubblicazione: (2024)
ICPS: Real-Time Resource Configuration for Cloud Serverless Functions Considering Affinity
di: Chen, Long, et al.
Pubblicazione: (2025)
di: Chen, Long, et al.
Pubblicazione: (2025)
SeBS-Flow: Benchmarking Serverless Cloud Function Workflows
di: Schmid, Larissa, et al.
Pubblicazione: (2024)
di: Schmid, Larissa, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Closing the HPC-Cloud Convergence Gap: Multi-Tenant Slingshot RDMA for Kubernetes
di: Friese, Philipp A., et al.
Pubblicazione: (2025) -
LIFL: A Lightweight, Event-driven Serverless Platform for Federated Learning
di: Qi, Shixiong, et al.
Pubblicazione: (2024) -
Caching Aided Multi-Tenant Serverless Computing
di: Qiao, Chu, et al.
Pubblicazione: (2024) -
Making MoE-based LLM Inference Resilient with Tarragon
di: Zhang, Songyu, et al.
Pubblicazione: (2026) -
Trabant: A Serverless Architecture for Multi-Tenant Orbital Edge Computing
di: Pfandzelter, Tobias, et al.
Pubblicazione: (2025)