Humas: A Heterogeneity- and Upgrade-aware Microservice Auto-scaling Framework in Large-scale Data Centers
Fuente:
arXiv
Salvato in:
| Autori principali: | Hua, Qin, Yang, Dingyu, Qian, Shiyou, Cao, Jian, Xue, Guangtao, Li, Minglu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Interference of Microservices with a Scoring Mechanism in Large-scale Clusters
di: Yang, Dingyu, et al.
Pubblicazione: (2024)
di: Yang, Dingyu, et al.
Pubblicazione: (2024)
Hestia: Hyperthread-Level Scheduling for Cloud Microservices with Interference-Aware Attention
di: Yang, Dingyu, et al.
Pubblicazione: (2026)
di: Yang, Dingyu, et al.
Pubblicazione: (2026)
MOPAR: A Model Partitioning Framework for Deep Learning Inference Services on Serverless Platforms
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management
di: Duan, Jiaang, et al.
Pubblicazione: (2025)
di: Duan, Jiaang, et al.
Pubblicazione: (2025)
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
di: Xu, Minxian, et al.
Pubblicazione: (2025)
di: Xu, Minxian, et al.
Pubblicazione: (2025)
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
di: Song, Shengye, et al.
Pubblicazione: (2025)
di: Song, Shengye, et al.
Pubblicazione: (2025)
HAS-GPU: Efficient Hybrid Auto-scaling with Fine-grained GPU Allocation for SLO-aware Serverless Inferences
di: Gu, Jianfeng, et al.
Pubblicazione: (2025)
di: Gu, Jianfeng, et al.
Pubblicazione: (2025)
Resilient Auto-Scaling of Microservice Architectures with Efficient Resource Management
di: Ahmad, Hussain, et al.
Pubblicazione: (2025)
di: Ahmad, Hussain, et al.
Pubblicazione: (2025)
Energy-aware Distributed Microservice Request Placement at the Edge
di: Toczé, Klervie, et al.
Pubblicazione: (2024)
di: Toczé, Klervie, et al.
Pubblicazione: (2024)
Literature Study on Operational Data Analytics Frameworks in Large-scale Computing Infrastructures
di: Suman, Shekhar, et al.
Pubblicazione: (2026)
di: Suman, Shekhar, et al.
Pubblicazione: (2026)
STaleX: A Spatiotemporal-Aware Adaptive Auto-scaling Framework for Microservices
di: Dashtbani, Majid, et al.
Pubblicazione: (2025)
di: Dashtbani, Majid, et al.
Pubblicazione: (2025)
StatuScale: Status-aware and Elastic Scaling Strategy for Microservice Applications
di: Wen, Linfeng, et al.
Pubblicazione: (2024)
di: Wen, Linfeng, et al.
Pubblicazione: (2024)
Fantasy: Efficient Large-scale Vector Search on GPU Clusters with GPUDirect Async
di: Liu, Yi, et al.
Pubblicazione: (2025)
di: Liu, Yi, et al.
Pubblicazione: (2025)
Towards Cloud Efficiency with Large-scale Workload Characterization
di: Parayil, Anjaly, et al.
Pubblicazione: (2024)
di: Parayil, Anjaly, et al.
Pubblicazione: (2024)
MoEntwine: Unleashing the Potential of Wafer-scale Chips for Large-scale Expert Parallel Inference
di: Tang, Xinru, et al.
Pubblicazione: (2025)
di: Tang, Xinru, et al.
Pubblicazione: (2025)
A Hybrid Reactive-Proactive Auto-scaling Algorithm for SLA-Constrained Edge Computing
di: Gupta, Suhrid, et al.
Pubblicazione: (2025)
di: Gupta, Suhrid, et al.
Pubblicazione: (2025)
Blockchain and Edge Computing Nexus: A Large-scale Systematic Literature Review
di: Nezami, Zeinab, et al.
Pubblicazione: (2025)
di: Nezami, Zeinab, et al.
Pubblicazione: (2025)
Collaborative Evolution of Intelligent Agents in Large-Scale Microservice Systems
di: Li, Yilin, et al.
Pubblicazione: (2025)
di: Li, Yilin, et al.
Pubblicazione: (2025)
Hummingbird: SLO-Oriented GPU Preemption at Microsecond-scale
di: Hu, Tiancheng, et al.
Pubblicazione: (2026)
di: Hu, Tiancheng, et al.
Pubblicazione: (2026)
BSODiag: A Global Diagnosis Framework for Batch Servers Outage in Large-scale Cloud Infrastructure Systems
di: Duan, Tao, et al.
Pubblicazione: (2025)
di: Duan, Tao, et al.
Pubblicazione: (2025)
Joint Temporal-Structural Representation Learning for Distributed Fault Discrimination in Microservice Architectures
di: Xue, Yihan, et al.
Pubblicazione: (2026)
di: Xue, Yihan, et al.
Pubblicazione: (2026)
SageServe: Optimizing LLM Serving on Cloud Data Centers with Forecast Aware Auto-Scaling
di: Jaiswal, Shashwat, et al.
Pubblicazione: (2025)
di: Jaiswal, Shashwat, et al.
Pubblicazione: (2025)
PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training
di: Fang, Jiahao, et al.
Pubblicazione: (2024)
di: Fang, Jiahao, et al.
Pubblicazione: (2024)
HuntMS: A Framework for Microservice Geo-Distribution for Carbon and Cost Reduction
di: Christofidi, Georgia, et al.
Pubblicazione: (2026)
di: Christofidi, Georgia, et al.
Pubblicazione: (2026)
SAF: Scalable Acceleration Framework for dynamic and flexible scaling of FPGAs
di: Quraishi, Masudul Hassan, et al.
Pubblicazione: (2025)
di: Quraishi, Masudul Hassan, et al.
Pubblicazione: (2025)
LEISA: A Scalable Microservice-based System for Efficient Livestock Data Sharing
di: Habib, Mahir, et al.
Pubblicazione: (2025)
di: Habib, Mahir, et al.
Pubblicazione: (2025)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
GPU-Accelerated Distributed QAOA on Large-scale HPC Ecosystems
di: Xu, Zhihao, et al.
Pubblicazione: (2025)
di: Xu, Zhihao, et al.
Pubblicazione: (2025)
Malleus: Straggler-Resilient Hybrid Parallel Training of Large-scale Models via Malleable Data and Model Parallelization
di: Li, Haoyang, et al.
Pubblicazione: (2024)
di: Li, Haoyang, et al.
Pubblicazione: (2024)
An Upload-Efficient Scheme for Transferring Knowledge From a Server-Side Pre-trained Generator to Clients in Heterogeneous Federated Learning
di: Zhang, Jianqing, et al.
Pubblicazione: (2024)
di: Zhang, Jianqing, et al.
Pubblicazione: (2024)
Cost-aware Duration Prediction for Software Upgrades in Datacenters
di: Ding, Yi, et al.
Pubblicazione: (2022)
di: Ding, Yi, et al.
Pubblicazione: (2022)
Metric Criticality Identification for Cloud Microservices
di: Singal, Akanksha, et al.
Pubblicazione: (2025)
di: Singal, Akanksha, et al.
Pubblicazione: (2025)
Harmonic Decomposition in Data Sketches
di: Wang, Dingyu
Pubblicazione: (2024)
di: Wang, Dingyu
Pubblicazione: (2024)
MOSS: A Large-scale Open Microscopic Traffic Simulation System
di: Zhang, Jun, et al.
Pubblicazione: (2024)
di: Zhang, Jun, et al.
Pubblicazione: (2024)
LSRAM: A Lightweight Autoscaling and SLO Resource Allocation Framework for Microservices Based on Gradient Descent
di: Hu, Kan, et al.
Pubblicazione: (2024)
di: Hu, Kan, et al.
Pubblicazione: (2024)
An Efficient, Reliable and Observable Collective Communication Library in Large-scale GPU Training Clusters
di: Zhang, Mingjun, et al.
Pubblicazione: (2025)
di: Zhang, Mingjun, et al.
Pubblicazione: (2025)
Signalling Health for Improved Kubernetes Microservice Availability
di: Roberts, Jacob, et al.
Pubblicazione: (2025)
di: Roberts, Jacob, et al.
Pubblicazione: (2025)
Self-adaptive, Requirements-driven Autoscaling of Microservices
di: Nunes, João Paulo Karol Santos, et al.
Pubblicazione: (2024)
di: Nunes, João Paulo Karol Santos, et al.
Pubblicazione: (2024)
NotNets: Accelerating Microservices by Bypassing the Network
di: Alvaro, Peter, et al.
Pubblicazione: (2024)
di: Alvaro, Peter, et al.
Pubblicazione: (2024)
Towards the Distributed Large-scale k-NN Graph Construction by Graph Merge
di: Zhang, Cheng, et al.
Pubblicazione: (2025)
di: Zhang, Cheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mitigating Interference of Microservices with a Scoring Mechanism in Large-scale Clusters
di: Yang, Dingyu, et al.
Pubblicazione: (2024) -
Hestia: Hyperthread-Level Scheduling for Cloud Microservices with Interference-Aware Attention
di: Yang, Dingyu, et al.
Pubblicazione: (2026) -
MOPAR: A Model Partitioning Framework for Deep Learning Inference Services on Serverless Platforms
di: Duan, Jiaang, et al.
Pubblicazione: (2024) -
GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management
di: Duan, Jiaang, et al.
Pubblicazione: (2025) -
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
di: Xu, Minxian, et al.
Pubblicazione: (2025)