Hestia: Hyperthread-Level Scheduling for Cloud Microservices with Interference-Aware Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Dingyu, Kong, Fanyong, Dai, Jie, Qian, Shiyou, Li, Shuangwei, Cao, Jian, Xue, Guangtao, Chen, Gang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Interference of Microservices with a Scoring Mechanism in Large-scale Clusters
di: Yang, Dingyu, et al.
Pubblicazione: (2024)
di: Yang, Dingyu, et al.
Pubblicazione: (2024)
Humas: A Heterogeneity- and Upgrade-aware Microservice Auto-scaling Framework in Large-scale Data Centers
di: Hua, Qin, et al.
Pubblicazione: (2024)
di: Hua, Qin, et al.
Pubblicazione: (2024)
MOPAR: A Model Partitioning Framework for Deep Learning Inference Services on Serverless Platforms
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management
di: Duan, Jiaang, et al.
Pubblicazione: (2025)
di: Duan, Jiaang, et al.
Pubblicazione: (2025)
Service-Level Energy Modeling and Experimentation for Cloud-Native Microservices
di: Legler, Julian, et al.
Pubblicazione: (2025)
di: Legler, Julian, et al.
Pubblicazione: (2025)
A Decentralized Microservice Scheduling Approach Using Service Mesh in Cloud-Edge Systems
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
Artifact for Service-Level Energy Modeling and Experimentation for Cloud-Native Microservices
di: Legler, Julian
Pubblicazione: (2026)
di: Legler, Julian
Pubblicazione: (2026)
Metric Criticality Identification for Cloud Microservices
di: Singal, Akanksha, et al.
Pubblicazione: (2025)
di: Singal, Akanksha, et al.
Pubblicazione: (2025)
HGraphScale: Hierarchical Graph Learning for Autoscaling Microservice Applications in Container-based Cloud Computing
di: Fang, Zhengxin, et al.
Pubblicazione: (2025)
di: Fang, Zhengxin, et al.
Pubblicazione: (2025)
iDynamics: A Configurable Emulation Framework for Evaluating Microservice Scheduling Policies under Controllable Cloud-Edge Dynamics
di: Chen, Ming, et al.
Pubblicazione: (2025)
di: Chen, Ming, et al.
Pubblicazione: (2025)
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
di: Song, Shengye, et al.
Pubblicazione: (2025)
di: Song, Shengye, et al.
Pubblicazione: (2025)
REACH: Reinforcement Learning for Adaptive Microservice Rescheduling in the Cloud-Edge Continuum
di: Bai, Xu, et al.
Pubblicazione: (2025)
di: Bai, Xu, et al.
Pubblicazione: (2025)
Failure-Resilient and Carbon-Efficient Deployment of Microservices over the Cloud-Edge Continuum
di: Ponce, Francisco, et al.
Pubblicazione: (2026)
di: Ponce, Francisco, et al.
Pubblicazione: (2026)
Hotspot-Aware Scheduling of Virtual Machines with Overcommitment for Ultimate Utilization in Cloud Datacenters
di: Wu, Jiaxi, et al.
Pubblicazione: (2026)
di: Wu, Jiaxi, et al.
Pubblicazione: (2026)
Carbon-Aware Microservice Deployment for Optimal User Experience on a Budget
di: Kreutz, Kevin, et al.
Pubblicazione: (2025)
di: Kreutz, Kevin, et al.
Pubblicazione: (2025)
Modular Foundation Model Inference at the Edge: Network-Aware Microservice Optimization
di: Zhu, Juan, et al.
Pubblicazione: (2026)
di: Zhu, Juan, et al.
Pubblicazione: (2026)
Seer: Proactive Revenue-Aware Scheduling for Live Streaming Services in Crowdsourced Cloud-Edge Platforms
di: Huang, Shaoyuan, et al.
Pubblicazione: (2024)
di: Huang, Shaoyuan, et al.
Pubblicazione: (2024)
Scene-Aware Latency Estimation for Microservices via Multi-Scale Graph Fusion
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
Deep Reinforcement Learning-based Methods for Resource Scheduling in Cloud Computing: A Review and Future Directions
di: Zhou, Guangyao, et al.
Pubblicazione: (2021)
di: Zhou, Guangyao, et al.
Pubblicazione: (2021)
An Elastic Job Scheduler for HPC Applications on the Cloud
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
Efficient Probabilistic Workflow Scheduling for IaaS Clouds
di: Russo, Gabriele Russo, et al.
Pubblicazione: (2024)
di: Russo, Gabriele Russo, et al.
Pubblicazione: (2024)
Joint Temporal-Structural Representation Learning for Distributed Fault Discrimination in Microservice Architectures
di: Xue, Yihan, et al.
Pubblicazione: (2026)
di: Xue, Yihan, et al.
Pubblicazione: (2026)
Eva: Cost-Efficient Cloud-Based Cluster Scheduling
di: Chang, Tzu-Tao, et al.
Pubblicazione: (2025)
di: Chang, Tzu-Tao, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review
di: Gu, Yan, et al.
Pubblicazione: (2025)
di: Gu, Yan, et al.
Pubblicazione: (2025)
EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning
di: Xu, Zhifei, et al.
Pubblicazione: (2025)
di: Xu, Zhifei, et al.
Pubblicazione: (2025)
Understanding GPU Resource Interference One Level Deeper
di: Elvinger, Paul, et al.
Pubblicazione: (2025)
di: Elvinger, Paul, et al.
Pubblicazione: (2025)
Analytically-Driven Resource Management for Cloud-Native Microservices
di: Zhang, Yanqi, et al.
Pubblicazione: (2024)
di: Zhang, Yanqi, et al.
Pubblicazione: (2024)
Synthetic Time Series for Anomaly Detection in Cloud Microservices
di: Allam, Mohamed, et al.
Pubblicazione: (2024)
di: Allam, Mohamed, et al.
Pubblicazione: (2024)
CASA: A Framework for SLO and Carbon-Aware Autoscaling and Scheduling in Serverless Cloud Computing
di: Qi, S., et al.
Pubblicazione: (2024)
di: Qi, S., et al.
Pubblicazione: (2024)
Minimizing Energy in Reliability and Deadline-Ensured Workflow Scheduling in Cloud
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
di: Sarkar, Suvarthi, et al.
Pubblicazione: (2025)
CascadeInfer: Length-Aware Scheduling of LLM Serving with Low Latency and Load Balancing
di: Yuan, Yitao, et al.
Pubblicazione: (2025)
di: Yuan, Yitao, et al.
Pubblicazione: (2025)
CarbonFlex: Enabling Carbon-aware Provisioning and Scheduling for Cloud Clusters
di: Hanafy, Walid A., et al.
Pubblicazione: (2025)
di: Hanafy, Walid A., et al.
Pubblicazione: (2025)
Signalling Health for Improved Kubernetes Microservice Availability
di: Roberts, Jacob, et al.
Pubblicazione: (2025)
di: Roberts, Jacob, et al.
Pubblicazione: (2025)
Self-adaptive, Requirements-driven Autoscaling of Microservices
di: Nunes, João Paulo Karol Santos, et al.
Pubblicazione: (2024)
di: Nunes, João Paulo Karol Santos, et al.
Pubblicazione: (2024)
NotNets: Accelerating Microservices by Bypassing the Network
di: Alvaro, Peter, et al.
Pubblicazione: (2024)
di: Alvaro, Peter, et al.
Pubblicazione: (2024)
Learning to Schedule: A Supervised Learning Framework for Network-Aware Scheduling of Data-Intensive Workloads
di: Timilsina, Sankalpa, et al.
Pubblicazione: (2025)
di: Timilsina, Sankalpa, et al.
Pubblicazione: (2025)
TAPAS: Thermal- and Power-Aware Scheduling for LLM Inference in Cloud Platforms
di: Stojkovic, Jovan, et al.
Pubblicazione: (2025)
di: Stojkovic, Jovan, et al.
Pubblicazione: (2025)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
di: Raj, Suman, et al.
Pubblicazione: (2024)
di: Raj, Suman, et al.
Pubblicazione: (2024)
A Survey on Scheduling Techniques in the Edge Cloud: Issues, Challenges and Future Directions
di: Asghar, Hassan, et al.
Pubblicazione: (2022)
di: Asghar, Hassan, et al.
Pubblicazione: (2022)
A Poly-Log Approximation for Transaction Scheduling in Fog-Cloud Computing and Beyond
di: Adhikari, Ramesh, et al.
Pubblicazione: (2025)
di: Adhikari, Ramesh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mitigating Interference of Microservices with a Scoring Mechanism in Large-scale Clusters
di: Yang, Dingyu, et al.
Pubblicazione: (2024) -
Humas: A Heterogeneity- and Upgrade-aware Microservice Auto-scaling Framework in Large-scale Data Centers
di: Hua, Qin, et al.
Pubblicazione: (2024) -
MOPAR: A Model Partitioning Framework for Deep Learning Inference Services on Serverless Platforms
di: Duan, Jiaang, et al.
Pubblicazione: (2024) -
GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management
di: Duan, Jiaang, et al.
Pubblicazione: (2025) -
Service-Level Energy Modeling and Experimentation for Cloud-Native Microservices
di: Legler, Julian, et al.
Pubblicazione: (2025)