StatuScale: Status-aware and Elastic Scaling Strategy for Microservice Applications
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Linfeng, Xu, Minxian, Gill, Sukhpal Singh, Hilman, Muhammad Hafizhuddin, Srirama, Satish Narayana, Ye, Kejiang, Xu, Chengzhong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MSARS: A Meta-Learning and Reinforcement Learning Framework for SLO Resource Allocation and Adaptive Scaling for Microservices
di: Hu, Kan, et al.
Pubblicazione: (2024)
di: Hu, Kan, et al.
Pubblicazione: (2024)
LSRAM: A Lightweight Autoscaling and SLO Resource Allocation Framework for Microservices Based on Gradient Descent
di: Hu, Kan, et al.
Pubblicazione: (2024)
di: Hu, Kan, et al.
Pubblicazione: (2024)
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
di: Xu, Minxian, et al.
Pubblicazione: (2025)
di: Xu, Minxian, et al.
Pubblicazione: (2025)
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
di: Srirama, Satish Narayana
Pubblicazione: (2024)
di: Srirama, Satish Narayana
Pubblicazione: (2024)
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
di: Song, Shengye, et al.
Pubblicazione: (2025)
di: Song, Shengye, et al.
Pubblicazione: (2025)
An Interference-aware Approach for Co-located Container Orchestration with Novel Metric
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
TempoScale: A Cloud Workloads Prediction Approach Integrating Short-Term and Long-Term Information
di: Wen, Linfeng, et al.
Pubblicazione: (2024)
di: Wen, Linfeng, et al.
Pubblicazione: (2024)
Unlock the Potential of Fine-grained LLM Serving via Dynamic Module Scaling
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
di: Wu, Jingfeng, et al.
Pubblicazione: (2025)
Collaborative Resource Management and Workloads Scheduling in Cloud-Assisted Mobile Edge Computing across Timescales
di: Tang, Lujie, et al.
Pubblicazione: (2024)
di: Tang, Lujie, et al.
Pubblicazione: (2024)
BrownoutServe: SLO-Aware Inference Serving under Bursty Workloads for MoE-based LLMs
di: Hu, Jianmin, et al.
Pubblicazione: (2025)
di: Hu, Jianmin, et al.
Pubblicazione: (2025)
Fog enabled distributed training architecture for federated learning
di: Kumar, Aditya, et al.
Pubblicazione: (2024)
di: Kumar, Aditya, et al.
Pubblicazione: (2024)
DRPC: Distributed Reinforcement Learning Approach for Scalable Resource Provisioning in Container-based Clusters
di: Bai, Haoyu, et al.
Pubblicazione: (2024)
di: Bai, Haoyu, et al.
Pubblicazione: (2024)
CloudNativeSim: a toolkit for modeling and simulation of cloud-native applications
di: Wu, Jingfeng, et al.
Pubblicazione: (2024)
di: Wu, Jingfeng, et al.
Pubblicazione: (2024)
Autonomic Cloud Computing: Research Perspective
di: Gill, Sukhpal Singh
Pubblicazione: (2015)
di: Gill, Sukhpal Singh
Pubblicazione: (2015)
Cloud Native System for LLM Inference Serving
di: Xu, Minxian, et al.
Pubblicazione: (2025)
di: Xu, Minxian, et al.
Pubblicazione: (2025)
UELLM: A Unified and Efficient Approach for LLM Inference Serving
di: He, Yiyuan, et al.
Pubblicazione: (2024)
di: He, Yiyuan, et al.
Pubblicazione: (2024)
DOPD: A Dynamic PD-Disaggregation Architecture for Maximizing Goodput in LLM Inference Serving
di: Liao, Junhan, et al.
Pubblicazione: (2025)
di: Liao, Junhan, et al.
Pubblicazione: (2025)
Computing: Looking Back and Moving Forward
di: Golec, Muhammed, et al.
Pubblicazione: (2024)
di: Golec, Muhammed, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning (DRL)-based Methods for Serverless Stream Processing Engines: A Vision, Architectural Elements, and Future Directions
di: Read, Maria R., et al.
Pubblicazione: (2024)
di: Read, Maria R., et al.
Pubblicazione: (2024)
Cloud-native and Distributed Systems for Efficient and Scalable Large Language Models -- A Research Agenda
di: Xu, Minxian, et al.
Pubblicazione: (2026)
di: Xu, Minxian, et al.
Pubblicazione: (2026)
DeF-DReL: Systematic Deployment of Serverless Functions in Fog and Cloud environments using Deep Reinforcement Learning
di: Dehury, Chinmaya Kumar, et al.
Pubblicazione: (2021)
di: Dehury, Chinmaya Kumar, et al.
Pubblicazione: (2021)
ORACL: Optimized Reasoning for Autoscaling via Chain of Thought with LLMs for Microservices
di: Bai, Haoyu, et al.
Pubblicazione: (2026)
di: Bai, Haoyu, et al.
Pubblicazione: (2026)
COUNTER: Cluster GCN based Energy Efficient Resource Management for Sustainable Cloud Computing Environments
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
SealOS+: A Sealos-based Approach for Adaptive Resource Optimization Under Dynamic Workloads for Securities Trading System
di: Jia, Haojie, et al.
Pubblicazione: (2025)
di: Jia, Haojie, et al.
Pubblicazione: (2025)
TD3-Sched: Learning to Orchestrate Container-based Cloud-Edge Resources via Distributed Reinforcement Learning
di: Song, Shengye, et al.
Pubblicazione: (2025)
di: Song, Shengye, et al.
Pubblicazione: (2025)
BanaServe: Unified KV Cache and Dynamic Module Migration for Balancing Disaggregated LLM Serving in AI Infrastructure
di: He, Yiyuan, et al.
Pubblicazione: (2025)
di: He, Yiyuan, et al.
Pubblicazione: (2025)
BucketServe: Bucket-Based Dynamic Batching for Smart and Efficient LLM Inference Serving
di: Zheng, Wanyi, et al.
Pubblicazione: (2025)
di: Zheng, Wanyi, et al.
Pubblicazione: (2025)
FlexPipe: Adapting Dynamic LLM Serving Through Inflight Pipeline Refactoring in Fragmented Serverless Clusters
di: Lin, Yanying, et al.
Pubblicazione: (2025)
di: Lin, Yanying, et al.
Pubblicazione: (2025)
Edge AI: A Taxonomy, Systematic Review and Future Directions
di: Gill, Sukhpal Singh, et al.
Pubblicazione: (2024)
di: Gill, Sukhpal Singh, et al.
Pubblicazione: (2024)
QAISim: A Toolkit for Modeling and Simulation of AI in Quantum Cloud Computing Environments
di: Singh, Irwindeep, et al.
Pubblicazione: (2025)
di: Singh, Irwindeep, et al.
Pubblicazione: (2025)
Bridging Memory Gaps: Scaling Federated Learning for Heterogeneous Clients
di: Wu, Yebo, et al.
Pubblicazione: (2024)
di: Wu, Yebo, et al.
Pubblicazione: (2024)
Resilient Auto-Scaling of Microservice Architectures with Efficient Resource Management
di: Ahmad, Hussain, et al.
Pubblicazione: (2025)
di: Ahmad, Hussain, et al.
Pubblicazione: (2025)
Collaborative Evolution of Intelligent Agents in Large-Scale Microservice Systems
di: Li, Yilin, et al.
Pubblicazione: (2025)
di: Li, Yilin, et al.
Pubblicazione: (2025)
Flare: Leveraging Serverless Elasticity to Absorb Microservice Load Spikes
di: Dehigama, Dilina, et al.
Pubblicazione: (2026)
di: Dehigama, Dilina, et al.
Pubblicazione: (2026)
Cold Start Latency in Serverless Computing: A Systematic Review, Taxonomy, and Future Directions
di: Golec, Muhammed, et al.
Pubblicazione: (2023)
di: Golec, Muhammed, et al.
Pubblicazione: (2023)
Complexity at Scale: A Quantitative Analysis of an Alibaba Microservice Deployment
di: Winchester, Giles, et al.
Pubblicazione: (2025)
di: Winchester, Giles, et al.
Pubblicazione: (2025)
Energy-aware Distributed Microservice Request Placement at the Edge
di: Toczé, Klervie, et al.
Pubblicazione: (2024)
di: Toczé, Klervie, et al.
Pubblicazione: (2024)
Scene-Aware Latency Estimation for Microservices via Multi-Scale Graph Fusion
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
Beyond Microservices: Testing Web-Scale RCA Methods on GPU-Driven LLM Workloads
di: Scheinert, Dominik, et al.
Pubblicazione: (2026)
di: Scheinert, Dominik, et al.
Pubblicazione: (2026)
ElasticMoE: An Efficient Auto Scaling Method for Mixture-of-Experts Models
di: Singh, Gursimran, et al.
Pubblicazione: (2025)
di: Singh, Gursimran, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MSARS: A Meta-Learning and Reinforcement Learning Framework for SLO Resource Allocation and Adaptive Scaling for Microservices
di: Hu, Kan, et al.
Pubblicazione: (2024) -
LSRAM: A Lightweight Autoscaling and SLO Resource Allocation Framework for Microservices Based on Gradient Descent
di: Hu, Kan, et al.
Pubblicazione: (2024) -
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
di: Xu, Minxian, et al.
Pubblicazione: (2025) -
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
di: Srirama, Satish Narayana
Pubblicazione: (2024) -
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
di: Song, Shengye, et al.
Pubblicazione: (2025)