TD3-Sched: Learning to Orchestrate Container-based Cloud-Edge Resources via Distributed Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Shengye, Xu, Minxian, Hu, Kan, Guo, Wenxia, Ye, Kejiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DRPC: Distributed Reinforcement Learning Approach for Scalable Resource Provisioning in Container-based Clusters
par: Bai, Haoyu, et autres
Publié: (2024)
par: Bai, Haoyu, et autres
Publié: (2024)
MSARS: A Meta-Learning and Reinforcement Learning Framework for SLO Resource Allocation and Adaptive Scaling for Microservices
par: Hu, Kan, et autres
Publié: (2024)
par: Hu, Kan, et autres
Publié: (2024)
An Interference-aware Approach for Co-located Container Orchestration with Novel Metric
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Collaborative Resource Management and Workloads Scheduling in Cloud-Assisted Mobile Edge Computing across Timescales
par: Tang, Lujie, et autres
Publié: (2024)
par: Tang, Lujie, et autres
Publié: (2024)
LSRAM: A Lightweight Autoscaling and SLO Resource Allocation Framework for Microservices Based on Gradient Descent
par: Hu, Kan, et autres
Publié: (2024)
par: Hu, Kan, et autres
Publié: (2024)
BucketServe: Bucket-Based Dynamic Batching for Smart and Efficient LLM Inference Serving
par: Zheng, Wanyi, et autres
Publié: (2025)
par: Zheng, Wanyi, et autres
Publié: (2025)
BrownoutServe: SLO-Aware Inference Serving under Bursty Workloads for MoE-based LLMs
par: Hu, Jianmin, et autres
Publié: (2025)
par: Hu, Jianmin, et autres
Publié: (2025)
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
par: Song, Shengye, et autres
Publié: (2025)
par: Song, Shengye, et autres
Publié: (2025)
TempoScale: A Cloud Workloads Prediction Approach Integrating Short-Term and Long-Term Information
par: Wen, Linfeng, et autres
Publié: (2024)
par: Wen, Linfeng, et autres
Publié: (2024)
CloudNativeSim: a toolkit for modeling and simulation of cloud-native applications
par: Wu, Jingfeng, et autres
Publié: (2024)
par: Wu, Jingfeng, et autres
Publié: (2024)
SealOS+: A Sealos-based Approach for Adaptive Resource Optimization Under Dynamic Workloads for Securities Trading System
par: Jia, Haojie, et autres
Publié: (2025)
par: Jia, Haojie, et autres
Publié: (2025)
Cloud Native System for LLM Inference Serving
par: Xu, Minxian, et autres
Publié: (2025)
par: Xu, Minxian, et autres
Publié: (2025)
Unlock the Potential of Fine-grained LLM Serving via Dynamic Module Scaling
par: Wu, Jingfeng, et autres
Publié: (2025)
par: Wu, Jingfeng, et autres
Publié: (2025)
Cloud-native and Distributed Systems for Efficient and Scalable Large Language Models -- A Research Agenda
par: Xu, Minxian, et autres
Publié: (2026)
par: Xu, Minxian, et autres
Publié: (2026)
UELLM: A Unified and Efficient Approach for LLM Inference Serving
par: He, Yiyuan, et autres
Publié: (2024)
par: He, Yiyuan, et autres
Publié: (2024)
DOPD: A Dynamic PD-Disaggregation Architecture for Maximizing Goodput in LLM Inference Serving
par: Liao, Junhan, et autres
Publié: (2025)
par: Liao, Junhan, et autres
Publié: (2025)
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
par: Xu, Minxian, et autres
Publié: (2025)
par: Xu, Minxian, et autres
Publié: (2025)
Evaluating Container Orchestration for Neuromorphic Workloads in Virtual Edge Environments
par: Pham, Huyen, et autres
Publié: (2026)
par: Pham, Huyen, et autres
Publié: (2026)
Resource Slicing through Intelligent Orchestration of Energy-aware IoT services in Edge-Cloud Continuum
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
par: Shahid, Hafiz Faheem, et autres
Publié: (2024)
IsoSched: Preemptive Tile Cascaded Scheduling of Multi-DNN via Subgraph Isomorphism
par: Zhao, Boran, et autres
Publié: (2025)
par: Zhao, Boran, et autres
Publié: (2025)
REACH: Reinforcement Learning for Adaptive Microservice Rescheduling in the Cloud-Edge Continuum
par: Bai, Xu, et autres
Publié: (2025)
par: Bai, Xu, et autres
Publié: (2025)
Scale: Deep Reinforcement Learning for Container Scheduling in Serverless Edge Computing
par: Chen, Chen, et autres
Publié: (2026)
par: Chen, Chen, et autres
Publié: (2026)
SageSched: Efficient LLM Scheduling Confronting Demand Uncertainty and Hybridity
par: Gan, Zhenghao, et autres
Publié: (2026)
par: Gan, Zhenghao, et autres
Publié: (2026)
Deep Reinforcement Learning-based Methods for Resource Scheduling in Cloud Computing: A Review and Future Directions
par: Zhou, Guangyao, et autres
Publié: (2021)
par: Zhou, Guangyao, et autres
Publié: (2021)
StatuScale: Status-aware and Elastic Scaling Strategy for Microservice Applications
par: Wen, Linfeng, et autres
Publié: (2024)
par: Wen, Linfeng, et autres
Publié: (2024)
Distributed Resource Selection for Self-Organising Cloud-Edge Systems
par: Renau, Quentin, et autres
Publié: (2025)
par: Renau, Quentin, et autres
Publié: (2025)
BanaServe: Unified KV Cache and Dynamic Module Migration for Balancing Disaggregated LLM Serving in AI Infrastructure
par: He, Yiyuan, et autres
Publié: (2025)
par: He, Yiyuan, et autres
Publié: (2025)
ReinFog: A Deep Reinforcement Learning Empowered Framework for Resource Management in Edge and Cloud Computing Environments
par: Wang, Zhiyu, et autres
Publié: (2024)
par: Wang, Zhiyu, et autres
Publié: (2024)
Edge AI: A Taxonomy, Systematic Review and Future Directions
par: Gill, Sukhpal Singh, et autres
Publié: (2024)
par: Gill, Sukhpal Singh, et autres
Publié: (2024)
HiRL: Hierarchical Reinforcement Learning for Coordinated Resource Management in Heterogeneous Edge Computing
par: Zhu, Jianyong, et autres
Publié: (2026)
par: Zhu, Jianyong, et autres
Publié: (2026)
LRScheduler: A Layer-aware and Resource-adaptive Container Scheduler in Edge Computing
par: Tang, Zhiqing, et autres
Publié: (2025)
par: Tang, Zhiqing, et autres
Publié: (2025)
Reinforcement Learning based Workflow Scheduling in Cloud and Edge Computing Environments: A Taxonomy, Review and Future Directions
par: Jayanetti, Amanda, et autres
Publié: (2024)
par: Jayanetti, Amanda, et autres
Publié: (2024)
Sustainable Graph Analytics Workload Scheduling with Evolutionary Reinforcement Learning in Edge-Cloud Systems
par: Ramicetty, P., et autres
Publié: (2026)
par: Ramicetty, P., et autres
Publié: (2026)
LLM-Driven Intent-Based Privacy-Aware Orchestration Across the Cloud-Edge Continuum
par: Su, Zijie, et autres
Publié: (2026)
par: Su, Zijie, et autres
Publié: (2026)
Orchestrating Serverless Applications in the Edge Cloud Space Continuum: What Breaks and What is Next?
par: Malazi, Hadi Tabatabaee, et autres
Publié: (2026)
par: Malazi, Hadi Tabatabaee, et autres
Publié: (2026)
Collaborative Multi-Agent Reinforcement Learning Approach for Elastic Cloud Resource Scaling
par: Fang, Bruce, et autres
Publié: (2025)
par: Fang, Bruce, et autres
Publié: (2025)
Distributed Edge Analytics in Edge-Fog-Cloud Continuum
par: Srirama, Satish Narayana
Publié: (2024)
par: Srirama, Satish Narayana
Publié: (2024)
Distributed Load Orchestration for Vision Computing in Multi-Access Edge Computing
par: Boing, Ricardo N., et autres
Publié: (2022)
par: Boing, Ricardo N., et autres
Publié: (2022)
Environmentally-Conscious Cloud Orchestration Considering Geo-Distributed Data Centers
par: Attenni, Giulio, et autres
Publié: (2025)
par: Attenni, Giulio, et autres
Publié: (2025)
Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges
par: Li, Senyao, et autres
Publié: (2025)
par: Li, Senyao, et autres
Publié: (2025)
Documents similaires
-
DRPC: Distributed Reinforcement Learning Approach for Scalable Resource Provisioning in Container-based Clusters
par: Bai, Haoyu, et autres
Publié: (2024) -
MSARS: A Meta-Learning and Reinforcement Learning Framework for SLO Resource Allocation and Adaptive Scaling for Microservices
par: Hu, Kan, et autres
Publié: (2024) -
An Interference-aware Approach for Co-located Container Orchestration with Novel Metric
par: Li, Xiang, et autres
Publié: (2024) -
Collaborative Resource Management and Workloads Scheduling in Cloud-Assisted Mobile Edge Computing across Timescales
par: Tang, Lujie, et autres
Publié: (2024) -
LSRAM: A Lightweight Autoscaling and SLO Resource Allocation Framework for Microservices Based on Gradient Descent
par: Hu, Kan, et autres
Publié: (2024)