Morpheus: Lightweight RTT Prediction for Performance-Aware Load Balancing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Giannakopoulos, Panagiotis, van Knippenberg, Bart, Joshi, Kishor Chandra, Calabretta, Nicola, Exarchakos, George |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accurate Performance Predictors for Edge Computing Applications
par: Giannakopoulos, Panagiotis, et autres
Publié: (2025)
par: Giannakopoulos, Panagiotis, et autres
Publié: (2025)
Morpheus Consensus: Excelling on trails and autobahns
par: Lewis-Pye, Andrew, et autres
Publié: (2025)
par: Lewis-Pye, Andrew, et autres
Publié: (2025)
KnapsackLB: Enabling Performance-Aware Layer-4 Load Balancing
par: Gandhi, Rohan, et autres
Publié: (2024)
par: Gandhi, Rohan, et autres
Publié: (2024)
A Communication- and Memory-Aware Model for Load Balancing Tasks
par: Lifflander, Jonathan, et autres
Publié: (2024)
par: Lifflander, Jonathan, et autres
Publié: (2024)
QEdgeProxy: QoS-Aware Load Balancing for IoT Services in the Computing Continuum
par: Čilić, Ivan, et autres
Publié: (2024)
par: Čilić, Ivan, et autres
Publié: (2024)
SkyWalker: A Locality-Aware Cross-Region Load Balancer for LLM Inference
par: Xia, Tian, et autres
Publié: (2025)
par: Xia, Tian, et autres
Publié: (2025)
CascadeInfer: Length-Aware Scheduling of LLM Serving with Low Latency and Load Balancing
par: Yuan, Yitao, et autres
Publié: (2025)
par: Yuan, Yitao, et autres
Publié: (2025)
S-HPLB: Efficient LLM Attention Serving via Sparsity-Aware Head Parallelism Load Balance
par: Liu, Di, et autres
Publié: (2026)
par: Liu, Di, et autres
Publié: (2026)
Communication-Aware Diffusion Load Balancing for Persistently Interacting Objects
par: Taylor, Maya, et autres
Publié: (2026)
par: Taylor, Maya, et autres
Publié: (2026)
Intelligent Router for LLM Workloads: Improving Performance Through Workload-Aware Load Balancing
par: Jain, Kunal, et autres
Publié: (2024)
par: Jain, Kunal, et autres
Publié: (2024)
Distributed Load Balancing with Workload-Dependent Service Rates
par: Zhang, Wenxin, et autres
Publié: (2024)
par: Zhang, Wenxin, et autres
Publié: (2024)
Fine-grained MoE Load Balancing with Linear Programming
par: Zhao, Chenqi, et autres
Publié: (2025)
par: Zhao, Chenqi, et autres
Publié: (2025)
Review of Hybrid Load Balancing Algorithms in Cloud Computing Environment
par: Ijeoma, Chukwuneke Chiamaka, et autres
Publié: (2022)
par: Ijeoma, Chukwuneke Chiamaka, et autres
Publié: (2022)
Load Balanced Parallel Node Generation for Meshless Numerical Methods
par: Vehovar, Jon, et autres
Publié: (2026)
par: Vehovar, Jon, et autres
Publié: (2026)
Scalable and Performant Data Loading
par: Hira, Moto, et autres
Publié: (2025)
par: Hira, Moto, et autres
Publié: (2025)
Load Balancing in Strongly Inhomogeneous Simulations -- a Vlasiator Case Study
par: Kotipalo, Leo, et autres
Publié: (2025)
par: Kotipalo, Leo, et autres
Publié: (2025)
Slice-Level Scheduling for High Throughput and Load Balanced LLM Serving
par: Cheng, Ke, et autres
Publié: (2024)
par: Cheng, Ke, et autres
Publié: (2024)
Performance Cost Tradeoffs in Intelligent Load Balancing for Multi Data Center Cloud Systems: From Static Policies to Adaptive Resource Distribution
par: Najafabadi, Saeid Aghasoleymani, et autres
Publié: (2025)
par: Najafabadi, Saeid Aghasoleymani, et autres
Publié: (2025)
TD-Orch: Scalable Load-Balancing for Distributed Systems with Applications to Graph Processing
par: Zhao, Yiwei, et autres
Publié: (2025)
par: Zhao, Yiwei, et autres
Publié: (2025)
ReaLB: Real-Time Load Balancing for Multimodal MoE Inference
par: Wang, Yingping, et autres
Publié: (2026)
par: Wang, Yingping, et autres
Publié: (2026)
LB4OMP: A Dynamic Load Balancing Library for Multithreaded Applications
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2021)
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2021)
Inference Load-Aware Orchestration for Hierarchical Federated Learning
par: Lackinger, Anna, et autres
Publié: (2024)
par: Lackinger, Anna, et autres
Publié: (2024)
An Analytical Overview Of Virtual Machine Load Balancing Scheduling Algorithms with their Comparative Case Study
par: Vaidya, Priyank, et autres
Publié: (2025)
par: Vaidya, Priyank, et autres
Publié: (2025)
DualMap: Enabling Both Cache Affinity and Load Balancing for Distributed LLM Serving
par: Yuan, Ying, et autres
Publié: (2026)
par: Yuan, Ying, et autres
Publié: (2026)
AcceLLM: Accelerating LLM Inference using Redundancy for Load Balancing and Data Locality
par: Bournias, Ilias, et autres
Publié: (2024)
par: Bournias, Ilias, et autres
Publié: (2024)
NeutronTP: Load-Balanced Distributed Full-Graph GNN Training with Tensor Parallelism
par: Ai, Xin, et autres
Publié: (2024)
par: Ai, Xin, et autres
Publié: (2024)
(Almost) Perfect Discrete Iterative Load Balancing
par: Berenbrink, Petra, et autres
Publié: (2025)
par: Berenbrink, Petra, et autres
Publié: (2025)
Exploring Dynamic Load Balancing Algorithms for Block-Structured Mesh-and-Particle Simulations in AMReX
par: Nanda, Amitash, et autres
Publié: (2025)
par: Nanda, Amitash, et autres
Publié: (2025)
A Dynamic Approach to Load Balancing in Cloud Infrastructure: Enhancing Energy Efficiency and Resource Utilization
par: Sakib, Shadman, et autres
Publié: (2025)
par: Sakib, Shadman, et autres
Publié: (2025)
FEPLB: Exploiting Copy Engines for Nearly Free MoE Load Balancing in Distributed Training
par: Qi, Shuyao, et autres
Publié: (2026)
par: Qi, Shuyao, et autres
Publié: (2026)
Tackling the Data-Parallel Load Balancing Bottleneck in LLM Serving: Practical Online Routing at Scale
par: Bu, Tianci, et autres
Publié: (2026)
par: Bu, Tianci, et autres
Publié: (2026)
Block: Balancing Load in LLM Serving with Context, Knowledge and Predictive Scheduling
par: Da, Wei, et autres
Publié: (2025)
par: Da, Wei, et autres
Publié: (2025)
TopoSZp: Lightweight Topology-Aware Error-controlled Compression for Scientific Data
par: Agarwal, Tripti, et autres
Publié: (2026)
par: Agarwal, Tripti, et autres
Publié: (2026)
SneakPeek: Data-Aware Model Selection and Scheduling for Inference Serving on the Edge
par: Wolfrath, Joel, et autres
Publié: (2025)
par: Wolfrath, Joel, et autres
Publié: (2025)
A Hierarchical Sharded Blockchain Balancing Performance and Availability
par: Jo, Yongrae, et autres
Publié: (2025)
par: Jo, Yongrae, et autres
Publié: (2025)
Comparative Analysis of Lightweight Kubernetes Distributions for Edge Computing: Performance and Resource Efficiency
par: Yakubov, Diyaz, et autres
Publié: (2025)
par: Yakubov, Diyaz, et autres
Publié: (2025)
Pro-Prophet: A Systematic Load Balancing Method for Efficient Parallel Training of Large-scale MoE Models
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
Load Balancing Using Sparse Communication
par: Mendelson, Gal, et autres
Publié: (2022)
par: Mendelson, Gal, et autres
Publié: (2022)
QoS-Aware Load Balancing in the Computing Continuum via Multi-Player Bandits
par: Čilić, Ivan, et autres
Publié: (2025)
par: Čilić, Ivan, et autres
Publié: (2025)
Load Balancing For High Performance Computing Using Quantum Annealing
par: Rathore, Omer, et autres
Publié: (2024)
par: Rathore, Omer, et autres
Publié: (2024)
Documents similaires
-
Accurate Performance Predictors for Edge Computing Applications
par: Giannakopoulos, Panagiotis, et autres
Publié: (2025) -
Morpheus Consensus: Excelling on trails and autobahns
par: Lewis-Pye, Andrew, et autres
Publié: (2025) -
KnapsackLB: Enabling Performance-Aware Layer-4 Load Balancing
par: Gandhi, Rohan, et autres
Publié: (2024) -
A Communication- and Memory-Aware Model for Load Balancing Tasks
par: Lifflander, Jonathan, et autres
Publié: (2024) -
QEdgeProxy: QoS-Aware Load Balancing for IoT Services in the Computing Continuum
par: Čilić, Ivan, et autres
Publié: (2024)