SkipPredict: When to Invest in Predictions for Scheduling
Fuente:
arXiv
Saved in:
| Main Authors: | Shahout, Rana, Mitzenmacher, Michael |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
From Score Distributions to Balance: Plug-and-Play Mixture-of-Experts Routing
by: Shahout, Rana, et al.
Published: (2025)
by: Shahout, Rana, et al.
Published: (2025)
Deadline-Aware Online Scheduling for LLM Fine-Tuning with Spot Market Predictions
by: Kong, Linggao, et al.
Published: (2025)
by: Kong, Linggao, et al.
Published: (2025)
Prediction-Assisted Online Distributed Deep Learning Workload Scheduling in GPU Clusters
by: Luo, Ziyue, et al.
Published: (2025)
by: Luo, Ziyue, et al.
Published: (2025)
HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference
by: Zhang, Zeyu, et al.
Published: (2025)
by: Zhang, Zeyu, et al.
Published: (2025)
SkipPipe: Partial and Reordered Pipelining Framework for Training LLMs in Heterogeneous Networks
by: Blagoev, Nikolay, et al.
Published: (2025)
by: Blagoev, Nikolay, et al.
Published: (2025)
Predicting Temporal Aspects of Movement for Predictive Replication in Fog Environments
by: Balitzki, Emil, et al.
Published: (2023)
by: Balitzki, Emil, et al.
Published: (2023)
Observation, Not Prediction: Conversation-Level Disaggregated Scheduling for Agentic Serving
by: Ding, Jianru, et al.
Published: (2026)
by: Ding, Jianru, et al.
Published: (2026)
Distributed Recoverable Sketches (Extended Version)
by: Cohen, Diana, et al.
Published: (2025)
by: Cohen, Diana, et al.
Published: (2025)
Learning to Schedule Online Tasks with Bandit Feedback
by: Xu, Yongxin, et al.
Published: (2024)
by: Xu, Yongxin, et al.
Published: (2024)
Scheduling for On-Board Federated Learning with Satellite Clusters
by: Razmi, Nasrin, et al.
Published: (2024)
by: Razmi, Nasrin, et al.
Published: (2024)
Locality-aware Fair Scheduling in LLM Serving
by: Cao, Shiyi, et al.
Published: (2025)
by: Cao, Shiyi, et al.
Published: (2025)
Aryl: An Elastic Cluster Scheduler for Deep Learning
by: Li, Jiamin, et al.
Published: (2022)
by: Li, Jiamin, et al.
Published: (2022)
Cost-aware Duration Prediction for Software Upgrades in Datacenters
by: Ding, Yi, et al.
Published: (2022)
by: Ding, Yi, et al.
Published: (2022)
Federated Aggregation of Mallows Rankings: A Comparative Analysis of Borda and Lehmer Coding
by: Sima, Jin, et al.
Published: (2024)
by: Sima, Jin, et al.
Published: (2024)
When GPUs Fail Quietly: Observability-Aware Early Warning Beyond Numeric Telemetry
by: Bidollahkhani, Michael, et al.
Published: (2026)
by: Bidollahkhani, Michael, et al.
Published: (2026)
Preble: Efficient Distributed Prompt Scheduling for LLM Serving
by: Srivatsa, Vikranth, et al.
Published: (2024)
by: Srivatsa, Vikranth, et al.
Published: (2024)
Averaging Rate Scheduler for Decentralized Learning on Heterogeneous Data
by: Aketi, Sai Aparna, et al.
Published: (2024)
by: Aketi, Sai Aparna, et al.
Published: (2024)
Adaptive Execution Scheduler for DataDios SmartDiff
by: Poduri, Aryan
Published: (2025)
by: Poduri, Aryan
Published: (2025)
Optimal Scheduling Algorithms for LLM Inference: Theory and Practice
by: Bari, Agrim, et al.
Published: (2025)
by: Bari, Agrim, et al.
Published: (2025)
Large Language Model Aided QoS Prediction for Service Recommendation
by: Liu, Huiying, et al.
Published: (2024)
by: Liu, Huiying, et al.
Published: (2024)
AERIS: Argonne Earth Systems Model for Reliable and Skillful Predictions
by: Hatanpää, Väinö, et al.
Published: (2025)
by: Hatanpää, Väinö, et al.
Published: (2025)
ExeGPT: Constraint-Aware Resource Scheduling for LLM Inference
by: Oh, Hyungjun, et al.
Published: (2024)
by: Oh, Hyungjun, et al.
Published: (2024)
Reinforcement Learning for Adaptive Resource Scheduling in Complex System Environments
by: Li, Pochun, et al.
Published: (2024)
by: Li, Pochun, et al.
Published: (2024)
Prioritizing Modalities: Flexible Importance Scheduling in Federated Multimodal Learning
by: Bian, Jieming, et al.
Published: (2024)
by: Bian, Jieming, et al.
Published: (2024)
PecSched: Preemptive and Efficient Cluster Scheduling for LLM Inference
by: Zhang, Zeyu, et al.
Published: (2024)
by: Zhang, Zeyu, et al.
Published: (2024)
Device Scheduling and Assignment in Hierarchical Federated Learning for Internet of Things
by: Zhang, Tinghao, et al.
Published: (2024)
by: Zhang, Tinghao, et al.
Published: (2024)
Semantic-Aware Scheduling for GPU Clusters with Large Language Models
by: Wang, Zerui, et al.
Published: (2025)
by: Wang, Zerui, et al.
Published: (2025)
Semi-decentralized Federated Time Series Prediction with Client Availability Budgets
by: Bao, Yunkai, et al.
Published: (2025)
by: Bao, Yunkai, et al.
Published: (2025)
SMART: A Surrogate Model for Predicting Application Runtime in Dragonfly Systems
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
Parm: Efficient Training of Large Sparsely-Activated Models with Dedicated Schedules
by: Pan, Xinglin, et al.
Published: (2024)
by: Pan, Xinglin, et al.
Published: (2024)
Accelerating AIGC Services with Latent Action Diffusion Scheduling in Edge Networks
by: Xu, Changfu, et al.
Published: (2024)
by: Xu, Changfu, et al.
Published: (2024)
Timeliness-Oriented Scheduling and Resource Allocation in Multi-Region Collaborative Perception
by: Zhu, Mengmeng, et al.
Published: (2026)
by: Zhu, Mengmeng, et al.
Published: (2026)
Communication-Efficient Device Scheduling for Federated Learning Using Lyapunov Optimization
by: Perazzone, Jake B., et al.
Published: (2025)
by: Perazzone, Jake B., et al.
Published: (2025)
DASH: Deterministic Attention Scheduling for High-throughput Reproducible LLM Training
by: Qiang, Xinwei, et al.
Published: (2026)
by: Qiang, Xinwei, et al.
Published: (2026)
Symphony: Optimized DNN Model Serving using Deferred Batch Scheduling
by: Chen, Lequn, et al.
Published: (2023)
by: Chen, Lequn, et al.
Published: (2023)
A Heavy-Load-Enhanced and Changeable-Periodicity-Perceived Workload Prediction Network
by: Chen, Feiyi, et al.
Published: (2023)
by: Chen, Feiyi, et al.
Published: (2023)
HydroGAT: Distributed Heterogeneous Graph Attention Transformer for Spatiotemporal Flood Prediction
by: Sarkar, Aishwarya, et al.
Published: (2025)
by: Sarkar, Aishwarya, et al.
Published: (2025)
DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference
by: Zhang, Yujie, et al.
Published: (2024)
by: Zhang, Yujie, et al.
Published: (2024)
Optimizing Performance on Trinity Utilizing Machine Learning, Proxy Applications and Scheduling Priorities
by: Romero, Phil
Published: (2024)
by: Romero, Phil
Published: (2024)
High Order Collaboration-Oriented Federated Graph Neural Network for Accurate QoS Prediction
by: Chen, Zehuan, et al.
Published: (2025)
by: Chen, Zehuan, et al.
Published: (2025)
Similar Items
-
From Score Distributions to Balance: Plug-and-Play Mixture-of-Experts Routing
by: Shahout, Rana, et al.
Published: (2025) -
Deadline-Aware Online Scheduling for LLM Fine-Tuning with Spot Market Predictions
by: Kong, Linggao, et al.
Published: (2025) -
Prediction-Assisted Online Distributed Deep Learning Workload Scheduling in GPU Clusters
by: Luo, Ziyue, et al.
Published: (2025) -
HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference
by: Zhang, Zeyu, et al.
Published: (2025) -
SkipPipe: Partial and Reordered Pipelining Framework for Training LLMs in Heterogeneous Networks
by: Blagoev, Nikolay, et al.
Published: (2025)