StraightLine: An End-to-End Resource-Aware Scheduler for Machine Learning Application Requests
Fuente:
arXiv
Saved in:
| Main Authors: | Ching, Cheng-Wei, Guan, Boyuan, Xu, Hailu, Hu, Liting |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ScaleLLM: A Resource-Frugal LLM Serving Framework by Optimizing End-to-End Efficiency
by: Yao, Yuhang, et al.
Published: (2024)
by: Yao, Yuhang, et al.
Published: (2024)
Communication Resources Constrained Hierarchical Federated Learning for End-to-End Autonomous Driving
by: Kou, Wei-Bin, et al.
Published: (2023)
by: Kou, Wei-Bin, et al.
Published: (2023)
Improving the End-to-End Efficiency of Offline Inference for Multi-LLM Applications Based on Sampling and Simulation
by: Fang, Jingzhi, et al.
Published: (2025)
by: Fang, Jingzhi, et al.
Published: (2025)
Application of Machine Learning Optimization in Cloud Computing Resource Scheduling and Management
by: Zhang, Yifan, et al.
Published: (2024)
by: Zhang, Yifan, et al.
Published: (2024)
Decaffe: DHT Tree-Based Online Federated Fake News Detection
by: Ching, Cheng-Wei, et al.
Published: (2023)
by: Ching, Cheng-Wei, et al.
Published: (2023)
Deal: Distributed End-to-End GNN Inference for All Nodes
by: Chen, Shiyang, et al.
Published: (2025)
by: Chen, Shiyang, et al.
Published: (2025)
ExeGPT: Constraint-Aware Resource Scheduling for LLM Inference
by: Oh, Hyungjun, et al.
Published: (2024)
by: Oh, Hyungjun, et al.
Published: (2024)
nncase: An End-to-End Compiler for Efficient LLM Deployment on Heterogeneous Storage Architectures
by: Guo, Hui, et al.
Published: (2025)
by: Guo, Hui, et al.
Published: (2025)
Optimizing Performance on Trinity Utilizing Machine Learning, Proxy Applications and Scheduling Priorities
by: Romero, Phil
Published: (2024)
by: Romero, Phil
Published: (2024)
End-to-End Verifiable Decentralized Federated Learning
by: Lee, Chaehyeon, et al.
Published: (2024)
by: Lee, Chaehyeon, et al.
Published: (2024)
Reinforcement Learning for Adaptive Resource Scheduling in Complex System Environments
by: Li, Pochun, et al.
Published: (2024)
by: Li, Pochun, et al.
Published: (2024)
Beyond Model Scale Limits: End-Edge-Cloud Federated Learning with Self-Rectified Knowledge Agglomeration
by: Wu, Zhiyuan, et al.
Published: (2025)
by: Wu, Zhiyuan, et al.
Published: (2025)
FedTeddi: Temporal Drift and Divergence Aware Scheduling for Timely Federated Edge Learning
by: Bai, Yuxuan, et al.
Published: (2025)
by: Bai, Yuxuan, et al.
Published: (2025)
Neighborhood and Global Perturbations Supported SAM in Federated Learning: From Local Tweaks To Global Awareness
by: Li, Boyuan, et al.
Published: (2024)
by: Li, Boyuan, et al.
Published: (2024)
Timeliness-Oriented Scheduling and Resource Allocation in Multi-Region Collaborative Perception
by: Zhu, Mengmeng, et al.
Published: (2026)
by: Zhu, Mengmeng, et al.
Published: (2026)
Semantic-Aware Scheduling for GPU Clusters with Large Language Models
by: Wang, Zerui, et al.
Published: (2025)
by: Wang, Zerui, et al.
Published: (2025)
Deadline-Aware Online Scheduling for LLM Fine-Tuning with Spot Market Predictions
by: Kong, Linggao, et al.
Published: (2025)
by: Kong, Linggao, et al.
Published: (2025)
FT-Transformer: Resilient and Reliable Transformer with End-to-End Fault Tolerant Attention
by: Dai, Huangliang, et al.
Published: (2025)
by: Dai, Huangliang, et al.
Published: (2025)
Enabling Disaggregated Multi-Stage MLLM Inference via GPU-Internal Scheduling and Resource Sharing
by: Zhao, Lingxiao, et al.
Published: (2025)
by: Zhao, Lingxiao, et al.
Published: (2025)
Agglomerative Federated Learning: Empowering Larger Model Training via End-Edge-Cloud Collaboration
by: Wu, Zhiyuan, et al.
Published: (2023)
by: Wu, Zhiyuan, et al.
Published: (2023)
OrcoDCS: An IoT-Edge Orchestrated Online Deep Compressed Sensing Framework
by: Ching, Cheng-Wei, et al.
Published: (2023)
by: Ching, Cheng-Wei, et al.
Published: (2023)
Learning to Schedule Online Tasks with Bandit Feedback
by: Xu, Yongxin, et al.
Published: (2024)
by: Xu, Yongxin, et al.
Published: (2024)
Aryl: An Elastic Cluster Scheduler for Deep Learning
by: Li, Jiamin, et al.
Published: (2022)
by: Li, Jiamin, et al.
Published: (2022)
Resource-Aware Aggregation and Sparsification in Heterogeneous Ensemble Federated Learning
by: Ryum, Keumseo, et al.
Published: (2025)
by: Ryum, Keumseo, et al.
Published: (2025)
Prioritizing Modalities: Flexible Importance Scheduling in Federated Multimodal Learning
by: Bian, Jieming, et al.
Published: (2024)
by: Bian, Jieming, et al.
Published: (2024)
DeFRiS: Silo-Cooperative IoT Applications Scheduling via Decentralized Federated Reinforcement Learning
by: Wang, Zhiyu, et al.
Published: (2026)
by: Wang, Zhiyu, et al.
Published: (2026)
Agent.xpu: Efficient Scheduling of Agentic LLM Workloads on Heterogeneous SoC
by: Wei, Xinming, et al.
Published: (2025)
by: Wei, Xinming, et al.
Published: (2025)
LACS: Learning-Augmented Algorithms for Carbon-Aware Resource Scaling with Uncertain Demand
by: Bostandoost, Roozbeh, et al.
Published: (2024)
by: Bostandoost, Roozbeh, et al.
Published: (2024)
An End-to-End DNN Inference Framework for the SpiNNaker2 Neuromorphic MPSoC
by: Jobst, Matthias, et al.
Published: (2025)
by: Jobst, Matthias, et al.
Published: (2025)
Taming Request Imbalance: SLO-Aware Scheduling for Disaggregated LLM Inference
by: Wang, Qipeng
Published: (2026)
by: Wang, Qipeng
Published: (2026)
TACOS: Topology-Aware Collective Algorithm Synthesizer for Distributed Machine Learning
by: Won, William, et al.
Published: (2023)
by: Won, William, et al.
Published: (2023)
Priority-Aware Preemptive Scheduling for Mixed-Priority Workloads in MoE Inference
by: Siavashi, Mohammad, et al.
Published: (2025)
by: Siavashi, Mohammad, et al.
Published: (2025)
FedCompass: Efficient Cross-Silo Federated Learning on Heterogeneous Client Devices using a Computing Power Aware Scheduler
by: Li, Zilinghan, et al.
Published: (2023)
by: Li, Zilinghan, et al.
Published: (2023)
TRAIL: Trust-Aware Client Scheduling for Semi-Decentralized Federated Learning
by: Hu, Gangqiang, et al.
Published: (2024)
by: Hu, Gangqiang, et al.
Published: (2024)
Scheduling for On-Board Federated Learning with Satellite Clusters
by: Razmi, Nasrin, et al.
Published: (2024)
by: Razmi, Nasrin, et al.
Published: (2024)
A Tabular Schedule Abstraction for Communication-Aware Evaluation of Pipeline-Parallel LLM Training
by: Barley, Daniel, et al.
Published: (2026)
by: Barley, Daniel, et al.
Published: (2026)
No Request Left Behind: Tackling Heterogeneity in Long-Context LLM Inference with Medha
by: Agrawal, Amey, et al.
Published: (2024)
by: Agrawal, Amey, et al.
Published: (2024)
Averaging Rate Scheduler for Decentralized Learning on Heterogeneous Data
by: Aketi, Sai Aparna, et al.
Published: (2024)
by: Aketi, Sai Aparna, et al.
Published: (2024)
Adaptive Approach to Enhance Machine Learning Scheduling Algorithms During Runtime Using Reinforcement Learning in Metascheduling Applications
by: Alshaer, Samer, et al.
Published: (2025)
by: Alshaer, Samer, et al.
Published: (2025)
Accelerating Communication in Deep Learning Recommendation Model Training with Dual-Level Adaptive Lossy Compression
by: Feng, Hao, et al.
Published: (2024)
by: Feng, Hao, et al.
Published: (2024)
Similar Items
-
ScaleLLM: A Resource-Frugal LLM Serving Framework by Optimizing End-to-End Efficiency
by: Yao, Yuhang, et al.
Published: (2024) -
Communication Resources Constrained Hierarchical Federated Learning for End-to-End Autonomous Driving
by: Kou, Wei-Bin, et al.
Published: (2023) -
Improving the End-to-End Efficiency of Offline Inference for Multi-LLM Applications Based on Sampling and Simulation
by: Fang, Jingzhi, et al.
Published: (2025) -
Application of Machine Learning Optimization in Cloud Computing Resource Scheduling and Management
by: Zhang, Yifan, et al.
Published: (2024) -
Decaffe: DHT Tree-Based Online Federated Fake News Detection
by: Ching, Cheng-Wei, et al.
Published: (2023)