Exploiting Dependency and Parallelism: Real-Time Scheduling and Analysis for GPU Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yuanhai, He, Songyang, Gou, Ruizhe, Cui, Mingyue, Li, Boyang, Zhao, Shuai, Huang, Kai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Global Scheduling of Weakly-Hard Real-Time Tasks using Job-Level Priority Classes
di: Moyano, V. Gabriel, et al.
Pubblicazione: (2024)
di: Moyano, V. Gabriel, et al.
Pubblicazione: (2024)
Foreactor: Exploiting Storage I/O Parallelism with Explicit Speculation
di: Hu, Guanzhou, et al.
Pubblicazione: (2024)
di: Hu, Guanzhou, et al.
Pubblicazione: (2024)
Exploiting Application-to-Architecture Dependencies for Designing Scalable OS
di: Xiao, Yao, et al.
Pubblicazione: (2025)
di: Xiao, Yao, et al.
Pubblicazione: (2025)
Towards Fully-fledged GPU Multitasking via Proactive Memory Scheduling
di: Shen, Weihang, et al.
Pubblicazione: (2025)
di: Shen, Weihang, et al.
Pubblicazione: (2025)
Flare: Anomaly Diagnostics for Divergent LLM Training in GPU Clusters of Thousand-Plus Scale
di: Cui, Weihao, et al.
Pubblicazione: (2025)
di: Cui, Weihao, et al.
Pubblicazione: (2025)
FRAP: A Flexible Resource Accessing Protocol for Multiprocessor Real-Time Systems
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
Nova: Real-Time Agentic Vision-Language Model Serving with Adaptive Cross-Stage Parallelization
di: Xu, Yuhang, et al.
Pubblicazione: (2025)
di: Xu, Yuhang, et al.
Pubblicazione: (2025)
A Task Equalization Allocation Algorithm Incorporating Blocking Estimation and Resource Similarity Analysis for Vehicle Control Real-Time Systems
di: Duan, Qianlong, et al.
Pubblicazione: (2025)
di: Duan, Qianlong, et al.
Pubblicazione: (2025)
Optimizing Task Scheduling in Heterogeneous Computing Environments: A Comparative Analysis of CPU, GPU, and ASIC Platforms Using E2C Simulator
di: Mohammadjafari, Ali, et al.
Pubblicazione: (2024)
di: Mohammadjafari, Ali, et al.
Pubblicazione: (2024)
TempoNet: Slack-Quantized Transformer-Guided Reinforcement Scheduler for Adaptive Deadline-Centric Real-Time Dispatchs
di: Fu, Rong, et al.
Pubblicazione: (2026)
di: Fu, Rong, et al.
Pubblicazione: (2026)
Coach: Exploiting Temporal Patterns for All-Resource Oversubscription in Cloud Platforms
di: Reidys, Benjamin, et al.
Pubblicazione: (2025)
di: Reidys, Benjamin, et al.
Pubblicazione: (2025)
Idleness is Relative: Exploiting Tool-Call Idle Windows for Offloading in Agentic Systems with MORI
di: Xia, Tian, et al.
Pubblicazione: (2026)
di: Xia, Tian, et al.
Pubblicazione: (2026)
Trustworthy and Controllable Professional Knowledge Utilization in Large Language Models with TEE-GPU Execution
di: Cai, Yifeng, et al.
Pubblicazione: (2025)
di: Cai, Yifeng, et al.
Pubblicazione: (2025)
Enhancing Attack Resilience in Real-Time Systems through Variable Control Task Sampling Rates
di: Sain, Arkaprava, et al.
Pubblicazione: (2024)
di: Sain, Arkaprava, et al.
Pubblicazione: (2024)
Experimental Analysis of FreeRTOS Dependability through Targeted Fault Injection Campaigns
di: Mannella, Luca, et al.
Pubblicazione: (2026)
di: Mannella, Luca, et al.
Pubblicazione: (2026)
Leveraging OS-Level Primitives for Robotic Action Management
di: Zheng, Wenxin, et al.
Pubblicazione: (2025)
di: Zheng, Wenxin, et al.
Pubblicazione: (2025)
UrgenGo: Urgency-Aware Transparent GPU Kernel Launching for Autonomous Driving
di: Zhu, Hanqi, et al.
Pubblicazione: (2025)
di: Zhu, Hanqi, et al.
Pubblicazione: (2025)
Efficient Function-as-a-Service for Large Language Models with TIDAL
di: Cui, Weihao, et al.
Pubblicazione: (2025)
di: Cui, Weihao, et al.
Pubblicazione: (2025)
HyperGraph ROS: An Open-Source Robot Operating System for Hybrid Parallel Computing based on Computational HyperGraph
di: Zhang, Shufang, et al.
Pubblicazione: (2025)
di: Zhang, Shufang, et al.
Pubblicazione: (2025)
Analyzing Configuration Dependencies of File Systems
di: Mahmud, Tabassum, et al.
Pubblicazione: (2025)
di: Mahmud, Tabassum, et al.
Pubblicazione: (2025)
CHRONOS: Compensating Hardware Related Overheads with Native Multi Timer Support for Real-Time Operating Systems
di: Heider, Kay, et al.
Pubblicazione: (2025)
di: Heider, Kay, et al.
Pubblicazione: (2025)
LEFT-RS: A Lock-Free Fault-Tolerant Resource Sharing Protocol for Multicore Real-Time Systems
di: Chen, Nan, et al.
Pubblicazione: (2025)
di: Chen, Nan, et al.
Pubblicazione: (2025)
Work-in-Progress: Multi-Deadline DAG Scheduling Model for Autonomous Driving Systems
di: Yano, Atsushi, et al.
Pubblicazione: (2025)
di: Yano, Atsushi, et al.
Pubblicazione: (2025)
CARTOS: A Charging-Aware Real-Time Operating System for Intermittent Batteryless Devices
di: Karimi, Mohsen, et al.
Pubblicazione: (2023)
di: Karimi, Mohsen, et al.
Pubblicazione: (2023)
Exploiting Page Faults for Covert Communication
di: Swaminathan, Sathvik
Pubblicazione: (2025)
di: Swaminathan, Sathvik
Pubblicazione: (2025)
Ensuring Data Freshness in Multi-Rate Task Chains Scheduling
di: Hoffmann, José Luis Conradi, et al.
Pubblicazione: (2026)
di: Hoffmann, José Luis Conradi, et al.
Pubblicazione: (2026)
Holistic Heterogeneous Scheduling for Autonomous Applications using Fine-grained, Multi-XPU Abstraction
di: Han, Mingcong, et al.
Pubblicazione: (2025)
di: Han, Mingcong, et al.
Pubblicazione: (2025)
Assessing FIFO and Round Robin Scheduling:Effects on Data Pipeline Performance and Energy Usage
di: Choudhury, Malobika Roy, et al.
Pubblicazione: (2024)
di: Choudhury, Malobika Roy, et al.
Pubblicazione: (2024)
Scheduling Analysis of UAV Flight Control Workloads using Raspberry Pi 5 Using PREEMPT_RT Linux
di: Giacomossi, Luiz, et al.
Pubblicazione: (2026)
di: Giacomossi, Luiz, et al.
Pubblicazione: (2026)
TenonOS: A Self-Generating LibOS-on-LibOS Framework for Time-Critical Embedded Operating Systems
di: Zhao, Xinkui, et al.
Pubblicazione: (2025)
di: Zhao, Xinkui, et al.
Pubblicazione: (2025)
Towards High-Goodput LLM Serving with Prefill-decode Multiplexing
di: Chen, Yukang, et al.
Pubblicazione: (2025)
di: Chen, Yukang, et al.
Pubblicazione: (2025)
Continuum: Efficient and Robust Multi-Turn LLM Agent Scheduling with KV Cache Time-to-Live
di: Li, Hanchen, et al.
Pubblicazione: (2025)
di: Li, Hanchen, et al.
Pubblicazione: (2025)
Semantic Scheduling for LLM Inference
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
Towards Agentic OS: An LLM Agent Framework for Linux Schedulers
di: Zheng, Yusheng, et al.
Pubblicazione: (2025)
di: Zheng, Yusheng, et al.
Pubblicazione: (2025)
Towards Efficient and Practical GPU Multitasking in the Era of LLM
di: Xing, Jiarong, et al.
Pubblicazione: (2025)
di: Xing, Jiarong, et al.
Pubblicazione: (2025)
MOAT: Towards Safe BPF Kernel Extension
di: Lu, Hongyi, et al.
Pubblicazione: (2023)
di: Lu, Hongyi, et al.
Pubblicazione: (2023)
Modeling and Scheduling of Fusion Patterns in Autonomous Driving Systems (Extended Version)
di: Sobhani, Hoora, et al.
Pubblicazione: (2025)
di: Sobhani, Hoora, et al.
Pubblicazione: (2025)
Mitigating Timing-Based Attacks in Real-Time Cyber-Physical Systems
di: Sain, Arkaprava, et al.
Pubblicazione: (2026)
di: Sain, Arkaprava, et al.
Pubblicazione: (2026)
Dissecting CXL Memory Performance at Scale: Analysis, Modeling, and Optimization
di: Liu, Jinshu, et al.
Pubblicazione: (2024)
di: Liu, Jinshu, et al.
Pubblicazione: (2024)
An Early Exploration of Deep-Learning-Driven Prefetching for Far Memory
di: Huang, Yutong, et al.
Pubblicazione: (2025)
di: Huang, Yutong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Global Scheduling of Weakly-Hard Real-Time Tasks using Job-Level Priority Classes
di: Moyano, V. Gabriel, et al.
Pubblicazione: (2024) -
Foreactor: Exploiting Storage I/O Parallelism with Explicit Speculation
di: Hu, Guanzhou, et al.
Pubblicazione: (2024) -
Exploiting Application-to-Architecture Dependencies for Designing Scalable OS
di: Xiao, Yao, et al.
Pubblicazione: (2025) -
Towards Fully-fledged GPU Multitasking via Proactive Memory Scheduling
di: Shen, Weihang, et al.
Pubblicazione: (2025) -
Flare: Anomaly Diagnostics for Divergent LLM Training in GPU Clusters of Thousand-Plus Scale
di: Cui, Weihao, et al.
Pubblicazione: (2025)