A Survey of Real-time Scheduling on Accelerator-based Heterogeneous Architecture for Time Critical Applications
Fuente:
arXiv
Guardado en:
| Autores principales: | Zou, An, Xu, Yuankai, Ni, Yinchen, Chen, Jintao, Ma, Yehan, Li, Jing, Gill, Christopher, Zhang, Xuan, Jin, Yier |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scheduling Techniques of AI Models on Modern Heterogeneous Edge GPU -- A Critical Review
por: Majeed, Ashiyana Abdul, et al.
Publicado: (2025)
por: Majeed, Ashiyana Abdul, et al.
Publicado: (2025)
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
por: Sharma, Harsh, et al.
Publicado: (2023)
por: Sharma, Harsh, et al.
Publicado: (2023)
XDMA: A Distributed, Extensible DMA Architecture for Layout-Flexible Data Movements in Heterogeneous Multi-Accelerator SoCs
por: Kong, Fanchen, et al.
Publicado: (2025)
por: Kong, Fanchen, et al.
Publicado: (2025)
A Reliable, Time-Predictable Heterogeneous SoC for AI-Enhanced Mixed-Criticality Edge Applications
por: Garofalo, Angelo, et al.
Publicado: (2025)
por: Garofalo, Angelo, et al.
Publicado: (2025)
Accelerating Triangle Counting with Real Processing-in-Memory Systems
por: Asquini, Lorenzo, et al.
Publicado: (2025)
por: Asquini, Lorenzo, et al.
Publicado: (2025)
DeFiNES: Enabling Fast Exploration of the Depth-first Scheduling Space for DNN Accelerators through Analytical Modeling
por: Mei, Linyan, et al.
Publicado: (2022)
por: Mei, Linyan, et al.
Publicado: (2022)
HgPCN: A Heterogeneous Architecture for E2E Embedded Point Cloud Inference
por: Gao, Yiming, et al.
Publicado: (2025)
por: Gao, Yiming, et al.
Publicado: (2025)
SLIM: A Heterogeneous Accelerator for Edge Inference of Sparse Large Language Model via Adaptive Thresholding
por: Xu, Weihong, et al.
Publicado: (2025)
por: Xu, Weihong, et al.
Publicado: (2025)
Application Experiences on a GPU-Accelerated Arm-based HPC Testbed
por: Elwasif, Wael, et al.
Publicado: (2022)
por: Elwasif, Wael, et al.
Publicado: (2022)
DCRA: A Distributed Chiplet-based Reconfigurable Architecture for Irregular Applications
por: Orenes-Vera, Marcelo, et al.
Publicado: (2023)
por: Orenes-Vera, Marcelo, et al.
Publicado: (2023)
Optimizing Task Scheduling in Fog Computing with Deadline Awareness
por: Sirjani, Mohammad Sadegh, et al.
Publicado: (2025)
por: Sirjani, Mohammad Sadegh, et al.
Publicado: (2025)
Survey of Disaggregated Memory: Cross-layer Technique Insights for Next-Generation Datacenters
por: Wang, Jing, et al.
Publicado: (2025)
por: Wang, Jing, et al.
Publicado: (2025)
ALPHA-PIM: Analysis of Linear Algebraic Processing for High-Performance Graph Applications on a Real Processing-In-Memory System
por: Barkhordar, Marzieh, et al.
Publicado: (2026)
por: Barkhordar, Marzieh, et al.
Publicado: (2026)
General-Purpose Multicore Architectures
por: Ghose, Saugata
Publicado: (2024)
por: Ghose, Saugata
Publicado: (2024)
Dynamic Simultaneous Multithreaded Architecture
por: Ortiz-Arroyo, Daniel, et al.
Publicado: (2024)
por: Ortiz-Arroyo, Daniel, et al.
Publicado: (2024)
Optimizing Offload Performance in Heterogeneous MPSoCs
por: Colagrande, Luca, et al.
Publicado: (2024)
por: Colagrande, Luca, et al.
Publicado: (2024)
CELLO: Co-designing Schedule and Hybrid Implicit/Explicit Buffer for Complex Tensor Reuse
por: Garg, Raveesh, et al.
Publicado: (2023)
por: Garg, Raveesh, et al.
Publicado: (2023)
Towards Fair and Firm Real-Time Scheduling in DNN Multi-Tenant Multi-Accelerator Systems via Reinforcement Learning
por: Russo, Enrico, et al.
Publicado: (2024)
por: Russo, Enrico, et al.
Publicado: (2024)
FlexStep: Enabling Flexible Error Detection in Multi/Many-core Real-time Systems
por: Wang, Tinglue, et al.
Publicado: (2025)
por: Wang, Tinglue, et al.
Publicado: (2025)
Sparse MTTKRP Acceleration for Tensor Decomposition on GPU
por: Wijeratne, Sasindu, et al.
Publicado: (2024)
por: Wijeratne, Sasindu, et al.
Publicado: (2024)
Leveraging SIMD for Accelerating Large-number Arithmetic
por: Das, Subhrajit, et al.
Publicado: (2026)
por: Das, Subhrajit, et al.
Publicado: (2026)
PIUMA: Programmable Integrated Unified Memory Architecture
por: Aananthakrishnan, Sriram, et al.
Publicado: (2020)
por: Aananthakrishnan, Sriram, et al.
Publicado: (2020)
Evaluating Rapid Makespan Predictions for Heterogeneous Systems with Programmable Logic
por: Wilhelm, Martin, et al.
Publicado: (2025)
por: Wilhelm, Martin, et al.
Publicado: (2025)
Data-aware Dynamic Execution of Irregular Workloads on Heterogeneous Systems
por: Bai, Zhenyu, et al.
Publicado: (2025)
por: Bai, Zhenyu, et al.
Publicado: (2025)
Balanced Data Placement for GEMV Acceleration with Processing-In-Memory
por: Ibrahim, Mohamed Assem, et al.
Publicado: (2024)
por: Ibrahim, Mohamed Assem, et al.
Publicado: (2024)
EPOCH: Enabling Preemption Operation for Context Saving in Heterogeneous FPGA Systems
por: Malik, Arsalan Ali, et al.
Publicado: (2025)
por: Malik, Arsalan Ali, et al.
Publicado: (2025)
HARP: A Taxonomy for Heterogeneous and Hierarchical Processors for Mixed-reuse Workloads
por: Garg, Raveesh, et al.
Publicado: (2025)
por: Garg, Raveesh, et al.
Publicado: (2025)
SpArch: Efficient Architecture for Sparse Matrix Multiplication
por: Zhang, Zhekai, et al.
Publicado: (2020)
por: Zhang, Zhekai, et al.
Publicado: (2020)
Efficient Architecture for RISC-V Vector Memory Access
por: Guan, Hongyi, et al.
Publicado: (2025)
por: Guan, Hongyi, et al.
Publicado: (2025)
Accelerating Data Chunking in Deduplication Systems using Vector Instructions
por: Udayashankar, Sreeharsha, et al.
Publicado: (2025)
por: Udayashankar, Sreeharsha, et al.
Publicado: (2025)
Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs
por: Zhang, Qijun, et al.
Publicado: (2026)
por: Zhang, Qijun, et al.
Publicado: (2026)
Navigating the Landscape of Distributed File Systems: Architectures, Implementations, and Considerations
por: Pan, Xueting, et al.
Publicado: (2024)
por: Pan, Xueting, et al.
Publicado: (2024)
Workload-Aware Hardware Accelerator Mining for Distributed Deep Learning Training
por: Adnan, Muhammad, et al.
Publicado: (2024)
por: Adnan, Muhammad, et al.
Publicado: (2024)
TAPA-CS: Enabling Scalable Accelerator Design on Distributed HBM-FPGAs
por: Prakriya, Neha, et al.
Publicado: (2023)
por: Prakriya, Neha, et al.
Publicado: (2023)
iHAC: A Hybrid Cluster Architecture for Enhanced Performance and Resilience
por: Muntaka, Siddique Abubakr, et al.
Publicado: (2026)
por: Muntaka, Siddique Abubakr, et al.
Publicado: (2026)
Microbenchmark-Driven Analytical Performance Modeling Across Modern GPU Architectures
por: Jarmusch, Aaron, et al.
Publicado: (2026)
por: Jarmusch, Aaron, et al.
Publicado: (2026)
New Tools, Programming Models, and System Support for Processing-in-Memory Architectures
por: Oliveira, Geraldo F.
Publicado: (2025)
por: Oliveira, Geraldo F.
Publicado: (2025)
Exploring Parallelism in FPGA-Based Accelerators for Machine Learning Applications
por: Centeno, Sed, et al.
Publicado: (2025)
por: Centeno, Sed, et al.
Publicado: (2025)
Design in Tiles: Automating GEMM Deployment on Tile-Based Many-PE Accelerators
por: Shen, Aofeng, et al.
Publicado: (2025)
por: Shen, Aofeng, et al.
Publicado: (2025)
FLEX: Leveraging FPGA-CPU Synergy for Mixed-Cell-Height Legalization Acceleration
por: Liu, Xingyu, et al.
Publicado: (2025)
por: Liu, Xingyu, et al.
Publicado: (2025)
Ejemplares similares
-
Scheduling Techniques of AI Models on Modern Heterogeneous Edge GPU -- A Critical Review
por: Majeed, Ashiyana Abdul, et al.
Publicado: (2025) -
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
por: Sharma, Harsh, et al.
Publicado: (2023) -
XDMA: A Distributed, Extensible DMA Architecture for Layout-Flexible Data Movements in Heterogeneous Multi-Accelerator SoCs
por: Kong, Fanchen, et al.
Publicado: (2025) -
A Reliable, Time-Predictable Heterogeneous SoC for AI-Enhanced Mixed-Criticality Edge Applications
por: Garofalo, Angelo, et al.
Publicado: (2025) -
Accelerating Triangle Counting with Real Processing-in-Memory Systems
por: Asquini, Lorenzo, et al.
Publicado: (2025)