A Data-Driven Approach to Dataflow-Aware Online Scheduling for Graph Neural Network Inference
Fuente:
arXiv
Salvato in:
| Autori principali: | Puigdemont, Pol, Russo, Enrico, Wassington, Axel, Das, Abhijit, Abadal, Sergi, Palesi, Maurizio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Objective Hardware-Mapping Co-Optimisation for Multi-DNN Workloads on Chiplet-based Accelerators
di: Das, Abhijit, et al.
Pubblicazione: (2022)
di: Das, Abhijit, et al.
Pubblicazione: (2022)
CHAOS: Controlled Hardware fAult injectOr System for gem5
di: Vinciguerra, Elio, et al.
Pubblicazione: (2026)
di: Vinciguerra, Elio, et al.
Pubblicazione: (2026)
Deep Reinforcement Learning based Online Scheduling Policy for Deep Neural Network Multi-Tenant Multi-Accelerator Systems
di: Blanco, Francesco G., et al.
Pubblicazione: (2024)
di: Blanco, Francesco G., et al.
Pubblicazione: (2024)
Communication Characterization of AI Workloads for Large-scale Multi-chiplet Accelerators
di: Musavi, Mariam, et al.
Pubblicazione: (2024)
di: Musavi, Mariam, et al.
Pubblicazione: (2024)
Exploring the Potential of Wireless-enabled Multi-Chip AI Accelerators
di: Irabor, Emmanuel, et al.
Pubblicazione: (2025)
di: Irabor, Emmanuel, et al.
Pubblicazione: (2025)
Towards Fair and Firm Real-Time Scheduling in DNN Multi-Tenant Multi-Accelerator Systems via Reinforcement Learning
di: Russo, Enrico, et al.
Pubblicazione: (2024)
di: Russo, Enrico, et al.
Pubblicazione: (2024)
The Immutable Tensor Architecture: A Pure Dataflow Approach for Secure, Energy-Efficient AI Inference
di: Li, Fang
Pubblicazione: (2025)
di: Li, Fang
Pubblicazione: (2025)
SIRA: Scaled-Integer Range Analysis for Optimizing FPGA Dataflow Neural Network Accelerators
di: Umuroglu, Yaman, et al.
Pubblicazione: (2025)
di: Umuroglu, Yaman, et al.
Pubblicazione: (2025)
LoopLynx: A Scalable Dataflow Architecture for Efficient LLM Inference
di: Zheng, Jianing, et al.
Pubblicazione: (2025)
di: Zheng, Jianing, et al.
Pubblicazione: (2025)
Time Reversal for Near-Field Communications on Multi-chip Wireless Networks
di: Rodríguez-Galán, Fátima, et al.
Pubblicazione: (2024)
di: Rodríguez-Galán, Fátima, et al.
Pubblicazione: (2024)
A Dataflow Compiler for Efficient LLM Inference using Custom Microscaling Formats
di: Cheng, Jianyi, et al.
Pubblicazione: (2023)
di: Cheng, Jianyi, et al.
Pubblicazione: (2023)
MATCHA: Efficient Deployment of Deep Neural Networks on Multi-Accelerator Heterogeneous Edge SoCs
di: Russo, Enrico, et al.
Pubblicazione: (2026)
di: Russo, Enrico, et al.
Pubblicazione: (2026)
MIREDO: MIP-Driven Resource-Efficient Dataflow Optimization for Computing-in-Memory Accelerator
di: He, Xiaolin, et al.
Pubblicazione: (2025)
di: He, Xiaolin, et al.
Pubblicazione: (2025)
DAS-MP: Enabling High-Quality Macro Placement with Enhanced Dataflow Awareness
di: Zhao, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhao, Xiaotian, et al.
Pubblicazione: (2025)
Sparsity-Aware Streaming SNN Accelerator with Output-Channel Dataflow for Automatic Modulation Classification
di: Yang, Kuilian, et al.
Pubblicazione: (2026)
di: Yang, Kuilian, et al.
Pubblicazione: (2026)
LEAP: LLM Inference on Scalable PIM-NoC Architecture with Balanced Dataflow and Fine-Grained Parallelism
di: Wang, Yimin, et al.
Pubblicazione: (2025)
di: Wang, Yimin, et al.
Pubblicazione: (2025)
LP-Spec: Leveraging LPDDR PIM for Efficient LLM Mobile Speculative Inference with Architecture-Dataflow Co-Optimization
di: He, Siyuan, et al.
Pubblicazione: (2025)
di: He, Siyuan, et al.
Pubblicazione: (2025)
NEURAL: An Elastic Neuromorphic Architecture with Hybrid Data-Event Execution and On-the-fly Attention Dataflow
di: Chen, Yuehai, et al.
Pubblicazione: (2025)
di: Chen, Yuehai, et al.
Pubblicazione: (2025)
CODO: An Automated Compiler for Comprehensive Dataflow Optimization
di: Zhang, Weichuang, et al.
Pubblicazione: (2026)
di: Zhang, Weichuang, et al.
Pubblicazione: (2026)
Revet: A Language and Compiler for Dataflow Threads
di: Rucker, Alexander, et al.
Pubblicazione: (2023)
di: Rucker, Alexander, et al.
Pubblicazione: (2023)
Fast Cross-Operator Optimization of Attention Dataflow
di: Chang, Haodong, et al.
Pubblicazione: (2026)
di: Chang, Haodong, et al.
Pubblicazione: (2026)
Stream-HLS: Towards Automatic Dataflow Acceleration
di: Basalama, Suhail, et al.
Pubblicazione: (2025)
di: Basalama, Suhail, et al.
Pubblicazione: (2025)
FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Large Attention-Based Model Inference on Tile-Based Accelerators
di: Zhang, Chi, et al.
Pubblicazione: (2026)
di: Zhang, Chi, et al.
Pubblicazione: (2026)
High Utilization Energy-Aware Real-Time Inference Deep Convolutional Neural Network Accelerator
di: Lin, Kuan-Ting, et al.
Pubblicazione: (2025)
di: Lin, Kuan-Ting, et al.
Pubblicazione: (2025)
FlexNeRFer: A Multi-Dataflow, Adaptive Sparsity-Aware Accelerator for On-Device NeRF Rendering
di: Noh, Seock-Hwan, et al.
Pubblicazione: (2025)
di: Noh, Seock-Hwan, et al.
Pubblicazione: (2025)
DataMaestro: A Versatile and Efficient Data Streaming Engine Bringing Decoupled Memory Access To Dataflow Accelerators
di: Yi, Xiaoling, et al.
Pubblicazione: (2025)
di: Yi, Xiaoling, et al.
Pubblicazione: (2025)
PIMfused: Near-Bank DRAM-PIM with Fused-layer Dataflow for CNN Data Transfer Optimization
di: Yang, Simei, et al.
Pubblicazione: (2025)
di: Yang, Simei, et al.
Pubblicazione: (2025)
FEATHER: A Reconfigurable Accelerator with Data Reordering Support for Low-Cost On-Chip Dataflow Switching
di: Tong, Jianming, et al.
Pubblicazione: (2024)
di: Tong, Jianming, et al.
Pubblicazione: (2024)
DORA: Dataflow-Instruction Orchestration Architecture for DNN Acceleration
di: Chen, Xingzhen, et al.
Pubblicazione: (2026)
di: Chen, Xingzhen, et al.
Pubblicazione: (2026)
A Sparsity-Aware Autonomous Path Planning Accelerator with HW/SW Co-Design and Multi-Level Dataflow Optimization
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
HASS: Hardware-Aware Sparsity Search for Dataflow DNN Accelerator
di: Yu, Zhewen, et al.
Pubblicazione: (2024)
di: Yu, Zhewen, et al.
Pubblicazione: (2024)
Taming the Exponential: A Fast Softmax Surrogate for Integer-Native Edge Inference
di: Danopoulos, Dimitrios, et al.
Pubblicazione: (2026)
di: Danopoulos, Dimitrios, et al.
Pubblicazione: (2026)
Multilayer Dataflow: Orchestrate Butterfly Sparsity to Accelerate Attention Computation
di: Wu, Haibin, et al.
Pubblicazione: (2024)
di: Wu, Haibin, et al.
Pubblicazione: (2024)
StreamTensor: Make Tensors Stream in Dataflow Accelerators for LLMs
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
di: Ye, Hanchen, et al.
Pubblicazione: (2025)
Implementing and Optimizing the Scaled Dot-Product Attention on Streaming Dataflow
di: Sohn, Gina, et al.
Pubblicazione: (2024)
di: Sohn, Gina, et al.
Pubblicazione: (2024)
Hardware-Aware Neural Network Compilation with Learned Optimization: A RISC-V Accelerator Approach
di: Ganti, Ravindra, et al.
Pubblicazione: (2025)
di: Ganti, Ravindra, et al.
Pubblicazione: (2025)
A Hierarchical Dataflow-Driven Heterogeneous Architecture for Wireless Baseband Processing
di: Jiang, Limin, et al.
Pubblicazione: (2024)
di: Jiang, Limin, et al.
Pubblicazione: (2024)
Hermes: A Unified High-Performance NTT Architecture with Hybrid Dataflow
di: Gu, Hang, et al.
Pubblicazione: (2026)
di: Gu, Hang, et al.
Pubblicazione: (2026)
AccelCIM: Systematic Dataflow Exploration for SRAM Compute-in-Memory Accelerator
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
di: Xue, Chenhao, et al.
Pubblicazione: (2026)
LoopTree: Exploring the Fused-layer Dataflow Accelerator Design Space
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
di: Gilbert, Michael, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multi-Objective Hardware-Mapping Co-Optimisation for Multi-DNN Workloads on Chiplet-based Accelerators
di: Das, Abhijit, et al.
Pubblicazione: (2022) -
CHAOS: Controlled Hardware fAult injectOr System for gem5
di: Vinciguerra, Elio, et al.
Pubblicazione: (2026) -
Deep Reinforcement Learning based Online Scheduling Policy for Deep Neural Network Multi-Tenant Multi-Accelerator Systems
di: Blanco, Francesco G., et al.
Pubblicazione: (2024) -
Communication Characterization of AI Workloads for Large-scale Multi-chiplet Accelerators
di: Musavi, Mariam, et al.
Pubblicazione: (2024) -
Exploring the Potential of Wireless-enabled Multi-Chip AI Accelerators
di: Irabor, Emmanuel, et al.
Pubblicazione: (2025)