An End-to-End DNN Inference Framework for the SpiNNaker2 Neuromorphic MPSoC
Fuente:
arXiv
Salvato in:
| Autori principali: | Jobst, Matthias, Langer, Tim, Liu, Chen, Alici, Mehmet, Gonzalez, Hector A., Mayr, Christian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimizing Offload Performance in Heterogeneous MPSoCs
di: Colagrande, Luca, et al.
Pubblicazione: (2024)
di: Colagrande, Luca, et al.
Pubblicazione: (2024)
Taming Offload Overheads in a Massively Parallel Open-Source RISC-V MPSoC: Analysis and Optimization
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
Fast Switching Serial and Parallel Paradigms of SNN Inference on Multi-core Heterogeneous Neuromorphic Platform SpiNNaker2
di: Huang, Jiaxin, et al.
Pubblicazione: (2024)
di: Huang, Jiaxin, et al.
Pubblicazione: (2024)
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
di: Sharma, Harsh, et al.
Pubblicazione: (2023)
di: Sharma, Harsh, et al.
Pubblicazione: (2023)
MIMDRAM: An End-to-End Processing-Using-DRAM System for High-Throughput, Energy-Efficient and Programmer-Transparent Multiple-Instruction Multiple-Data Processing
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2024)
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2024)
A Scalable NorthPole System with End-to-End Vertical Integration for Low-Latency and Energy-Efficient LLM Inference
di: DeBole, Michael V., et al.
Pubblicazione: (2025)
di: DeBole, Michael V., et al.
Pubblicazione: (2025)
CMDS: Cross-layer Dataflow Optimization for DNN Accelerators Exploiting Multi-bank Memories
di: Shi, Man, et al.
Pubblicazione: (2024)
di: Shi, Man, et al.
Pubblicazione: (2024)
Automated Deep Neural Network Inference Partitioning for Distributed Embedded Systems
di: Kreß, Fabian, et al.
Pubblicazione: (2024)
di: Kreß, Fabian, et al.
Pubblicazione: (2024)
DeFiNES: Enabling Fast Exploration of the Depth-first Scheduling Space for DNN Accelerators through Analytical Modeling
di: Mei, Linyan, et al.
Pubblicazione: (2022)
di: Mei, Linyan, et al.
Pubblicazione: (2022)
Hardware-Aware Fine-Tuning of Spiking Q-Networks on the SpiNNaker2 Neuromorphic Platform
di: Arfa, Sirine, et al.
Pubblicazione: (2025)
di: Arfa, Sirine, et al.
Pubblicazione: (2025)
A Lightweight High-Throughput Collective-Capable NoC for Large-Scale ML Accelerators
di: Colagrande, Luca, et al.
Pubblicazione: (2026)
di: Colagrande, Luca, et al.
Pubblicazione: (2026)
FengHuang: Next-Generation Memory Orchestration for AI Inferencing
di: Li, Jiamin, et al.
Pubblicazione: (2025)
di: Li, Jiamin, et al.
Pubblicazione: (2025)
Characterizing CPU-Induced Slowdowns in Multi-GPU LLM Inference
di: Chung, Euijun, et al.
Pubblicazione: (2026)
di: Chung, Euijun, et al.
Pubblicazione: (2026)
Understanding Bottlenecks for Efficiently Serving LLM Inference With KV Offloading
di: Meng, William, et al.
Pubblicazione: (2025)
di: Meng, William, et al.
Pubblicazione: (2025)
Exploring the Efficiency of 3D-Stacked AI Chip Architecture for LLM Inference with Voxel
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
di: Liu, Yiqi, et al.
Pubblicazione: (2026)
HgPCN: A Heterogeneous Architecture for E2E Embedded Point Cloud Inference
di: Gao, Yiming, et al.
Pubblicazione: (2025)
di: Gao, Yiming, et al.
Pubblicazione: (2025)
SLIM: A Heterogeneous Accelerator for Edge Inference of Sparse Large Language Model via Adaptive Thresholding
di: Xu, Weihong, et al.
Pubblicazione: (2025)
di: Xu, Weihong, et al.
Pubblicazione: (2025)
Implementation and Evaluation of GBDI Memory Compression Algorithm Using C/C++ on a Broader Range of Workloads
di: Aina, Adeyemi
Pubblicazione: (2025)
di: Aina, Adeyemi
Pubblicazione: (2025)
NetSmith: An Optimization Framework for Machine-Discovered Network Topologies
di: Green, Conor, et al.
Pubblicazione: (2024)
di: Green, Conor, et al.
Pubblicazione: (2024)
COMET: A Framework for Modeling Compound Operation Dataflows with Explicit Collectives
di: Negi, Shubham, et al.
Pubblicazione: (2025)
di: Negi, Shubham, et al.
Pubblicazione: (2025)
Switchboard: An Open-Source Framework for Modular Simulation of Large Hardware Systems
di: Herbst, Steven, et al.
Pubblicazione: (2024)
di: Herbst, Steven, et al.
Pubblicazione: (2024)
Muchisim: A Simulation Framework for Design Exploration of Multi-Chip Manycore Systems
di: Orenes-Vera, Marcelo, et al.
Pubblicazione: (2023)
di: Orenes-Vera, Marcelo, et al.
Pubblicazione: (2023)
DP-HLS: A High-Level Synthesis Framework for Accelerating Dynamic Programming Algorithms in Bioinformatics
di: Cao, Yingqi, et al.
Pubblicazione: (2024)
di: Cao, Yingqi, et al.
Pubblicazione: (2024)
PID-Comm: A Fast and Flexible Collective Communication Framework for Commodity Processing-in-DIMM Devices
di: Noh, Si Ung, et al.
Pubblicazione: (2024)
di: Noh, Si Ung, et al.
Pubblicazione: (2024)
A Reliable, Time-Predictable Heterogeneous SoC for AI-Enhanced Mixed-Criticality Edge Applications
di: Garofalo, Angelo, et al.
Pubblicazione: (2025)
di: Garofalo, Angelo, et al.
Pubblicazione: (2025)
Optimizing Communication for Latency Sensitive HPC Applications on up to 48 FPGAs Using ACCL
di: Meyer, Marius, et al.
Pubblicazione: (2024)
di: Meyer, Marius, et al.
Pubblicazione: (2024)
Event-based backpropagation on the neuromorphic platform SpiNNaker2
di: Béna, Gabriel, et al.
Pubblicazione: (2024)
di: Béna, Gabriel, et al.
Pubblicazione: (2024)
Fusing Depthwise and Pointwise Convolutions for Efficient Inference on GPUs
di: Qararyah, Fareed, et al.
Pubblicazione: (2024)
di: Qararyah, Fareed, et al.
Pubblicazione: (2024)
Neuromorphic Computing: A Theoretical Framework for Time, Space, and Energy Scaling
di: Aimone, James B
Pubblicazione: (2025)
di: Aimone, James B
Pubblicazione: (2025)
Profiling Concurrent Vision Inference Workloads on NVIDIA Jetson -- Extended
di: Chakraborty, Abhinaba, et al.
Pubblicazione: (2025)
di: Chakraborty, Abhinaba, et al.
Pubblicazione: (2025)
Towards Fair and Firm Real-Time Scheduling in DNN Multi-Tenant Multi-Accelerator Systems via Reinforcement Learning
di: Russo, Enrico, et al.
Pubblicazione: (2024)
di: Russo, Enrico, et al.
Pubblicazione: (2024)
EPAC: The Last Dance
di: Mantovani, Filippo, et al.
Pubblicazione: (2026)
di: Mantovani, Filippo, et al.
Pubblicazione: (2026)
A High Energy-Efficiency Multi-core Neuromorphic Architecture for Deep SNN Training
di: Li, Mingjing, et al.
Pubblicazione: (2024)
di: Li, Mingjing, et al.
Pubblicazione: (2024)
Application Experiences on a GPU-Accelerated Arm-based HPC Testbed
di: Elwasif, Wael, et al.
Pubblicazione: (2022)
di: Elwasif, Wael, et al.
Pubblicazione: (2022)
TT-Edge: A Hardware-Software Co-Design for Energy-Efficient Tensor-Train Decomposition on Edge AI
di: Kwak, Hyunseok, et al.
Pubblicazione: (2025)
di: Kwak, Hyunseok, et al.
Pubblicazione: (2025)
The DEEP-ER project: I/O and resiliency extensions for the Cluster-Booster architecture
di: Kreuzer, Anke, et al.
Pubblicazione: (2019)
di: Kreuzer, Anke, et al.
Pubblicazione: (2019)
An Evaluation and Comparison of GPU Hardware and Solver Libraries for Accelerating the OPM Flow Reservoir Simulator
di: Qiu, Tong Dong, et al.
Pubblicazione: (2023)
di: Qiu, Tong Dong, et al.
Pubblicazione: (2023)
MVDRAM: Enabling GeMV Execution in Unmodified DRAM for Low-Bit LLM Acceleration
di: Kubo, Tatsuya, et al.
Pubblicazione: (2025)
di: Kubo, Tatsuya, et al.
Pubblicazione: (2025)
PAM: Processing Across Memory Hierarchy for Efficient KV-centric LLM Serving System
di: Liu, Lian, et al.
Pubblicazione: (2026)
di: Liu, Lian, et al.
Pubblicazione: (2026)
RAPID-Graph: Recursive All-Pairs Shortest Paths Using Processing-in-Memory for Dynamic Programming on Graphs
di: Chen, Yanru, et al.
Pubblicazione: (2025)
di: Chen, Yanru, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Optimizing Offload Performance in Heterogeneous MPSoCs
di: Colagrande, Luca, et al.
Pubblicazione: (2024) -
Taming Offload Overheads in a Massively Parallel Open-Source RISC-V MPSoC: Analysis and Optimization
di: Colagrande, Luca, et al.
Pubblicazione: (2025) -
Fast Switching Serial and Parallel Paradigms of SNN Inference on Multi-core Heterogeneous Neuromorphic Platform SpiNNaker2
di: Huang, Jiaxin, et al.
Pubblicazione: (2024) -
A Heterogeneous Chiplet Architecture for Accelerating End-to-End Transformer Models
di: Sharma, Harsh, et al.
Pubblicazione: (2023) -
MIMDRAM: An End-to-End Processing-Using-DRAM System for High-Throughput, Energy-Efficient and Programmer-Transparent Multiple-Instruction Multiple-Data Processing
di: Oliveira, Geraldo F., et al.
Pubblicazione: (2024)