DPU or GPU for Accelerating Neural Networks Inference -- Why not both? Split CNN Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Oztas, Ali Emre, Demir, Mahir, Garside, James, Luj'an, Mikel |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
von: Chen, Tse-Wei, et al.
Veröffentlicht: (2025)
von: Chen, Tse-Wei, et al.
Veröffentlicht: (2025)
Vision Transformer Computation and Resilience for Dynamic Inference
von: Sreedhar, Kavya, et al.
Veröffentlicht: (2022)
von: Sreedhar, Kavya, et al.
Veröffentlicht: (2022)
NeuralFuse: Learning to Recover the Accuracy of Access-Limited Neural Network Inference in Low-Voltage Regimes
von: Sun, Hao-Lun, et al.
Veröffentlicht: (2023)
von: Sun, Hao-Lun, et al.
Veröffentlicht: (2023)
SteROI-D: System Design and Mapping for Stereo Depth Inference on Regions of Interest
von: Erhardt, Jack, et al.
Veröffentlicht: (2025)
von: Erhardt, Jack, et al.
Veröffentlicht: (2025)
SpNeRF: Memory Efficient Sparse Volumetric Neural Rendering Accelerator for Edge Devices
von: Zhang, Yipu, et al.
Veröffentlicht: (2025)
von: Zhang, Yipu, et al.
Veröffentlicht: (2025)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
von: Zhang, Baoheng, et al.
Veröffentlicht: (2024)
von: Zhang, Baoheng, et al.
Veröffentlicht: (2024)
LoRA-Edge: Tensor-Train-Assisted LoRA for Practical CNN Fine-Tuning on Edge Devices
von: Kwak, Hyunseok, et al.
Veröffentlicht: (2025)
von: Kwak, Hyunseok, et al.
Veröffentlicht: (2025)
Accelerating ViT Inference on FPGA through Static and Dynamic Pruning
von: Parikh, Dhruv, et al.
Veröffentlicht: (2024)
von: Parikh, Dhruv, et al.
Veröffentlicht: (2024)
Agentic-HLS: An agentic reasoning based high-level synthesis system using large language models (AI for EDA workshop 2024)
von: Oztas, Ali Emre, et al.
Veröffentlicht: (2024)
von: Oztas, Ali Emre, et al.
Veröffentlicht: (2024)
HARFLOW3D: A Latency-Oriented 3D-CNN Accelerator Toolflow for HAR on FPGA Devices
von: Toupas, Petros, et al.
Veröffentlicht: (2023)
von: Toupas, Petros, et al.
Veröffentlicht: (2023)
Hardware-Algorithm Co-Optimization of Early-Exit Neural Networks for Multi-Core Edge Accelerators
von: Zniber, Alaa, et al.
Veröffentlicht: (2025)
von: Zniber, Alaa, et al.
Veröffentlicht: (2025)
Uni-Render: A Unified Accelerator for Real-Time Rendering Across Diverse Neural Renderers
von: Li, Chaojian, et al.
Veröffentlicht: (2025)
von: Li, Chaojian, et al.
Veröffentlicht: (2025)
A Parameterizable Convolution Accelerator for Embedded Deep Learning Applications
von: Mousouliotis, Panagiotis, et al.
Veröffentlicht: (2026)
von: Mousouliotis, Panagiotis, et al.
Veröffentlicht: (2026)
Primitive-Driven Acceleration of Hyperdimensional Computing for Real-Time Image Classification
von: Parikh, Dhruv, et al.
Veröffentlicht: (2026)
von: Parikh, Dhruv, et al.
Veröffentlicht: (2026)
MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization
von: Li, Shuaiting, et al.
Veröffentlicht: (2024)
von: Li, Shuaiting, et al.
Veröffentlicht: (2024)
CHOSEN: Compilation to Hardware Optimization Stack for Efficient Vision Transformer Inference
von: Sadeghi, Mohammad Erfan, et al.
Veröffentlicht: (2024)
von: Sadeghi, Mohammad Erfan, et al.
Veröffentlicht: (2024)
Vision Transformers on the Edge: A Comprehensive Survey of Model Compression and Acceleration Strategies
von: Saha, Shaibal, et al.
Veröffentlicht: (2025)
von: Saha, Shaibal, et al.
Veröffentlicht: (2025)
ORBIS: Output-Guided Token Reduction with Distribution-Aware Matching for Video Diffusion Acceleration
von: Lee, Hangyeol, et al.
Veröffentlicht: (2026)
von: Lee, Hangyeol, et al.
Veröffentlicht: (2026)
TIMERIPPLE: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space
von: Miao, Wenxuan, et al.
Veröffentlicht: (2025)
von: Miao, Wenxuan, et al.
Veröffentlicht: (2025)
SF-MMCN: Low-Power Sever Flow Multi-Mode Diffusion Model Accelerator
von: Hsu, Huan-Ke, et al.
Veröffentlicht: (2024)
von: Hsu, Huan-Ke, et al.
Veröffentlicht: (2024)
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
von: Oh, Changhun, et al.
Veröffentlicht: (2025)
von: Oh, Changhun, et al.
Veröffentlicht: (2025)
hARMS: A Hardware Acceleration Architecture for Real-Time Event-Based Optical Flow
von: Stumpp, Daniel C., et al.
Veröffentlicht: (2021)
von: Stumpp, Daniel C., et al.
Veröffentlicht: (2021)
Accelerating AI and Computer Vision for Satellite Pose Estimation on the Intel Myriad X Embedded SoC
von: Leon, Vasileios, et al.
Veröffentlicht: (2024)
von: Leon, Vasileios, et al.
Veröffentlicht: (2024)
DPD-NeuralEngine: A 22-nm 6.6-TOPS/W/mm$^2$ Recurrent Neural Network Accelerator for Wideband Power Amplifier Digital Pre-Distortion
von: Li, Ang, et al.
Veröffentlicht: (2024)
von: Li, Ang, et al.
Veröffentlicht: (2024)
GS-TG: 3D Gaussian Splatting Accelerator with Tile Grouping for Reducing Redundant Sorting while Preserving Rasterization Efficiency
von: Jo, Joongho, et al.
Veröffentlicht: (2025)
von: Jo, Joongho, et al.
Veröffentlicht: (2025)
TinyIceNet: Low-Power SAR Sea Ice Segmentation for On-Board FPGA Inference
von: Koutayni, Mhd Rashed Al, et al.
Veröffentlicht: (2026)
von: Koutayni, Mhd Rashed Al, et al.
Veröffentlicht: (2026)
ViM-Q: Scalable Algorithm-Hardware Co-Design for Vision Mamba Model Inference on FPGA
von: Lyu, Shengzhe, et al.
Veröffentlicht: (2026)
von: Lyu, Shengzhe, et al.
Veröffentlicht: (2026)
Ternary-Input Binary-Weight CNN Accelerator Design for Miniature Object Classification System with Query-Driven Spatial DVS
von: Li, Yuyang, et al.
Veröffentlicht: (2025)
von: Li, Yuyang, et al.
Veröffentlicht: (2025)
Gen-NeRF: Efficient and Generalizable Neural Radiance Fields via Algorithm-Hardware Co-Design
von: Fu, Yonggan, et al.
Veröffentlicht: (2023)
von: Fu, Yonggan, et al.
Veröffentlicht: (2023)
Hyft: A Reconfigurable Softmax Accelerator with Hybrid Numeric Format for both Training and Inference
von: Xia, Tianhua, et al.
Veröffentlicht: (2023)
von: Xia, Tianhua, et al.
Veröffentlicht: (2023)
BILLNET: A Binarized Conv3D-LSTM Network with Logic-gated residual architecture for hardware-efficient video inference
von: Nguyen, Van Thien, et al.
Veröffentlicht: (2025)
von: Nguyen, Van Thien, et al.
Veröffentlicht: (2025)
Edge-GPU Based Face Tracking for Face Detection and Recognition Acceleration
von: Baobaid, Asma, et al.
Veröffentlicht: (2025)
von: Baobaid, Asma, et al.
Veröffentlicht: (2025)
ViTCoD: Vision Transformer Acceleration via Dedicated Algorithm and Accelerator Co-Design
von: You, Haoran, et al.
Veröffentlicht: (2022)
von: You, Haoran, et al.
Veröffentlicht: (2022)
Accelerating 3D Gaussian Splatting with Neural Sorting and Axis-Oriented Rasterization
von: Wang, Zhican, et al.
Veröffentlicht: (2025)
von: Wang, Zhican, et al.
Veröffentlicht: (2025)
Hardware acceleration for ultra-fast Neural Network training on FPGA for MRF map reconstruction
von: Ricchi, Mattia, et al.
Veröffentlicht: (2025)
von: Ricchi, Mattia, et al.
Veröffentlicht: (2025)
DPUV4E: High-Throughput DPU Architecture Design for CNN on Versal ACAP
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
Late Breaking Result: FPGA-Based Emulation and Fault Injection for CNN Inference Accelerators
von: Masar, Filip, et al.
Veröffentlicht: (2025)
von: Masar, Filip, et al.
Veröffentlicht: (2025)
Ditto: Accelerating Diffusion Model via Temporal Value Similarity
von: Kim, Sungbin, et al.
Veröffentlicht: (2025)
von: Kim, Sungbin, et al.
Veröffentlicht: (2025)
Real-Time Spacecraft Pose Estimation Using Mixed-Precision Quantized Neural Network on COTS Reconfigurable MPSoC
von: Posso, Julien, et al.
Veröffentlicht: (2024)
von: Posso, Julien, et al.
Veröffentlicht: (2024)
EvGNN: An Event-driven Graph Neural Network Accelerator for Edge Vision
von: Yang, Yufeng, et al.
Veröffentlicht: (2024)
von: Yang, Yufeng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
von: Chen, Tse-Wei, et al.
Veröffentlicht: (2025) -
Vision Transformer Computation and Resilience for Dynamic Inference
von: Sreedhar, Kavya, et al.
Veröffentlicht: (2022) -
NeuralFuse: Learning to Recover the Accuracy of Access-Limited Neural Network Inference in Low-Voltage Regimes
von: Sun, Hao-Lun, et al.
Veröffentlicht: (2023) -
SteROI-D: System Design and Mapping for Stereo Depth Inference on Regions of Interest
von: Erhardt, Jack, et al.
Veröffentlicht: (2025) -
SpNeRF: Memory Efficient Sparse Volumetric Neural Rendering Accelerator for Edge Devices
von: Zhang, Yipu, et al.
Veröffentlicht: (2025)