Hardware-Algorithm Co-Optimization of Early-Exit Neural Networks for Multi-Core Edge Accelerators
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zniber, Alaa, Symons, Arne, Karrakchou, Ouassim, Verhelst, Marian, Ghogho, Mounir |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Balancing Stability and Plasticity in Sequentially Trained Early-Exiting Neural Networks
par: Zniber, Alaa, et autres
Publié: (2026)
par: Zniber, Alaa, et autres
Publié: (2026)
Early Exiting Predictive Coding Neural Networks for Edge AI
par: Zniber, Alaa, et autres
Publié: (2023)
par: Zniber, Alaa, et autres
Publié: (2023)
Fine-Grained Fusion: The Missing Piece in Area-Efficient State Space Model Acceleration
par: Geens, Robin, et autres
Publié: (2025)
par: Geens, Robin, et autres
Publié: (2025)
Collaborative P4-SDN DDoS Detection and Mitigation with Early-Exit Neural Networks
par: Karrakchou, Ouassim, et autres
Publié: (2025)
par: Karrakchou, Ouassim, et autres
Publié: (2025)
DeFiNES: Enabling Fast Exploration of the Depth-first Scheduling Space for DNN Accelerators through Analytical Modeling
par: Mei, Linyan, et autres
Publié: (2022)
par: Mei, Linyan, et autres
Publié: (2022)
Optimizing Layer-Fused Scheduling of Transformer Networks on Multi-accelerator Platforms
par: Colleman, Steven, et autres
Publié: (2024)
par: Colleman, Steven, et autres
Publié: (2024)
Enabling Efficient Hardware Acceleration of Hybrid Vision Transformer (ViT) Networks at the Edge
par: Dumoulin, Joren, et autres
Publié: (2025)
par: Dumoulin, Joren, et autres
Publié: (2025)
Stream: Design Space Exploration of Layer-Fused DNNs on Heterogeneous Dataflow Accelerators
par: Symons, Arne, et autres
Publié: (2022)
par: Symons, Arne, et autres
Publié: (2022)
Hardware-Centric Analysis of DeepSeek's Multi-Head Latent Attention
par: Geens, Robin, et autres
Publié: (2025)
par: Geens, Robin, et autres
Publié: (2025)
SALSA: Simulated Annealing based Loop-Ordering Scheduler for DNN Accelerators
par: Jung, Victor J. B., et autres
Publié: (2023)
par: Jung, Victor J. B., et autres
Publié: (2023)
Hardware Generation and Exploration of Lookup Table-Based Accelerators for 1.58-bit LLM Inference
par: Geens, Robin, et autres
Publié: (2026)
par: Geens, Robin, et autres
Publié: (2026)
CARMEN: CORDIC-Accelerated Resource-Efficient Multi-Precision Inference Engine for Deep Learning
par: Kumar, Sonu, et autres
Publié: (2026)
par: Kumar, Sonu, et autres
Publié: (2026)
CMDS: Cross-layer Dataflow Optimization for DNN Accelerators Exploiting Multi-bank Memories
par: Shi, Man, et autres
Publié: (2024)
par: Shi, Man, et autres
Publié: (2024)
XDMA: A Distributed, Extensible DMA Architecture for Layout-Flexible Data Movements in Heterogeneous Multi-Accelerator SoCs
par: Kong, Fanchen, et autres
Publié: (2025)
par: Kong, Fanchen, et autres
Publié: (2025)
MC$^2$A: Enabling Algorithm-Hardware Co-Design for Efficient Markov Chain Monte Carlo Acceleration
par: Zhao, Shirui, et autres
Publié: (2025)
par: Zhao, Shirui, et autres
Publié: (2025)
NX-CGRA: A Programmable Hardware Accelerator for Core Transformer Algorithms on Edge Devices
par: Prasad, Rohit
Publié: (2025)
par: Prasad, Rohit
Publié: (2025)
The Hyperscale Lottery: How State-Space Models Have Sacrificed Edge Efficiency
par: Geens, Robin, et autres
Publié: (2026)
par: Geens, Robin, et autres
Publié: (2026)
Anda: Unlocking Efficient LLM Inference with a Variable-Length Grouped Activation Data Format
par: Fang, Chao, et autres
Publié: (2024)
par: Fang, Chao, et autres
Publié: (2024)
SpikeX: Exploring Accelerator Architecture and Network-Hardware Co-Optimization for Sparse Spiking Neural Networks
par: Xu, Boxun, et autres
Publié: (2025)
par: Xu, Boxun, et autres
Publié: (2025)
Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
par: Cuyckens, Stef, et autres
Publié: (2025)
par: Cuyckens, Stef, et autres
Publié: (2025)
NDFT: Accelerating Density Functional Theory Calculations via Hardware/Software Co-Design on Near-Data Computing System
par: Jiang, Qingcai, et autres
Publié: (2025)
par: Jiang, Qingcai, et autres
Publié: (2025)
How to keep pushing ML accelerator performance? Know your rooflines!
par: Verhelst, Marian, et autres
Publié: (2025)
par: Verhelst, Marian, et autres
Publié: (2025)
Torrent: A Distributed DMA for Efficient and Flexible Point-to-Multipoint Data Movement
par: Deng, Yunhao, et autres
Publié: (2025)
par: Deng, Yunhao, et autres
Publié: (2025)
Gen-NeRF: Efficient and Generalizable Neural Radiance Fields via Algorithm-Hardware Co-Design
par: Fu, Yonggan, et autres
Publié: (2023)
par: Fu, Yonggan, et autres
Publié: (2023)
An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems
par: Antonio, Ryan Albert, et autres
Publié: (2025)
par: Antonio, Ryan Albert, et autres
Publié: (2025)
iEEG Seizure Detection with a Sparse Hyperdimensional Computing Accelerator
par: Cuyckens, Stef, et autres
Publié: (2025)
par: Cuyckens, Stef, et autres
Publié: (2025)
EyeCoD: Eye Tracking System Acceleration via FlatCam-based Algorithm & Accelerator Co-Design
par: You, Haoran, et autres
Publié: (2022)
par: You, Haoran, et autres
Publié: (2022)
ATHEENA: A Toolflow for Hardware Early-Exit Network Automation
par: Biggs, Benjamin, et autres
Publié: (2023)
par: Biggs, Benjamin, et autres
Publié: (2023)
TT-Edge: A Hardware-Software Co-Design for Energy-Efficient Tensor-Train Decomposition on Edge AI
par: Kwak, Hyunseok, et autres
Publié: (2025)
par: Kwak, Hyunseok, et autres
Publié: (2025)
RAMAN: Resource-efficient ApproxiMate Posit Processing for Algorithm-Hardware Co-desigN
par: Khan, Mohd Faisal, et autres
Publié: (2025)
par: Khan, Mohd Faisal, et autres
Publié: (2025)
DataMaestro: A Versatile and Efficient Data Streaming Engine Bringing Decoupled Memory Access To Dataflow Accelerators
par: Yi, Xiaoling, et autres
Publié: (2025)
par: Yi, Xiaoling, et autres
Publié: (2025)
A Survey on Graph Neural Network Acceleration: Algorithms, Systems, and Customized Hardware
par: Zhang, Shichang, et autres
Publié: (2023)
par: Zhang, Shichang, et autres
Publié: (2023)
P3-LLM: An Integrated NPU-PIM Accelerator for Edge LLM Inference Using Hybrid Numerical Formats
par: Chen, Yuzong, et autres
Publié: (2025)
par: Chen, Yuzong, et autres
Publié: (2025)
Spiking Transformer Hardware Accelerators in 3D Integration
par: Xu, Boxun, et autres
Publié: (2024)
par: Xu, Boxun, et autres
Publié: (2024)
POLARON: Precision-aware On-device Learning and Adaptive Runtime-cONfigurable AI acceleration
par: Lokhande, Mukul, et autres
Publié: (2025)
par: Lokhande, Mukul, et autres
Publié: (2025)
VeriPy -- A New Python-Based Approach for SDR Pipelined/Unrolled Hardware Accelerator Generation
par: Zhao, Yuqin, et autres
Publié: (2025)
par: Zhao, Yuqin, et autres
Publié: (2025)
Multi-Objective Hardware-Mapping Co-Optimisation for Multi-DNN Workloads on Chiplet-based Accelerators
par: Das, Abhijit, et autres
Publié: (2022)
par: Das, Abhijit, et autres
Publié: (2022)
Pack my weights and run! Minimizing overheads for in-memory computing accelerators
par: Houshmand, Pouya, et autres
Publié: (2024)
par: Houshmand, Pouya, et autres
Publié: (2024)
Bhasha-Rupantarika: Algorithm-Hardware Co-design approach for Multilingual Neural Machine Translation
par: Lokhande, Mukul, et autres
Publié: (2025)
par: Lokhande, Mukul, et autres
Publié: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
par: Huang, Wei-Hsing, et autres
Publié: (2024)
par: Huang, Wei-Hsing, et autres
Publié: (2024)
Documents similaires
-
Balancing Stability and Plasticity in Sequentially Trained Early-Exiting Neural Networks
par: Zniber, Alaa, et autres
Publié: (2026) -
Early Exiting Predictive Coding Neural Networks for Edge AI
par: Zniber, Alaa, et autres
Publié: (2023) -
Fine-Grained Fusion: The Missing Piece in Area-Efficient State Space Model Acceleration
par: Geens, Robin, et autres
Publié: (2025) -
Collaborative P4-SDN DDoS Detection and Mitigation with Early-Exit Neural Networks
par: Karrakchou, Ouassim, et autres
Publié: (2025) -
DeFiNES: Enabling Fast Exploration of the Depth-first Scheduling Space for DNN Accelerators through Analytical Modeling
par: Mei, Linyan, et autres
Publié: (2022)