High Utilization Energy-Aware Real-Time Inference Deep Convolutional Neural Network Accelerator
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Kuan-Ting, Chiu, Ching-Te, Chang, Jheng-Yi, Huang, Shi-Zong, Li, Yu-Ting |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Flexible Precision Scaling Deep Neural Network Accelerator with Efficient Weight Combination
di: Zhao, Liang, et al.
Pubblicazione: (2025)
di: Zhao, Liang, et al.
Pubblicazione: (2025)
Low Power Vision Transformer Accelerator with Hardware-Aware Pruning and Optimized Dataflow
di: Hsiung, Ching-Lin, et al.
Pubblicazione: (2025)
di: Hsiung, Ching-Lin, et al.
Pubblicazione: (2025)
A Hybrid-Domain Floating-Point Compute-in-Memory Architecture for Efficient Acceleration of High-Precision Deep Neural Networks
di: Yi, Zhiqiang, et al.
Pubblicazione: (2025)
di: Yi, Zhiqiang, et al.
Pubblicazione: (2025)
Energy-Efficient FPGA Framework for Non-Quantized Convolutional Neural Networks
di: Athanasiadis, Angelos, et al.
Pubblicazione: (2025)
di: Athanasiadis, Angelos, et al.
Pubblicazione: (2025)
Special Session: Sustainable Deployment of Deep Neural Networks on Non-Volatile Compute-in-Memory Accelerators
di: Qin, Yifan, et al.
Pubblicazione: (2025)
di: Qin, Yifan, et al.
Pubblicazione: (2025)
Work-in-Progress: Real-Time Neural Network Inference on a Custom RISC-V Multicore Vector Processor
di: Kirschner, Maximilian, et al.
Pubblicazione: (2024)
di: Kirschner, Maximilian, et al.
Pubblicazione: (2024)
VitaLLM: A Versatile and Tiny Accelerator for Mixed-Precision LLM Inference on Edge Devices
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
Exploring Quantization and Mapping Synergy in Hardware-Aware Deep Neural Network Accelerators
di: Klhufek, Jan, et al.
Pubblicazione: (2024)
di: Klhufek, Jan, et al.
Pubblicazione: (2024)
VitaLLM: A Versatile, Ultra-Compact Ternary LLM Accelerator with Dependency-Aware Scheduling
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
di: Lin, Zi-Wei, et al.
Pubblicazione: (2026)
FILCO: Flexible Composing Architecture with Real-Time Reconfigurability for DNN Acceleration
di: Chen, Xingzhen, et al.
Pubblicazione: (2026)
di: Chen, Xingzhen, et al.
Pubblicazione: (2026)
FLICKER: A Fine-Grained Contribution-Aware Accelerator for Real-Time 3D Gaussian Splatting
di: Ou, Wenhui, et al.
Pubblicazione: (2026)
di: Ou, Wenhui, et al.
Pubblicazione: (2026)
SpikeStream: Accelerating Spiking Neural Network Inference on RISC-V Clusters with Sparse Computation Extensions
di: Manoni, Simone, et al.
Pubblicazione: (2025)
di: Manoni, Simone, et al.
Pubblicazione: (2025)
Hardware-Aware Neural Network Compilation with Learned Optimization: A RISC-V Accelerator Approach
di: Ganti, Ravindra, et al.
Pubblicazione: (2025)
di: Ganti, Ravindra, et al.
Pubblicazione: (2025)
HURRY: Highly Utilized, Reconfigurable ReRAM-based In-situ Accelerator with Multifunctionality
di: Shin, Hery, et al.
Pubblicazione: (2024)
di: Shin, Hery, et al.
Pubblicazione: (2024)
TENET: An Efficient Sparsity-Aware LUT-Centric Architecture for Ternary LLM Inference On Edge
di: Huang, Zhirui, et al.
Pubblicazione: (2025)
di: Huang, Zhirui, et al.
Pubblicazione: (2025)
DCI: A Coordinated Allocation and Filling Workload-Aware Dual-Cache Allocation GNN Inference Acceleration System
di: Luo, Yi, et al.
Pubblicazione: (2025)
di: Luo, Yi, et al.
Pubblicazione: (2025)
always_comm: An FPGA-based Hardware Accelerator for Audio/Video Compression and Transmission
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
Analysis of Single Event Induced Bit Faults in a Deep Neural Network Accelerator Pipeline
di: Jonckers, Naïn, et al.
Pubblicazione: (2025)
di: Jonckers, Naïn, et al.
Pubblicazione: (2025)
A PVT-Resilient Subthreshold SRAM-Based In-Memory Computing Accelerator with In-Situ Regulation for Energy-Efficient Spiking Neural Networks
di: Kao, Shih-Hang, et al.
Pubblicazione: (2026)
di: Kao, Shih-Hang, et al.
Pubblicazione: (2026)
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
di: Fayyazi, Arash, et al.
Pubblicazione: (2023)
di: Fayyazi, Arash, et al.
Pubblicazione: (2023)
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
Sparse-on-Dense: Area and Energy-Efficient Computing of Sparse Neural Networks on Dense Matrix Multiplication Accelerators
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
VESTA: A Versatile SNN-Based Transformer Accelerator with Unified PEs for Multiple Computational Layers
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
di: Chen, Ching-Yao, et al.
Pubblicazione: (2025)
Real-Time, Energy-Efficient, Sampling-Based Optimal Control via FPGA Acceleration
di: Desai, Tanmay, et al.
Pubblicazione: (2026)
di: Desai, Tanmay, et al.
Pubblicazione: (2026)
Energy-Aware Heterogeneous Federated Learning via Approximate DNN Accelerators
di: Pfeiffer, Kilian, et al.
Pubblicazione: (2024)
di: Pfeiffer, Kilian, et al.
Pubblicazione: (2024)
Convolutions Predictable Offloading to an Accelerator: Formalization and Optimization
di: Husson, Benjamin, et al.
Pubblicazione: (2026)
di: Husson, Benjamin, et al.
Pubblicazione: (2026)
Voxel-CIM: An Efficient Compute-in-Memory Accelerator for Voxel-based Point Cloud Neural Networks
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
di: Lin, Xipeng, et al.
Pubblicazione: (2024)
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
di: Khataei, Alireza, et al.
Pubblicazione: (2025)
di: Khataei, Alireza, et al.
Pubblicazione: (2025)
A Switch-Centric In-Network Architecture for Accelerating LLM Inference in Shared-Memory Network
di: Jiang, Aojie, et al.
Pubblicazione: (2026)
di: Jiang, Aojie, et al.
Pubblicazione: (2026)
DIRC-RAG: Accelerating Edge RAG with Robust High-Density and High-Loading-Bandwidth Digital In-ReRAM Computation
di: Shao, Kunming, et al.
Pubblicazione: (2025)
di: Shao, Kunming, et al.
Pubblicazione: (2025)
Lumina: Real-Time Mobile Neural Rendering by Exploiting Computational Redundancy
di: Feng, Yu, et al.
Pubblicazione: (2025)
di: Feng, Yu, et al.
Pubblicazione: (2025)
GCoD: Graph Convolutional Network Acceleration via Dedicated Algorithm and Accelerator Co-Design
di: You, Haoran, et al.
Pubblicazione: (2021)
di: You, Haoran, et al.
Pubblicazione: (2021)
ARMAN: A Reconfigurable Monolithic 3D Accelerator Architecture for Convolutional Neural Networks
di: Sedaghatgoo, Ali, et al.
Pubblicazione: (2024)
di: Sedaghatgoo, Ali, et al.
Pubblicazione: (2024)
FireFly-P: FPGA-Accelerated Spiking Neural Network Plasticity for Robust Adaptive Control
di: Li, Tenglong, et al.
Pubblicazione: (2026)
di: Li, Tenglong, et al.
Pubblicazione: (2026)
Real-Time Adaptive Neural Network on FPGA: Enhancing Adaptability through Dynamic Classifier Selection
di: Bouazzaoui, Achraf El, et al.
Pubblicazione: (2023)
di: Bouazzaoui, Achraf El, et al.
Pubblicazione: (2023)
FireFly-S: Exploiting Dual-Side Sparsity for Spiking Neural Networks Acceleration with Reconfigurable Spatial Architecture
di: Li, Tenglong, et al.
Pubblicazione: (2024)
di: Li, Tenglong, et al.
Pubblicazione: (2024)
A 16 nm 1.60TOPS/W High Utilization DNN Accelerator with 3D Spatial Data Reuse and Efficient Shared Memory Access
di: Yi, Xiaoling, et al.
Pubblicazione: (2026)
di: Yi, Xiaoling, et al.
Pubblicazione: (2026)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
di: Hsu, Kai-Chieh, et al.
Pubblicazione: (2025)
MultiVic: A Time-Predictable RISC-V Multi-Core Processor Optimized for Neural Network Inference
di: Kirschner, Maximilian, et al.
Pubblicazione: (2025)
di: Kirschner, Maximilian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Flexible Precision Scaling Deep Neural Network Accelerator with Efficient Weight Combination
di: Zhao, Liang, et al.
Pubblicazione: (2025) -
Low Power Vision Transformer Accelerator with Hardware-Aware Pruning and Optimized Dataflow
di: Hsiung, Ching-Lin, et al.
Pubblicazione: (2025) -
A Hybrid-Domain Floating-Point Compute-in-Memory Architecture for Efficient Acceleration of High-Precision Deep Neural Networks
di: Yi, Zhiqiang, et al.
Pubblicazione: (2025) -
Energy-Efficient FPGA Framework for Non-Quantized Convolutional Neural Networks
di: Athanasiadis, Angelos, et al.
Pubblicazione: (2025) -
Special Session: Sustainable Deployment of Deep Neural Networks on Non-Volatile Compute-in-Memory Accelerators
di: Qin, Yifan, et al.
Pubblicazione: (2025)