Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Tse-Wei, Tao, Wei, Zhao, Dongyue, Mima, Kazuhiro, Ito, Tadayuki, Osa, Kinya, Kato, Masami |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
par: Fayyazi, Arash, et autres
Publié: (2023)
par: Fayyazi, Arash, et autres
Publié: (2023)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
par: Huang, Wei-Hsing, et autres
Publié: (2024)
par: Huang, Wei-Hsing, et autres
Publié: (2024)
UNet--: Memory-Efficient and Feature-Enhanced Network Architecture based on U-Net with Reduced Skip-Connections
par: Yin, Lingxiao, et autres
Publié: (2024)
par: Yin, Lingxiao, et autres
Publié: (2024)
Binary Neural Network Implementation for Handwritten Digit Recognition on FPGA
par: Ertörer, Emir Devlet, et autres
Publié: (2025)
par: Ertörer, Emir Devlet, et autres
Publié: (2025)
NL-DPE: An Analog In-memory Non-Linear Dot Product Engine for Efficient CNN and LLM Inference
par: Zhao, Lei, et autres
Publié: (2025)
par: Zhao, Lei, et autres
Publié: (2025)
CIMPool: Scalable Neural Network Acceleration for Compute-In-Memory using Weight Pools
par: Li, Shurui, et autres
Publié: (2025)
par: Li, Shurui, et autres
Publié: (2025)
Reuse and Blend: Energy-Efficient Optical Neural Network Enabled by Weight Sharing
par: Xu, Bo, et autres
Publié: (2024)
par: Xu, Bo, et autres
Publié: (2024)
ONNX-to-Hardware Design Flow for Adaptive Neural-Network Inference on FPGAs
par: Manca, Federico, et autres
Publié: (2024)
par: Manca, Federico, et autres
Publié: (2024)
BinSparX: Sparsified Binary Neural Networks for Reduced Hardware Non-Idealities in Xbar Arrays
par: Malhotra, Akul, et autres
Publié: (2024)
par: Malhotra, Akul, et autres
Publié: (2024)
Siracusa: A 16 nm Heterogenous RISC-V SoC for Extended Reality with At-MRAM Neural Engine
par: Prasad, Arpan Suravi, et autres
Publié: (2023)
par: Prasad, Arpan Suravi, et autres
Publié: (2023)
High Utilization Energy-Aware Real-Time Inference Deep Convolutional Neural Network Accelerator
par: Lin, Kuan-Ting, et autres
Publié: (2025)
par: Lin, Kuan-Ting, et autres
Publié: (2025)
No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering
par: Wei, Linye, et autres
Publié: (2025)
par: Wei, Linye, et autres
Publié: (2025)
Exploring the Performance Improvement of Tensor Processing Engines through Transformation in the Bit-weight Dimension of MACs
par: Wu, Qizhe, et autres
Publié: (2025)
par: Wu, Qizhe, et autres
Publié: (2025)
Prosperity: Accelerating Spiking Neural Networks via Product Sparsity
par: Wei, Chiyue, et autres
Publié: (2025)
par: Wei, Chiyue, et autres
Publié: (2025)
SpikeStream: Accelerating Spiking Neural Network Inference on RISC-V Clusters with Sparse Computation Extensions
par: Manoni, Simone, et autres
Publié: (2025)
par: Manoni, Simone, et autres
Publié: (2025)
GCoD: Graph Convolutional Network Acceleration via Dedicated Algorithm and Accelerator Co-Design
par: You, Haoran, et autres
Publié: (2021)
par: You, Haoran, et autres
Publié: (2021)
MultiVic: A Time-Predictable RISC-V Multi-Core Processor Optimized for Neural Network Inference
par: Kirschner, Maximilian, et autres
Publié: (2025)
par: Kirschner, Maximilian, et autres
Publié: (2025)
Work-in-Progress: Real-Time Neural Network Inference on a Custom RISC-V Multicore Vector Processor
par: Kirschner, Maximilian, et autres
Publié: (2024)
par: Kirschner, Maximilian, et autres
Publié: (2024)
Revealing Untapped DSP Optimization Potentials for FPGA-Based Systolic Matrix Engines
par: Li, Jindong, et autres
Publié: (2024)
par: Li, Jindong, et autres
Publié: (2024)
VitaLLM: A Versatile and Tiny Accelerator for Mixed-Precision LLM Inference on Edge Devices
par: Lin, Zi-Wei, et autres
Publié: (2026)
par: Lin, Zi-Wei, et autres
Publié: (2026)
IMAGine: An In-Memory Accelerated GEMV Engine Overlay
par: Kabir, MD Arafat, et autres
Publié: (2024)
par: Kabir, MD Arafat, et autres
Publié: (2024)
Orion: Characterizing and Programming Apple's Neural Engine for LLM Training and Inference
par: Kumaresan, Ramchand
Publié: (2026)
par: Kumaresan, Ramchand
Publié: (2026)
BiKA: Kolmogorov-Arnold-Network-inspired Ultra Lightweight Neural Network Hardware Accelerator
par: Liu, Yuhao, et autres
Publié: (2026)
par: Liu, Yuhao, et autres
Publié: (2026)
A Flexible Precision Scaling Deep Neural Network Accelerator with Efficient Weight Combination
par: Zhao, Liang, et autres
Publié: (2025)
par: Zhao, Liang, et autres
Publié: (2025)
Monitor Placement for Fault Localization in Deep Neural Network Accelerators
par: Liu, Wei-Kai
Publié: (2023)
par: Liu, Wei-Kai
Publié: (2023)
CuLifter: Lifting GPU Binaries to Typed IR
par: Zhao, Jisheng, et autres
Publié: (2026)
par: Zhao, Jisheng, et autres
Publié: (2026)
Bayes2IMC: In-Memory Computing for Bayesian Binary Neural Networks
par: Katti, Prabodh, et autres
Publié: (2024)
par: Katti, Prabodh, et autres
Publié: (2024)
FireFly-T: High-Throughput Sparsity Exploitation for Spiking Transformer Acceleration with Dual-Engine Overlay Architecture
par: Li, Tenglong, et autres
Publié: (2025)
par: Li, Tenglong, et autres
Publié: (2025)
CMD: A Cache-assisted GPU Memory Deduplication Architecture
par: Zhao, Wei, et autres
Publié: (2024)
par: Zhao, Wei, et autres
Publié: (2024)
HENNC: Hardware Engine for Artificial Neural Network-based Chaotic Oscillators
par: Vaziri, Mobin, et autres
Publié: (2024)
par: Vaziri, Mobin, et autres
Publié: (2024)
Accelerating CRONet on AMD Versal AIE-ML Engines
par: Mhatre, Kaustubh, et autres
Publié: (2026)
par: Mhatre, Kaustubh, et autres
Publié: (2026)
A High-Throughput FPGA Accelerator for Lightweight CNNs With Balanced Dataflow
par: Zhao, Zhiyuan, et autres
Publié: (2024)
par: Zhao, Zhiyuan, et autres
Publié: (2024)
Table-Lookup MAC: Scalable Processing of Quantised Neural Networks in FPGA Soft Logic
par: Gerlinghoff, Daniel, et autres
Publié: (2024)
par: Gerlinghoff, Daniel, et autres
Publié: (2024)
KLiNQ: Knowledge Distillation-Assisted Lightweight Neural Network for Qubit Readout on FPGA
par: Guo, Xiaorang, et autres
Publié: (2025)
par: Guo, Xiaorang, et autres
Publié: (2025)
NeuroAI Temporal Neural Networks (NeuTNNs): Microarchitecture and Design Framework for Specialized Neuromorphic Processing Units
par: Venkatachalam, Shanmuga, et autres
Publié: (2026)
par: Venkatachalam, Shanmuga, et autres
Publié: (2026)
ONE-SA: Enabling Nonlinear Operations in Systolic Arrays for Efficient and Flexible Neural Network Inference
par: Sun, Ruiqi, et autres
Publié: (2024)
par: Sun, Ruiqi, et autres
Publié: (2024)
Exploring the Versal AI Engine for 3D Gaussian Splatting
par: Shimamura, Kotaro, et autres
Publié: (2025)
par: Shimamura, Kotaro, et autres
Publié: (2025)
Tensor Memory Engine: On-the-fly Data Reorganization for Ideal Locality
par: Hoornaert, Denis, et autres
Publié: (2026)
par: Hoornaert, Denis, et autres
Publié: (2026)
STAR: An Efficient Softmax Engine for Attention Model with RRAM Crossbar
par: Zhai, Yifeng, et autres
Publié: (2024)
par: Zhai, Yifeng, et autres
Publié: (2024)
Platinum: Path-Adaptable LUT-Based Accelerator Tailored for Low-Bit Weight Matrix Multiplication
par: Shan, Haoxuan, et autres
Publié: (2025)
par: Shan, Haoxuan, et autres
Publié: (2025)
Documents similaires
-
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
par: Fayyazi, Arash, et autres
Publié: (2023) -
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
par: Huang, Wei-Hsing, et autres
Publié: (2024) -
UNet--: Memory-Efficient and Feature-Enhanced Network Architecture based on U-Net with Reduced Skip-Connections
par: Yin, Lingxiao, et autres
Publié: (2024) -
Binary Neural Network Implementation for Handwritten Digit Recognition on FPGA
par: Ertörer, Emir Devlet, et autres
Publié: (2025) -
NL-DPE: An Analog In-memory Non-Linear Dot Product Engine for Efficient CNN and LLM Inference
par: Zhao, Lei, et autres
Publié: (2025)