Leveraging Application-Specific Knowledge for Energy-Efficient Deep Learning Accelerators on Resource-Constrained FPGAs
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Qian, Chao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Energy Efficient LSTM Accelerators for Embedded FPGAs through Parameterised Architecture Design
par: Qian, Chao, et autres
Publié: (2026)
par: Qian, Chao, et autres
Publié: (2026)
An Energy-Efficient Artefact Detection Accelerator on FPGAs for Hyper-Spectral Satellite Imagery
par: Castelino, Cornell, et autres
Publié: (2024)
par: Castelino, Cornell, et autres
Publié: (2024)
Accelerating Boolean Constraint Propagation for Efficient SAT-Solving on FPGAs
par: Govindasamy, Hariprasadh, et autres
Publié: (2024)
par: Govindasamy, Hariprasadh, et autres
Publié: (2024)
Efficient Approaches for GEMM Acceleration on Leading AI-Optimized FPGAs
par: Taka, Endri, et autres
Publié: (2024)
par: Taka, Endri, et autres
Publié: (2024)
LlamaF: An Efficient Llama2 Architecture Accelerator on Embedded FPGAs
par: Xu, Han, et autres
Publié: (2024)
par: Xu, Han, et autres
Publié: (2024)
Memory-efficient Sketch Acceleration for Handling Large Network Flows on FPGAs
par: Han, Zhaoyang, et autres
Publié: (2025)
par: Han, Zhaoyang, et autres
Publié: (2025)
TeLLMe: An Energy-Efficient Ternary LLM Accelerator for Prefilling and Decoding on Edge FPGAs
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
Energy-Aware Deep Learning on Resource-Constrained Hardware
par: Millar, Josh, et autres
Publié: (2025)
par: Millar, Josh, et autres
Publié: (2025)
ElasticAI: Creating and Deploying Energy-Efficient Deep Learning Accelerator for Pervasive Computing
par: Qian, Chao, et autres
Publié: (2024)
par: Qian, Chao, et autres
Publié: (2024)
Theoretical Analysis of the Efficient-Memory Matrix Storage Method for Quantum Emulation Accelerators with Gate Fusion on FPGAs
par: Le, Tran Xuan Hieu, et autres
Publié: (2024)
par: Le, Tran Xuan Hieu, et autres
Publié: (2024)
SWAT: Scalable and Efficient Window Attention-based Transformers Acceleration on FPGAs
par: Bai, Zhenyu, et autres
Publié: (2024)
par: Bai, Zhenyu, et autres
Publié: (2024)
A Resource-Driven Approach for Implementing CNNs on FPGAs Using Adaptive IPs
par: Magalhães, Philippe, et autres
Publié: (2025)
par: Magalhães, Philippe, et autres
Publié: (2025)
A Survey on LUT-based Deep Neural Networks Implemented in FPGAs
par: Guo, Zeyu
Publié: (2025)
par: Guo, Zeyu
Publié: (2025)
DPUConfig: Optimizing ML Inference in FPGAs Using Reinforcement Learning
par: Patras, Alexandros, et autres
Publié: (2026)
par: Patras, Alexandros, et autres
Publié: (2026)
Hardware-Efficient Accurate 4-bit Multiplier for Xilinx 7 Series FPGAs
par: Kida, Misaki, et autres
Publié: (2025)
par: Kida, Misaki, et autres
Publié: (2025)
MCBP: A Memory-Compute Efficient LLM Inference Accelerator Leveraging Bit-Slice-enabled Sparsity and Repetitiveness
par: Wang, Huizheng, et autres
Publié: (2025)
par: Wang, Huizheng, et autres
Publié: (2025)
Leveraging FPGAs for Homomorphic Matrix-Vector Multiplication in Oblivious Message Retrieval
par: Bosworth, Grant, et autres
Publié: (2025)
par: Bosworth, Grant, et autres
Publié: (2025)
Enabling Long FFT Convolutions on Memory-Constrained FPGAs via Chunking
par: Wang, Peter, et autres
Publié: (2025)
par: Wang, Peter, et autres
Publié: (2025)
BETA: Binarized Energy-Efficient Transformer Accelerator at the Edge
par: Ji, Yuhao, et autres
Publié: (2024)
par: Ji, Yuhao, et autres
Publié: (2024)
QUADOL: A Quality-Driven Approximate Logic Synthesis Method Exploiting Dual-Output LUTs for Modern FPGAs
par: Shi, Jian, et autres
Publié: (2024)
par: Shi, Jian, et autres
Publié: (2024)
Wavelet Based Frequency Detection Using FPGAs
par: Hill, Caleb, et autres
Publié: (2024)
par: Hill, Caleb, et autres
Publié: (2024)
Resource Utilization of Differentiable Logic Gate Networks Deployed on FPGAs
par: Wormald, Stephen, et autres
Publié: (2026)
par: Wormald, Stephen, et autres
Publié: (2026)
Leveraging Recurrent Patterns in Graph Accelerators
par: Rahimi, Masoud, et autres
Publié: (2025)
par: Rahimi, Masoud, et autres
Publié: (2025)
Dynamic Tsetlin Machine Accelerators for On-Chip Training at the Edge using FPGAs
par: Mao, Gang, et autres
Publié: (2025)
par: Mao, Gang, et autres
Publié: (2025)
Energy-Efficient Hardware Acceleration of Whisper ASR on a CGLA
par: Ando, Takuto, et autres
Publié: (2025)
par: Ando, Takuto, et autres
Publié: (2025)
Design and Implementation of Washing Machine HUD Using FPGAs
par: Stites, Norman, et autres
Publié: (2025)
par: Stites, Norman, et autres
Publié: (2025)
Duet: Creating Harmony between Processors and Embedded FPGAs
par: Li, Ang, et autres
Publié: (2023)
par: Li, Ang, et autres
Publié: (2023)
Studying the Degradation of Propagation Delay on FPGAs at the European XFEL
par: Lanzieri, Leandro, et autres
Publié: (2024)
par: Lanzieri, Leandro, et autres
Publié: (2024)
Interconnect-Aware Logic Resynthesis for Multi-Die FPGAs
par: Wang, Xiaoke, et autres
Publié: (2026)
par: Wang, Xiaoke, et autres
Publié: (2026)
MIREDO: MIP-Driven Resource-Efficient Dataflow Optimization for Computing-in-Memory Accelerator
par: He, Xiaolin, et autres
Publié: (2025)
par: He, Xiaolin, et autres
Publié: (2025)
Towards Zero-Stall Matrix Multiplication on Energy-Efficient RISC-V Clusters for Machine Learning Acceleration
par: Colagrande, Luca, et autres
Publié: (2025)
par: Colagrande, Luca, et autres
Publié: (2025)
Mozart: A Chiplet Ecosystem-Accelerator Codesign Framework for Composable Bespoke Application Specific Integrated Circuits
par: Jin, Haoran, et autres
Publié: (2025)
par: Jin, Haoran, et autres
Publié: (2025)
smallNet: Implementation of a convolutional layer in tiny FPGAs
par: Bascuñán, Fernanda Zapata, et autres
Publié: (2025)
par: Bascuñán, Fernanda Zapata, et autres
Publié: (2025)
Lightweight Congruence Profiling for Early Design Exploration of Heterogeneous FPGAs
par: Boston, Allen, et autres
Publié: (2025)
par: Boston, Allen, et autres
Publié: (2025)
RidgeWalker: Perfectly Pipelined Graph Random Walks on FPGAs
par: Tan, Hongshi, et autres
Publié: (2026)
par: Tan, Hongshi, et autres
Publié: (2026)
Fast Generation of Custom Floating-Point Spatial Filters on FPGAs
par: Campos, Nelson, et autres
Publié: (2024)
par: Campos, Nelson, et autres
Publié: (2024)
GreenFPGA: Evaluating FPGAs as Environmentally Sustainable Computing Solutions
par: Sudarshan, Chetan Choppali, et autres
Publié: (2023)
par: Sudarshan, Chetan Choppali, et autres
Publié: (2023)
Small Logic-based Multipliers with Incomplete Sub-Multipliers for FPGAs
par: Böttcher, Andreas, et autres
Publié: (2024)
par: Böttcher, Andreas, et autres
Publié: (2024)
In-Storage Domain-Specific Acceleration for Serverless Computing
par: Mahapatra, Rohan, et autres
Publié: (2023)
par: Mahapatra, Rohan, et autres
Publié: (2023)
Coyote v2: Raising the Level of Abstraction for Data Center FPGAs
par: Ramhorst, Benjamin, et autres
Publié: (2025)
par: Ramhorst, Benjamin, et autres
Publié: (2025)
Documents similaires
-
Energy Efficient LSTM Accelerators for Embedded FPGAs through Parameterised Architecture Design
par: Qian, Chao, et autres
Publié: (2026) -
An Energy-Efficient Artefact Detection Accelerator on FPGAs for Hyper-Spectral Satellite Imagery
par: Castelino, Cornell, et autres
Publié: (2024) -
Accelerating Boolean Constraint Propagation for Efficient SAT-Solving on FPGAs
par: Govindasamy, Hariprasadh, et autres
Publié: (2024) -
Efficient Approaches for GEMM Acceleration on Leading AI-Optimized FPGAs
par: Taka, Endri, et autres
Publié: (2024) -
LlamaF: An Efficient Llama2 Architecture Accelerator on Embedded FPGAs
par: Xu, Han, et autres
Publié: (2024)