Energy-Efficient Hardware Acceleration of Whisper ASR on a CGLA
Fuente:
arXiv
Salvato in:
| Autori principali: | Ando, Takuto, Eto, Yu, Takeuchi, Ayumu, Nakashima, Yasuhiko |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Kernel Mapping and Comprehensive System Evaluation of LLM Acceleration on a CGLA
di: Ando, Takuto, et al.
Pubblicazione: (2025)
di: Ando, Takuto, et al.
Pubblicazione: (2025)
Implementation and Evaluation of Stable Diffusion on a General-Purpose CGLA Accelerator
di: Ando, Takuto, et al.
Pubblicazione: (2025)
di: Ando, Takuto, et al.
Pubblicazione: (2025)
Facial Expression Recognition System Using DNN Accelerator with Multi-threading on FPGA
di: Ando, Takuto, et al.
Pubblicazione: (2025)
di: Ando, Takuto, et al.
Pubblicazione: (2025)
Theoretical Analysis of the Efficient-Memory Matrix Storage Method for Quantum Emulation Accelerators with Gate Fusion on FPGAs
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
Hardware Efficient Accelerator for Spiking Transformer With Reconfigurable Parallel Time Step Computing
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)
An Efficient Sparse Hardware Accelerator for Spike-Driven Transformer
di: Li, Zhengke, et al.
Pubblicazione: (2025)
di: Li, Zhengke, et al.
Pubblicazione: (2025)
FETTA: Flexible and Efficient Hardware Accelerator for Tensorized Neural Network Training
di: Lu, Jinming, et al.
Pubblicazione: (2025)
di: Lu, Jinming, et al.
Pubblicazione: (2025)
SeDA: Secure and Efficient DNN Accelerators with Hardware/Software Synergy
di: Xuan, Wei, et al.
Pubblicazione: (2025)
di: Xuan, Wei, et al.
Pubblicazione: (2025)
Enabling Efficient Hardware Acceleration of Hybrid Vision Transformer (ViT) Networks at the Edge
di: Dumoulin, Joren, et al.
Pubblicazione: (2025)
di: Dumoulin, Joren, et al.
Pubblicazione: (2025)
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
di: Leon, Vasileios, et al.
Pubblicazione: (2025)
di: Leon, Vasileios, et al.
Pubblicazione: (2025)
ApproXAI: Energy-Efficient Hardware Acceleration of Explainable AI using Approximate Computing
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) in Large-Scale Systems
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
Bombyx: OpenCilk Compilation for FPGA Hardware Acceleration
di: Shahawy, Mohamed, et al.
Pubblicazione: (2025)
di: Shahawy, Mohamed, et al.
Pubblicazione: (2025)
Hardware Acceleration in Portable MRIs: State of the Art and Future Prospects
di: Habsi, Omar Al, et al.
Pubblicazione: (2025)
di: Habsi, Omar Al, et al.
Pubblicazione: (2025)
HyDRA: Deadline and Reuse-Aware Cacheability for Hardware Accelerators
di: Agarwal, Ayushi, et al.
Pubblicazione: (2026)
di: Agarwal, Ayushi, et al.
Pubblicazione: (2026)
Xpikeformer: Hybrid Analog-Digital Hardware Acceleration for Spiking Transformers
di: Song, Zihang, et al.
Pubblicazione: (2024)
di: Song, Zihang, et al.
Pubblicazione: (2024)
Accelerating PageRank Algorithmic Tasks with a new Programmable Hardware Architecture
di: Chowdhury, Md Rownak Hossain, et al.
Pubblicazione: (2024)
di: Chowdhury, Md Rownak Hossain, et al.
Pubblicazione: (2024)
FQsun: A Configurable Wave Function-Based Quantum Emulator for Power-Efficient Quantum Simulations
di: Vu, Tuan Hai, et al.
Pubblicazione: (2024)
di: Vu, Tuan Hai, et al.
Pubblicazione: (2024)
Exploring the Limitations of Kolmogorov-Arnold Networks in Classification: Insights to Software Training and Hardware Implementation
di: Tran, Van Duy, et al.
Pubblicazione: (2024)
di: Tran, Van Duy, et al.
Pubblicazione: (2024)
TurboFuzz: FPGA Accelerated Hardware Fuzzing for Processor Agile Verification
di: Zhong, Yang, et al.
Pubblicazione: (2025)
di: Zhong, Yang, et al.
Pubblicazione: (2025)
Design and Analysis of Approximate Hardware Accelerators for VVC Intra Angular Prediction
di: de Fraga, Lucas M. Leipnitz, et al.
Pubblicazione: (2025)
di: de Fraga, Lucas M. Leipnitz, et al.
Pubblicazione: (2025)
Memory-Guided Unified Hardware Accelerator for Mixed-Precision Scientific Computing
di: Wang, Chuanzhen, et al.
Pubblicazione: (2026)
di: Wang, Chuanzhen, et al.
Pubblicazione: (2026)
HFRWKV: A High-Performance Fully On-Chip Hardware Accelerator for RWKV
di: Shijie, Liu, et al.
Pubblicazione: (2026)
di: Shijie, Liu, et al.
Pubblicazione: (2026)
Manticore: Hardware-Accelerated RTL Simulation with Static Bulk-Synchronous Parallelism
di: Emami, Mahyar, et al.
Pubblicazione: (2023)
di: Emami, Mahyar, et al.
Pubblicazione: (2023)
In-Memory Computing Architecture for Efficient Hardware Security
di: Ajmi, Hala, et al.
Pubblicazione: (2024)
di: Ajmi, Hala, et al.
Pubblicazione: (2024)
Hardware Accelerators for Autonomous Cars: A Review
di: Islayem, Ruba, et al.
Pubblicazione: (2024)
di: Islayem, Ruba, et al.
Pubblicazione: (2024)
Energy Efficient LSTM Accelerators for Embedded FPGAs through Parameterised Architecture Design
di: Qian, Chao, et al.
Pubblicazione: (2026)
di: Qian, Chao, et al.
Pubblicazione: (2026)
An Energy-Efficient Artefact Detection Accelerator on FPGAs for Hyper-Spectral Satellite Imagery
di: Castelino, Cornell, et al.
Pubblicazione: (2024)
di: Castelino, Cornell, et al.
Pubblicazione: (2024)
always_comm: An FPGA-based Hardware Accelerator for Audio/Video Compression and Transmission
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
Hardware-Software Co-Design for Accelerating Transformer Inference Leveraging Compute-in-Memory
di: Kim, Dong Eun, et al.
Pubblicazione: (2025)
di: Kim, Dong Eun, et al.
Pubblicazione: (2025)
FireBridge: Cycle-Accurate Hardware + Firmware Co-Verification for Modern Accelerators
di: Abarajithan, G, et al.
Pubblicazione: (2026)
di: Abarajithan, G, et al.
Pubblicazione: (2026)
Towards the Certification of Hybrid Architectures: Analysing Interference on Hardware Accelerators through PML
di: Lesage, Benjamin, et al.
Pubblicazione: (2024)
di: Lesage, Benjamin, et al.
Pubblicazione: (2024)
Fast Graph Vector Search via Hardware Acceleration and Delayed-Synchronization Traversal
di: Jiang, Wenqi, et al.
Pubblicazione: (2024)
di: Jiang, Wenqi, et al.
Pubblicazione: (2024)
METRO: A Software-Hardware Co-Design of Interconnections for Spatial DNN Accelerators
di: Wang, Zhao, et al.
Pubblicazione: (2021)
di: Wang, Zhao, et al.
Pubblicazione: (2021)
A Configurable and Efficient Memory Hierarchy for Neural Network Hardware Accelerator
di: Bause, Oliver, et al.
Pubblicazione: (2024)
di: Bause, Oliver, et al.
Pubblicazione: (2024)
A Power-Efficient Hardware Implementation of L-Mul
di: Chen, Ruiqi, et al.
Pubblicazione: (2024)
di: Chen, Ruiqi, et al.
Pubblicazione: (2024)
NX-CGRA: A Programmable Hardware Accelerator for Core Transformer Algorithms on Edge Devices
di: Prasad, Rohit
Pubblicazione: (2025)
di: Prasad, Rohit
Pubblicazione: (2025)
FPGA-Optimized Hardware Accelerator for Fast Fourier Transform and Singular Value Decomposition in AI
di: Ding, Hong, et al.
Pubblicazione: (2025)
di: Ding, Hong, et al.
Pubblicazione: (2025)
DiffAxE: Diffusion-driven Hardware Accelerator Generation and Design Space Exploration
di: Ghosh, Arkapravo, et al.
Pubblicazione: (2025)
di: Ghosh, Arkapravo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Efficient Kernel Mapping and Comprehensive System Evaluation of LLM Acceleration on a CGLA
di: Ando, Takuto, et al.
Pubblicazione: (2025) -
Implementation and Evaluation of Stable Diffusion on a General-Purpose CGLA Accelerator
di: Ando, Takuto, et al.
Pubblicazione: (2025) -
Facial Expression Recognition System Using DNN Accelerator with Multi-threading on FPGA
di: Ando, Takuto, et al.
Pubblicazione: (2025) -
Theoretical Analysis of the Efficient-Memory Matrix Storage Method for Quantum Emulation Accelerators with Gate Fusion on FPGAs
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024) -
Hardware Efficient Accelerator for Spiking Transformer With Reconfigurable Parallel Time Step Computing
di: Chen, Bo-Yu, et al.
Pubblicazione: (2025)