Salvato in:
| Autori principali: | Zhu, Xuqi, Zhang, Huaizhi, Lee, JunKyu, Zhu, Jiacheng, Pal, Chandrajit, Saha, Sangeet, McDonald-Maier, Klaus D., Zhai, Xiaojun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.02362 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FAME: FPGA Acceleration of Secure Matrix Multiplication with Homomorphic Encryption
di: Xu, Zhihan, et al.
Pubblicazione: (2025)
di: Xu, Zhihan, et al.
Pubblicazione: (2025)
MANOJAVAM: A Scalable, Unified FPGA Accelerator for Matrix Multiplication and Singular Value Decomposition in Principal Component Analysis
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026)
FastFlow in FPGA Stacks of Data Centers
di: Paul, Rourab, et al.
Pubblicazione: (2024)
di: Paul, Rourab, et al.
Pubblicazione: (2024)
SuperUROP: An FPGA-Based Spatial Accelerator for Sparse Matrix Operations
di: Parthasarathy, Rishab
Pubblicazione: (2025)
di: Parthasarathy, Rishab
Pubblicazione: (2025)
DiP: A Scalable, Energy-Efficient Systolic Array for Matrix Multiplication Acceleration
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2024)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2024)
Revealing Untapped DSP Optimization Potentials for FPGA-Based Systolic Matrix Engines
di: Li, Jindong, et al.
Pubblicazione: (2024)
di: Li, Jindong, et al.
Pubblicazione: (2024)
Virgo: Cluster-level Matrix Unit Integration in GPUs for Scalability and Energy Efficiency
di: Kim, Hansung, et al.
Pubblicazione: (2024)
di: Kim, Hansung, et al.
Pubblicazione: (2024)
D-Legion: A Scalable Many-Core Architecture for Accelerating Matrix Multiplication in Quantized LLMs
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
A Scalable FPGA Architecture With Adaptive Memory Utilization for GEMM-Based Operations
di: Petropoulos, Anastasios, et al.
Pubblicazione: (2025)
di: Petropoulos, Anastasios, et al.
Pubblicazione: (2025)
A Scalable FPGA Architecture for Quantum Computing Simulation
di: Belfore II, Lee A.
Pubblicazione: (2024)
di: Belfore II, Lee A.
Pubblicazione: (2024)
Fast and Practical Strassen's Matrix Multiplication using FPGAs
di: Ahmad, Afzal, et al.
Pubblicazione: (2024)
di: Ahmad, Afzal, et al.
Pubblicazione: (2024)
Design and Implementation of BNN-Based Object Detection on FPGA
di: Zhao, Xuyu, et al.
Pubblicazione: (2026)
di: Zhao, Xuyu, et al.
Pubblicazione: (2026)
Table-Lookup MAC: Scalable Processing of Quantised Neural Networks in FPGA Soft Logic
di: Gerlinghoff, Daniel, et al.
Pubblicazione: (2024)
di: Gerlinghoff, Daniel, et al.
Pubblicazione: (2024)
FPGA-Optimized Hardware Accelerator for Fast Fourier Transform and Singular Value Decomposition in AI
di: Ding, Hong, et al.
Pubblicazione: (2025)
di: Ding, Hong, et al.
Pubblicazione: (2025)
Energy-Efficient FPGA Framework for Non-Quantized Convolutional Neural Networks
di: Athanasiadis, Angelos, et al.
Pubblicazione: (2025)
di: Athanasiadis, Angelos, et al.
Pubblicazione: (2025)
ISAAC: Intelligent, Scalable, Agile, and Accelerated CPU Verification via LLM-aided FPGA Parallelism
di: Sun, Jialin, et al.
Pubblicazione: (2025)
di: Sun, Jialin, et al.
Pubblicazione: (2025)
Blink: Fast Automated Design of Run-Time Power Monitors on FPGA-Based Computing Platforms
di: Galimberti, Andrea, et al.
Pubblicazione: (2024)
di: Galimberti, Andrea, et al.
Pubblicazione: (2024)
An Efficient Hardware Implementation of Elliptic Curve Point Multiplication over $GF(2^m)$ on FPGA
di: Kumari, Ruby, et al.
Pubblicazione: (2025)
di: Kumari, Ruby, et al.
Pubblicazione: (2025)
MX: Enhancing RISC-V's Vector ISA for Ultra-Low Overhead, Energy-Efficient Matrix Multiplication
di: Perotti, Matteo, et al.
Pubblicazione: (2024)
di: Perotti, Matteo, et al.
Pubblicazione: (2024)
Sparse-on-Dense: Area and Energy-Efficient Computing of Sparse Neural Networks on Dense Matrix Multiplication Accelerators
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
di: Yoon, Hyunsung, et al.
Pubblicazione: (2026)
Towards Zero-Stall Matrix Multiplication on Energy-Efficient RISC-V Clusters for Machine Learning Acceleration
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
EasyDRAM: An FPGA-based Infrastructure for Fast and Accurate End-to-End Evaluation of Emerging DRAM Techniques
di: Canpolat, Oğuzhan, et al.
Pubblicazione: (2025)
di: Canpolat, Oğuzhan, et al.
Pubblicazione: (2025)
Embedded FPGA Acceleration of Brain-Like Neural Networks: Online Learning to Scalable Inference
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2025)
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2025)
Performance Analysis of Matrix Multiplication for Deep Learning on the Edge
di: Ramírez, Cristian, et al.
Pubblicazione: (2024)
di: Ramírez, Cristian, et al.
Pubblicazione: (2024)
FastMamba: A High-Speed and Efficient Mamba Accelerator on FPGA with Accurate Quantization
di: Wang, Aotao, et al.
Pubblicazione: (2025)
di: Wang, Aotao, et al.
Pubblicazione: (2025)
Real-Time, Energy-Efficient, Sampling-Based Optimal Control via FPGA Acceleration
di: Desai, Tanmay, et al.
Pubblicazione: (2026)
di: Desai, Tanmay, et al.
Pubblicazione: (2026)
Holistic Optimization Framework for FPGA Accelerators
di: Pouget, Stéphane, et al.
Pubblicazione: (2025)
di: Pouget, Stéphane, et al.
Pubblicazione: (2025)
Empowering Vector Architectures for ML: The CAMP Architecture for Matrix Multiplication
di: Nojehdeh, Mohammadreza Esmali, et al.
Pubblicazione: (2025)
di: Nojehdeh, Mohammadreza Esmali, et al.
Pubblicazione: (2025)
bitSMM: A bit-Serial Matrix Multiplication Accelerator
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
Demystifying FPGA Hard NoC Performance
di: Liu, Sihao, et al.
Pubblicazione: (2025)
di: Liu, Sihao, et al.
Pubblicazione: (2025)
FPGA-based Hyrbid Memory Emulation System
di: Wen, Fei, et al.
Pubblicazione: (2020)
di: Wen, Fei, et al.
Pubblicazione: (2020)
ADiP: Adaptive-Precision Systolic Array for Matrix Multiplication Acceleration
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2025)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2025)
Optimizing Structured-Sparse Matrix Multiplication in RISC-V Vector Processors
di: Titopoulos, Vasileios, et al.
Pubblicazione: (2025)
di: Titopoulos, Vasileios, et al.
Pubblicazione: (2025)
A Scalable Resource Management Layer for FPGA SoCs in 6G Radio Units
di: Bartzoudis, Nikolaos, et al.
Pubblicazione: (2025)
di: Bartzoudis, Nikolaos, et al.
Pubblicazione: (2025)
FPPS: An FPGA-Based Point Cloud Processing System
di: Zhou, Xiaofeng, et al.
Pubblicazione: (2026)
di: Zhou, Xiaofeng, et al.
Pubblicazione: (2026)
Efficient and Accurate Graph Classification with Hyperdimensional Computing on FPGA
di: Arockiaraj, Jebacyril, et al.
Pubblicazione: (2025)
di: Arockiaraj, Jebacyril, et al.
Pubblicazione: (2025)
LUTstructions: Self-loading FPGA-based Reconfigurable Instructions
di: Papaphilippou, Philippos
Pubblicazione: (2026)
di: Papaphilippou, Philippos
Pubblicazione: (2026)
Bombyx: OpenCilk Compilation for FPGA Hardware Acceleration
di: Shahawy, Mohamed, et al.
Pubblicazione: (2025)
di: Shahawy, Mohamed, et al.
Pubblicazione: (2025)
Implementation and Analysis of Thermometer Encoding in DWN FPGA Accelerators
di: Mecik, Michael, et al.
Pubblicazione: (2025)
di: Mecik, Michael, et al.
Pubblicazione: (2025)
An FPGA Compiler for On-the-Fly Adaptive CNN Deployment and Reconfiguration
di: Mazouz, Alaa, et al.
Pubblicazione: (2025)
di: Mazouz, Alaa, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FAME: FPGA Acceleration of Secure Matrix Multiplication with Homomorphic Encryption
di: Xu, Zhihan, et al.
Pubblicazione: (2025) -
MANOJAVAM: A Scalable, Unified FPGA Accelerator for Matrix Multiplication and Singular Value Decomposition in Principal Component Analysis
di: Ramasubramanian, Srivaths, et al.
Pubblicazione: (2026) -
FastFlow in FPGA Stacks of Data Centers
di: Paul, Rourab, et al.
Pubblicazione: (2024) -
SuperUROP: An FPGA-Based Spatial Accelerator for Sparse Matrix Operations
di: Parthasarathy, Rishab
Pubblicazione: (2025) -
DiP: A Scalable, Energy-Efficient Systolic Array for Matrix Multiplication Acceleration
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2024)