DAISM: Digital Approximate In-SRAM Multiplier-based Accelerator for DNN Training and Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sonnino, Lorenzo, Shresthamali, Shaswot, He, Yuan, Kondo, Masaaki |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Highly Approximated Multipliers in DNN Inference
par: Zervakis, Georgios, et autres
Publié: (2024)
par: Zervakis, Georgios, et autres
Publié: (2024)
AdAM: Adaptive Fault-Tolerant Approximate Multiplier for Edge DNN Accelerators
par: Taheri, Mahdi, et autres
Publié: (2024)
par: Taheri, Mahdi, et autres
Publié: (2024)
AxMoE: Characterizing the Impact of Approximate Multipliers on Mixture-of-Experts DNN Architectures
par: Shende, Omkar B, et autres
Publié: (2026)
par: Shende, Omkar B, et autres
Publié: (2026)
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
par: Leon, Vasileios, et autres
Publié: (2025)
par: Leon, Vasileios, et autres
Publié: (2025)
TRAM: Training Approximate Multiplier Structures for Low-Power AI Accelerators
par: Meng, Chang, et autres
Publié: (2026)
par: Meng, Chang, et autres
Publié: (2026)
Performance Analysis of DNN Inference/Training with Convolution and non-Convolution Operations
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
Approximate Multiplier Induced Error Propagation in Deep Neural Networks
par: Alahakoon, A. M. H. H., et autres
Publié: (2025)
par: Alahakoon, A. M. H. H., et autres
Publié: (2025)
Mirage: An RNS-Based Photonic Accelerator for DNN Training
par: Demirkiran, Cansu, et autres
Publié: (2023)
par: Demirkiran, Cansu, et autres
Publié: (2023)
PQA: Exploring the Potential of Product Quantization in DNN Hardware Acceleration
par: AbouElhamayed, Ahmed F., et autres
Publié: (2023)
par: AbouElhamayed, Ahmed F., et autres
Publié: (2023)
HASS: Hardware-Aware Sparsity Search for Dataflow DNN Accelerator
par: Yu, Zhewen, et autres
Publié: (2024)
par: Yu, Zhewen, et autres
Publié: (2024)
FORTALESA: Fault-Tolerant Reconfigurable Systolic Array for DNN Inference
par: Cherezova, Natalia, et autres
Publié: (2025)
par: Cherezova, Natalia, et autres
Publié: (2025)
MaRVIn: A Cross-Layer Mixed-Precision RISC-V Framework for DNN Inference, from ISA Extension to Hardware Acceleration
par: Armeniakos, Giorgos, et autres
Publié: (2025)
par: Armeniakos, Giorgos, et autres
Publié: (2025)
DOSA: Differentiable Model-Based One-Loop Search for DNN Accelerators
par: Hong, Charles, et autres
Publié: (2025)
par: Hong, Charles, et autres
Publié: (2025)
CIMinus: Empowering Sparse DNN Workloads Modeling and Exploration on SRAM-based CIM Architectures
par: Qi, Yingjie, et autres
Publié: (2025)
par: Qi, Yingjie, et autres
Publié: (2025)
Exploration of Activation Fault Reliability in Quantized Systolic Array-Based DNN Accelerators
par: Taheri, Mahdi, et autres
Publié: (2024)
par: Taheri, Mahdi, et autres
Publié: (2024)
SigmaQuant: Hardware-Aware Heterogeneous Quantization Method for Edge DNN Inference
par: Liu, Qunyou, et autres
Publié: (2026)
par: Liu, Qunyou, et autres
Publié: (2026)
vMCU: Coordinated Memory Management and Kernel Optimization for DNN Inference on MCUs
par: Zheng, Size, et autres
Publié: (2024)
par: Zheng, Size, et autres
Publié: (2024)
DOMAC: Differentiable Optimization for High-Speed Multipliers and Multiply-Accumulators
par: Xue, Chenhao, et autres
Publié: (2025)
par: Xue, Chenhao, et autres
Publié: (2025)
Prefill vs. Decode Bottlenecks: SRAM-Frequency Tradeoffs and the Memory-Bandwidth Ceiling
par: Atmer, Hannah, et autres
Publié: (2025)
par: Atmer, Hannah, et autres
Publié: (2025)
NeFT: Negative Feedback Training to Improve Robustness of Compute-In-Memory DNN Accelerators
par: Qin, Yifan, et autres
Publié: (2023)
par: Qin, Yifan, et autres
Publié: (2023)
HaShiFlex: A High-Throughput Hardened Shifter DNN Accelerator with Fine-Tuning Flexibility
par: Herbst, Jonathan, et autres
Publié: (2025)
par: Herbst, Jonathan, et autres
Publié: (2025)
SAIL: SRAM-Accelerated LLM Inference System with Lookup-Table-based GEMV
par: Zhang, Jingyao, et autres
Publié: (2025)
par: Zhang, Jingyao, et autres
Publié: (2025)
FRED: Flexible REduction-Distribution Interconnect and Communication Implementation for Wafer-Scale Distributed Training of DNN Models
par: Rashidi, Saeed, et autres
Publié: (2024)
par: Rashidi, Saeed, et autres
Publié: (2024)
'1'-bit Count-based Sorting Unit to Reduce Link Power in DNN Accelerators
par: Han, Ruichi, et autres
Publié: (2026)
par: Han, Ruichi, et autres
Publié: (2026)
An Analog and Digital Hybrid Attention Accelerator for Transformers with Charge-based In-memory Computing
par: Moradifirouzabadi, Ashkan, et autres
Publié: (2024)
par: Moradifirouzabadi, Ashkan, et autres
Publié: (2024)
Full-Stack Optimization for CAM-Only DNN Inference
par: de Lima, João Paulo C., et autres
Publié: (2024)
par: de Lima, João Paulo C., et autres
Publié: (2024)
CHIME: Chiplet-based Heterogeneous Near-Memory Acceleration for Edge Multimodal LLM Inference
par: Chen, Yanru, et autres
Publié: (2025)
par: Chen, Yanru, et autres
Publié: (2025)
Thales: Formulating and Estimating Architectural Vulnerability Factors for DNN Accelerators
par: Tyagi, Abhishek, et autres
Publié: (2022)
par: Tyagi, Abhishek, et autres
Publié: (2022)
Leveraging Stochastic Depth Training for Adaptive Inference
par: Korol, Guilherme, et autres
Publié: (2025)
par: Korol, Guilherme, et autres
Publié: (2025)
SAFFIRA: a Framework for Assessing the Reliability of Systolic-Array-Based DNN Accelerators
par: Taheri, Mahdi, et autres
Publié: (2024)
par: Taheri, Mahdi, et autres
Publié: (2024)
Large Language Model Inference Acceleration: A Comprehensive Hardware Perspective
par: Li, Jinhao, et autres
Publié: (2024)
par: Li, Jinhao, et autres
Publié: (2024)
Explainable AI-Guided Efficient Approximate DNN Generation for Multi-Pod Systolic Arrays
par: Siddique, Ayesha, et autres
Publié: (2025)
par: Siddique, Ayesha, et autres
Publié: (2025)
HGQ-LUT: Fast LUT-Aware Training and Efficient Architectures for DNN Inference
par: Sun, Chang, et autres
Publié: (2026)
par: Sun, Chang, et autres
Publié: (2026)
AI Accelerators for Large Language Model Inference: Architecture Analysis and Scaling Strategies
par: Sharma, Amit
Publié: (2025)
par: Sharma, Amit
Publié: (2025)
COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
A 14uJ/Decision Keyword Spotting Accelerator with In-SRAM-Computing and On Chip Learning for Customization
par: Chiang, Yu-Hsiang, et autres
Publié: (2022)
par: Chiang, Yu-Hsiang, et autres
Publié: (2022)
Accelerating LLM Inference with Flexible N:M Sparsity via A Fully Digital Compute-in-Memory Accelerator
par: Ramachandran, Akshat, et autres
Publié: (2025)
par: Ramachandran, Akshat, et autres
Publié: (2025)
Dynamic Tsetlin Machine Accelerators for On-Chip Training at the Edge using FPGAs
par: Mao, Gang, et autres
Publié: (2025)
par: Mao, Gang, et autres
Publié: (2025)
MixDiT: Accelerating Image Diffusion Transformer Inference with Mixed-Precision MX Quantization
par: Kim, Daeun, et autres
Publié: (2025)
par: Kim, Daeun, et autres
Publié: (2025)
On-Device Qwen2.5: Efficient LLM Inference with Model Compression and Hardware Acceleration
par: Xiang, Maoyang, et autres
Publié: (2025)
par: Xiang, Maoyang, et autres
Publié: (2025)
Documents similaires
-
Leveraging Highly Approximated Multipliers in DNN Inference
par: Zervakis, Georgios, et autres
Publié: (2024) -
AdAM: Adaptive Fault-Tolerant Approximate Multiplier for Edge DNN Accelerators
par: Taheri, Mahdi, et autres
Publié: (2024) -
AxMoE: Characterizing the Impact of Approximate Multipliers on Mixture-of-Experts DNN Architectures
par: Shende, Omkar B, et autres
Publié: (2026) -
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
par: Leon, Vasileios, et autres
Publié: (2025) -
TRAM: Training Approximate Multiplier Structures for Low-Power AI Accelerators
par: Meng, Chang, et autres
Publié: (2026)