HOAA: Hybrid Overestimating Approximate Adder for Enhanced Performance Processing Engine
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kokane, Omkar, Sati, Prabhat, Lokhande, Mukul, Vishvakarma, Santosh Kumar |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EULER-ADAS: Energy-Efficient & SIMD-Unified Logarithmic-Posit Engine for Precision-Reconfigurable Approximate ADAS Acceleration
par: Lokhande, Mukul, et autres
Publié: (2026)
par: Lokhande, Mukul, et autres
Publié: (2026)
XR-NPE: High-Throughput Mixed-precision SIMD Neural Processing Engine for Extended Reality Perception Workloads
par: Chaudhari, Tejas, et autres
Publié: (2025)
par: Chaudhari, Tejas, et autres
Publié: (2025)
Retrospective: A CORDIC Based Configurable Activation Function for NN Applications
par: Kokane, Omkar, et autres
Publié: (2025)
par: Kokane, Omkar, et autres
Publié: (2025)
CORVET: A CORDIC-Powered, Resource-Frugal Mixed-Precision Vector Processing Engine for High-Throughput AIoT applications
par: Kumar, Sonu, et autres
Publié: (2026)
par: Kumar, Sonu, et autres
Publié: (2026)
HYDRA: Hybrid Data Multiplexing and Run-time Layer Configurable DNN Accelerator
par: Kumar, Sonu, et autres
Publié: (2024)
par: Kumar, Sonu, et autres
Publié: (2024)
L-SPINE: A Low-Precision SIMD Spiking Neural Compute Engine for Resource-efficient Edge Inference
par: Kumar, Sonu, et autres
Publié: (2026)
par: Kumar, Sonu, et autres
Publié: (2026)
QForce-RL: Quantized FPGA-Optimized Reinforcement Learning Compute Engine
par: Jha, Anushka, et autres
Publié: (2025)
par: Jha, Anushka, et autres
Publié: (2025)
POLARON: Precision-aware On-device Learning and Adaptive Runtime-cONfigurable AI acceleration
par: Lokhande, Mukul, et autres
Publié: (2025)
par: Lokhande, Mukul, et autres
Publié: (2025)
Flex-PE: Flexible and SIMD Multi-Precision Processing Element for AI Workloads
par: Lokhande, Mukul, et autres
Publié: (2024)
par: Lokhande, Mukul, et autres
Publié: (2024)
E-ReCON: An Energy- and Resource-Efficient Precision-Configurable Sparse nvCIM Macro for Conventional and Spiking Neural Edge Inference
par: Tenwar, Ankit Kumar, et autres
Publié: (2026)
par: Tenwar, Ankit Kumar, et autres
Publié: (2026)
CORDIC Is All You Need
par: Kokane, Omkar, et autres
Publié: (2025)
par: Kokane, Omkar, et autres
Publié: (2025)
SPADE: A SIMD Posit-enabled compute engine for Accelerating DNN Efficiency
par: Kumar, Sonu, et autres
Publié: (2026)
par: Kumar, Sonu, et autres
Publié: (2026)
RAMAN: Resource-efficient ApproxiMate Posit Processing for Algorithm-Hardware Co-desigN
par: Khan, Mohd Faisal, et autres
Publié: (2025)
par: Khan, Mohd Faisal, et autres
Publié: (2025)
TREA: Low-precision Time-Multiplexed, Resource-Efficient Edge Accelerator for Object Detection and Classification
par: Sharma, Vijay Pratap, et autres
Publié: (2026)
par: Sharma, Vijay Pratap, et autres
Publié: (2026)
ReLANCE: A Resource-Efficient Low-Latency Cortical Neural Acceleration Engine
par: Kumar, Sonu, et autres
Publié: (2025)
par: Kumar, Sonu, et autres
Publié: (2025)
CARMEN: CORDIC-Accelerated Resource-Efficient Multi-Precision Inference Engine for Deep Learning
par: Kumar, Sonu, et autres
Publié: (2026)
par: Kumar, Sonu, et autres
Publié: (2026)
DPD-NeuralEngine: A 22-nm 6.6-TOPS/W/mm$^2$ Recurrent Neural Network Accelerator for Wideband Power Amplifier Digital Pre-Distortion
par: Li, Ang, et autres
Publié: (2024)
par: Li, Ang, et autres
Publié: (2024)
SRAM Based Digital Custom Compute Engine for Improved Area Efficiency of AI Hardware
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
Bio-RV: Low-Power Resource-Efficient RISC-V Processor for Biomedical Applications
par: Sharma, Vijay Pratap, et autres
Publié: (2026)
par: Sharma, Vijay Pratap, et autres
Publié: (2026)
Res-DPU: Resource-shared Digital Processing-in-memory Unit for Edge-AI Workloads
par: Lokhande, Mukul, et autres
Publié: (2025)
par: Lokhande, Mukul, et autres
Publié: (2025)
MorphOPC: Advancing Mask Optimization with Multi-scale Hierarchical Morphological Learning
par: Hu, Yuting, et autres
Publié: (2026)
par: Hu, Yuting, et autres
Publié: (2026)
Procrastination Is All You Need: Exponent Indexed Accumulators for Floating Point, Posits and Logarithmic Numbers
par: Liguori, Vincenzo
Publié: (2024)
par: Liguori, Vincenzo
Publié: (2024)
Real-Time Spacecraft Pose Estimation Using Mixed-Precision Quantized Neural Network on COTS Reconfigurable MPSoC
par: Posso, Julien, et autres
Publié: (2024)
par: Posso, Julien, et autres
Publié: (2024)
CHOSEN: Compilation to Hardware Optimization Stack for Efficient Vision Transformer Inference
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
TinyIceNet: Low-Power SAR Sea Ice Segmentation for On-Board FPGA Inference
par: Koutayni, Mhd Rashed Al, et autres
Publié: (2026)
par: Koutayni, Mhd Rashed Al, et autres
Publié: (2026)
From a Lossless (~1.5:1) Compression Algorithm for Llama2 7B Weights to Variable Precision, Variable Range, Compressed Numeric Data Types for CNNs and LLMs
par: Liguori, Vincenzo
Publié: (2024)
par: Liguori, Vincenzo
Publié: (2024)
FERMI-ML: A Flexible and Resource-Efficient Memory-In-Situ SRAM Macro for TinyML acceleration
par: Lokhande, Mukul, et autres
Publié: (2025)
par: Lokhande, Mukul, et autres
Publié: (2025)
Assessing the Added Value of Onboard Earth Observation Processing with the IRIDE HEO Service Segment
par: Thind, Parampuneet Kaur, et autres
Publié: (2026)
par: Thind, Parampuneet Kaur, et autres
Publié: (2026)
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
par: Lu, Jinming, et autres
Publié: (2025)
par: Lu, Jinming, et autres
Publié: (2025)
Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
par: Chen, Tse-Wei, et autres
Publié: (2025)
par: Chen, Tse-Wei, et autres
Publié: (2025)
PrefixAgent: An LLM-Powered Design Framework for Efficient Prefix Adder Optimization
par: Zuo, Dongsheng, et autres
Publié: (2025)
par: Zuo, Dongsheng, et autres
Publié: (2025)
ADS-IMC: Accelerating Data Sorting with In-Memory Computation
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
Configurable Multi-Port Memory Architecture for High-Speed Data Communication
par: Dhakad, Narendra Singh, et autres
Publié: (2024)
par: Dhakad, Narendra Singh, et autres
Publié: (2024)
Image2Net: Datasets, Benchmark and Hybrid Framework to Convert Analog Circuit Diagrams into Netlists
par: Xu, Haohang, et autres
Publié: (2025)
par: Xu, Haohang, et autres
Publié: (2025)
Real-World Deployment of a Lane Change Prediction Architecture Based on Knowledge Graph Embeddings and Bayesian Inference
par: Manzour, M., et autres
Publié: (2025)
par: Manzour, M., et autres
Publié: (2025)
LLM-FP4: 4-Bit Floating-Point Quantized Transformers
par: Liu, Shih-yang, et autres
Publié: (2023)
par: Liu, Shih-yang, et autres
Publié: (2023)
TSLA: A Task-Specific Learning Adaptation for Semantic Segmentation on Autonomous Vehicles Platform
par: Liu, Jun, et autres
Publié: (2025)
par: Liu, Jun, et autres
Publié: (2025)
fpgaHART: A toolflow for throughput-oriented acceleration of 3D CNNs for HAR onto FPGAs
par: Toupas, Petros, et autres
Publié: (2023)
par: Toupas, Petros, et autres
Publié: (2023)
SQ-DM: Accelerating Diffusion Models with Aggressive Quantization and Temporal Sparsity
par: Fan, Zichen, et autres
Publié: (2025)
par: Fan, Zichen, et autres
Publié: (2025)
SageAttention2++: A More Efficient Implementation of SageAttention2
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
Documents similaires
-
EULER-ADAS: Energy-Efficient & SIMD-Unified Logarithmic-Posit Engine for Precision-Reconfigurable Approximate ADAS Acceleration
par: Lokhande, Mukul, et autres
Publié: (2026) -
XR-NPE: High-Throughput Mixed-precision SIMD Neural Processing Engine for Extended Reality Perception Workloads
par: Chaudhari, Tejas, et autres
Publié: (2025) -
Retrospective: A CORDIC Based Configurable Activation Function for NN Applications
par: Kokane, Omkar, et autres
Publié: (2025) -
CORVET: A CORDIC-Powered, Resource-Frugal Mixed-Precision Vector Processing Engine for High-Throughput AIoT applications
par: Kumar, Sonu, et autres
Publié: (2026) -
HYDRA: Hybrid Data Multiplexing and Run-time Layer Configurable DNN Accelerator
par: Kumar, Sonu, et autres
Publié: (2024)