Enhancing Computational Efficiency in Intensive Domains via Redundant Residue Number Systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Mousavi, Soudabeh, Rahmati, Dara, Gorgin, Saeid, Lee, Jeong-A |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Modeling and Simulation Frameworks for Processing-in-Memory Architectures
di: Aghaei, Mahdi, et al.
Pubblicazione: (2025)
di: Aghaei, Mahdi, et al.
Pubblicazione: (2025)
DSLR-CNN: Efficient CNN Acceleration using Digit-Serial Left-to-Right Arithmetic
di: Nisar, Malik Zohaib, et al.
Pubblicazione: (2025)
di: Nisar, Malik Zohaib, et al.
Pubblicazione: (2025)
Computing-In-Memory Dataflow for Minimal Buffer Traffic
di: Song, Choongseok, et al.
Pubblicazione: (2025)
di: Song, Choongseok, et al.
Pubblicazione: (2025)
STELLAR: Structure-guided LLM Assertion Retrieval and Generation for Formal Verification
di: Rajabi, Saeid, et al.
Pubblicazione: (2025)
di: Rajabi, Saeid, et al.
Pubblicazione: (2025)
Cerberus: Cross-Layer ECC Co-Design for Robust and Efficient Memory Protection
di: Kim, Junhwan, et al.
Pubblicazione: (2026)
di: Kim, Junhwan, et al.
Pubblicazione: (2026)
SA-Kura: An Energy-Efficient Systolic Array Accelerator for Locally-Coupled Kuramoto Drift in Diffusion Sampling
di: Jin, Jeongmin, et al.
Pubblicazione: (2026)
di: Jin, Jeongmin, et al.
Pubblicazione: (2026)
ELSA: An ELastic SNN Inference Architecture for Efficient Neuromorphic Computing
di: You, Kang, et al.
Pubblicazione: (2026)
di: You, Kang, et al.
Pubblicazione: (2026)
Pragmatic Formal Verification Methodology for Clock Domain Crossing (CDC)
di: Kumar, Aman, et al.
Pubblicazione: (2024)
di: Kumar, Aman, et al.
Pubblicazione: (2024)
RISC-V R-Extension: Advancing Efficiency with Rented-Pipeline for Edge DNN Processing
di: Kim, Won Hyeok, et al.
Pubblicazione: (2024)
di: Kim, Won Hyeok, et al.
Pubblicazione: (2024)
Phi: Leveraging Pattern-based Hierarchical Sparsity for High-Efficiency Spiking Neural Networks
di: Wei, Chiyue, et al.
Pubblicazione: (2025)
di: Wei, Chiyue, et al.
Pubblicazione: (2025)
ProactivePIM: Accelerating Weight-Sharing Embedding Layer with PIM for Scalable Recommendation System
di: Kim, Youngsuk, et al.
Pubblicazione: (2024)
di: Kim, Youngsuk, et al.
Pubblicazione: (2024)
PIMphony: Overcoming Bandwidth and Capacity Inefficiency in PIM-based Long-Context LLM Inference System
di: Kwon, Hyucksung, et al.
Pubblicazione: (2024)
di: Kwon, Hyucksung, et al.
Pubblicazione: (2024)
Neuromorphic Computing for Low-Power Artificial Intelligence
di: Katti, Keshava, et al.
Pubblicazione: (2026)
di: Katti, Keshava, et al.
Pubblicazione: (2026)
Neural Network Quantization for Microcontrollers: A Comprehensive Survey of Methods, Platforms, and Applications
di: Abushahla, Hamza A., et al.
Pubblicazione: (2025)
di: Abushahla, Hamza A., et al.
Pubblicazione: (2025)
Learning in Log-Domain: Subthreshold Analog AI Accelerator Based on Stochastic Gradient Descent
di: Tageldeen, Momen K, et al.
Pubblicazione: (2025)
di: Tageldeen, Momen K, et al.
Pubblicazione: (2025)
LLM4SecHW: Leveraging Domain Specific Large Language Model for Hardware Debugging
di: Fu, Weimin, et al.
Pubblicazione: (2024)
di: Fu, Weimin, et al.
Pubblicazione: (2024)
HH-PIM: Dynamic Optimization of Power and Performance with Heterogeneous-Hybrid PIM for Edge AI Devices
di: Jeon, Sangmin, et al.
Pubblicazione: (2025)
di: Jeon, Sangmin, et al.
Pubblicazione: (2025)
Efficient Deployment of CNN Models on Multiple In-Memory Computing Units
di: Bougioukou, Eleni, et al.
Pubblicazione: (2025)
di: Bougioukou, Eleni, et al.
Pubblicazione: (2025)
Leveraging Compute-in-Memory for Efficient Generative Model Inference in TPUs
di: Zhu, Zhantong, et al.
Pubblicazione: (2025)
di: Zhu, Zhantong, et al.
Pubblicazione: (2025)
A CMOS Probabilistic Computing Chip With In-situ hardware Aware Learning
di: Jhonsa, Jinesh, et al.
Pubblicazione: (2025)
di: Jhonsa, Jinesh, et al.
Pubblicazione: (2025)
Scalable Processing-Near-Memory for 1M-Token LLM Inference: CXL-Enabled KV-Cache Management Beyond GPU Limits
di: Kim, Dowon, et al.
Pubblicazione: (2025)
di: Kim, Dowon, et al.
Pubblicazione: (2025)
TReX- Reusing Vision Transformer's Attention for Efficient Xbar-based Computing
di: Moitra, Abhishek, et al.
Pubblicazione: (2024)
di: Moitra, Abhishek, et al.
Pubblicazione: (2024)
Using the Abstract Computer Architecture Description Language to Model AI Hardware Accelerators
di: Müller, Mika Markus, et al.
Pubblicazione: (2024)
di: Müller, Mika Markus, et al.
Pubblicazione: (2024)
MICSim: A Modular Simulator for Mixed-signal Compute-in-Memory based AI Accelerator
di: Wang, Cong, et al.
Pubblicazione: (2024)
di: Wang, Cong, et al.
Pubblicazione: (2024)
CiMNet: Towards Joint Optimization for DNN Architecture and Configuration for Compute-In-Memory Hardware
di: Kundu, Souvik, et al.
Pubblicazione: (2024)
di: Kundu, Souvik, et al.
Pubblicazione: (2024)
LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs
di: He, Zifan, et al.
Pubblicazione: (2025)
di: He, Zifan, et al.
Pubblicazione: (2025)
ApproXAI: Energy-Efficient Hardware Acceleration of Explainable AI using Approximate Computing
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
CaMDN: Enhancing Cache Efficiency for Multi-tenant DNNs on Integrated NPUs
di: Cai, Tianhao, et al.
Pubblicazione: (2025)
di: Cai, Tianhao, et al.
Pubblicazione: (2025)
Modulo-$(2^{2n}+1)$ Arithmetic via Two Parallel n-bit Residue Channels
di: Jaberipur, Ghassem, et al.
Pubblicazione: (2024)
di: Jaberipur, Ghassem, et al.
Pubblicazione: (2024)
A Fully Hardware Implemented Accelerator Design in ReRAM Analog Computing without ADCs
di: Dang, Peng, et al.
Pubblicazione: (2024)
di: Dang, Peng, et al.
Pubblicazione: (2024)
HiAER-Spike Software-Hardware Reconfigurable Platform for Event-Driven Neuromorphic Computing at Scale
di: Frank, Gwenevere, et al.
Pubblicazione: (2026)
di: Frank, Gwenevere, et al.
Pubblicazione: (2026)
Kelle: Co-design KV Caching and eDRAM for Efficient LLM Serving in Edge Computing
di: Xia, Tianhua, et al.
Pubblicazione: (2025)
di: Xia, Tianhua, et al.
Pubblicazione: (2025)
ScaleRTL: Scaling LLMs with Reasoning Data and Test-Time Compute for Accurate RTL Code Generation
di: Deng, Chenhui, et al.
Pubblicazione: (2025)
di: Deng, Chenhui, et al.
Pubblicazione: (2025)
Heterogeneous SoC Integrating an Open-Source Recurrent SNN Accelerator for Neuromorphic Edge Computing on FPGA
di: Barocci, Michelangelo, et al.
Pubblicazione: (2026)
di: Barocci, Michelangelo, et al.
Pubblicazione: (2026)
Enable Lightweight and Precision-Scalable Posit/IEEE-754 Arithmetic in RISC-V Cores for Transprecision Computing
di: Li, Qiong, et al.
Pubblicazione: (2025)
di: Li, Qiong, et al.
Pubblicazione: (2025)
PRO-V-R1: Reasoning Enhanced Programming Agent for RTL Verification
di: Zhao, Yujie, et al.
Pubblicazione: (2025)
di: Zhao, Yujie, et al.
Pubblicazione: (2025)
Enhancing LUT-based Deep Neural Networks Inference through Architecture and Connectivity Optimization
di: Lou, Binglei, et al.
Pubblicazione: (2026)
di: Lou, Binglei, et al.
Pubblicazione: (2026)
YOCO: A Hybrid In-Memory Computing Architecture with 8-bit Sub-PetaOps/W In-Situ Multiply Arithmetic for Large-Scale AI
di: Xuan, Zihao, et al.
Pubblicazione: (2023)
di: Xuan, Zihao, et al.
Pubblicazione: (2023)
TriGen: NPU Architecture for End-to-End Acceleration of Large Language Models based on SW-HW Co-Design
di: Lee, Jonghun, et al.
Pubblicazione: (2026)
di: Lee, Jonghun, et al.
Pubblicazione: (2026)
Silicon Showdown: Performance, Efficiency, and Ecosystem Barriers in Consumer-Grade LLM Inference
di: Javat, Abdurrahman, et al.
Pubblicazione: (2026)
di: Javat, Abdurrahman, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Modeling and Simulation Frameworks for Processing-in-Memory Architectures
di: Aghaei, Mahdi, et al.
Pubblicazione: (2025) -
DSLR-CNN: Efficient CNN Acceleration using Digit-Serial Left-to-Right Arithmetic
di: Nisar, Malik Zohaib, et al.
Pubblicazione: (2025) -
Computing-In-Memory Dataflow for Minimal Buffer Traffic
di: Song, Choongseok, et al.
Pubblicazione: (2025) -
STELLAR: Structure-guided LLM Assertion Retrieval and Generation for Formal Verification
di: Rajabi, Saeid, et al.
Pubblicazione: (2025) -
Cerberus: Cross-Layer ECC Co-Design for Robust and Efficient Memory Protection
di: Kim, Junhwan, et al.
Pubblicazione: (2026)