LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Guoyu, Ye, Shengyu, Chen, Chunyun, Wang, Yang, Yang, Fan, Cao, Ting, Liu, Cheng, Sabry, Mohamed M., Yang, Mao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SigDLA: A Deep Learning Accelerator Extension for Signal Processing
par: Fu, Fangfa, et autres
Publié: (2024)
par: Fu, Fangfa, et autres
Publié: (2024)
T-MAN: Enabling End-to-End Low-Bit LLM Inference on NPUs via Unified Table Lookup
par: Wei, Jianyu, et autres
Publié: (2025)
par: Wei, Jianyu, et autres
Publié: (2025)
Platinum: Path-Adaptable LUT-Based Accelerator Tailored for Low-Bit Weight Matrix Multiplication
par: Shan, Haoxuan, et autres
Publié: (2025)
par: Shan, Haoxuan, et autres
Publié: (2025)
SparseLUT: Sparse Connectivity Optimization for Lookup Table-based Deep Neural Networks
par: Lou, Binglei, et autres
Publié: (2025)
par: Lou, Binglei, et autres
Publié: (2025)
LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs
par: He, Zifan, et autres
Publié: (2025)
par: He, Zifan, et autres
Publié: (2025)
LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference
par: Mo, Zhiwen, et autres
Publié: (2024)
par: Mo, Zhiwen, et autres
Publié: (2024)
TENET: An Efficient Sparsity-Aware LUT-Centric Architecture for Ternary LLM Inference On Edge
par: Huang, Zhirui, et autres
Publié: (2025)
par: Huang, Zhirui, et autres
Publié: (2025)
BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache
par: Du, Dayou, et autres
Publié: (2025)
par: Du, Dayou, et autres
Publié: (2025)
SAIL: SRAM-Accelerated LLM Inference System with Lookup-Table-based GEMV
par: Zhang, Jingyao, et autres
Publié: (2025)
par: Zhang, Jingyao, et autres
Publié: (2025)
MCBP: A Memory-Compute Efficient LLM Inference Accelerator Leveraging Bit-Slice-enabled Sparsity and Repetitiveness
par: Wang, Huizheng, et autres
Publié: (2025)
par: Wang, Huizheng, et autres
Publié: (2025)
Hardware Generation and Exploration of Lookup Table-Based Accelerators for 1.58-bit LLM Inference
par: Geens, Robin, et autres
Publié: (2026)
par: Geens, Robin, et autres
Publié: (2026)
BBS: Bi-directional Bit-level Sparsity for Deep Learning Acceleration
par: Chen, Yuzong, et autres
Publié: (2024)
par: Chen, Yuzong, et autres
Publié: (2024)
Towards Efficient LUT-based PIM: A Scalable and Low-Power Approach for Modern Workloads
par: Khabbazan, Bahareh, et autres
Publié: (2025)
par: Khabbazan, Bahareh, et autres
Publié: (2025)
PolyLUT: Learning Piecewise Polynomials for Ultra-Low Latency FPGA LUT-based Inference
par: Andronic, Marta, et autres
Publié: (2023)
par: Andronic, Marta, et autres
Publié: (2023)
DSLUT: An Asymmetric LUT and its Automatic Design Flow Based on Practical Functions
par: Yang, Moucheng, et autres
Publié: (2025)
par: Yang, Moucheng, et autres
Publié: (2025)
BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration
par: Chen, Yuzong, et autres
Publié: (2024)
par: Chen, Yuzong, et autres
Publié: (2024)
Lookup Table-based Multiplication-free All-digital DNN Accelerator Featuring Self-Synchronous Pipeline Accumulation
par: Tagata, Hiroto, et autres
Publié: (2025)
par: Tagata, Hiroto, et autres
Publié: (2025)
TeLLMe v2: An Efficient End-to-End Ternary LLM Prefill and Decode Accelerator with Table-Lookup Matmul on Edge FPGAs
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
par: Khataei, Alireza, et autres
Publié: (2025)
par: Khataei, Alireza, et autres
Publié: (2025)
A Survey on LUT-based Deep Neural Networks Implemented in FPGAs
par: Guo, Zeyu
Publié: (2025)
par: Guo, Zeyu
Publié: (2025)
Double Duty: FPGA Architecture to Enable Concurrent LUT and Adder Chain Usage
par: Pun, Junius, et autres
Publié: (2025)
par: Pun, Junius, et autres
Publié: (2025)
RAS: A Bit-Exact rANS Accelerator For High-Performance Neural Lossless Compression
par: Qin, Yuchao, et autres
Publié: (2025)
par: Qin, Yuchao, et autres
Publié: (2025)
Table-Lookup MAC: Scalable Processing of Quantised Neural Networks in FPGA Soft Logic
par: Gerlinghoff, Daniel, et autres
Publié: (2024)
par: Gerlinghoff, Daniel, et autres
Publié: (2024)
Analysis of Single Event Induced Bit Faults in a Deep Neural Network Accelerator Pipeline
par: Jonckers, Naïn, et autres
Publié: (2025)
par: Jonckers, Naïn, et autres
Publié: (2025)
ReducedLUT: Table Decomposition with "Don't Care" Conditions
par: Cassidy, Oliver, et autres
Publié: (2024)
par: Cassidy, Oliver, et autres
Publié: (2024)
Bit-Accurate Modeling of GPU Matrix Multiply-Accumulate Units: Demystifying Numerical Discrepancy and Accuracy
par: Xie, Peichen, et autres
Publié: (2025)
par: Xie, Peichen, et autres
Publié: (2025)
A Bit Level Weight Reordering Strategy Based on Column Similarity to Explore Weight Sparsity in RRAM-based NN Accelerator
par: Yang, Weiping, et autres
Publié: (2025)
par: Yang, Weiping, et autres
Publié: (2025)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
par: Hsu, Kai-Chieh, et autres
Publié: (2025)
par: Hsu, Kai-Chieh, et autres
Publié: (2025)
MVDRAM: Enabling GeMV Execution in Unmodified DRAM for Low-Bit LLM Acceleration
par: Kubo, Tatsuya, et autres
Publié: (2025)
par: Kubo, Tatsuya, et autres
Publié: (2025)
Towards Efficient SRAM-PIM Architecture Design by Exploiting Unstructured Bit-Level Sparsity
par: Duan, Cenlin, et autres
Publié: (2024)
par: Duan, Cenlin, et autres
Publié: (2024)
LOCALUT: Harnessing Capacity-Computation Tradeoffs for LUT-Based Inference in DRAM-PIM
par: Hong, Junguk, et autres
Publié: (2026)
par: Hong, Junguk, et autres
Publié: (2026)
Efficient SRAM-PIM Co-design by Joint Exploration of Value-Level and Bit-Level Sparsity
par: Duan, Cenlin, et autres
Publié: (2025)
par: Duan, Cenlin, et autres
Publié: (2025)
A Hybrid-Domain Floating-Point Compute-in-Memory Architecture for Efficient Acceleration of High-Precision Deep Neural Networks
par: Yi, Zhiqiang, et autres
Publié: (2025)
par: Yi, Zhiqiang, et autres
Publié: (2025)
Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels
par: Wu, Meng, et autres
Publié: (2024)
par: Wu, Meng, et autres
Publié: (2024)
Accelerating OTA Circuit Design: Transistor Sizing Based on a Transformer Model and Precomputed Lookup Tables
par: Ghosh, Subhadip, et autres
Publié: (2025)
par: Ghosh, Subhadip, et autres
Publié: (2025)
An Efficient Sparse Hardware Accelerator for Spike-Driven Transformer
par: Li, Zhengke, et autres
Publié: (2025)
par: Li, Zhengke, et autres
Publié: (2025)
CIMple: Standard-cell SRAM-based CIM with LUT-based split softmax for attention acceleration
par: Ahn, Bas, et autres
Publié: (2026)
par: Ahn, Bas, et autres
Publié: (2026)
Enhancing LUT-based Deep Neural Networks Inference through Architecture and Connectivity Optimization
par: Lou, Binglei, et autres
Publié: (2026)
par: Lou, Binglei, et autres
Publié: (2026)
Leveraging Application-Specific Knowledge for Energy-Efficient Deep Learning Accelerators on Resource-Constrained FPGAs
par: Qian, Chao
Publié: (2025)
par: Qian, Chao
Publié: (2025)
MIREDO: MIP-Driven Resource-Efficient Dataflow Optimization for Computing-in-Memory Accelerator
par: He, Xiaolin, et autres
Publié: (2025)
par: He, Xiaolin, et autres
Publié: (2025)
Documents similaires
-
SigDLA: A Deep Learning Accelerator Extension for Signal Processing
par: Fu, Fangfa, et autres
Publié: (2024) -
T-MAN: Enabling End-to-End Low-Bit LLM Inference on NPUs via Unified Table Lookup
par: Wei, Jianyu, et autres
Publié: (2025) -
Platinum: Path-Adaptable LUT-Based Accelerator Tailored for Low-Bit Weight Matrix Multiplication
par: Shan, Haoxuan, et autres
Publié: (2025) -
SparseLUT: Sparse Connectivity Optimization for Lookup Table-based Deep Neural Networks
par: Lou, Binglei, et autres
Publié: (2025) -
LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs
par: He, Zifan, et autres
Publié: (2025)