NeuraLUT-Assemble: Hardware-aware Assembling of Sub-Neural Networks for Efficient LUT Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Andronic, Marta, Constantinides, George A. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
NeuraLUT: Hiding Neural Network Density in Boolean Synthesizable Functions
von: Andronic, Marta, et al.
Veröffentlicht: (2024)
von: Andronic, Marta, et al.
Veröffentlicht: (2024)
PolyLUT: Learning Piecewise Polynomials for Ultra-Low Latency FPGA LUT-based Inference
von: Andronic, Marta, et al.
Veröffentlicht: (2023)
von: Andronic, Marta, et al.
Veröffentlicht: (2023)
PolyLUT: Ultra-low Latency Polynomial Inference with Hardware-Aware Structured Pruning
von: Andronic, Marta, et al.
Veröffentlicht: (2025)
von: Andronic, Marta, et al.
Veröffentlicht: (2025)
ReducedLUT: Table Decomposition with "Don't Care" Conditions
von: Cassidy, Oliver, et al.
Veröffentlicht: (2024)
von: Cassidy, Oliver, et al.
Veröffentlicht: (2024)
LUT-KAN: Segment-wise LUT Quantization for Fast KAN Inference
von: Kuznetsov, Oleksandr
Veröffentlicht: (2026)
von: Kuznetsov, Oleksandr
Veröffentlicht: (2026)
HGQ-LUT: Fast LUT-Aware Training and Efficient Architectures for DNN Inference
von: Sun, Chang, et al.
Veröffentlicht: (2026)
von: Sun, Chang, et al.
Veröffentlicht: (2026)
PolyLUT-Add: FPGA-based LUT Inference with Wide Inputs
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference
von: Mo, Zhiwen, et al.
Veröffentlicht: (2024)
von: Mo, Zhiwen, et al.
Veröffentlicht: (2024)
LUTMUL: Exceed Conventional FPGA Roofline Limit by LUT-based Efficient Multiplication for Neural Network Inference
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
von: Khataei, Alireza, et al.
Veröffentlicht: (2025)
von: Khataei, Alireza, et al.
Veröffentlicht: (2025)
KANELÉ: Kolmogorov-Arnold Networks for Efficient LUT-based Evaluation
von: Hoang, Duc, et al.
Veröffentlicht: (2025)
von: Hoang, Duc, et al.
Veröffentlicht: (2025)
Training with Fewer Bits: Unlocking Edge LLMs Training with Stochastic Rounding
von: Liu, Taowen, et al.
Veröffentlicht: (2025)
von: Liu, Taowen, et al.
Veröffentlicht: (2025)
LUNA: LUT-Based Neural Architecture for Fast and Low-Cost Qubit Readout
von: Farooq, M. A., et al.
Veröffentlicht: (2025)
von: Farooq, M. A., et al.
Veröffentlicht: (2025)
LUT-Compiled Kolmogorov-Arnold Networks for Lightweight DoS Detection on IoT Edge Devices
von: Kuznetsov, Oleksandr
Veröffentlicht: (2026)
von: Kuznetsov, Oleksandr
Veröffentlicht: (2026)
ELUTQ: Optimizing Quantization Accuracy under LUT-Based Computation for Edge LLMs
von: Nie, Xin, et al.
Veröffentlicht: (2025)
von: Nie, Xin, et al.
Veröffentlicht: (2025)
LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
AMPLE: Event-Driven Accelerator for Mixed-Precision Inference of Graph Neural Networks
von: Gimenes, Pedro, et al.
Veröffentlicht: (2025)
von: Gimenes, Pedro, et al.
Veröffentlicht: (2025)
ATHEENA: A Toolflow for Hardware Early-Exit Network Automation
von: Biggs, Benjamin, et al.
Veröffentlicht: (2023)
von: Biggs, Benjamin, et al.
Veröffentlicht: (2023)
Revisiting Block-based Quantisation: What is Important for Sub-8-bit LLM Inference?
von: Zhang, Cheng, et al.
Veröffentlicht: (2023)
von: Zhang, Cheng, et al.
Veröffentlicht: (2023)
VoLUT: Efficient Volumetric streaming enhanced by LUT-based super-resolution
von: Wang, Chendong, et al.
Veröffentlicht: (2025)
von: Wang, Chendong, et al.
Veröffentlicht: (2025)
NeuraLSP: An Efficient and Rigorous Neural Left Singular Subspace Preconditioner for Conjugate Gradient Methods
von: Benanti, Alexander, et al.
Veröffentlicht: (2026)
von: Benanti, Alexander, et al.
Veröffentlicht: (2026)
BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration
von: Chen, Yuzong, et al.
Veröffentlicht: (2024)
von: Chen, Yuzong, et al.
Veröffentlicht: (2024)
IQ-LUT: interpolated and quantized LUT for efficient image super-resolution
von: Zhang, Yuxuan, et al.
Veröffentlicht: (2026)
von: Zhang, Yuxuan, et al.
Veröffentlicht: (2026)
Enhancing LUT-based Deep Neural Networks Inference through Architecture and Connectivity Optimization
von: Lou, Binglei, et al.
Veröffentlicht: (2026)
von: Lou, Binglei, et al.
Veröffentlicht: (2026)
DCA-LUT: Deep Chromatic Alignment with 5D LUT for Purple Fringing Removal
von: Lu, Jialang, et al.
Veröffentlicht: (2025)
von: Lu, Jialang, et al.
Veröffentlicht: (2025)
AutoLUT: LUT-Based Image Super-Resolution with Automatic Sampling and Adaptive Residual Learning
von: Xu, Yuheng, et al.
Veröffentlicht: (2025)
von: Xu, Yuheng, et al.
Veröffentlicht: (2025)
A Survey on LUT-based Deep Neural Networks Implemented in FPGAs
von: Guo, Zeyu
Veröffentlicht: (2025)
von: Guo, Zeyu
Veröffentlicht: (2025)
An Overview of Arithmetic Adaptations for Inference of Convolutional Neural Networks on Re-configurable Hardware
von: Wunderlich, Ilkay, et al.
Veröffentlicht: (2025)
von: Wunderlich, Ilkay, et al.
Veröffentlicht: (2025)
Direction-Preserving Number Representations
von: Zadeh, Bardia, et al.
Veröffentlicht: (2026)
von: Zadeh, Bardia, et al.
Veröffentlicht: (2026)
LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs
von: He, Zifan, et al.
Veröffentlicht: (2025)
von: He, Zifan, et al.
Veröffentlicht: (2025)
TENET: An Efficient Sparsity-Aware LUT-Centric Architecture for Ternary LLM Inference On Edge
von: Huang, Zhirui, et al.
Veröffentlicht: (2025)
von: Huang, Zhirui, et al.
Veröffentlicht: (2025)
Causal Learning with Neural Assemblies
von: Kopadi, Evangelia, et al.
Veröffentlicht: (2026)
von: Kopadi, Evangelia, et al.
Veröffentlicht: (2026)
Convergence for Discrete Parameter Update Schemes
von: Wilson, Paul, et al.
Veröffentlicht: (2025)
von: Wilson, Paul, et al.
Veröffentlicht: (2025)
Hardware-Oriented Inference Complexity of Kolmogorov-Arnold Networks
von: Khalid, Bilal, et al.
Veröffentlicht: (2026)
von: Khalid, Bilal, et al.
Veröffentlicht: (2026)
JUICER: Data-Efficient Imitation Learning for Robotic Assembly
von: Ankile, Lars, et al.
Veröffentlicht: (2024)
von: Ankile, Lars, et al.
Veröffentlicht: (2024)
Budget-Aware Sequential Brick Assembly with Efficient Constraint Satisfaction
von: Ahn, Seokjun, et al.
Veröffentlicht: (2022)
von: Ahn, Seokjun, et al.
Veröffentlicht: (2022)
BiAssemble: Learning Collaborative Affordance for Bimanual Geometric Assembly
von: Shen, Yan, et al.
Veröffentlicht: (2025)
von: Shen, Yan, et al.
Veröffentlicht: (2025)
Using the IBM Analog In-Memory Hardware Acceleration Kit for Neural Network Training and Inference
von: Gallo, Manuel Le, et al.
Veröffentlicht: (2023)
von: Gallo, Manuel Le, et al.
Veröffentlicht: (2023)
Pre-Defined Sparse Neural Networks with Hardware Acceleration
von: Dey, Sourya, et al.
Veröffentlicht: (2018)
von: Dey, Sourya, et al.
Veröffentlicht: (2018)
JigsawRL: Assembling RL Pipelines for Efficient LLM Post-Training
von: Hu, Zhengding, et al.
Veröffentlicht: (2026)
von: Hu, Zhengding, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
NeuraLUT: Hiding Neural Network Density in Boolean Synthesizable Functions
von: Andronic, Marta, et al.
Veröffentlicht: (2024) -
PolyLUT: Learning Piecewise Polynomials for Ultra-Low Latency FPGA LUT-based Inference
von: Andronic, Marta, et al.
Veröffentlicht: (2023) -
PolyLUT: Ultra-low Latency Polynomial Inference with Hardware-Aware Structured Pruning
von: Andronic, Marta, et al.
Veröffentlicht: (2025) -
ReducedLUT: Table Decomposition with "Don't Care" Conditions
von: Cassidy, Oliver, et al.
Veröffentlicht: (2024) -
LUT-KAN: Segment-wise LUT Quantization for Fast KAN Inference
von: Kuznetsov, Oleksandr
Veröffentlicht: (2026)