Efficient and Mathematically Robust Operations for Certified Neural Networks Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Geyer, Fabien, Freitag, Johannes, Schulz, Tobias, Uhrig, Sascha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NeuralMatrix: Compute the Entire Neural Networks with Linear Matrix Operations for Efficient Inference
par: Sun, Ruiqi, et autres
Publié: (2023)
par: Sun, Ruiqi, et autres
Publié: (2023)
xTern: Energy-Efficient Ternary Neural Network Inference on RISC-V-Based Edge Systems
par: Rutishauser, Georg, et autres
Publié: (2024)
par: Rutishauser, Georg, et autres
Publié: (2024)
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
par: Khataei, Alireza, et autres
Publié: (2025)
par: Khataei, Alireza, et autres
Publié: (2025)
PolyThrottle: Energy-efficient Neural Network Inference on Edge Devices
par: Yan, Minghao, et autres
Publié: (2023)
par: Yan, Minghao, et autres
Publié: (2023)
Data-Rate-Aware High-Speed CNN Inference on FPGAs
par: Habermann, Tobias, et autres
Publié: (2026)
par: Habermann, Tobias, et autres
Publié: (2026)
ROSA: Robust and Energy-Efficient Microring-Based Optical Neural Networks via Optical Shift-and-Add and Layer-Wise Hybrid Mapping
par: Zhang, Huifan, et autres
Publié: (2026)
par: Zhang, Huifan, et autres
Publié: (2026)
A Data-Driven Approach to Dataflow-Aware Online Scheduling for Graph Neural Network Inference
par: Puigdemont, Pol, et autres
Publié: (2024)
par: Puigdemont, Pol, et autres
Publié: (2024)
Architectural Implications of Neural Network Inference for High Data-Rate, Low-Latency Scientific Applications
par: Weng, Olivia, et autres
Publié: (2024)
par: Weng, Olivia, et autres
Publié: (2024)
Resource-Efficient and Robust Inference of Deep and Bayesian Neural Networks on Embedded and Analog Computing Platforms
par: Klein, Bernhard
Publié: (2025)
par: Klein, Bernhard
Publié: (2025)
Efficient VQ-QAT and Mixed Vector/Linear quantized Neural Networks
par: Gou, Terry, et autres
Publié: (2026)
par: Gou, Terry, et autres
Publié: (2026)
Layer-wise Weight Selection for Power-Efficient Neural Network Acceleration
par: Fang, Jiaxun, et autres
Publié: (2025)
par: Fang, Jiaxun, et autres
Publié: (2025)
Evaluating Four FPGA-accelerated Space Use Cases based on Neural Network Algorithms for On-board Inference
par: Antunes, Pedro, et autres
Publié: (2026)
par: Antunes, Pedro, et autres
Publié: (2026)
Performance Analysis of DNN Inference/Training with Convolution and non-Convolution Operations
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
Huff-LLM: End-to-End Lossless Compression for Efficient LLM Inference
par: Yubeaton, Patrick, et autres
Publié: (2025)
par: Yubeaton, Patrick, et autres
Publié: (2025)
LUTMUL: Exceed Conventional FPGA Roofline Limit by LUT-based Efficient Multiplication for Neural Network Inference
par: Xie, Yanyue, et autres
Publié: (2024)
par: Xie, Yanyue, et autres
Publié: (2024)
FPGA Co-Design for Efficient N:M Sparse and Quantized Model Inference
par: Hsieh, Fen-Yu, et autres
Publié: (2025)
par: Hsieh, Fen-Yu, et autres
Publié: (2025)
An FPGA-Based SoC Architecture with a RISC-V Controller for Energy-Efficient Temporal-Coding Spiking Neural Networks
par: Sekonji, Mohammad Javad, et autres
Publié: (2026)
par: Sekonji, Mohammad Javad, et autres
Publié: (2026)
On-Device Qwen2.5: Efficient LLM Inference with Model Compression and Hardware Acceleration
par: Xiang, Maoyang, et autres
Publié: (2025)
par: Xiang, Maoyang, et autres
Publié: (2025)
SOLE: Hardware-Software Co-design of Softmax and LayerNorm for Efficient Transformer Inference
par: Wang, Wenxun, et autres
Publié: (2025)
par: Wang, Wenxun, et autres
Publié: (2025)
SHIELD: A Segmented Hierarchical Memory Architecture for Energy-Efficient LLM Inference on Edge NPUs
par: Zhang, Jintao, et autres
Publié: (2026)
par: Zhang, Jintao, et autres
Publié: (2026)
Accelerating Sparse Graph Neural Networks with Tensor Core Optimization
par: Wu, Ka Wai
Publié: (2024)
par: Wu, Ka Wai
Publié: (2024)
Approximate Multiplier Induced Error Propagation in Deep Neural Networks
par: Alahakoon, A. M. H. H., et autres
Publié: (2025)
par: Alahakoon, A. M. H. H., et autres
Publié: (2025)
Sustainable Transformer Neural Network Acceleration with Stochastic Photonic Computing
par: Afifi, S., et autres
Publié: (2026)
par: Afifi, S., et autres
Publié: (2026)
Histogram-Equalized Quantization for logic-gated Residual Neural Networks
par: Nguyen, Van Thien, et autres
Publié: (2025)
par: Nguyen, Van Thien, et autres
Publié: (2025)
Graph Neural Networks Based Analog Circuit Link Prediction
par: Pan, Guanyuan, et autres
Publié: (2025)
par: Pan, Guanyuan, et autres
Publié: (2025)
Algorithmic Strategies for Sustainable Reuse of Neural Network Accelerators with Permanent Faults
par: Alama, Youssef A. Ait, et autres
Publié: (2024)
par: Alama, Youssef A. Ait, et autres
Publié: (2024)
NeuraLUT: Hiding Neural Network Density in Boolean Synthesizable Functions
par: Andronic, Marta, et autres
Publié: (2024)
par: Andronic, Marta, et autres
Publié: (2024)
PhotoGAN: Generative Adversarial Neural Network Acceleration with Silicon Photonics
par: Suresh, Tharini, et autres
Publié: (2025)
par: Suresh, Tharini, et autres
Publié: (2025)
A Cost-Efficient FPGA Implementation of Tiny Transformer Model using Neural ODE
par: Okubo, Ikumi, et autres
Publié: (2024)
par: Okubo, Ikumi, et autres
Publié: (2024)
AMPLE: Event-Driven Accelerator for Mixed-Precision Inference of Graph Neural Networks
par: Gimenes, Pedro, et autres
Publié: (2025)
par: Gimenes, Pedro, et autres
Publié: (2025)
Accelerating Neural Networks for Large Language Models and Graph Processing with Silicon Photonics
par: Afifi, Salma, et autres
Publié: (2024)
par: Afifi, Salma, et autres
Publié: (2024)
Exploring Quantization and Mapping Synergy in Hardware-Aware Deep Neural Network Accelerators
par: Klhufek, Jan, et autres
Publié: (2024)
par: Klhufek, Jan, et autres
Publié: (2024)
ARTEMIS: A Mixed Analog-Stochastic In-DRAM Accelerator for Transformer Neural Networks
par: Afifi, Salma, et autres
Publié: (2024)
par: Afifi, Salma, et autres
Publié: (2024)
FuncGNN: Learning Functional Semantics of Logic Circuits with Graph Neural Networks
par: Zhao, Qiyun
Publié: (2025)
par: Zhao, Qiyun
Publié: (2025)
The prediction of the quality of results in Logic Synthesis using Transformer and Graph Neural Networks
par: Yang, Chenghao, et autres
Publié: (2022)
par: Yang, Chenghao, et autres
Publié: (2022)
FPGA-Enabled Machine Learning Applications in Earth Observation: A Systematic Review
par: Léonard, Cédric, et autres
Publié: (2025)
par: Léonard, Cédric, et autres
Publié: (2025)
Boolean-aware Boolean Circuit Classification: A Comprehensive Study on Graph Neural Network
par: Ni, Liwei, et autres
Publié: (2024)
par: Ni, Liwei, et autres
Publié: (2024)
Optical Computing for Deep Neural Network Acceleration: Foundations, Recent Developments, and Emerging Directions
par: Pasricha, Sudeep
Publié: (2024)
par: Pasricha, Sudeep
Publié: (2024)
MCEL: Margin-Based Cross-Entropy Loss for Error-Tolerant Quantized Neural Networks
par: Yayla, Mikail, et autres
Publié: (2026)
par: Yayla, Mikail, et autres
Publié: (2026)
Bit-Flip Fault Attack: Crushing Graph Neural Networks via Gradual Bit Search
par: Abharian, Sanaz Kazemi, et autres
Publié: (2025)
par: Abharian, Sanaz Kazemi, et autres
Publié: (2025)
Documents similaires
-
NeuralMatrix: Compute the Entire Neural Networks with Linear Matrix Operations for Efficient Inference
par: Sun, Ruiqi, et autres
Publié: (2023) -
xTern: Energy-Efficient Ternary Neural Network Inference on RISC-V-Based Edge Systems
par: Rutishauser, Georg, et autres
Publié: (2024) -
TreeLUT: An Efficient Alternative to Deep Neural Networks for Inference Acceleration Using Gradient Boosted Decision Trees
par: Khataei, Alireza, et autres
Publié: (2025) -
PolyThrottle: Energy-efficient Neural Network Inference on Edge Devices
par: Yan, Minghao, et autres
Publié: (2023) -
Data-Rate-Aware High-Speed CNN Inference on FPGAs
par: Habermann, Tobias, et autres
Publié: (2026)