TransAxx: Efficient Transformers with Approximate Computing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Danopoulos, Dimitrios, Zervakis, Georgios, Soudris, Dimitrios, Henkel, Jörg |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
par: Leon, Vasileios, et autres
Publié: (2025)
par: Leon, Vasileios, et autres
Publié: (2025)
Leveraging Highly Approximated Multipliers in DNN Inference
par: Zervakis, Georgios, et autres
Publié: (2024)
par: Zervakis, Georgios, et autres
Publié: (2024)
Taming the Exponential: A Fast Softmax Surrogate for Integer-Native Edge Inference
par: Danopoulos, Dimitrios, et autres
Publié: (2026)
par: Danopoulos, Dimitrios, et autres
Publié: (2026)
MaRVIn: A Cross-Layer Mixed-Precision RISC-V Framework for DNN Inference, from ISA Extension to Hardware Acceleration
par: Armeniakos, Giorgos, et autres
Publié: (2025)
par: Armeniakos, Giorgos, et autres
Publié: (2025)
Exploiting temporal parallelism for LSTM Autoencoder acceleration on FPGA
par: Leftheriotis, Aimilios, et autres
Publié: (2026)
par: Leftheriotis, Aimilios, et autres
Publié: (2026)
Design Rules for Extreme-Edge Scientific Computing on AI Engines
par: Ma, Zhenghua, et autres
Publié: (2026)
par: Ma, Zhenghua, et autres
Publié: (2026)
Bespoke Approximation of Multiplication-Accumulation and Activation Targeting Printed Multilayer Perceptrons
par: Afentaki, Florentia, et autres
Publié: (2023)
par: Afentaki, Florentia, et autres
Publié: (2023)
Bespoke Co-processor for Energy-Efficient Health Monitoring on RISC-V-based Flexible Wearables
par: Vergos, Theofanis, et autres
Publié: (2025)
par: Vergos, Theofanis, et autres
Publié: (2025)
Co-Design of CNN Accelerators for TinyML using Approximate Matrix Decomposition
par: Morales, José Juan Hernández, et autres
Publié: (2026)
par: Morales, José Juan Hernández, et autres
Publié: (2026)
A Unified Framework for Mapping and Synthesis of Approximate R-Blocks CGRAs
par: Alexandris, Georgios, et autres
Publié: (2025)
par: Alexandris, Georgios, et autres
Publié: (2025)
A Bespoke Design Approach to Low-Power Printed Microprocessors for Machine Learning Applications
par: Chaidos, Panagiotis, et autres
Publié: (2025)
par: Chaidos, Panagiotis, et autres
Publié: (2025)
SLO-aware GPU Frequency Scaling for Energy Efficient LLM Inference Serving
par: Kakolyris, Andreas Kosmas, et autres
Publié: (2024)
par: Kakolyris, Andreas Kosmas, et autres
Publié: (2024)
AIE4ML: An End-to-End Framework for Compiling Neural Networks for the Next Generation of AMD AI Engines
par: Danopoulos, Dimitrios, et autres
Publié: (2025)
par: Danopoulos, Dimitrios, et autres
Publié: (2025)
Compact Yet Highly Accurate Printed Classifiers Using Sequential Support Vector Machine Circuits
par: Sertaridis, Ilias, et autres
Publié: (2025)
par: Sertaridis, Ilias, et autres
Publié: (2025)
Embedding Hardware Approximations in Discrete Genetic-based Training for Printed MLPs
par: Afentaki, Florentia, et autres
Publié: (2024)
par: Afentaki, Florentia, et autres
Publié: (2024)
Optimizing GEMM for Energy and Performance on Versal ACAP Architectures
par: Papalamprou, Ilias, et autres
Publié: (2025)
par: Papalamprou, Ilias, et autres
Publié: (2025)
Towards Employing FPGA and ASIP Acceleration to Enable Onboard AI/ML in Space Applications
par: Leon, Vasileios, et autres
Publié: (2025)
par: Leon, Vasileios, et autres
Publié: (2025)
Variability-Aware Approximate Circuit Synthesis via Genetic Optimization
par: Balaskas, Konstantinos, et autres
Publié: (2023)
par: Balaskas, Konstantinos, et autres
Publié: (2023)
Kernel Approximation using Analog In-Memory Computing
par: Büchel, Julian, et autres
Publié: (2024)
par: Büchel, Julian, et autres
Publié: (2024)
Decoupled Access-Execute enabled DVFS for tinyML deployments on STM32 microcontrollers
par: Alvanaki, Elisavet Lydia, et autres
Publié: (2024)
par: Alvanaki, Elisavet Lydia, et autres
Publié: (2024)
Approximate Computing Survey, Part I: Terminology and Software & Hardware Approximation Techniques
par: Leon, Vasileios, et autres
Publié: (2023)
par: Leon, Vasileios, et autres
Publié: (2023)
Mixed-precision Neural Networks on RISC-V Cores: ISA extensions for Multi-Pumped Soft SIMD Operations
par: Armeniakos, Giorgos, et autres
Publié: (2024)
par: Armeniakos, Giorgos, et autres
Publié: (2024)
MPAI: A Co-Processing Architecture with MPSoC & AI Accelerators for Vision Applications in Space
par: Leon, Vasileios, et autres
Publié: (2024)
par: Leon, Vasileios, et autres
Publié: (2024)
Accelerating AI and Computer Vision for Satellite Pose Estimation on the Intel Myriad X Embedded SoC
par: Leon, Vasileios, et autres
Publié: (2024)
par: Leon, Vasileios, et autres
Publié: (2024)
Combining Fault Tolerance Techniques and COTS SoC Accelerators for Payload Processing in Space
par: Leon, Vasileios, et autres
Publié: (2025)
par: Leon, Vasileios, et autres
Publié: (2025)
ShortCircuit: AlphaZero-Driven Circuit Design
par: Tsaras, Dimitrios, et autres
Publié: (2024)
par: Tsaras, Dimitrios, et autres
Publié: (2024)
Post-Quantum and Blockchain-Based Attestation for Trusted FPGAs in B5G Networks
par: Papalamprou, Ilias, et autres
Publié: (2025)
par: Papalamprou, Ilias, et autres
Publié: (2025)
Late Breaking Results: Leveraging Approximate Computing for Carbon-Aware DNN Accelerators
par: Panteleaki, Aikaterini Maria, et autres
Publié: (2025)
par: Panteleaki, Aikaterini Maria, et autres
Publié: (2025)
Reusing Softmax Hardware Unit for GELU Computation in Transformers
par: Peltekis, Christodoulos, et autres
Publié: (2024)
par: Peltekis, Christodoulos, et autres
Publié: (2024)
PACiM: A Sparsity-Centric Hybrid Compute-in-Memory Architecture via Probabilistic Approximation
par: Zhang, Wenlun, et autres
Publié: (2024)
par: Zhang, Wenlun, et autres
Publié: (2024)
Sustainable Transformer Neural Network Acceleration with Stochastic Photonic Computing
par: Afifi, S., et autres
Publié: (2026)
par: Afifi, S., et autres
Publié: (2026)
Exploration of Low-Power Flexible Stress Monitoring Classifiers for Conformal Wearables
par: Afentaki, Florentia, et autres
Publié: (2025)
par: Afentaki, Florentia, et autres
Publié: (2025)
Synthesis of Resource-Efficient Superconducting Circuits with Clock-Free Alternating Logic
par: Volk, Jennifer, et autres
Publié: (2024)
par: Volk, Jennifer, et autres
Publié: (2024)
An Analog and Digital Hybrid Attention Accelerator for Transformers with Charge-based In-memory Computing
par: Moradifirouzabadi, Ashkan, et autres
Publié: (2024)
par: Moradifirouzabadi, Ashkan, et autres
Publié: (2024)
TinyFormer: Efficient Transformer Design and Deployment on Tiny Devices
par: Yang, Jianlei, et autres
Publié: (2023)
par: Yang, Jianlei, et autres
Publié: (2023)
ITA: An Energy-Efficient Attention and Softmax Accelerator for Quantized Transformers
par: İslamoğlu, Gamze, et autres
Publié: (2023)
par: İslamoğlu, Gamze, et autres
Publié: (2023)
ESACT: An End-to-End Sparse Accelerator for Compute-Intensive Transformers via Local Similarity
par: Liu, Hongxiang, et autres
Publié: (2025)
par: Liu, Hongxiang, et autres
Publié: (2025)
An FPGA-Based Reconfigurable Accelerator for Convolution-Transformer Hybrid EfficientViT
par: Shao, Haikuo, et autres
Publié: (2024)
par: Shao, Haikuo, et autres
Publié: (2024)
An Efficient Data Reuse with Tile-Based Adaptive Stationary for Transformer Accelerators
par: Li, Tseng-Jen, et autres
Publié: (2025)
par: Li, Tseng-Jen, et autres
Publié: (2025)
Approximate Computing Survey, Part II: Application-Specific & Architectural Approximation Techniques and Applications
par: Leon, Vasileios, et autres
Publié: (2023)
par: Leon, Vasileios, et autres
Publié: (2023)
Documents similaires
-
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
par: Leon, Vasileios, et autres
Publié: (2025) -
Leveraging Highly Approximated Multipliers in DNN Inference
par: Zervakis, Georgios, et autres
Publié: (2024) -
Taming the Exponential: A Fast Softmax Surrogate for Integer-Native Edge Inference
par: Danopoulos, Dimitrios, et autres
Publié: (2026) -
MaRVIn: A Cross-Layer Mixed-Precision RISC-V Framework for DNN Inference, from ISA Extension to Hardware Acceleration
par: Armeniakos, Giorgos, et autres
Publié: (2025) -
Exploiting temporal parallelism for LSTM Autoencoder acceleration on FPGA
par: Leftheriotis, Aimilios, et autres
Publié: (2026)