CHOSEN: Compilation to Hardware Optimization Stack for Efficient Vision Transformer Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sadeghi, Mohammad Erfan, Fayyazi, Arash, Somashekar, Suhas, Abdollahi, Armin, Pedram, Massoud |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
par: Fayyazi, Arash, et autres
Publié: (2023)
par: Fayyazi, Arash, et autres
Publié: (2023)
MENAGE: Mixed-Signal Event-Driven Neuromorphic Accelerator for Edge Applications
par: Abdollahi, Armin, et autres
Publié: (2024)
par: Abdollahi, Armin, et autres
Publié: (2024)
IC-D2S: A Hybrid Ising-Classical-Machines Data-Driven QUBO Solver Method
par: Abdollahi, Armin, et autres
Publié: (2025)
par: Abdollahi, Armin, et autres
Publié: (2025)
Dynamic Co-Optimization Compiler: Leveraging Multi-Agent Reinforcement Learning for Enhanced DNN Accelerator Performance
par: Fayyazi, Arya, et autres
Publié: (2024)
par: Fayyazi, Arya, et autres
Publié: (2024)
PEANO-ViT: Power-Efficient Approximations of Non-Linearities in Vision Transformers
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)
HDLFORGE: A Two-Stage Multi-Agent Framework for Efficient Verilog Code Generation with Adaptive Model Escalation
par: Abdollahi, Armin, et autres
Publié: (2026)
par: Abdollahi, Armin, et autres
Publié: (2026)
Vision Transformer Computation and Resilience for Dynamic Inference
par: Sreedhar, Kavya, et autres
Publié: (2022)
par: Sreedhar, Kavya, et autres
Publié: (2022)
TimingLLM: A Two-Stage Retrieval-Augmented Framework for Pre-Synthesis Timing Prediction from Verilog
par: Abdollahi, Armin, et autres
Publié: (2026)
par: Abdollahi, Armin, et autres
Publié: (2026)
Evolving Layer-Specific Scalar Functions for Hardware-Aware Transformer Adaptation
par: Carrigg, Kieran, et autres
Publié: (2026)
par: Carrigg, Kieran, et autres
Publié: (2026)
ViM-Q: Scalable Algorithm-Hardware Co-Design for Vision Mamba Model Inference on FPGA
par: Lyu, Shengzhe, et autres
Publié: (2026)
par: Lyu, Shengzhe, et autres
Publié: (2026)
Gen-NeRF: Efficient and Generalizable Neural Radiance Fields via Algorithm-Hardware Co-Design
par: Fu, Yonggan, et autres
Publié: (2023)
par: Fu, Yonggan, et autres
Publié: (2023)
Vision Transformers on the Edge: A Comprehensive Survey of Model Compression and Acceleration Strategies
par: Saha, Shaibal, et autres
Publié: (2025)
par: Saha, Shaibal, et autres
Publié: (2025)
hARMS: A Hardware Acceleration Architecture for Real-Time Event-Based Optical Flow
par: Stumpp, Daniel C., et autres
Publié: (2021)
par: Stumpp, Daniel C., et autres
Publié: (2021)
DPU or GPU for Accelerating Neural Networks Inference -- Why not both? Split CNN Inference
par: Oztas, Ali Emre, et autres
Publié: (2026)
par: Oztas, Ali Emre, et autres
Publié: (2026)
VR-Pipe: Streamlining Hardware Graphics Pipeline for Volume Rendering
par: Lee, Junseo, et autres
Publié: (2025)
par: Lee, Junseo, et autres
Publié: (2025)
Hardware-Algorithm Co-Optimization of Early-Exit Neural Networks for Multi-Core Edge Accelerators
par: Zniber, Alaa, et autres
Publié: (2025)
par: Zniber, Alaa, et autres
Publié: (2025)
Stella Nera: A Differentiable Maddness-Based Hardware Accelerator for Efficient Approximate Matrix Multiplication
par: Schönleber, Jannis, et autres
Publié: (2023)
par: Schönleber, Jannis, et autres
Publié: (2023)
Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
par: Chen, Tse-Wei, et autres
Publié: (2025)
par: Chen, Tse-Wei, et autres
Publié: (2025)
Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey
par: Du, Dayou, et autres
Publié: (2024)
par: Du, Dayou, et autres
Publié: (2024)
SteROI-D: System Design and Mapping for Stereo Depth Inference on Regions of Interest
par: Erhardt, Jack, et autres
Publié: (2025)
par: Erhardt, Jack, et autres
Publié: (2025)
FG-Attn: Leveraging Fine-Grained Sparsity In Diffusion Transformers
par: Durvasula, Sankeerth, et autres
Publié: (2025)
par: Durvasula, Sankeerth, et autres
Publié: (2025)
Accelerating AI and Computer Vision for Satellite Pose Estimation on the Intel Myriad X Embedded SoC
par: Leon, Vasileios, et autres
Publié: (2024)
par: Leon, Vasileios, et autres
Publié: (2024)
CAMO: Correlation-Aware Mask Optimization with Modulated Reinforcement Learning
par: Liang, Xiaoxiao, et autres
Publié: (2024)
par: Liang, Xiaoxiao, et autres
Publié: (2024)
MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization
par: Li, Shuaiting, et autres
Publié: (2024)
par: Li, Shuaiting, et autres
Publié: (2024)
Efficient stereo matching on embedded GPUs with zero-means cross correlation
par: Chang, Qiong, et autres
Publié: (2022)
par: Chang, Qiong, et autres
Publié: (2022)
SpNeRF: Memory Efficient Sparse Volumetric Neural Rendering Accelerator for Edge Devices
par: Zhang, Yipu, et autres
Publié: (2025)
par: Zhang, Yipu, et autres
Publié: (2025)
ViTCoD: Vision Transformer Acceleration via Dedicated Algorithm and Accelerator Co-Design
par: You, Haoran, et autres
Publié: (2022)
par: You, Haoran, et autres
Publié: (2022)
Hardware acceleration for ultra-fast Neural Network training on FPGA for MRF map reconstruction
par: Ricchi, Mattia, et autres
Publié: (2025)
par: Ricchi, Mattia, et autres
Publié: (2025)
AHCQ-SAM: Toward Accurate and Hardware-Compatible Post-Training Segment Anything Model Quantization
par: Zhang, Wenlun, et autres
Publié: (2025)
par: Zhang, Wenlun, et autres
Publié: (2025)
GRTX: Efficient Ray Tracing for 3D Gaussian-Based Rendering
par: Lee, Junseo, et autres
Publié: (2026)
par: Lee, Junseo, et autres
Publié: (2026)
Lite VLA: Efficient Vision-Language-Action Control on CPU-Bound Edge Robots
par: Williams, Justin, et autres
Publié: (2025)
par: Williams, Justin, et autres
Publié: (2025)
AppSign: Multi-level Approximate Computing for Real-Time Traffic Sign Recognition in Autonomous Vehicles
par: Omidian, Fatemeh, et autres
Publié: (2024)
par: Omidian, Fatemeh, et autres
Publié: (2024)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
par: Zhang, Baoheng, et autres
Publié: (2024)
par: Zhang, Baoheng, et autres
Publié: (2024)
ORBIS: Output-Guided Token Reduction with Distribution-Aware Matching for Video Diffusion Acceleration
par: Lee, Hangyeol, et autres
Publié: (2026)
par: Lee, Hangyeol, et autres
Publié: (2026)
Primitive-Driven Acceleration of Hyperdimensional Computing for Real-Time Image Classification
par: Parikh, Dhruv, et autres
Publié: (2026)
par: Parikh, Dhruv, et autres
Publié: (2026)
TIMERIPPLE: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space
par: Miao, Wenxuan, et autres
Publié: (2025)
par: Miao, Wenxuan, et autres
Publié: (2025)
Identifying Unnecessary 3D Gaussians using Clustering for Fast Rendering of 3D Gaussian Splatting
par: Jo, Joongho, et autres
Publié: (2024)
par: Jo, Joongho, et autres
Publié: (2024)
Real-Time Object Detection and Classification using YOLO for Edge FPGAs
par: Amin, Rashed Al, et autres
Publié: (2025)
par: Amin, Rashed Al, et autres
Publié: (2025)
GS-TG: 3D Gaussian Splatting Accelerator with Tile Grouping for Reducing Redundant Sorting while Preserving Rasterization Efficiency
par: Jo, Joongho, et autres
Publié: (2025)
par: Jo, Joongho, et autres
Publié: (2025)
Using GUI Agent for Electronic Design Automation
par: Li, Chunyi, et autres
Publié: (2025)
par: Li, Chunyi, et autres
Publié: (2025)
Documents similaires
-
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
par: Fayyazi, Arash, et autres
Publié: (2023) -
MENAGE: Mixed-Signal Event-Driven Neuromorphic Accelerator for Edge Applications
par: Abdollahi, Armin, et autres
Publié: (2024) -
IC-D2S: A Hybrid Ising-Classical-Machines Data-Driven QUBO Solver Method
par: Abdollahi, Armin, et autres
Publié: (2025) -
Dynamic Co-Optimization Compiler: Leveraging Multi-Agent Reinforcement Learning for Enhanced DNN Accelerator Performance
par: Fayyazi, Arya, et autres
Publié: (2024) -
PEANO-ViT: Power-Efficient Approximations of Non-Linearities in Vision Transformers
par: Sadeghi, Mohammad Erfan, et autres
Publié: (2024)