BitStopper: An Efficient Transformer Attention Accelerator via Stage-fusion and Early Termination
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Huizheng, Wang, Hongbin, Wei, Shaojun, Hu, Yang, Yin, Shouyi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Designing Spatial Architectures for Sparse Attention: STAR Accelerator via Cross-Stage Tiling
por: Wang, Huizheng, et al.
Publicado: (2025)
por: Wang, Huizheng, et al.
Publicado: (2025)
PADE: A Predictor-Free Sparse Attention Accelerator via Unified Execution and Stage Fusion
por: Wang, Huizheng, et al.
Publicado: (2025)
por: Wang, Huizheng, et al.
Publicado: (2025)
LAPA: Log-Domain Prediction-Driven Dynamic Sparsity Accelerator for Transformer Model
por: Wang, Huizheng, et al.
Publicado: (2025)
por: Wang, Huizheng, et al.
Publicado: (2025)
WATOS: Efficient LLM Training Strategies and Architecture Co-exploration for Wafer-scale Chip
por: Wang, Huizheng, et al.
Publicado: (2025)
por: Wang, Huizheng, et al.
Publicado: (2025)
Label-Efficient Sleep Staging Using Transformers Pre-trained with Position Prediction
por: Lala, Sayeri, et al.
Publicado: (2024)
por: Lala, Sayeri, et al.
Publicado: (2024)
MSA-CNN: A Lightweight Multi-Scale CNN with Attention for Sleep Stage Classification
por: Goerttler, Stephan, et al.
Publicado: (2025)
por: Goerttler, Stephan, et al.
Publicado: (2025)
Attentional Graph Meta-Learning for Indoor Localization Using Extremely Sparse Fingerprints
por: Yan, Wenzhong, et al.
Publicado: (2025)
por: Yan, Wenzhong, et al.
Publicado: (2025)
Generalizable Sleep Staging via Multi-Level Domain Alignment
por: Wang, Jiquan, et al.
Publicado: (2023)
por: Wang, Jiquan, et al.
Publicado: (2023)
Attentional Graph Neural Network Is All You Need for Robust Massive Network Localization
por: Yan, Wenzhong, et al.
Publicado: (2023)
por: Yan, Wenzhong, et al.
Publicado: (2023)
Toward Interpretable Sleep Stage Classification Using Cross-Modal Transformers
por: Pradeepkumar, Jathurshan, et al.
Publicado: (2022)
por: Pradeepkumar, Jathurshan, et al.
Publicado: (2022)
On Improving PPG-Based Sleep Staging: A Pilot Study
por: Wang, Jiawei, et al.
Publicado: (2025)
por: Wang, Jiawei, et al.
Publicado: (2025)
Enhancing Off-Grid One-Bit DOA Estimation with Learning-Based Sparse Bayesian Approach for Non-Uniform Sparse Array
por: Hu, Yunqiao, et al.
Publicado: (2024)
por: Hu, Yunqiao, et al.
Publicado: (2024)
Contrastive Learning for Sleep Staging based on Inter Subject Correlation
por: Zhang, Tongxu, et al.
Publicado: (2023)
por: Zhang, Tongxu, et al.
Publicado: (2023)
Efficient Transformed Gaussian Process State-Space Models for Non-Stationary High-Dimensional Dynamical Systems
por: Lin, Zhidi, et al.
Publicado: (2025)
por: Lin, Zhidi, et al.
Publicado: (2025)
Downlink MIMO Channel Estimation from Bits: Recoverability and Algorithm
por: Shrestha, Rajesh, et al.
Publicado: (2024)
por: Shrestha, Rajesh, et al.
Publicado: (2024)
Automatic Classification of Sleep Stages from EEG Signals Using Riemannian Metrics and Transformer Networks
por: Seraphim, Mathieu, et al.
Publicado: (2024)
por: Seraphim, Mathieu, et al.
Publicado: (2024)
WaveSleepNet: An Interpretable Network for Expert-like Sleep Staging
por: Pei, Yan, et al.
Publicado: (2024)
por: Pei, Yan, et al.
Publicado: (2024)
Efficient Pain Recognition via Respiration Signals: A Single Cross-Attention Transformer Multi-Window Fusion Pipeline
por: Gkikas, Stefanos, et al.
Publicado: (2025)
por: Gkikas, Stefanos, et al.
Publicado: (2025)
ESTformer: Transformer utilising spatiotemporal dependencies for electroencephalogram super-resolution
por: Li, Dongdong, et al.
Publicado: (2023)
por: Li, Dongdong, et al.
Publicado: (2023)
Multimodal Sleep Stage and Sleep Apnea Classification Using Vision Transformer: A Multitask Explainable Learning Approach
por: Kazemi, Kianoosh, et al.
Publicado: (2025)
por: Kazemi, Kianoosh, et al.
Publicado: (2025)
Channel Estimation for RIS-Assisted mmWave Systems via Diffusion Models
por: Wang, Yang, et al.
Publicado: (2025)
por: Wang, Yang, et al.
Publicado: (2025)
Adaptive Progressive Attention Graph Neural Network for EEG Emotion Recognition
por: Feng, Tianzhi, et al.
Publicado: (2025)
por: Feng, Tianzhi, et al.
Publicado: (2025)
Holographic Transformers for Complex-Valued Signal Processing: Integrating Phase Interference into Self-Attention
por: Huang, Enhao, et al.
Publicado: (2025)
por: Huang, Enhao, et al.
Publicado: (2025)
TSAK: Two-Stage Semantic-Aware Knowledge Distillation for Efficient Wearable Modality and Model Optimization in Manufacturing Lines
por: Bello, Hymalai, et al.
Publicado: (2024)
por: Bello, Hymalai, et al.
Publicado: (2024)
Energy-Efficient Real-Time 4-Stage Sleep Classification at 10-Second Resolution: A Comprehensive Study
por: Mohammadi, Zahra, et al.
Publicado: (2025)
por: Mohammadi, Zahra, et al.
Publicado: (2025)
ULW-SleepNet: An Ultra-Lightweight Network for Multimodal Sleep Stage Scoring
por: Wang, Zhaowen, et al.
Publicado: (2026)
por: Wang, Zhaowen, et al.
Publicado: (2026)
PaperNet: Efficient Temporal Convolutions and Channel Residual Attention for EEG Epilepsy Detection
por: Sajid, Md Shahriar, et al.
Publicado: (2025)
por: Sajid, Md Shahriar, et al.
Publicado: (2025)
Multi-Block Attention for Efficient Channel Estimation in IRS-Assisted mmWave MIMO
por: Momen-Tayefeh, Mehrdad, et al.
Publicado: (2026)
por: Momen-Tayefeh, Mehrdad, et al.
Publicado: (2026)
TQ-DiT: Efficient Time-Aware Quantization for Diffusion Transformers
por: Hwang, Younghye, et al.
Publicado: (2025)
por: Hwang, Younghye, et al.
Publicado: (2025)
Transparency in Sleep Staging: Deep Learning Method for EEG Sleep Stage Classification with Model Interpretability
por: Sharma, Shivam, et al.
Publicado: (2023)
por: Sharma, Shivam, et al.
Publicado: (2023)
Transformer-Based Indirect Structural Health Monitoring of Rail Infrastructure with Attention-Driven Detection and Localization of Transient Defects
por: Ma, Sizhe, et al.
Publicado: (2025)
por: Ma, Sizhe, et al.
Publicado: (2025)
BiT-MamSleep: Bidirectional Temporal Mamba for EEG Sleep Staging
por: Zhou, Xinliang, et al.
Publicado: (2024)
por: Zhou, Xinliang, et al.
Publicado: (2024)
Energy-Gated Attention: Spectral Salience as an Inductive Bias for Transformer Attention
por: Zeris, Athanasios
Publicado: (2026)
por: Zeris, Athanasios
Publicado: (2026)
Early Prediction of Natural Gas Pipeline Leaks Using the MKTCN Model
por: Li, Xuguang, et al.
Publicado: (2024)
por: Li, Xuguang, et al.
Publicado: (2024)
BrainBits: How Much of the Brain are Generative Reconstruction Methods Using?
por: Mayo, David, et al.
Publicado: (2024)
por: Mayo, David, et al.
Publicado: (2024)
Robust Cross-Domain WiFi Fall Detection via Physics-Driven Attention-Enhanced Transformers
por: Wang, Yingzhe, et al.
Publicado: (2026)
por: Wang, Yingzhe, et al.
Publicado: (2026)
Energy-Efficient Prediction in Textile Manufacturing: Enhancing Accuracy and Data Efficiency With Ensemble Deep Transfer Learning
por: Chen, Yan-Chen, et al.
Publicado: (2026)
por: Chen, Yan-Chen, et al.
Publicado: (2026)
Sequential Weakly Labeled Multi-Activity Localization and Recognition on Wearable Sensors using Recurrent Attention Networks
por: Wang, Kun, et al.
Publicado: (2020)
por: Wang, Kun, et al.
Publicado: (2020)
Communication Efficient ConFederated Learning: An Event-Triggered SAGA Approach
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
BrainODE: Dynamic Brain Signal Analysis via Graph-Aided Neural Ordinary Differential Equations
por: Han, Kaiqiao, et al.
Publicado: (2024)
por: Han, Kaiqiao, et al.
Publicado: (2024)
Ejemplares similares
-
Designing Spatial Architectures for Sparse Attention: STAR Accelerator via Cross-Stage Tiling
por: Wang, Huizheng, et al.
Publicado: (2025) -
PADE: A Predictor-Free Sparse Attention Accelerator via Unified Execution and Stage Fusion
por: Wang, Huizheng, et al.
Publicado: (2025) -
LAPA: Log-Domain Prediction-Driven Dynamic Sparsity Accelerator for Transformer Model
por: Wang, Huizheng, et al.
Publicado: (2025) -
WATOS: Efficient LLM Training Strategies and Architecture Co-exploration for Wafer-scale Chip
por: Wang, Huizheng, et al.
Publicado: (2025) -
Label-Efficient Sleep Staging Using Transformers Pre-trained with Position Prediction
por: Lala, Sayeri, et al.
Publicado: (2024)