S2AFormer: Strip Self-Attention for Efficient Vision Transformer
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Guoan, Huang, Wenfeng, Jia, Wenjing, Li, Jiamao, Gao, Guangwei, Qi, Guo-Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SCASeg: Strip Cross-Attention for Efficient Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2024)
di: Xu, Guoan, et al.
Pubblicazione: (2024)
ReviveDiff: A Universal Diffusion Model for Restoring Images in Adverse Weather Conditions
di: Huang, Wenfeng, et al.
Pubblicazione: (2024)
di: Huang, Wenfeng, et al.
Pubblicazione: (2024)
RSGMamba: Reliability-Aware Self-Gated State Space Model for Multimodal Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2026)
di: Xu, Guoan, et al.
Pubblicazione: (2026)
WaveSeg: Enhancing Segmentation Precision via High-Frequency Prior and Mamba-Driven Spectrum Decomposition
di: Xu, Guoan, et al.
Pubblicazione: (2025)
di: Xu, Guoan, et al.
Pubblicazione: (2025)
MacFormer: Semantic Segmentation with Fine Object Boundaries
di: Xu, Guoan, et al.
Pubblicazione: (2024)
di: Xu, Guoan, et al.
Pubblicazione: (2024)
HAFormer: Unleashing the Power of Hierarchy-Aware Features for Lightweight Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2024)
di: Xu, Guoan, et al.
Pubblicazione: (2024)
Efficient Semantic Segmentation via Lightweight Multiple-Information Interaction Network
di: Qiu, Yangyang, et al.
Pubblicazione: (2024)
di: Qiu, Yangyang, et al.
Pubblicazione: (2024)
Versatile and Efficient Medical Image Super-Resolution Via Frequency-Gated Mamba
di: Huang, Wenfeng, et al.
Pubblicazione: (2025)
di: Huang, Wenfeng, et al.
Pubblicazione: (2025)
Vision Transformers are Circulant Attention Learners
di: Han, Dongchen, et al.
Pubblicazione: (2025)
di: Han, Dongchen, et al.
Pubblicazione: (2025)
JointSplat: Probabilistic Joint Flow-Depth Optimization for Sparse-View Gaussian Splatting
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
Representative Attention For Vision Transformers
di: Li, Yuntong, et al.
Pubblicazione: (2026)
di: Li, Yuntong, et al.
Pubblicazione: (2026)
Cross Paradigm Representation and Alignment Transformer for Image Deraining
di: Zou, Shun, et al.
Pubblicazione: (2025)
di: Zou, Shun, et al.
Pubblicazione: (2025)
Efficient Image Super-Resolution with Feature Interaction Weighted Hybrid Network
di: Li, Wenjie, et al.
Pubblicazione: (2022)
di: Li, Wenjie, et al.
Pubblicazione: (2022)
SAGS: Self-Adaptive Alias-Free Gaussian Splatting for Dynamic Surgical Endoscopic Reconstruction
di: Huang, Wenfeng, et al.
Pubblicazione: (2025)
di: Huang, Wenfeng, et al.
Pubblicazione: (2025)
FADPNet: Frequency-Aware Dual-Path Network for Face Super-Resolution
di: Xu, Siyu, et al.
Pubblicazione: (2025)
di: Xu, Siyu, et al.
Pubblicazione: (2025)
Self-Supervised Selective-Guided Diffusion Model for Old-Photo Face Restoration
di: Li, Wenjie, et al.
Pubblicazione: (2025)
di: Li, Wenjie, et al.
Pubblicazione: (2025)
Efficient Diffusion Transformer with Step-wise Dynamic Attention Mediators
di: Pu, Yifan, et al.
Pubblicazione: (2024)
di: Pu, Yifan, et al.
Pubblicazione: (2024)
MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device
di: Setyawan, Novendra, et al.
Pubblicazione: (2025)
di: Setyawan, Novendra, et al.
Pubblicazione: (2025)
Multiple-Exit Tuning: Towards Inference-Efficient Adaptation for Vision Transformer
di: Liu, Zheng, et al.
Pubblicazione: (2024)
di: Liu, Zheng, et al.
Pubblicazione: (2024)
EViT: An Eagle Vision Transformer with Bi-Fovea Self-Attention
di: Shi, Yulong, et al.
Pubblicazione: (2023)
di: Shi, Yulong, et al.
Pubblicazione: (2023)
Polyline Path Masked Attention for Vision Transformer
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
di: Jia, Ding, et al.
Pubblicazione: (2024)
di: Jia, Ding, et al.
Pubblicazione: (2024)
Transformer-Progressive Mamba Network for Lightweight Image Super-Resolution
di: Guo, Sichen, et al.
Pubblicazione: (2025)
di: Guo, Sichen, et al.
Pubblicazione: (2025)
ToSA: Token Selective Attention for Efficient Vision Transformers
di: Singh, Manish Kumar, et al.
Pubblicazione: (2024)
di: Singh, Manish Kumar, et al.
Pubblicazione: (2024)
Artifacts and Attention Sinks: Structured Approximations for Efficient Vision Transformers
di: Lu, Andrew, et al.
Pubblicazione: (2025)
di: Lu, Andrew, et al.
Pubblicazione: (2025)
Calibration Attention: Learning Reliability-Aware Representations for Vision Transformers
di: Liang, Wenhao, et al.
Pubblicazione: (2025)
di: Liang, Wenhao, et al.
Pubblicazione: (2025)
Structured Initialization for Attention in Vision Transformers
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
Improving Vision Transformers by Overlapping Heads in Multi-Head Self-Attention
di: Zhang, Tianxiao, et al.
Pubblicazione: (2024)
di: Zhang, Tianxiao, et al.
Pubblicazione: (2024)
Parallel Cross Strip Attention Network for Single Image Dehazing
di: Tong, Lihan, et al.
Pubblicazione: (2024)
di: Tong, Lihan, et al.
Pubblicazione: (2024)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
StripDet: Strip Attention-Based Lightweight 3D Object Detection from Point Cloud
di: Wang, Weichao, et al.
Pubblicazione: (2025)
di: Wang, Weichao, et al.
Pubblicazione: (2025)
Vision Transformers with Hierarchical Attention
di: Liu, Yun, et al.
Pubblicazione: (2021)
di: Liu, Yun, et al.
Pubblicazione: (2021)
Lightweight Vision Transformer with Window and Spatial Attention for Food Image Classification
di: Gao, Xinle, et al.
Pubblicazione: (2025)
di: Gao, Xinle, et al.
Pubblicazione: (2025)
Attention-Guided Multi-scale Interaction Network for Face Super-Resolution
di: Wan, Xujie, et al.
Pubblicazione: (2024)
di: Wan, Xujie, et al.
Pubblicazione: (2024)
MambaMIC: An Efficient Baseline for Microscopic Image Classification with State Space Models
di: Zou, Shun, et al.
Pubblicazione: (2024)
di: Zou, Shun, et al.
Pubblicazione: (2024)
Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction
di: Chen, Jun, et al.
Pubblicazione: (2022)
di: Chen, Jun, et al.
Pubblicazione: (2022)
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
di: Guo, Qi, et al.
Pubblicazione: (2024)
di: Guo, Qi, et al.
Pubblicazione: (2024)
EDIT: Enhancing Vision Transformers by Mitigating Attention Sink through an Encoder-Decoder Architecture
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
di: Feng, Wenfeng, et al.
Pubblicazione: (2025)
PADRe: A Unifying Polynomial Attention Drop-in Replacement for Efficient Vision Transformer
di: Letourneau, Pierre-David, et al.
Pubblicazione: (2024)
di: Letourneau, Pierre-David, et al.
Pubblicazione: (2024)
Castling-ViT: Compressing Self-Attention via Switching Towards Linear-Angular Attention at Vision Transformer Inference
di: You, Haoran, et al.
Pubblicazione: (2022)
di: You, Haoran, et al.
Pubblicazione: (2022)
Documenti analoghi
-
SCASeg: Strip Cross-Attention for Efficient Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2024) -
ReviveDiff: A Universal Diffusion Model for Restoring Images in Adverse Weather Conditions
di: Huang, Wenfeng, et al.
Pubblicazione: (2024) -
RSGMamba: Reliability-Aware Self-Gated State Space Model for Multimodal Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2026) -
WaveSeg: Enhancing Segmentation Precision via High-Frequency Prior and Mamba-Driven Spectrum Decomposition
di: Xu, Guoan, et al.
Pubblicazione: (2025) -
MacFormer: Semantic Segmentation with Fine Object Boundaries
di: Xu, Guoan, et al.
Pubblicazione: (2024)