SeaFormer++: Squeeze-enhanced Axial Transformer for Mobile Visual Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Wan, Qiang, Huang, Zilong, Lu, Jiachen, Yu, Gang, Zhang, Li |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
por: Li, Kunchang, et al.
Publicado: (2022)
por: Li, Kunchang, et al.
Publicado: (2022)
BRepFormer: Transformer-Based B-rep Geometric Feature Recognition
por: Dai, Yongkang, et al.
Publicado: (2025)
por: Dai, Yongkang, et al.
Publicado: (2025)
Proto-Former: Unified Facial Landmark Detection by Prototype Transformer
por: Hu, Shengkai, et al.
Publicado: (2025)
por: Hu, Shengkai, et al.
Publicado: (2025)
SkateFormer: Skeletal-Temporal Transformer for Human Action Recognition
por: Do, Jeonghyeok, et al.
Publicado: (2024)
por: Do, Jeonghyeok, et al.
Publicado: (2024)
Uncertainty-aware Bridge based Mobile-Former Network for Event-based Pattern Recognition
por: Yang, Haoxiang, et al.
Publicado: (2024)
por: Yang, Haoxiang, et al.
Publicado: (2024)
GeoFormer: Learning Point Cloud Completion with Tri-Plane Integrated Transformer
por: Yu, Jinpeng, et al.
Publicado: (2024)
por: Yu, Jinpeng, et al.
Publicado: (2024)
PlaceFormer: Transformer-based Visual Place Recognition using Multi-Scale Patch Selection and Fusion
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
Adapt PointFormer: 3D Point Cloud Analysis via Adapting 2D Visual Transformers
por: Li, Mengke, et al.
Publicado: (2024)
por: Li, Mengke, et al.
Publicado: (2024)
FuseFormer: A Transformer for Visual and Thermal Image Fusion
por: Erdogan, Aytekin, et al.
Publicado: (2024)
por: Erdogan, Aytekin, et al.
Publicado: (2024)
WaveFormer: A Lightweight Transformer Model for sEMG-based Gesture Recognition
por: Chen, Yanlong, et al.
Publicado: (2025)
por: Chen, Yanlong, et al.
Publicado: (2025)
FreqMixFormerV2: Lightweight Frequency-aware Mixed Transformer for Human Skeleton Action Recognition
por: Wu, Wenhan, et al.
Publicado: (2024)
por: Wu, Wenhan, et al.
Publicado: (2024)
No Time to Waste: Squeeze Time into Channel for Mobile Video Understanding
por: Zhai, Yingjie, et al.
Publicado: (2024)
por: Zhai, Yingjie, et al.
Publicado: (2024)
GridFormer: Point-Grid Transformer for Surface Reconstruction
por: Li, Shengtao, et al.
Publicado: (2024)
por: Li, Shengtao, et al.
Publicado: (2024)
M2Former: Multi-Scale Patch Selection for Fine-Grained Visual Recognition
por: Moon, Jiyong, et al.
Publicado: (2023)
por: Moon, Jiyong, et al.
Publicado: (2023)
SqueezeMe: Mobile-Ready Distillation of Gaussian Full-Body Avatars
por: Iandola, Forrest, et al.
Publicado: (2024)
por: Iandola, Forrest, et al.
Publicado: (2024)
ScatterFormer: Efficient Voxel Transformer with Scattered Linear Attention
por: He, Chenhang, et al.
Publicado: (2024)
por: He, Chenhang, et al.
Publicado: (2024)
EDTformer: An Efficient Decoder Transformer for Visual Place Recognition
por: Jin, Tong, et al.
Publicado: (2024)
por: Jin, Tong, et al.
Publicado: (2024)
WidthFormer: Toward Efficient Transformer-based BEV View Transformation
por: Yang, Chenhongyi, et al.
Publicado: (2024)
por: Yang, Chenhongyi, et al.
Publicado: (2024)
Query Nearby: Offset-Adjusted Mask2Former enhances small-organ segmentation
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
TGBFormer: Transformer-GraphFormer Blender Network for Video Object Detection
por: Qi, Qiang, et al.
Publicado: (2025)
por: Qi, Qiang, et al.
Publicado: (2025)
STEAM: Squeeze and Transform Enhanced Attention Module
por: Sabharwal, Rishabh, et al.
Publicado: (2024)
por: Sabharwal, Rishabh, et al.
Publicado: (2024)
Improving Visual Prompt Tuning by Gaussian Neighborhood Minimization for Long-Tailed Visual Recognition
por: Li, Mengke, et al.
Publicado: (2024)
por: Li, Mengke, et al.
Publicado: (2024)
Hybrid-supervised Hypergraph-enhanced Transformer for Micro-gesture Based Emotion Recognition
por: Xia, Zhaoqiang, et al.
Publicado: (2025)
por: Xia, Zhaoqiang, et al.
Publicado: (2025)
CascadeFormer: A Family of Two-stage Cascading Transformers for Skeleton-based Human Action Recognition
por: Peng, Yusen, et al.
Publicado: (2025)
por: Peng, Yusen, et al.
Publicado: (2025)
CARE Transformer: Mobile-Friendly Linear Visual Transformer via Decoupled Dual Interaction
por: Zhou, Yuan, et al.
Publicado: (2024)
por: Zhou, Yuan, et al.
Publicado: (2024)
FootFormer: Estimating Stability from Visual Input
por: Kraiger, Keaton, et al.
Publicado: (2025)
por: Kraiger, Keaton, et al.
Publicado: (2025)
Multimodal Industrial Anomaly Detection via Geometric Prior
por: Li, Min, et al.
Publicado: (2026)
por: Li, Min, et al.
Publicado: (2026)
SpiLiFormer: Enhancing Spiking Transformers with Lateral Inhibition
por: Zheng, Zeqi, et al.
Publicado: (2025)
por: Zheng, Zeqi, et al.
Publicado: (2025)
LoFormer: Local Frequency Transformer for Image Deblurring
por: Mao, Xintian, et al.
Publicado: (2024)
por: Mao, Xintian, et al.
Publicado: (2024)
CountFormer: Multi-View Crowd Counting Transformer
por: Mo, Hong, et al.
Publicado: (2024)
por: Mo, Hong, et al.
Publicado: (2024)
A Survey on Interpretability in Visual Recognition
por: Wan, Qiyang, et al.
Publicado: (2025)
por: Wan, Qiyang, et al.
Publicado: (2025)
VidFormer: A novel end-to-end framework fused by 3DCNN and Transformer for Video-based Remote Physiological Measurement
por: Li, Jiachen, et al.
Publicado: (2025)
por: Li, Jiachen, et al.
Publicado: (2025)
GridFormer: Residual Dense Transformer with Grid Structure for Image Restoration in Adverse Weather Conditions
por: Wang, Tao, et al.
Publicado: (2023)
por: Wang, Tao, et al.
Publicado: (2023)
Flexible and Efficient Spatio-Temporal Transformer for Sequential Visual Place Recognition
por: Kiu, Yu, et al.
Publicado: (2025)
por: Kiu, Yu, et al.
Publicado: (2025)
Distributed Zero-Shot Learning for Visual Recognition
por: Chen, Zhi, et al.
Publicado: (2025)
por: Chen, Zhi, et al.
Publicado: (2025)
iFormer: Integrating ConvNet and Transformer for Mobile Application
por: Zheng, Chuanyang
Publicado: (2025)
por: Zheng, Chuanyang
Publicado: (2025)
Boosting the Generalization Ability for Hyperspectral Image Classification using Spectral-spatial Axial Aggregation Transformer
por: Zhao, Enzhe, et al.
Publicado: (2023)
por: Zhao, Enzhe, et al.
Publicado: (2023)
Lightweight Model Pre-training via Language Guided Knowledge Distillation
por: Li, Mingsheng, et al.
Publicado: (2024)
por: Li, Mingsheng, et al.
Publicado: (2024)
SLAM-Former: Putting SLAM into One Transformer
por: Yuan, Yijun, et al.
Publicado: (2025)
por: Yuan, Yijun, et al.
Publicado: (2025)
HResFormer: Hybrid Residual Transformer for Volumetric Medical Image Segmentation
por: Ren, Sucheng, et al.
Publicado: (2024)
por: Ren, Sucheng, et al.
Publicado: (2024)
Ejemplares similares
-
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
por: Li, Kunchang, et al.
Publicado: (2022) -
BRepFormer: Transformer-Based B-rep Geometric Feature Recognition
por: Dai, Yongkang, et al.
Publicado: (2025) -
Proto-Former: Unified Facial Landmark Detection by Prototype Transformer
por: Hu, Shengkai, et al.
Publicado: (2025) -
SkateFormer: Skeletal-Temporal Transformer for Human Action Recognition
por: Do, Jeonghyeok, et al.
Publicado: (2024) -
Uncertainty-aware Bridge based Mobile-Former Network for Event-based Pattern Recognition
por: Yang, Haoxiang, et al.
Publicado: (2024)