Fast Vision Mamba: Pooling Spatial Dimensions for Accelerated Processing
Fuente:
arXiv
Salvato in:
| Autori principali: | Kapse, Saarthak, Betz, Robin, Sivanandan, Srinivasan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Semantic Context-aware mOdality fUsion Transformer (SCOUT): A Context-Aware Multimodal Transformer for Concept-Grounded Pathology Report Generation
di: Singh, Suryakant, et al.
Pubblicazione: (2026)
di: Singh, Suryakant, et al.
Pubblicazione: (2026)
Channel Vision Transformers: An Image Is Worth 1 x 16 x 16 Words
di: Bao, Yujia, et al.
Pubblicazione: (2023)
di: Bao, Yujia, et al.
Pubblicazione: (2023)
Histo-Diffusion: A Diffusion Super-Resolution Method for Digital Pathology with Comprehensive Quality Assessment
di: Xu, Xuan, et al.
Pubblicazione: (2024)
di: Xu, Xuan, et al.
Pubblicazione: (2024)
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
di: Shen, Hui, et al.
Pubblicazione: (2024)
di: Shen, Hui, et al.
Pubblicazione: (2024)
Dynamic Vision Mamba
di: Wu, Mengxuan, et al.
Pubblicazione: (2025)
di: Wu, Mengxuan, et al.
Pubblicazione: (2025)
Accelerating Vision Transformers on Brain Processing Unit
di: Tang, Jinchi, et al.
Pubblicazione: (2026)
di: Tang, Jinchi, et al.
Pubblicazione: (2026)
MambaScope: Coarse-to-Fine Scoping for Efficient Vision Mamba
di: Liu, Shanhui, et al.
Pubblicazione: (2025)
di: Liu, Shanhui, et al.
Pubblicazione: (2025)
OuroMamba: A Data-Free Quantization Framework for Vision Mamba
di: Ramachandran, Akshat, et al.
Pubblicazione: (2025)
di: Ramachandran, Akshat, et al.
Pubblicazione: (2025)
Selective Visual Prompting in Vision Mamba
di: Yao, Yifeng, et al.
Pubblicazione: (2024)
di: Yao, Yifeng, et al.
Pubblicazione: (2024)
SRMA-Mamba: Spatial Reverse Mamba Attention Network for Pathological Liver Segmentation in MRI Volumes
di: Zeng, Jun, et al.
Pubblicazione: (2025)
di: Zeng, Jun, et al.
Pubblicazione: (2025)
A Survey on Mamba Architecture for Vision Applications
di: Ibrahim, Fady, et al.
Pubblicazione: (2025)
di: Ibrahim, Fady, et al.
Pubblicazione: (2025)
Separators in Enhancing Autoregressive Pretraining for Vision Mamba
di: Liu, Hanpeng, et al.
Pubblicazione: (2026)
di: Liu, Hanpeng, et al.
Pubblicazione: (2026)
Enhancing Satellite Object Localization with Dilated Convolutions and Attention-aided Spatial Pooling
di: Mostafa, Seraj Al Mahmud, et al.
Pubblicazione: (2025)
di: Mostafa, Seraj Al Mahmud, et al.
Pubblicazione: (2025)
SF-Mamba: Rethinking State Space Model for Vision
di: Yoshimura, Masakazu, et al.
Pubblicazione: (2026)
di: Yoshimura, Masakazu, et al.
Pubblicazione: (2026)
Beyond ZOH: Advanced Discretization Strategies for Vision Mamba
di: Ibrahim, Fady, et al.
Pubblicazione: (2026)
di: Ibrahim, Fady, et al.
Pubblicazione: (2026)
SPFFNet: Strip Perception and Feature Fusion Spatial Pyramid Pooling for Fabric Defect Detection
di: Zhao, Peizhe, et al.
Pubblicazione: (2025)
di: Zhao, Peizhe, et al.
Pubblicazione: (2025)
MambaU-Lite: A Lightweight Model based on Mamba and Integrated Channel-Spatial Attention for Skin Lesion Segmentation
di: Nguyen, Thi-Nhu-Quynh, et al.
Pubblicazione: (2024)
di: Nguyen, Thi-Nhu-Quynh, et al.
Pubblicazione: (2024)
Gather-Scatter Mamba: Accelerating Propagation with Efficient State Space Model
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2025)
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2025)
MSCrackMamba: Leveraging Vision Mamba for Crack Detection in Fused Multispectral Imagery
di: Zhu, Qinfeng, et al.
Pubblicazione: (2024)
di: Zhu, Qinfeng, et al.
Pubblicazione: (2024)
Conjugated Semantic Pool Improves OOD Detection with Pre-trained Vision-Language Models
di: Chen, Mengyuan, et al.
Pubblicazione: (2024)
di: Chen, Mengyuan, et al.
Pubblicazione: (2024)
EVM-Fusion: An Explainable Vision Mamba Architecture with Neural Algorithmic Fusion
di: Yang, Zichuan, et al.
Pubblicazione: (2025)
di: Yang, Zichuan, et al.
Pubblicazione: (2025)
MambaOut: Do We Really Need Mamba for Vision?
di: Yu, Weihao, et al.
Pubblicazione: (2024)
di: Yu, Weihao, et al.
Pubblicazione: (2024)
S$^2$Mamba: A Spatial-spectral State Space Model for Hyperspectral Image Classification
di: Wang, Guanchun, et al.
Pubblicazione: (2024)
di: Wang, Guanchun, et al.
Pubblicazione: (2024)
FSCM: Frequency-Enhanced Spatial-Spectral Coupled Mamba for Infrared Hyperspectral Image Colorization
di: Liu, Tingting, et al.
Pubblicazione: (2026)
di: Liu, Tingting, et al.
Pubblicazione: (2026)
GECKO: Gigapixel Vision-Concept Contrastive Pretraining in Histopathology
di: Kapse, Saarthak, et al.
Pubblicazione: (2025)
di: Kapse, Saarthak, et al.
Pubblicazione: (2025)
PEaRL: Pathway-Enhanced Representation Learning for Gene and Pathway Expression Prediction from Histology
di: Majumder, Sejuti, et al.
Pubblicazione: (2025)
di: Majumder, Sejuti, et al.
Pubblicazione: (2025)
LKM-UNet: Large Kernel Vision Mamba UNet for Medical Image Segmentation
di: Wang, Jinhong, et al.
Pubblicazione: (2024)
di: Wang, Jinhong, et al.
Pubblicazione: (2024)
MambaEye: A Size-Agnostic Visual Encoder with Causal Sequential Processing
di: Choi, Changho, et al.
Pubblicazione: (2025)
di: Choi, Changho, et al.
Pubblicazione: (2025)
TextMamba: Scene Text Detector with Mamba
di: Zhao, Qiyan, et al.
Pubblicazione: (2025)
di: Zhao, Qiyan, et al.
Pubblicazione: (2025)
DiMSUM: Diffusion Mamba -- A Scalable and Unified Spatial-Frequency Method for Image Generation
di: Phung, Hao, et al.
Pubblicazione: (2024)
di: Phung, Hao, et al.
Pubblicazione: (2024)
Enhancing Visual Token Representations for Video Large Language Models via Training-Free Spatial-Temporal Pooling and Gridding
di: Luo, Bingjun, et al.
Pubblicazione: (2026)
di: Luo, Bingjun, et al.
Pubblicazione: (2026)
MS-UMamba: An Improved Vision Mamba Unet for Fetal Abdominal Medical Image Segmentation
di: Xu, Caixu, et al.
Pubblicazione: (2025)
di: Xu, Caixu, et al.
Pubblicazione: (2025)
MAP: Unleashing Hybrid Mamba-Transformer Vision Backbone's Potential with Masked Autoregressive Pretraining
di: Liu, Yunze, et al.
Pubblicazione: (2024)
di: Liu, Yunze, et al.
Pubblicazione: (2024)
Fusion Flow-enhanced Graph Pooling Residual Networks for Unmanned Aerial Vehicles Surveillance in Day and Night Dual Visions
di: Noor, Alam, et al.
Pubblicazione: (2024)
di: Noor, Alam, et al.
Pubblicazione: (2024)
LIDAR: Lightweight Adaptive Cue-Aware Fusion Vision Mamba for Multimodal Segmentation of Structural Cracks
di: Liu, Hui, et al.
Pubblicazione: (2025)
di: Liu, Hui, et al.
Pubblicazione: (2025)
Surface Vision Mamba: Leveraging Bidirectional State Space Model for Efficient Spherical Manifold Representation
di: He, Rongzhao, et al.
Pubblicazione: (2025)
di: He, Rongzhao, et al.
Pubblicazione: (2025)
CellMamba: Adaptive Mamba for Accurate and Efficient Cell Detection
di: Liu, Ruochen, et al.
Pubblicazione: (2025)
di: Liu, Ruochen, et al.
Pubblicazione: (2025)
StereoMamba: Real-time and Robust Intraoperative Stereo Disparity Estimation via Long-range Spatial Dependencies
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
Exploring Non-Local Spatial-Angular Correlations with a Hybrid Mamba-Transformer Framework for Light Field Super-Resolution
di: Liu, Haosong, et al.
Pubblicazione: (2025)
di: Liu, Haosong, et al.
Pubblicazione: (2025)
AlignMamba: Enhancing Multimodal Mamba with Local and Global Cross-modal Alignment
di: Li, Yan, et al.
Pubblicazione: (2024)
di: Li, Yan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Semantic Context-aware mOdality fUsion Transformer (SCOUT): A Context-Aware Multimodal Transformer for Concept-Grounded Pathology Report Generation
di: Singh, Suryakant, et al.
Pubblicazione: (2026) -
Channel Vision Transformers: An Image Is Worth 1 x 16 x 16 Words
di: Bao, Yujia, et al.
Pubblicazione: (2023) -
Histo-Diffusion: A Diffusion Super-Resolution Method for Digital Pathology with Comprehensive Quality Assessment
di: Xu, Xuan, et al.
Pubblicazione: (2024) -
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
di: Shen, Hui, et al.
Pubblicazione: (2024) -
Dynamic Vision Mamba
di: Wu, Mengxuan, et al.
Pubblicazione: (2025)