MambaOut: Do We Really Need Mamba for Vision?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Weihao, Wang, Xinchao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do We Really Need Quantum Machine Learning?: A Multidimensional Empirical Study
par: Vhaduri, Sudip, et autres
Publié: (2026)
par: Vhaduri, Sudip, et autres
Publié: (2026)
InceptionNeXt: When Inception Meets ConvNeXt
par: Yu, Weihao, et autres
Publié: (2023)
par: Yu, Weihao, et autres
Publié: (2023)
MetaFormer Baselines for Vision
par: Yu, Weihao, et autres
Publié: (2022)
par: Yu, Weihao, et autres
Publié: (2022)
Vision Mamba: A Comprehensive Survey and Taxonomy
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
Attention-Mamba: A Mamba-Enhanced Multi-Scale Parallel Inference Network for Medical Image Segmentation
par: Zhang, Yanhua, et autres
Publié: (2024)
par: Zhang, Yanhua, et autres
Publié: (2024)
Mamba in Vision: A Comprehensive Survey of Techniques and Applications
par: Rahman, Md Maklachur, et autres
Publié: (2024)
par: Rahman, Md Maklachur, et autres
Publié: (2024)
MambaPEFT: Exploring Parameter-Efficient Fine-Tuning for Mamba
par: Yoshimura, Masakazu, et autres
Publié: (2024)
par: Yoshimura, Masakazu, et autres
Publié: (2024)
Do We Really Need Curated Malicious Data for Safety Alignment in Multi-modal Large Language Models?
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
par: Yahathugoda, Yovin, et autres
Publié: (2025)
par: Yahathugoda, Yovin, et autres
Publié: (2025)
Attention Prompting on Image for Large Vision-Language Models
par: Yu, Runpeng, et autres
Publié: (2024)
par: Yu, Runpeng, et autres
Publié: (2024)
Do We Need Large VLMs for Spotting Soccer Actions?
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
par: Chakraborty, Ritabrata, et autres
Publié: (2025)
End-to-End Multi-Modal Diffusion Mamba
par: Lu, Chunhao, et autres
Publié: (2025)
par: Lu, Chunhao, et autres
Publié: (2025)
RadMamba: Efficient Human Activity Recognition through Radar-based Micro-Doppler-Oriented Mamba State-Space Model
par: Wu, Yizhuo, et autres
Publié: (2025)
par: Wu, Yizhuo, et autres
Publié: (2025)
Do We Really Need a Large Number of Visual Prompts?
par: Kim, Youngeun, et autres
Publié: (2023)
par: Kim, Youngeun, et autres
Publié: (2023)
Isomorphic Pruning for Vision Models
par: Fang, Gongfan, et autres
Publié: (2024)
par: Fang, Gongfan, et autres
Publié: (2024)
MambaScope: Coarse-to-Fine Scoping for Efficient Vision Mamba
par: Liu, Shanhui, et autres
Publié: (2025)
par: Liu, Shanhui, et autres
Publié: (2025)
Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation
par: Munir, Mustafa, et autres
Publié: (2025)
par: Munir, Mustafa, et autres
Publié: (2025)
M4V: Multi-Modal Mamba for Text-to-Video Generation
par: Huang, Jiancheng, et autres
Publié: (2025)
par: Huang, Jiancheng, et autres
Publié: (2025)
Dynamic Vision Mamba
par: Wu, Mengxuan, et autres
Publié: (2025)
par: Wu, Mengxuan, et autres
Publié: (2025)
Efficient 3D Shape Generation via Diffusion Mamba with Bidirectional SSMs
par: Mo, Shentong
Publié: (2024)
par: Mo, Shentong
Publié: (2024)
Dual Branch VideoMamba with Gated Class Token Fusion for Violence Detection
par: Senadeera, Damith Chamalke, et autres
Publié: (2025)
par: Senadeera, Damith Chamalke, et autres
Publié: (2025)
Neural Metamorphosis
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
par: Zhou, Andy, et autres
Publié: (2023)
par: Zhou, Andy, et autres
Publié: (2023)
MambaMixer: Efficient Selective State Space Models with Dual Token and Channel Selection
par: Behrouz, Ali, et autres
Publié: (2024)
par: Behrouz, Ali, et autres
Publié: (2024)
Mamba-FETrack V2: Revisiting State Space Model for Frame-Event based Visual Object Tracking
par: Wang, Shiao, et autres
Publié: (2025)
par: Wang, Shiao, et autres
Publié: (2025)
OuroMamba: A Data-Free Quantization Framework for Vision Mamba
par: Ramachandran, Akshat, et autres
Publié: (2025)
par: Ramachandran, Akshat, et autres
Publié: (2025)
SkelMamba: A State Space Model for Efficient Skeleton Action Recognition of Neurological Disorders
par: Martinel, Niki, et autres
Publié: (2024)
par: Martinel, Niki, et autres
Publié: (2024)
DF-Mamba: Deformable State Space Modeling for 3D Hand Pose Estimation in Interactions
par: Zhou, Yifan, et autres
Publié: (2025)
par: Zhou, Yifan, et autres
Publié: (2025)
Mamba-3D as Masked Autoencoders for Accurate and Data-Efficient Analysis of Medical Ultrasound Videos
par: Zhou, Jiaheng, et autres
Publié: (2025)
par: Zhou, Jiaheng, et autres
Publié: (2025)
Mixture-of-Mamba: Enhancing Multi-Modal State-Space Models with Modality-Aware Sparsity
par: Liang, Weixin, et autres
Publié: (2025)
par: Liang, Weixin, et autres
Publié: (2025)
Mamba3D: Enhancing Local Features for 3D Point Cloud Analysis via State Space Model
par: Han, Xu, et autres
Publié: (2024)
par: Han, Xu, et autres
Publié: (2024)
MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities
par: Yu, Weihao, et autres
Publié: (2023)
par: Yu, Weihao, et autres
Publié: (2023)
Surface Vision Mamba: Leveraging Bidirectional State Space Model for Efficient Spherical Manifold Representation
par: He, Rongzhao, et autres
Publié: (2025)
par: He, Rongzhao, et autres
Publié: (2025)
CFSPMNet: Cross-subject Fourier-guided Spatial-Patch Mamba Network for EEG Motor Imagery Decoding in Stroke Patients
par: Wang, Xiangkai, et autres
Publié: (2026)
par: Wang, Xiangkai, et autres
Publié: (2026)
Do We Really Need a Complex Agent System? Distill Embodied Agent into a Single Model
par: Zhao, Zhonghan, et autres
Publié: (2024)
par: Zhao, Zhonghan, et autres
Publié: (2024)
ZigMa: A DiT-style Zigzag Mamba Diffusion Model
par: Hu, Vincent Tao, et autres
Publié: (2024)
par: Hu, Vincent Tao, et autres
Publié: (2024)
NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors
par: Ren, Lingfeng, et autres
Publié: (2026)
par: Ren, Lingfeng, et autres
Publié: (2026)
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
par: Yu, Geng, et autres
Publié: (2024)
par: Yu, Geng, et autres
Publié: (2024)
A Survey on Mamba Architecture for Vision Applications
par: Ibrahim, Fady, et autres
Publié: (2025)
par: Ibrahim, Fady, et autres
Publié: (2025)
Documents similaires
-
Do We Really Need Quantum Machine Learning?: A Multidimensional Empirical Study
par: Vhaduri, Sudip, et autres
Publié: (2026) -
InceptionNeXt: When Inception Meets ConvNeXt
par: Yu, Weihao, et autres
Publié: (2023) -
MetaFormer Baselines for Vision
par: Yu, Weihao, et autres
Publié: (2022) -
Vision Mamba: A Comprehensive Survey and Taxonomy
par: Liu, Xiao, et autres
Publié: (2024) -
Attention-Mamba: A Mamba-Enhanced Multi-Scale Parallel Inference Network for Medical Image Segmentation
par: Zhang, Yanhua, et autres
Publié: (2024)