SparX: A Sparse Cross-Layer Connection Mechanism for Hierarchical Vision Mamba and Transformer Networks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lou, Meng, Fu, Yunxiang, Yu, Yizhou |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A2Mamba: Attention-augmented State Space Models for Visual Recognition
von: Lou, Meng, et al.
Veröffentlicht: (2025)
von: Lou, Meng, et al.
Veröffentlicht: (2025)
SegMAN: Omni-scale Context Modeling with State Space Models and Local Attention for Semantic Segmentation
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts
von: Lou, Meng, et al.
Veröffentlicht: (2026)
von: Lou, Meng, et al.
Veröffentlicht: (2026)
Parameters as Experts: Adapting Vision Models with Dynamic Parameter Routing
von: Lou, Meng, et al.
Veröffentlicht: (2026)
von: Lou, Meng, et al.
Veröffentlicht: (2026)
OverLoCK: An Overview-first-Look-Closely-next ConvNet with Context-Mixing Dynamic Kernels
von: Lou, Meng, et al.
Veröffentlicht: (2025)
von: Lou, Meng, et al.
Veröffentlicht: (2025)
DreamDA: Generative Data Augmentation with Diffusion Models
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
Vision Function Layer in Multimodal LLMs
von: Shi, Cheng, et al.
Veröffentlicht: (2025)
von: Shi, Cheng, et al.
Veröffentlicht: (2025)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
von: Hatamizadeh, Ali, et al.
Veröffentlicht: (2024)
von: Hatamizadeh, Ali, et al.
Veröffentlicht: (2024)
Vision Transformers Need More Than Registers
von: Shi, Cheng, et al.
Veröffentlicht: (2026)
von: Shi, Cheng, et al.
Veröffentlicht: (2026)
SignSparK: Efficient Multilingual Sign Language Production via Sparse Keyframe Learning
von: Low, Jianhe, et al.
Veröffentlicht: (2026)
von: Low, Jianhe, et al.
Veröffentlicht: (2026)
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
von: Shen, Hui, et al.
Veröffentlicht: (2024)
von: Shen, Hui, et al.
Veröffentlicht: (2024)
A Lightweight and Effective Image Tampering Localization Network with Vision Mamba
von: Guo, Kun, et al.
Veröffentlicht: (2025)
von: Guo, Kun, et al.
Veröffentlicht: (2025)
Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM
von: Huang, Yizhou, et al.
Veröffentlicht: (2025)
von: Huang, Yizhou, et al.
Veröffentlicht: (2025)
Vision Transformers with Hierarchical Attention
von: Liu, Yun, et al.
Veröffentlicht: (2021)
von: Liu, Yun, et al.
Veröffentlicht: (2021)
Unleashing the Potential of Mamba: Boosting a LiDAR 3D Sparse Detector by Using Cross-Model Knowledge Distillation
von: Yu, Rui, et al.
Veröffentlicht: (2024)
von: Yu, Rui, et al.
Veröffentlicht: (2024)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
von: Chen, Wenchao, et al.
Veröffentlicht: (2024)
von: Chen, Wenchao, et al.
Veröffentlicht: (2024)
Stochastic Layer-Wise Shuffle for Improving Vision Mamba Training
von: Huang, Zizheng, et al.
Veröffentlicht: (2024)
von: Huang, Zizheng, et al.
Veröffentlicht: (2024)
SMamba: Sparse Mamba for Event-based Object Detection
von: Yang, Nan, et al.
Veröffentlicht: (2025)
von: Yang, Nan, et al.
Veröffentlicht: (2025)
Cross-Dimensional Medical Self-Supervised Representation Learning Based on a Pseudo-3D Transformation
von: Gao, Fei, et al.
Veröffentlicht: (2024)
von: Gao, Fei, et al.
Veröffentlicht: (2024)
MedFormer: Hierarchical Medical Vision Transformer with Content-Aware Dual Sparse Selection Attention
von: Xia, Zunhui, et al.
Veröffentlicht: (2025)
von: Xia, Zunhui, et al.
Veröffentlicht: (2025)
Rotation Equivariant Mamba for Vision Tasks
von: Zhao, Zhongchen, et al.
Veröffentlicht: (2026)
von: Zhao, Zhongchen, et al.
Veröffentlicht: (2026)
Vivim: a Video Vision Mamba for Medical Video Segmentation
von: Yang, Yijun, et al.
Veröffentlicht: (2024)
von: Yang, Yijun, et al.
Veröffentlicht: (2024)
LUMOS: Universal Semi-Supervised OCT Retinal Layer Segmentation with Hierarchical Reliable Mutual Learning
von: Fang, Yizhou, et al.
Veröffentlicht: (2026)
von: Fang, Yizhou, et al.
Veröffentlicht: (2026)
Vision Transformer with Sparse Scan Prior
von: Zhang, Yuguang, et al.
Veröffentlicht: (2024)
von: Zhang, Yuguang, et al.
Veröffentlicht: (2024)
Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning
von: Lou, Meng, et al.
Veröffentlicht: (2026)
von: Lou, Meng, et al.
Veröffentlicht: (2026)
TransMamba: Fast Universal Architecture Adaption from Transformers to Mamba
von: Chen, Xiuwei, et al.
Veröffentlicht: (2025)
von: Chen, Xiuwei, et al.
Veröffentlicht: (2025)
Hi-Mamba: Hierarchical Mamba for Efficient Image Super-Resolution
von: Qiao, Junbo, et al.
Veröffentlicht: (2024)
von: Qiao, Junbo, et al.
Veröffentlicht: (2024)
Hierarchical Side-Tuning for Vision Transformers
von: Lin, Weifeng, et al.
Veröffentlicht: (2023)
von: Lin, Weifeng, et al.
Veröffentlicht: (2023)
A Hybrid Transformer-Mamba Network for Single Image Deraining
von: Sun, Shangquan, et al.
Veröffentlicht: (2024)
von: Sun, Shangquan, et al.
Veröffentlicht: (2024)
MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling
von: Li, Yingyue, et al.
Veröffentlicht: (2025)
von: Li, Yingyue, et al.
Veröffentlicht: (2025)
DeflareMamba: Hierarchical Vision Mamba for Contextually Consistent Lens Flare Removal
von: Huang, Yihang, et al.
Veröffentlicht: (2025)
von: Huang, Yihang, et al.
Veröffentlicht: (2025)
Vanilla Group Equivariant Vision Transformer: Simple and Effective
von: Fu, Jiahong, et al.
Veröffentlicht: (2026)
von: Fu, Jiahong, et al.
Veröffentlicht: (2026)
MambaPlace:Text-to-Point-Cloud Cross-Modal Place Recognition with Attention Mamba Mechanisms
von: Shang, Tianyi, et al.
Veröffentlicht: (2024)
von: Shang, Tianyi, et al.
Veröffentlicht: (2024)
HySparK: Hybrid Sparse Masking for Large Scale Medical Image Pre-Training
von: Tang, Fenghe, et al.
Veröffentlicht: (2024)
von: Tang, Fenghe, et al.
Veröffentlicht: (2024)
Mamba-in-Mamba: Centralized Mamba-Cross-Scan in Tokenized Mamba Model for Hyperspectral Image Classification
von: Zhou, Weilian, et al.
Veröffentlicht: (2024)
von: Zhou, Weilian, et al.
Veröffentlicht: (2024)
Mamba-R: Vision Mamba ALSO Needs Registers
von: Wang, Feng, et al.
Veröffentlicht: (2024)
von: Wang, Feng, et al.
Veröffentlicht: (2024)
GlobalMamba: Global Image Serialization for Vision Mamba
von: Wang, Chengkun, et al.
Veröffentlicht: (2024)
von: Wang, Chengkun, et al.
Veröffentlicht: (2024)
TransXNet: Learning Both Global and Local Dynamics with a Dual Dynamic Token Mixer for Visual Recognition
von: Lou, Meng, et al.
Veröffentlicht: (2023)
von: Lou, Meng, et al.
Veröffentlicht: (2023)
Inside-Out: Measuring Generalization in Vision Transformers Through Inner Workings
von: Peng, Yunxiang, et al.
Veröffentlicht: (2026)
von: Peng, Yunxiang, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
A2Mamba: Attention-augmented State Space Models for Visual Recognition
von: Lou, Meng, et al.
Veröffentlicht: (2025) -
SegMAN: Omni-scale Context Modeling with State Space Models and Local Attention for Semantic Segmentation
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024) -
LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024) -
Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts
von: Lou, Meng, et al.
Veröffentlicht: (2026) -
Parameters as Experts: Adapting Vision Models with Dynamic Parameter Routing
von: Lou, Meng, et al.
Veröffentlicht: (2026)