VMambaCC: A Visual State Space Model for Crowd Counting
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Hao-Yuan, Zhang, Li, Shi, Shuai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VMamba: Visual State Space Model
di: Liu, Yue, et al.
Pubblicazione: (2024)
di: Liu, Yue, et al.
Pubblicazione: (2024)
Multi-Scale VMamba: Hierarchy in Hierarchy Visual State Space Model
di: Shi, Yuheng, et al.
Pubblicazione: (2024)
di: Shi, Yuheng, et al.
Pubblicazione: (2024)
ProgRoCC: A Progressive Approach to Rough Crowd Counting
di: Jiang, Shengqin, et al.
Pubblicazione: (2025)
di: Jiang, Shengqin, et al.
Pubblicazione: (2025)
FGENet: Fine-Grained Extraction Network for Congested Crowd Counting
di: Ma, Hao-Yuan, et al.
Pubblicazione: (2024)
di: Ma, Hao-Yuan, et al.
Pubblicazione: (2024)
VMambaMorph: a Multi-Modality Deformable Image Registration Framework based on Visual State Space Model with Cross-Scan Module
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
Res-VMamba: Fine-Grained Food Category Visual Classification Using Selective State Space Models with Deep Residual Learning
di: Chen, Chi-Sheng, et al.
Pubblicazione: (2024)
di: Chen, Chi-Sheng, et al.
Pubblicazione: (2024)
RACANet: Reliability-Aware Crowd Anchor Network for RGB-T Crowd Counting
di: Shi, Jinghao, et al.
Pubblicazione: (2026)
di: Shi, Jinghao, et al.
Pubblicazione: (2026)
Multi-View Crowd Counting With Self-Supervised Learning
di: Mo, Hong, et al.
Pubblicazione: (2025)
di: Mo, Hong, et al.
Pubblicazione: (2025)
Embodied Crowd Counting
di: Long, Runling, et al.
Pubblicazione: (2025)
di: Long, Runling, et al.
Pubblicazione: (2025)
Regressor-Segmenter Mutual Prompt Learning for Crowd Counting
di: Guo, Mingyue, et al.
Pubblicazione: (2023)
di: Guo, Mingyue, et al.
Pubblicazione: (2023)
ZIP: Scalable Crowd Counting via Zero-Inflated Poisson Modeling
di: Ma, Yiming, et al.
Pubblicazione: (2025)
di: Ma, Yiming, et al.
Pubblicazione: (2025)
CountFormer: Multi-View Crowd Counting Transformer
di: Mo, Hong, et al.
Pubblicazione: (2024)
di: Mo, Hong, et al.
Pubblicazione: (2024)
EfficientVMamba: Atrous Selective Scan for Light Weight Visual Mamba
di: Pei, Xiaohuan, et al.
Pubblicazione: (2024)
di: Pei, Xiaohuan, et al.
Pubblicazione: (2024)
The Effectiveness of a Simplified Model Structure for Crowd Counting
di: Chen, Lei, et al.
Pubblicazione: (2024)
di: Chen, Lei, et al.
Pubblicazione: (2024)
Density Estimation and Crowd Counting
di: Sunil, Balachandra Devarangadi, et al.
Pubblicazione: (2025)
di: Sunil, Balachandra Devarangadi, et al.
Pubblicazione: (2025)
Scalable Visual State Space Model with Fractal Scanning
di: Tang, Lv, et al.
Pubblicazione: (2024)
di: Tang, Lv, et al.
Pubblicazione: (2024)
Crowded Video Individual Counting Informed by Social Grouping and Spatial-Temporal Displacement Priors
di: Lu, Hao, et al.
Pubblicazione: (2026)
di: Lu, Hao, et al.
Pubblicazione: (2026)
Semi-Supervised Crowd Counting with Contextual Modeling: Facilitating Holistic Understanding of Crowd Scenes
di: Qian, Yifei, et al.
Pubblicazione: (2023)
di: Qian, Yifei, et al.
Pubblicazione: (2023)
Multi-modal Crowd Counting via Modal Emulation
di: Wang, Chenhao, et al.
Pubblicazione: (2024)
di: Wang, Chenhao, et al.
Pubblicazione: (2024)
Single Domain Generalization for Crowd Counting
di: Peng, Zhuoxuan, et al.
Pubblicazione: (2024)
di: Peng, Zhuoxuan, et al.
Pubblicazione: (2024)
Rethinking Global Context in Crowd Counting
di: Sun, Guolei, et al.
Pubblicazione: (2021)
di: Sun, Guolei, et al.
Pubblicazione: (2021)
Learning Discriminative Features for Crowd Counting
di: Chen, Yuehai, et al.
Pubblicazione: (2023)
di: Chen, Yuehai, et al.
Pubblicazione: (2023)
Gramformer: Learning Crowd Counting via Graph-Modulated Transformer
di: Lin, Hui, et al.
Pubblicazione: (2024)
di: Lin, Hui, et al.
Pubblicazione: (2024)
One-Shot Crowd Counting With Density Guidance For Scene Adaptation
di: Chen, Jiwei, et al.
Pubblicazione: (2026)
di: Chen, Jiwei, et al.
Pubblicazione: (2026)
CountMamba: Exploring Multi-directional Selective State-Space Models for Plant Counting
di: He, Hulingxiao, et al.
Pubblicazione: (2024)
di: He, Hulingxiao, et al.
Pubblicazione: (2024)
A Transformer-based Multimodal Fusion Model for Efficient Crowd Counting Using Visual and Wireless Signals
di: Cui, Zhe, et al.
Pubblicazione: (2025)
di: Cui, Zhe, et al.
Pubblicazione: (2025)
WSCF-MVCC: Weakly-supervised Calibration-free Multi-view Crowd Counting
di: Li, Bin, et al.
Pubblicazione: (2025)
di: Li, Bin, et al.
Pubblicazione: (2025)
Local Information Matters: A Rethink of Crowd Counting
di: Pan, Tianhang, et al.
Pubblicazione: (2025)
di: Pan, Tianhang, et al.
Pubblicazione: (2025)
Efficient High-Resolution Visual Representation Learning with State Space Model for Human Pose Estimation
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
X-VMamba: Explainable Vision Mamba
di: Mabrok, Mohamed A., et al.
Pubblicazione: (2025)
di: Mabrok, Mohamed A., et al.
Pubblicazione: (2025)
Taste More, Taste Better: Diverse Data and Strong Model Boost Semi-Supervised Crowd Counting
di: Yang, Maochen, et al.
Pubblicazione: (2025)
di: Yang, Maochen, et al.
Pubblicazione: (2025)
VmambaIR: Visual State Space Model for Image Restoration
di: Shi, Yuan, et al.
Pubblicazione: (2024)
di: Shi, Yuan, et al.
Pubblicazione: (2024)
Foggy Crowd Counting: Combining Physical Priors and KAN-Graph
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
L2HCount:Generalizing Crowd Counting from Low to High Crowd Density via Density Simulation
di: Xu, Guoliang, et al.
Pubblicazione: (2025)
di: Xu, Guoliang, et al.
Pubblicazione: (2025)
Curriculum for Crowd Counting -- Is it Worthy?
di: Khan, Muhammad Asif, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Asif, et al.
Pubblicazione: (2024)
Semi-Supervised Multi-View Crowd Counting by Ranking Multi-View Fusion Models
di: Zhang, Qi, et al.
Pubblicazione: (2025)
di: Zhang, Qi, et al.
Pubblicazione: (2025)
EHNet: An Efficient Hybrid Network for Crowd Counting and Localization
di: Yan, Yuqing, et al.
Pubblicazione: (2025)
di: Yan, Yuqing, et al.
Pubblicazione: (2025)
SynMVCrowd: A Large Synthetic Benchmark for Multi-view Crowd Counting and Localization
di: Zhang, Qi, et al.
Pubblicazione: (2026)
di: Zhang, Qi, et al.
Pubblicazione: (2026)
A Lightweight Feature Fusion Architecture For Resource-Constrained Crowd Counting
di: Chaudhuri, Yashwardhan, et al.
Pubblicazione: (2024)
di: Chaudhuri, Yashwardhan, et al.
Pubblicazione: (2024)
Active View Selection for Scene-level Multi-view Crowd Counting and Localization with Limited Labels
di: Zhang, Qi, et al.
Pubblicazione: (2025)
di: Zhang, Qi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
VMamba: Visual State Space Model
di: Liu, Yue, et al.
Pubblicazione: (2024) -
Multi-Scale VMamba: Hierarchy in Hierarchy Visual State Space Model
di: Shi, Yuheng, et al.
Pubblicazione: (2024) -
ProgRoCC: A Progressive Approach to Rough Crowd Counting
di: Jiang, Shengqin, et al.
Pubblicazione: (2025) -
FGENet: Fine-Grained Extraction Network for Congested Crowd Counting
di: Ma, Hao-Yuan, et al.
Pubblicazione: (2024) -
VMambaMorph: a Multi-Modality Deformable Image Registration Framework based on Visual State Space Model with Cross-Scan Module
di: Wang, Ziyang, et al.
Pubblicazione: (2024)