CountMamba: Exploring Multi-directional Selective State-Space Models for Plant Counting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Hulingxiao, Zhang, Yaqi, Xu, Jinglin, Peng, Yuxin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models
par: He, Hulingxiao, et autres
Publié: (2025)
par: He, Hulingxiao, et autres
Publié: (2025)
Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping
par: Du, Tianxiang, et autres
Publié: (2026)
par: Du, Tianxiang, et autres
Publié: (2026)
AesFormer: Transform Everyday Photos into Beautiful Memories
par: Du, Tianxiang, et autres
Publié: (2026)
par: Du, Tianxiang, et autres
Publié: (2026)
Fine-R1: Make Multi-modal LLMs Excel in Fine-Grained Visual Recognition by Chain-of-Thought Reasoning
par: He, Hulingxiao, et autres
Publié: (2026)
par: He, Hulingxiao, et autres
Publié: (2026)
Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models
par: He, Hulingxiao, et autres
Publié: (2026)
par: He, Hulingxiao, et autres
Publié: (2026)
Mamba-MOC: A Multicategory Remote Object Counting via State Space Model
par: Liu, Peng, et autres
Publié: (2025)
par: Liu, Peng, et autres
Publié: (2025)
Plant Taxonomy Meets Plant Counting: A Fine-Grained, Taxonomic Dataset for Counting Hundreds of Plant Species
par: Xu, Jinyu, et autres
Publié: (2026)
par: Xu, Jinyu, et autres
Publié: (2026)
MambaAD: Exploring State Space Models for Multi-class Unsupervised Anomaly Detection
par: He, Haoyang, et autres
Publié: (2024)
par: He, Haoyang, et autres
Publié: (2024)
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
par: Xu, Jinglin, et autres
Publié: (2024)
par: Xu, Jinglin, et autres
Publié: (2024)
VMambaCC: A Visual State Space Model for Crowd Counting
par: Ma, Hao-Yuan, et autres
Publié: (2024)
par: Ma, Hao-Yuan, et autres
Publié: (2024)
Mamba-CL: Optimizing Selective State Space Model in Null Space for Continual Learning
par: Cheng, De, et autres
Publié: (2024)
par: Cheng, De, et autres
Publié: (2024)
Mamba-ND: Selective State Space Modeling for Multi-Dimensional Data
par: Li, Shufan, et autres
Publié: (2024)
par: Li, Shufan, et autres
Publié: (2024)
CountFormer: Multi-View Crowd Counting Transformer
par: Mo, Hong, et autres
Publié: (2024)
par: Mo, Hong, et autres
Publié: (2024)
CountZES: Counting via Zero-Shot Exemplar Selection
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
par: Siddiqui, Muhammad Ibraheem, et autres
Publié: (2025)
FocalCount: Towards Class-Count Imbalance in Class-Agnostic Counting
par: Zhu, Huilin, et autres
Publié: (2025)
par: Zhu, Huilin, et autres
Publié: (2025)
Decoupling What to Count and Where to See for Referring Expression Counting
par: Zou, Yuda, et autres
Publié: (2025)
par: Zou, Yuda, et autres
Publié: (2025)
VL-Mamba: Exploring State Space Models for Multimodal Learning
par: Qiao, Yanyuan, et autres
Publié: (2024)
par: Qiao, Yanyuan, et autres
Publié: (2024)
CountGD: Multi-Modal Open-World Counting
par: Amini-Naieni, Niki, et autres
Publié: (2024)
par: Amini-Naieni, Niki, et autres
Publié: (2024)
VideoMamba: Spatio-Temporal Selective State Space Model
par: Park, Jinyoung, et autres
Publié: (2024)
par: Park, Jinyoung, et autres
Publié: (2024)
Shuffle Mamba: State Space Models with Random Shuffle for Multi-Modal Image Fusion
par: Cao, Ke, et autres
Publié: (2024)
par: Cao, Ke, et autres
Publié: (2024)
Exploring Contextual Attribute Density in Referring Expression Counting
par: Wang, Zhicheng, et autres
Publié: (2025)
par: Wang, Zhicheng, et autres
Publié: (2025)
YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
par: Zeng, Guanning, et autres
Publié: (2025)
par: Zeng, Guanning, et autres
Publié: (2025)
QuadMamba: Learning Quadtree-based Selective Scan for Visual State Space Model
par: Xie, Fei, et autres
Publié: (2024)
par: Xie, Fei, et autres
Publié: (2024)
MambaTalk: Efficient Holistic Gesture Synthesis with Selective State Space Models
par: Xu, Zunnan, et autres
Publié: (2024)
par: Xu, Zunnan, et autres
Publié: (2024)
Pan-Mamba: Effective pan-sharpening with State Space Model
par: He, Xuanhua, et autres
Publié: (2024)
par: He, Xuanhua, et autres
Publié: (2024)
DyFo: A Training-Free Dynamic Focus Visual Search for Enhancing LMMs in Fine-Grained Visual Understanding
par: Li, Geng, et autres
Publié: (2025)
par: Li, Geng, et autres
Publié: (2025)
ZeroMamba: Exploring Visual State Space Model for Zero-Shot Learning
par: Hou, Wenjin, et autres
Publié: (2024)
par: Hou, Wenjin, et autres
Publié: (2024)
CountSteer: Steering Attention for Object Counting in Diffusion Models
par: Boo, Hyemin, et autres
Publié: (2025)
par: Boo, Hyemin, et autres
Publié: (2025)
LocalMamba: Visual State Space Model with Windowed Selective Scan
par: Huang, Tao, et autres
Publié: (2024)
par: Huang, Tao, et autres
Publié: (2024)
CU-Mamba: Selective State Space Models with Channel Learning for Image Restoration
par: Deng, Rui, et autres
Publié: (2024)
par: Deng, Rui, et autres
Publié: (2024)
Point, Segment and Count: A Generalized Framework for Object Counting
par: Huang, Zhizhong, et autres
Publié: (2023)
par: Huang, Zhizhong, et autres
Publié: (2023)
Serp-Mamba: Advancing High-Resolution Retinal Vessel Segmentation with Selective State-Space Model
par: Wang, Hongqiu, et autres
Publié: (2024)
par: Wang, Hongqiu, et autres
Publié: (2024)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
Counting Hallucinations in Diffusion Models
par: Fu, Shuai, et autres
Publié: (2025)
par: Fu, Shuai, et autres
Publié: (2025)
CausalFSFG: Rethinking Few-Shot Fine-Grained Visual Categorization from Causal Perspective
par: Yang, Zhiwen, et autres
Publié: (2025)
par: Yang, Zhiwen, et autres
Publié: (2025)
VideoMamba: State Space Model for Efficient Video Understanding
par: Li, Kunchang, et autres
Publié: (2024)
par: Li, Kunchang, et autres
Publié: (2024)
Minkowski-MambaNet: A Point Cloud Framework with Selective State Space Models for Forest Biomass Quantification
par: Tu, Jinxiang, et autres
Publié: (2025)
par: Tu, Jinxiang, et autres
Publié: (2025)
ShadowMamba: State-Space Model with Boundary-Region Selective Scan for Shadow Removal
par: Zhu, Xiujin, et autres
Publié: (2024)
par: Zhu, Xiujin, et autres
Publié: (2024)
PhysMamba: State Space Duality Model for Remote Physiological Measurement
par: Yan, Zhixin, et autres
Publié: (2024)
par: Yan, Zhixin, et autres
Publié: (2024)
Active View Selection for Scene-level Multi-view Crowd Counting and Localization with Limited Labels
par: Zhang, Qi, et autres
Publié: (2025)
par: Zhang, Qi, et autres
Publié: (2025)
Documents similaires
-
Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models
par: He, Hulingxiao, et autres
Publié: (2025) -
Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping
par: Du, Tianxiang, et autres
Publié: (2026) -
AesFormer: Transform Everyday Photos into Beautiful Memories
par: Du, Tianxiang, et autres
Publié: (2026) -
Fine-R1: Make Multi-modal LLMs Excel in Fine-Grained Visual Recognition by Chain-of-Thought Reasoning
par: He, Hulingxiao, et autres
Publié: (2026) -
Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models
par: He, Hulingxiao, et autres
Publié: (2026)