MSCrackMamba: Leveraging Vision Mamba for Crack Detection in Fused Multispectral Imagery
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Qinfeng, Fang, Yuan, Fan, Lei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enhancing Environmental Monitoring through Multispectral Imaging: The WasteMS Dataset for Semantic Segmentation of Lakeside Waste
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
ClassWise-CRF: Category-Specific Fusion for Enhanced Semantic Segmentation of Remote Sensing Imagery
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2025)
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2025)
Evaluating the Impact of Point Cloud Colorization on Semantic Segmentation Accuracy
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
LEAF-Mamba: Local Emphatic and Adaptive Fusion State Space Model for RGB-D Salient Object Detection
von: Wu, Lanhu, et al.
Veröffentlicht: (2025)
von: Wu, Lanhu, et al.
Veröffentlicht: (2025)
Smart Transfer: Leveraging Vision Foundation Model for Rapid Building Damage Mapping with Post-Earthquake VHR Imagery
von: Li, Hao, et al.
Veröffentlicht: (2026)
von: Li, Hao, et al.
Veröffentlicht: (2026)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
von: Zhu, Haodong, et al.
Veröffentlicht: (2025)
von: Zhu, Haodong, et al.
Veröffentlicht: (2025)
Rethinking Scanning Strategies with Vision Mamba in Semantic Segmentation of Remote Sensing Imagery: An Experimental Study
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
IVAC-P2L: Leveraging Irregular Repetition Priors for Improving Video Action Counting
von: Wang, Hang, et al.
Veröffentlicht: (2024)
von: Wang, Hang, et al.
Veröffentlicht: (2024)
Advance Fake Video Detection via Vision Transformers
von: Battocchio, Joy, et al.
Veröffentlicht: (2025)
von: Battocchio, Joy, et al.
Veröffentlicht: (2025)
MambaPro: Multi-Modal Object Re-Identification with Mamba Aggregation and Synergistic Prompt
von: Wang, Yuhao, et al.
Veröffentlicht: (2024)
von: Wang, Yuhao, et al.
Veröffentlicht: (2024)
AI-Driven Virtual Teacher for Enhanced Educational Efficiency: Leveraging Large Pretrain Models for Autonomous Error Analysis and Correction
von: Xu, Tianlong, et al.
Veröffentlicht: (2024)
von: Xu, Tianlong, et al.
Veröffentlicht: (2024)
POINTS: Improving Your Vision-language Model with Affordable Strategies
von: Liu, Yuan, et al.
Veröffentlicht: (2024)
von: Liu, Yuan, et al.
Veröffentlicht: (2024)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
von: Li, Wenrui, et al.
Veröffentlicht: (2024)
von: Li, Wenrui, et al.
Veröffentlicht: (2024)
ContextDet: Temporal Action Detection with Adaptive Context Aggregation
von: Wang, Ning, et al.
Veröffentlicht: (2024)
von: Wang, Ning, et al.
Veröffentlicht: (2024)
Band-Attention Modulated RetNet for Face Forgery Detection
von: Zhang, Zhida, et al.
Veröffentlicht: (2024)
von: Zhang, Zhida, et al.
Veröffentlicht: (2024)
ScaleDreamer: Scalable Text-to-3D Synthesis with Asynchronous Score Distillation
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Ma, Zhiyuan, et al.
Veröffentlicht: (2024)
Relational Retrieval: Leveraging Known-Novel Interactions for Generalized Category Discovery
von: Xu, Yulin, et al.
Veröffentlicht: (2026)
von: Xu, Yulin, et al.
Veröffentlicht: (2026)
MRD: Multi-resolution Retrieval-Detection Fusion for High-Resolution Image Understanding
von: Yang, Fan, et al.
Veröffentlicht: (2025)
von: Yang, Fan, et al.
Veröffentlicht: (2025)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
von: Zhu, Yixin, et al.
Veröffentlicht: (2026)
von: Zhu, Yixin, et al.
Veröffentlicht: (2026)
AToken: A Unified Tokenizer for Vision
von: Lu, Jiasen, et al.
Veröffentlicht: (2025)
von: Lu, Jiasen, et al.
Veröffentlicht: (2025)
Vision-and-Language Navigation with Analogical Textual Descriptions in LLMs
von: Zhang, Yue, et al.
Veröffentlicht: (2025)
von: Zhang, Yue, et al.
Veröffentlicht: (2025)
SSTFB: Leveraging self-supervised pretext learning and temporal self-attention with feature branching for real-time video polyp segmentation
von: Xu, Ziang, et al.
Veröffentlicht: (2024)
von: Xu, Ziang, et al.
Veröffentlicht: (2024)
Text-Only Data Synthesis for Vision Language Model Training
von: Yu, Xiaomin, et al.
Veröffentlicht: (2025)
von: Yu, Xiaomin, et al.
Veröffentlicht: (2025)
Learning to Mask and Permute Visual Tokens for Vision Transformer Pre-Training
von: Baraldi, Lorenzo, et al.
Veröffentlicht: (2023)
von: Baraldi, Lorenzo, et al.
Veröffentlicht: (2023)
StyleAR: Customizing Multimodal Autoregressive Model for Style-Aligned Text-to-Image Generation
von: Wu, Yi, et al.
Veröffentlicht: (2025)
von: Wu, Yi, et al.
Veröffentlicht: (2025)
Dual Memory Networks: A Versatile Adaptation Approach for Vision-Language Models
von: Zhang, Yabin, et al.
Veröffentlicht: (2024)
von: Zhang, Yabin, et al.
Veröffentlicht: (2024)
InstructFLIP: Exploring Unified Vision-Language Model for Face Anti-spoofing
von: Lin, Kun-Hsiang, et al.
Veröffentlicht: (2025)
von: Lin, Kun-Hsiang, et al.
Veröffentlicht: (2025)
PanMatch: Unleashing the Potential of Large Vision Models for Unified Matching Models
von: Zhang, Yongjian, et al.
Veröffentlicht: (2025)
von: Zhang, Yongjian, et al.
Veröffentlicht: (2025)
HSVLT: Hierarchical Scale-Aware Vision-Language Transformer for Multi-Label Image Classification
von: Ouyang, Shuyi, et al.
Veröffentlicht: (2024)
von: Ouyang, Shuyi, et al.
Veröffentlicht: (2024)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
RacketVision: A Multiple Racket Sports Benchmark for Unified Ball and Racket Analysis
von: Dong, Linfeng, et al.
Veröffentlicht: (2025)
von: Dong, Linfeng, et al.
Veröffentlicht: (2025)
Distilling Vision-Language Foundation Models: A Data-Free Approach via Prompt Diversification
von: Xuan, Yunyi, et al.
Veröffentlicht: (2024)
von: Xuan, Yunyi, et al.
Veröffentlicht: (2024)
STATUS Bench: A Rigorous Benchmark for Evaluating Object State Understanding in Vision-Language Models
von: Ukai, Mahiro, et al.
Veröffentlicht: (2025)
von: Ukai, Mahiro, et al.
Veröffentlicht: (2025)
PaveBench: A Versatile Benchmark for Pavement Distress Perception and Interactive Vision-Language Analysis
von: Li, Dexiang, et al.
Veröffentlicht: (2026)
von: Li, Dexiang, et al.
Veröffentlicht: (2026)
EvRepSL: Event-Stream Representation via Self-Supervised Learning for Event-Based Vision
von: Qu, Qiang, et al.
Veröffentlicht: (2024)
von: Qu, Qiang, et al.
Veröffentlicht: (2024)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
von: Lin, Haokun, et al.
Veröffentlicht: (2024)
von: Lin, Haokun, et al.
Veröffentlicht: (2024)
LIDAR: Lightweight Adaptive Cue-Aware Fusion Vision Mamba for Multimodal Segmentation of Structural Cracks
von: Liu, Hui, et al.
Veröffentlicht: (2025)
von: Liu, Hui, et al.
Veröffentlicht: (2025)
PFB-Diff: Progressive Feature Blending Diffusion for Text-driven Image Editing
von: Huang, Wenjing, et al.
Veröffentlicht: (2023)
von: Huang, Wenjing, et al.
Veröffentlicht: (2023)
SFANet: Spatial-Frequency Attention Network for Deepfake Detection
von: Ahire, Vrushank, et al.
Veröffentlicht: (2025)
von: Ahire, Vrushank, et al.
Veröffentlicht: (2025)
Unsupervised Transcript-assisted Video Summarization and Highlight Detection
von: Barbakos, Spyros, et al.
Veröffentlicht: (2025)
von: Barbakos, Spyros, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Enhancing Environmental Monitoring through Multispectral Imaging: The WasteMS Dataset for Semantic Segmentation of Lakeside Waste
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024) -
ClassWise-CRF: Category-Specific Fusion for Enhanced Semantic Segmentation of Remote Sensing Imagery
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2025) -
Evaluating the Impact of Point Cloud Colorization on Semantic Segmentation Accuracy
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024) -
LEAF-Mamba: Local Emphatic and Adaptive Fusion State Space Model for RGB-D Salient Object Detection
von: Wu, Lanhu, et al.
Veröffentlicht: (2025) -
Smart Transfer: Leveraging Vision Foundation Model for Rapid Building Damage Mapping with Post-Earthquake VHR Imagery
von: Li, Hao, et al.
Veröffentlicht: (2026)