COMO: Cross-Mamba Interaction and Offset-Guided Fusion for Multimodal Object Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Chang, Ma, Xin, Yang, Xiaochen, Zhang, Yuxiang, Dong, Yanni |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fusion-Mamba for Cross-modality Object Detection
por: Dong, Wenhao, et al.
Publicado: (2024)
por: Dong, Wenhao, et al.
Publicado: (2024)
DEPFusion: Dual-Domain Enhancement and Priority-Guided Mamba Fusion for UAV Multispectral Object Detection
por: Li, Shucong, et al.
Publicado: (2025)
por: Li, Shucong, et al.
Publicado: (2025)
LASFNet: A Lightweight Attention-Guided Self-Modulation Feature Fusion Network for Multimodal Object Detection
por: Hao, Lei, et al.
Publicado: (2025)
por: Hao, Lei, et al.
Publicado: (2025)
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
por: Shen, Hui, et al.
Publicado: (2024)
por: Shen, Hui, et al.
Publicado: (2024)
ME-Mamba: Multi-Expert Mamba with Efficient Knowledge Capture and Fusion for Multimodal Survival Analysis
por: Zhang, Chengsheng, et al.
Publicado: (2025)
por: Zhang, Chengsheng, et al.
Publicado: (2025)
AlignMamba: Enhancing Multimodal Mamba with Local and Global Cross-modal Alignment
por: Li, Yan, et al.
Publicado: (2024)
por: Li, Yan, et al.
Publicado: (2024)
HiddenObject: Modality-Agnostic Fusion for Multimodal Hidden Object Detection
por: Song, Harris, et al.
Publicado: (2025)
por: Song, Harris, et al.
Publicado: (2025)
MambaOVSR: Multiscale Fusion with Global Motion Modeling for Chinese Opera Video Super-Resolution
por: Chang, Hua, et al.
Publicado: (2025)
por: Chang, Hua, et al.
Publicado: (2025)
Fore-Mamba3D: Mamba-based Foreground-Enhanced Encoding for 3D Object Detection
por: Ning, Zhiwei, et al.
Publicado: (2026)
por: Ning, Zhiwei, et al.
Publicado: (2026)
Mamba Fusion: Learning Actions Through Questioning
por: Dong, Zhikang, et al.
Publicado: (2024)
por: Dong, Zhikang, et al.
Publicado: (2024)
CFMD: Dynamic Cross-layer Feature Fusion for Salient Object Detection
por: Lian, Jin, et al.
Publicado: (2025)
por: Lian, Jin, et al.
Publicado: (2025)
RayMamba: Ray-Aligned Serialization for Long-Range 3D Object Detection
por: Lu, Cheng, et al.
Publicado: (2026)
por: Lu, Cheng, et al.
Publicado: (2026)
EVM-Fusion: An Explainable Vision Mamba Architecture with Neural Algorithmic Fusion
por: Yang, Zichuan, et al.
Publicado: (2025)
por: Yang, Zichuan, et al.
Publicado: (2025)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
por: Cai, Xinhao, et al.
Publicado: (2025)
por: Cai, Xinhao, et al.
Publicado: (2025)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
por: Wu, Wentao, et al.
Publicado: (2025)
por: Wu, Wentao, et al.
Publicado: (2025)
LIDAR: Lightweight Adaptive Cue-Aware Fusion Vision Mamba for Multimodal Segmentation of Structural Cracks
por: Liu, Hui, et al.
Publicado: (2025)
por: Liu, Hui, et al.
Publicado: (2025)
Adaptive Guidance Semantically Enhanced via Multimodal LLM for Edge-Cloud Object Detection
por: Hu, Yunqing, et al.
Publicado: (2025)
por: Hu, Yunqing, et al.
Publicado: (2025)
Dark-ISP: Enhancing RAW Image Processing for Low-Light Object Detection
por: Guo, Jiasheng, et al.
Publicado: (2025)
por: Guo, Jiasheng, et al.
Publicado: (2025)
DPG-CD: Depth-Prior-Guided Cross-Modal Joint 2D-3D Change Detection
por: Zhang, Luqi, et al.
Publicado: (2026)
por: Zhang, Luqi, et al.
Publicado: (2026)
DepthMamba with Adaptive Fusion
por: Meng, Zelin, et al.
Publicado: (2024)
por: Meng, Zelin, et al.
Publicado: (2024)
LEAF-Mamba: Local Emphatic and Adaptive Fusion State Space Model for RGB-D Salient Object Detection
por: Wu, Lanhu, et al.
Publicado: (2025)
por: Wu, Lanhu, et al.
Publicado: (2025)
Short-term Object Interaction Anticipation with Disentangled Object Detection @ Ego4D Short Term Object Interaction Anticipation Challenge
por: Cho, Hyunjin, et al.
Publicado: (2024)
por: Cho, Hyunjin, et al.
Publicado: (2024)
CellMamba: Adaptive Mamba for Accurate and Efficient Cell Detection
por: Liu, Ruochen, et al.
Publicado: (2025)
por: Liu, Ruochen, et al.
Publicado: (2025)
SSLFusion: Scale & Space Aligned Latent Fusion Model for Multimodal 3D Object Detection
por: Ding, Bonan, et al.
Publicado: (2025)
por: Ding, Bonan, et al.
Publicado: (2025)
RSOD: Reliability-Guided Sonar Image Object Detection with Extremely Limited Labels
por: Li, Chengzhou, et al.
Publicado: (2026)
por: Li, Chengzhou, et al.
Publicado: (2026)
FrustumFusionNets: A Three-Dimensional Object Detection Network Based on Tractor Road Scene
por: Yang, Lili, et al.
Publicado: (2025)
por: Yang, Lili, et al.
Publicado: (2025)
COXNet: Cross-Layer Fusion with Adaptive Alignment and Scale Integration for RGBT Tiny Object Detection
por: Peng, Peiran, et al.
Publicado: (2025)
por: Peng, Peiran, et al.
Publicado: (2025)
Cross-Modal Purification and Fusion for Small-Object RGB-D Transmission-Line Defect Detection
por: Cui, Jiaming, et al.
Publicado: (2026)
por: Cui, Jiaming, et al.
Publicado: (2026)
MDDFNet: Mamba-based Dynamic Dual Fusion Network for Traffic Sign Detection
por: Yu, TianYi
Publicado: (2025)
por: Yu, TianYi
Publicado: (2025)
Spectral Discrepancy and Cross-modal Semantic Consistency Learning for Object Detection in Hyperspectral Image
por: He, Xiao, et al.
Publicado: (2025)
por: He, Xiao, et al.
Publicado: (2025)
VLM-E2E: Enhancing End-to-End Autonomous Driving with Multimodal Driver Attention Fusion
por: Liu, Pei, et al.
Publicado: (2025)
por: Liu, Pei, et al.
Publicado: (2025)
Reasoning-Aware Multimodal Fusion for Hateful Video Detection
por: Yang, Shuonan, et al.
Publicado: (2025)
por: Yang, Shuonan, et al.
Publicado: (2025)
MambaLiteUNet: Cross-Gated Adaptive Feature Fusion for Robust Skin Lesion Segmentation
por: Rahman, Md Maklachur, et al.
Publicado: (2026)
por: Rahman, Md Maklachur, et al.
Publicado: (2026)
MRD: Multi-resolution Retrieval-Detection Fusion for High-Resolution Image Understanding
por: Yang, Fan, et al.
Publicado: (2025)
por: Yang, Fan, et al.
Publicado: (2025)
A Review of Human-Object Interaction Detection
por: Wang, Yuxiao, et al.
Publicado: (2024)
por: Wang, Yuxiao, et al.
Publicado: (2024)
Co-Fusion4D: Spatio-temporal Collaborative Fusion for Robust 3D Object Detection
por: Li, Wenxuan, et al.
Publicado: (2026)
por: Li, Wenxuan, et al.
Publicado: (2026)
AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers
por: Liu, Dong, et al.
Publicado: (2026)
por: Liu, Dong, et al.
Publicado: (2026)
Language-Guided Structure-Aware Network for Camouflaged Object Detection
por: Zhang, Min
Publicado: (2026)
por: Zhang, Min
Publicado: (2026)
Relative-Absolute Fusion: Rethinking Feature Extraction in Image-Based Iterative Method Selection for Solving Sparse Linear Systems
por: Zhang, Kaiqi, et al.
Publicado: (2025)
por: Zhang, Kaiqi, et al.
Publicado: (2025)
S-LAM3D: Segmentation-Guided Monocular 3D Object Detection via Feature Space Fusion
por: Sas, Diana-Alexandra, et al.
Publicado: (2025)
por: Sas, Diana-Alexandra, et al.
Publicado: (2025)
Ejemplares similares
-
Fusion-Mamba for Cross-modality Object Detection
por: Dong, Wenhao, et al.
Publicado: (2024) -
DEPFusion: Dual-Domain Enhancement and Priority-Guided Mamba Fusion for UAV Multispectral Object Detection
por: Li, Shucong, et al.
Publicado: (2025) -
LASFNet: A Lightweight Attention-Guided Self-Modulation Feature Fusion Network for Multimodal Object Detection
por: Hao, Lei, et al.
Publicado: (2025) -
Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion
por: Shen, Hui, et al.
Publicado: (2024) -
ME-Mamba: Multi-Expert Mamba with Efficient Knowledge Capture and Fusion for Multimodal Survival Analysis
por: Zhang, Chengsheng, et al.
Publicado: (2025)