MamFusion: Multi-Mamba with Temporal Fusion for Partially Relevant Video Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ying, Xinru, Mo, Jiaqi, Lin, Jingyang, Jin, Canghong, Wang, Fangfang, Wei, Lina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PRVR: Partially Relevant Video Retrieval
par: Chen, Xianke, et autres
Publié: (2022)
par: Chen, Xianke, et autres
Publié: (2022)
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
par: Tang, Linfeng, et autres
Publié: (2025)
par: Tang, Linfeng, et autres
Publié: (2025)
MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection
par: Wang, Hanshi, et autres
Publié: (2025)
par: Wang, Hanshi, et autres
Publié: (2025)
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
par: Xie, Xinyu, et autres
Publié: (2024)
par: Xie, Xinyu, et autres
Publié: (2024)
Dual Learning with Dynamic Knowledge Distillation and Soft Alignment for Partially Relevant Video Retrieval
par: Dong, Jianfeng, et autres
Publié: (2025)
par: Dong, Jianfeng, et autres
Publié: (2025)
StyMam: A Mamba-Based Generator for Artistic Style Transfer
par: Hong, Zhou, et autres
Publié: (2026)
par: Hong, Zhou, et autres
Publié: (2026)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)
par: Zhu, Yixin, et autres
Publié: (2026)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
par: Song, Peipei, et autres
Publié: (2025)
par: Song, Peipei, et autres
Publié: (2025)
Evidential Deep Partial Multi-View Classification With Discount Fusion
par: Huang, Haojian, et autres
Publié: (2024)
par: Huang, Haojian, et autres
Publié: (2024)
MambaVF: State Space Model for Efficient Video Fusion
par: Zhao, Zixiang, et autres
Publié: (2026)
par: Zhao, Zixiang, et autres
Publié: (2026)
GMMFormer v2: An Uncertainty-aware Framework for Partially Relevant Video Retrieval
par: Wang, Yuting, et autres
Publié: (2024)
par: Wang, Yuting, et autres
Publié: (2024)
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
par: Yang, Junkai, et autres
Publié: (2026)
par: Yang, Junkai, et autres
Publié: (2026)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
par: Yu, Li, et autres
Publié: (2024)
par: Yu, Li, et autres
Publié: (2024)
MambaDFuse: A Mamba-based Dual-phase Model for Multi-modality Image Fusion
par: Li, Zhe, et autres
Publié: (2024)
par: Li, Zhe, et autres
Publié: (2024)
MambaDSF: Multi-Scale SSM with Dilated Feature Fusion for Sonar Small Target Detection
par: Lin, Hui, et autres
Publié: (2026)
par: Lin, Hui, et autres
Publié: (2026)
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
par: Moon, WonJun, et autres
Publié: (2025)
par: Moon, WonJun, et autres
Publié: (2025)
Uneven Event Modeling for Partially Relevant Video Retrieval
par: Zhu, Sa, et autres
Publié: (2025)
par: Zhu, Sa, et autres
Publié: (2025)
DepthMamba with Adaptive Fusion
par: Meng, Zelin, et autres
Publié: (2024)
par: Meng, Zelin, et autres
Publié: (2024)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
par: Zhang, Long, et autres
Publié: (2025)
par: Zhang, Long, et autres
Publié: (2025)
Spatial-Frequency Enhanced Mamba for Multi-Modal Image Fusion
par: Sun, Hui, et autres
Publié: (2025)
par: Sun, Hui, et autres
Publié: (2025)
UAVD-Mamba: Deformable Token Fusion Vision Mamba for Multimodal UAV Detection
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
MambaOVSR: Multiscale Fusion with Global Motion Modeling for Chinese Opera Video Super-Resolution
par: Chang, Hua, et autres
Publié: (2025)
par: Chang, Hua, et autres
Publié: (2025)
Laplace-Mamba: Laplace Frequency Prior-Guided Mamba-CNN Fusion Network for Image Dehazing
par: Wang, Yongzhen, et autres
Publié: (2025)
par: Wang, Yongzhen, et autres
Publié: (2025)
EVM-Fusion: An Explainable Vision Mamba Architecture with Neural Algorithmic Fusion
par: Yang, Zichuan, et autres
Publié: (2025)
par: Yang, Zichuan, et autres
Publié: (2025)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
par: Hou, Danyang, et autres
Publié: (2024)
par: Hou, Danyang, et autres
Publié: (2024)
Multi-scale Temporal Fusion Transformer for Incomplete Vehicle Trajectory Prediction
par: Liu, Zhanwen, et autres
Publié: (2024)
par: Liu, Zhanwen, et autres
Publié: (2024)
MambaCAFU: Hybrid Multi-Scale and Multi-Attention Model with Mamba-Based Fusion for Medical Image Segmentation
par: Bui, T-Mai, et autres
Publié: (2025)
par: Bui, T-Mai, et autres
Publié: (2025)
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
par: Lu, Andong, et autres
Publié: (2024)
par: Lu, Andong, et autres
Publié: (2024)
Self-distilled Dynamic Fusion Network for Language-based Fashion Retrieval
par: Wu, Yiming, et autres
Publié: (2024)
par: Wu, Yiming, et autres
Publié: (2024)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
par: Zheng, Xiaoyu, et autres
Publié: (2025)
par: Zheng, Xiaoyu, et autres
Publié: (2025)
Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
par: Ren, Junlong, et autres
Publié: (2025)
par: Ren, Junlong, et autres
Publié: (2025)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
par: Cho, CH, et autres
Publié: (2025)
par: Cho, CH, et autres
Publié: (2025)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
par: Zhu, Haodong, et autres
Publié: (2025)
par: Zhu, Haodong, et autres
Publié: (2025)
Multi-modal Fusion and Query Refinement Network for Video Moment Retrieval and Highlight Detection
par: Xu, Yifang, et autres
Publié: (2025)
par: Xu, Yifang, et autres
Publié: (2025)
milliMamba: Specular-Aware Human Pose Estimation via Dual mmWave Radar with Multi-Frame Mamba Fusion
par: Kini, Niraj Prakash, et autres
Publié: (2025)
par: Kini, Niraj Prakash, et autres
Publié: (2025)
MambaFusion: Adaptive State-Space Fusion for Multimodal 3D Object Detection
par: Narayanan, Venkatraman, et autres
Publié: (2026)
par: Narayanan, Venkatraman, et autres
Publié: (2026)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
par: Moon, WonJun, et autres
Publié: (2025)
par: Moon, WonJun, et autres
Publié: (2025)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
Documents similaires
-
PRVR: Partially Relevant Video Retrieval
par: Chen, Xianke, et autres
Publié: (2022) -
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
par: Tang, Linfeng, et autres
Publié: (2025) -
MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection
par: Wang, Hanshi, et autres
Publié: (2025) -
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
par: Xie, Xinyu, et autres
Publié: (2024) -
Dual Learning with Dynamic Knowledge Distillation and Soft Alignment for Partially Relevant Video Retrieval
par: Dong, Jianfeng, et autres
Publié: (2025)