Deep Mamba Multi-modal Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Jian, Zou, Xin, Cui, Yu, Huang, Zhangmin, Hu, Chenshu, Lyu, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
di: Zhan, Yu-Wei, et al.
Pubblicazione: (2024)
di: Zhan, Yu-Wei, et al.
Pubblicazione: (2024)
Multi-view Hypergraph-based Contrastive Learning Model for Cold-Start Micro-video Recommendation
di: Lyu, Sisuo, et al.
Pubblicazione: (2024)
di: Lyu, Sisuo, et al.
Pubblicazione: (2024)
MMoFusion: Multi-modal Co-Speech Motion Generation with Diffusion Model
di: Wang, Sen, et al.
Pubblicazione: (2024)
di: Wang, Sen, et al.
Pubblicazione: (2024)
Clinical Multi-modal Fusion with Heterogeneous Graph and Disease Correlation Learning for Multi-Disease Prediction
di: Jiang, Yueheng, et al.
Pubblicazione: (2025)
di: Jiang, Yueheng, et al.
Pubblicazione: (2025)
MMPKUBase: A Comprehensive and High-quality Chinese Multi-modal Knowledge Graph
di: Yi, Xuan, et al.
Pubblicazione: (2024)
di: Yi, Xuan, et al.
Pubblicazione: (2024)
Emotional Cues Extraction and Fusion for Multi-modal Emotion Prediction and Recognition in Conversation
di: Shi, Haoxiang, et al.
Pubblicazione: (2024)
di: Shi, Haoxiang, et al.
Pubblicazione: (2024)
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
di: Wu, Qiong, et al.
Pubblicazione: (2024)
di: Wu, Qiong, et al.
Pubblicazione: (2024)
Mixture-of-Prompt-Experts for Multi-modal Semantic Understanding
di: Wu, Zichen, et al.
Pubblicazione: (2024)
di: Wu, Zichen, et al.
Pubblicazione: (2024)
GSSF: Generalized Structural Sparse Function for Deep Cross-modal Metric Learning
di: Diao, Haiwen, et al.
Pubblicazione: (2024)
di: Diao, Haiwen, et al.
Pubblicazione: (2024)
Towards Structure-aware Model for Multi-modal Knowledge Graph Completion
di: Li, Linyu, et al.
Pubblicazione: (2025)
di: Li, Linyu, et al.
Pubblicazione: (2025)
Multi-modal and Metadata Capture Model for Micro Video Popularity Prediction
di: Lu, Jiacheng, et al.
Pubblicazione: (2025)
di: Lu, Jiacheng, et al.
Pubblicazione: (2025)
Robust Multi-modal Task-oriented Communications with Redundancy-aware Representations
di: Fu, Jingwen, et al.
Pubblicazione: (2025)
di: Fu, Jingwen, et al.
Pubblicazione: (2025)
TF-Mamba: Text-enhanced Fusion Mamba with Missing Modalities for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Deep Reversible Consistency Learning for Cross-modal Retrieval
di: Pu, Ruitao, et al.
Pubblicazione: (2025)
di: Pu, Ruitao, et al.
Pubblicazione: (2025)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
di: Zou, Heqing, et al.
Pubblicazione: (2024)
di: Zou, Heqing, et al.
Pubblicazione: (2024)
Characterizing Multimedia Information Environment through Multi-modal Clustering of YouTube Videos
di: Yousefi, Niloofar, et al.
Pubblicazione: (2024)
di: Yousefi, Niloofar, et al.
Pubblicazione: (2024)
Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health Understanding
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2026)
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2026)
Robust Multi-generation Learned Compression of Point Cloud Attribute
di: Liu, Xiangzuo, et al.
Pubblicazione: (2025)
di: Liu, Xiangzuo, et al.
Pubblicazione: (2025)
CMMU: A Benchmark for Chinese Multi-modal Multi-type Question Understanding and Reasoning
di: He, Zheqi, et al.
Pubblicazione: (2024)
di: He, Zheqi, et al.
Pubblicazione: (2024)
MambaGesture: Enhancing Co-Speech Gesture Generation with Mamba and Disentangled Multi-Modality Fusion
di: Fu, Chencan, et al.
Pubblicazione: (2024)
di: Fu, Chencan, et al.
Pubblicazione: (2024)
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
di: Yang, Zequn, et al.
Pubblicazione: (2024)
di: Yang, Zequn, et al.
Pubblicazione: (2024)
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
di: Gao, Lancheng, et al.
Pubblicazione: (2025)
di: Gao, Lancheng, et al.
Pubblicazione: (2025)
AIM: Let Any Multi-modal Large Language Models Embrace Efficient In-Context Learning
di: Gao, Jun, et al.
Pubblicazione: (2024)
di: Gao, Jun, et al.
Pubblicazione: (2024)
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
di: Zhang, Ze, et al.
Pubblicazione: (2025)
di: Zhang, Ze, et al.
Pubblicazione: (2025)
MambaPro: Multi-Modal Object Re-Identification with Mamba Aggregation and Synergistic Prompt
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
di: Zhu, Yixin, et al.
Pubblicazione: (2026)
di: Zhu, Yixin, et al.
Pubblicazione: (2026)
Not All Attention is Needed: Parameter and Computation Efficient Transfer Learning for Multi-modal Large Language Models
di: Wu, Qiong, et al.
Pubblicazione: (2024)
di: Wu, Qiong, et al.
Pubblicazione: (2024)
Hybrid CNN-Mamba Enhancement Network for Robust Multimodal Sentiment Analysis
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Balanced Multi-modal Federated Learning via Cross-Modal Infiltration
di: Fan, Yunfeng, et al.
Pubblicazione: (2023)
di: Fan, Yunfeng, et al.
Pubblicazione: (2023)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
di: Zhu, Haodong, et al.
Pubblicazione: (2025)
di: Zhu, Haodong, et al.
Pubblicazione: (2025)
HAFM: Hierarchical Autoregressive Foundation Model for Music Accompaniment Generation
di: Zhu, Jian, et al.
Pubblicazione: (2026)
di: Zhu, Jian, et al.
Pubblicazione: (2026)
Continual Panoptic Perception: Towards Multi-modal Incremental Interpretation of Remote Sensing Images
di: Yuan, Bo, et al.
Pubblicazione: (2024)
di: Yuan, Bo, et al.
Pubblicazione: (2024)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
di: Li, Haoyuan, et al.
Pubblicazione: (2024)
di: Li, Haoyuan, et al.
Pubblicazione: (2024)
IBMEA: Exploring Variational Information Bottleneck for Multi-modal Entity Alignment
di: Su, Taoyu, et al.
Pubblicazione: (2024)
di: Su, Taoyu, et al.
Pubblicazione: (2024)
Accelerating Multi-Condition T2I Generation via Adaptive Condition Offloading and Pruning
di: Kong, Yuxin, et al.
Pubblicazione: (2026)
di: Kong, Yuxin, et al.
Pubblicazione: (2026)
CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration
di: Xie, Tianyidan, et al.
Pubblicazione: (2026)
di: Xie, Tianyidan, et al.
Pubblicazione: (2026)
How to Cache Important Contents for Multi-modal Service in Dynamic Networks: A DRL-based Caching Scheme
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
Spatiotemporal Graph Guided Multi-modal Network for Livestreaming Product Retrieval
di: Hu, Xiaowan, et al.
Pubblicazione: (2024)
di: Hu, Xiaowan, et al.
Pubblicazione: (2024)
LoginMEA: Local-to-Global Interaction Network for Multi-modal Entity Alignment
di: Su, Taoyu, et al.
Pubblicazione: (2024)
di: Su, Taoyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
di: Zhan, Yu-Wei, et al.
Pubblicazione: (2024) -
Multi-view Hypergraph-based Contrastive Learning Model for Cold-Start Micro-video Recommendation
di: Lyu, Sisuo, et al.
Pubblicazione: (2024) -
MMoFusion: Multi-modal Co-Speech Motion Generation with Diffusion Model
di: Wang, Sen, et al.
Pubblicazione: (2024) -
Clinical Multi-modal Fusion with Heterogeneous Graph and Disease Correlation Learning for Multi-Disease Prediction
di: Jiang, Yueheng, et al.
Pubblicazione: (2025) -
MMPKUBase: A Comprehensive and High-quality Chinese Multi-modal Knowledge Graph
di: Yi, Xuan, et al.
Pubblicazione: (2024)