M2I2HA: Multi-modal Object Detection Based on Intra- and Inter-Modal Hypergraph Attention
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Xiaofan, Liu, Yubin, Pan, Wei, Chu, Guoqing, Zhang, Junming, Zhao, Jie, Man, Zhuoqi, Cao, Xuanming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Leveraging Intra-modal and Inter-modal Interaction for Multi-Modal Entity Alignment
por: Hu, Zhiwei, et al.
Publicado: (2024)
por: Hu, Zhiwei, et al.
Publicado: (2024)
Jointly Modeling Inter- & Intra-Modality Dependencies for Multi-modal Learning
por: Madaan, Divyam, et al.
Publicado: (2024)
por: Madaan, Divyam, et al.
Publicado: (2024)
I2CR: Intra- and Inter-modal Collaborative Reflections for Multimodal Entity Linking
por: Liu, Ziyan, et al.
Publicado: (2025)
por: Liu, Ziyan, et al.
Publicado: (2025)
Enhancing Incomplete Multi-modal Brain Tumor Segmentation with Intra-modal Asymmetry and Inter-modal Dependency
por: Liu, Weide, et al.
Publicado: (2024)
por: Liu, Weide, et al.
Publicado: (2024)
Disentangling Bias by Modeling Intra- and Inter-modal Causal Attention for Multimodal Sentiment Analysis
por: Jiang, Menghua, et al.
Publicado: (2025)
por: Jiang, Menghua, et al.
Publicado: (2025)
Variational Multi-Modal Hypergraph Attention Network for Multi-Modal Relation Extraction
por: Li, Qian, et al.
Publicado: (2024)
por: Li, Qian, et al.
Publicado: (2024)
IIANet: An Intra- and Inter-Modality Attention Network for Audio-Visual Speech Separation
por: Li, Kai, et al.
Publicado: (2023)
por: Li, Kai, et al.
Publicado: (2023)
I$^2$OL-Net: Intra-Inter Objectness Learning Network for Point-Supervised X-Ray Prohibited Item Detection
por: Wong, Sanjoeng, et al.
Publicado: (2024)
por: Wong, Sanjoeng, et al.
Publicado: (2024)
Modality-Aware and Shift Mixer for Multi-modal Brain Tumor Segmentation
por: Huang, Zhongzhen, et al.
Publicado: (2024)
por: Huang, Zhongzhen, et al.
Publicado: (2024)
I$^2$VC: A Unified Framework for Intra- & Inter-frame Video Compression
por: Liu, Meiqin, et al.
Publicado: (2024)
por: Liu, Meiqin, et al.
Publicado: (2024)
Video Super-Resolution Transformer with Masked Inter&Intra-Frame Attention
por: Zhou, Xingyu, et al.
Publicado: (2024)
por: Zhou, Xingyu, et al.
Publicado: (2024)
Intra- and Inter-modal Context Interaction Modeling for Conversational Speech Synthesis
por: Jia, Zhenqi, et al.
Publicado: (2024)
por: Jia, Zhenqi, et al.
Publicado: (2024)
STMI: Segmentation-Guided Token Modulation with Cross-Modal Hypergraph Interaction for Multi-Modal Object Re-Identification
por: Xu, Xingguo, et al.
Publicado: (2026)
por: Xu, Xingguo, et al.
Publicado: (2026)
G$^{2}$SF-MIAD: Geometry-Guided Score Fusion for Multimodal Industrial Anomaly Detection
por: Tao, Chengyu, et al.
Publicado: (2025)
por: Tao, Chengyu, et al.
Publicado: (2025)
I2CKD : Intra- and Inter-Class Knowledge Distillation for Semantic Segmentation
por: Karine, Ayoub, et al.
Publicado: (2024)
por: Karine, Ayoub, et al.
Publicado: (2024)
Mitigating Intra- and Inter-modal Forgetting in Continual Learning of Unified Multimodal Models
por: Wei, Xiwen, et al.
Publicado: (2025)
por: Wei, Xiwen, et al.
Publicado: (2025)
Detail-Enhanced Intra- and Inter-modal Interaction for Audio-Visual Emotion Recognition
por: Shi, Tong, et al.
Publicado: (2024)
por: Shi, Tong, et al.
Publicado: (2024)
Align3D-AD: Cross-Modal Feature Alignment and Dual-Prompt Learning for Zero-shot 3D Anomaly Detection
por: Bai, Letian, et al.
Publicado: (2026)
por: Bai, Letian, et al.
Publicado: (2026)
Adversarial Representation with Intra-Modal and Inter-Modal Graph Contrastive Learning for Multimodal Emotion Recognition
por: Shou, Yuntao, et al.
Publicado: (2023)
por: Shou, Yuntao, et al.
Publicado: (2023)
Start from Video-Music Retrieval: An Inter-Intra Modal Loss for Cross Modal Retrieval
por: Chen, Zeyu, et al.
Publicado: (2024)
por: Chen, Zeyu, et al.
Publicado: (2024)
RGB-T Object Detection via Group Shuffled Multi-receptive Attention and Multi-modal Supervision
por: Wang, Jinzhong, et al.
Publicado: (2024)
por: Wang, Jinzhong, et al.
Publicado: (2024)
Separated Inter/Intra-Modal Fusion Prompts for Compositional Zero-Shot Learning
por: Jung, Sua
Publicado: (2025)
por: Jung, Sua
Publicado: (2025)
scI2CL: Effectively Integrating Single-cell Multi-omics by Intra- and Inter-omics Contrastive Learning
por: Liu, Wuchao, et al.
Publicado: (2025)
por: Liu, Wuchao, et al.
Publicado: (2025)
Dual-Stream Attention with Multi-Modal Queries for Object Detection in Transportation Applications
por: Anwar, Noreen, et al.
Publicado: (2025)
por: Anwar, Noreen, et al.
Publicado: (2025)
$I^{2}$-World: Intra-Inter Tokenization for Efficient Dynamic 4D Scene Forecasting
por: Liao, Zhimin, et al.
Publicado: (2025)
por: Liao, Zhimin, et al.
Publicado: (2025)
CCF: Complementary Collaborative Fusion for Domain Generalized Multi-Modal 3D Object Detection
por: Wu, Yuchen, et al.
Publicado: (2026)
por: Wu, Yuchen, et al.
Publicado: (2026)
Intra and Inter Parser-Prompted Transformers for Effective Image Restoration
por: Wang, Cong, et al.
Publicado: (2025)
por: Wang, Cong, et al.
Publicado: (2025)
Multi-Granular Attention based Heterogeneous Hypergraph Neural Network
por: Jin, Hong, et al.
Publicado: (2025)
por: Jin, Hong, et al.
Publicado: (2025)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
MoIIE: Mixture of Intra- and Inter-Modality Experts for Large Vision Language Models
por: Wang, Dianyi, et al.
Publicado: (2025)
por: Wang, Dianyi, et al.
Publicado: (2025)
Cross the Gap: Exposing the Intra-modal Misalignment in CLIP via Modality Inversion
por: Mistretta, Marco, et al.
Publicado: (2025)
por: Mistretta, Marco, et al.
Publicado: (2025)
Hypergraph Multi-modal Large Language Model: Exploiting EEG and Eye-tracking Modalities to Evaluate Heterogeneous Responses for Video Understanding
por: Wu, Minghui, et al.
Publicado: (2024)
por: Wu, Minghui, et al.
Publicado: (2024)
Open-World Human-Object Interaction Detection via Multi-modal Prompts
por: Yang, Jie, et al.
Publicado: (2024)
por: Yang, Jie, et al.
Publicado: (2024)
M3-AD: Reflection-aware Multi-modal, Multi-category, and Multi-dimensional Benchmark and Framework for Industrial Anomaly Detection
por: Huang, Chao, et al.
Publicado: (2026)
por: Huang, Chao, et al.
Publicado: (2026)
MMLF: Multi-modal Multi-class Late Fusion for Object Detection with Uncertainty Estimation
por: Yang, Qihang, et al.
Publicado: (2024)
por: Yang, Qihang, et al.
Publicado: (2024)
3D-CSAD: Untrained 3D Anomaly Detection for Complex Manufacturing Surfaces
por: Cao, Xuanming, et al.
Publicado: (2024)
por: Cao, Xuanming, et al.
Publicado: (2024)
LLMTrack: Semantic Multi-Object Tracking with Multi-modal Large Language Models
por: Liao, Pan, et al.
Publicado: (2026)
por: Liao, Pan, et al.
Publicado: (2026)
InEx: Hallucination Mitigation via Introspection and Cross-Modal Multi-Agent Collaboration
por: Yang, Zhongyu, et al.
Publicado: (2025)
por: Yang, Zhongyu, et al.
Publicado: (2025)
Rethinking Multi-Modal Object Detection from the Perspective of Mono-Modality Feature Learning
por: Zhao, Tianyi, et al.
Publicado: (2025)
por: Zhao, Tianyi, et al.
Publicado: (2025)
SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection
por: Zhao, Haimei, et al.
Publicado: (2023)
por: Zhao, Haimei, et al.
Publicado: (2023)
Ejemplares similares
-
Leveraging Intra-modal and Inter-modal Interaction for Multi-Modal Entity Alignment
por: Hu, Zhiwei, et al.
Publicado: (2024) -
Jointly Modeling Inter- & Intra-Modality Dependencies for Multi-modal Learning
por: Madaan, Divyam, et al.
Publicado: (2024) -
I2CR: Intra- and Inter-modal Collaborative Reflections for Multimodal Entity Linking
por: Liu, Ziyan, et al.
Publicado: (2025) -
Enhancing Incomplete Multi-modal Brain Tumor Segmentation with Intra-modal Asymmetry and Inter-modal Dependency
por: Liu, Weide, et al.
Publicado: (2024) -
Disentangling Bias by Modeling Intra- and Inter-modal Causal Attention for Multimodal Sentiment Analysis
por: Jiang, Menghua, et al.
Publicado: (2025)