MIAR: Modality Interaction and Alignment Representation Fuison for Multimodal Emotion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Jichao, Yu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Compound Expression Recognition via Multi Model Ensemble
par: Yu, Jun, et autres
Publié: (2024)
par: Yu, Jun, et autres
Publié: (2024)
Enhancing Modal Fusion by Alignment and Label Matching for Multimodal Emotion Recognition
par: Li, Qifei, et autres
Publié: (2024)
par: Li, Qifei, et autres
Publié: (2024)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
par: Huang, Hai, et autres
Publié: (2024)
par: Huang, Hai, et autres
Publié: (2024)
Multimodal Emotion Recognition with Vision-language Prompting and Modality Dropout
par: QI, Anbin, et autres
Publié: (2024)
par: QI, Anbin, et autres
Publié: (2024)
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations
par: Kim, Jeonghyeon, et autres
Publié: (2025)
par: Kim, Jeonghyeon, et autres
Publié: (2025)
Leveraging Retrieval Augment Approach for Multimodal Emotion Recognition Under Missing Modalities
par: Fan, Qi, et autres
Publié: (2024)
par: Fan, Qi, et autres
Publié: (2024)
Multimodal Video Emotion Recognition with Reliable Reasoning Priors
par: Wang, Zhepeng, et autres
Publié: (2025)
par: Wang, Zhepeng, et autres
Publié: (2025)
Unsupervised Audio-Visual Segmentation with Modality Alignment
par: Bhosale, Swapnil, et autres
Publié: (2024)
par: Bhosale, Swapnil, et autres
Publié: (2024)
Modality Gap-Driven Subspace Alignment Training Paradigm For Multimodal Large Language Models
par: Yu, Xiaomin, et autres
Publié: (2026)
par: Yu, Xiaomin, et autres
Publié: (2026)
MIRROR: Multi-Modal Pathological Self-Supervised Representation Learning via Modality Alignment and Retention
par: Wang, Tianyi, et autres
Publié: (2025)
par: Wang, Tianyi, et autres
Publié: (2025)
Beyond CLIP: Knowledge-Enhanced Multimodal Transformers for Cross-Modal Alignment in Diabetic Retinopathy Diagnosis
par: Samanta, Argha Kamal, et autres
Publié: (2025)
par: Samanta, Argha Kamal, et autres
Publié: (2025)
Gramian Multimodal Representation Learning and Alignment
par: Cicchetti, Giordano, et autres
Publié: (2024)
par: Cicchetti, Giordano, et autres
Publié: (2024)
Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models
par: He, Hulingxiao, et autres
Publié: (2026)
par: He, Hulingxiao, et autres
Publié: (2026)
MIRe: Enhancing Multimodal Queries Representation via Fusion-Free Modality Interaction for Multimodal Retrieval
par: Ju, Yeong-Joon, et autres
Publié: (2024)
par: Ju, Yeong-Joon, et autres
Publié: (2024)
Single-to-mix Modality Alignment with Multimodal Large Language Model for Document Image Machine Translation
par: Liang, Yupu, et autres
Publié: (2025)
par: Liang, Yupu, et autres
Publié: (2025)
Multimodal Sentiment Analysis based on Multi-channel and Symmetric Mutual Promotion Feature Fusion
par: Zhu, Wangyuan, et autres
Publié: (2026)
par: Zhu, Wangyuan, et autres
Publié: (2026)
Learning Relative Representations for Fine-Grained Multimodal Alignment with Limited Data
par: Kim, Shiwon, et autres
Publié: (2026)
par: Kim, Shiwon, et autres
Publié: (2026)
Distill-then-prune: An Efficient Compression Framework for Real-time Stereo Matching Network on Edge Devices
par: Pan, Baiyu, et autres
Publié: (2024)
par: Pan, Baiyu, et autres
Publié: (2024)
AttAnchor: Guiding Cross-Modal Token Alignment in VLMs with Attention Anchors
par: Zhang, Junyang, et autres
Publié: (2025)
par: Zhang, Junyang, et autres
Publié: (2025)
A Novel Approach to for Multimodal Emotion Recognition : Multimodal semantic information fusion
par: Dai, Wei, et autres
Publié: (2025)
par: Dai, Wei, et autres
Publié: (2025)
Uni-X: Mitigating Modality Conflict with a Two-End-Separated Architecture for Unified Multimodal Models
par: Hao, Jitai, et autres
Publié: (2025)
par: Hao, Jitai, et autres
Publié: (2025)
Solution to the 10th ABAW Expression Recognition Challenge: A Robust Multimodal Framework with Safe Cross-Attention and Modality Dropout
par: Yu, Jun, et autres
Publié: (2026)
par: Yu, Jun, et autres
Publié: (2026)
ECMF: Enhanced Cross-Modal Fusion for Multimodal Emotion Recognition in MER-SEMI Challenge
par: Hu, Juewen, et autres
Publié: (2025)
par: Hu, Juewen, et autres
Publié: (2025)
EEG-based Multimodal Representation Learning for Emotion Recognition
par: Yin, Kang, et autres
Publié: (2024)
par: Yin, Kang, et autres
Publié: (2024)
Emotion-LLaMAv2 and MMEVerse: A New Framework and Benchmark for Multimodal Emotion Understanding
par: Peng, Xiaojiang, et autres
Publié: (2026)
par: Peng, Xiaojiang, et autres
Publié: (2026)
Exploring Facial Expression Recognition through Semi-Supervised Pretraining and Temporal Modeling
par: Yu, Jun, et autres
Publié: (2024)
par: Yu, Jun, et autres
Publié: (2024)
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
par: Yan, Hanqi, et autres
Publié: (2025)
par: Yan, Hanqi, et autres
Publié: (2025)
Learning Modality-Aware Representations: Adaptive Group-wise Interaction Network for Multimodal MRI Synthesis
par: Song, Tao, et autres
Publié: (2024)
par: Song, Tao, et autres
Publié: (2024)
MME-Emotion: A Holistic Evaluation Benchmark for Emotional Intelligence in Multimodal Large Language Models
par: Zhang, Fan, et autres
Publié: (2025)
par: Zhang, Fan, et autres
Publié: (2025)
MANTA: Cross-Modal Semantic Alignment and Information-Theoretic Optimization for Long-form Multimodal Understanding
par: Zhong, Ziqi, et autres
Publié: (2025)
par: Zhong, Ziqi, et autres
Publié: (2025)
Multimodal Prototype Alignment for Semi-supervised Pathology Image Segmentation
par: Fu, Mingxi, et autres
Publié: (2025)
par: Fu, Mingxi, et autres
Publié: (2025)
CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
par: Chen, Zeyu, et autres
Publié: (2026)
par: Chen, Zeyu, et autres
Publié: (2026)
MLVTG: Mamba-Based Feature Alignment and LLM-Driven Purification for Multi-Modal Video Temporal Grounding
par: Zhu, Zhiyi, et autres
Publié: (2025)
par: Zhu, Zhiyi, et autres
Publié: (2025)
Time Series, Vision, and Language: Exploring the Limits of Alignment in Contrastive Representation Spaces
par: Yashwante, Pratham, et autres
Publié: (2026)
par: Yashwante, Pratham, et autres
Publié: (2026)
Nano-EmoX: Unifying Multimodal Emotional Intelligence from Perception to Empathy
par: Huang, Jiahao, et autres
Publié: (2026)
par: Huang, Jiahao, et autres
Publié: (2026)
CorMulT: A Semi-supervised Modality Correlation-aware Multimodal Transformer for Sentiment Analysis
par: Li, Yangmin, et autres
Publié: (2024)
par: Li, Yangmin, et autres
Publié: (2024)
From Coarse to Nuanced: Cross-Modal Alignment of Fine-Grained Linguistic Cues and Visual Salient Regions for Dynamic Emotion Recognition
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
Optical Flow Representation Alignment Mamba Diffusion Model for Medical Video Generation
par: Wang, Zhenbin, et autres
Publié: (2024)
par: Wang, Zhenbin, et autres
Publié: (2024)
MIBench: Evaluating LMMs on Multimodal Interaction
par: Miao, Yu, et autres
Publié: (2026)
par: Miao, Yu, et autres
Publié: (2026)
PAN-Crafter: Learning Modality-Consistent Alignment for PAN-Sharpening
par: Do, Jeonghyeok, et autres
Publié: (2025)
par: Do, Jeonghyeok, et autres
Publié: (2025)
Documents similaires
-
Compound Expression Recognition via Multi Model Ensemble
par: Yu, Jun, et autres
Publié: (2024) -
Enhancing Modal Fusion by Alignment and Label Matching for Multimodal Emotion Recognition
par: Li, Qifei, et autres
Publié: (2024) -
Enhancing Multimodal Unified Representations for Cross Modal Generalization
par: Huang, Hai, et autres
Publié: (2024) -
Multimodal Emotion Recognition with Vision-language Prompting and Modality Dropout
par: QI, Anbin, et autres
Publié: (2024) -
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations
par: Kim, Jeonghyeon, et autres
Publié: (2025)