Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yifan, Wang, Peiwu, Chi, Yunxian, Gou, Zhinan, Gao, Kai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2026)
par: Zhou, Qianrui, et autres
Publié: (2026)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2025)
par: Zhou, Qianrui, et autres
Publié: (2025)
Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2023)
par: Zhou, Qianrui, et autres
Publié: (2023)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
par: Wang, Bingbing, et autres
Publié: (2025)
par: Wang, Bingbing, et autres
Publié: (2025)
InconVAD: A Two-Stage Dual-Tower Framework for Multimodal Emotion Inconsistency Detection
par: Li, Zongyi, et autres
Publié: (2025)
par: Li, Zongyi, et autres
Publié: (2025)
Mitigating Shared-Private Branch Imbalance via Dual-Branch Rebalancing for Multimodal Sentiment Analysis
par: Meng, Chunlei, et autres
Publié: (2026)
par: Meng, Chunlei, et autres
Publié: (2026)
WDMIR: Wavelet-Driven Multimodal Intent Recognition
par: Gong, Weiyin, et autres
Publié: (2025)
par: Gong, Weiyin, et autres
Publié: (2025)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
par: Cheng, Zebang, et autres
Publié: (2024)
par: Cheng, Zebang, et autres
Publié: (2024)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
par: Liu, Shuhang, et autres
Publié: (2025)
par: Liu, Shuhang, et autres
Publié: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
Multimodal Emotion Recognition with Large Language Models
par: Zhang, Hongrui, et autres
Publié: (2026)
par: Zhang, Hongrui, et autres
Publié: (2026)
Revisiting Vision-Language Features Adaptation and Inconsistency for Social Media Popularity Prediction
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction
par: Chen, Zixuan, et autres
Publié: (2026)
par: Chen, Zixuan, et autres
Publié: (2026)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
par: Bai, Hayes, et autres
Publié: (2026)
par: Bai, Hayes, et autres
Publié: (2026)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
par: Yang, Xiaocui, et autres
Publié: (2024)
par: Yang, Xiaocui, et autres
Publié: (2024)
Multimodal Fusion via Hypergraph Autoencoder and Contrastive Learning for Emotion Recognition in Conversation
par: Yi, Zijian, et autres
Publié: (2024)
par: Yi, Zijian, et autres
Publié: (2024)
LungCURE: Benchmarking Multimodal Real-World Clinical Reasoning for Precision Lung Cancer Diagnosis and Treatment
par: Hao, Fangyu, et autres
Publié: (2026)
par: Hao, Fangyu, et autres
Publié: (2026)
Dual Knowledge-Enhanced Two-Stage Reasoner for Multimodal Dialog Systems
par: Chen, Xiaolin, et autres
Publié: (2025)
par: Chen, Xiaolin, et autres
Publié: (2025)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
par: Li, Mingxin, et autres
Publié: (2025)
par: Li, Mingxin, et autres
Publié: (2025)
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
par: Wang, Jianlu, et autres
Publié: (2025)
par: Wang, Jianlu, et autres
Publié: (2025)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
par: Zhang, Kangning, et autres
Publié: (2024)
par: Zhang, Kangning, et autres
Publié: (2024)
Can Large Language Models Help Multimodal Language Analysis? MMLA: A Comprehensive Benchmark
par: Zhang, Hanlei, et autres
Publié: (2025)
par: Zhang, Hanlei, et autres
Publié: (2025)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
par: Dai, Weichen, et autres
Publié: (2024)
par: Dai, Weichen, et autres
Publié: (2024)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
par: Zhao, Yu, et autres
Publié: (2025)
par: Zhao, Yu, et autres
Publié: (2025)
ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs
par: Cui, Shiyao, et autres
Publié: (2025)
par: Cui, Shiyao, et autres
Publié: (2025)
Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in Conversation
par: Lyu, Xiaosen, et autres
Publié: (2025)
par: Lyu, Xiaosen, et autres
Publié: (2025)
Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal Utterances
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
par: Hu, Pengfei, et autres
Publié: (2025)
par: Hu, Pengfei, et autres
Publié: (2025)
OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy Scenarios
par: Yuan, Ziqi, et autres
Publié: (2024)
par: Yuan, Ziqi, et autres
Publié: (2024)
State-Anchored Complete-View Distillation for Robust Conversational Multimodal Emotion Recognition
par: Pan, Zhaoyan, et autres
Publié: (2026)
par: Pan, Zhaoyan, et autres
Publié: (2026)
Ada2I: Enhancing Modality Balance for Multimodal Conversational Emotion Recognition
par: Nguyen, Cam-Van Thi, et autres
Publié: (2024)
par: Nguyen, Cam-Van Thi, et autres
Publié: (2024)
StePO-Rec: Towards Personalized Outfit Styling Assistant via Knowledge-Guided Multi-Step Reasoning
par: Bi, Yuxi, et autres
Publié: (2025)
par: Bi, Yuxi, et autres
Publié: (2025)
MORE-R1: Guiding LVLM for Multimodal Object-Entity Relation Extraction via Stepwise Reasoning with Reinforcement Learning
par: Yuan, Xiang, et autres
Publié: (2026)
par: Yuan, Xiang, et autres
Publié: (2026)
MAGNeT: Multimodal Adaptive Gaussian Networks for Intent Inference in Moving Target Selection across Complex Scenarios
par: Li, Xiangxian, et autres
Publié: (2025)
par: Li, Xiangxian, et autres
Publié: (2025)
MAR3: Multi-Agent Recognition, Reasoning, and Reflection for Reference Audio-Visual Segmentation
par: Zhao, Yuan, et autres
Publié: (2026)
par: Zhao, Yuan, et autres
Publié: (2026)
Deconfounded Reasoning for Multimodal Fake News Detection via Causal Intervention
par: Liu, Moyang, et autres
Publié: (2025)
par: Liu, Moyang, et autres
Publié: (2025)
Documents similaires
-
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2026) -
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2025) -
Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2023) -
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
par: Zhang, Hanlei, et autres
Publié: (2024) -
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
par: Zhang, Hanlei, et autres
Publié: (2024)