Mitigating Multimodal Inconsistency via Cognitive Dual-Pathway Reasoning for Intent Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yifan, Wang, Peiwu, Chi, Yunxian, Gou, Zhinan, Gao, Kai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026)
por: Zhou, Qianrui, et al.
Publicado: (2026)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2025)
por: Zhou, Qianrui, et al.
Publicado: (2025)
Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2023)
por: Zhou, Qianrui, et al.
Publicado: (2023)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
por: Wang, Bingbing, et al.
Publicado: (2025)
por: Wang, Bingbing, et al.
Publicado: (2025)
InconVAD: A Two-Stage Dual-Tower Framework for Multimodal Emotion Inconsistency Detection
por: Li, Zongyi, et al.
Publicado: (2025)
por: Li, Zongyi, et al.
Publicado: (2025)
Mitigating Shared-Private Branch Imbalance via Dual-Branch Rebalancing for Multimodal Sentiment Analysis
por: Meng, Chunlei, et al.
Publicado: (2026)
por: Meng, Chunlei, et al.
Publicado: (2026)
WDMIR: Wavelet-Driven Multimodal Intent Recognition
por: Gong, Weiyin, et al.
Publicado: (2025)
por: Gong, Weiyin, et al.
Publicado: (2025)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
por: Cheng, Zebang, et al.
Publicado: (2024)
por: Cheng, Zebang, et al.
Publicado: (2024)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
por: Liu, Shuhang, et al.
Publicado: (2025)
por: Liu, Shuhang, et al.
Publicado: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
por: Ma, Chenghao, et al.
Publicado: (2025)
por: Ma, Chenghao, et al.
Publicado: (2025)
Multimodal Emotion Recognition with Large Language Models
por: Zhang, Hongrui, et al.
Publicado: (2026)
por: Zhang, Hongrui, et al.
Publicado: (2026)
Revisiting Vision-Language Features Adaptation and Inconsistency for Social Media Popularity Prediction
por: Hsu, Chih-Chung, et al.
Publicado: (2024)
por: Hsu, Chih-Chung, et al.
Publicado: (2024)
AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction
por: Chen, Zixuan, et al.
Publicado: (2026)
por: Chen, Zixuan, et al.
Publicado: (2026)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
por: Che, Xinyi, et al.
Publicado: (2025)
por: Che, Xinyi, et al.
Publicado: (2025)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
por: Bai, Hayes, et al.
Publicado: (2026)
por: Bai, Hayes, et al.
Publicado: (2026)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
por: Che, Xinyi, et al.
Publicado: (2025)
por: Che, Xinyi, et al.
Publicado: (2025)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
por: Yang, Xiaocui, et al.
Publicado: (2024)
por: Yang, Xiaocui, et al.
Publicado: (2024)
Multimodal Fusion via Hypergraph Autoencoder and Contrastive Learning for Emotion Recognition in Conversation
por: Yi, Zijian, et al.
Publicado: (2024)
por: Yi, Zijian, et al.
Publicado: (2024)
LungCURE: Benchmarking Multimodal Real-World Clinical Reasoning for Precision Lung Cancer Diagnosis and Treatment
por: Hao, Fangyu, et al.
Publicado: (2026)
por: Hao, Fangyu, et al.
Publicado: (2026)
Dual Knowledge-Enhanced Two-Stage Reasoner for Multimodal Dialog Systems
por: Chen, Xiaolin, et al.
Publicado: (2025)
por: Chen, Xiaolin, et al.
Publicado: (2025)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
por: Li, Mingxin, et al.
Publicado: (2025)
por: Li, Mingxin, et al.
Publicado: (2025)
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
por: Wang, Jianlu, et al.
Publicado: (2025)
por: Wang, Jianlu, et al.
Publicado: (2025)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
por: Zhang, Kangning, et al.
Publicado: (2024)
por: Zhang, Kangning, et al.
Publicado: (2024)
Can Large Language Models Help Multimodal Language Analysis? MMLA: A Comprehensive Benchmark
por: Zhang, Hanlei, et al.
Publicado: (2025)
por: Zhang, Hanlei, et al.
Publicado: (2025)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
por: Dai, Weichen, et al.
Publicado: (2024)
por: Dai, Weichen, et al.
Publicado: (2024)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
por: Zhao, Yu, et al.
Publicado: (2025)
por: Zhao, Yu, et al.
Publicado: (2025)
ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs
por: Cui, Shiyao, et al.
Publicado: (2025)
por: Cui, Shiyao, et al.
Publicado: (2025)
Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in Conversation
por: Lyu, Xiaosen, et al.
Publicado: (2025)
por: Lyu, Xiaosen, et al.
Publicado: (2025)
Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal Utterances
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
por: Hu, Pengfei, et al.
Publicado: (2025)
por: Hu, Pengfei, et al.
Publicado: (2025)
OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy Scenarios
por: Yuan, Ziqi, et al.
Publicado: (2024)
por: Yuan, Ziqi, et al.
Publicado: (2024)
State-Anchored Complete-View Distillation for Robust Conversational Multimodal Emotion Recognition
por: Pan, Zhaoyan, et al.
Publicado: (2026)
por: Pan, Zhaoyan, et al.
Publicado: (2026)
Ada2I: Enhancing Modality Balance for Multimodal Conversational Emotion Recognition
por: Nguyen, Cam-Van Thi, et al.
Publicado: (2024)
por: Nguyen, Cam-Van Thi, et al.
Publicado: (2024)
StePO-Rec: Towards Personalized Outfit Styling Assistant via Knowledge-Guided Multi-Step Reasoning
por: Bi, Yuxi, et al.
Publicado: (2025)
por: Bi, Yuxi, et al.
Publicado: (2025)
MORE-R1: Guiding LVLM for Multimodal Object-Entity Relation Extraction via Stepwise Reasoning with Reinforcement Learning
por: Yuan, Xiang, et al.
Publicado: (2026)
por: Yuan, Xiang, et al.
Publicado: (2026)
MAGNeT: Multimodal Adaptive Gaussian Networks for Intent Inference in Moving Target Selection across Complex Scenarios
por: Li, Xiangxian, et al.
Publicado: (2025)
por: Li, Xiangxian, et al.
Publicado: (2025)
MAR3: Multi-Agent Recognition, Reasoning, and Reflection for Reference Audio-Visual Segmentation
por: Zhao, Yuan, et al.
Publicado: (2026)
por: Zhao, Yuan, et al.
Publicado: (2026)
Deconfounded Reasoning for Multimodal Fake News Detection via Causal Intervention
por: Liu, Moyang, et al.
Publicado: (2025)
por: Liu, Moyang, et al.
Publicado: (2025)
Ejemplares similares
-
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026) -
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2025) -
Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2023) -
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
por: Zhang, Hanlei, et al.
Publicado: (2024) -
MIntRec2.0: A Large-scale Benchmark Dataset for Multimodal Intent Recognition and Out-of-scope Detection in Conversations
por: Zhang, Hanlei, et al.
Publicado: (2024)