From Coarse to Nuanced: Cross-Modal Alignment of Fine-Grained Linguistic Cues and Visual Salient Regions for Dynamic Emotion Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yu, Qu, Leyuan, Shi, Hanlei, Gao, Di, Zheng, Yuhua, Li, Taihao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Think-Before-Draw: Decomposing Emotion Semantics & Fine-Grained Controllable Expressive Talking Head Generation
di: Shi, Hanlei, et al.
Pubblicazione: (2025)
di: Shi, Hanlei, et al.
Pubblicazione: (2025)
Follow the Clues, Frame the Truth: Hybrid-evidential Deductive Reasoning in Open-Vocabulary Multimodal Emotion Recognition
di: Liu, Yu, et al.
Pubblicazione: (2026)
di: Liu, Yu, et al.
Pubblicazione: (2026)
Centering Emotion Hotspots: Multimodal Local-Global Fusion and Cross-Modal Alignment for Emotion Recognition in Conversations
di: Liu, Yu, et al.
Pubblicazione: (2025)
di: Liu, Yu, et al.
Pubblicazione: (2025)
EMORL-TTS: Reinforcement Learning for Fine-Grained Emotion Control in LLM-based TTS
di: Li, Haoxun, et al.
Pubblicazione: (2025)
di: Li, Haoxun, et al.
Pubblicazione: (2025)
FIRMED: A Peak-Centered Multimodal Dataset with Fine-Grained Annotation for Emotion Recognition
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
CMCRD: Cross-Modal Contrastive Representation Distillation for Emotion Recognition
di: Kan, Siyuan, et al.
Pubblicazione: (2025)
di: Kan, Siyuan, et al.
Pubblicazione: (2025)
MSF-SER: Enriching Acoustic Modeling with Multi-Granularity Semantics for Speech Emotion Recognition
di: Li, Haoxun, et al.
Pubblicazione: (2025)
di: Li, Haoxun, et al.
Pubblicazione: (2025)
Speejis: Enhancing User Experience of Mobile Voice Messaging with Automatic Visual Speech Emotion Cues
di: Aslan, Ilhan, et al.
Pubblicazione: (2025)
di: Aslan, Ilhan, et al.
Pubblicazione: (2025)
VCEMO: Multi-Modal Emotion Recognition for Chinese Voiceprints
di: Tang, Jinghua, et al.
Pubblicazione: (2024)
di: Tang, Jinghua, et al.
Pubblicazione: (2024)
Joint Contrastive Learning with Feature Alignment for Cross-Corpus EEG-based Emotion Recognition
di: Liu, Qile, et al.
Pubblicazione: (2024)
di: Liu, Qile, et al.
Pubblicazione: (2024)
Hypergraph Multi-Modal Learning for EEG-based Emotion Recognition in Conversation
di: Kang, Zijian, et al.
Pubblicazione: (2025)
di: Kang, Zijian, et al.
Pubblicazione: (2025)
Unmasking the Nuances of Loneliness: Using Digital Biomarkers to Understand Social and Emotional Loneliness in College Students
di: Qirtas, Malik Muhammad, et al.
Pubblicazione: (2024)
di: Qirtas, Malik Muhammad, et al.
Pubblicazione: (2024)
Mood as a Contextual Cue for Improved Emotion Inference
di: Narayana, Soujanya, et al.
Pubblicazione: (2024)
di: Narayana, Soujanya, et al.
Pubblicazione: (2024)
Towards LLM-Empowered Fine-Grained Speech Descriptors for Explainable Emotion Recognition
di: Chen, Youjun, et al.
Pubblicazione: (2025)
di: Chen, Youjun, et al.
Pubblicazione: (2025)
Improving Multimodal Emotion Recognition by Leveraging Acoustic Adaptation and Visual Alignment
di: Zhao, Zhixian, et al.
Pubblicazione: (2024)
di: Zhao, Zhixian, et al.
Pubblicazione: (2024)
MER 2026: From Discriminative Emotion Recognition to Generative Emotion Understanding
di: Lian, Zheng, et al.
Pubblicazione: (2026)
di: Lian, Zheng, et al.
Pubblicazione: (2026)
Pioneering Multimodal Emotion Recognition in the Era of Large Models: From Closed Sets to Open Vocabularies
di: Han, Jing, et al.
Pubblicazione: (2025)
di: Han, Jing, et al.
Pubblicazione: (2025)
AV-EmoDialog: Chat with Audio-Visual Users Leveraging Emotional Cues
di: Park, Se Jin, et al.
Pubblicazione: (2024)
di: Park, Se Jin, et al.
Pubblicazione: (2024)
Adaptive Captioning with Emotional Cues: Supporting DHH and Neurodivergent Learners in STEM
di: Ubur, Sunday David, et al.
Pubblicazione: (2026)
di: Ubur, Sunday David, et al.
Pubblicazione: (2026)
Automatically Detecting Confusion and Conflict During Collaborative Learning Using Linguistic, Prosodic, and Facial Cues
di: Ma, Yingbo, et al.
Pubblicazione: (2024)
di: Ma, Yingbo, et al.
Pubblicazione: (2024)
Reading Between the Lines: How Electronic Nonverbal Cues shape Emotion Decoding
di: Kumar, Taara, et al.
Pubblicazione: (2026)
di: Kumar, Taara, et al.
Pubblicazione: (2026)
Cross-Subject EEG Emotion Recognition Based on Temporal Asynchronous Alignment Contrastive Learning
di: Xie, Ying, et al.
Pubblicazione: (2026)
di: Xie, Ying, et al.
Pubblicazione: (2026)
Enhancing Cross-Dataset EEG Emotion Recognition: A Novel Approach with Emotional EEG Style Transfer Network
di: Zhou, Yijin, et al.
Pubblicazione: (2024)
di: Zhou, Yijin, et al.
Pubblicazione: (2024)
Augmenting Captions with Emotional Cues: An AR Interface for Real-Time Accessible Communication
di: Ubur, Sunday David
Pubblicazione: (2025)
di: Ubur, Sunday David
Pubblicazione: (2025)
VicSim: Enhancing Victim Simulation with Emotional and Linguistic Fidelity
di: Li, Yerong, et al.
Pubblicazione: (2025)
di: Li, Yerong, et al.
Pubblicazione: (2025)
Beyond the Portal: Enhancing Recognition in Virtual Reality Through Multisensory Cues
di: Bak, Siyeon, et al.
Pubblicazione: (2025)
di: Bak, Siyeon, et al.
Pubblicazione: (2025)
Rank-O-ToM: Unlocking Emotional Nuance Ranking to Enhance Affective Theory-of-Mind
di: Kim, JiHyun, et al.
Pubblicazione: (2025)
di: Kim, JiHyun, et al.
Pubblicazione: (2025)
DECAN: A Denoising Encoder via Contrastive Alignment Network for Dry Electrode EEG Emotion Recognition
di: Zhang, Meihong, et al.
Pubblicazione: (2024)
di: Zhang, Meihong, et al.
Pubblicazione: (2024)
Emotion-Disentangled Embedding Alignment for Noise-Robust and Cross-Corpus Speech Emotion Recognition
di: Tiwari, Upasana, et al.
Pubblicazione: (2025)
di: Tiwari, Upasana, et al.
Pubblicazione: (2025)
A Joint Cross-Attention Model for Audio-Visual Fusion in Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2022)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2022)
SDA-DDA Semi-supervised Domain Adaptation with Dynamic Distribution Alignment Network For Emotion Recognition Using EEG Signals
di: Tang, Jiahao
Pubblicazione: (2025)
di: Tang, Jiahao
Pubblicazione: (2025)
Chart What I Say: Exploring Cross-Modality Prompt Alignment in AI-Assisted Chart Authoring
di: Ponochevnyi, Nazar, et al.
Pubblicazione: (2024)
di: Ponochevnyi, Nazar, et al.
Pubblicazione: (2024)
An Audio-Visual Fusion Emotion Generation Model Based on Neuroanatomical Alignment
di: Wang, Haidong, et al.
Pubblicazione: (2025)
di: Wang, Haidong, et al.
Pubblicazione: (2025)
EgoLog: Ego-Centric Fine-Grained Daily Log with Ubiquitous Wearables
di: He, Lixing, et al.
Pubblicazione: (2025)
di: He, Lixing, et al.
Pubblicazione: (2025)
I'm Fine, But My Voice Isn't: Cross-Modal Affective Dissonance Detection for Reflective Journaling
di: Lee, Sumin
Pubblicazione: (2026)
di: Lee, Sumin
Pubblicazione: (2026)
Cross-Task Inconsistency Based Active Learning (CTIAL) for Emotion Recognition
di: Xu, Yifan, et al.
Pubblicazione: (2024)
di: Xu, Yifan, et al.
Pubblicazione: (2024)
Evaluating the Efficacy of Large Language Models for Generating Fine-Grained Visual Privacy Policies in Homes
di: Zhang, Shuning, et al.
Pubblicazione: (2025)
di: Zhang, Shuning, et al.
Pubblicazione: (2025)
Anger Speaks Louder? Exploring the Effects of AI Nonverbal Emotional Cues on Human Decision Certainty in Moral Dilemmas
di: Zhang, Chenyi, et al.
Pubblicazione: (2024)
di: Zhang, Chenyi, et al.
Pubblicazione: (2024)
From Chatbots to Confidants: A Cross-Cultural Study of LLM Adoption for Emotional Support
di: Amat-Lefort, Natalia, et al.
Pubblicazione: (2026)
di: Amat-Lefort, Natalia, et al.
Pubblicazione: (2026)
SDC-Net: A Domain Adaptation Framework with Semantic-Dynamic Consistency for Cross-Subject EEG Emotion Recognition
di: Tang, Jiahao, et al.
Pubblicazione: (2025)
di: Tang, Jiahao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Think-Before-Draw: Decomposing Emotion Semantics & Fine-Grained Controllable Expressive Talking Head Generation
di: Shi, Hanlei, et al.
Pubblicazione: (2025) -
Follow the Clues, Frame the Truth: Hybrid-evidential Deductive Reasoning in Open-Vocabulary Multimodal Emotion Recognition
di: Liu, Yu, et al.
Pubblicazione: (2026) -
Centering Emotion Hotspots: Multimodal Local-Global Fusion and Cross-Modal Alignment for Emotion Recognition in Conversations
di: Liu, Yu, et al.
Pubblicazione: (2025) -
EMORL-TTS: Reinforcement Learning for Fine-Grained Emotion Control in LLM-based TTS
di: Li, Haoxun, et al.
Pubblicazione: (2025) -
FIRMED: A Peak-Centered Multimodal Dataset with Fine-Grained Annotation for Emotion Recognition
di: Tang, Hao, et al.
Pubblicazione: (2025)