Cross-Attention is Not Always Needed: Dynamic Cross-Attention for Audio-Visual Dimensional Emotion Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Praveen, R. Gnana, Alam, Jahangir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Recursive Joint Cross-Modal Attention for Multimodal Fusion in Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
Dynamic Cross Attention for Audio-Visual Person Verification
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
Audio-Visual Person Verification based on Recursive Fusion of Joint Cross-Attention
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
Inconsistency-Aware Cross-Attention for Audio-Visual Fusion in Dimensional Emotion Recognition
di: Rajasekhar, G, et al.
Pubblicazione: (2024)
di: Rajasekhar, G, et al.
Pubblicazione: (2024)
Cross Attentional Audio-Visual Fusion for Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2021)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2021)
United we stand, Divided we fall: Handling Weak Complementary Relationships for Audio-Visual Emotion Recognition in Valence-Arousal Space
di: Praveen, R. Gnana, et al.
Pubblicazione: (2025)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2025)
SSAVSV: Towards Unified Model for Self-Supervised Audio-Visual Speaker Verification
di: Rajasekhar, Gnana Praveen, et al.
Pubblicazione: (2025)
di: Rajasekhar, Gnana Praveen, et al.
Pubblicazione: (2025)
A Joint Cross-Attention Model for Audio-Visual Fusion in Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2022)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2022)
CA^2ST: Cross-Attention in Audio, Space, and Time for Holistic Video Recognition
di: Lee, Jongseo, et al.
Pubblicazione: (2025)
di: Lee, Jongseo, et al.
Pubblicazione: (2025)
Multimodal Emotion Recognition via Bi-directional Cross-Attention and Temporal Modeling
di: Byeon, Junhyeong, et al.
Pubblicazione: (2026)
di: Byeon, Junhyeong, et al.
Pubblicazione: (2026)
MCN-CL: Multimodal Cross-Attention Network and Contrastive Learning for Multimodal Emotion Recognition
di: Li, Feng, et al.
Pubblicazione: (2025)
di: Li, Feng, et al.
Pubblicazione: (2025)
Multimodal Emotion Recognition using Audio-Video Transformer Fusion with Cross Attention
di: R, Joe Dhanith P, et al.
Pubblicazione: (2024)
di: R, Joe Dhanith P, et al.
Pubblicazione: (2024)
Deep Domain Adaptation for Ordinal Regression of Pain Intensity Estimation Using Weakly-Labelled Videos
di: Praveen, R. Gnana, et al.
Pubblicazione: (2020)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2020)
Weakly Supervised Learning for Facial Affective Behavior Analysis : A Review
di: Praveen, R. Gnana, et al.
Pubblicazione: (2021)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2021)
Deep Weakly-Supervised Domain Adaptation for Pain Localization in Videos
di: Praveen, R. Gnana, et al.
Pubblicazione: (2019)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2019)
Always Skip Attention
di: Ji, Yiping, et al.
Pubblicazione: (2025)
di: Ji, Yiping, et al.
Pubblicazione: (2025)
CAST: Cross-Attention in Space and Time for Video Action Recognition
di: Lee, Dongho, et al.
Pubblicazione: (2023)
di: Lee, Dongho, et al.
Pubblicazione: (2023)
X-AVDT: Audio-Visual Cross-Attention for Robust Deepfake Detection
di: Kim, Youngseo, et al.
Pubblicazione: (2026)
di: Kim, Youngseo, et al.
Pubblicazione: (2026)
Graph-Attention Network with Adversarial Domain Alignment for Robust Cross-Domain Facial Expression Recognition
di: Ghaedi, Razieh, et al.
Pubblicazione: (2025)
di: Ghaedi, Razieh, et al.
Pubblicazione: (2025)
Cross-Modal Binary Attention: An Energy-Efficient Fusion Framework for Audio-Visual Learning
di: Saleh, Mohamed, et al.
Pubblicazione: (2026)
di: Saleh, Mohamed, et al.
Pubblicazione: (2026)
Token Coordinated Prompt Attention is Needed for Visual Prompting
di: Liu, Zichen, et al.
Pubblicazione: (2025)
di: Liu, Zichen, et al.
Pubblicazione: (2025)
Contextual Cross-Modal Attention for Audio-Visual Deepfake Detection and Localization
di: Katamneni, Vinaya Sree, et al.
Pubblicazione: (2024)
di: Katamneni, Vinaya Sree, et al.
Pubblicazione: (2024)
Soft Knowledge Distillation with Multi-Dimensional Cross-Net Attention for Image Restoration Models Compression
di: Zhang, Yongheng, et al.
Pubblicazione: (2025)
di: Zhang, Yongheng, et al.
Pubblicazione: (2025)
Knowledge-Aligned Counterfactual-Enhancement Diffusion Perception for Unsupervised Cross-Domain Visual Emotion Recognition
di: Yin, Wen, et al.
Pubblicazione: (2025)
di: Yin, Wen, et al.
Pubblicazione: (2025)
CATFace: Cross-Attribute-Guided Transformer with Self-Attention Distillation for Low-Quality Face Recognition
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
MAVR-Net: Robust Multi-View Learning for MAV Action Recognition with Cross-View Attention
di: Zhang, Nengbo, et al.
Pubblicazione: (2025)
di: Zhang, Nengbo, et al.
Pubblicazione: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Cross-modulated Attention Transformer for RGBT Tracking
di: Xiao, Yun, et al.
Pubblicazione: (2024)
di: Xiao, Yun, et al.
Pubblicazione: (2024)
Gated Cross-Attention Network for Depth Completion
di: Jia, Xiaogang, et al.
Pubblicazione: (2023)
di: Jia, Xiaogang, et al.
Pubblicazione: (2023)
Robust Scene Change Detection Using Visual Foundation Models and Cross-Attention Mechanisms
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
di: Lin, Chun-Jung, et al.
Pubblicazione: (2024)
Cognitive-Inspired Hierarchical Attention Fusion With Visual and Textual for Cross-Domain Sequential Recommendation
di: Wu, Wangyu, et al.
Pubblicazione: (2025)
di: Wu, Wangyu, et al.
Pubblicazione: (2025)
DBAT: Dynamic Backward Attention Transformer for Material Segmentation with Cross-Resolution Patches
di: Heng, Yuwen, et al.
Pubblicazione: (2023)
di: Heng, Yuwen, et al.
Pubblicazione: (2023)
VAEER: Visual Attention-Inspired Emotion Elicitation Reasoning
di: Man, Fanhang, et al.
Pubblicazione: (2025)
di: Man, Fanhang, et al.
Pubblicazione: (2025)
Detail-Enhanced Intra- and Inter-modal Interaction for Audio-Visual Emotion Recognition
di: Shi, Tong, et al.
Pubblicazione: (2024)
di: Shi, Tong, et al.
Pubblicazione: (2024)
Enhancing Tea Leaf Disease Recognition with Attention Mechanisms and Grad-CAM Visualization
di: Shikdar, Omar Faruq, et al.
Pubblicazione: (2025)
di: Shikdar, Omar Faruq, et al.
Pubblicazione: (2025)
Cross-Attention Fusion of Visual and Geometric Features for Large Vocabulary Arabic Lipreading
di: Daou, Samar, et al.
Pubblicazione: (2024)
di: Daou, Samar, et al.
Pubblicazione: (2024)
Emotion Recognition with Facial Attention and Objective Activation Functions
di: Miskow, Andrzej, et al.
Pubblicazione: (2024)
di: Miskow, Andrzej, et al.
Pubblicazione: (2024)
Spatial Hierarchy and Temporal Attention Guided Cross Masking for Self-supervised Skeleton-based Action Recognition
di: Yin, Xinpeng, et al.
Pubblicazione: (2024)
di: Yin, Xinpeng, et al.
Pubblicazione: (2024)
Cross-domain EEG-based Emotion Recognition with Contrastive Learning
di: Yan, Rui, et al.
Pubblicazione: (2025)
di: Yan, Rui, et al.
Pubblicazione: (2025)
WiFi-based Cross-Domain Gesture Recognition Using Attention Mechanism
di: Liu, Ruijing, et al.
Pubblicazione: (2025)
di: Liu, Ruijing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Recursive Joint Cross-Modal Attention for Multimodal Fusion in Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024) -
Dynamic Cross Attention for Audio-Visual Person Verification
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024) -
Audio-Visual Person Verification based on Recursive Fusion of Joint Cross-Attention
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024) -
Inconsistency-Aware Cross-Attention for Audio-Visual Fusion in Dimensional Emotion Recognition
di: Rajasekhar, G, et al.
Pubblicazione: (2024) -
Cross Attentional Audio-Visual Fusion for Dimensional Emotion Recognition
di: Praveen, R. Gnana, et al.
Pubblicazione: (2021)