Audio-Visual Compound Expression Recognition Method based on Late Modality Fusion and Rule-based Decision
Fuente:
arXiv
Saved in:
| Main Authors: | Ryumina, Elena, Markitantov, Maxim, Ryumin, Dmitry, Kaya, Heysem, Karpov, Alexey |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Team RAS in 9th ABAW Competition: Multimodal Compound Expression Recognition Approach
by: Ryumina, Elena, et al.
Published: (2025)
by: Ryumina, Elena, et al.
Published: (2025)
Team RAS in 10th ABAW Competition: Multimodal Valence and Arousal Estimation Approach
by: Ryumina, Elena, et al.
Published: (2026)
by: Ryumina, Elena, et al.
Published: (2026)
SUN Team's Contribution to ABAW 2024 Competition: Audio-visual Valence-Arousal Estimation and Expression Recognition
by: Dresvyanskiy, Denis, et al.
Published: (2024)
by: Dresvyanskiy, Denis, et al.
Published: (2024)
Team LEYA in 10th ABAW Competition: Multimodal Ambivalence/Hesitancy Recognition Approach
by: Ryumina, Elena, et al.
Published: (2026)
by: Ryumina, Elena, et al.
Published: (2026)
Developing a foundation model for high-resolution remote sensing data of the Netherlands
by: Vermeeren, Paul, et al.
Published: (2026)
by: Vermeeren, Paul, et al.
Published: (2026)
Inconsistency-Aware Cross-Attention for Audio-Visual Fusion in Dimensional Emotion Recognition
by: Rajasekhar, G, et al.
Published: (2024)
by: Rajasekhar, G, et al.
Published: (2024)
Multi Loss-based Feature Fusion and Top Two Voting Ensemble Decision Strategy for Facial Expression Recognition in the Wild
by: Zhou, Guangyao, et al.
Published: (2023)
by: Zhou, Guangyao, et al.
Published: (2023)
Zero-shot Compound Expression Recognition with Visual Language Model at the 6th ABAW Challenge
by: Wang, Jiahe, et al.
Published: (2024)
by: Wang, Jiahe, et al.
Published: (2024)
Residual Cross-Modal Fusion Networks for Audio-Visual Navigation
by: Wang, Yi, et al.
Published: (2026)
by: Wang, Yi, et al.
Published: (2026)
MMME: A Spontaneous Multi-Modal Micro-Expression Dataset Enabling Visual-Physiological Fusion
by: Ma, Chuang, et al.
Published: (2025)
by: Ma, Chuang, et al.
Published: (2025)
7ABAW-Compound Expression Recognition via Curriculum Learning
by: Liu, Chen, et al.
Published: (2025)
by: Liu, Chen, et al.
Published: (2025)
Dynamic Inter-Class Confusion-Aware Encoder for Audio-Visual Fusion in Human Activity Recognition
by: Cong, Kaixuan, et al.
Published: (2025)
by: Cong, Kaixuan, et al.
Published: (2025)
Efficient Audio-Visual Fusion for Video Classification
by: Awan, Mahrukh, et al.
Published: (2024)
by: Awan, Mahrukh, et al.
Published: (2024)
A Robust Camera-based Method for Breath Rate Measurement
by: Protopopov, Alexey
Published: (2025)
by: Protopopov, Alexey
Published: (2025)
Compound Expression Recognition via Multi Model Ensemble
by: Yu, Jun, et al.
Published: (2024)
by: Yu, Jun, et al.
Published: (2024)
Emotic Masked Autoencoder with Attention Fusion for Facial Expression Recognition
by: Nguyen-Xuan, Bach, et al.
Published: (2024)
by: Nguyen-Xuan, Bach, et al.
Published: (2024)
7th ABAW Competition: Multi-Task Learning and Compound Expression Recognition
by: Kollias, Dimitrios, et al.
Published: (2024)
by: Kollias, Dimitrios, et al.
Published: (2024)
Compound Expression Recognition via Multi Model Ensemble for the ABAW7 Challenge
by: Liu, Xuxiong, et al.
Published: (2024)
by: Liu, Xuxiong, et al.
Published: (2024)
Open-Set Video-based Facial Expression Recognition with Human Expression-sensitive Prompting
by: Liu, Yuanyuan, et al.
Published: (2024)
by: Liu, Yuanyuan, et al.
Published: (2024)
Towards Omnimodal Expressions and Reasoning in Referring Audio-Visual Segmentation
by: Ying, Kaining, et al.
Published: (2025)
by: Ying, Kaining, et al.
Published: (2025)
CLEAR: Character Unlearning in Textual and Visual Modalities
by: Dontsov, Alexey, et al.
Published: (2024)
by: Dontsov, Alexey, et al.
Published: (2024)
AlignVSR: Audio-Visual Cross-Modal Alignment for Visual Speech Recognition
by: Liu, Zehua, et al.
Published: (2024)
by: Liu, Zehua, et al.
Published: (2024)
A Lightweight Attention-based Deep Network via Multi-Scale Feature Fusion for Multi-View Facial Expression Recognition
by: Ezati, Ali, et al.
Published: (2024)
by: Ezati, Ali, et al.
Published: (2024)
Fuzzy Rank-based Late Fusion Technique for Cytology image Segmentation
by: Dey, Soumyajyoti, et al.
Published: (2024)
by: Dey, Soumyajyoti, et al.
Published: (2024)
Textualized and Feature-based Models for Compound Multimodal Emotion Recognition in the Wild
by: Richet, Nicolas, et al.
Published: (2024)
by: Richet, Nicolas, et al.
Published: (2024)
Compound Expression Recognition via Large Vision-Language Models
by: Yu, Jun, et al.
Published: (2025)
by: Yu, Jun, et al.
Published: (2025)
ViCocktail: Automated Multi-Modal Data Collection for Vietnamese Audio-Visual Speech Recognition
by: Nguyen, Thai-Binh, et al.
Published: (2025)
by: Nguyen, Thai-Binh, et al.
Published: (2025)
Tri-Modal Fusion Transformers for UAV-based Object Detection
by: Iaboni, Craig, et al.
Published: (2026)
by: Iaboni, Craig, et al.
Published: (2026)
Audio-Guided Visual Editing with Complex Multi-Modal Prompts
by: Kim, Hyeonyu, et al.
Published: (2025)
by: Kim, Hyeonyu, et al.
Published: (2025)
LINK: Adaptive Modality Interaction for Audio-Visual Video Parsing
by: Wang, Langyu, et al.
Published: (2024)
by: Wang, Langyu, et al.
Published: (2024)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
by: Yu, Li, et al.
Published: (2024)
by: Yu, Li, et al.
Published: (2024)
Micro-Expression Recognition by Motion Feature Extraction based on Pre-training
by: Li, Ruolin, et al.
Published: (2024)
by: Li, Ruolin, et al.
Published: (2024)
A Two-Stage Dual-Modality Model for Facial Emotional Expression Recognition
by: Sun, Jiajun, et al.
Published: (2026)
by: Sun, Jiajun, et al.
Published: (2026)
Multi-Task Multi-Modal Self-Supervised Learning for Facial Expression Recognition
by: Halawa, Marah, et al.
Published: (2024)
by: Halawa, Marah, et al.
Published: (2024)
JEAN: Joint Expression and Audio-guided NeRF-based Talking Face Generation
by: Chakkera, Sai Tanmay Reddy, et al.
Published: (2024)
by: Chakkera, Sai Tanmay Reddy, et al.
Published: (2024)
Audio-Visual Person Verification based on Recursive Fusion of Joint Cross-Attention
by: Praveen, R. Gnana, et al.
Published: (2024)
by: Praveen, R. Gnana, et al.
Published: (2024)
Attend-Fusion: Efficient Audio-Visual Fusion for Video Classification
by: Awan, Mahrukh, et al.
Published: (2024)
by: Awan, Mahrukh, et al.
Published: (2024)
Unsupervised Audio-Visual Segmentation with Modality Alignment
by: Bhosale, Swapnil, et al.
Published: (2024)
by: Bhosale, Swapnil, et al.
Published: (2024)
CMFN: Cross-Modal Fusion Network for Irregular Scene Text Recognition
by: Zheng, Jinzhi, et al.
Published: (2024)
by: Zheng, Jinzhi, et al.
Published: (2024)
Cross-Modal Binary Attention: An Energy-Efficient Fusion Framework for Audio-Visual Learning
by: Saleh, Mohamed, et al.
Published: (2026)
by: Saleh, Mohamed, et al.
Published: (2026)
Similar Items
-
Team RAS in 9th ABAW Competition: Multimodal Compound Expression Recognition Approach
by: Ryumina, Elena, et al.
Published: (2025) -
Team RAS in 10th ABAW Competition: Multimodal Valence and Arousal Estimation Approach
by: Ryumina, Elena, et al.
Published: (2026) -
SUN Team's Contribution to ABAW 2024 Competition: Audio-visual Valence-Arousal Estimation and Expression Recognition
by: Dresvyanskiy, Denis, et al.
Published: (2024) -
Team LEYA in 10th ABAW Competition: Multimodal Ambivalence/Hesitancy Recognition Approach
by: Ryumina, Elena, et al.
Published: (2026) -
Developing a foundation model for high-resolution remote sensing data of the Netherlands
by: Vermeeren, Paul, et al.
Published: (2026)