Emotion Recognition Using Transformers with Masked Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Min, Seongjae, Yang, Junseok, Lim, Sangjun, Lee, Junyong, Lee, Sangwon, Lim, Sejoon |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multimodal Emotion Recognition via Bi-directional Cross-Attention and Temporal Modeling
di: Byeon, Junhyeong, et al.
Pubblicazione: (2026)
di: Byeon, Junhyeong, et al.
Pubblicazione: (2026)
CD-FKD: Cross-Domain Feature Knowledge Distillation for Robust Single-Domain Generalization in Object Detection
di: Lee, Junseok, et al.
Pubblicazione: (2026)
di: Lee, Junseok, et al.
Pubblicazione: (2026)
Mitigating Resolution-Drift in Federated Learning: Case of Keypoint Detection
di: Lim, Taeheon, et al.
Pubblicazione: (2025)
di: Lim, Taeheon, et al.
Pubblicazione: (2025)
VideoMaMa: Mask-Guided Video Matting via Generative Prior
di: Lim, Sangbeom, et al.
Pubblicazione: (2026)
di: Lim, Sangbeom, et al.
Pubblicazione: (2026)
MGHFT: Multi-Granularity Hierarchical Fusion Transformer for Cross-Modal Sticker Emotion Recognition
di: Chen, Jian, et al.
Pubblicazione: (2025)
di: Chen, Jian, et al.
Pubblicazione: (2025)
Localized Concept Erasure for Text-to-Image Diffusion Models Using Training-Free Gated Low-Rank Adaptation
di: Lee, Byung Hyun, et al.
Pubblicazione: (2025)
di: Lee, Byung Hyun, et al.
Pubblicazione: (2025)
Mosaic: Compositional Multi-Concept Erasure via Vector Field Blending
di: Ko, Junseok, et al.
Pubblicazione: (2026)
di: Ko, Junseok, et al.
Pubblicazione: (2026)
Open Set Recognition for Endoscopic Image Classification: A Deep Learning Approach on the Kvasir Dataset
di: Moazzami, Kasra, et al.
Pubblicazione: (2025)
di: Moazzami, Kasra, et al.
Pubblicazione: (2025)
Ordering Matters: Rank-Aware Selective Fusion for Blended Emotion Recognition
di: Lee, Junghyun, et al.
Pubblicazione: (2026)
di: Lee, Junghyun, et al.
Pubblicazione: (2026)
Distance-aware Soft Prompt Learning for Multimodal Valence-Arousal Estimation
di: Jung, Byeongjin, et al.
Pubblicazione: (2026)
di: Jung, Byeongjin, et al.
Pubblicazione: (2026)
Facial Expression Recognition Using Residual Masking Network
di: Pham, Luan, et al.
Pubblicazione: (2026)
di: Pham, Luan, et al.
Pubblicazione: (2026)
EEG-based Multimodal Representation Learning for Emotion Recognition
di: Yin, Kang, et al.
Pubblicazione: (2024)
di: Yin, Kang, et al.
Pubblicazione: (2024)
Before Forgetting, Learn to Remember: Revisiting Foundational Learning Failures in LVLM Unlearning Benchmarks
di: Kwon, JuneHyoung, et al.
Pubblicazione: (2026)
di: Kwon, JuneHyoung, et al.
Pubblicazione: (2026)
Exploring a Multimodal Fusion-based Deep Learning Network for Detecting Facial Palsy
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2024)
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2024)
MAESIL: Masked Autoencoder for Enhanced Self-supervised Medical Image Learning
di: Kim, Kyeonghun, et al.
Pubblicazione: (2026)
di: Kim, Kyeonghun, et al.
Pubblicazione: (2026)
A Multimodal Fusion Model Leveraging MLP Mixer and Handcrafted Features-based Deep Learning Networks for Facial Palsy Detection
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2025)
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2025)
Continual Multimodal Egocentric Activity Recognition via Modality-Aware Novel Detection
di: Lim, Wonseon, et al.
Pubblicazione: (2026)
di: Lim, Wonseon, et al.
Pubblicazione: (2026)
Identity Decoupling for Multi-Subject Personalization of Text-to-Image Models
di: Jang, Sangwon, et al.
Pubblicazione: (2024)
di: Jang, Sangwon, et al.
Pubblicazione: (2024)
CoBELa: Steering Transparent Generation via Concept Bottlenecks on Energy Landscapes
di: Kim, Sangwon, et al.
Pubblicazione: (2025)
di: Kim, Sangwon, et al.
Pubblicazione: (2025)
Simple yet Effective Semi-supervised Knowledge Distillation from Vision-Language Models via Dual-Head Optimization
di: Kang, Seongjae, et al.
Pubblicazione: (2025)
di: Kang, Seongjae, et al.
Pubblicazione: (2025)
MMeViT: Multi-Modal ensemble ViT for Post-Stroke Rehabilitation Action Recognition
di: Kim, Ye-eun, et al.
Pubblicazione: (2025)
di: Kim, Ye-eun, et al.
Pubblicazione: (2025)
CLAY: Conditional Visual Similarity Modulation in Vision-Language Embedding Space
di: Lim, Sohwi, et al.
Pubblicazione: (2026)
di: Lim, Sohwi, et al.
Pubblicazione: (2026)
EuraGovExam: A Multilingual Multimodal Benchmark from Real-World Civil Service Exams
di: Kim, Jaeseong, et al.
Pubblicazione: (2026)
di: Kim, Jaeseong, et al.
Pubblicazione: (2026)
A Data-Centric Vision Transformer Baseline for SAR Sea Ice Classification
di: Mike-Ewewie, David, et al.
Pubblicazione: (2026)
di: Mike-Ewewie, David, et al.
Pubblicazione: (2026)
Mask and Compress: Efficient Skeleton-based Action Recognition in Continual Learning
di: Mosconi, Matteo, et al.
Pubblicazione: (2024)
di: Mosconi, Matteo, et al.
Pubblicazione: (2024)
Emotion Recognition in Contemporary Dance Performances Using Laban Movement Analysis
di: Turab, Muhammad, et al.
Pubblicazione: (2025)
di: Turab, Muhammad, et al.
Pubblicazione: (2025)
CrimEdit: Controllable Editing for Counterfactual Object Removal, Insertion, and Movement
di: Jeon, Boseong, et al.
Pubblicazione: (2025)
di: Jeon, Boseong, et al.
Pubblicazione: (2025)
TACFN: Transformer-based Adaptive Cross-modal Fusion Network for Multimodal Emotion Recognition
di: Liu, Feng, et al.
Pubblicazione: (2025)
di: Liu, Feng, et al.
Pubblicazione: (2025)
Can visual language models resolve textual ambiguity with visual cues? Let visual puns tell you!
di: Chung, Jiwan, et al.
Pubblicazione: (2024)
di: Chung, Jiwan, et al.
Pubblicazione: (2024)
HU-based Foreground Masking for 3D Medical Masked Image Modeling
di: Lee, Jin, et al.
Pubblicazione: (2025)
di: Lee, Jin, et al.
Pubblicazione: (2025)
SwiftVGGT: A Scalable Visual Geometry Grounded Transformer for Large-Scale Scenes
di: Lee, Jungho, et al.
Pubblicazione: (2025)
di: Lee, Jungho, et al.
Pubblicazione: (2025)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
GraspClutter6D: A Large-scale Real-world Dataset for Robust Perception and Grasping in Cluttered Scenes
di: Back, Seunghyeok, et al.
Pubblicazione: (2025)
di: Back, Seunghyeok, et al.
Pubblicazione: (2025)
Temporal Label Hierachical Network for Compound Emotion Recognition
di: Li, Sunan, et al.
Pubblicazione: (2024)
di: Li, Sunan, et al.
Pubblicazione: (2024)
Measuring Agreeableness Bias in Multimodal Models
di: Lim, Jaehyuk, et al.
Pubblicazione: (2024)
di: Lim, Jaehyuk, et al.
Pubblicazione: (2024)
Scene Graph Generation Strategy with Co-occurrence Knowledge and Learnable Term Frequency
di: Kim, Hyeongjin, et al.
Pubblicazione: (2024)
di: Kim, Hyeongjin, et al.
Pubblicazione: (2024)
MF-LPR$^2$: Multi-Frame License Plate Image Restoration and Recognition using Optical Flow
di: Na, Kihyun, et al.
Pubblicazione: (2025)
di: Na, Kihyun, et al.
Pubblicazione: (2025)
Weaknesses of Facial Emotion Recognition Systems
di: Jamróz, Aleksandra, et al.
Pubblicazione: (2026)
di: Jamróz, Aleksandra, et al.
Pubblicazione: (2026)
When and Where to Reset Matters for Long-Term Test-Time Adaptation
di: Lim, Taejun, et al.
Pubblicazione: (2026)
di: Lim, Taejun, et al.
Pubblicazione: (2026)
Unlocking Transfer Learning for Open-World Few-Shot Recognition
di: Kim, Byeonggeun, et al.
Pubblicazione: (2024)
di: Kim, Byeonggeun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multimodal Emotion Recognition via Bi-directional Cross-Attention and Temporal Modeling
di: Byeon, Junhyeong, et al.
Pubblicazione: (2026) -
CD-FKD: Cross-Domain Feature Knowledge Distillation for Robust Single-Domain Generalization in Object Detection
di: Lee, Junseok, et al.
Pubblicazione: (2026) -
Mitigating Resolution-Drift in Federated Learning: Case of Keypoint Detection
di: Lim, Taeheon, et al.
Pubblicazione: (2025) -
VideoMaMa: Mask-Guided Video Matting via Generative Prior
di: Lim, Sangbeom, et al.
Pubblicazione: (2026) -
MGHFT: Multi-Granularity Hierarchical Fusion Transformer for Cross-Modal Sticker Emotion Recognition
di: Chen, Jian, et al.
Pubblicazione: (2025)