EALD-MLLM: Emotion Analysis in Long-sequential and De-identity videos with Multi-modal Large Language Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Deng, Liu, Xin, Xing, Bohao, Xia, Baiqiang, Zong, Yuan, Wen, Bihan, Kälviäinen, Heikki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DEEMO: De-identity Multimodal Emotion Recognition and Reasoning
por: Li, Deng, et al.
Publicado: (2025)
por: Li, Deng, et al.
Publicado: (2025)
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
por: Gao, Lancheng, et al.
Publicado: (2025)
por: Gao, Lancheng, et al.
Publicado: (2025)
Emotional Cues Extraction and Fusion for Multi-modal Emotion Prediction and Recognition in Conversation
por: Shi, Haoxiang, et al.
Publicado: (2024)
por: Shi, Haoxiang, et al.
Publicado: (2024)
EmotionHallucer: Evaluating Emotion Hallucinations in Multimodal Large Language Models
por: Xing, Bohao, et al.
Publicado: (2025)
por: Xing, Bohao, et al.
Publicado: (2025)
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024)
por: Wu, Qiong, et al.
Publicado: (2024)
Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health Understanding
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
Deep Mamba Multi-modal Learning
por: Zhu, Jian, et al.
Publicado: (2024)
por: Zhu, Jian, et al.
Publicado: (2024)
Multimodal Emotion Recognition with Large Language Models
por: Zhang, Hongrui, et al.
Publicado: (2026)
por: Zhang, Hongrui, et al.
Publicado: (2026)
FSBench: A Figure Skating Benchmark for Advancing Artistic Sports Understanding
por: Gao, Rong, et al.
Publicado: (2025)
por: Gao, Rong, et al.
Publicado: (2025)
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
MSF-Mamba: Motion-aware State Fusion Mamba for Efficient Micro-Gesture Recognition
por: Li, Deng, et al.
Publicado: (2025)
por: Li, Deng, et al.
Publicado: (2025)
MMoFusion: Multi-modal Co-Speech Motion Generation with Diffusion Model
por: Wang, Sen, et al.
Publicado: (2024)
por: Wang, Sen, et al.
Publicado: (2024)
An Emotion Recognition Framework via Cross-modal Alignment of EEG and Eye Movement Data
por: Wang, Jianlu, et al.
Publicado: (2025)
por: Wang, Jianlu, et al.
Publicado: (2025)
AIM: Let Any Multi-modal Large Language Models Embrace Efficient In-Context Learning
por: Gao, Jun, et al.
Publicado: (2024)
por: Gao, Jun, et al.
Publicado: (2024)
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
por: Shu, Dong, et al.
Publicado: (2025)
por: Shu, Dong, et al.
Publicado: (2025)
Multi-MLLM Knowledge Distillation for Out-of-Context News Detection
por: Gu, Yimeng, et al.
Publicado: (2025)
por: Gu, Yimeng, et al.
Publicado: (2025)
Unified Generative and Discriminative Training for Multi-modal Large Language Models
por: Chow, Wei, et al.
Publicado: (2024)
por: Chow, Wei, et al.
Publicado: (2024)
Not All Attention is Needed: Parameter and Computation Efficient Transfer Learning for Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024)
por: Wu, Qiong, et al.
Publicado: (2024)
Mixture-of-Prompt-Experts for Multi-modal Semantic Understanding
por: Wu, Zichen, et al.
Publicado: (2024)
por: Wu, Zichen, et al.
Publicado: (2024)
Improving Multi-modal Large Language Model through Boosting Vision Capabilities
por: Sun, Yanpeng, et al.
Publicado: (2024)
por: Sun, Yanpeng, et al.
Publicado: (2024)
Multi-modal Speech Emotion Recognition via Feature Distribution Adaptation Network
por: Li, Shaokai, et al.
Publicado: (2024)
por: Li, Shaokai, et al.
Publicado: (2024)
Traj-MLLM: Can Multimodal Large Language Models Reform Trajectory Data Mining?
por: Liu, Shuo, et al.
Publicado: (2025)
por: Liu, Shuo, et al.
Publicado: (2025)
FoodMLLM-JP: Leveraging Multimodal Large Language Models for Japanese Recipe Generation
por: Imajuku, Yuki, et al.
Publicado: (2024)
por: Imajuku, Yuki, et al.
Publicado: (2024)
Dopamine Audiobook: A Training-free MLLM Agent for Emotional and Immersive Audiobook Generation
por: Rong, Yan, et al.
Publicado: (2025)
por: Rong, Yan, et al.
Publicado: (2025)
Towards Structure-aware Model for Multi-modal Knowledge Graph Completion
por: Li, Linyu, et al.
Publicado: (2025)
por: Li, Linyu, et al.
Publicado: (2025)
Multi-modal and Metadata Capture Model for Micro Video Popularity Prediction
por: Lu, Jiacheng, et al.
Publicado: (2025)
por: Lu, Jiacheng, et al.
Publicado: (2025)
Modality-Aware Contrastive and Uncertainty-Regularized Emotion Recognition
por: Zhuang, Yan, et al.
Publicado: (2026)
por: Zhuang, Yan, et al.
Publicado: (2026)
Clinical Multi-modal Fusion with Heterogeneous Graph and Disease Correlation Learning for Multi-Disease Prediction
por: Jiang, Yueheng, et al.
Publicado: (2025)
por: Jiang, Yueheng, et al.
Publicado: (2025)
AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues
por: Zhou, Dingkun, et al.
Publicado: (2025)
por: Zhou, Dingkun, et al.
Publicado: (2025)
Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts
por: Liu, Yi, et al.
Publicado: (2024)
por: Liu, Yi, et al.
Publicado: (2024)
M$^{2}$UGen: Multi-modal Music Understanding and Generation with the Power of Large Language Models
por: Liu, Shansong, et al.
Publicado: (2023)
por: Liu, Shansong, et al.
Publicado: (2023)
Hallu-PI: Evaluating Hallucination in Multi-modal Large Language Models within Perturbed Inputs
por: Ding, Peng, et al.
Publicado: (2024)
por: Ding, Peng, et al.
Publicado: (2024)
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
por: Shang, Yu, et al.
Publicado: (2025)
por: Shang, Yu, et al.
Publicado: (2025)
VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning
por: Chen, Siran, et al.
Publicado: (2025)
por: Chen, Siran, et al.
Publicado: (2025)
Characterizing Multimedia Information Environment through Multi-modal Clustering of YouTube Videos
por: Yousefi, Niloofar, et al.
Publicado: (2024)
por: Yousefi, Niloofar, et al.
Publicado: (2024)
Loss-tolerant neural video codec aware congestion control for real time video communication
por: Xia, Zhengxu, et al.
Publicado: (2024)
por: Xia, Zhengxu, et al.
Publicado: (2024)
MuMu-LLaMA: Multi-modal Music Understanding and Generation via Large Language Models
por: Liu, Shansong, et al.
Publicado: (2024)
por: Liu, Shansong, et al.
Publicado: (2024)
Multi-view Hypergraph-based Contrastive Learning Model for Cold-Start Micro-video Recommendation
por: Lyu, Sisuo, et al.
Publicado: (2024)
por: Lyu, Sisuo, et al.
Publicado: (2024)
Harnessing Multimodal Large Language Models for Personalized Product Search with Query-aware Refinement
por: Zhang, Beibei, et al.
Publicado: (2025)
por: Zhang, Beibei, et al.
Publicado: (2025)
Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models
por: Lin, Yuxiang, et al.
Publicado: (2025)
por: Lin, Yuxiang, et al.
Publicado: (2025)
Ejemplares similares
-
DEEMO: De-identity Multimodal Emotion Recognition and Reasoning
por: Li, Deng, et al.
Publicado: (2025) -
EEmo-Bench: A Benchmark for Multi-modal Large Language Models on Image Evoked Emotion Assessment
por: Gao, Lancheng, et al.
Publicado: (2025) -
Emotional Cues Extraction and Fusion for Multi-modal Emotion Prediction and Recognition in Conversation
por: Shi, Haoxiang, et al.
Publicado: (2024) -
EmotionHallucer: Evaluating Emotion Hallucinations in Multimodal Large Language Models
por: Xing, Bohao, et al.
Publicado: (2025) -
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
por: Wu, Qiong, et al.
Publicado: (2024)