EmoVid: A Multimodal Emotion Video Dataset for Emotion-Centric Video Understanding and Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qiu, Zongyang, Wang, Bingyuan, Chen, Xingbei, He, Yingqing, Wang, Zeyu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EmoSpace: Fine-Grained Emotion Prototype Learning for Immersive Affective Content Generation
par: Wang, Bingyuan, et autres
Publié: (2026)
par: Wang, Bingyuan, et autres
Publié: (2026)
VidEmo: Affective-Tree Reasoning for Emotion-Centric Video Foundation Models
par: Zhang, Zhicheng, et autres
Publié: (2025)
par: Zhang, Zhicheng, et autres
Publié: (2025)
InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation
par: Wang, Yi, et autres
Publié: (2023)
par: Wang, Yi, et autres
Publié: (2023)
EmoSign: A Multimodal Dataset for Understanding Emotions in American Sign Language
par: Chua, Phoebe, et autres
Publié: (2025)
par: Chua, Phoebe, et autres
Publié: (2025)
OmniVid: A Generative Framework for Universal Video Understanding
par: Wang, Junke, et autres
Publié: (2024)
par: Wang, Junke, et autres
Publié: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
par: Zhang, Bingyuan, et autres
Publié: (2024)
par: Zhang, Bingyuan, et autres
Publié: (2024)
OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation
par: Li, Hui, et autres
Publié: (2024)
par: Li, Hui, et autres
Publié: (2024)
EmoLLM: Multimodal Emotional Understanding Meets Large Language Models
par: Yang, Qu, et autres
Publié: (2024)
par: Yang, Qu, et autres
Publié: (2024)
EmoTrans: A Benchmark for Understanding, Reasoning, and Predicting Emotion Transitions in Multimodal LLMs
par: Hu, He, et autres
Publié: (2026)
par: Hu, He, et autres
Publié: (2026)
EvoVid: Temporal-Centric Self-Evolution for Video Large Language Models
par: Huang, Shiqi, et autres
Publié: (2026)
par: Huang, Shiqi, et autres
Publié: (2026)
EmoArt: A Multidimensional Dataset for Emotion-Aware Artistic Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
ExpVid: A Benchmark for Experiment Video Understanding & Reasoning
par: Xu, Yicheng, et autres
Publié: (2025)
par: Xu, Yicheng, et autres
Publié: (2025)
MicroEmo: Time-Sensitive Multimodal Emotion Recognition with Micro-Expression Dynamics in Video Dialogues
par: Zhang, Liyun
Publié: (2024)
par: Zhang, Liyun
Publié: (2024)
EmoStory: Emotion-Aware Story Generation
par: Yang, Jingyuan, et autres
Publié: (2026)
par: Yang, Jingyuan, et autres
Publié: (2026)
UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries
par: Zhu, Yijie, et autres
Publié: (2025)
par: Zhu, Yijie, et autres
Publié: (2025)
EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation
par: Wang, Xiaofeng, et autres
Publié: (2024)
par: Wang, Xiaofeng, et autres
Publié: (2024)
EmoAttack: Emotion-to-Image Diffusion Models for Emotional Backdoor Generation
par: Wei, Tianyu, et autres
Publié: (2024)
par: Wei, Tianyu, et autres
Publié: (2024)
BlockVid: Block Diffusion for High-Quality and Consistent Minute-Long Video Generation
par: Zhang, Zeyu, et autres
Publié: (2025)
par: Zhang, Zeyu, et autres
Publié: (2025)
VideoChat: Chat-Centric Video Understanding
par: Li, KunChang, et autres
Publié: (2023)
par: Li, KunChang, et autres
Publié: (2023)
EmoCtrl: Controllable Emotional Image Content Generation
par: Yang, Jingyuan, et autres
Publié: (2025)
par: Yang, Jingyuan, et autres
Publié: (2025)
FindingEmo: An Image Dataset for Emotion Recognition in the Wild
par: Mertens, Laurent, et autres
Publié: (2024)
par: Mertens, Laurent, et autres
Publié: (2024)
EmoMeta: A Multimodal Dataset for Fine-grained Emotion Classification in Chinese Metaphors
par: Lu, Xingyuan, et autres
Publié: (2025)
par: Lu, Xingyuan, et autres
Publié: (2025)
Multimodal Video Emotion Recognition with Reliable Reasoning Priors
par: Wang, Zhepeng, et autres
Publié: (2025)
par: Wang, Zhepeng, et autres
Publié: (2025)
Controllable Video Generation: A Survey
par: Ma, Yue, et autres
Publié: (2025)
par: Ma, Yue, et autres
Publié: (2025)
UniVid: The Open-Source Unified Video Model
par: Luo, Jiabin, et autres
Publié: (2025)
par: Luo, Jiabin, et autres
Publié: (2025)
MagicAnime: A Hierarchically Annotated, Multimodal and Multitasking Dataset with Benchmarks for Cartoon Animation Generation
par: Xu, Shuolin, et autres
Publié: (2025)
par: Xu, Shuolin, et autres
Publié: (2025)
VidText: Towards Comprehensive Evaluation for Video Text Understanding
par: Yang, Zhoufaran, et autres
Publié: (2025)
par: Yang, Zhoufaran, et autres
Publié: (2025)
EmoAssist: Emotional Assistant for Visual Impairment Community
par: Qi, Xingyu, et autres
Publié: (2025)
par: Qi, Xingyu, et autres
Publié: (2025)
VidHalluc: Evaluating Temporal Hallucinations in Multimodal Large Language Models for Video Understanding
par: Li, Chaoyu, et autres
Publié: (2024)
par: Li, Chaoyu, et autres
Publié: (2024)
EmoSEM: Segment and Explain Emotion Stimuli in Visual Art
par: Zhang, Jing, et autres
Publié: (2025)
par: Zhang, Jing, et autres
Publié: (2025)
AnimationBench: Are Video Models Good at Character-Centric Animation?
par: Wu, Leyi, et autres
Publié: (2026)
par: Wu, Leyi, et autres
Publié: (2026)
FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
par: Qiu, Haonan, et autres
Publié: (2024)
par: Qiu, Haonan, et autres
Publié: (2024)
VidEvent: A Large Dataset for Understanding Dynamic Evolution of Events in Videos
par: Liang, Baoyu, et autres
Publié: (2025)
par: Liang, Baoyu, et autres
Publié: (2025)
EmoStyle: Emotion-Driven Image Stylization
par: Yang, Jingyuan, et autres
Publié: (2025)
par: Yang, Jingyuan, et autres
Publié: (2025)
DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
par: Di, Donglin, et autres
Publié: (2024)
par: Di, Donglin, et autres
Publié: (2024)
Nano-EmoX: Unifying Multimodal Emotional Intelligence from Perception to Empathy
par: Huang, Jiahao, et autres
Publié: (2026)
par: Huang, Jiahao, et autres
Publié: (2026)
EmoGist: Efficient In-Context Learning for Visual Emotion Understanding
par: Seoh, Ronald, et autres
Publié: (2025)
par: Seoh, Ronald, et autres
Publié: (2025)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
par: Ma, Yue, et autres
Publié: (2023)
par: Ma, Yue, et autres
Publié: (2023)
Beyond Emotion Recognition: A Multi-Turn Multimodal Emotion Understanding and Reasoning Benchmark
par: Hu, Jinpeng, et autres
Publié: (2025)
par: Hu, Jinpeng, et autres
Publié: (2025)
Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning
par: Xi, Zeyu, et autres
Publié: (2025)
par: Xi, Zeyu, et autres
Publié: (2025)
Documents similaires
-
EmoSpace: Fine-Grained Emotion Prototype Learning for Immersive Affective Content Generation
par: Wang, Bingyuan, et autres
Publié: (2026) -
VidEmo: Affective-Tree Reasoning for Emotion-Centric Video Foundation Models
par: Zhang, Zhicheng, et autres
Publié: (2025) -
InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation
par: Wang, Yi, et autres
Publié: (2023) -
EmoSign: A Multimodal Dataset for Understanding Emotions in American Sign Language
par: Chua, Phoebe, et autres
Publié: (2025) -
OmniVid: A Generative Framework for Universal Video Understanding
par: Wang, Junke, et autres
Publié: (2024)