A Computational Model of Message Sensation Value in Short Video Multimodal Features that Predicts Sensory and Behavioral Engagement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xue, Haoning, Zhang, Jingwen, Wang, Xiaohui, Kim, Diane Dagyong, Song, Yunya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Engagement Prediction of Short Videos with Large Multimodal Models
par: Sun, Wei, et autres
Publié: (2025)
par: Sun, Wei, et autres
Publié: (2025)
Leveraging Segment Anything Model in Identifying Buildings within Refugee Camps (SAM4Refugee) from Satellite Imagery for Humanitarian Operations
par: Gao, Yunya
Publié: (2024)
par: Gao, Yunya
Publié: (2024)
Delving Deep into Engagement Prediction of Short Videos
par: Li, Dasong, et autres
Publié: (2024)
par: Li, Dasong, et autres
Publié: (2024)
VQualA 2025 Challenge on Engagement Prediction for Short Videos: Methods and Results
par: Li, Dasong, et autres
Publié: (2025)
par: Li, Dasong, et autres
Publié: (2025)
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
par: Jin, Xiaojie, et autres
Publié: (2023)
par: Jin, Xiaojie, et autres
Publié: (2023)
Multimodal Engagement Analysis from Facial Videos in the Classroom
par: Sümer, Ömer, et autres
Publié: (2021)
par: Sümer, Ömer, et autres
Publié: (2021)
Reasoning-Enhanced Domain-Adaptive Pretraining of Multimodal Large Language Models for Short Video Content Governance
par: Wang, Zixuan, et autres
Publié: (2025)
par: Wang, Zixuan, et autres
Publié: (2025)
A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction
par: Mehta, Naval Kishore, et autres
Publié: (2025)
par: Mehta, Naval Kishore, et autres
Publié: (2025)
Analyzing Participants' Engagement during Online Meetings Using Unsupervised Remote Photoplethysmography with Behavioral Features
par: Vedernikov, Alexander, et autres
Publié: (2024)
par: Vedernikov, Alexander, et autres
Publié: (2024)
VideoAutoArena: An Automated Arena for Evaluating Large Multimodal Models in Video Analysis through User Simulation
par: Luo, Ziyang, et autres
Publié: (2024)
par: Luo, Ziyang, et autres
Publié: (2024)
Sens-VisualNews: A Benchmark Dataset for Sensational Image Detection
par: Goulas, Andreas, et autres
Publié: (2026)
par: Goulas, Andreas, et autres
Publié: (2026)
Realizing Immersive Volumetric Video: A Multimodal Framework for 6-DoF VR Engagement
par: Yang, Zhengxian, et autres
Publié: (2026)
par: Yang, Zhengxian, et autres
Publié: (2026)
EchoVideo: Identity-Preserving Human Video Generation by Multimodal Feature Fusion
par: Wei, Jiangchuan, et autres
Publié: (2025)
par: Wei, Jiangchuan, et autres
Publié: (2025)
An Ensemble Approach to Short-form Video Quality Assessment Using Multimodal LLM
par: Wen, Wen, et autres
Publié: (2024)
par: Wen, Wen, et autres
Publié: (2024)
ICANet: A Method of Short Video Emotion Recognition Driven by Multimodal Data
par: Wu, Xuecheng, et autres
Publié: (2022)
par: Wu, Xuecheng, et autres
Publié: (2022)
Fast Deep Predictive Coding Networks for Videos Feature Extraction without Labels
par: Xue, Wenqian, et autres
Publié: (2024)
par: Xue, Wenqian, et autres
Publié: (2024)
TCCT-Net: Two-Stream Network Architecture for Fast and Efficient Engagement Estimation via Behavioral Feature Signals
par: Vedernikov, Alexander, et autres
Publié: (2024)
par: Vedernikov, Alexander, et autres
Publié: (2024)
Towards Universal Soccer Video Understanding
par: Rao, Jiayuan, et autres
Publié: (2024)
par: Rao, Jiayuan, et autres
Publié: (2024)
ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks
par: Yang, Yan, et autres
Publié: (2025)
par: Yang, Yan, et autres
Publié: (2025)
Multimodal Feature-Driven Deep Learning for the Prediction of Duck Body Dimensions and Weight
par: Xiao, Wenbo, et autres
Publié: (2025)
par: Xiao, Wenbo, et autres
Publié: (2025)
Poisoning Prompt-Guided Sampling in Video Large Language Models
par: Cao, Yuxin, et autres
Publié: (2025)
par: Cao, Yuxin, et autres
Publié: (2025)
Vidi: Large Multimodal Models for Video Understanding and Editing
par: Vidi Team, et autres
Publié: (2025)
par: Vidi Team, et autres
Publié: (2025)
ViASNet: A Video Ad Saliency Network for Predicting Dynamic Saliency and Viewer Engagement
par: Ye, Jianping, et autres
Publié: (2026)
par: Ye, Jianping, et autres
Publié: (2026)
BYOCL: Build Your Own Consistent Latent with Hierarchical Representative Latent Clustering
par: Dai, Jiayue, et autres
Publié: (2024)
par: Dai, Jiayue, et autres
Publié: (2024)
Can Language Models Laugh at YouTube Short-form Videos?
par: Ko, Dayoon, et autres
Publié: (2023)
par: Ko, Dayoon, et autres
Publié: (2023)
EGVD: Event-Guided Video Diffusion Model for Physically Realistic Large-Motion Frame Interpolation
par: Zhang, Ziran, et autres
Publié: (2025)
par: Zhang, Ziran, et autres
Publié: (2025)
VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability
par: Cohendet, Romain, et autres
Publié: (2018)
par: Cohendet, Romain, et autres
Publié: (2018)
When Rules Fall Short: Agent-Driven Discovery of Emerging Content Issues in Short Video Platforms
par: Yu, Chenghui, et autres
Publié: (2026)
par: Yu, Chenghui, et autres
Publié: (2026)
Bounded-Compute Multimodal Regression for Product-Rating Prediction
par: Leach, William, et autres
Publié: (2026)
par: Leach, William, et autres
Publié: (2026)
CPFD: Confidence-aware Privileged Feature Distillation for Short Video Classification
par: Shi, Jinghao, et autres
Publié: (2024)
par: Shi, Jinghao, et autres
Publié: (2024)
Transformer-Driven Modeling of Variable Frequency Features for Classifying Student Engagement in Online Learning
par: Mandia, Sandeep, et autres
Publié: (2025)
par: Mandia, Sandeep, et autres
Publié: (2025)
V-Warper: Appearance-Consistent Video Diffusion Personalization via Value Warping
par: Lee, Hyunkoo, et autres
Publié: (2025)
par: Lee, Hyunkoo, et autres
Publié: (2025)
Personal Visual Context Learning in Large Multimodal Models
par: Xue, Zihui, et autres
Publié: (2026)
par: Xue, Zihui, et autres
Publié: (2026)
REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing
par: Xu, Weihan, et autres
Publié: (2025)
par: Xu, Weihan, et autres
Publié: (2025)
Multimodal Feature Prototype Learning for Interpretable and Discriminative Cancer Survival Prediction
par: Jiang, Shuo, et autres
Publié: (2025)
par: Jiang, Shuo, et autres
Publié: (2025)
Next-Frame Feature Prediction for Multimodal Deepfake Detection and Temporal Localization
par: Anshul, Ashutosh, et autres
Publié: (2025)
par: Anshul, Ashutosh, et autres
Publié: (2025)
Seer: Language Instructed Video Prediction with Latent Diffusion Models
par: Gu, Xianfan, et autres
Publié: (2023)
par: Gu, Xianfan, et autres
Publié: (2023)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
par: Zhou, Xunchu, et autres
Publié: (2024)
par: Zhou, Xunchu, et autres
Publié: (2024)
Bitbox: Behavioral Imaging Toolbox for Computational Analysis of Behavior from Videos
par: Sariyanidi, Evangelos, et autres
Publié: (2025)
par: Sariyanidi, Evangelos, et autres
Publié: (2025)
LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding
par: Wu, Haoning, et autres
Publié: (2024)
par: Wu, Haoning, et autres
Publié: (2024)
Documents similaires
-
Engagement Prediction of Short Videos with Large Multimodal Models
par: Sun, Wei, et autres
Publié: (2025) -
Leveraging Segment Anything Model in Identifying Buildings within Refugee Camps (SAM4Refugee) from Satellite Imagery for Humanitarian Operations
par: Gao, Yunya
Publié: (2024) -
Delving Deep into Engagement Prediction of Short Videos
par: Li, Dasong, et autres
Publié: (2024) -
VQualA 2025 Challenge on Engagement Prediction for Short Videos: Methods and Results
par: Li, Dasong, et autres
Publié: (2025) -
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
par: Jin, Xiaojie, et autres
Publié: (2023)