Find the Cliffhanger: Multi-Modal Trailerness in Soap Operas
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bretti, Carlo, Mettes, Pascal, Koops, Hendrik Vincent, Odijk, Daan, van Noord, Nanne |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Does SpatioTemporal information benefit Two video summarization benchmarks?
par: Ganesh, Aashutosh, et autres
Publié: (2024)
par: Ganesh, Aashutosh, et autres
Publié: (2024)
Stylistic Multi-Task Analysis of Ukiyo-e Woodblock Prints
par: Khan, Selina, et autres
Publié: (2024)
par: Khan, Selina, et autres
Publié: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
Hyperbolic Safety-Aware Vision-Language Models
par: Poppi, Tobia, et autres
Publié: (2025)
par: Poppi, Tobia, et autres
Publié: (2025)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025)
par: Zheng, Junjie, et autres
Publié: (2025)
Context-Infused Visual Grounding for Art
par: Khan, Selina, et autres
Publié: (2024)
par: Khan, Selina, et autres
Publié: (2024)
The Iconicity of the Generated Image
par: van Noord, Nanne, et autres
Publié: (2025)
par: van Noord, Nanne, et autres
Publié: (2025)
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
par: Yang, Zequn, et autres
Publié: (2024)
par: Yang, Zequn, et autres
Publié: (2024)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)
par: Zhu, Yixin, et autres
Publié: (2026)
An Empirical Comparison of Video Frame Sampling Methods for Multi-Modal RAG Retrieval
par: Kandhare, Mahesh, et autres
Publié: (2024)
par: Kandhare, Mahesh, et autres
Publié: (2024)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
par: Li, Wenrui, et autres
Publié: (2024)
par: Li, Wenrui, et autres
Publié: (2024)
GTPBD-MM: A Global Terraced Parcel and Boundary Dataset with Multi-Modality
par: Zhang, Zhiwei, et autres
Publié: (2026)
par: Zhang, Zhiwei, et autres
Publié: (2026)
Gradient-Guided Modality Decoupling for Missing-Modality Robustness
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
MambaPro: Multi-Modal Object Re-Identification with Mamba Aggregation and Synergistic Prompt
par: Wang, Yuhao, et autres
Publié: (2024)
par: Wang, Yuhao, et autres
Publié: (2024)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
par: Liu, Yangyang, et autres
Publié: (2025)
par: Liu, Yangyang, et autres
Publié: (2025)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
par: Li, Yuxuan, et autres
Publié: (2024)
par: Li, Yuxuan, et autres
Publié: (2024)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
par: Zhao, Yumiao, et autres
Publié: (2024)
par: Zhao, Yumiao, et autres
Publié: (2024)
M3FAS: An Accurate and Robust MultiModal Mobile Face Anti-Spoofing System
par: Kong, Chenqi, et autres
Publié: (2023)
par: Kong, Chenqi, et autres
Publié: (2023)
MMTrail: A Multimodal Trailer Video Dataset with Language and Music Descriptions
par: Chi, Xiaowei, et autres
Publié: (2024)
par: Chi, Xiaowei, et autres
Publié: (2024)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2026)
par: Fang, Xiang, et autres
Publié: (2026)
Anisotropic Modality Align
par: Yu, Xiaomin, et autres
Publié: (2026)
par: Yu, Xiaomin, et autres
Publié: (2026)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
par: Huang, Hailang, et autres
Publié: (2024)
par: Huang, Hailang, et autres
Publié: (2024)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
Multi-Modal Semantic Parsing for the Interpretation of Tombstone Inscriptions
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Movie Trailer Genre Classification Using Multimodal Pretrained Features
par: Sulun, Serkan, et autres
Publié: (2024)
par: Sulun, Serkan, et autres
Publié: (2024)
EMPLACE: Self-Supervised Urban Scene Change Detection
par: Alpherts, Tim, et autres
Publié: (2025)
par: Alpherts, Tim, et autres
Publié: (2025)
Artifacts of Idiosyncracy in Global Street View Data
par: Alpherts, Tim, et autres
Publié: (2025)
par: Alpherts, Tim, et autres
Publié: (2025)
Integrating Multi-Modal Sensors: A Review of Fusion Techniques for Intelligent Vehicles
par: Wei, Chuheng, et autres
Publié: (2025)
par: Wei, Chuheng, et autres
Publié: (2025)
MSCT: Differential Cross-Modal Attention for Deepfake Detection
par: Wei, Fangda, et autres
Publié: (2026)
par: Wei, Fangda, et autres
Publié: (2026)
Modality-Aware Shot Relating and Comparing for Video Scene Detection
par: Tan, Jiawei, et autres
Publié: (2024)
par: Tan, Jiawei, et autres
Publié: (2024)
Towards Robust and Realible Multimodal Misinformation Recognition with Incomplete Modality
par: Zhou, Hengyang, et autres
Publié: (2025)
par: Zhou, Hengyang, et autres
Publié: (2025)
CoNav: Collaborative Cross-Modal Reasoning for Embodied Navigation
par: Hao, Haihong, et autres
Publié: (2025)
par: Hao, Haihong, et autres
Publié: (2025)
Fantastic Animals and Where to Find Them: Segment Any Marine Animal with Dual SAM
par: Zhang, Pingping, et autres
Publié: (2024)
par: Zhang, Pingping, et autres
Publié: (2024)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
par: Chen, Yuheng, et autres
Publié: (2026)
par: Chen, Yuheng, et autres
Publié: (2026)
Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality Selection
par: Fan, Yunfeng, et autres
Publié: (2023)
par: Fan, Yunfeng, et autres
Publié: (2023)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
Leveraging multimodal explanatory annotations for video interpretation with Modality Specific Dataset
par: Ancarani, Elisa, et autres
Publié: (2025)
par: Ancarani, Elisa, et autres
Publié: (2025)
Robust Self-Paced Hashing for Cross-Modal Retrieval with Noisy Labels
par: Pu, Ruitao, et autres
Publié: (2025)
par: Pu, Ruitao, et autres
Publié: (2025)
Documents similaires
-
Does SpatioTemporal information benefit Two video summarization benchmarks?
par: Ganesh, Aashutosh, et autres
Publié: (2024) -
Stylistic Multi-Task Analysis of Ukiyo-e Woodblock Prints
par: Khan, Selina, et autres
Publié: (2024) -
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024) -
Hyperbolic Safety-Aware Vision-Language Models
par: Poppi, Tobia, et autres
Publié: (2025) -
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025)