Automatic Funny Scene Extraction from Long-form Cinematic Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Paul, Sibendu, Jiang, Haotian, Chen, Caren |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Captions to Keyframes: KeyScore for Multimodal Frame Scoring and Video-Language Understanding
di: Lin, Shih-Yao, et al.
Pubblicazione: (2025)
di: Lin, Shih-Yao, et al.
Pubblicazione: (2025)
LongVidSearch: An Agentic Benchmark for Multi-hop Evidence Retrieval Planning in Long Videos
di: Yu, Rongyi, et al.
Pubblicazione: (2026)
di: Yu, Rongyi, et al.
Pubblicazione: (2026)
VKIE: The Application of Key Information Extraction on Video Text
di: An, Siyu, et al.
Pubblicazione: (2023)
di: An, Siyu, et al.
Pubblicazione: (2023)
VideoAgent: Long-form Video Understanding with Large Language Model as Agent
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
Understanding Long Videos via LLM-Powered Entity Relation Graphs
di: Chu, Meng, et al.
Pubblicazione: (2025)
di: Chu, Meng, et al.
Pubblicazione: (2025)
LoVR: A Benchmark for Long Video Retrieval in Multimodal Contexts
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
di: Cai, Qifeng, et al.
Pubblicazione: (2025)
SHE-Net: Syntax-Hierarchy-Enhanced Text-Video Retrieval
di: Yu, Xuzheng, et al.
Pubblicazione: (2024)
di: Yu, Xuzheng, et al.
Pubblicazione: (2024)
Automatic Creative Selection with Cross-Modal Matching
di: Kim, Alex, et al.
Pubblicazione: (2024)
di: Kim, Alex, et al.
Pubblicazione: (2024)
Digitization of Document and Information Extraction using OCR
di: Sinha, Rasha, et al.
Pubblicazione: (2025)
di: Sinha, Rasha, et al.
Pubblicazione: (2025)
Video Editing for Video Retrieval
di: Zhu, Bin, et al.
Pubblicazione: (2024)
di: Zhu, Bin, et al.
Pubblicazione: (2024)
Which Country Is This? Automatic Country Ranking of Street View Photos
di: Menzner, Tim, et al.
Pubblicazione: (2024)
di: Menzner, Tim, et al.
Pubblicazione: (2024)
PCFEx: Point Cloud Feature Extraction for Graph Neural Networks
di: Masud, Abdullah Al, et al.
Pubblicazione: (2026)
di: Masud, Abdullah Al, et al.
Pubblicazione: (2026)
Visual Zero-Shot E-Commerce Product Attribute Value Extraction
di: Gong, Jiaying, et al.
Pubblicazione: (2025)
di: Gong, Jiaying, et al.
Pubblicazione: (2025)
GraphRevisedIE: Multimodal Information Extraction with Graph-Revised Network
di: Cao, Panfeng, et al.
Pubblicazione: (2024)
di: Cao, Panfeng, et al.
Pubblicazione: (2024)
Subtle Motion Blur Detection and Segmentation from Static Image Artworks
di: Samarth, Ganesh, et al.
Pubblicazione: (2026)
di: Samarth, Ganesh, et al.
Pubblicazione: (2026)
VideoRAG: Retrieval-Augmented Generation with Extreme Long-Context Videos
di: Ren, Xubin, et al.
Pubblicazione: (2025)
di: Ren, Xubin, et al.
Pubblicazione: (2025)
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
di: Huang, Jinghao, et al.
Pubblicazione: (2025)
di: Huang, Jinghao, et al.
Pubblicazione: (2025)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
di: Reddy, Arun, et al.
Pubblicazione: (2025)
di: Reddy, Arun, et al.
Pubblicazione: (2025)
Semi-Supervised Image-Based Narrative Extraction: A Case Study with Historical Photographic Records
di: German, Fausto, et al.
Pubblicazione: (2025)
di: German, Fausto, et al.
Pubblicazione: (2025)
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
di: Tang, Hengzhu, et al.
Pubblicazione: (2025)
di: Tang, Hengzhu, et al.
Pubblicazione: (2025)
GMM-Based Comprehensive Feature Extraction and Relative Distance Preservation For Few-Shot Cross-Modal Retrieval
di: Sun, Chengsong, et al.
Pubblicazione: (2025)
di: Sun, Chengsong, et al.
Pubblicazione: (2025)
LSC-ADL: An Activity of Daily Living (ADL)-Annotated Lifelog Dataset Generated via Semi-Automatic Clustering
di: Ho-Le, Minh-Quan, et al.
Pubblicazione: (2025)
di: Ho-Le, Minh-Quan, et al.
Pubblicazione: (2025)
Adapting MLLMs for Nuanced Video Retrieval
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
di: Skow, Tyler, et al.
Pubblicazione: (2026)
di: Skow, Tyler, et al.
Pubblicazione: (2026)
Event-aware Video Corpus Moment Retrieval
di: Hou, Danyang, et al.
Pubblicazione: (2024)
di: Hou, Danyang, et al.
Pubblicazione: (2024)
A Flexible and Scalable Framework for Video Moment Search
di: Zhang, Chongzhi, et al.
Pubblicazione: (2025)
di: Zhang, Chongzhi, et al.
Pubblicazione: (2025)
Hierarchical Long Video Understanding with Audiovisual Entity Cohesion and Agentic Search
di: Yin, Xinlei, et al.
Pubblicazione: (2026)
di: Yin, Xinlei, et al.
Pubblicazione: (2026)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
di: Li, Minghan, et al.
Pubblicazione: (2026)
di: Li, Minghan, et al.
Pubblicazione: (2026)
NextAds: Towards Next-generation Personalized Video Advertising
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
di: Hou, Danyang, et al.
Pubblicazione: (2024)
di: Hou, Danyang, et al.
Pubblicazione: (2024)
Multimodal Language Models for Domain-Specific Procedural Video Summarization
di: Hussain, Nafisa
Pubblicazione: (2024)
di: Hussain, Nafisa
Pubblicazione: (2024)
MARQUIS: A Three-Stage Pipeline for Video Retrieval-Augmented Generation
di: Chakraborty, Debashish, et al.
Pubblicazione: (2026)
di: Chakraborty, Debashish, et al.
Pubblicazione: (2026)
Personalized Video Summarization using Text-Based Queries and Conditional Modeling
di: Huang, Jia-Hong
Pubblicazione: (2024)
di: Huang, Jia-Hong
Pubblicazione: (2024)
Generative Ghost: Investigating Ranking Bias Hidden in AI-Generated Videos
di: Gao, Haowen, et al.
Pubblicazione: (2025)
di: Gao, Haowen, et al.
Pubblicazione: (2025)
TrajSV: A Trajectory-based Model for Sports Video Representations and Applications
di: Wang, Zheng, et al.
Pubblicazione: (2025)
di: Wang, Zheng, et al.
Pubblicazione: (2025)
TalentMine: LLM-Based Extraction and Question-Answering from Multimodal Talent Tables
di: Mannam, Varun, et al.
Pubblicazione: (2025)
di: Mannam, Varun, et al.
Pubblicazione: (2025)
POBEVM: Real-time Video Matting via Progressively Optimize the Target Body and Edge
di: Xian, Jianming
Pubblicazione: (2024)
di: Xian, Jianming
Pubblicazione: (2024)
Describe What You See with Multimodal Large Language Models to Enhance Video Recommendations
di: De Nadai, Marco, et al.
Pubblicazione: (2025)
di: De Nadai, Marco, et al.
Pubblicazione: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
di: Li, Jun, et al.
Pubblicazione: (2025)
di: Li, Jun, et al.
Pubblicazione: (2025)
MealRec: Multi-granularity Sequential Modeling via Hierarchical Diffusion Models for Micro-Video Recommendation
di: Dong, Xinxin, et al.
Pubblicazione: (2026)
di: Dong, Xinxin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
From Captions to Keyframes: KeyScore for Multimodal Frame Scoring and Video-Language Understanding
di: Lin, Shih-Yao, et al.
Pubblicazione: (2025) -
LongVidSearch: An Agentic Benchmark for Multi-hop Evidence Retrieval Planning in Long Videos
di: Yu, Rongyi, et al.
Pubblicazione: (2026) -
VKIE: The Application of Key Information Extraction on Video Text
di: An, Siyu, et al.
Pubblicazione: (2023) -
VideoAgent: Long-form Video Understanding with Large Language Model as Agent
di: Wang, Xiaohan, et al.
Pubblicazione: (2024) -
Understanding Long Videos via LLM-Powered Entity Relation Graphs
di: Chu, Meng, et al.
Pubblicazione: (2025)