Video Summarisation with Incident and Context Information using Generative AI
Fuente:
arXiv
Salvato in:
| Autori principali: | De Silva, Ulindu, Fernando, Leon, Bandara, Kalinga, Nawaratne, Rashmika |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ScreenWriter: Automatic Screenplay Generation and Movie Summarisation
di: Mahon, Louis, et al.
Pubblicazione: (2024)
di: Mahon, Louis, et al.
Pubblicazione: (2024)
Region-Constraint In-Context Generation for Instructional Video Editing
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
Learning Video Context as Interleaved Multimodal Sequences
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2024)
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2024)
Context Guided Transformer Entropy Modeling for Video Compression
di: Tong, Junlong, et al.
Pubblicazione: (2025)
di: Tong, Junlong, et al.
Pubblicazione: (2025)
Hybrid Local-Global Context Learning for Neural Video Compression
di: Zhai, Yongqi, et al.
Pubblicazione: (2024)
di: Zhai, Yongqi, et al.
Pubblicazione: (2024)
Context-Enhanced Video Moment Retrieval with Large Language Models
di: Liu, Weijia, et al.
Pubblicazione: (2024)
di: Liu, Weijia, et al.
Pubblicazione: (2024)
Face Consistency Benchmark for GenAI Video
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
di: Podstawski, Michal, et al.
Pubblicazione: (2025)
Viewport Prediction for Volumetric Video Streaming by Exploring Video Saliency and Trajectory Information
di: Li, Jie, et al.
Pubblicazione: (2023)
di: Li, Jie, et al.
Pubblicazione: (2023)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
di: Li, Minghan, et al.
Pubblicazione: (2026)
di: Li, Minghan, et al.
Pubblicazione: (2026)
Generative Frame Sampler for Long Video Understanding
di: Yao, Linli, et al.
Pubblicazione: (2025)
di: Yao, Linli, et al.
Pubblicazione: (2025)
Human Motion Video Generation: A Survey
di: Xue, Haiwei, et al.
Pubblicazione: (2025)
di: Xue, Haiwei, et al.
Pubblicazione: (2025)
Extending Visual Dynamics for Video-to-Music Generation
di: Liu, Xiaohao, et al.
Pubblicazione: (2025)
di: Liu, Xiaohao, et al.
Pubblicazione: (2025)
TAVGBench: Benchmarking Text to Audible-Video Generation
di: Mao, Yuxin, et al.
Pubblicazione: (2024)
di: Mao, Yuxin, et al.
Pubblicazione: (2024)
Identity-Preserving Text-to-Video Generation by Frequency Decomposition
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
Moiré Video Authentication: A Physical Signature Against AI Video Generation
di: Qing, Yuan, et al.
Pubblicazione: (2026)
di: Qing, Yuan, et al.
Pubblicazione: (2026)
Exploring Mutual Cross-Modal Attention for Context-Aware Human Affordance Generation
di: Roy, Prasun, et al.
Pubblicazione: (2025)
di: Roy, Prasun, et al.
Pubblicazione: (2025)
A Sleep Monitoring System Based on Audio, Video and Depth Information
di: Chen, Lyn Chao-ling, et al.
Pubblicazione: (2025)
di: Chen, Lyn Chao-ling, et al.
Pubblicazione: (2025)
SSNVC: Single Stream Neural Video Compression with Implicit Temporal Information
di: Wang, Feng, et al.
Pubblicazione: (2024)
di: Wang, Feng, et al.
Pubblicazione: (2024)
A Survey on Generative AI and LLM for Video Generation, Understanding, and Streaming
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
di: Zhou, Pengyuan, et al.
Pubblicazione: (2024)
T-GVC: Trajectory-Guided Generative Video Coding at Ultra-Low Bitrates
di: Wang, Zhitao, et al.
Pubblicazione: (2025)
di: Wang, Zhitao, et al.
Pubblicazione: (2025)
TA-V2A: Textually Assisted Video-to-Audio Generation
di: You, Yuhuan, et al.
Pubblicazione: (2025)
di: You, Yuhuan, et al.
Pubblicazione: (2025)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
MSVBench: Towards Human-Level Evaluation of Multi-Shot Video Generation
di: Shi, Haoyuan, et al.
Pubblicazione: (2026)
di: Shi, Haoyuan, et al.
Pubblicazione: (2026)
Unbiased Video Scene Graph Generation via Visual and Semantic Dual Debiasing
di: Li, Yanjun, et al.
Pubblicazione: (2025)
di: Li, Yanjun, et al.
Pubblicazione: (2025)
A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
di: Zhou, S. Z., et al.
Pubblicazione: (2025)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
di: Zhang, Jiaxu, et al.
Pubblicazione: (2025)
di: Zhang, Jiaxu, et al.
Pubblicazione: (2025)
Controllable Complex Human Motion Video Generation via Text-to-Skeleton Cascades
di: Taghipour, Ashkan, et al.
Pubblicazione: (2026)
di: Taghipour, Ashkan, et al.
Pubblicazione: (2026)
Generalized Video Anomaly Event Detection: Systematic Taxonomy and Comparison of Deep Models
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
di: Qu, Bowen, et al.
Pubblicazione: (2024)
di: Qu, Bowen, et al.
Pubblicazione: (2024)
PathAsst: A Generative Foundation AI Assistant Towards Artificial General Intelligence of Pathology
di: Sun, Yuxuan, et al.
Pubblicazione: (2023)
di: Sun, Yuxuan, et al.
Pubblicazione: (2023)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
di: Chen, Liyang, et al.
Pubblicazione: (2025)
di: Chen, Liyang, et al.
Pubblicazione: (2025)
LipGen: Viseme-Guided Lip Video Generation for Enhancing Visual Speech Recognition
di: Hao, Bowen, et al.
Pubblicazione: (2025)
di: Hao, Bowen, et al.
Pubblicazione: (2025)
OmniScript: Towards Audio-Visual Script Generation for Long-Form Cinematic Video
di: Pu, Junfu, et al.
Pubblicazione: (2026)
di: Pu, Junfu, et al.
Pubblicazione: (2026)
AIS 2024 Challenge on Video Quality Assessment of User-Generated Content: Methods and Results
di: Conde, Marcos V., et al.
Pubblicazione: (2024)
di: Conde, Marcos V., et al.
Pubblicazione: (2024)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
di: Gao, Jiayi, et al.
Pubblicazione: (2025)
di: Gao, Jiayi, et al.
Pubblicazione: (2025)
Context-aware TFL: A Universal Context-aware Contrastive Learning Framework for Temporal Forgery Localization
di: Yin, Qilin, et al.
Pubblicazione: (2025)
di: Yin, Qilin, et al.
Pubblicazione: (2025)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
Consistency-aware Fake Videos Detection on Short Video Platforms
di: Wang, Junxi, et al.
Pubblicazione: (2025)
di: Wang, Junxi, et al.
Pubblicazione: (2025)
Looking Backward: Streaming Video-to-Video Translation with Feature Banks
di: Liang, Feng, et al.
Pubblicazione: (2024)
di: Liang, Feng, et al.
Pubblicazione: (2024)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ScreenWriter: Automatic Screenplay Generation and Movie Summarisation
di: Mahon, Louis, et al.
Pubblicazione: (2024) -
Region-Constraint In-Context Generation for Instructional Video Editing
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025) -
Learning Video Context as Interleaved Multimodal Sequences
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2024) -
Context Guided Transformer Entropy Modeling for Video Compression
di: Tong, Junlong, et al.
Pubblicazione: (2025) -
Hybrid Local-Global Context Learning for Neural Video Compression
di: Zhai, Yongqi, et al.
Pubblicazione: (2024)