SD-VSum: A Method and Dataset for Script-Driven Video Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Mylonas, Manolis, Apostolidis, Evlampios, Mezaris, Vasileios |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SD-MVSum: Script-Driven Multimodal Video Summarization Method and Datasets
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
An Integrated Framework for Multi-Granular Explanation of Video Summarization
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
An Experimental Study on Generating Plausible Textual Explanations for Video Summarization
di: Eleftheriadis, Thomas, et al.
Pubblicazione: (2025)
di: Eleftheriadis, Thomas, et al.
Pubblicazione: (2025)
TSalV360: A Method and Dataset for Text-driven Saliency Detection in 360-Degrees Videos
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2025)
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2025)
Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated Samples
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2025)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2025)
VidCtx: Context-aware Video Question Answering with Image Models
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
Exploiting LMM-based knowledge for image classification tasks
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
Towards Quantitative Evaluation of Explainable AI Methods for Deepfake Detection
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
Sens-VisualNews: A Benchmark Dataset for Sensational Image Detection
di: Goulas, Andreas, et al.
Pubblicazione: (2026)
di: Goulas, Andreas, et al.
Pubblicazione: (2026)
T-TAME: Trainable Attention Mechanism for Explaining Convolutional Networks and Vision Transformers
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2024)
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2024)
SoccerHigh: A Benchmark Dataset for Automatic Soccer Video Summarization
di: Díaz-Juan, Artur, et al.
Pubblicazione: (2025)
di: Díaz-Juan, Artur, et al.
Pubblicazione: (2025)
Visual and audio scene classification for detecting discrepancies in video: a baseline method and experimental protocol
di: Apostolidis, Konstantinos, et al.
Pubblicazione: (2024)
di: Apostolidis, Konstantinos, et al.
Pubblicazione: (2024)
LMM-Regularized CLIP Embeddings for Image Classification
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
Unsupervised Transcript-assisted Video Summarization and Highlight Detection
di: Barbakos, Spyros, et al.
Pubblicazione: (2025)
di: Barbakos, Spyros, et al.
Pubblicazione: (2025)
UBiSS: A Unified Framework for Bimodal Semantic Summarization of Videos
di: Mei, Yuting, et al.
Pubblicazione: (2024)
di: Mei, Yuting, et al.
Pubblicazione: (2024)
Video Summarization: Towards Entity-Aware Captions
di: Ayyubi, Hammad A., et al.
Pubblicazione: (2023)
di: Ayyubi, Hammad A., et al.
Pubblicazione: (2023)
MSC: A Marine Wildlife Video Dataset with Grounded Segmentation and Clip-Level Captioning
di: Truong, Quang-Trung, et al.
Pubblicazione: (2025)
di: Truong, Quang-Trung, et al.
Pubblicazione: (2025)
JPEG AI Image Compression Visual Artifacts: Detection Methods and Dataset
di: Tsereh, Daria, et al.
Pubblicazione: (2024)
di: Tsereh, Daria, et al.
Pubblicazione: (2024)
Reinforcement Learning for Unsupervised Video Summarization with Reward Generator Training
di: Abbasi, Mehryar, et al.
Pubblicazione: (2024)
di: Abbasi, Mehryar, et al.
Pubblicazione: (2024)
Official-NV: An LLM-Generated News Video Dataset for Multimodal Fake News Detection
di: Wang, Yihao, et al.
Pubblicazione: (2024)
di: Wang, Yihao, et al.
Pubblicazione: (2024)
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
di: Gan, Qijun, et al.
Pubblicazione: (2025)
di: Gan, Qijun, et al.
Pubblicazione: (2025)
Using AI to Summarize US Presidential Campaign TV Advertisement Videos, 1952-2012
di: Breuer, Adam, et al.
Pubblicazione: (2025)
di: Breuer, Adam, et al.
Pubblicazione: (2025)
Moiré Video Authentication: A Physical Signature Against AI Video Generation
di: Qing, Yuan, et al.
Pubblicazione: (2026)
di: Qing, Yuan, et al.
Pubblicazione: (2026)
Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input
di: Liu, Jiajun, et al.
Pubblicazione: (2024)
di: Liu, Jiajun, et al.
Pubblicazione: (2024)
TalkVerse: Democratizing Minute-Long Audio-Driven Video Generation
di: Wang, Zhenzhi, et al.
Pubblicazione: (2025)
di: Wang, Zhenzhi, et al.
Pubblicazione: (2025)
FlowPortrait: Reinforcement Learning for Audio-Driven Portrait Video Generation
di: Tan, Weiting, et al.
Pubblicazione: (2026)
di: Tan, Weiting, et al.
Pubblicazione: (2026)
Video Seal: Open and Efficient Video Watermarking
di: Fernandez, Pierre, et al.
Pubblicazione: (2024)
di: Fernandez, Pierre, et al.
Pubblicazione: (2024)
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
di: Ku, Max, et al.
Pubblicazione: (2024)
di: Ku, Max, et al.
Pubblicazione: (2024)
Decoupled Audio-Visual Dataset Distillation
di: Li, Wenyuan, et al.
Pubblicazione: (2025)
di: Li, Wenyuan, et al.
Pubblicazione: (2025)
FedVideoMAE: Efficient Privacy-Preserving Federated Video Moderation
di: Tao, Ziyuan, et al.
Pubblicazione: (2025)
di: Tao, Ziyuan, et al.
Pubblicazione: (2025)
CrypticBio: A Large Multimodal Dataset for Visually Confusing Biodiversity
di: Manolache, Georgiana, et al.
Pubblicazione: (2025)
di: Manolache, Georgiana, et al.
Pubblicazione: (2025)
IDNet: A Novel Dataset for Identity Document Analysis and Fraud Detection
di: Guan, Hong, et al.
Pubblicazione: (2024)
di: Guan, Hong, et al.
Pubblicazione: (2024)
Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding
di: Wang, Yun, et al.
Pubblicazione: (2025)
di: Wang, Yun, et al.
Pubblicazione: (2025)
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing
di: Gu, Jing, et al.
Pubblicazione: (2024)
di: Gu, Jing, et al.
Pubblicazione: (2024)
LMVD: A Large-Scale Multimodal Vlog Dataset for Depression Detection in the Wild
di: He, Lang, et al.
Pubblicazione: (2024)
di: He, Lang, et al.
Pubblicazione: (2024)
Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
di: Meng, Jiahao, et al.
Pubblicazione: (2025)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation
di: Yan, Xin, et al.
Pubblicazione: (2024)
di: Yan, Xin, et al.
Pubblicazione: (2024)
DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement
di: Wu, Hao, et al.
Pubblicazione: (2024)
di: Wu, Hao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SD-MVSum: Script-Driven Multimodal Video Summarization Method and Datasets
di: Mylonas, Manolis, et al.
Pubblicazione: (2025) -
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024) -
An Integrated Framework for Multi-Granular Explanation of Video Summarization
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024) -
An Experimental Study on Generating Plausible Textual Explanations for Video Summarization
di: Eleftheriadis, Thomas, et al.
Pubblicazione: (2025) -
TSalV360: A Method and Dataset for Text-driven Saliency Detection in 360-Degrees Videos
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2025)