An Experimental Study on Generating Plausible Textual Explanations for Video Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Eleftheriadis, Thomas, Apostolidis, Evlampios, Mezaris, Vasileios |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Integrated Framework for Multi-Granular Explanation of Video Summarization
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
SD-VSum: A Method and Dataset for Script-Driven Video Summarization
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated Samples
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2025)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2025)
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024)
SD-MVSum: Script-Driven Multimodal Video Summarization Method and Datasets
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)
TSalV360: A Method and Dataset for Text-driven Saliency Detection in 360-Degrees Videos
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2025)
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2025)
Towards Quantitative Evaluation of Explainable AI Methods for Deepfake Detection
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
Sens-VisualNews: A Benchmark Dataset for Sensational Image Detection
di: Goulas, Andreas, et al.
Pubblicazione: (2026)
di: Goulas, Andreas, et al.
Pubblicazione: (2026)
LLaVA-CKD: Bottom-Up Cascaded Knowledge Distillation for Vision-Language Models
di: Gkalelis, Nikolaos, et al.
Pubblicazione: (2026)
di: Gkalelis, Nikolaos, et al.
Pubblicazione: (2026)
VidCtx: Context-aware Video Question Answering with Image Models
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
di: Goulas, Andreas, et al.
Pubblicazione: (2024)
Exploiting LMM-based knowledge for image classification tasks
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
P-TAME: Explain Any Image Classifier with Trained Perturbations
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2025)
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2025)
TAME: Attention Mechanism Based Feature Fusion for Generating Explanation Maps of Convolutional Neural Networks
di: Ntrougkas, Mariano, et al.
Pubblicazione: (2023)
di: Ntrougkas, Mariano, et al.
Pubblicazione: (2023)
T-TAME: Trainable Attention Mechanism for Explaining Convolutional Networks and Vision Transformers
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2024)
di: Ntrougkas, Mariano V., et al.
Pubblicazione: (2024)
MLLM-based Textual Explanations for Face Comparison
di: Sony, Redwan, et al.
Pubblicazione: (2026)
di: Sony, Redwan, et al.
Pubblicazione: (2026)
Visual and audio scene classification for detecting discrepancies in video: a baseline method and experimental protocol
di: Apostolidis, Konstantinos, et al.
Pubblicazione: (2024)
di: Apostolidis, Konstantinos, et al.
Pubblicazione: (2024)
Improving Multimodal Hateful Meme Detection Exploiting LMM-Generated Knowledge
di: Tzelepi, Maria, et al.
Pubblicazione: (2025)
di: Tzelepi, Maria, et al.
Pubblicazione: (2025)
SDAKD: Student Discriminator Assisted Knowledge Distillation for Super-Resolution Generative Adversarial Networks
di: Kaparinos, Nikolaos, et al.
Pubblicazione: (2025)
di: Kaparinos, Nikolaos, et al.
Pubblicazione: (2025)
VLIPP: Towards Physically Plausible Video Generation with Vision and Language Informed Physical Prior
di: Yang, Xindi, et al.
Pubblicazione: (2025)
di: Yang, Xindi, et al.
Pubblicazione: (2025)
PhyPrompt: RL-based Prompt Refinement for Physically Plausible Text-to-Video Generation
di: Wu, Shang, et al.
Pubblicazione: (2026)
di: Wu, Shang, et al.
Pubblicazione: (2026)
Personalized Video Summarization by Multimodal Video Understanding
di: Chen, Brian, et al.
Pubblicazione: (2024)
di: Chen, Brian, et al.
Pubblicazione: (2024)
LangXAI: Integrating Large Vision Models for Generating Textual Explanations to Enhance Explainability in Visual Perception Tasks
di: Nguyen, Truong Thanh Hung, et al.
Pubblicazione: (2024)
di: Nguyen, Truong Thanh Hung, et al.
Pubblicazione: (2024)
B-FPGM: Lightweight Face Detection via Bayesian-Optimized Soft FPGM Pruning
di: Kaparinos, Nikolaos, et al.
Pubblicazione: (2025)
di: Kaparinos, Nikolaos, et al.
Pubblicazione: (2025)
Online Anchor-based Training for Image Classification Tasks
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
Disturbing Image Detection Using LMM-Elicited Emotion Embeddings
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
VideoSAGE: Video Summarization with Graph Representation Learning
di: Chaves, Jose M. Rojas, et al.
Pubblicazione: (2024)
di: Chaves, Jose M. Rojas, et al.
Pubblicazione: (2024)
Enhancing Video Summarization with Context Awareness
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
Comparing Learning Paradigms for Egocentric Video Summarization
di: Wen, Daniel
Pubblicazione: (2025)
di: Wen, Daniel
Pubblicazione: (2025)
Show, Tell and Summarize: Dense Video Captioning Using Visual Cue Aided Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
LMM-Regularized CLIP Embeddings for Image Classification
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
di: Tzelepi, Maria, et al.
Pubblicazione: (2024)
Cluster-based Video Summarization with Temporal Context Awareness
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
Dynamic Distinction Learning: Adaptive Pseudo Anomalies for Video Anomaly Detection
di: Lappas, Demetris, et al.
Pubblicazione: (2024)
di: Lappas, Demetris, et al.
Pubblicazione: (2024)
LSA: Localized Semantic Alignment for Enhancing Temporal Consistency in Traffic Video Generation
di: Karimov, Mirlan, et al.
Pubblicazione: (2026)
di: Karimov, Mirlan, et al.
Pubblicazione: (2026)
Dense Video Captioning using Graph-based Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
Language-guided Recursive Spatiotemporal Graph Modeling for Video Summarization
di: Park, Jungin, et al.
Pubblicazione: (2025)
di: Park, Jungin, et al.
Pubblicazione: (2025)
Less is More: Label-Guided Summarization of Procedural and Instructional Videos
di: Rajpal, Shreya, et al.
Pubblicazione: (2026)
di: Rajpal, Shreya, et al.
Pubblicazione: (2026)
Exploring Efficient Foundational Multi-modal Models for Video Summarization
di: Samel, Karan, et al.
Pubblicazione: (2024)
di: Samel, Karan, et al.
Pubblicazione: (2024)
EdgeVidSum: Real-Time Personalized Video Summarization at the Edge
di: Mujtaba, Ghulam, et al.
Pubblicazione: (2025)
di: Mujtaba, Ghulam, et al.
Pubblicazione: (2025)
Context-Aware Pseudo-Label Scoring for Zero-Shot Video Summarization
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
Early Exit and Multi Stage Knowledge Distillation in VLMs for Video Summarization
di: Khan, Anas Anwarul Haq, et al.
Pubblicazione: (2025)
di: Khan, Anas Anwarul Haq, et al.
Pubblicazione: (2025)
Documenti analoghi
-
An Integrated Framework for Multi-Granular Explanation of Video Summarization
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024) -
SD-VSum: A Method and Dataset for Script-Driven Video Summarization
di: Mylonas, Manolis, et al.
Pubblicazione: (2025) -
Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated Samples
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2025) -
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
di: Kontostathis, Ioannis, et al.
Pubblicazione: (2024) -
SD-MVSum: Script-Driven Multimodal Video Summarization Method and Datasets
di: Mylonas, Manolis, et al.
Pubblicazione: (2025)