CFSum: A Transformer-Based Multi-Modal Video Summarization Framework With Coarse-Fine Fusion

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Guo, Yaowei, Xing, Jiazheng, Hou, Xiaojun, Xin, Shuo, Jiang, Juntao, Terzopoulos, Demetri, Jiang, Chenfanfu, Liu, Yong
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!