CFSum: A Transformer-Based Multi-Modal Video Summarization Framework With Coarse-Fine Fusion

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Guo, Yaowei, Xing, Jiazheng, Hou, Xiaojun, Xin, Shuo, Jiang, Juntao, Terzopoulos, Demetri, Jiang, Chenfanfu, Liu, Yong
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi