Dense Video Captioning using Graph-based Sentence Summarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zhiwang, Xu, Dong, Ouyang, Wanli, Zhou, Luping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Show, Tell and Summarize: Dense Video Captioning Using Visual Cue Aided Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised Dense Video Captioning
di: Kim, Ye-Chan, et al.
Pubblicazione: (2026)
di: Kim, Ye-Chan, et al.
Pubblicazione: (2026)
Model Compression using Progressive Channel Pruning
di: Guo, Jinyang, et al.
Pubblicazione: (2025)
di: Guo, Jinyang, et al.
Pubblicazione: (2025)
Video Summarization: Towards Entity-Aware Captions
di: Ayyubi, Hammad A., et al.
Pubblicazione: (2023)
di: Ayyubi, Hammad A., et al.
Pubblicazione: (2023)
VideoSAGE: Video Summarization with Graph Representation Learning
di: Chaves, Jose M. Rojas, et al.
Pubblicazione: (2024)
di: Chaves, Jose M. Rojas, et al.
Pubblicazione: (2024)
Exploring Annotation-free Image Captioning with Retrieval-augmented Pseudo Sentence Generation
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
Dense Connector for MLLMs
di: Yao, Huanjin, et al.
Pubblicazione: (2024)
di: Yao, Huanjin, et al.
Pubblicazione: (2024)
Accurate and Fast Compressed Video Captioning
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
Improving Weakly Supervised Temporal Action Localization by Exploiting Multi-resolution Information in Temporal Domain
di: Su, Rui, et al.
Pubblicazione: (2025)
di: Su, Rui, et al.
Pubblicazione: (2025)
Progressive Cross-Stream Cooperation in Spatial and Temporal Domain for Action Localization
di: Su, Rui, et al.
Pubblicazione: (2019)
di: Su, Rui, et al.
Pubblicazione: (2019)
LVD-2M: A Long-take Video Dataset with Temporally Dense Captions
di: Xiong, Tianwei, et al.
Pubblicazione: (2024)
di: Xiong, Tianwei, et al.
Pubblicazione: (2024)
DIBS: Enhancing Dense Video Captioning with Unlabeled Videos via Pseudo Boundary Enrichment and Online Refinement
di: Wu, Hao, et al.
Pubblicazione: (2024)
di: Wu, Hao, et al.
Pubblicazione: (2024)
Language-guided Recursive Spatiotemporal Graph Modeling for Video Summarization
di: Park, Jungin, et al.
Pubblicazione: (2025)
di: Park, Jungin, et al.
Pubblicazione: (2025)
BLIP3-KALE: Knowledge Augmented Large-Scale Dense Captions
di: Awadalla, Anas, et al.
Pubblicazione: (2024)
di: Awadalla, Anas, et al.
Pubblicazione: (2024)
SCRA-VQA: Summarized Caption-Rerank for Augmented Large Language Models in Visual Question Answering
di: Zhang, Yan, et al.
Pubblicazione: (2025)
di: Zhang, Yan, et al.
Pubblicazione: (2025)
Rethinking 3D Dense Caption and Visual Grounding in A Unified Framework through Prompt-based Localization
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
Cluster-based Video Summarization with Temporal Context Awareness
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation
di: Wu, Shengqiong, et al.
Pubblicazione: (2025)
di: Wu, Shengqiong, et al.
Pubblicazione: (2025)
TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
di: Cheng, Wei-Yuan, et al.
Pubblicazione: (2026)
di: Cheng, Wei-Yuan, et al.
Pubblicazione: (2026)
ChartCap: Mitigating Hallucination of Dense Chart Captioning
di: Lim, Junyoung, et al.
Pubblicazione: (2025)
di: Lim, Junyoung, et al.
Pubblicazione: (2025)
CapRL: Stimulating Dense Image Caption Capabilities via Reinforcement Learning
di: Xing, Long, et al.
Pubblicazione: (2025)
di: Xing, Long, et al.
Pubblicazione: (2025)
Personalized Video Summarization by Multimodal Video Understanding
di: Chen, Brian, et al.
Pubblicazione: (2024)
di: Chen, Brian, et al.
Pubblicazione: (2024)
Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning
di: Ge, Shiping, et al.
Pubblicazione: (2024)
di: Ge, Shiping, et al.
Pubblicazione: (2024)
Enhancing Video Summarization with Context Awareness
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
di: Huynh-Lam, Hai-Dang, et al.
Pubblicazione: (2024)
DeVAn: Dense Video Annotation for Video-Language Models
di: Liu, Tingkai, et al.
Pubblicazione: (2023)
di: Liu, Tingkai, et al.
Pubblicazione: (2023)
Towards Multimodal Video Paragraph Captioning Models Robust to Missing Modality
di: Chen, Sishuo, et al.
Pubblicazione: (2024)
di: Chen, Sishuo, et al.
Pubblicazione: (2024)
EVC-MF: End-to-end Video Captioning Network with Multi-scale Features
di: Niu, Tian-Zi, et al.
Pubblicazione: (2024)
di: Niu, Tian-Zi, et al.
Pubblicazione: (2024)
Comparing Learning Paradigms for Egocentric Video Summarization
di: Wen, Daniel
Pubblicazione: (2025)
di: Wen, Daniel
Pubblicazione: (2025)
Describe Anything: Detailed Localized Image and Video Captioning
di: Lian, Long, et al.
Pubblicazione: (2025)
di: Lian, Long, et al.
Pubblicazione: (2025)
Towards Fine-Grained Human Motion Video Captioning
di: Song, Guorui, et al.
Pubblicazione: (2025)
di: Song, Guorui, et al.
Pubblicazione: (2025)
Do More Details Always Introduce More Hallucinations in LVLM-based Image Captioning?
di: Feng, Mingqian, et al.
Pubblicazione: (2024)
di: Feng, Mingqian, et al.
Pubblicazione: (2024)
Context-Aware Pseudo-Label Scoring for Zero-Shot Video Summarization
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
Depth Any Video with Scalable Synthetic Data
di: Yang, Honghui, et al.
Pubblicazione: (2024)
di: Yang, Honghui, et al.
Pubblicazione: (2024)
SynPO: Synergizing Descriptiveness and Preference Optimization for Video Detailed Captioning
di: Dang, Jisheng, et al.
Pubblicazione: (2025)
di: Dang, Jisheng, et al.
Pubblicazione: (2025)
Unveiling the Invisible: Captioning Videos with Metaphors
di: Kalarani, Abisek Rajakumar, et al.
Pubblicazione: (2024)
di: Kalarani, Abisek Rajakumar, et al.
Pubblicazione: (2024)
An Integrated Framework for Multi-Granular Explanation of Video Summarization
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
FastMap: Fast Queries Initialization Based Vectorized HD Map Reconstruction Framework
di: Hu, Haotian, et al.
Pubblicazione: (2025)
di: Hu, Haotian, et al.
Pubblicazione: (2025)
MAMS: Model-Agnostic Module Selection Framework for Video Captioning
di: Lee, Sangho, et al.
Pubblicazione: (2025)
di: Lee, Sangho, et al.
Pubblicazione: (2025)
Controllable Hybrid Captioner for Improved Long-form Video Understanding
di: Sasse, Kuleen, et al.
Pubblicazione: (2025)
di: Sasse, Kuleen, et al.
Pubblicazione: (2025)
InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption
di: Fan, Tiehan, et al.
Pubblicazione: (2024)
di: Fan, Tiehan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Show, Tell and Summarize: Dense Video Captioning Using Visual Cue Aided Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025) -
SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised Dense Video Captioning
di: Kim, Ye-Chan, et al.
Pubblicazione: (2026) -
Model Compression using Progressive Channel Pruning
di: Guo, Jinyang, et al.
Pubblicazione: (2025) -
Video Summarization: Towards Entity-Aware Captions
di: Ayyubi, Hammad A., et al.
Pubblicazione: (2023) -
VideoSAGE: Video Summarization with Graph Representation Learning
di: Chaves, Jose M. Rojas, et al.
Pubblicazione: (2024)