Video Summarization using Denoising Diffusion Probabilistic Model
Fuente:
arXiv
Saved in:
| Main Authors: | Shang, Zirui, Zhu, Yubo, Li, Hongxi, Yang, Shuo, Wu, Xinxiao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LLM-powered Query Expansion for Enhancing Boundary Prediction in Language-driven Action Localization
by: Shang, Zirui, et al.
Published: (2025)
by: Shang, Zirui, et al.
Published: (2025)
METOR: A Unified Framework for Mutual Enhancement of Objects and Relationships in Open-vocabulary Video Visual Relationship Detection
by: Wang, Yongqi, et al.
Published: (2025)
by: Wang, Yongqi, et al.
Published: (2025)
End-to-end Open-vocabulary Video Visual Relationship Detection using Multi-modal Prompting
by: Wang, Yongqi, et al.
Published: (2024)
by: Wang, Yongqi, et al.
Published: (2024)
Data-free Multi-label Image Recognition via LLM-powered Prompt Tuning
by: Yang, Shuo, et al.
Published: (2024)
by: Yang, Shuo, et al.
Published: (2024)
LLM-enhanced Action-aware Multi-modal Prompt Tuning for Image-Text Matching
by: Tian, Mengxiao, et al.
Published: (2025)
by: Tian, Mengxiao, et al.
Published: (2025)
How Vision-Language Tasks Benefit from Large Pre-trained Models: A Survey
by: Qi, Yayun, et al.
Published: (2024)
by: Qi, Yayun, et al.
Published: (2024)
Self-Prompting Diffusion Transformer for Open-Vocabulary Scene Text Editing via In-Context Learning
by: Li, Hongxi, et al.
Published: (2026)
by: Li, Hongxi, et al.
Published: (2026)
VUDG: A Dataset for Video Understanding Domain Generalization
by: Wang, Ziyi, et al.
Published: (2025)
by: Wang, Ziyi, et al.
Published: (2025)
DiffCLIP: Leveraging Stable Diffusion for Language Grounded 3D Classification
by: Shen, Sitian, et al.
Published: (2023)
by: Shen, Sitian, et al.
Published: (2023)
qMRI Diffuser: Quantitative T1 Mapping of the Brain using a Denoising Diffusion Probabilistic Model
by: Wang, Shishuai, et al.
Published: (2024)
by: Wang, Shishuai, et al.
Published: (2024)
GaussianDiffusion: 3D Gaussian Splatting for Denoising Diffusion Probabilistic Models with Structured Noise
by: Li, Xinhai, et al.
Published: (2023)
by: Li, Xinhai, et al.
Published: (2023)
LiDAR Data Synthesis with Denoising Diffusion Probabilistic Models
by: Nakashima, Kazuto, et al.
Published: (2023)
by: Nakashima, Kazuto, et al.
Published: (2023)
TongUI: Internet-Scale Trajectories from Multimodal Web Tutorials for Generalized GUI Agents
by: Zhang, Bofei, et al.
Published: (2025)
by: Zhang, Bofei, et al.
Published: (2025)
Annotated Biomedical Video Generation using Denoising Diffusion Probabilistic Models and Flow Fields
by: Yilmaz, Rüveyda, et al.
Published: (2024)
by: Yilmaz, Rüveyda, et al.
Published: (2024)
BGDB: Bernoulli-Gaussian Decision Block with Improved Denoising Diffusion Probabilistic Models
by: Sun, Chengkun, et al.
Published: (2024)
by: Sun, Chengkun, et al.
Published: (2024)
MF2Summ: Multimodal Fusion for Video Summarization with Temporal Alignment
by: wang, Shuo, et al.
Published: (2025)
by: wang, Shuo, et al.
Published: (2025)
Storyboard guided Alignment for Fine-grained Video Action Recognition
by: Liu, Enqi, et al.
Published: (2024)
by: Liu, Enqi, et al.
Published: (2024)
Multi-Conditioned Denoising Diffusion Probabilistic Model (mDDPM) for Medical Image Synthesis
by: Krishna, Arjun, et al.
Published: (2024)
by: Krishna, Arjun, et al.
Published: (2024)
Denoising Reuse: Exploiting Inter-frame Motion Consistency for Efficient Video Latent Generation
by: Wang, Chenyu, et al.
Published: (2024)
by: Wang, Chenyu, et al.
Published: (2024)
Limited-Angle CBCT Reconstruction via Geometry-Integrated Cycle-domain Denoising Diffusion Probabilistic Models
by: Gao, Yuan, et al.
Published: (2025)
by: Gao, Yuan, et al.
Published: (2025)
Denoise to Track: Harnessing Video Diffusion Priors for Robust Correspondence
by: Yuan, Tianyu, et al.
Published: (2025)
by: Yuan, Tianyu, et al.
Published: (2025)
D$^2$-DPM: Dual Denoising for Quantized Diffusion Probabilistic Models
by: Zeng, Qian, et al.
Published: (2025)
by: Zeng, Qian, et al.
Published: (2025)
Brick-Diffusion: Generating Long Videos with Brick-to-Wall Denoising
by: Yuan, Yunlong, et al.
Published: (2025)
by: Yuan, Yunlong, et al.
Published: (2025)
Denoising Diffusion Step-aware Models
by: Yang, Shuai, et al.
Published: (2023)
by: Yang, Shuai, et al.
Published: (2023)
Denoise-then-Retrieve: Text-Conditioned Video Denoising for Video Moment Retrieval
by: Liu, Weijia, et al.
Published: (2025)
by: Liu, Weijia, et al.
Published: (2025)
Resfusion: Denoising Diffusion Probabilistic Models for Image Restoration Based on Prior Residual Noise
by: Shi, Zhenning, et al.
Published: (2023)
by: Shi, Zhenning, et al.
Published: (2023)
Video Summarization with Large Language Models
by: Lee, Min Jung, et al.
Published: (2025)
by: Lee, Min Jung, et al.
Published: (2025)
Enhancing Video Memorability Prediction with Text-Motion Cross-modal Contrastive Loss and Its Application in Video Summarization
by: Zhu, Zhiyi, et al.
Published: (2025)
by: Zhu, Zhiyi, et al.
Published: (2025)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
by: Chen, Feng, et al.
Published: (2024)
by: Chen, Feng, et al.
Published: (2024)
DDPM-CD: Denoising Diffusion Probabilistic Models as Feature Extractors for Change Detection
by: Bandara, Wele Gedara Chaminda, et al.
Published: (2022)
by: Bandara, Wele Gedara Chaminda, et al.
Published: (2022)
Simultaneous Dual-View Mammogram Synthesis Using Denoising Diffusion Probabilistic Models
by: Garza-Abdala, Jorge Alberto, et al.
Published: (2026)
by: Garza-Abdala, Jorge Alberto, et al.
Published: (2026)
DiffSSC: Semantic LiDAR Scan Completion using Denoising Diffusion Probabilistic Models
by: Cao, Helin, et al.
Published: (2024)
by: Cao, Helin, et al.
Published: (2024)
Directly Denoising Diffusion Models
by: Zhang, Dan, et al.
Published: (2024)
by: Zhang, Dan, et al.
Published: (2024)
SAR Despeckling via Regional Denoising Diffusion Probabilistic Model
by: Hu, Xuran, et al.
Published: (2024)
by: Hu, Xuran, et al.
Published: (2024)
Exploring Data-Free LoRA Transferability for Video Diffusion Models
by: Wang, Yuchen, et al.
Published: (2026)
by: Wang, Yuchen, et al.
Published: (2026)
Denoising Diffusion Probabilistic Models for Magnetic Resonance Fingerprinting
by: Mayo, Perla, et al.
Published: (2024)
by: Mayo, Perla, et al.
Published: (2024)
Paired Diffusion: Generation of related, synthetic PET-CT-Segmentation scans using Linked Denoising Diffusion Probabilistic Models
by: Bradbury, Rowan, et al.
Published: (2024)
by: Bradbury, Rowan, et al.
Published: (2024)
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
by: Tian, Ye, et al.
Published: (2025)
by: Tian, Ye, et al.
Published: (2025)
MammoRGB: Dual-View Mammogram Synthesis Using Denoising Diffusion Probabilistic Models
by: Garza-Abdala, Jorge Alberto, et al.
Published: (2025)
by: Garza-Abdala, Jorge Alberto, et al.
Published: (2025)
Causality in Video Diffusers is Separable from Denoising
by: Bai, Xingjian, et al.
Published: (2026)
by: Bai, Xingjian, et al.
Published: (2026)
Similar Items
-
LLM-powered Query Expansion for Enhancing Boundary Prediction in Language-driven Action Localization
by: Shang, Zirui, et al.
Published: (2025) -
METOR: A Unified Framework for Mutual Enhancement of Objects and Relationships in Open-vocabulary Video Visual Relationship Detection
by: Wang, Yongqi, et al.
Published: (2025) -
End-to-end Open-vocabulary Video Visual Relationship Detection using Multi-modal Prompting
by: Wang, Yongqi, et al.
Published: (2024) -
Data-free Multi-label Image Recognition via LLM-powered Prompt Tuning
by: Yang, Shuo, et al.
Published: (2024) -
LLM-enhanced Action-aware Multi-modal Prompt Tuning for Image-Text Matching
by: Tian, Mengxiao, et al.
Published: (2025)