Learning Plug-and-play Memory for Guiding Video Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Selena, Xu, Ziming, Zhang, Zijun, Zhou, Kun, Guo, Jiaxian, Qin, Lianhui, Huang, Biwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LPNSR: Optimal Noise-Guided Diffusion Image Super-Resolution Via Learnable Noise Prediction
por: Huang, Shuwei, et al.
Publicado: (2026)
por: Huang, Shuwei, et al.
Publicado: (2026)
Plug-and-play Diffusion Models for Image Compressive Sensing with Data Consistency Projection
por: Wang, Xiaodong, et al.
Publicado: (2025)
por: Wang, Xiaodong, et al.
Publicado: (2025)
Enabling Versatile Controls for Video Diffusion Models
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
HiGS: History-Guided Sampling for Plug-and-Play Enhancement of Diffusion Models
por: Sadat, Seyedmorteza, et al.
Publicado: (2025)
por: Sadat, Seyedmorteza, et al.
Publicado: (2025)
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
por: Lv, Chengtao, et al.
Publicado: (2025)
por: Lv, Chengtao, et al.
Publicado: (2025)
HyperAlign: Hypernetwork for Efficient Test-Time Alignment of Diffusion Models
por: Xie, Xin, et al.
Publicado: (2026)
por: Xie, Xin, et al.
Publicado: (2026)
GVD: Guiding Video Diffusion Model for Scalable Video Distillation
por: Li, Kunyang, et al.
Publicado: (2025)
por: Li, Kunyang, et al.
Publicado: (2025)
Small Drafts, Big Verdict: Information-Intensive Visual Reasoning via Speculation
por: Liu, Yuhan, et al.
Publicado: (2025)
por: Liu, Yuhan, et al.
Publicado: (2025)
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
por: Li, Pengxiang, et al.
Publicado: (2023)
por: Li, Pengxiang, et al.
Publicado: (2023)
Do Diffusion Models Learn Semantically Meaningful and Efficient Representations?
por: Liang, Qiyao, et al.
Publicado: (2024)
por: Liang, Qiyao, et al.
Publicado: (2024)
A Dataset Generation Scheme Based on Video2EEG-SPGN-Diffusion for SEED-VD
por: Guo, Yunfei, et al.
Publicado: (2025)
por: Guo, Yunfei, et al.
Publicado: (2025)
How Diffusion Models Learn to Factorize and Compose
por: Liang, Qiyao, et al.
Publicado: (2024)
por: Liang, Qiyao, et al.
Publicado: (2024)
Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model
por: Yin, Junhui, et al.
Publicado: (2026)
por: Yin, Junhui, et al.
Publicado: (2026)
Noise Calibration: Plug-and-play Content-Preserving Video Enhancement using Pre-trained Video Diffusion Models
por: Yang, Qinyu, et al.
Publicado: (2024)
por: Yang, Qinyu, et al.
Publicado: (2024)
SVGDreamer: Text Guided SVG Generation with Diffusion Model
por: Xing, Ximing, et al.
Publicado: (2023)
por: Xing, Ximing, et al.
Publicado: (2023)
Scaling the Long Video Understanding of Multimodal Large Language Models via Visual Memory Mechanism
por: Chen, Tao, et al.
Publicado: (2026)
por: Chen, Tao, et al.
Publicado: (2026)
Timeline and Boundary Guided Diffusion Network for Video Shadow Detection
por: Zhou, Haipeng, et al.
Publicado: (2024)
por: Zhou, Haipeng, et al.
Publicado: (2024)
Auto-scaling Continuous Memory for GUI Agent
por: Wu, Wenyi, et al.
Publicado: (2025)
por: Wu, Wenyi, et al.
Publicado: (2025)
TS-P$^2$CL: Plug-and-Play Dual Contrastive Learning for Vision-Guided Medical Time Series Classification
por: Xu, Qi'ao, et al.
Publicado: (2025)
por: Xu, Qi'ao, et al.
Publicado: (2025)
VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control
por: Bian, Yuxuan, et al.
Publicado: (2025)
por: Bian, Yuxuan, et al.
Publicado: (2025)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
por: Yang, Ling, et al.
Publicado: (2024)
por: Yang, Ling, et al.
Publicado: (2024)
Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing
por: Lee, Dohun, et al.
Publicado: (2026)
por: Lee, Dohun, et al.
Publicado: (2026)
UnGuide: Learning to Forget with LoRA-Guided Diffusion Models
por: Polowczyk, Agnieszka, et al.
Publicado: (2025)
por: Polowczyk, Agnieszka, et al.
Publicado: (2025)
MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation
por: Zheng, Longtao, et al.
Publicado: (2024)
por: Zheng, Longtao, et al.
Publicado: (2024)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
por: Zhan, Zheng, et al.
Publicado: (2024)
por: Zhan, Zheng, et al.
Publicado: (2024)
Enhancing Self-Supervised Fine-Grained Video Object Tracking with Dynamic Memory Prediction
por: Zhou, Zihan, et al.
Publicado: (2025)
por: Zhou, Zihan, et al.
Publicado: (2025)
HCVP: Leveraging Hierarchical Contrastive Visual Prompt for Domain Generalization
por: Zhou, Guanglin, et al.
Publicado: (2024)
por: Zhou, Guanglin, et al.
Publicado: (2024)
PADS: Plug-and-Play 3D Human Pose Analysis via Diffusion Generative Modeling
por: Ji, Haorui, et al.
Publicado: (2024)
por: Ji, Haorui, et al.
Publicado: (2024)
VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide
por: Lee, Dohun, et al.
Publicado: (2024)
por: Lee, Dohun, et al.
Publicado: (2024)
Coherent Video Inpainting Using Optical Flow-Guided Efficient Diffusion
por: Gu, Bohai, et al.
Publicado: (2024)
por: Gu, Bohai, et al.
Publicado: (2024)
FAIRT2V: Training-Free Debiasing for Text-to-Video Diffusion Models
por: Zhong, Haonan, et al.
Publicado: (2026)
por: Zhong, Haonan, et al.
Publicado: (2026)
DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models
por: Xing, Ximing, et al.
Publicado: (2023)
por: Xing, Ximing, et al.
Publicado: (2023)
MAVIN: Multi-Action Video Generation with Diffusion Models via Transition Video Infilling
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
Learning Spatiotemporal Sensitivity in Video LLMs via Counterfactual Reinforcement Learning
por: Du, Dazhao, et al.
Publicado: (2026)
por: Du, Dazhao, et al.
Publicado: (2026)
Pack and Force Your Memory: Long-form and Consistent Video Generation
por: Wu, Xiaofei, et al.
Publicado: (2025)
por: Wu, Xiaofei, et al.
Publicado: (2025)
QVD: Post-training Quantization for Video Diffusion Models
por: Tian, Shilong, et al.
Publicado: (2024)
por: Tian, Shilong, et al.
Publicado: (2024)
VideoEraser: Concept Erasure in Text-to-Video Diffusion Models
por: Xu, Naen, et al.
Publicado: (2025)
por: Xu, Naen, et al.
Publicado: (2025)
Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation
por: Si, Qi, et al.
Publicado: (2025)
por: Si, Qi, et al.
Publicado: (2025)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
por: Zhou, Mingde, et al.
Publicado: (2026)
por: Zhou, Mingde, et al.
Publicado: (2026)
Robust Polyp Detection and Diagnosis through Compositional Prompt-Guided Diffusion Models
por: Yu, Jia, et al.
Publicado: (2025)
por: Yu, Jia, et al.
Publicado: (2025)
Ejemplares similares
-
LPNSR: Optimal Noise-Guided Diffusion Image Super-Resolution Via Learnable Noise Prediction
por: Huang, Shuwei, et al.
Publicado: (2026) -
Plug-and-play Diffusion Models for Image Compressive Sensing with Data Consistency Projection
por: Wang, Xiaodong, et al.
Publicado: (2025) -
Enabling Versatile Controls for Video Diffusion Models
por: Zhang, Xu, et al.
Publicado: (2025) -
HiGS: History-Guided Sampling for Plug-and-Play Enhancement of Diffusion Models
por: Sadat, Seyedmorteza, et al.
Publicado: (2025) -
LLMC+: Benchmarking Vision-Language Model Compression with a Plug-and-play Toolkit
por: Lv, Chengtao, et al.
Publicado: (2025)