Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Min, Zhu, Hongzhou, Xiang, Chendong, Zheng, Kaiwen, Li, Chongxuan, Zhu, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025)
por: Zhao, Min, et al.
Publicado: (2025)
UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025)
por: Zhao, Min, et al.
Publicado: (2025)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
por: Zhao, Min, et al.
Publicado: (2026)
por: Zhao, Min, et al.
Publicado: (2026)
High-quality Image Dehazing with Diffusion Model
por: Yu, Hu, et al.
Publicado: (2023)
por: Yu, Hu, et al.
Publicado: (2023)
Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models
por: Bao, Fan, et al.
Publicado: (2024)
por: Bao, Fan, et al.
Publicado: (2024)
On Revisiting Entropy for Identifying Mislabeled Images
por: Li, Chunlei, et al.
Publicado: (2026)
por: Li, Chunlei, et al.
Publicado: (2026)
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
por: Feng, Yao, et al.
Publicado: (2025)
por: Feng, Yao, et al.
Publicado: (2025)
UltraViCo: Breaking Extrapolation Limits in Video Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025)
por: Zhao, Min, et al.
Publicado: (2025)
Warped Diffusion: Solving Video Inverse Problems with Image Diffusion Models
por: Daras, Giannis, et al.
Publicado: (2024)
por: Daras, Giannis, et al.
Publicado: (2024)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
Solving Video Inverse Problems Using Image Diffusion Models
por: Kwon, Taesung, et al.
Publicado: (2024)
por: Kwon, Taesung, et al.
Publicado: (2024)
CGI: Identifying Conditional Generative Models with Example Images
por: Zhou, Zhi, et al.
Publicado: (2025)
por: Zhou, Zhi, et al.
Publicado: (2025)
PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control
por: Zhong, Yong, et al.
Publicado: (2024)
por: Zhong, Yong, et al.
Publicado: (2024)
Conditional Image Synthesis with Diffusion Models: A Survey
por: Zhan, Zheyuan, et al.
Publicado: (2024)
por: Zhan, Zheyuan, et al.
Publicado: (2024)
SLA: Beyond Sparsity in Diffusion Transformers via Fine-Tunable Sparse-Linear Attention
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models
por: Zhao, Min, et al.
Publicado: (2026)
por: Zhao, Min, et al.
Publicado: (2026)
Elucidating and Endowing the Diffusion Training Paradigm for General Image Restoration
por: Lu, Xin, et al.
Publicado: (2025)
por: Lu, Xin, et al.
Publicado: (2025)
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
por: Niu, Muyao, et al.
Publicado: (2024)
por: Niu, Muyao, et al.
Publicado: (2024)
GEWDiff: Geometric Enhanced Wavelet-based Diffusion Model for Hyperspectral Image Super-resolution
por: Wang, Sirui, et al.
Publicado: (2025)
por: Wang, Sirui, et al.
Publicado: (2025)
On Memorization in Diffusion Models
por: Gu, Xiangming, et al.
Publicado: (2023)
por: Gu, Xiangming, et al.
Publicado: (2023)
Image-Conditional Diffusion Transformer for Underwater Image Enhancement
por: Nie, Xingyang, et al.
Publicado: (2024)
por: Nie, Xingyang, et al.
Publicado: (2024)
Scaling Diffusion Transformers Efficiently via $μ$P
por: Zheng, Chenyu, et al.
Publicado: (2025)
por: Zheng, Chenyu, et al.
Publicado: (2025)
Conditional Diffusion Model for Longitudinal Medical Image Generation
por: Dao, Duy-Phuong, et al.
Publicado: (2024)
por: Dao, Duy-Phuong, et al.
Publicado: (2024)
InpDiffusion: Image Inpainting Localization via Conditional Diffusion Models
por: Wang, Kai, et al.
Publicado: (2025)
por: Wang, Kai, et al.
Publicado: (2025)
Diffusion Image Generation with Explicit Modeling of Data Manifold Geometry
por: Xue, Duoduo, et al.
Publicado: (2026)
por: Xue, Duoduo, et al.
Publicado: (2026)
RetriBooru: Leakage-Free Retrieval of Conditions from Reference Images for Subject-Driven Generation
por: Tang, Haoran, et al.
Publicado: (2023)
por: Tang, Haoran, et al.
Publicado: (2023)
StableI2I: Spotting Unintended Changes in Image-to-Image Transition
por: Li, Jiayang, et al.
Publicado: (2026)
por: Li, Jiayang, et al.
Publicado: (2026)
Image Restoration via Diffusion Models with Dynamic Resolution
por: Zheng, Yang, et al.
Publicado: (2026)
por: Zheng, Yang, et al.
Publicado: (2026)
Mitigating Cross-Image Information Leakage in LVLMs for Multi-Image Tasks
por: Park, Yeji, et al.
Publicado: (2025)
por: Park, Yeji, et al.
Publicado: (2025)
Rethinking Video Tokenization: A Conditioned Diffusion-based Approach
por: Yang, Nianzu, et al.
Publicado: (2025)
por: Yang, Nianzu, et al.
Publicado: (2025)
Graph Conditioned Diffusion for Controllable Histopathology Image Generation
por: Cechnicka, Sarah, et al.
Publicado: (2025)
por: Cechnicka, Sarah, et al.
Publicado: (2025)
Learning Image Priors through Patch-based Diffusion Models for Solving Inverse Problems
por: Hu, Jason, et al.
Publicado: (2024)
por: Hu, Jason, et al.
Publicado: (2024)
Concat-ID: Towards Universal Identity-Preserving Video Synthesis
por: Zhong, Yong, et al.
Publicado: (2025)
por: Zhong, Yong, et al.
Publicado: (2025)
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
por: Li, Pengxiang, et al.
Publicado: (2023)
por: Li, Pengxiang, et al.
Publicado: (2023)
Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation
por: Si, Qi, et al.
Publicado: (2025)
por: Si, Qi, et al.
Publicado: (2025)
ReTool-Video: Recursive Tool-Using Video Agents with Meta-Augmented Tool Grounding
por: Liu, Xiao, et al.
Publicado: (2026)
por: Liu, Xiao, et al.
Publicado: (2026)
Controllable Coupled Image Generation via Diffusion Models
por: Yuan, Chenfei, et al.
Publicado: (2025)
por: Yuan, Chenfei, et al.
Publicado: (2025)
Paired Image Generation with Diffusion-Guided Diffusion Models
por: Zhang, Haoxuan, et al.
Publicado: (2025)
por: Zhang, Haoxuan, et al.
Publicado: (2025)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
por: Xian, Jia Jun Cheng, et al.
Publicado: (2025)
por: Xian, Jia Jun Cheng, et al.
Publicado: (2025)
FrameBridge: Improving Image-to-Video Generation with Bridge Models
por: Wang, Yuji, et al.
Publicado: (2024)
por: Wang, Yuji, et al.
Publicado: (2024)
Ejemplares similares
-
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025) -
UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025) -
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
por: Zhao, Min, et al.
Publicado: (2026) -
High-quality Image Dehazing with Diffusion Model
por: Yu, Hu, et al.
Publicado: (2023) -
Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models
por: Bao, Fan, et al.
Publicado: (2024)