JVID: Joint Video-Image Diffusion for Visual-Quality and Temporal-Consistency in Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Reynaud, Hadrien, Baugh, Matthew, Dombrowski, Mischa, Cechnicka, Sarah, Meng, Qingjie, Kainz, Bernhard |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Image Generation Diversity Issues and How to Tame Them
por: Dombrowski, Mischa, et al.
Publicado: (2024)
por: Dombrowski, Mischa, et al.
Publicado: (2024)
Video Dataset Condensation with Diffusion Models
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Uncovering Hidden Subspaces in Video Diffusion Models Using Re-Identification
por: Dombrowski, Mischa, et al.
Publicado: (2024)
por: Dombrowski, Mischa, et al.
Publicado: (2024)
EchoNet-Synthetic: Privacy-preserving Video Generation for Safe Medical Data Sharing
por: Reynaud, Hadrien, et al.
Publicado: (2024)
por: Reynaud, Hadrien, et al.
Publicado: (2024)
EchoFlow: A Foundation Model for Cardiac Ultrasound Image and Video Generation
por: Reynaud, Hadrien, et al.
Publicado: (2025)
por: Reynaud, Hadrien, et al.
Publicado: (2025)
Graph Conditioned Diffusion for Controllable Histopathology Image Generation
por: Cechnicka, Sarah, et al.
Publicado: (2025)
por: Cechnicka, Sarah, et al.
Publicado: (2025)
Noise Crystallization and Liquid Noise: Zero-shot Video Generation using Image Diffusion Models
por: Khan, Muhammad Haaris, et al.
Publicado: (2024)
por: Khan, Muhammad Haaris, et al.
Publicado: (2024)
Feature-Conditioned Cascaded Video Diffusion Models for Precise Echocardiogram Synthesis
por: Reynaud, Hadrien, et al.
Publicado: (2023)
por: Reynaud, Hadrien, et al.
Publicado: (2023)
Enabling PSO-Secure Synthetic Data Sharing Using Diversity-Aware Diffusion Models
por: Dombrowski, Mischa, et al.
Publicado: (2025)
por: Dombrowski, Mischa, et al.
Publicado: (2025)
The Learnability Gap in Medical Latent Diffusion
por: Dombrowski, Mischa, et al.
Publicado: (2026)
por: Dombrowski, Mischa, et al.
Publicado: (2026)
LCMem: A Universal Model for Robust Image Memorization Detection
por: Dombrowski, Mischa, et al.
Publicado: (2025)
por: Dombrowski, Mischa, et al.
Publicado: (2025)
URCDM: Ultra-Resolution Image Synthesis in Histopathology
por: Cechnicka, Sarah, et al.
Publicado: (2024)
por: Cechnicka, Sarah, et al.
Publicado: (2024)
Generate to Ground: Multimodal Text Conditioning Boosts Phrase Grounding in Medical Vision-Language Models
por: Nützel, Felix, et al.
Publicado: (2025)
por: Nützel, Felix, et al.
Publicado: (2025)
InfoMotion: A Graph-Based Approach to Video Dataset Distillation for Echocardiography
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Flow Matching with Optimized Subclass Priors for Medical Image Augmentation
por: Nützel, Felix, et al.
Publicado: (2026)
por: Nützel, Felix, et al.
Publicado: (2026)
GRASP: Guided Residual Adapters with Sample-wise Partitioning
por: Nützel, Felix, et al.
Publicado: (2025)
por: Nützel, Felix, et al.
Publicado: (2025)
Leveraging Multi-Modal Information to Enhance Dataset Distillation
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
CTFlow: Video-Inspired Latent Flow Matching for 3D CT Synthesis
por: Wang, Jiayi, et al.
Publicado: (2025)
por: Wang, Jiayi, et al.
Publicado: (2025)
Data-Efficient Generation for Dataset Distillation
por: Li, Zhe, et al.
Publicado: (2024)
por: Li, Zhe, et al.
Publicado: (2024)
Label-free Motion-Conditioned Diffusion Model for Cardiac Ultrasound Synthesis
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
Wasserstein-Aligned Localisation for VLM-Based Distributional OOD Detection in Medical Imaging
por: Kainz, Bernhard, et al.
Publicado: (2026)
por: Kainz, Bernhard, et al.
Publicado: (2026)
Dataset Distillation with Probabilistic Latent Features
por: Li, Zhe, et al.
Publicado: (2025)
por: Li, Zhe, et al.
Publicado: (2025)
CRG Score: A Distribution-Aware Clinical Metric for Radiology Report Generation
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2025)
por: Papantoniou, Foivos Paraperas, et al.
Publicado: (2025)
Edit Temporal-Consistent Videos with Image Diffusion Model
por: Wang, Yuanzhi, et al.
Publicado: (2023)
por: Wang, Yuanzhi, et al.
Publicado: (2023)
Ensembled Cold-Diffusion Restorations for Unsupervised Anomaly Detection
por: Marimont, Sergio Naval, et al.
Publicado: (2024)
por: Marimont, Sergio Naval, et al.
Publicado: (2024)
SigVLP: Sigmoid Volume-Language Pre-Training for Self-Supervised CT-Volume Adaptive Representation Learning
por: Wang, Jiayi, et al.
Publicado: (2026)
por: Wang, Jiayi, et al.
Publicado: (2026)
DISYRE: Diffusion-Inspired SYnthetic REstoration for Unsupervised Anomaly Detection
por: Marimont, Sergio Naval, et al.
Publicado: (2023)
por: Marimont, Sergio Naval, et al.
Publicado: (2023)
SpinMeRound: Consistent Multi-View Identity Generation Using Diffusion Models
por: Galanakis, Stathis, et al.
Publicado: (2025)
por: Galanakis, Stathis, et al.
Publicado: (2025)
MCM: Mamba-based Cardiac Motion Tracking using Sequential Images in MRI
por: Yin, Jiahui, et al.
Publicado: (2025)
por: Yin, Jiahui, et al.
Publicado: (2025)
Learning Temporally Consistent Video Depth from Video Diffusion Priors
por: Shao, Jiahao, et al.
Publicado: (2024)
por: Shao, Jiahao, et al.
Publicado: (2024)
STCDiT: Spatio-Temporally Consistent Diffusion Transformer for High-Quality Video Super-Resolution
por: Chen, Junyang, et al.
Publicado: (2025)
por: Chen, Junyang, et al.
Publicado: (2025)
Video Consistency Distance: Enhancing Temporal Consistency for Image-to-Video Generation via Reward-Based Fine-Tuning
por: Aoshima, Takehiro, et al.
Publicado: (2025)
por: Aoshima, Takehiro, et al.
Publicado: (2025)
Better Tokens for Better 3D: Advancing Vision-Language Modeling in 3D Medical Imaging
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
Image Distillation for Safe Data Sharing in Histopathology
por: Li, Zhe, et al.
Publicado: (2024)
por: Li, Zhe, et al.
Publicado: (2024)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
por: Ren, Weiming, et al.
Publicado: (2024)
por: Ren, Weiming, et al.
Publicado: (2024)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
por: Cao, Mingdeng, et al.
Publicado: (2024)
por: Cao, Mingdeng, et al.
Publicado: (2024)
ShapePuri: Shape Guided and Appearance Generalized Adversarial Purification
por: Li, Zhe, et al.
Publicado: (2026)
por: Li, Zhe, et al.
Publicado: (2026)
Temporal-Consistent Video Restoration with Pre-trained Diffusion Models
por: Wang, Hengkang, et al.
Publicado: (2025)
por: Wang, Hengkang, et al.
Publicado: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
por: Zhang, Yabo, et al.
Publicado: (2024)
por: Zhang, Yabo, et al.
Publicado: (2024)
Ejemplares similares
-
Image Generation Diversity Issues and How to Tame Them
por: Dombrowski, Mischa, et al.
Publicado: (2024) -
Video Dataset Condensation with Diffusion Models
por: Li, Zhe, et al.
Publicado: (2025) -
Uncovering Hidden Subspaces in Video Diffusion Models Using Re-Identification
por: Dombrowski, Mischa, et al.
Publicado: (2024) -
EchoNet-Synthetic: Privacy-preserving Video Generation for Safe Medical Data Sharing
por: Reynaud, Hadrien, et al.
Publicado: (2024) -
EchoFlow: A Foundation Model for Cardiac Ultrasound Image and Video Generation
por: Reynaud, Hadrien, et al.
Publicado: (2025)