Improved Video VAE for Latent Video Diffusion Model
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Pingyu, Zhu, Kai, Liu, Yu, Zhao, Liming, Zhai, Wei, Cao, Yang, Zha, Zheng-Jun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
OD-VAE: An Omni-dimensional Video Compressor for Improving Latent Video Diffusion Model
by: Chen, Liuhan, et al.
Published: (2024)
by: Chen, Liuhan, et al.
Published: (2024)
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
by: Zhao, Sijie, et al.
Published: (2024)
by: Zhao, Sijie, et al.
Published: (2024)
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models
by: Cheng, Yu, et al.
Published: (2025)
by: Cheng, Yu, et al.
Published: (2025)
Ultrasound Image-to-Video Synthesis via Latent Dynamic Diffusion Models
by: Chen, Tingxiu, et al.
Published: (2025)
by: Chen, Tingxiu, et al.
Published: (2025)
Event-based Asynchronous HDR Imaging by Temporal Incident Light Modulation
by: Wu, Yuliang, et al.
Published: (2024)
by: Wu, Yuliang, et al.
Published: (2024)
LDMVFI: Video Frame Interpolation with Latent Diffusion Models
by: Danier, Duolikun, et al.
Published: (2023)
by: Danier, Duolikun, et al.
Published: (2023)
Semantic and Temporal Integration in Latent Diffusion Space for High-Fidelity Video Super-Resolution
by: Wang, Yiwen, et al.
Published: (2025)
by: Wang, Yiwen, et al.
Published: (2025)
MoVideo: Motion-Aware Video Generation with Diffusion Models
by: Liang, Jingyun, et al.
Published: (2023)
by: Liang, Jingyun, et al.
Published: (2023)
LDPM: Towards undersampled MRI reconstruction with MR-VAE and Latent Diffusion Prior
by: Tang, Xingjian, et al.
Published: (2024)
by: Tang, Xingjian, et al.
Published: (2024)
CompressedVQA-HDR: Generalized Full-reference and No-reference Quality Assessment Models for Compressed High Dynamic Range Videos
by: Sun, Wei, et al.
Published: (2025)
by: Sun, Wei, et al.
Published: (2025)
Generative Latent Video Compression
by: Guo, Zongyu, et al.
Published: (2025)
by: Guo, Zongyu, et al.
Published: (2025)
Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
by: Sun, Wei, et al.
Published: (2023)
by: Sun, Wei, et al.
Published: (2023)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
by: Sun, Wei, et al.
Published: (2024)
by: Sun, Wei, et al.
Published: (2024)
Perceptual Video Quality Assessment: A Survey
by: Min, Xiongkuo, et al.
Published: (2024)
by: Min, Xiongkuo, et al.
Published: (2024)
How Accurate are Video Quality Models for Diffusion-Based Video Super-Resolution?
by: Herb, Benjamin, et al.
Published: (2026)
by: Herb, Benjamin, et al.
Published: (2026)
Individual Content and Motion Dynamics Preserved Pruning for Video Diffusion Models
by: Wu, Yiming, et al.
Published: (2024)
by: Wu, Yiming, et al.
Published: (2024)
WMAdapter: Adding WaterMark Control to Latent Diffusion Models
by: Ci, Hai, et al.
Published: (2024)
by: Ci, Hai, et al.
Published: (2024)
RealisVSR: Detail-enhanced Diffusion for Real-World 4K Video Super-Resolution
by: Zhao, Weisong, et al.
Published: (2025)
by: Zhao, Weisong, et al.
Published: (2025)
Anchor Forcing: Anchor Memory and Tri-Region RoPE for Interactive Streaming Video Diffusion
by: Yang, Yang, et al.
Published: (2026)
by: Yang, Yang, et al.
Published: (2026)
Extreme Video Compression with Pre-trained Diffusion Models
by: Li, Bohan, et al.
Published: (2024)
by: Li, Bohan, et al.
Published: (2024)
DLADiff: A Dual-Layer Defense Framework against Fine-Tuning and Zero-Shot Customization of Diffusion Models
by: Jia, Jun, et al.
Published: (2025)
by: Jia, Jun, et al.
Published: (2025)
DoseDiff: Distance-aware Diffusion Model for Dose Prediction in Radiotherapy
by: Zhang, Yiwen, et al.
Published: (2023)
by: Zhang, Yiwen, et al.
Published: (2023)
DiffVQA: Video Quality Assessment Using Diffusion Feature Extractor
by: Chen, Wei-Ting, et al.
Published: (2025)
by: Chen, Wei-Ting, et al.
Published: (2025)
Resolution-Agnostic Neural Compression for High-Fidelity Portrait Video Conferencing via Implicit Radiance Fields
by: Li, Yifei, et al.
Published: (2024)
by: Li, Yifei, et al.
Published: (2024)
DeTracker: Motion-decoupled Vehicle Detection and Tracking in Unstabilized Satellite Videos
by: Chen, Jiajun, et al.
Published: (2026)
by: Chen, Jiajun, et al.
Published: (2026)
CLIPVQA:Video Quality Assessment via CLIP
by: Xing, Fengchuang, et al.
Published: (2024)
by: Xing, Fengchuang, et al.
Published: (2024)
Difflare: Removing Image Lens Flare with Latent Diffusion Model
by: Zhou, Tianwen, et al.
Published: (2024)
by: Zhou, Tianwen, et al.
Published: (2024)
Latent Motion Profiling for Annotation-free Cardiac Phase Detection in Adult and Fetal Echocardiography Videos
by: Yang, Yingyu, et al.
Published: (2025)
by: Yang, Yingyu, et al.
Published: (2025)
Memory Matching is not Enough: Jointly Improving Memory Matching and Decoding for Video Object Segmentation
by: Zheng, Jintu, et al.
Published: (2024)
by: Zheng, Jintu, et al.
Published: (2024)
Generative Latent Coding for Ultra-Low Bitrate Image and Video Compression
by: Qi, Linfeng, et al.
Published: (2025)
by: Qi, Linfeng, et al.
Published: (2025)
BiECVC: Gated Diversification of Bidirectional Contexts for Learned Video Compression
by: Jiang, Wei, et al.
Published: (2025)
by: Jiang, Wei, et al.
Published: (2025)
VRVVC: Variable-Rate NeRF-Based Volumetric Video Compression
by: Hu, Qiang, et al.
Published: (2024)
by: Hu, Qiang, et al.
Published: (2024)
SF-V: Single Forward Video Generation Model
by: Zhang, Zhixing, et al.
Published: (2024)
by: Zhang, Zhixing, et al.
Published: (2024)
Latent Interpolation Learning Using Diffusion Models for Cardiac Volume Reconstruction
by: Bubeck, Niklas, et al.
Published: (2025)
by: Bubeck, Niklas, et al.
Published: (2025)
Taming Diffusion Transformer for Efficient Mobile Video Generation in Seconds
by: Wu, Yushu, et al.
Published: (2025)
by: Wu, Yushu, et al.
Published: (2025)
LVC-LGMC: Joint Local and Global Motion Compensation for Learned Video Compression
by: Jiang, Wei, et al.
Published: (2024)
by: Jiang, Wei, et al.
Published: (2024)
Compressed Video Quality Enhancement with Temporal Group Alignment and Fusion
by: Zhu, Qiang, et al.
Published: (2024)
by: Zhu, Qiang, et al.
Published: (2024)
Bora: Biomedical Generalist Video Generation Model
by: Sun, Weixiang, et al.
Published: (2024)
by: Sun, Weixiang, et al.
Published: (2024)
Unpaired Volumetric Harmonization of Brain MRI with Conditional Latent Diffusion
by: Wu, Mengqi, et al.
Published: (2024)
by: Wu, Mengqi, et al.
Published: (2024)
FourierMamba: Fourier Learning Integration with State Space Models for Image Deraining
by: Li, Dong, et al.
Published: (2024)
by: Li, Dong, et al.
Published: (2024)
Similar Items
-
OD-VAE: An Omni-dimensional Video Compressor for Improving Latent Video Diffusion Model
by: Chen, Liuhan, et al.
Published: (2024) -
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
by: Zhao, Sijie, et al.
Published: (2024) -
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models
by: Cheng, Yu, et al.
Published: (2025) -
Ultrasound Image-to-Video Synthesis via Latent Dynamic Diffusion Models
by: Chen, Tingxiu, et al.
Published: (2025) -
Event-based Asynchronous HDR Imaging by Temporal Incident Light Modulation
by: Wu, Yuliang, et al.
Published: (2024)