OD-VAE: An Omni-dimensional Video Compressor for Improving Latent Video Diffusion Model
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Liuhan, Li, Zongjian, Lin, Bin, Zhu, Bin, Wang, Qian, Yuan, Shenghai, Zhou, Xing, Cheng, Xinhua, Yuan, Li |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model
by: Li, Zongjian, et al.
Published: (2024)
by: Li, Zongjian, et al.
Published: (2024)
Improved Video VAE for Latent Video Diffusion Model
by: Wu, Pingyu, et al.
Published: (2024)
by: Wu, Pingyu, et al.
Published: (2024)
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models
by: Cheng, Yu, et al.
Published: (2025)
by: Cheng, Yu, et al.
Published: (2025)
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
by: Zhao, Sijie, et al.
Published: (2024)
by: Zhao, Sijie, et al.
Published: (2024)
YODA: Yet Another One-step Diffusion-based Video Compressor
by: Li, Xingchen, et al.
Published: (2026)
by: Li, Xingchen, et al.
Published: (2026)
FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise
by: Yuan, Yunlong, et al.
Published: (2025)
by: Yuan, Yunlong, et al.
Published: (2025)
Generative Latent Video Compression
by: Guo, Zongyu, et al.
Published: (2025)
by: Guo, Zongyu, et al.
Published: (2025)
Generative Latent Coding for Ultra-Low Bitrate Image and Video Compression
by: Qi, Linfeng, et al.
Published: (2025)
by: Qi, Linfeng, et al.
Published: (2025)
LDPM: Towards undersampled MRI reconstruction with MR-VAE and Latent Diffusion Prior
by: Tang, Xingjian, et al.
Published: (2024)
by: Tang, Xingjian, et al.
Published: (2024)
CLIPVQA:Video Quality Assessment via CLIP
by: Xing, Fengchuang, et al.
Published: (2024)
by: Xing, Fengchuang, et al.
Published: (2024)
Neural Video Compression with Feature Modulation
by: Li, Jiahao, et al.
Published: (2024)
by: Li, Jiahao, et al.
Published: (2024)
Improved Encoding for Overfitted Video Codecs
by: Leguay, Thomas, et al.
Published: (2025)
by: Leguay, Thomas, et al.
Published: (2025)
Goal-Oriented Framework for Optical Flow-based Multi-User Multi-Task Video Transmission
by: Xu, Yujie, et al.
Published: (2026)
by: Xu, Yujie, et al.
Published: (2026)
Semantic and Temporal Integration in Latent Diffusion Space for High-Fidelity Video Super-Resolution
by: Wang, Yiwen, et al.
Published: (2025)
by: Wang, Yiwen, et al.
Published: (2025)
Uncertainty-Aware Deep Video Compression with Ensembles
by: Ma, Wufei, et al.
Published: (2024)
by: Ma, Wufei, et al.
Published: (2024)
A Multi-Grid Implicit Neural Representation for Multi-View Videos
by: Ling, Qingyue, et al.
Published: (2025)
by: Ling, Qingyue, et al.
Published: (2025)
DLF: Extreme Image Compression with Dual-generative Latent Fusion
by: Xue, Naifu, et al.
Published: (2025)
by: Xue, Naifu, et al.
Published: (2025)
Ultrasound Image-to-Video Synthesis via Latent Dynamic Diffusion Models
by: Chen, Tingxiu, et al.
Published: (2025)
by: Chen, Tingxiu, et al.
Published: (2025)
A Video Coding Method Based on Neural Network for CLIC2024
by: Li, Zhengang, et al.
Published: (2024)
by: Li, Zhengang, et al.
Published: (2024)
Diffusion-aided Extreme Video Compression with Lightweight Semantics Guidance
by: Zhang, Maojun, et al.
Published: (2026)
by: Zhang, Maojun, et al.
Published: (2026)
LDMVFI: Video Frame Interpolation with Latent Diffusion Models
by: Danier, Duolikun, et al.
Published: (2023)
by: Danier, Duolikun, et al.
Published: (2023)
Enhancing Neural Video Compression of Static Scenes with Positive-Incentive Noise
by: Yuan, Cheng, et al.
Published: (2026)
by: Yuan, Cheng, et al.
Published: (2026)
VISTA: A Benchmark for Real-Time Video Streaming under Network Impairments in Surgical Teleoperation
by: Deng, Zexin, et al.
Published: (2026)
by: Deng, Zexin, et al.
Published: (2026)
Latent Space Single-Pixel Imaging Under Low-Sampling Conditions
by: Yuan, Chenyu
Published: (2025)
by: Yuan, Chenyu
Published: (2025)
Cuboid-Net: A Multi-Branch Convolutional Neural Network for Joint Space-Time Video Super Resolution
by: Fu, Congrui, et al.
Published: (2024)
by: Fu, Congrui, et al.
Published: (2024)
Image and Video Quality Assessment using Prompt-Guided Latent Diffusion Models for Cross-Dataset Generalization
by: Mitra, Shankhanil, et al.
Published: (2024)
by: Mitra, Shankhanil, et al.
Published: (2024)
Unsupervised Cardiac Video Translation Via Motion Feature Guided Diffusion Model
by: Deb, Swakshar, et al.
Published: (2025)
by: Deb, Swakshar, et al.
Published: (2025)
ECVC: Exploiting Non-Local Correlations in Multiple Frames for Contextual Video Compression
by: Jiang, Wei, et al.
Published: (2024)
by: Jiang, Wei, et al.
Published: (2024)
MaskCRT: Masked Conditional Residual Transformer for Learned Video Compression
by: Chen, Yi-Hsin, et al.
Published: (2023)
by: Chen, Yi-Hsin, et al.
Published: (2023)
DiffRect: Latent Diffusion Label Rectification for Semi-supervised Medical Image Segmentation
by: Liu, Xinyu, et al.
Published: (2024)
by: Liu, Xinyu, et al.
Published: (2024)
3DAttGAN: A 3D Attention-based Generative Adversarial Network for Joint Space-Time Video Super-Resolution
by: Fu, Congrui, et al.
Published: (2024)
by: Fu, Congrui, et al.
Published: (2024)
KVQ: Kwai Video Quality Assessment for Short-form Videos
by: Lu, Yiting, et al.
Published: (2024)
by: Lu, Yiting, et al.
Published: (2024)
Towards Practical Real-Time Neural Video Compression
by: Jia, Zhaoyang, et al.
Published: (2025)
by: Jia, Zhaoyang, et al.
Published: (2025)
MediViSTA: Medical Video Segmentation via Temporal Fusion SAM Adaptation for Echocardiography
by: Kim, Sekeun, et al.
Published: (2023)
by: Kim, Sekeun, et al.
Published: (2023)
One-Step Diffusion-Based Image Compression with Semantic Distillation
by: Xue, Naifu, et al.
Published: (2025)
by: Xue, Naifu, et al.
Published: (2025)
ResVR: Joint Rescaling and Viewport Rendering of Omnidirectional Images
by: Li, Weiqi, et al.
Published: (2024)
by: Li, Weiqi, et al.
Published: (2024)
Analysis of Neural Video Compression Networks for 360-Degree Video Coding
by: Regensky, Andy, et al.
Published: (2024)
by: Regensky, Andy, et al.
Published: (2024)
Wireless Semantic Communications for Video Conferencing
by: Jiang, Peiwen, et al.
Published: (2022)
by: Jiang, Peiwen, et al.
Published: (2022)
CardiacNet: Learning to Reconstruct Abnormalities for Cardiac Disease Assessment from Echocardiogram Videos
by: Yang, Jiewen, et al.
Published: (2024)
by: Yang, Jiewen, et al.
Published: (2024)
TransVFC: A Transformable Video Feature Compression Framework for Machines
by: Sun, Yuxiao, et al.
Published: (2025)
by: Sun, Yuxiao, et al.
Published: (2025)
Similar Items
-
WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model
by: Li, Zongjian, et al.
Published: (2024) -
Improved Video VAE for Latent Video Diffusion Model
by: Wu, Pingyu, et al.
Published: (2024) -
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models
by: Cheng, Yu, et al.
Published: (2025) -
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
by: Zhao, Sijie, et al.
Published: (2024) -
YODA: Yet Another One-step Diffusion-based Video Compressor
by: Li, Xingchen, et al.
Published: (2026)