DLFR-VAE: Dynamic Latent Frame Rate VAE for Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuan, Zhihang, Wang, Siyuan, Xie, Rui, Zhang, Hanling, Fang, Tongcheng, Shang, Yuzhang, Yan, Shengen, Dai, Guohao, Wang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
VocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model
di: Li, Zongjian, et al.
Pubblicazione: (2024)
di: Li, Zongjian, et al.
Pubblicazione: (2024)
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models
di: Cheng, Yu, et al.
Pubblicazione: (2025)
di: Cheng, Yu, et al.
Pubblicazione: (2025)
Improved Video VAE for Latent Video Diffusion Model
di: Wu, Pingyu, et al.
Pubblicazione: (2024)
di: Wu, Pingyu, et al.
Pubblicazione: (2024)
VidTwin: Video VAE with Decoupled Structure and Dynamics
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
OD-VAE: An Omni-dimensional Video Compressor for Improving Latent Video Diffusion Model
di: Chen, Liuhan, et al.
Pubblicazione: (2024)
di: Chen, Liuhan, et al.
Pubblicazione: (2024)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
Large Motion Video Autoencoding with Cross-modal Video VAE
di: Xing, Yazhou, et al.
Pubblicazione: (2024)
di: Xing, Yazhou, et al.
Pubblicazione: (2024)
OneVAE: Joint Discrete and Continuous Optimization Helps Discrete Video VAE Train Better
di: Zhou, Yupeng, et al.
Pubblicazione: (2025)
di: Zhou, Yupeng, et al.
Pubblicazione: (2025)
Eliminating VAE for Fast and High-Resolution Generative Detail Restoration
di: Wang, Yan, et al.
Pubblicazione: (2026)
di: Wang, Yan, et al.
Pubblicazione: (2026)
DeCo-VAE: Learning Compact Latents for Video Reconstruction via Decoupled Representation
di: Yin, Xiangchen, et al.
Pubblicazione: (2025)
di: Yin, Xiangchen, et al.
Pubblicazione: (2025)
HireVAE: An Online and Adaptive Factor Model Based on Hierarchical and Regime-Switch VAE
di: Wei, Zikai, et al.
Pubblicazione: (2023)
di: Wei, Zikai, et al.
Pubblicazione: (2023)
CAD-VAE: Leveraging Correlation-Aware Latents for Comprehensive Fair Disentanglement
di: Ma, Chenrui, et al.
Pubblicazione: (2025)
di: Ma, Chenrui, et al.
Pubblicazione: (2025)
FissionVAE: Federated Non-IID Image Generation with Latent Space and Decoder Decomposition
di: Hu, Chen, et al.
Pubblicazione: (2024)
di: Hu, Chen, et al.
Pubblicazione: (2024)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
Latent Dirichlet Transformer VAE for Hyperspectral Unmixing with Bundled Endmembers
di: Giannetti, Giancarlo, et al.
Pubblicazione: (2025)
di: Giannetti, Giancarlo, et al.
Pubblicazione: (2025)
REPA-E: Unlocking VAE for End-to-End Tuning with Latent Diffusion Transformers
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation
di: Zhu, Lunjie, et al.
Pubblicazione: (2026)
di: Zhu, Lunjie, et al.
Pubblicazione: (2026)
Slot-VAE: Object-Centric Scene Generation with Slot Attention
di: Wang, Yanbo, et al.
Pubblicazione: (2023)
di: Wang, Yanbo, et al.
Pubblicazione: (2023)
Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene Generation
di: Edirimuni, Dasith de Silva, et al.
Pubblicazione: (2026)
di: Edirimuni, Dasith de Silva, et al.
Pubblicazione: (2026)
AlphaVAE: Unified End-to-End RGBA Image Reconstruction and Generation with Alpha-Aware Representation Learning
di: Wang, Zile, et al.
Pubblicazione: (2025)
di: Wang, Zile, et al.
Pubblicazione: (2025)
Attend Locally, Remember Linearly: Linear Attention as Cross-Frame Memory for Autoregressive Video Diffusion
di: Li, Kunyang, et al.
Pubblicazione: (2026)
di: Li, Kunyang, et al.
Pubblicazione: (2026)
DA-VAE: Plug-in Latent Compression for Diffusion via Detail Alignment
di: Cai, Xin, et al.
Pubblicazione: (2026)
di: Cai, Xin, et al.
Pubblicazione: (2026)
LDPM: Towards undersampled MRI reconstruction with MR-VAE and Latent Diffusion Prior
di: Tang, Xingjian, et al.
Pubblicazione: (2024)
di: Tang, Xingjian, et al.
Pubblicazione: (2024)
VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models
di: Bi, Tianci, et al.
Pubblicazione: (2025)
di: Bi, Tianci, et al.
Pubblicazione: (2025)
SVGFusion: A VAE-Diffusion Transformer for Vector Graphic Generation
di: Xing, Ximing, et al.
Pubblicazione: (2024)
di: Xing, Ximing, et al.
Pubblicazione: (2024)
Distill Video Datasets into Images
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
R3-VAE: Reference Vector-Guided Rating Residual Quantization VAE for Generative Recommendation
di: Wan, Qiang, et al.
Pubblicazione: (2026)
di: Wan, Qiang, et al.
Pubblicazione: (2026)
Hi-VAE: Efficient Video Autoencoding with Global and Detailed Motion
di: Liu, Huaize, et al.
Pubblicazione: (2025)
di: Liu, Huaize, et al.
Pubblicazione: (2025)
Asymmetric VAE for One-Step Video Super-Resolution Acceleration
di: Li, Jianze, et al.
Pubblicazione: (2025)
di: Li, Jianze, et al.
Pubblicazione: (2025)
Attentive VQ-VAE
di: Hoyos, Angello, et al.
Pubblicazione: (2023)
di: Hoyos, Angello, et al.
Pubblicazione: (2023)
SepVAE: a contrastive VAE to separate pathological patterns from healthy ones
di: Louiset, Robin, et al.
Pubblicazione: (2023)
di: Louiset, Robin, et al.
Pubblicazione: (2023)
MGVQ: Could VQ-VAE Beat VAE? A Generalizable Tokenizer with Multi-group Quantization
di: Jia, Mingkai, et al.
Pubblicazione: (2025)
di: Jia, Mingkai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
di: Yuan, Zhihang, et al.
Pubblicazione: (2025) -
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024) -
VocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models
di: Zhang, Hanling, et al.
Pubblicazione: (2025) -
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
di: Zhao, Sijie, et al.
Pubblicazione: (2024) -
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)