World-consistent Video Diffusion with Explicit 3D Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Qihang, Zhai, Shuangfei, Bautista, Miguel Angel, Miao, Kevin, Toshev, Alexander, Susskind, Joshua, Gu, Jiatao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kaleido Diffusion: Improving Conditional Diffusion Models with Autoregressive Latent Modeling
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
Matryoshka Diffusion Models
di: Gu, Jiatao, et al.
Pubblicazione: (2023)
di: Gu, Jiatao, et al.
Pubblicazione: (2023)
Many-to-many Image Generation with Auto-regressive Diffusion Models
di: Shen, Ying, et al.
Pubblicazione: (2024)
di: Shen, Ying, et al.
Pubblicazione: (2024)
DSplats: 3D Generation by Denoising Splats-Based Multiview Diffusion Models
di: Miao, Kevin, et al.
Pubblicazione: (2024)
di: Miao, Kevin, et al.
Pubblicazione: (2024)
Scalable Pre-training of Large Autoregressive Image Models
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
Normalizing Flows with Iterative Denoising
di: Chen, Tianrong, et al.
Pubblicazione: (2026)
di: Chen, Tianrong, et al.
Pubblicazione: (2026)
STARFlow-V: End-to-End Video Generative Modeling with Normalizing Flows
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
STARFlow2: Bridging Language Models and Normalizing Flows for Unified Multimodal Generation
di: Shen, Ying, et al.
Pubblicazione: (2026)
di: Shen, Ying, et al.
Pubblicazione: (2026)
Normalizing Trajectory Models
di: Gu, Jiatao, et al.
Pubblicazione: (2026)
di: Gu, Jiatao, et al.
Pubblicazione: (2026)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
Improving GFlowNets for Text-to-Image Diffusion Alignment
di: Zhang, Dinghuai, et al.
Pubblicazione: (2024)
di: Zhang, Dinghuai, et al.
Pubblicazione: (2024)
Normalizing Flows are Capable Generative Models
di: Zhai, Shuangfei, et al.
Pubblicazione: (2024)
di: Zhai, Shuangfei, et al.
Pubblicazione: (2024)
TypeScore: A Text Fidelity Metric for Text-to-Image Generative Models
di: Sampaio, Georgia Gabriela, et al.
Pubblicazione: (2024)
di: Sampaio, Georgia Gabriela, et al.
Pubblicazione: (2024)
STARFlow: Scaling Latent Normalizing Flows for High-resolution Image Synthesis
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
How Far Are We from Intelligent Visual Deductive Reasoning?
di: Zhang, Yizhe, et al.
Pubblicazione: (2024)
di: Zhang, Yizhe, et al.
Pubblicazione: (2024)
3D Shape Tokenization via Latent Flow Matching
di: Chang, Jen-Hao Rick, et al.
Pubblicazione: (2024)
di: Chang, Jen-Hao Rick, et al.
Pubblicazione: (2024)
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
di: Liu, Qihao, et al.
Pubblicazione: (2025)
di: Liu, Qihao, et al.
Pubblicazione: (2025)
Pseudo-Generalized Dynamic View Synthesis from a Video
di: Zhao, Xiaoming, et al.
Pubblicazione: (2023)
di: Zhao, Xiaoming, et al.
Pubblicazione: (2023)
The Coupling Within: Flow Matching via Distilled Normalizing Flows
di: Berthelot, David, et al.
Pubblicazione: (2026)
di: Berthelot, David, et al.
Pubblicazione: (2026)
CTRLorALTer: Conditional LoRAdapter for Efficient 0-Shot Control & Altering of T2I Models
di: Stracke, Nick, et al.
Pubblicazione: (2024)
di: Stracke, Nick, et al.
Pubblicazione: (2024)
Explicit Critic Guidance for Aligning Diffusion Models
di: Liang, Zhengyang, et al.
Pubblicazione: (2026)
di: Liang, Zhengyang, et al.
Pubblicazione: (2026)
Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
Geometry-as-context: Modulating Explicit 3D in Scene-consistent Video Generation to Geometry Context
di: Hu, JiaKui, et al.
Pubblicazione: (2026)
di: Hu, JiaKui, et al.
Pubblicazione: (2026)
Learning Long-term Motion Embeddings for Efficient Kinematics Generation
di: Stracke, Nick, et al.
Pubblicazione: (2026)
di: Stracke, Nick, et al.
Pubblicazione: (2026)
GECO: Generative Image-to-3D within a SECOnd
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Vid2World: Crafting Video Diffusion Models to Interactive World Models
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
Adapting Self-Supervised Representations as a Latent Space for Efficient Generation
di: Gui, Ming, et al.
Pubblicazione: (2025)
di: Gui, Ming, et al.
Pubblicazione: (2025)
Human-3Diffusion: Realistic Avatar Creation via Explicit 3D Consistent Diffusion Models
di: Xue, Yuxuan, et al.
Pubblicazione: (2024)
di: Xue, Yuxuan, et al.
Pubblicazione: (2024)
EvoWorld: Evolving Panoramic World Generation with Explicit 3D Memory
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting
di: Shin, Inkyu, et al.
Pubblicazione: (2024)
di: Shin, Inkyu, et al.
Pubblicazione: (2024)
ViViD: Video Virtual Try-on using Diffusion Models
di: Fang, Zixun, et al.
Pubblicazione: (2024)
di: Fang, Zixun, et al.
Pubblicazione: (2024)
CamLit: Unified Video Diffusion with Explicit Camera and Lighting Control
di: Kuang, Zhiyi, et al.
Pubblicazione: (2026)
di: Kuang, Zhiyi, et al.
Pubblicazione: (2026)
Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
V3D: Video Diffusion Models are Effective 3D Generators
di: Chen, Zilong, et al.
Pubblicazione: (2024)
di: Chen, Zilong, et al.
Pubblicazione: (2024)
GO-Renderer: Generative Object Rendering with 3D-aware Controllable Video Diffusion Models
di: Gu, Zekai, et al.
Pubblicazione: (2026)
di: Gu, Zekai, et al.
Pubblicazione: (2026)
PhysCtrl: Generative Physics for Controllable and Physics-Grounded Video Generation
di: Wang, Chen, et al.
Pubblicazione: (2025)
di: Wang, Chen, et al.
Pubblicazione: (2025)
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation
di: Huang, Tianyu, et al.
Pubblicazione: (2025)
di: Huang, Tianyu, et al.
Pubblicazione: (2025)
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Kaleido Diffusion: Improving Conditional Diffusion Models with Autoregressive Latent Modeling
di: Gu, Jiatao, et al.
Pubblicazione: (2024) -
Matryoshka Diffusion Models
di: Gu, Jiatao, et al.
Pubblicazione: (2023) -
Many-to-many Image Generation with Auto-regressive Diffusion Models
di: Shen, Ying, et al.
Pubblicazione: (2024) -
DSplats: 3D Generation by Denoising Splats-Based Multiview Diffusion Models
di: Miao, Kevin, et al.
Pubblicazione: (2024) -
Scalable Pre-training of Large Autoregressive Image Models
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)