TC4D: Trajectory-Conditioned Text-to-4D Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Bahmani, Sherwin, Liu, Xian, Yifan, Wang, Skorokhodov, Ivan, Rong, Victor, Liu, Ziwei, Liu, Xihui, Park, Jeong Joon, Tulyakov, Sergey, Wetzstein, Gordon, Tagliasacchi, Andrea, Lindell, David B. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
4D-fy: Text-to-4D Generation Using Hybrid Score Distillation Sampling
por: Bahmani, Sherwin, et al.
Publicado: (2023)
por: Bahmani, Sherwin, et al.
Publicado: (2023)
AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers
por: Bahmani, Sherwin, et al.
Publicado: (2024)
por: Bahmani, Sherwin, et al.
Publicado: (2024)
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
por: Bahmani, Sherwin, et al.
Publicado: (2024)
por: Bahmani, Sherwin, et al.
Publicado: (2024)
Grow with the Flow: 4D Reconstruction of Growing Plants with Gaussian Flow Fields
por: Luo, Weihan, et al.
Publicado: (2026)
por: Luo, Weihan, et al.
Publicado: (2026)
MVP4D: Multi-View Portrait Video Diffusion for Animatable 4D Avatars
por: Taubner, Felix, et al.
Publicado: (2025)
por: Taubner, Felix, et al.
Publicado: (2025)
HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion
por: Liu, Xian, et al.
Publicado: (2023)
por: Liu, Xian, et al.
Publicado: (2023)
GStex: Per-Primitive Texturing of 2D Gaussian Splatting for Decoupled Appearance and Geometry Modeling
por: Rong, Victor, et al.
Publicado: (2024)
por: Rong, Victor, et al.
Publicado: (2024)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
por: Skorokhodov, Ivan, et al.
Publicado: (2024)
por: Skorokhodov, Ivan, et al.
Publicado: (2024)
GPT-4V(ision) is a Human-Aligned Evaluator for Text-to-3D Generation
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation
por: Namekata, Koichi, et al.
Publicado: (2024)
por: Namekata, Koichi, et al.
Publicado: (2024)
HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting
por: Liu, Xian, et al.
Publicado: (2023)
por: Liu, Xian, et al.
Publicado: (2023)
4Real-Video: Learning Generalizable Photo-Realistic 4D Video Diffusion
por: Wang, Chaoyang, et al.
Publicado: (2024)
por: Wang, Chaoyang, et al.
Publicado: (2024)
4Real-Video-V2: Fused View-Time Attention and Feedforward Reconstruction for 4D Scene Generation
por: Wang, Chaoyang, et al.
Publicado: (2025)
por: Wang, Chaoyang, et al.
Publicado: (2025)
GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography
por: Zhang, Mengchen, et al.
Publicado: (2025)
por: Zhang, Mengchen, et al.
Publicado: (2025)
Helix4D: Complex 4D Mesh Generation
por: Yenphraphai, Jiraphon, et al.
Publicado: (2026)
por: Yenphraphai, Jiraphon, et al.
Publicado: (2026)
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
por: Bahmani, Sherwin, et al.
Publicado: (2025)
por: Bahmani, Sherwin, et al.
Publicado: (2025)
Personalized Text-to-Image Generation with Auto-Regressive Models
por: Sun, Kaiyue, et al.
Publicado: (2025)
por: Sun, Kaiyue, et al.
Publicado: (2025)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
por: Zhang, Yuhan, et al.
Publicado: (2025)
por: Zhang, Yuhan, et al.
Publicado: (2025)
LayerPano3D: Layered 3D Panorama for Hyper-Immersive Scene Generation
por: Yang, Shuai, et al.
Publicado: (2024)
por: Yang, Shuai, et al.
Publicado: (2024)
Make-it-Real: Unleashing Large Multimodal Model for Painting 3D Objects with Realistic Materials
por: Fang, Ye, et al.
Publicado: (2024)
por: Fang, Ye, et al.
Publicado: (2024)
Interspatial Attention for Efficient 4D Human Video Generation
por: Shao, Ruizhi, et al.
Publicado: (2025)
por: Shao, Ruizhi, et al.
Publicado: (2025)
AlphaFlow: Understanding and Improving MeanFlow Models
por: Zhang, Huijie, et al.
Publicado: (2025)
por: Zhang, Huijie, et al.
Publicado: (2025)
AToM: Amortized Text-to-Mesh using 2D Diffusion
por: Qian, Guocheng, et al.
Publicado: (2024)
por: Qian, Guocheng, et al.
Publicado: (2024)
Improving Progressive Generation with Decomposable Flow Matching
por: Haji-Ali, Moayed, et al.
Publicado: (2025)
por: Haji-Ali, Moayed, et al.
Publicado: (2025)
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing
por: Gu, Jing, et al.
Publicado: (2024)
por: Gu, Jing, et al.
Publicado: (2024)
Dynamic Concepts Personalization from Single Videos
por: Abdal, Rameen, et al.
Publicado: (2025)
por: Abdal, Rameen, et al.
Publicado: (2025)
Adaptive 1D Video Diffusion Autoencoder
por: Teng, Yao, et al.
Publicado: (2026)
por: Teng, Yao, et al.
Publicado: (2026)
Kinema4D: Kinematic 4D World Modeling for Spatiotemporal Embodied Simulation
por: Xu, Mutian, et al.
Publicado: (2026)
por: Xu, Mutian, et al.
Publicado: (2026)
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
por: Sun, Kaiyue, et al.
Publicado: (2025)
por: Sun, Kaiyue, et al.
Publicado: (2025)
4Diffusion: Multi-view Video Diffusion Model for 4D Generation
por: Zhang, Haiyu, et al.
Publicado: (2024)
por: Zhang, Haiyu, et al.
Publicado: (2024)
CAP4D: Creating Animatable 4D Portrait Avatars with Morphable Multi-View Diffusion Models
por: Taubner, Felix, et al.
Publicado: (2024)
por: Taubner, Felix, et al.
Publicado: (2024)
Not All Points Are Equal: Uncertainty-Aware 4D LiDAR Scene Synthesis
por: Xu, Xiang, et al.
Publicado: (2026)
por: Xu, Xiang, et al.
Publicado: (2026)
U4D: Uncertainty-Aware 4D World Modeling from LiDAR Sequences
por: Xu, Xiang, et al.
Publicado: (2025)
por: Xu, Xiang, et al.
Publicado: (2025)
ShapeGen4D: Towards High Quality 4D Shape Generation from Videos
por: Yenphraphai, Jiraphon, et al.
Publicado: (2025)
por: Yenphraphai, Jiraphon, et al.
Publicado: (2025)
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models
por: Wu, Ziyi, et al.
Publicado: (2025)
por: Wu, Ziyi, et al.
Publicado: (2025)
Improving the Diffusability of Autoencoders
por: Skorokhodov, Ivan, et al.
Publicado: (2025)
por: Skorokhodov, Ivan, et al.
Publicado: (2025)
Mind the Time: Temporally-Controlled Multi-Event Video Generation
por: Wu, Ziyi, et al.
Publicado: (2024)
por: Wu, Ziyi, et al.
Publicado: (2024)
One Model, Many Budgets: Elastic Latent Interfaces for Diffusion Transformers
por: Haji-Ali, Moayed, et al.
Publicado: (2026)
por: Haji-Ali, Moayed, et al.
Publicado: (2026)
Snap Video: Scaled Spatiotemporal Transformers for Text-to-Video Synthesis
por: Menapace, Willi, et al.
Publicado: (2024)
por: Menapace, Willi, et al.
Publicado: (2024)
Garment Particles: A 2D--3D Symmetric Garment Representation for Generation and Editing
por: Nakayama, Kiyohiro, et al.
Publicado: (2026)
por: Nakayama, Kiyohiro, et al.
Publicado: (2026)
Ejemplares similares
-
4D-fy: Text-to-4D Generation Using Hybrid Score Distillation Sampling
por: Bahmani, Sherwin, et al.
Publicado: (2023) -
AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers
por: Bahmani, Sherwin, et al.
Publicado: (2024) -
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
por: Bahmani, Sherwin, et al.
Publicado: (2024) -
Grow with the Flow: 4D Reconstruction of Growing Plants with Gaussian Flow Fields
por: Luo, Weihan, et al.
Publicado: (2026) -
MVP4D: Multi-View Portrait Video Diffusion for Animatable 4D Avatars
por: Taubner, Felix, et al.
Publicado: (2025)