AR4D: Autoregressive 4D Generation from Monocular Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Hanxin, He, Tianyu, Yu, Xiqian, Guo, Junliang, Chen, Zhibo, Bian, Jiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GaussianSR: 3D Gaussian Super-Resolution with 2D Diffusion Priors
di: Yu, Xiqian, et al.
Pubblicazione: (2024)
di: Yu, Xiqian, et al.
Pubblicazione: (2024)
Compositional 3D-aware Video Generation with LLM Director
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
P-4DGS: Predictive 4D Gaussian Splatting with 90$\times$ Compression
di: Wang, Henan, et al.
Pubblicazione: (2025)
di: Wang, Henan, et al.
Pubblicazione: (2025)
Video In-context Learning: Autoregressive Transformers are Zero-Shot Video Imitators
di: Zhang, Wentao, et al.
Pubblicazione: (2024)
di: Zhang, Wentao, et al.
Pubblicazione: (2024)
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
End-to-End Rate-Distortion Optimized 3D Gaussian Representation
di: Wang, Henan, et al.
Pubblicazione: (2024)
di: Wang, Henan, et al.
Pubblicazione: (2024)
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
Fast Autoregressive Video Generation with Diagonal Decoding
di: Ye, Yang, et al.
Pubblicazione: (2025)
di: Ye, Yang, et al.
Pubblicazione: (2025)
Embody4D: A Generalist 4D World Model for Embodied AI
di: Tu, Peiyan, et al.
Pubblicazione: (2026)
di: Tu, Peiyan, et al.
Pubblicazione: (2026)
4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models
di: Lu, Yiting, et al.
Pubblicazione: (2025)
di: Lu, Yiting, et al.
Pubblicazione: (2025)
Is Vanilla MLP in Neural Radiance Field Enough for Few-shot View Synthesis?
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
DeepVerse: 4D Autoregressive Video Generation as a World Model
di: Chen, Junyi, et al.
Pubblicazione: (2025)
di: Chen, Junyi, et al.
Pubblicazione: (2025)
Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
Mesh4D: 4D Mesh Reconstruction and Tracking from Monocular Video
di: Jiang, Zeren, et al.
Pubblicazione: (2026)
di: Jiang, Zeren, et al.
Pubblicazione: (2026)
GSemSplat: Generalizable Semantic 3D Gaussian Splatting from Uncalibrated Image Pairs
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
Vivid4D: Improving 4D Reconstruction from Monocular Video by Video Inpainting
di: Huang, Jiaxin, et al.
Pubblicazione: (2025)
di: Huang, Jiaxin, et al.
Pubblicazione: (2025)
UniEdit: A Unified Tuning-Free Framework for Video Motion and Appearance Editing
di: Bai, Jianhong, et al.
Pubblicazione: (2024)
di: Bai, Jianhong, et al.
Pubblicazione: (2024)
OrthoPhys: Physically Plausible Video Generation with Orthogonal-View Geometry Guidance
di: Wang, Cong, et al.
Pubblicazione: (2026)
di: Wang, Cong, et al.
Pubblicazione: (2026)
TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular Video
di: Wu, Renlong, et al.
Pubblicazione: (2024)
di: Wu, Renlong, et al.
Pubblicazione: (2024)
Predicting 4D Hand Trajectory from Monocular Videos
di: Ye, Yufei, et al.
Pubblicazione: (2025)
di: Ye, Yufei, et al.
Pubblicazione: (2025)
GFlow: Recovering 4D World from Monocular Video
di: Wang, Shizun, et al.
Pubblicazione: (2024)
di: Wang, Shizun, et al.
Pubblicazione: (2024)
AR-CoPO: Align Autoregressive Video Generation with Contrastive Policy Optimization
di: He, Dailan, et al.
Pubblicazione: (2026)
di: He, Dailan, et al.
Pubblicazione: (2026)
RiGS: Rigid-aware 4D Gaussian Splatting from a Single Monocular Video
di: Wu, Chenyu, et al.
Pubblicazione: (2026)
di: Wu, Chenyu, et al.
Pubblicazione: (2026)
Light Field Compression Based on Implicit Neural Representation
di: Wang, Henan, et al.
Pubblicazione: (2024)
di: Wang, Henan, et al.
Pubblicazione: (2024)
D-AR: Diffusion via Autoregressive Models
di: Gao, Ziteng, et al.
Pubblicazione: (2025)
di: Gao, Ziteng, et al.
Pubblicazione: (2025)
VidTwin: Video VAE with Decoupled Structure and Dynamics
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
DreamScene4D: Dynamic Multi-Object Scene Generation from Monocular Videos
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2024)
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2024)
VidTok: A Versatile and Open-Source Video Tokenizer
di: Tang, Anni, et al.
Pubblicazione: (2024)
di: Tang, Anni, et al.
Pubblicazione: (2024)
HiAR: Efficient Autoregressive Long Video Generation via Hierarchical Denoising
di: Zou, Kai, et al.
Pubblicazione: (2026)
di: Zou, Kai, et al.
Pubblicazione: (2026)
Self-Supervised Monocular 4D Scene Reconstruction for Egocentric Videos
di: Yuan, Chengbo, et al.
Pubblicazione: (2024)
di: Yuan, Chengbo, et al.
Pubblicazione: (2024)
4DEquine: Disentangling Motion and Appearance for 4D Equine Reconstruction from Monocular Video
di: Lyu, Jin, et al.
Pubblicazione: (2026)
di: Lyu, Jin, et al.
Pubblicazione: (2026)
SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer
di: Wu, Zijie, et al.
Pubblicazione: (2024)
di: Wu, Zijie, et al.
Pubblicazione: (2024)
DressRecon: Freeform 4D Human Reconstruction from Monocular Video
di: Tan, Jeff, et al.
Pubblicazione: (2024)
di: Tan, Jeff, et al.
Pubblicazione: (2024)
TT4D: A Pipeline and Dataset for Table Tennis 4D Reconstruction From Monocular Videos
di: Rahmanian, Nima, et al.
Pubblicazione: (2026)
di: Rahmanian, Nima, et al.
Pubblicazione: (2026)
FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
Playing with Transformer at 30+ FPS via Next-Frame Diffusion
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
LongDPM: Overlap-Aware 4D Reconstruction from Long Monocular Videos
di: Xu, Chenyi, et al.
Pubblicazione: (2026)
di: Xu, Chenyi, et al.
Pubblicazione: (2026)
FlashAR: Efficient Post-Training Acceleration for Autoregressive Image Generation
di: Zhou, Junkang, et al.
Pubblicazione: (2026)
di: Zhou, Junkang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GaussianSR: 3D Gaussian Super-Resolution with 2D Diffusion Priors
di: Yu, Xiqian, et al.
Pubblicazione: (2024) -
Compositional 3D-aware Video Generation with LLM Director
di: Zhu, Hanxin, et al.
Pubblicazione: (2024) -
P-4DGS: Predictive 4D Gaussian Splatting with 90$\times$ Compression
di: Wang, Henan, et al.
Pubblicazione: (2025) -
Video In-context Learning: Autoregressive Transformers are Zero-Shot Video Imitators
di: Zhang, Wentao, et al.
Pubblicazione: (2024) -
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)