Embody4D: A Generalist 4D World Model for Embodied AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Tu, Peiyan, Zhu, Hanxin, Sun, Jingwen, Ren, Shaojie, Wang, Cong, Luo, Jiayi, Cheng, Xiaoqian, Chen, Zhibo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
di: Zhu, Hanxin, et al.
Pubblicazione: (2026)
4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models
di: Lu, Yiting, et al.
Pubblicazione: (2025)
di: Lu, Yiting, et al.
Pubblicazione: (2025)
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
di: Sun, Jingwen, et al.
Pubblicazione: (2026)
di: Sun, Jingwen, et al.
Pubblicazione: (2026)
An Embodied Generalist Agent in 3D World
di: Huang, Jiangyong, et al.
Pubblicazione: (2023)
di: Huang, Jiangyong, et al.
Pubblicazione: (2023)
OmniActor: A Generalist GUI and Embodied Agent for 2D&3D Worlds
di: Yang, Longrong, et al.
Pubblicazione: (2025)
di: Yang, Longrong, et al.
Pubblicazione: (2025)
TesserAct: Learning 4D Embodied World Models
di: Zhen, Haoyu, et al.
Pubblicazione: (2025)
di: Zhen, Haoyu, et al.
Pubblicazione: (2025)
AR4D: Autoregressive 4D Generation from Monocular Videos
di: Zhu, Hanxin, et al.
Pubblicazione: (2025)
di: Zhu, Hanxin, et al.
Pubblicazione: (2025)
Kinema4D: Kinematic 4D World Modeling for Spatiotemporal Embodied Simulation
di: Xu, Mutian, et al.
Pubblicazione: (2026)
di: Xu, Mutian, et al.
Pubblicazione: (2026)
P-4DGS: Predictive 4D Gaussian Splatting with 90$\times$ Compression
di: Wang, Henan, et al.
Pubblicazione: (2025)
di: Wang, Henan, et al.
Pubblicazione: (2025)
GaussianSR: 3D Gaussian Super-Resolution with 2D Diffusion Priors
di: Yu, Xiqian, et al.
Pubblicazione: (2024)
di: Yu, Xiqian, et al.
Pubblicazione: (2024)
RoboStereo: Dual-Tower 4D Embodied World Models for Unified Policy Optimization
di: Zhang, Ruicheng, et al.
Pubblicazione: (2026)
di: Zhang, Ruicheng, et al.
Pubblicazione: (2026)
OrthoPhys: Physically Plausible Video Generation with Orthogonal-View Geometry Guidance
di: Wang, Cong, et al.
Pubblicazione: (2026)
di: Wang, Cong, et al.
Pubblicazione: (2026)
Learning 3D Persistent Embodied World Models
di: Zhou, Siyuan, et al.
Pubblicazione: (2025)
di: Zhou, Siyuan, et al.
Pubblicazione: (2025)
The Semantic Lifecycle in Embodied AI: Acquisition, Representation and Storage via Foundation Models
di: Chen, Shuai, et al.
Pubblicazione: (2026)
di: Chen, Shuai, et al.
Pubblicazione: (2026)
Towards Learning a Generalist Model for Embodied Navigation
di: Zheng, Duo, et al.
Pubblicazione: (2023)
di: Zheng, Duo, et al.
Pubblicazione: (2023)
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
di: He, Ziheng, et al.
Pubblicazione: (2026)
di: He, Ziheng, et al.
Pubblicazione: (2026)
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
di: Wang, Xinjie, et al.
Pubblicazione: (2025)
Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
OctoNav: Towards Generalist Embodied Navigation
di: Gao, Chen, et al.
Pubblicazione: (2025)
di: Gao, Chen, et al.
Pubblicazione: (2025)
A Comprehensive Survey on World Models for Embodied AI
di: Li, Xinqing, et al.
Pubblicazione: (2025)
di: Li, Xinqing, et al.
Pubblicazione: (2025)
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
di: Feng, Yao, et al.
Pubblicazione: (2025)
di: Feng, Yao, et al.
Pubblicazione: (2025)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
di: X, Tencent Robotics, et al.
Pubblicazione: (2026)
EmbodMocap: In-the-Wild 4D Human-Scene Reconstruction for Embodied Agents
di: Wang, Wenjia, et al.
Pubblicazione: (2026)
di: Wang, Wenjia, et al.
Pubblicazione: (2026)
GSemSplat: Generalizable Semantic 3D Gaussian Splatting from Uncalibrated Image Pairs
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
GigaWorld-0: World Models as Data Engine to Empower Embodied AI
di: GigaWorld Team, et al.
Pubblicazione: (2025)
di: GigaWorld Team, et al.
Pubblicazione: (2025)
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
di: Cheng, Zhili, et al.
Pubblicazione: (2025)
di: Cheng, Zhili, et al.
Pubblicazione: (2025)
Compositional 3D-aware Video Generation with LLM Director
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
di: Zhu, Hanxin, et al.
Pubblicazione: (2024)
3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
di: He, Yunhong, et al.
Pubblicazione: (2025)
di: He, Yunhong, et al.
Pubblicazione: (2025)
WorldArena: A Unified Benchmark for Evaluating Perception and Functional Utility of Embodied World Models
di: Shang, Yu, et al.
Pubblicazione: (2026)
di: Shang, Yu, et al.
Pubblicazione: (2026)
Embodied Tree of Thoughts: Deliberate Manipulation Planning with Embodied World Model
di: Xu, Wenjiang, et al.
Pubblicazione: (2025)
di: Xu, Wenjiang, et al.
Pubblicazione: (2025)
TwinBrainVLA: Unleashing the Potential of Generalist VLMs for Embodied Tasks via Asymmetric Mixture-of-Transformers
di: Yu, Bin, et al.
Pubblicazione: (2026)
di: Yu, Bin, et al.
Pubblicazione: (2026)
3D Generation for Embodied AI and Robotic Simulation: A Survey
di: Ye, Tianwei, et al.
Pubblicazione: (2026)
di: Ye, Tianwei, et al.
Pubblicazione: (2026)
BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks
di: Chen, Yixiang, et al.
Pubblicazione: (2026)
di: Chen, Yixiang, et al.
Pubblicazione: (2026)
Wanderland: Geometrically Grounded Simulation for Open-World Embodied AI
di: Liu, Xinhao, et al.
Pubblicazione: (2025)
di: Liu, Xinhao, et al.
Pubblicazione: (2025)
Light Field Compression Based on Implicit Neural Representation
di: Wang, Henan, et al.
Pubblicazione: (2024)
di: Wang, Henan, et al.
Pubblicazione: (2024)
WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform
di: Shang, Yu, et al.
Pubblicazione: (2026)
di: Shang, Yu, et al.
Pubblicazione: (2026)
World Action Models: The Next Frontier in Embodied AI
di: Wang, Siyin, et al.
Pubblicazione: (2026)
di: Wang, Siyin, et al.
Pubblicazione: (2026)
Image Quality Assessment for Embodied AI
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
Self-evolving Embodied AI
di: Feng, Tongtong, et al.
Pubblicazione: (2026)
di: Feng, Tongtong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
di: Zhu, Hanxin, et al.
Pubblicazione: (2026) -
4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models
di: Lu, Yiting, et al.
Pubblicazione: (2025) -
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
di: Sun, Jingwen, et al.
Pubblicazione: (2026) -
An Embodied Generalist Agent in 3D World
di: Huang, Jiangyong, et al.
Pubblicazione: (2023) -
OmniActor: A Generalist GUI and Embodied Agent for 2D&3D Worlds
di: Yang, Longrong, et al.
Pubblicazione: (2025)