BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yixiang, Li, Peiyan, Yang, Jiabing, He, Keji, Wu, Xiangnan, Xu, Yuan, Wang, Kai, Liu, Jing, Liu, Nianfeng, Huang, Yan, Wang, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
di: He, Ziheng, et al.
Pubblicazione: (2026)
di: He, Ziheng, et al.
Pubblicazione: (2026)
EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
VERM: Leveraging Foundation Models to Create a Virtual Eye for Efficient 3D Robotic Manipulation
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
di: Li, Peiyan, et al.
Pubblicazione: (2026)
di: Li, Peiyan, et al.
Pubblicazione: (2026)
UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models
di: Yang, Jiabing, et al.
Pubblicazione: (2026)
di: Yang, Jiabing, et al.
Pubblicazione: (2026)
BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
di: Li, Peiyan, et al.
Pubblicazione: (2025)
di: Li, Peiyan, et al.
Pubblicazione: (2025)
EgoDemoGen: Egocentric Demonstration Generation for Viewpoint Generalization in Robotic Manipulation
di: Xu, Yuan, et al.
Pubblicazione: (2025)
di: Xu, Yuan, et al.
Pubblicazione: (2025)
Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
di: Li, Zhiyuan, et al.
Pubblicazione: (2026)
Bridging Embodiment Gaps: Deploying Vision-Language-Action Models on Soft Robots
di: Su, Haochen, et al.
Pubblicazione: (2025)
di: Su, Haochen, et al.
Pubblicazione: (2025)
Scaling Cross-Embodiment World Models for Dexterous Manipulation
di: He, Zihao, et al.
Pubblicazione: (2025)
di: He, Zihao, et al.
Pubblicazione: (2025)
FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation
di: Chen, Kehan, et al.
Pubblicazione: (2026)
di: Chen, Kehan, et al.
Pubblicazione: (2026)
EVA: An Embodied World Model for Future Video Anticipation
di: Chi, Xiaowei, et al.
Pubblicazione: (2024)
di: Chi, Xiaowei, et al.
Pubblicazione: (2024)
RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
EnvBridge: Bridging Diverse Environments with Cross-Environment Knowledge Transfer for Embodied AI
di: Kagaya, Tomoyuki, et al.
Pubblicazione: (2024)
di: Kagaya, Tomoyuki, et al.
Pubblicazione: (2024)
Rethinking Video Generation Model for the Embodied World
di: Deng, Yufan, et al.
Pubblicazione: (2026)
di: Deng, Yufan, et al.
Pubblicazione: (2026)
GAIDE: Graph-based Attention Masking for Spatial- and Embodiment-aware Motion Planning
di: Soleymanzadeh, Davood, et al.
Pubblicazione: (2026)
di: Soleymanzadeh, Davood, et al.
Pubblicazione: (2026)
Latent Policy Steering with Embodiment-Agnostic Pretrained World Models
di: Wang, Yiqi, et al.
Pubblicazione: (2025)
di: Wang, Yiqi, et al.
Pubblicazione: (2025)
ReWorld: Multi-Dimensional Reward Modeling for Embodied World Models
di: Peng, Baorui, et al.
Pubblicazione: (2026)
di: Peng, Baorui, et al.
Pubblicazione: (2026)
Imaginative World Modeling with Scene Graphs for Embodied Agent Navigation
di: Hu, Yue, et al.
Pubblicazione: (2025)
di: Hu, Yue, et al.
Pubblicazione: (2025)
Towards High-Consistency Embodied World Model with Multi-View Trajectory Videos
di: Su, Taiyi, et al.
Pubblicazione: (2025)
di: Su, Taiyi, et al.
Pubblicazione: (2025)
Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising
di: Guo, Jun, et al.
Pubblicazione: (2026)
di: Guo, Jun, et al.
Pubblicazione: (2026)
Embodied Navigation Foundation Model
di: Zhang, Jiazhao, et al.
Pubblicazione: (2025)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2025)
Modeling the Mental World for Embodied AI: A Comprehensive Review
di: Liu, Biyuan, et al.
Pubblicazione: (2025)
di: Liu, Biyuan, et al.
Pubblicazione: (2025)
Shadow: Leveraging Segmentation Masks for Cross-Embodiment Policy Transfer
di: Lepert, Marion, et al.
Pubblicazione: (2025)
di: Lepert, Marion, et al.
Pubblicazione: (2025)
Latent Bridge: Feature Delta Prediction for Efficient Dual-System Vision-Language-Action Model Inference
di: Liu, Yudong, et al.
Pubblicazione: (2026)
di: Liu, Yudong, et al.
Pubblicazione: (2026)
Embodied Tree of Thoughts: Deliberate Manipulation Planning with Embodied World Model
di: Xu, Wenjiang, et al.
Pubblicazione: (2025)
di: Xu, Wenjiang, et al.
Pubblicazione: (2025)
Improved Constrained Generation by Bridging Pretrained Generative Models
di: Liang, Xiaoxuan, et al.
Pubblicazione: (2026)
di: Liang, Xiaoxuan, et al.
Pubblicazione: (2026)
RoboWheel: A Data Engine from Real-World Human Demonstrations for Cross-Embodiment Robotic Learning
di: Zhang, Yuhong, et al.
Pubblicazione: (2025)
di: Zhang, Yuhong, et al.
Pubblicazione: (2025)
WorldGym: World Model as An Environment for Policy Evaluation
di: Quevedo, Julian, et al.
Pubblicazione: (2025)
di: Quevedo, Julian, et al.
Pubblicazione: (2025)
Grounding Large Language Models In Embodied Environment With Imperfect World Models
di: Liu, Haolan, et al.
Pubblicazione: (2024)
di: Liu, Haolan, et al.
Pubblicazione: (2024)
Scaling World Model for Hierarchical Manipulation Policies
di: Long, Qian, et al.
Pubblicazione: (2026)
di: Long, Qian, et al.
Pubblicazione: (2026)
A Survey: Learning Embodied Intelligence from Physical Simulators and World Models
di: Long, Xiaoxiao, et al.
Pubblicazione: (2025)
di: Long, Xiaoxiao, et al.
Pubblicazione: (2025)
World-Gymnast: Training Robots with Reinforcement Learning in a World Model
di: Sharma, Ansh Kumar, et al.
Pubblicazione: (2026)
di: Sharma, Ansh Kumar, et al.
Pubblicazione: (2026)
Embodied AI: From LLMs to World Models
di: Feng, Tongtong, et al.
Pubblicazione: (2025)
di: Feng, Tongtong, et al.
Pubblicazione: (2025)
WoW: Towards a World omniscient World model Through Embodied Interaction
di: Chi, Xiaowei, et al.
Pubblicazione: (2025)
di: Chi, Xiaowei, et al.
Pubblicazione: (2025)
RealD$^2$iff: Bridging Real-World Gap in Robot Manipulation via Depth Diffusion
di: Liang, Xiujian, et al.
Pubblicazione: (2025)
di: Liang, Xiujian, et al.
Pubblicazione: (2025)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
di: An, Dong, et al.
Pubblicazione: (2023)
di: An, Dong, et al.
Pubblicazione: (2023)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
BridgeDepth: Bridging Monocular and Stereo Reasoning with Latent Alignment
di: Guan, Tongfan, et al.
Pubblicazione: (2025)
di: Guan, Tongfan, et al.
Pubblicazione: (2025)
TraceGen: World Modeling in 3D Trace Space Enables Learning from Cross-Embodiment Videos
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
di: He, Ziheng, et al.
Pubblicazione: (2026) -
EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow
di: Chen, Yixiang, et al.
Pubblicazione: (2025) -
VERM: Leveraging Foundation Models to Create a Virtual Eye for Efficient 3D Robotic Manipulation
di: Chen, Yixiang, et al.
Pubblicazione: (2025) -
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
di: Li, Peiyan, et al.
Pubblicazione: (2026) -
UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models
di: Yang, Jiabing, et al.
Pubblicazione: (2026)