Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yaxuan, Zhou, Zhongyi, Chen, Yefei, Guo, Yanjiang, Liu, Jiaming, Zhang, Shanghang, Chen, Jianyu, Zhu, Yichen |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
par: Li, Yaxuan, et autres
Publié: (2026)
par: Li, Yaxuan, et autres
Publié: (2026)
Ctrl-World: A Controllable Generative World Model for Robot Manipulation
par: Guo, Yanjiang, et autres
Publié: (2025)
par: Guo, Yanjiang, et autres
Publié: (2025)
HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers
par: Zhang, Jianke, et autres
Publié: (2024)
par: Zhang, Jianke, et autres
Publié: (2024)
Learning Generalizable Robot Policy with Human Demonstration Video as a Prompt
par: Zhu, Xiang, et autres
Publié: (2025)
par: Zhu, Xiang, et autres
Publié: (2025)
HARP-VLA: Human-Robot Aligned Representation Learning for Vision-Language-Action Model
par: Zhu, Xiang, et autres
Publié: (2026)
par: Zhu, Xiang, et autres
Publié: (2026)
Advancing Humanoid Locomotion: Mastering Challenging Terrains with Denoising World Model Learning
par: Gu, Xinyang, et autres
Publié: (2024)
par: Gu, Xinyang, et autres
Publié: (2024)
UniJEPA: Enhancing Robot Policy via Unified Continuous and Discrete Representation Learning
par: Zhang, Jianke, et autres
Publié: (2025)
par: Zhang, Jianke, et autres
Publié: (2025)
$τ_0$-WM: A Unified Video-Action World Model for Robotic Manipulation
par: Zhou, Pengfei, et autres
Publié: (2026)
par: Zhou, Pengfei, et autres
Publié: (2026)
H-WM: Robotic Task and Motion Planning Guided by Hierarchical World Model
par: Huang, Jinbang, et autres
Publié: (2026)
par: Huang, Jinbang, et autres
Publié: (2026)
WorldEval: World Model as Real-World Robot Policies Evaluator
par: Li, Yaxuan, et autres
Publié: (2025)
par: Li, Yaxuan, et autres
Publié: (2025)
RoboWM-Bench: A Benchmark for Evaluating World Models in Robotic Manipulation
par: Jiang, Feng, et autres
Publié: (2026)
par: Jiang, Feng, et autres
Publié: (2026)
AtomVLA: Scalable Post-Training for Robotic Manipulation via Predictive Latent World Models
par: Sun, Xiaoquan, et autres
Publié: (2026)
par: Sun, Xiaoquan, et autres
Publié: (2026)
Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation?
par: Zhang, Zhongru, et autres
Publié: (2026)
par: Zhang, Zhongru, et autres
Publié: (2026)
VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model
par: Guo, Yanjiang, et autres
Publié: (2026)
par: Guo, Yanjiang, et autres
Publié: (2026)
iMoWM: Taming Interactive Multi-Modal World Model for Robotic Manipulation
par: Zhang, Chuanrui, et autres
Publié: (2025)
par: Zhang, Chuanrui, et autres
Publié: (2025)
DDP-WM: Disentangled Dynamics Prediction for Efficient World Models
par: Yin, Shicheng, et autres
Publié: (2026)
par: Yin, Shicheng, et autres
Publié: (2026)
DoReMi: Grounding Language Model by Detecting and Recovering from Plan-Execution Misalignment
par: Guo, Yanjiang, et autres
Publié: (2023)
par: Guo, Yanjiang, et autres
Publié: (2023)
WM-DAgger: Enabling Efficient Data Aggregation for Imitation Learning with World Models
par: Yu, Anlan, et autres
Publié: (2026)
par: Yu, Anlan, et autres
Publié: (2026)
ResWM: Residual-Action World Model for Visual RL
par: Zhang, Jseen, et autres
Publié: (2026)
par: Zhang, Jseen, et autres
Publié: (2026)
AdaWM: Adaptive World Model based Planning for Autonomous Driving
par: Wang, Hang, et autres
Publié: (2025)
par: Wang, Hang, et autres
Publié: (2025)
Genie Centurion: Accelerating Scalable Real-World Robot Training with Human Rewind-and-Refine Guidance
par: Wang, Wenhao, et autres
Publié: (2025)
par: Wang, Wenhao, et autres
Publié: (2025)
ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
par: Zeng, Qiyuan, et autres
Publié: (2025)
par: Zeng, Qiyuan, et autres
Publié: (2025)
H2R: A Human-to-Robot Data Augmentation for Robot Pre-training from Videos
par: Li, Guangrun, et autres
Publié: (2025)
par: Li, Guangrun, et autres
Publié: (2025)
DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation
par: Han, Yifan, et autres
Publié: (2026)
par: Han, Yifan, et autres
Publié: (2026)
MimicDreamer: Aligning Human and Robot Demonstrations for Scalable VLA Training
par: Li, Haoyun, et autres
Publié: (2025)
par: Li, Haoyun, et autres
Publié: (2025)
Driver-WM: A Driver-Centric Traffic-Conditioned Latent World Model for In-Cabin Dynamics Rollout
par: Chi, Haozhuang, et autres
Publié: (2026)
par: Chi, Haozhuang, et autres
Publié: (2026)
PIN-WM: Learning Physics-INformed World Models for Non-Prehensile Manipulation
par: Li, Wenxuan, et autres
Publié: (2025)
par: Li, Wenxuan, et autres
Publié: (2025)
ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge
par: Zhou, Zhongyi, et autres
Publié: (2025)
par: Zhou, Zhongyi, et autres
Publié: (2025)
RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot
par: Heng, Liang, et autres
Publié: (2025)
par: Heng, Liang, et autres
Publié: (2025)
dVLA: Diffusion Vision-Language-Action Model with Multimodal Chain-of-Thought
par: Wen, Junjie, et autres
Publié: (2025)
par: Wen, Junjie, et autres
Publié: (2025)
DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning
par: Zhou, Gaoyue, et autres
Publié: (2024)
par: Zhou, Gaoyue, et autres
Publié: (2024)
SOP: A Scalable Online Post-Training System for Vision-Language-Action Models
par: Pan, Mingjie, et autres
Publié: (2026)
par: Pan, Mingjie, et autres
Publié: (2026)
LaDi-WM: A Latent Diffusion-based World Model for Predictive Manipulation
par: Huang, Yuhang, et autres
Publié: (2025)
par: Huang, Yuhang, et autres
Publié: (2025)
ManualVLA: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation
par: Gu, Chenyang, et autres
Publié: (2025)
par: Gu, Chenyang, et autres
Publié: (2025)
Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations
par: Hu, Yucheng, et autres
Publié: (2024)
par: Hu, Yucheng, et autres
Publié: (2024)
TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation
par: Xu, Qinwen, et autres
Publié: (2026)
par: Xu, Qinwen, et autres
Publié: (2026)
Prediction with Action: Visual Policy Learning via Joint Denoising Process
par: Guo, Yanjiang, et autres
Publié: (2024)
par: Guo, Yanjiang, et autres
Publié: (2024)
MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation
par: Liu, Zhuoyang, et autres
Publié: (2025)
par: Liu, Zhuoyang, et autres
Publié: (2025)
World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training
par: Xiao, Junjin, et autres
Publié: (2025)
par: Xiao, Junjin, et autres
Publié: (2025)
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
par: Jiang, Zhennan, et autres
Publié: (2026)
par: Jiang, Zhennan, et autres
Publié: (2026)
Documents similaires
-
dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
par: Li, Yaxuan, et autres
Publié: (2026) -
Ctrl-World: A Controllable Generative World Model for Robot Manipulation
par: Guo, Yanjiang, et autres
Publié: (2025) -
HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers
par: Zhang, Jianke, et autres
Publié: (2024) -
Learning Generalizable Robot Policy with Human Demonstration Video as a Prompt
par: Zhu, Xiang, et autres
Publié: (2025) -
HARP-VLA: Human-Robot Aligned Representation Learning for Vision-Language-Action Model
par: Zhu, Xiang, et autres
Publié: (2026)