Enregistré dans:
| Auteurs principaux: | Hansen, Nicklas, Su, Hao, Wang, Xiaolong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2310.16828 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Massively Multitask World Models for Continuous Control
par: Hansen, Nicklas, et autres
Publié: (2025)
par: Hansen, Nicklas, et autres
Publié: (2025)
MoDem-V2: Visuo-Motor World Models for Real-World Robot Manipulation
par: Lancaster, Patrick, et autres
Publié: (2023)
par: Lancaster, Patrick, et autres
Publié: (2023)
Hierarchical World Models as Visual Whole-Body Humanoid Controllers
par: Hansen, Nicklas, et autres
Publié: (2024)
par: Hansen, Nicklas, et autres
Publié: (2024)
GWM: Towards Scalable Gaussian World Models for Robotic Manipulation
par: Lu, Guanxing, et autres
Publié: (2025)
par: Lu, Guanxing, et autres
Publié: (2025)
Helpful DoggyBot: Open-World Object Fetching using Legged Robots and Vision-Language Models
par: Wu, Qi, et autres
Publié: (2024)
par: Wu, Qi, et autres
Publié: (2024)
Multi-Stage Manipulation with Demonstration-Augmented Reward, Policy, and World Model Learning
par: Escoriza, Adrià López, et autres
Publié: (2025)
par: Escoriza, Adrià López, et autres
Publié: (2025)
LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving
par: Sha, Hao, et autres
Publié: (2023)
par: Sha, Hao, et autres
Publié: (2023)
StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement
par: Seo, Junwon, et autres
Publié: (2026)
par: Seo, Junwon, et autres
Publié: (2026)
Navigation World Models
par: Bar, Amir, et autres
Publié: (2024)
par: Bar, Amir, et autres
Publié: (2024)
AdaWorld: Learning Adaptable World Models with Latent Actions
par: Gao, Shenyuan, et autres
Publié: (2025)
par: Gao, Shenyuan, et autres
Publié: (2025)
World Simulation with Video Foundation Models for Physical AI
par: NVIDIA, et autres
Publié: (2025)
par: NVIDIA, et autres
Publié: (2025)
Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control
par: NVIDIA, et autres
Publié: (2025)
par: NVIDIA, et autres
Publié: (2025)
Aether: Geometric-Aware Unified World Modeling
par: Aether Team, et autres
Publié: (2025)
par: Aether Team, et autres
Publié: (2025)
VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot Planning
par: Liang, Yichao, et autres
Publié: (2024)
par: Liang, Yichao, et autres
Publié: (2024)
Cosmos World Foundation Model Platform for Physical AI
par: NVIDIA, et autres
Publié: (2025)
par: NVIDIA, et autres
Publié: (2025)
Scalable Vision-Language-Action Model Pretraining for Robotic Manipulation with Real-Life Human Activity Videos
par: Li, Qixiu, et autres
Publié: (2025)
par: Li, Qixiu, et autres
Publié: (2025)
ManiSkill-HAB: A Benchmark for Low-Level Manipulation in Home Rearrangement Tasks
par: Shukla, Arth, et autres
Publié: (2024)
par: Shukla, Arth, et autres
Publié: (2024)
AutoWorld: Scaling Multi-Agent Traffic Simulation with Self-Supervised World Models
par: Pourkeshavatz, Mozhgan, et autres
Publié: (2026)
par: Pourkeshavatz, Mozhgan, et autres
Publié: (2026)
Enhancing Generalization in Vision-Language-Action Models by Preserving Pretrained Representations
par: Grover, Shresth, et autres
Publié: (2025)
par: Grover, Shresth, et autres
Publié: (2025)
From Pixels to Predicates: Learning Symbolic World Models via Pretrained Vision-Language Models
par: Athalye, Ashay, et autres
Publié: (2024)
par: Athalye, Ashay, et autres
Publié: (2024)
Learning Visual Feature-Based World Models via Residual Latent Action
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
Harmonic Mobile Manipulation
par: Yang, Ruihan, et autres
Publié: (2023)
par: Yang, Ruihan, et autres
Publié: (2023)
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration
par: Ni, Chaojun, et autres
Publié: (2024)
par: Ni, Chaojun, et autres
Publié: (2024)
E0: Enhancing Generalization and Fine-Grained Control in VLA Models via Tweedie Discrete Diffusion
par: Zhan, Zhihao, et autres
Publié: (2025)
par: Zhan, Zhihao, et autres
Publié: (2025)
DexCap: Scalable and Portable Mocap Data Collection System for Dexterous Manipulation
par: Wang, Chen, et autres
Publié: (2024)
par: Wang, Chen, et autres
Publié: (2024)
Surfer: Progressive Reasoning with World Models for Robotic Manipulation
par: Ren, Pengzhen, et autres
Publié: (2023)
par: Ren, Pengzhen, et autres
Publié: (2023)
Real-World Robot Applications of Foundation Models: A Review
par: Kawaharazuka, Kento, et autres
Publié: (2024)
par: Kawaharazuka, Kento, et autres
Publié: (2024)
Continuously Improving Mobile Manipulation with Autonomous Real-World RL
par: Mendonca, Russell, et autres
Publié: (2024)
par: Mendonca, Russell, et autres
Publié: (2024)
ImitDiff: Transferring Foundation-Model Priors for Distraction Robust Visuomotor Policy
par: Dong, Yuhang, et autres
Publié: (2025)
par: Dong, Yuhang, et autres
Publié: (2025)
ReCoRe: Regularized Contrastive Representation Learning of World Model
par: Poudel, Rudra P. K., et autres
Publié: (2023)
par: Poudel, Rudra P. K., et autres
Publié: (2023)
ExoPredicator: Learning Abstract Models of Dynamic Worlds for Robot Planning
par: Liang, Yichao, et autres
Publié: (2025)
par: Liang, Yichao, et autres
Publié: (2025)
GrndCtrl: Grounding World Models via Self-Supervised Reward Alignment
par: He, Haoyang, et autres
Publié: (2025)
par: He, Haoyang, et autres
Publié: (2025)
PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation
par: Zhang, Kaidong, et autres
Publié: (2024)
par: Zhang, Kaidong, et autres
Publié: (2024)
Critiques of World Models
par: Xing, Eric, et autres
Publié: (2025)
par: Xing, Eric, et autres
Publié: (2025)
Vision-Language-Action Models for Robotics: A Review Towards Real-World Applications
par: Kawaharazuka, Kento, et autres
Publié: (2025)
par: Kawaharazuka, Kento, et autres
Publié: (2025)
DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA
par: Chen, Yi, et autres
Publié: (2026)
par: Chen, Yi, et autres
Publié: (2026)
Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis
par: Hu, Yafei, et autres
Publié: (2023)
par: Hu, Yafei, et autres
Publié: (2023)
CHOrD: Generation of Collision-Free, House-Scale, and Organized Digital Twins for 3D Indoor Scenes with Controllable Floor Plans and Optimal Layouts
par: Su, Chong, et autres
Publié: (2025)
par: Su, Chong, et autres
Publié: (2025)
EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos
par: Yang, Ruihan, et autres
Publié: (2025)
par: Yang, Ruihan, et autres
Publié: (2025)
Copilot4D: Learning Unsupervised World Models for Autonomous Driving via Discrete Diffusion
par: Zhang, Lunjun, et autres
Publié: (2023)
par: Zhang, Lunjun, et autres
Publié: (2023)
Documents similaires
-
Learning Massively Multitask World Models for Continuous Control
par: Hansen, Nicklas, et autres
Publié: (2025) -
MoDem-V2: Visuo-Motor World Models for Real-World Robot Manipulation
par: Lancaster, Patrick, et autres
Publié: (2023) -
Hierarchical World Models as Visual Whole-Body Humanoid Controllers
par: Hansen, Nicklas, et autres
Publié: (2024) -
GWM: Towards Scalable Gaussian World Models for Robotic Manipulation
par: Lu, Guanxing, et autres
Publié: (2025) -
Helpful DoggyBot: Open-World Object Fetching using Legged Robots and Vision-Language Models
par: Wu, Qi, et autres
Publié: (2024)