Imagine-2-Drive: Leveraging High-Fidelity World Models via Multi-Modal Diffusion Policies
Fuente:
arXiv
Salvato in:
| Autori principali: | Garg, Anant, Krishna, K Madhava |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MetricGold: Leveraging Text-To-Image Latent Diffusion Models for Metric Depth Estimation
di: Shah, Ansh, et al.
Pubblicazione: (2024)
di: Shah, Ansh, et al.
Pubblicazione: (2024)
Composing Diffusion Policies for Few-shot Learning of Movement Trajectories
di: Patil, Omkar, et al.
Pubblicazione: (2024)
di: Patil, Omkar, et al.
Pubblicazione: (2024)
LeGo-Drive: Language-enhanced Goal-oriented Closed-Loop End-to-End Autonomous Driving
di: Paul, Pranjal, et al.
Pubblicazione: (2024)
di: Paul, Pranjal, et al.
Pubblicazione: (2024)
GR-MG: Leveraging Partially Annotated Data via Multi-Modal Goal-Conditioned Policy
di: Li, Peiyan, et al.
Pubblicazione: (2024)
di: Li, Peiyan, et al.
Pubblicazione: (2024)
PWM: Policy Learning with Multi-Task World Models
di: Georgiev, Ignat, et al.
Pubblicazione: (2024)
di: Georgiev, Ignat, et al.
Pubblicazione: (2024)
MASt3R-Nav: WayPixel Navigation in Relative 3D Maps
di: Garg, Vansh, et al.
Pubblicazione: (2026)
di: Garg, Vansh, et al.
Pubblicazione: (2026)
Revisit Anything: Visual Place Recognition via Image Segment Retrieval
di: Garg, Kartik, et al.
Pubblicazione: (2024)
di: Garg, Kartik, et al.
Pubblicazione: (2024)
Swarm-Gen: Fast Generation of Diverse Feasible Swarm Behaviors
di: Idoko, Simon, et al.
Pubblicazione: (2025)
di: Idoko, Simon, et al.
Pubblicazione: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
di: Chen, Haonan, et al.
Pubblicazione: (2025)
di: Chen, Haonan, et al.
Pubblicazione: (2025)
Curiosity-Driven Imagination: Discovering Plan Operators and Learning Associated Policies for Open-World Adaptation
di: Lorang, Pierrick, et al.
Pubblicazione: (2025)
di: Lorang, Pierrick, et al.
Pubblicazione: (2025)
AdaWorldPolicy: World-Model-Driven Diffusion Policy with Online Adaptive Learning for Robotic Manipulation
di: Yuan, Ge, et al.
Pubblicazione: (2026)
di: Yuan, Ge, et al.
Pubblicazione: (2026)
Feedback World Model Enables Precise Guidance of Diffusion Policy
di: An, Tuo, et al.
Pubblicazione: (2026)
di: An, Tuo, et al.
Pubblicazione: (2026)
When to Trust Imagination: Adaptive Action Execution for World Action Models
di: Wang, Rui, et al.
Pubblicazione: (2026)
di: Wang, Rui, et al.
Pubblicazione: (2026)
Discrete Contrastive Learning for Diffusion Policies in Autonomous Driving
di: Kujanpää, Kalle, et al.
Pubblicazione: (2025)
di: Kujanpää, Kalle, et al.
Pubblicazione: (2025)
AnchDrive: Bootstrapping Diffusion Policies with Hybrid Trajectory Anchors for End-to-End Driving
di: Chai, Jinhao, et al.
Pubblicazione: (2025)
di: Chai, Jinhao, et al.
Pubblicazione: (2025)
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
EDMP: Ensemble-of-costs-guided Diffusion for Motion Planning
di: Saha, Kallol, et al.
Pubblicazione: (2023)
di: Saha, Kallol, et al.
Pubblicazione: (2023)
RealDrive: Retrieval-Augmented Driving with Diffusion Models
di: Ding, Wenhao, et al.
Pubblicazione: (2025)
di: Ding, Wenhao, et al.
Pubblicazione: (2025)
Imagination Policy: Using Generative Point Cloud Models for Learning Manipulation Policies
di: Huang, Haojie, et al.
Pubblicazione: (2024)
di: Huang, Haojie, et al.
Pubblicazione: (2024)
PolyTouch: A Robust Multi-Modal Tactile Sensor for Contact-rich Manipulation Using Tactile-Diffusion Policies
di: Zhao, Jialiang, et al.
Pubblicazione: (2025)
di: Zhao, Jialiang, et al.
Pubblicazione: (2025)
Map Imagination Like Blind Humans: Group Diffusion Model for Robotic Map Generation
di: Song, Qijin, et al.
Pubblicazione: (2024)
di: Song, Qijin, et al.
Pubblicazione: (2024)
RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
di: Yang, Xuning, et al.
Pubblicazione: (2026)
di: Yang, Xuning, et al.
Pubblicazione: (2026)
PKRD-CoT: A Unified Chain-of-thought Prompting for Multi-Modal Large Language Models in Autonomous Driving
di: Luo, Xuewen, et al.
Pubblicazione: (2024)
di: Luo, Xuewen, et al.
Pubblicazione: (2024)
RAG-Driver: Generalisable Driving Explanations with Retrieval-Augmented In-Context Learning in Multi-Modal Large Language Model
di: Yuan, Jianhao, et al.
Pubblicazione: (2024)
di: Yuan, Jianhao, et al.
Pubblicazione: (2024)
WorldGym: World Model as An Environment for Policy Evaluation
di: Quevedo, Julian, et al.
Pubblicazione: (2025)
di: Quevedo, Julian, et al.
Pubblicazione: (2025)
Learning to Model Diverse Driving Behaviors in Highly Interactive Autonomous Driving Scenarios with Multi-Agent Reinforcement Learning
di: Weiwei, Liu, et al.
Pubblicazione: (2024)
di: Weiwei, Liu, et al.
Pubblicazione: (2024)
Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models
di: Høeg, Sigmund H., et al.
Pubblicazione: (2024)
di: Høeg, Sigmund H., et al.
Pubblicazione: (2024)
Vehicle Dynamics Embedded World Models for Autonomous Driving
di: Li, Huiqian, et al.
Pubblicazione: (2025)
di: Li, Huiqian, et al.
Pubblicazione: (2025)
RoboGolf: Mastering Real-World Minigolf with a Reflective Multi-Modality Vision-Language Model
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
Prompting Multi-Modal Tokens to Enhance End-to-End Autonomous Driving Imitation Learning with LLMs
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
A Knowledge-Driven Diffusion Policy for End-to-End Autonomous Driving Based on Expert Routing
di: Xu, Chengkai, et al.
Pubblicazione: (2025)
di: Xu, Chengkai, et al.
Pubblicazione: (2025)
Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
di: Dugar, Pranay, et al.
Pubblicazione: (2024)
Drive As You Like: Strategy-Level Motion Planning Based on A Multi-Head Diffusion Model
di: Ding, Fan, et al.
Pubblicazione: (2025)
di: Ding, Fan, et al.
Pubblicazione: (2025)
Diffusion Models for Safety Validation of Autonomous Driving Systems
di: Wang, Juanran, et al.
Pubblicazione: (2025)
di: Wang, Juanran, et al.
Pubblicazione: (2025)
Ego-centric Learning of Communicative World Models for Autonomous Driving
di: Wang, Hang, et al.
Pubblicazione: (2025)
di: Wang, Hang, et al.
Pubblicazione: (2025)
Exploring the Potential of World Models for Anomaly Detection in Autonomous Driving
di: Bogdoll, Daniel, et al.
Pubblicazione: (2023)
di: Bogdoll, Daniel, et al.
Pubblicazione: (2023)
A Multi-Fidelity Control Variate Approach for Policy Gradient Estimation
di: Liu, Xinjie, et al.
Pubblicazione: (2025)
di: Liu, Xinjie, et al.
Pubblicazione: (2025)
Reason--Imagine--Act: Closed-Loop LLM Decision Making with World Models for Autonomous Driving
di: Sun, Zhengqi, et al.
Pubblicazione: (2026)
di: Sun, Zhengqi, et al.
Pubblicazione: (2026)
Modality Selection and Skill Segmentation via Cross-Modality Attention
di: Jiang, Jiawei, et al.
Pubblicazione: (2025)
di: Jiang, Jiawei, et al.
Pubblicazione: (2025)
Sparse Imagination for Efficient Visual World Model Planning
di: Chun, Junha, et al.
Pubblicazione: (2025)
di: Chun, Junha, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MetricGold: Leveraging Text-To-Image Latent Diffusion Models for Metric Depth Estimation
di: Shah, Ansh, et al.
Pubblicazione: (2024) -
Composing Diffusion Policies for Few-shot Learning of Movement Trajectories
di: Patil, Omkar, et al.
Pubblicazione: (2024) -
LeGo-Drive: Language-enhanced Goal-oriented Closed-Loop End-to-End Autonomous Driving
di: Paul, Pranjal, et al.
Pubblicazione: (2024) -
GR-MG: Leveraging Partially Annotated Data via Multi-Modal Goal-Conditioned Policy
di: Li, Peiyan, et al.
Pubblicazione: (2024) -
PWM: Policy Learning with Multi-Task World Models
di: Georgiev, Ignat, et al.
Pubblicazione: (2024)