DreamToNav: Generalizable Navigation for Robots via Generative Video Planning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Serpiva, Valerii, Sam, Jeffrin, Simon, Chidera, Amjad, Hajira, Zhura, Iana, Lykov, Artem, Tsetserukou, Dzmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
SwarmDiffusion: End-To-End Traversability-Guided Diffusion for Embodiment-Agnostic Navigation of Heterogeneous Robots
par: Zhura, Iana, et autres
Publié: (2025)
par: Zhura, Iana, et autres
Publié: (2025)
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion
par: Zhura, Iana, et autres
Publié: (2026)
par: Zhura, Iana, et autres
Publié: (2026)
HumanDiffusion: A Vision-Based Diffusion Trajectory Planner with Human-Conditioned Goals for Search and Rescue UAV
par: Batool, Faryal, et autres
Publié: (2026)
par: Batool, Faryal, et autres
Publié: (2026)
GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction
par: Kobzarev, Oleg, et autres
Publié: (2025)
par: Kobzarev, Oleg, et autres
Publié: (2025)
GestOS: Advanced Hand Gesture Interpretation via Large Language Models to control Any Type of Robot
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
UAV-VLRR: Vision-Language Informed NMPC for Rapid Response in UAV Search and Rescue
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
RaceVLA: VLA-based Racing Drone Navigation with Human-like Behaviour
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
FlockGPT: Guiding UAV Flocking with Linguistic Orchestration
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
CognitiveDrone: A VLA Model and Evaluation Benchmark for Real-Time Cognitive Task Solving and Reasoning in UAVs
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
UAV-CodeAgents: Scalable UAV Mission Planning via Multi-Agent ReAct and Vision-Language Reasoning
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
AgilePilot: DRL-Based Drone Agent for Real-Time Motion Planning in Dynamic Environments by Leveraging Object Detection
par: Khan, Roohan Ahmed, et autres
Publié: (2025)
par: Khan, Roohan Ahmed, et autres
Publié: (2025)
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
SharpSLAM: 3D Object-Oriented Visual SLAM with Deblurring for Agile Drones
par: Davletshin, Denis, et autres
Publié: (2024)
par: Davletshin, Denis, et autres
Publié: (2024)
SafeHumanoid: VLM-RAG-driven Control of Upper Body Impedance for Humanoid Robot
par: Mahmoud, Yara, et autres
Publié: (2025)
par: Mahmoud, Yara, et autres
Publié: (2025)
GazeRace: Revolutionizing Remote Piloting with Eye-Gaze Control
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
par: Tokmurziyev, Issatay, et autres
Publié: (2024)
OmniRace: 6D Hand Pose Estimation for Intuitive Guidance of Racing Drone
par: Serpiva, Valerii, et autres
Publié: (2024)
par: Serpiva, Valerii, et autres
Publié: (2024)
Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
Evolution 6.0: Robot Evolution through Generative Design
par: Khan, Muhammad Haris, et autres
Publié: (2025)
par: Khan, Muhammad Haris, et autres
Publié: (2025)
Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion
par: Sam, Jeffrin, et autres
Publié: (2026)
par: Sam, Jeffrin, et autres
Publié: (2026)
VR-GPT: Visual Language Model for Intelligent Virtual Reality Applications
par: Konenkov, Mikhail, et autres
Publié: (2024)
par: Konenkov, Mikhail, et autres
Publié: (2024)
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
par: Bazhenov, Artem, et autres
Publié: (2024)
par: Bazhenov, Artem, et autres
Publié: (2024)
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
YawSitter: Modeling and Controlling a Tail-Sitter UAV with Enhanced Yaw Control
par: Habel, Amir, et autres
Publié: (2025)
par: Habel, Amir, et autres
Publié: (2025)
MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model
par: Berman, Vladimir, et autres
Publié: (2024)
par: Berman, Vladimir, et autres
Publié: (2024)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems
par: Lykov, Artem, et autres
Publié: (2023)
par: Lykov, Artem, et autres
Publié: (2023)
FADet: A Multi-sensor 3D Object Detection Network based on Local Featured Attention
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
par: Fernando, Marcelino Julio, et autres
Publié: (2026)
SafeSwarm: Decentralized Safe RL for the Swarm of Drones Landing in Dense Crowds
par: Tadevosyan, Grik, et autres
Publié: (2025)
par: Tadevosyan, Grik, et autres
Publié: (2025)
AttentionSwarm: Reinforcement Learning with Attention Control Barier Function for Crazyflie Drones in Dynamic Environments
par: Tadevosyan, Grik, et autres
Publié: (2025)
par: Tadevosyan, Grik, et autres
Publié: (2025)
CognitiveDog: Large Multimodal Model Based System to Translate Vision and Language into Action of Quadruped Robot
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
UAV-VLPA*: A Vision-Language-Path-Action System for Optimal Route Generation on a Large Scales
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
DroneVLA: VLA based Aerial Manipulation
par: Mehboob, Fawad, et autres
Publié: (2026)
par: Mehboob, Fawad, et autres
Publié: (2026)
CognitiveOS: Large Multimodal Model based System to Endow Any Type of Robot with Generative AI
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
H-RINS: Hierarchical Tightly-coupled Radar-Inertial Navigation via Smoothing and Mapping
par: Abdulkarim, Ali Alridha, et autres
Publié: (2026)
par: Abdulkarim, Ali Alridha, et autres
Publié: (2026)
CONTHER: Human-Like Contextual Robot Learning via Hindsight Experience Replay and Transformers without Expert Demonstrations
par: Makarova, Maria, et autres
Publié: (2025)
par: Makarova, Maria, et autres
Publié: (2025)
Echo: An Open-Source, Low-Cost Teleoperation System with Force Feedback for Dataset Collection in Robot Learning
par: Bazhenov, Artem, et autres
Publié: (2025)
par: Bazhenov, Artem, et autres
Publié: (2025)
Documents similaires
-
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026) -
SwarmDiffusion: End-To-End Traversability-Guided Diffusion for Embodiment-Agnostic Navigation of Heterogeneous Robots
par: Zhura, Iana, et autres
Publié: (2025) -
PhysicalAgent: Towards General Cognitive Robotics with Foundation World Models
par: Lykov, Artem, et autres
Publié: (2025) -
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025) -
DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion
par: Zhura, Iana, et autres
Publié: (2026)