Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
Fuente:
arXiv
Saved in:
| Main Authors: | Ding, Hongyu, Zhang, Sizhuo, Xu, Ziming, Guo, Jinwen, Liu, Hongxiu, Cheng, Xingzhi, Chen, Zixuan, Qi, Haifei, Wang, Duo, Xu, Hao, Shi, Jieqi, Zhang, Yifan, Huo, Jing, Cheng, Jian, Gao, Yang, Luo, Jiebo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments
by: Ding, Hongyu, et al.
Published: (2025)
by: Ding, Hongyu, et al.
Published: (2025)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
by: Zhang, Jiazhao, et al.
Published: (2024)
by: Zhang, Jiazhao, et al.
Published: (2024)
GeoUni: A Unified Model for Generating Geometry Diagrams, Problems and Problem Solutions
by: Cheng, Jo-Ku, et al.
Published: (2025)
by: Cheng, Jo-Ku, et al.
Published: (2025)
UniViTAR: Unified Vision Transformer with Native Resolution
by: Qiao, Limeng, et al.
Published: (2025)
by: Qiao, Limeng, et al.
Published: (2025)
MoMaStage: Skill-State Graph Guided Planning and Closed-Loop Execution for Long-Horizon Indoor Mobile Manipulation
by: Li, Chenxu, et al.
Published: (2026)
by: Li, Chenxu, et al.
Published: (2026)
Do Blue Light Filters Reduce Visual Fatigue When Using Digital Maps? An Eye Tracking Experiment to Promote Vision Health
by: Sizhuo Gao, et al.
Published: (2025)
by: Sizhuo Gao, et al.
Published: (2025)
GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D Manipulation
by: Chen, Yangtao, et al.
Published: (2024)
by: Chen, Yangtao, et al.
Published: (2024)
UniSS: Unified Expressive Speech-to-Speech Translation with Your Voice
by: Cheng, Sitong, et al.
Published: (2025)
by: Cheng, Sitong, et al.
Published: (2025)
Aerial Vision-Language Navigation with a Unified Framework for Spatial, Temporal and Embodied Reasoning
by: Xu, Huilin, et al.
Published: (2025)
by: Xu, Huilin, et al.
Published: (2025)
FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation
by: Shao, Dian, et al.
Published: (2026)
by: Shao, Dian, et al.
Published: (2026)
V-Dreamer: Automating Robotic Simulation and Trajectory Synthesis via Video Generation Priors
by: He, Songjia, et al.
Published: (2026)
by: He, Songjia, et al.
Published: (2026)
ViT$^3$: Unlocking Test-Time Training in Vision
by: Han, Dongchen, et al.
Published: (2025)
by: Han, Dongchen, et al.
Published: (2025)
Towards Learning a Generalist Model for Embodied Navigation
by: Zheng, Duo, et al.
Published: (2023)
by: Zheng, Duo, et al.
Published: (2023)
ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation
by: Chen, Zixuan, et al.
Published: (2025)
by: Chen, Zixuan, et al.
Published: (2025)
Region crossing change on surfaces
by: Cheng, Jiawei, et al.
Published: (2019)
by: Cheng, Jiawei, et al.
Published: (2019)
Multimodal learning enables instant ionizing radiation alerts on unmodified mobile phones for real-world emergency response
by: Xie, Yanfeng, et al.
Published: (2025)
by: Xie, Yanfeng, et al.
Published: (2025)
Does Unification Come at a Cost? Uni-SafeBench: A Safety Benchmark for Unified Multimodal Large Models
by: Peng, Zixiang, et al.
Published: (2026)
by: Peng, Zixiang, et al.
Published: (2026)
Chat-UniVi: Unified Visual Representation Empowers Large Language Models with Image and Video Understanding
by: Jin, Peng, et al.
Published: (2023)
by: Jin, Peng, et al.
Published: (2023)
Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action
by: Zhang, Yi, et al.
Published: (2026)
by: Zhang, Yi, et al.
Published: (2026)
UniADC: A Unified Framework for Anomaly Detection and Classification
by: Zhang, Ximiao, et al.
Published: (2025)
by: Zhang, Ximiao, et al.
Published: (2025)
UniISP: A Unified ISP Framework for Both Human and Machine Vision
by: Li, Hanxi, et al.
Published: (2026)
by: Li, Hanxi, et al.
Published: (2026)
Declining Prevalence and Disability Burden of Chronic Obstructive Pulmonary Disease Associated With Heart Failure
by: Shengjie Xu, et al.
Published: (2026)
by: Shengjie Xu, et al.
Published: (2026)
Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
by: Qin, Luozheng, et al.
Published: (2026)
by: Qin, Luozheng, et al.
Published: (2026)
Data for Effect of Mesoscale Oceanic Eddies on Extratropical Cyclogenesis: a Tracking Approach
by: Zhang, Xingzhi
Published: (2019)
by: Zhang, Xingzhi
Published: (2019)
Embodied Navigation with Auxiliary Task of Action Description Prediction
by: Kondoh, Haru, et al.
Published: (2025)
by: Kondoh, Haru, et al.
Published: (2025)
UniMPR: A Unified Framework for Multimodal Place Recognition with Heterogeneous Sensor Configurations
by: Qi, Zhangshuo, et al.
Published: (2025)
by: Qi, Zhangshuo, et al.
Published: (2025)
UniCom: Towards a Unified and Cohesiveness-aware Framework for Community Search and Detection
by: Zhu, Yifan, et al.
Published: (2025)
by: Zhu, Yifan, et al.
Published: (2025)
Rational Design of PdPt Nanoalloys Sensitized Mesoporous SnO2 for High‐Performance Methane Sensing Applications
by: Chenyi Yuan, et al.
Published: (2025)
by: Chenyi Yuan, et al.
Published: (2025)
AdaClearGrasp: Learning Adaptive Clearing for Zero-Shot Robust Dexterous Grasping in Densely Cluttered Environments
by: Chen, Zixuan, et al.
Published: (2026)
by: Chen, Zixuan, et al.
Published: (2026)
PILoRA: Prototype Guided Incremental LoRA for Federated Class-Incremental Learning
by: Guo, Haiyang, et al.
Published: (2024)
by: Guo, Haiyang, et al.
Published: (2024)
How Far Are Large Multimodal Models from Human-Level Spatial Action? A Benchmark for Goal-Oriented Embodied Navigation in Urban Airspace
by: Zhao, Baining, et al.
Published: (2026)
by: Zhao, Baining, et al.
Published: (2026)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
by: Zhang, Junkai, et al.
Published: (2024)
by: Zhang, Junkai, et al.
Published: (2024)
Agentic Self-Evolutionary Replanning for Embodied Navigation
by: Li, Guoliang, et al.
Published: (2026)
by: Li, Guoliang, et al.
Published: (2026)
UniDyG: A Unified and Effective Representation Learning Approach for Large Dynamic Graphs
by: Xu, Yuanyuan, et al.
Published: (2025)
by: Xu, Yuanyuan, et al.
Published: (2025)
ContextFlow: Hierarchical Task-State Alignment for Long-Horizon Embodied Agents
by: Guo, Shuhan, et al.
Published: (2026)
by: Guo, Shuhan, et al.
Published: (2026)
INHerit-SG: Incremental Hierarchical Semantic Scene Graphs with RAG-Style Retrieval
by: Fang, YukTungSamuel, et al.
Published: (2026)
by: Fang, YukTungSamuel, et al.
Published: (2026)
Point2Graph: An End-to-end Point Cloud-based 3D Open-Vocabulary Scene Graph for Robot Navigation
by: Xu, Yifan, et al.
Published: (2024)
by: Xu, Yifan, et al.
Published: (2024)
NaviMaster: Learning a Unified Policy for GUI and Embodied Navigation Tasks
by: Luo, Zhihao, et al.
Published: (2025)
by: Luo, Zhihao, et al.
Published: (2025)
Advances in Embodied Navigation Using Large Language Models: A Survey
by: Lin, Jinzhou, et al.
Published: (2023)
by: Lin, Jinzhou, et al.
Published: (2023)
UniIF: Unified Molecule Inverse Folding
by: Gao, Zhangyang, et al.
Published: (2024)
by: Gao, Zhangyang, et al.
Published: (2024)
Similar Items
-
LaViRA: Language-Vision-Robot Actions Translation for Zero-Shot Vision Language Navigation in Continuous Environments
by: Ding, Hongyu, et al.
Published: (2025) -
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
by: Zhang, Jiazhao, et al.
Published: (2024) -
GeoUni: A Unified Model for Generating Geometry Diagrams, Problems and Problem Solutions
by: Cheng, Jo-Ku, et al.
Published: (2025) -
UniViTAR: Unified Vision Transformer with Native Resolution
by: Qiao, Limeng, et al.
Published: (2025) -
MoMaStage: Skill-State Graph Guided Planning and Closed-Loop Execution for Long-Horizon Indoor Mobile Manipulation
by: Li, Chenxu, et al.
Published: (2026)