Navigating Motion Agents in Dynamic and Cluttered Environments through LLM Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yubo, Wu, Qi, Wang, Yifan, Tai, Yu-Wing, Tang, Chi-Keung |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation
di: Ao, Yuzhuo, et al.
Pubblicazione: (2026)
di: Ao, Yuzhuo, et al.
Pubblicazione: (2026)
Motion-Agent: A Conversational Framework for Human Motion Generation with LLMs
di: Wu, Qi, et al.
Pubblicazione: (2024)
di: Wu, Qi, et al.
Pubblicazione: (2024)
WorldCraft: Photo-Realistic 3D World Creation and Customization via LLM Agents
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
ReelWave: Multi-Agentic Movie Sound Generation through Multimodal LLM Conversation
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
VP-LLM: Text-Driven 3D Volume Completion with Large Language Models through Patchification
di: Liu, Jianmeng, et al.
Pubblicazione: (2024)
di: Liu, Jianmeng, et al.
Pubblicazione: (2024)
ChatCam: Empowering Camera Control through Conversational AI
di: Liu, Xinhang, et al.
Pubblicazione: (2024)
di: Liu, Xinhang, et al.
Pubblicazione: (2024)
CoT-RVS: Zero-Shot Chain-of-Thought Reasoning Segmentation for Videos
di: Kao, Shiu-hong, et al.
Pubblicazione: (2025)
di: Kao, Shiu-hong, et al.
Pubblicazione: (2025)
FED-NeRF: Achieve High 3D Consistency and Temporal Coherence for Face Video Editing on Dynamic NeRF
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
Think Before You Segment: High-Quality Reasoning Segmentation with GPT Chain of Thoughts
di: Kao, Shiu-hong, et al.
Pubblicazione: (2025)
di: Kao, Shiu-hong, et al.
Pubblicazione: (2025)
IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
HA-VLN 2.0: An Open Benchmark and Leaderboard for Human-Aware Navigation in Discrete and Continuous Environments with Dynamic Multi-Human Interactions
di: Dong, Yifei, et al.
Pubblicazione: (2025)
di: Dong, Yifei, et al.
Pubblicazione: (2025)
Distracted Robot: How Visual Clutter Undermine Robotic Manipulation
di: Rasouli, Amir, et al.
Pubblicazione: (2025)
di: Rasouli, Amir, et al.
Pubblicazione: (2025)
ZeST: an LLM-based Zero-Shot Traversability Navigation for Unknown Environments
di: Gummadi, Shreya, et al.
Pubblicazione: (2025)
di: Gummadi, Shreya, et al.
Pubblicazione: (2025)
Efficient Heatmap-Guided 6-Dof Grasp Detection in Cluttered Scenes
di: Chen, Siang, et al.
Pubblicazione: (2024)
di: Chen, Siang, et al.
Pubblicazione: (2024)
Multimodal Generation of Animatable 3D Human Models with AvatarForge
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
GraspClutter6D: A Large-scale Real-world Dataset for Robust Perception and Grasping in Cluttered Scenes
di: Back, Seunghyeok, et al.
Pubblicazione: (2025)
di: Back, Seunghyeok, et al.
Pubblicazione: (2025)
FLAME: Learning to Navigate with Multimodal LLM in Urban Environments
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
di: Xu, Yunzhe, et al.
Pubblicazione: (2024)
Agentic 3D Scene Generation with Spatially Contextualized VLMs
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
Audio-Agent: Leveraging LLMs For Audio Generation, Editing and Composition
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
di: Wang, Zixuan, et al.
Pubblicazione: (2024)
ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable Diffusion
di: Hu, Zichao, et al.
Pubblicazione: (2025)
di: Hu, Zichao, et al.
Pubblicazione: (2025)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025)
di: Li, Zerui, et al.
Pubblicazione: (2025)
Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
Multi-Agent Dynamic Relational Reasoning for Social Robot Navigation
di: Li, Jiachen, et al.
Pubblicazione: (2024)
di: Li, Jiachen, et al.
Pubblicazione: (2024)
DOZE: A Dataset for Open-Vocabulary Zero-Shot Object Navigation in Dynamic Environments
di: Ma, Ji, et al.
Pubblicazione: (2024)
di: Ma, Ji, et al.
Pubblicazione: (2024)
GarmentPile: Point-Level Visual Affordance Guided Retrieval and Adaptation for Cluttered Garments Manipulation
di: Wu, Ruihai, et al.
Pubblicazione: (2025)
di: Wu, Ruihai, et al.
Pubblicazione: (2025)
Generating Future Observations to Estimate Grasp Success in Cluttered Environments
di: Gomes, Daniel Fernandes, et al.
Pubblicazione: (2023)
di: Gomes, Daniel Fernandes, et al.
Pubblicazione: (2023)
OMEGA: Efficient Occlusion-Aware Navigation for Air-Ground Robot in Dynamic Environments via State Space Model
di: Wang, Junming, et al.
Pubblicazione: (2024)
di: Wang, Junming, et al.
Pubblicazione: (2024)
Human-Aware Vision-and-Language Navigation: Bridging Simulation to Reality with Dynamic Human Interactions
di: Li, Heng, et al.
Pubblicazione: (2024)
di: Li, Heng, et al.
Pubblicazione: (2024)
MPVO: Motion-Prior based Visual Odometry for PointGoal Navigation
di: Paul, Sayan, et al.
Pubblicazione: (2024)
di: Paul, Sayan, et al.
Pubblicazione: (2024)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles
di: Yoo, Seungyeon, et al.
Pubblicazione: (2026)
di: Yoo, Seungyeon, et al.
Pubblicazione: (2026)
SANeRF-HQ: Segment Anything for NeRF in High Quality
di: Liu, Yichen, et al.
Pubblicazione: (2023)
di: Liu, Yichen, et al.
Pubblicazione: (2023)
Flowing from Reasoning to Motion: Learning 3D Hand Trajectory Prediction from Egocentric Human Interaction Videos
di: Chen, Mingfei, et al.
Pubblicazione: (2025)
di: Chen, Mingfei, et al.
Pubblicazione: (2025)
ContraMap: Contrastive Uncertainty Mapping for Robot Environment Representation
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
Language-Conditioned World Modeling for Visual Navigation
di: Dong, Yifei, et al.
Pubblicazione: (2026)
di: Dong, Yifei, et al.
Pubblicazione: (2026)
CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction
di: Kao, Shiu-hong, et al.
Pubblicazione: (2026)
di: Kao, Shiu-hong, et al.
Pubblicazione: (2026)
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
di: Hong, Haodong, et al.
Pubblicazione: (2024)
di: Hong, Haodong, et al.
Pubblicazione: (2024)
Schrödinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation
di: He, Yu, et al.
Pubblicazione: (2025)
di: He, Yu, et al.
Pubblicazione: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation
di: Ao, Yuzhuo, et al.
Pubblicazione: (2026) -
Motion-Agent: A Conversational Framework for Human Motion Generation with LLMs
di: Wu, Qi, et al.
Pubblicazione: (2024) -
WorldCraft: Photo-Realistic 3D World Creation and Customization via LLM Agents
di: Liu, Xinhang, et al.
Pubblicazione: (2025) -
ReelWave: Multi-Agentic Movie Sound Generation through Multimodal LLM Conversation
di: Wang, Zixuan, et al.
Pubblicazione: (2025) -
VP-LLM: Text-Driven 3D Volume Completion with Large Language Models through Patchification
di: Liu, Jianmeng, et al.
Pubblicazione: (2024)