Scene Exploration by Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sripada, Venkatesh, Carter, Samuel, Guerin, Frank, Ghalamzan, Amir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Zero-shot Interactive Perception
di: Sripada, Venkatesh, et al.
Pubblicazione: (2026)
di: Sripada, Venkatesh, et al.
Pubblicazione: (2026)
HARMONI: Haptic-Guided Assistance for Unified Robotic Tele-Manipulation and Tele-Navigation
di: Sripada, V., et al.
Pubblicazione: (2025)
di: Sripada, V., et al.
Pubblicazione: (2025)
Multi-Modal World Model for Physical Robot Interactions: Simultaneous Visual and Tactile Predictions for Enhanced Accuracy
di: Mandil, Willow, et al.
Pubblicazione: (2023)
di: Mandil, Willow, et al.
Pubblicazione: (2023)
Enabling Tactile Feedback for Robotic Strawberry Handling using AST Skin
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024)
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024)
Single and bi-layered 2-D acoustic soft tactile skin (AST2)
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024)
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024)
Acoustic Soft Tactile Skin (AST Skin)
di: S, Vishnu Rajendran, et al.
Pubblicazione: (2023)
di: S, Vishnu Rajendran, et al.
Pubblicazione: (2023)
Peduncle Gripping and Cutting Force for Strawberry Harvesting Robotic End-effector Design
di: S, Vishnu Rajendran, et al.
Pubblicazione: (2022)
di: S, Vishnu Rajendran, et al.
Pubblicazione: (2022)
Action Conditioned Tactile Prediction: case study on slip prediction
di: Mandil, Willow, et al.
Pubblicazione: (2022)
di: Mandil, Willow, et al.
Pubblicazione: (2022)
Walking, Rolling, and Beyond: First-Principles and RL Locomotion on a TARS-Inspired Robot
di: Sripada, Aditya, et al.
Pubblicazione: (2025)
di: Sripada, Aditya, et al.
Pubblicazione: (2025)
Soft Acoustic Curvature Sensor: Design and Development
di: Sofla, Mohammad Sheikh, et al.
Pubblicazione: (2024)
di: Sofla, Mohammad Sheikh, et al.
Pubblicazione: (2024)
HELIOS: Hierarchical Exploration for Language-Grounded Interaction in Open Scenes
di: Ashton, Katrina, et al.
Pubblicazione: (2025)
di: Ashton, Katrina, et al.
Pubblicazione: (2025)
ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
di: Zhao, Xinxin, et al.
Pubblicazione: (2024)
di: Zhao, Xinxin, et al.
Pubblicazione: (2024)
ImagineNav++: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination
di: Wang, Teng, et al.
Pubblicazione: (2025)
di: Wang, Teng, et al.
Pubblicazione: (2025)
ExploreVLM: Closed-Loop Robot Exploration Task Planning with Vision-Language Models
di: Lou, Zhichen, et al.
Pubblicazione: (2025)
di: Lou, Zhichen, et al.
Pubblicazione: (2025)
Embodied Scene Understanding for Vision Language Models via MetaVQA
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
ZeroCAP: Zero-Shot Multi-Robot Context Aware Pattern Formation via Large Language Models
di: Venkatesh, Vishnunandan L. N., et al.
Pubblicazione: (2024)
di: Venkatesh, Vishnunandan L. N., et al.
Pubblicazione: (2024)
VL-Explore: Zero-shot Vision-Language Exploration and Target Discovery by Mobile Robots
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
Utilizing Inpainting for Keypoint Detection for Vision-Based Control of Robotic Manipulators
di: Chatterjee, Sreejani, et al.
Pubblicazione: (2026)
di: Chatterjee, Sreejani, et al.
Pubblicazione: (2026)
HELM: Human-Preferred Exploration with Language Models
di: Liao, Shuhao, et al.
Pubblicazione: (2025)
di: Liao, Shuhao, et al.
Pubblicazione: (2025)
Steering Vision-Language-Action Models as Anti-Exploration: A Test-Time Scaling Approach
di: Yang, Siyuan, et al.
Pubblicazione: (2025)
di: Yang, Siyuan, et al.
Pubblicazione: (2025)
Vision-Language Models for Infrared Industrial Sensing in Additive Manufacturing Scene Description
di: Mahjourian, Nazanin, et al.
Pubblicazione: (2025)
di: Mahjourian, Nazanin, et al.
Pubblicazione: (2025)
VLM-Social-Nav: Socially Aware Robot Navigation through Scoring using Vision-Language Models
di: Song, Daeun, et al.
Pubblicazione: (2024)
di: Song, Daeun, et al.
Pubblicazione: (2024)
Autonomous Implicit Indoor Scene Reconstruction with Frontier Exploration
di: Zeng, Jing, et al.
Pubblicazione: (2024)
di: Zeng, Jing, et al.
Pubblicazione: (2024)
A Deployable Embodied Vision-Language Navigation System with Hierarchical Cognition and Context-Aware Exploration
di: Xu, Kuan, et al.
Pubblicazione: (2026)
di: Xu, Kuan, et al.
Pubblicazione: (2026)
Integrated Exploration and Sequential Manipulation on Scene Graph with LLM-based Situated Replanning
di: Yang, Heqing, et al.
Pubblicazione: (2026)
di: Yang, Heqing, et al.
Pubblicazione: (2026)
LCLA: Language-Conditioned Latent Alignment for Vision-Language Navigation
di: Subedi, Nitesh, et al.
Pubblicazione: (2026)
di: Subedi, Nitesh, et al.
Pubblicazione: (2026)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
Optimising robotic operation speed with edge computing over 5G networks: Insights from selective harvesting robots
di: Zahidi, Usman A., et al.
Pubblicazione: (2024)
di: Zahidi, Usman A., et al.
Pubblicazione: (2024)
Enhancing Vision-Language Models with Scene Graphs for Traffic Accident Understanding
di: Lohner, Aaron, et al.
Pubblicazione: (2024)
di: Lohner, Aaron, et al.
Pubblicazione: (2024)
FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
di: Zhou, Xiaolin, et al.
Pubblicazione: (2025)
Toward Accurate Long-Horizon Robotic Manipulation: Language-to-Action with Foundation Models via Scene Graphs
di: Dinesh, Sushil Samuel, et al.
Pubblicazione: (2025)
di: Dinesh, Sushil Samuel, et al.
Pubblicazione: (2025)
COMRES-VLM: Coordinated Multi-Robot Exploration and Search using Vision Language Models
di: Wang, Ruiyang, et al.
Pubblicazione: (2025)
di: Wang, Ruiyang, et al.
Pubblicazione: (2025)
Causal Scene Narration with Runtime Safety Supervision for Vision-Language-Action Driving
di: Li, Yun, et al.
Pubblicazione: (2026)
di: Li, Yun, et al.
Pubblicazione: (2026)
SMART-LLM: Smart Multi-Agent Robot Task Planning using Large Language Models
di: Kannan, Shyam Sundar, et al.
Pubblicazione: (2023)
di: Kannan, Shyam Sundar, et al.
Pubblicazione: (2023)
Optimal Scene Graph Planning with Large Language Model Guidance
di: Dai, Zhirui, et al.
Pubblicazione: (2023)
di: Dai, Zhirui, et al.
Pubblicazione: (2023)
Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language Models
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
di: Lee, Seungjae, et al.
Pubblicazione: (2025)
PRISM: Preference Refinement via Implicit Scene Modeling for 3D Vision-Language Preference-Based Reinforcement Learning
di: Sun, Yirong, et al.
Pubblicazione: (2025)
di: Sun, Yirong, et al.
Pubblicazione: (2025)
Gaussian Process-Based Active Exploration Strategies in Vision and Touch
di: Choi, Ho Jin, et al.
Pubblicazione: (2025)
di: Choi, Ho Jin, et al.
Pubblicazione: (2025)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
ExploRLLM: Guiding Exploration in Reinforcement Learning with Large Language Models
di: Ma, Runyu, et al.
Pubblicazione: (2024)
di: Ma, Runyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Zero-shot Interactive Perception
di: Sripada, Venkatesh, et al.
Pubblicazione: (2026) -
HARMONI: Haptic-Guided Assistance for Unified Robotic Tele-Manipulation and Tele-Navigation
di: Sripada, V., et al.
Pubblicazione: (2025) -
Multi-Modal World Model for Physical Robot Interactions: Simultaneous Visual and Tactile Predictions for Enhanced Accuracy
di: Mandil, Willow, et al.
Pubblicazione: (2023) -
Enabling Tactile Feedback for Robotic Strawberry Handling using AST Skin
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024) -
Single and bi-layered 2-D acoustic soft tactile skin (AST2)
di: Rajendran, Vishnu, et al.
Pubblicazione: (2024)