Active Test-time Vision-Language Navigation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ko, Heeju, Kim, Sungjune, Oh, Gyeongrok, Yoon, Jeongyoon, Lee, Honglak, Jang, Sujin, Kim, Seungryong, Kim, Sangpil |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SECOND-Grasp: Semantic Contact-guided Dexterous Grasping
von: Shin, Han Yi, et al.
Veröffentlicht: (2026)
von: Shin, Han Yi, et al.
Veröffentlicht: (2026)
3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2025)
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2025)
FPANet: Frequency-based Video Demoireing using Frame-level Post Alignment
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2023)
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2023)
Verifier-free Test-Time Sampling for Vision Language Action Models
von: Jang, Suhyeok, et al.
Veröffentlicht: (2025)
von: Jang, Suhyeok, et al.
Veröffentlicht: (2025)
Semantic Environment Atlas for Object-Goal Navigation
von: Kim, Nuri, et al.
Veröffentlicht: (2024)
von: Kim, Nuri, et al.
Veröffentlicht: (2024)
Training-Free Global Geometric Association for 4D LiDAR Panoptic Segmentation
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2025)
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2025)
Pri4R: Learning World Dynamics for Vision-Language-Action Models with Privileged 4D Representation
von: Kim, Jisoo, et al.
Veröffentlicht: (2026)
von: Kim, Jisoo, et al.
Veröffentlicht: (2026)
E2Map: Experience-and-Emotion Map for Self-Reflective Robot Navigation with Language Models
von: Kim, Chan, et al.
Veröffentlicht: (2024)
von: Kim, Chan, et al.
Veröffentlicht: (2024)
GraspCorrect: Robotic Grasp Correction via Vision-Language Model-Guided Feedback
von: Lee, Sungjae, et al.
Veröffentlicht: (2025)
von: Lee, Sungjae, et al.
Veröffentlicht: (2025)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
von: Kim, Donghoon, et al.
Veröffentlicht: (2026)
von: Kim, Donghoon, et al.
Veröffentlicht: (2026)
Learning Dexterous Bimanual Catch Skills through Adversarial-Cooperative Heterogeneous-Agent Reinforcement Learning
von: Kim, Taewoo, et al.
Veröffentlicht: (2025)
von: Kim, Taewoo, et al.
Veröffentlicht: (2025)
"I am here for you": How relational conversational AI appeals to adolescents, especially those who are socially and emotionally vulnerable
von: Kim, Pilyoung, et al.
Veröffentlicht: (2025)
von: Kim, Pilyoung, et al.
Veröffentlicht: (2025)
Stage-Wise Reward Shaping for Acrobatic Robots: A Constrained Multi-Objective Reinforcement Learning Approach
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
Communication-Free Collective Navigation for a Swarm of UAVs via LiDAR-Based Deep Reinforcement Learning
von: Choi, Myong-Yol, et al.
Veröffentlicht: (2026)
von: Choi, Myong-Yol, et al.
Veröffentlicht: (2026)
Self-Corrective Task Planning by Inverse Prompting with Large Language Models
von: Lee, Jiho, et al.
Veröffentlicht: (2025)
von: Lee, Jiho, et al.
Veröffentlicht: (2025)
Transformable Gaussian Reward Function for Socially-Aware Navigation with Deep Reinforcement Learning
von: Kim, Jinyeob, et al.
Veröffentlicht: (2024)
von: Kim, Jinyeob, et al.
Veröffentlicht: (2024)
RAPID: Robust and Agile Planner Using Inverse Reinforcement Learning for Vision-Based Drone Navigation
von: Kim, Minwoo, et al.
Veröffentlicht: (2025)
von: Kim, Minwoo, et al.
Veröffentlicht: (2025)
SAM: Semi-Active Mechanism for Extensible Continuum Manipulator and Real-time Hysteresis Compensation Control Algorithm
von: Park, Junhyun, et al.
Veröffentlicht: (2024)
von: Park, Junhyun, et al.
Veröffentlicht: (2024)
Before We Trust Them: Decision-Making Failures in Navigation of Foundation Models
von: Han, Jua, et al.
Veröffentlicht: (2026)
von: Han, Jua, et al.
Veröffentlicht: (2026)
Vision-Language Navigation with Continual Learning
von: Li, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Li, Zhiyuan, et al.
Veröffentlicht: (2024)
ASBI: Leveraging Informative Real-World Data for Active Black-Box Simulator Tuning
von: Kim, Gahee, et al.
Veröffentlicht: (2025)
von: Kim, Gahee, et al.
Veröffentlicht: (2025)
3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting
von: Zheng, Wancai, et al.
Veröffentlicht: (2026)
von: Zheng, Wancai, et al.
Veröffentlicht: (2026)
Explainable Adversarial-Robust Vision-Language-Action Model for Robotic Manipulation
von: Kim, Ju-Young, et al.
Veröffentlicht: (2025)
von: Kim, Ju-Young, et al.
Veröffentlicht: (2025)
Vision-Language-Policy Model for Dynamic Robot Task Planning
von: Wang, Jin, et al.
Veröffentlicht: (2025)
von: Wang, Jin, et al.
Veröffentlicht: (2025)
Robot-R1: Reinforcement Learning for Enhanced Embodied Reasoning in Robotics
von: Kim, Dongyoung, et al.
Veröffentlicht: (2025)
von: Kim, Dongyoung, et al.
Veröffentlicht: (2025)
Belief Aided Navigation using Bayesian Reinforcement Learning for Avoiding Humans in Blind Spots
von: Kim, Jinyeob, et al.
Veröffentlicht: (2024)
von: Kim, Jinyeob, et al.
Veröffentlicht: (2024)
RoboCurate: Harnessing Diversity with Action-Verified Neural Trajectory for Robot Learning
von: Kim, Seungku, et al.
Veröffentlicht: (2026)
von: Kim, Seungku, et al.
Veröffentlicht: (2026)
Learning Dexterous Grasping from Sparse Taxonomy Guidance
von: Park, Juhan, et al.
Veröffentlicht: (2026)
von: Park, Juhan, et al.
Veröffentlicht: (2026)
LaMOuR: Leveraging Language Models for Out-of-Distribution Recovery in Reinforcement Learning
von: Kim, Chan, et al.
Veröffentlicht: (2025)
von: Kim, Chan, et al.
Veröffentlicht: (2025)
RDMM: Fine-Tuned LLM Models for On-Device Robotic Decision Making with Enhanced Contextual Awareness in Specific Domains
von: Nasrat, Shady, et al.
Veröffentlicht: (2025)
von: Nasrat, Shady, et al.
Veröffentlicht: (2025)
ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles
von: Yoo, Seungyeon, et al.
Veröffentlicht: (2026)
von: Yoo, Seungyeon, et al.
Veröffentlicht: (2026)
Accelerating Reinforcement Learning via Error-Related Human Brain Signals
von: Kim, Suzie, et al.
Veröffentlicht: (2025)
von: Kim, Suzie, et al.
Veröffentlicht: (2025)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
von: Fan, Chengjie, et al.
Veröffentlicht: (2026)
von: Fan, Chengjie, et al.
Veröffentlicht: (2026)
MA3DSG: Multi-Agent 3D Scene Graph Generation for Large-Scale Indoor Environments
von: Kim, Yirum, et al.
Veröffentlicht: (2026)
von: Kim, Yirum, et al.
Veröffentlicht: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
von: Wen, Congcong, et al.
Veröffentlicht: (2024)
von: Wen, Congcong, et al.
Veröffentlicht: (2024)
Dialogue Possibilities between a Human Supervisor and UAM Air Traffic Management: Route Alteration
von: Kim, Jeongseok, et al.
Veröffentlicht: (2023)
von: Kim, Jeongseok, et al.
Veröffentlicht: (2023)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
von: Zhang, Zekai, et al.
Veröffentlicht: (2025)
von: Zhang, Zekai, et al.
Veröffentlicht: (2025)
SynAD: Enhancing Real-World End-to-End Autonomous Driving Models through Synthetic Data Integration
von: Kim, Jongsuk, et al.
Veröffentlicht: (2025)
von: Kim, Jongsuk, et al.
Veröffentlicht: (2025)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
von: Zhang, Zhen, et al.
Veröffentlicht: (2023)
von: Zhang, Zhen, et al.
Veröffentlicht: (2023)
Endowing Embodied Agents with Spatial Reasoning Capabilities for Vision-and-Language Navigation
von: Bai, Qianqian, et al.
Veröffentlicht: (2025)
von: Bai, Qianqian, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SECOND-Grasp: Semantic Contact-guided Dexterous Grasping
von: Shin, Han Yi, et al.
Veröffentlicht: (2026) -
3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2025) -
FPANet: Frequency-based Video Demoireing using Frame-level Post Alignment
von: Oh, Gyeongrok, et al.
Veröffentlicht: (2023) -
Verifier-free Test-Time Sampling for Vision Language Action Models
von: Jang, Suhyeok, et al.
Veröffentlicht: (2025) -
Semantic Environment Atlas for Object-Goal Navigation
von: Kim, Nuri, et al.
Veröffentlicht: (2024)