Active Test-time Vision-Language Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ko, Heeju, Kim, Sungjune, Oh, Gyeongrok, Yoon, Jeongyoon, Lee, Honglak, Jang, Sujin, Kim, Seungryong, Kim, Sangpil |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SECOND-Grasp: Semantic Contact-guided Dexterous Grasping
par: Shin, Han Yi, et autres
Publié: (2026)
par: Shin, Han Yi, et autres
Publié: (2026)
3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation
par: Oh, Gyeongrok, et autres
Publié: (2025)
par: Oh, Gyeongrok, et autres
Publié: (2025)
FPANet: Frequency-based Video Demoireing using Frame-level Post Alignment
par: Oh, Gyeongrok, et autres
Publié: (2023)
par: Oh, Gyeongrok, et autres
Publié: (2023)
Verifier-free Test-Time Sampling for Vision Language Action Models
par: Jang, Suhyeok, et autres
Publié: (2025)
par: Jang, Suhyeok, et autres
Publié: (2025)
Semantic Environment Atlas for Object-Goal Navigation
par: Kim, Nuri, et autres
Publié: (2024)
par: Kim, Nuri, et autres
Publié: (2024)
Training-Free Global Geometric Association for 4D LiDAR Panoptic Segmentation
par: Oh, Gyeongrok, et autres
Publié: (2025)
par: Oh, Gyeongrok, et autres
Publié: (2025)
Pri4R: Learning World Dynamics for Vision-Language-Action Models with Privileged 4D Representation
par: Kim, Jisoo, et autres
Publié: (2026)
par: Kim, Jisoo, et autres
Publié: (2026)
E2Map: Experience-and-Emotion Map for Self-Reflective Robot Navigation with Language Models
par: Kim, Chan, et autres
Publié: (2024)
par: Kim, Chan, et autres
Publié: (2024)
GraspCorrect: Robotic Grasp Correction via Vision-Language Model-Guided Feedback
par: Lee, Sungjae, et autres
Publié: (2025)
par: Lee, Sungjae, et autres
Publié: (2025)
Adaptive Capacity Allocation for Vision Language Action Fine-tuning
par: Kim, Donghoon, et autres
Publié: (2026)
par: Kim, Donghoon, et autres
Publié: (2026)
Learning Dexterous Bimanual Catch Skills through Adversarial-Cooperative Heterogeneous-Agent Reinforcement Learning
par: Kim, Taewoo, et autres
Publié: (2025)
par: Kim, Taewoo, et autres
Publié: (2025)
"I am here for you": How relational conversational AI appeals to adolescents, especially those who are socially and emotionally vulnerable
par: Kim, Pilyoung, et autres
Publié: (2025)
par: Kim, Pilyoung, et autres
Publié: (2025)
Stage-Wise Reward Shaping for Acrobatic Robots: A Constrained Multi-Objective Reinforcement Learning Approach
par: Kim, Dohyeong, et autres
Publié: (2024)
par: Kim, Dohyeong, et autres
Publié: (2024)
Communication-Free Collective Navigation for a Swarm of UAVs via LiDAR-Based Deep Reinforcement Learning
par: Choi, Myong-Yol, et autres
Publié: (2026)
par: Choi, Myong-Yol, et autres
Publié: (2026)
Self-Corrective Task Planning by Inverse Prompting with Large Language Models
par: Lee, Jiho, et autres
Publié: (2025)
par: Lee, Jiho, et autres
Publié: (2025)
Transformable Gaussian Reward Function for Socially-Aware Navigation with Deep Reinforcement Learning
par: Kim, Jinyeob, et autres
Publié: (2024)
par: Kim, Jinyeob, et autres
Publié: (2024)
RAPID: Robust and Agile Planner Using Inverse Reinforcement Learning for Vision-Based Drone Navigation
par: Kim, Minwoo, et autres
Publié: (2025)
par: Kim, Minwoo, et autres
Publié: (2025)
SAM: Semi-Active Mechanism for Extensible Continuum Manipulator and Real-time Hysteresis Compensation Control Algorithm
par: Park, Junhyun, et autres
Publié: (2024)
par: Park, Junhyun, et autres
Publié: (2024)
Before We Trust Them: Decision-Making Failures in Navigation of Foundation Models
par: Han, Jua, et autres
Publié: (2026)
par: Han, Jua, et autres
Publié: (2026)
Vision-Language Navigation with Continual Learning
par: Li, Zhiyuan, et autres
Publié: (2024)
par: Li, Zhiyuan, et autres
Publié: (2024)
ASBI: Leveraging Informative Real-World Data for Active Black-Box Simulator Tuning
par: Kim, Gahee, et autres
Publié: (2025)
par: Kim, Gahee, et autres
Publié: (2025)
3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting
par: Zheng, Wancai, et autres
Publié: (2026)
par: Zheng, Wancai, et autres
Publié: (2026)
Explainable Adversarial-Robust Vision-Language-Action Model for Robotic Manipulation
par: Kim, Ju-Young, et autres
Publié: (2025)
par: Kim, Ju-Young, et autres
Publié: (2025)
Vision-Language-Policy Model for Dynamic Robot Task Planning
par: Wang, Jin, et autres
Publié: (2025)
par: Wang, Jin, et autres
Publié: (2025)
Robot-R1: Reinforcement Learning for Enhanced Embodied Reasoning in Robotics
par: Kim, Dongyoung, et autres
Publié: (2025)
par: Kim, Dongyoung, et autres
Publié: (2025)
Belief Aided Navigation using Bayesian Reinforcement Learning for Avoiding Humans in Blind Spots
par: Kim, Jinyeob, et autres
Publié: (2024)
par: Kim, Jinyeob, et autres
Publié: (2024)
RoboCurate: Harnessing Diversity with Action-Verified Neural Trajectory for Robot Learning
par: Kim, Seungku, et autres
Publié: (2026)
par: Kim, Seungku, et autres
Publié: (2026)
Learning Dexterous Grasping from Sparse Taxonomy Guidance
par: Park, Juhan, et autres
Publié: (2026)
par: Park, Juhan, et autres
Publié: (2026)
LaMOuR: Leveraging Language Models for Out-of-Distribution Recovery in Reinforcement Learning
par: Kim, Chan, et autres
Publié: (2025)
par: Kim, Chan, et autres
Publié: (2025)
RDMM: Fine-Tuned LLM Models for On-Device Robotic Decision Making with Enhanced Contextual Awareness in Specific Domains
par: Nasrat, Shady, et autres
Publié: (2025)
par: Nasrat, Shady, et autres
Publié: (2025)
ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles
par: Yoo, Seungyeon, et autres
Publié: (2026)
par: Yoo, Seungyeon, et autres
Publié: (2026)
Accelerating Reinforcement Learning via Error-Related Human Brain Signals
par: Kim, Suzie, et autres
Publié: (2025)
par: Kim, Suzie, et autres
Publié: (2025)
HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation
par: Fan, Chengjie, et autres
Publié: (2026)
par: Fan, Chengjie, et autres
Publié: (2026)
MA3DSG: Multi-Agent 3D Scene Graph Generation for Large-Scale Indoor Environments
par: Kim, Yirum, et autres
Publié: (2026)
par: Kim, Yirum, et autres
Publié: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
par: Wen, Congcong, et autres
Publié: (2024)
par: Wen, Congcong, et autres
Publié: (2024)
Dialogue Possibilities between a Human Supervisor and UAM Air Traffic Management: Route Alteration
par: Kim, Jeongseok, et autres
Publié: (2023)
par: Kim, Jeongseok, et autres
Publié: (2023)
ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation
par: Zhang, Zekai, et autres
Publié: (2025)
par: Zhang, Zekai, et autres
Publié: (2025)
SynAD: Enhancing Real-World End-to-End Autonomous Driving Models through Synthetic Data Integration
par: Kim, Jongsuk, et autres
Publié: (2025)
par: Kim, Jongsuk, et autres
Publié: (2025)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
par: Zhang, Zhen, et autres
Publié: (2023)
par: Zhang, Zhen, et autres
Publié: (2023)
Endowing Embodied Agents with Spatial Reasoning Capabilities for Vision-and-Language Navigation
par: Bai, Qianqian, et autres
Publié: (2025)
par: Bai, Qianqian, et autres
Publié: (2025)
Documents similaires
-
SECOND-Grasp: Semantic Contact-guided Dexterous Grasping
par: Shin, Han Yi, et autres
Publié: (2026) -
3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation
par: Oh, Gyeongrok, et autres
Publié: (2025) -
FPANet: Frequency-based Video Demoireing using Frame-level Post Alignment
par: Oh, Gyeongrok, et autres
Publié: (2023) -
Verifier-free Test-Time Sampling for Vision Language Action Models
par: Jang, Suhyeok, et autres
Publié: (2025) -
Semantic Environment Atlas for Object-Goal Navigation
par: Kim, Nuri, et autres
Publié: (2024)