Towards Deviation-Robust Agent Navigation via Perturbation-Aware Contrastive Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Bingqian, Long, Yanxin, Zhu, Yi, Zhu, Fengda, Liang, Xiaodan, Ye, Qixiang, Lin, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Actional Atomic-Concept Learning for Demystifying Vision-Language Navigation
di: Lin, Bingqian, et al.
Pubblicazione: (2023)
di: Lin, Bingqian, et al.
Pubblicazione: (2023)
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation
di: Zhang, Kaidong, et al.
Pubblicazione: (2024)
di: Zhang, Kaidong, et al.
Pubblicazione: (2024)
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
di: Wei, Ziming, et al.
Pubblicazione: (2025)
di: Wei, Ziming, et al.
Pubblicazione: (2025)
VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation
di: Wen, Youpeng, et al.
Pubblicazione: (2024)
di: Wen, Youpeng, et al.
Pubblicazione: (2024)
Surfer: Progressive Reasoning with World Models for Robotic Manipulation
di: Ren, Pengzhen, et al.
Pubblicazione: (2023)
di: Ren, Pengzhen, et al.
Pubblicazione: (2023)
PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly
di: Ma, Liang, et al.
Pubblicazione: (2025)
di: Ma, Liang, et al.
Pubblicazione: (2025)
RoomTour3D: Geometry-Aware Video-Instruction Tuning for Embodied Navigation
di: Han, Mingfei, et al.
Pubblicazione: (2024)
di: Han, Mingfei, et al.
Pubblicazione: (2024)
Bootstrap Dynamic-Aware 3D Visual Representation for Scalable Robot Learning
di: Liang, Qiwei, et al.
Pubblicazione: (2025)
di: Liang, Qiwei, et al.
Pubblicazione: (2025)
Implicit Geometry Representations for Vision-and-Language Navigation from Web Videos
di: Han, Mingfei, et al.
Pubblicazione: (2026)
di: Han, Mingfei, et al.
Pubblicazione: (2026)
Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments
di: Li, Haoyuan, et al.
Pubblicazione: (2026)
di: Li, Haoyuan, et al.
Pubblicazione: (2026)
Correctable Landmark Discovery via Large Models for Vision-Language Navigation
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
Uncovering Linguistic Fragility in Vision-Language-Action Models via Diversity-Aware Red Teaming
di: Tong, Baoshun, et al.
Pubblicazione: (2026)
di: Tong, Baoshun, et al.
Pubblicazione: (2026)
Robust Subpixel Localization of Diagonal Markers in Large-Scale Navigation via Multi-Layer Screening and Adaptive Matching
di: Tao, Jing, et al.
Pubblicazione: (2026)
di: Tao, Jing, et al.
Pubblicazione: (2026)
RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation
di: Zhang, Kaidong, et al.
Pubblicazione: (2025)
di: Zhang, Kaidong, et al.
Pubblicazione: (2025)
Your Vision-Language-Action Model Already Has Attention Heads For Path Deviation Detection
di: Jeong, Jaehwan, et al.
Pubblicazione: (2026)
di: Jeong, Jaehwan, et al.
Pubblicazione: (2026)
EgoTraj-Bench: Towards Robust Trajectory Prediction Under Ego-view Noisy Observations
di: Liu, Jiayi, et al.
Pubblicazione: (2025)
di: Liu, Jiayi, et al.
Pubblicazione: (2025)
UniDWM: Towards a Unified Driving World Model via Multifaceted Representation Learning
di: Liu, Shuai, et al.
Pubblicazione: (2026)
di: Liu, Shuai, et al.
Pubblicazione: (2026)
Splatblox: Traversability-Aware Gaussian Splatting for Outdoor Robot Navigation
di: Chopra, Samarth, et al.
Pubblicazione: (2025)
di: Chopra, Samarth, et al.
Pubblicazione: (2025)
MCRL4OR: Multimodal Contrastive Representation Learning for Off-Road Environmental Perception
di: Yang, Yi, et al.
Pubblicazione: (2025)
di: Yang, Yi, et al.
Pubblicazione: (2025)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
di: Chen, Kehan, et al.
Pubblicazione: (2024)
di: Chen, Kehan, et al.
Pubblicazione: (2024)
Referring-Aware Visuomotor Policy Learning for Closed-Loop Manipulation
di: Ma, Jiahua, et al.
Pubblicazione: (2026)
di: Ma, Jiahua, et al.
Pubblicazione: (2026)
AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots
di: Zhang, Likui, et al.
Pubblicazione: (2026)
di: Zhang, Likui, et al.
Pubblicazione: (2026)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
di: Bai, Long, et al.
Pubblicazione: (2024)
di: Bai, Long, et al.
Pubblicazione: (2024)
Contrastive Imitation Learning for Language-guided Multi-Task Robotic Manipulation
di: Ma, Teli, et al.
Pubblicazione: (2024)
di: Ma, Teli, et al.
Pubblicazione: (2024)
Collision-Aware Object-Goal Visual Navigation via Two-Stage Deep Reinforcement Learning
di: Wang, Hongwu, et al.
Pubblicazione: (2025)
di: Wang, Hongwu, et al.
Pubblicazione: (2025)
Self-supervised Learning of Event-guided Video Frame Interpolation for Rolling Shutter Frames
di: Lu, Yunfan, et al.
Pubblicazione: (2023)
di: Lu, Yunfan, et al.
Pubblicazione: (2023)
Pixel-wise Smoothing for Certified Robustness against Camera Motion Perturbations
di: Hu, Hanjiang, et al.
Pubblicazione: (2023)
di: Hu, Hanjiang, et al.
Pubblicazione: (2023)
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
di: Bai, Yongjie, et al.
Pubblicazione: (2025)
di: Bai, Yongjie, et al.
Pubblicazione: (2025)
VR-Robo: A Real-to-Sim-to-Real Framework for Visual Robot Navigation and Locomotion
di: Zhu, Shaoting, et al.
Pubblicazione: (2025)
di: Zhu, Shaoting, et al.
Pubblicazione: (2025)
DC-VLAQ: Query-Residual Aggregation for Robust Visual Place Recognition
di: Zhu, Hanyu, et al.
Pubblicazione: (2026)
di: Zhu, Hanyu, et al.
Pubblicazione: (2026)
Learning to Tune Like an Expert: Interpretable and Scene-Aware Navigation via MLLM Reasoning and CVAE-Based Adaptation
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
CDP: Towards Robust Autoregressive Visuomotor Policy Learning via Causal Diffusion
di: Ma, Jiahua, et al.
Pubblicazione: (2025)
di: Ma, Jiahua, et al.
Pubblicazione: (2025)
ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
MISCGrasp: Leveraging Multiple Integrated Scales and Contrastive Learning for Enhanced Volumetric Grasping
di: Fan, Qingyu, et al.
Pubblicazione: (2025)
di: Fan, Qingyu, et al.
Pubblicazione: (2025)
UncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty
di: Yang, Pengxuan, et al.
Pubblicazione: (2025)
di: Yang, Pengxuan, et al.
Pubblicazione: (2025)
RoboPearls: Editable Video Simulation for Robot Manipulation
di: Tang, Tao, et al.
Pubblicazione: (2025)
di: Tang, Tao, et al.
Pubblicazione: (2025)
Toward Efficient and Robust Behavior Models for Multi-Agent Driving Simulation
di: Konstantinidis, Fabian, et al.
Pubblicazione: (2025)
di: Konstantinidis, Fabian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Actional Atomic-Concept Learning for Demystifying Vision-Language Navigation
di: Lin, Bingqian, et al.
Pubblicazione: (2023) -
MapGPT: Map-Guided Prompting with Adaptive Path Planning for Vision-and-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024) -
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2024) -
PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation
di: Zhang, Kaidong, et al.
Pubblicazione: (2024) -
Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation
di: Wei, Ziming, et al.
Pubblicazione: (2025)