LCGNav: Local Candidate-Aware Geometric Enhancement for General Topological Planning in Vision-Language Navigation
Fuente:
arXiv
Guardado en:
| Autores principales: | Peng, Jiankun, Guo, Jianyuan, Yang, Yiguang, Liu, Yue, Yan, Jiashuang, Xu, Ying |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
por: Peng, Jiankun, et al.
Publicado: (2026)
por: Peng, Jiankun, et al.
Publicado: (2026)
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
por: Gao, Jianzhe, et al.
Publicado: (2026)
por: Gao, Jianzhe, et al.
Publicado: (2026)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
por: An, Dong, et al.
Publicado: (2023)
por: An, Dong, et al.
Publicado: (2023)
Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation
por: Gu, Shutian, et al.
Publicado: (2026)
por: Gu, Shutian, et al.
Publicado: (2026)
World-Consistent Data Generation for Vision-and-Language Navigation
por: Zhong, Yu, et al.
Publicado: (2024)
por: Zhong, Yu, et al.
Publicado: (2024)
Vision Superalignment: Weak-to-Strong Generalization for Vision Foundation Models
por: Guo, Jianyuan, et al.
Publicado: (2024)
por: Guo, Jianyuan, et al.
Publicado: (2024)
Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation
por: Guo, Jianyuan, et al.
Publicado: (2025)
por: Guo, Jianyuan, et al.
Publicado: (2025)
TagaVLM: Topology-Aware Global Action Reasoning for Vision-Language Navigation
por: Liu, Jiaxing, et al.
Publicado: (2026)
por: Liu, Jiaxing, et al.
Publicado: (2026)
DOPE: Dual Object Perception-Enhancement Network for Vision-and-Language Navigation
por: Yu, Yinfeng, et al.
Publicado: (2025)
por: Yu, Yinfeng, et al.
Publicado: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
por: Guo, Wenxuan, et al.
Publicado: (2026)
por: Guo, Wenxuan, et al.
Publicado: (2026)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
por: Li, Junjie, et al.
Publicado: (2025)
por: Li, Junjie, et al.
Publicado: (2025)
Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments
por: Chen, Kehan, et al.
Publicado: (2024)
por: Chen, Kehan, et al.
Publicado: (2024)
Loc4Plan: Locating Before Planning for Outdoor Vision and Language Navigation
por: Tian, Huilin, et al.
Publicado: (2024)
por: Tian, Huilin, et al.
Publicado: (2024)
Geometric-Aware Low-Light Image and Video Enhancement via Depth Guidance
por: Lin, Yingqi, et al.
Publicado: (2023)
por: Lin, Yingqi, et al.
Publicado: (2023)
Degradation-Aware Image Enhancement via Vision-Language Classification
por: Cai, Jie, et al.
Publicado: (2025)
por: Cai, Jie, et al.
Publicado: (2025)
Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models
por: Guo, Boyang, et al.
Publicado: (2026)
por: Guo, Boyang, et al.
Publicado: (2026)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
por: Ning, Yuwei, et al.
Publicado: (2026)
por: Ning, Yuwei, et al.
Publicado: (2026)
Topology-Aware Layer Pruning for Large Vision-Language Models
por: Zheng, Pengcheng, et al.
Publicado: (2026)
por: Zheng, Pengcheng, et al.
Publicado: (2026)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
por: Wang, Liuyi, et al.
Publicado: (2023)
por: Wang, Liuyi, et al.
Publicado: (2023)
Egocentric Vision Language Planning
por: Fang, Zhirui, et al.
Publicado: (2024)
por: Fang, Zhirui, et al.
Publicado: (2024)
PRET: Planning with Directed Fidelity Trajectory for Vision and Language Navigation
por: Lu, Renjie, et al.
Publicado: (2024)
por: Lu, Renjie, et al.
Publicado: (2024)
ADEM-VL: Adaptive and Embedded Fusion for Efficient Vision-Language Tuning
por: Hao, Zhiwei, et al.
Publicado: (2024)
por: Hao, Zhiwei, et al.
Publicado: (2024)
DAP: Domain-aware Prompt Learning for Vision-and-Language Navigation
por: Liu, Ting, et al.
Publicado: (2023)
por: Liu, Ting, et al.
Publicado: (2023)
GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation
por: Yang, Jiahao, et al.
Publicado: (2026)
por: Yang, Jiahao, et al.
Publicado: (2026)
MambaLLIE: Implicit Retinex-Aware Low Light Enhancement with Global-then-Local State Space
por: Weng, Jiangwei, et al.
Publicado: (2024)
por: Weng, Jiangwei, et al.
Publicado: (2024)
PA-Attack: Guiding Gray-Box Attacks on LVLM Vision Encoders with Prototypes and Attention
por: Mei, Hefei, et al.
Publicado: (2026)
por: Mei, Hefei, et al.
Publicado: (2026)
Seeing Space and Motion: Enhancing Latent Actions with Geometric and Dynamic Awareness for Vision-Language-Action Models
por: Cai, Zhejia, et al.
Publicado: (2025)
por: Cai, Zhejia, et al.
Publicado: (2025)
Online Topological Localization for Navigation Assistance in Bronchoscopy
por: Tomasini, Clara, et al.
Publicado: (2025)
por: Tomasini, Clara, et al.
Publicado: (2025)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
por: Pan, Yiyuan, et al.
Publicado: (2024)
por: Pan, Yiyuan, et al.
Publicado: (2024)
Structured Observation Language for Efficient and Generalizable Vision-Language Navigation
por: Peng, Daojie, et al.
Publicado: (2026)
por: Peng, Daojie, et al.
Publicado: (2026)
NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation
por: Zhang, Jiazhao, et al.
Publicado: (2024)
por: Zhang, Jiazhao, et al.
Publicado: (2024)
Adversarial Error Correction for Visual Autoregressive Generation
por: Bi, Ligong, et al.
Publicado: (2026)
por: Bi, Ligong, et al.
Publicado: (2026)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
por: Liang, Xiwen, et al.
Publicado: (2023)
por: Liang, Xiwen, et al.
Publicado: (2023)
PlatonicNav: Unveiling Semantic Correspondence in Navigation with Platonic Topological Maps
por: Long, Junlin, et al.
Publicado: (2026)
por: Long, Junlin, et al.
Publicado: (2026)
Hierarchical Spatial Proximity Reasoning for Vision-and-Language Navigation
por: Xu, Ming, et al.
Publicado: (2024)
por: Xu, Ming, et al.
Publicado: (2024)
Volumetric Environment Representation for Vision-Language Navigation
por: Liu, Rui, et al.
Publicado: (2024)
por: Liu, Rui, et al.
Publicado: (2024)
Vision-Language Navigation with Energy-Based Policy
por: Liu, Rui, et al.
Publicado: (2024)
por: Liu, Rui, et al.
Publicado: (2024)
PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation for Vision-and-Language Navigation
por: Wang, Sen, et al.
Publicado: (2025)
por: Wang, Sen, et al.
Publicado: (2025)
Evaluation and Enhancement of Semantic Grounding in Large Vision-Language Models
por: Lu, Jiaying, et al.
Publicado: (2023)
por: Lu, Jiaying, et al.
Publicado: (2023)
Accelerating Globally Optimal Consensus Maximization in Geometric Vision
por: Zhang, Xinyue, et al.
Publicado: (2023)
por: Zhang, Xinyue, et al.
Publicado: (2023)
Ejemplares similares
-
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
por: Peng, Jiankun, et al.
Publicado: (2026) -
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
por: Gao, Jianzhe, et al.
Publicado: (2026) -
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
por: An, Dong, et al.
Publicado: (2023) -
Learning to Retrieve Navigable Candidates for Efficient Vision-and-Language Navigation
por: Gu, Shutian, et al.
Publicado: (2026) -
World-Consistent Data Generation for Vision-and-Language Navigation
por: Zhong, Yu, et al.
Publicado: (2024)