User-Feedback-Driven Adaptation for Vision-and-Language Navigation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Yongqiang, Li, Xuhui, Mahmood, Hazza, Zhou, Jinxing, Hong, Haodong, Jiang, Longtao, Xu, Zhiqiang, Wu, Qi, Chang, Xiaojun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AgriChain Visually Grounded Expert Verified Reasoning for Interpretable Agricultural Vision Language Models
di: Mahmood, Hazza, et al.
Pubblicazione: (2026)
di: Mahmood, Hazza, et al.
Pubblicazione: (2026)
General Scene Adaptation for Vision-and-Language Navigation
di: Hong, Haodong, et al.
Pubblicazione: (2025)
di: Hong, Haodong, et al.
Pubblicazione: (2025)
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025)
di: Li, Zerui, et al.
Pubblicazione: (2025)
Why Only Text: Empowering Vision-and-Language Navigation with Multi-modal Prompts
di: Hong, Haodong, et al.
Pubblicazione: (2024)
di: Hong, Haodong, et al.
Pubblicazione: (2024)
Path-Guided Flow Matching for Dataset Distillation
di: Li, Xuhui, et al.
Pubblicazione: (2026)
di: Li, Xuhui, et al.
Pubblicazione: (2026)
Measuring Social Bias in Vision-Language Models with Face-Only Counterfactuals from Real Photos
di: Chen, Haodong, et al.
Pubblicazione: (2026)
di: Chen, Haodong, et al.
Pubblicazione: (2026)
Self-Consistency as a Free Lunch: Reducing Hallucinations in Vision-Language Models via Self-Reflection
di: Han, Mingfei, et al.
Pubblicazione: (2025)
di: Han, Mingfei, et al.
Pubblicazione: (2025)
Navigating Beyond Instructions: Vision-and-Language Navigation in Obstructed Environments
di: Hong, Haodong, et al.
Pubblicazione: (2024)
di: Hong, Haodong, et al.
Pubblicazione: (2024)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
Vision-Language Navigation with Continual Learning
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
A Vision for AI-Driven Adaptation of Dynamic AR Content to Users and Environments
di: Rasch, Julian, et al.
Pubblicazione: (2025)
di: Rasch, Julian, et al.
Pubblicazione: (2025)
Label-anticipated Event Disentanglement for Audio-Visual Video Parsing
di: Zhou, Jinxing, et al.
Pubblicazione: (2024)
di: Zhou, Jinxing, et al.
Pubblicazione: (2024)
NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
di: Lin, Bingqian, et al.
Pubblicazione: (2024)
LatentPilot: Scene-Aware Vision-and-Language Navigation by Dreaming Ahead with Latent Visual Reasoning
di: Hao, Haihong, et al.
Pubblicazione: (2026)
di: Hao, Haihong, et al.
Pubblicazione: (2026)
Rethinking Theory of Mind Benchmarks for LLMs: Towards A User-Centered Perspective
di: Wang, Qiaosi, et al.
Pubblicazione: (2025)
di: Wang, Qiaosi, et al.
Pubblicazione: (2025)
Mettle: Meta-Token Learning for Memory-Efficient Audio-Visual Adaptation
di: Zhou, Jinxing, et al.
Pubblicazione: (2025)
di: Zhou, Jinxing, et al.
Pubblicazione: (2025)
CMMR-VLN: Vision-and-Language Navigation via Continual Multimodal Memory Retrieval
di: Li, Haozhou, et al.
Pubblicazione: (2026)
di: Li, Haozhou, et al.
Pubblicazione: (2026)
Landmark-Guided Knowledge for Vision-and-Language Navigation
di: Yang, Dongsheng, et al.
Pubblicazione: (2025)
di: Yang, Dongsheng, et al.
Pubblicazione: (2025)
Vision-Language Model Selection and Reuse for Downstream Adaptation
di: Tan, Hao-Zhe, et al.
Pubblicazione: (2025)
di: Tan, Hao-Zhe, et al.
Pubblicazione: (2025)
All-day Multi-scenes Lifelong Vision-and-Language Navigation with Tucker Adaptation
di: Wang, Xudong, et al.
Pubblicazione: (2026)
di: Wang, Xudong, et al.
Pubblicazione: (2026)
Test-Time Adaptation for Tactile-Vision-Language Models
di: Ye, Chuyang, et al.
Pubblicazione: (2026)
di: Ye, Chuyang, et al.
Pubblicazione: (2026)
Feedback-Driven Vision-Language Alignment with Minimal Human Supervision
di: Giannone, Giorgio, et al.
Pubblicazione: (2025)
di: Giannone, Giorgio, et al.
Pubblicazione: (2025)
GeoDM: Geometry-aware Distribution Matching for Dataset Distillation
di: Li, Xuhui, et al.
Pubblicazione: (2025)
di: Li, Xuhui, et al.
Pubblicazione: (2025)
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
di: Li, Jiajie, et al.
Pubblicazione: (2026)
di: Li, Jiajie, et al.
Pubblicazione: (2026)
IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments
di: Liu, Xu, et al.
Pubblicazione: (2025)
di: Liu, Xu, et al.
Pubblicazione: (2025)
MapDream: Task-Driven Map Learning for Vision-Language Navigation
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
di: Lian, Guoxin, et al.
Pubblicazione: (2026)
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
GraspCorrect: Robotic Grasp Correction via Vision-Language Model-Guided Feedback
di: Lee, Sungjae, et al.
Pubblicazione: (2025)
di: Lee, Sungjae, et al.
Pubblicazione: (2025)
GoodPoint: Learning Constructive Scientific Paper Feedback from Author Responses
di: Mun, Jimin, et al.
Pubblicazione: (2026)
di: Mun, Jimin, et al.
Pubblicazione: (2026)
What Limits Vision-and-Language Navigation ?
di: Wang, Yunheng, et al.
Pubblicazione: (2026)
di: Wang, Yunheng, et al.
Pubblicazione: (2026)
Zero-shot Object Navigation with Vision-Language Models Reasoning
di: Wen, Congcong, et al.
Pubblicazione: (2024)
di: Wen, Congcong, et al.
Pubblicazione: (2024)
Routing, Cascades, and User Choice for LLMs
di: Mahmood, Rafid
Pubblicazione: (2026)
di: Mahmood, Rafid
Pubblicazione: (2026)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
di: Yang, Cehao, et al.
Pubblicazione: (2025)
di: Yang, Cehao, et al.
Pubblicazione: (2025)
UniHOI: Unified Human-Object Interaction Understanding via Unified Token Space
di: Yang, Panqi, et al.
Pubblicazione: (2025)
di: Yang, Panqi, et al.
Pubblicazione: (2025)
Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
di: Zhang, Zhen, et al.
Pubblicazione: (2023)
Evolving Prompt Adaptation for Vision-Language Models
di: Zhang, Enming, et al.
Pubblicazione: (2026)
di: Zhang, Enming, et al.
Pubblicazione: (2026)
SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning
di: Han, Zebin, et al.
Pubblicazione: (2026)
di: Han, Zebin, et al.
Pubblicazione: (2026)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
Continual Vision-and-Language Navigation
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
di: Jeong, Seongjun, et al.
Pubblicazione: (2024)
Human-Aware Vision-and-Language Navigation: Bridging Simulation to Reality with Dynamic Human Interactions
di: Li, Heng, et al.
Pubblicazione: (2024)
di: Li, Heng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AgriChain Visually Grounded Expert Verified Reasoning for Interpretable Agricultural Vision Language Models
di: Mahmood, Hazza, et al.
Pubblicazione: (2026) -
General Scene Adaptation for Vision-and-Language Navigation
di: Hong, Haodong, et al.
Pubblicazione: (2025) -
Ground-level Viewpoint Vision-and-Language Navigation in Continuous Environments
di: Li, Zerui, et al.
Pubblicazione: (2025) -
Why Only Text: Empowering Vision-and-Language Navigation with Multi-modal Prompts
di: Hong, Haodong, et al.
Pubblicazione: (2024) -
Path-Guided Flow Matching for Dataset Distillation
di: Li, Xuhui, et al.
Pubblicazione: (2026)