Urban Risk-Aware Navigation via VQA-Based Event Maps for People with Low Vision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Valls, Antoni, Sanchez-Riera, Jordi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
par: Gao, Jianzhe, et autres
Publié: (2026)
par: Gao, Jianzhe, et autres
Publié: (2026)
Vision-Based Autonomous UAV Navigation and Landing for Urban Search and Rescue
par: Mittal, Mayank, et autres
Publié: (2019)
par: Mittal, Mayank, et autres
Publié: (2019)
Vision-Based Risk Aware Emergency Landing for UAVs in Complex Urban Environments
par: de la Torre-Vanegas, Julio, et autres
Publié: (2025)
par: de la Torre-Vanegas, Julio, et autres
Publié: (2025)
Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
Empowering Dynamic Urban Navigation with Stereo and Mid-Level Vision
par: Zhou, Wentao, et autres
Publié: (2025)
par: Zhou, Wentao, et autres
Publié: (2025)
Ask4VG: Risk-Aware Question Selection for Reducing Prior-Driven Answers in Medical VQA
par: Zhu, Xiaorong, et autres
Publié: (2026)
par: Zhu, Xiaorong, et autres
Publié: (2026)
Embodied Scene Understanding for Vision Language Models via MetaVQA
par: Wang, Weizhen, et autres
Publié: (2025)
par: Wang, Weizhen, et autres
Publié: (2025)
Verification Mirage: Mapping the Reliability Boundary of Self-Verification in Medical VQA
par: Jin, Ruinan, et autres
Publié: (2026)
par: Jin, Ruinan, et autres
Publié: (2026)
Uncertainty-Aware Vision-based Risk Object Identification via Conformal Risk Tube Prediction
par: Fu, Kai-Yu, et autres
Publié: (2026)
par: Fu, Kai-Yu, et autres
Publié: (2026)
VTAgent: Agentic Keyframe Anchoring for Evidence-Aware Video TextVQA
par: He, Haibin, et autres
Publié: (2026)
par: He, Haibin, et autres
Publié: (2026)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
par: Ning, Yuwei, et autres
Publié: (2026)
par: Ning, Yuwei, et autres
Publié: (2026)
Identifying Crucial Objects in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
IRIS: Intent Resolution via Inference-time Saccades for Open-Ended VQA in Large Vision-Language Models
par: Madinei, Parsa, et autres
Publié: (2026)
par: Madinei, Parsa, et autres
Publié: (2026)
Do Vision-Language Models See Urban Scenes as People Do? An Urban Perception Benchmark
par: Mushkani, Rashid
Publié: (2025)
par: Mushkani, Rashid
Publié: (2025)
CC-VQA: Conflict- and Correlation-Aware Method for Mitigating Knowledge Conflict in Knowledge-Based Visual Question Answering
par: Hong, Yuyang, et autres
Publié: (2026)
par: Hong, Yuyang, et autres
Publié: (2026)
EventFlash: Towards Efficient MLLMs for Event-Based Vision
par: Liu, Shaoyu, et autres
Publié: (2026)
par: Liu, Shaoyu, et autres
Publié: (2026)
EduVQA: Towards Concept-Aware Assessment of Educational AI-Generated Videos
par: Chen, Baoliang, et autres
Publié: (2026)
par: Chen, Baoliang, et autres
Publié: (2026)
Look-Closer-Then-Diagnose: Confidence-Aware Ultrasound VQA via Active Zooming
par: Zhou, Yue, et autres
Publié: (2026)
par: Zhou, Yue, et autres
Publié: (2026)
Aerial Vision-and-Language Navigation with Grid-based View Selection and Map Construction
par: Zhao, Ganlong, et autres
Publié: (2025)
par: Zhao, Ganlong, et autres
Publié: (2025)
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
par: Peng, Jiankun, et autres
Publié: (2026)
par: Peng, Jiankun, et autres
Publié: (2026)
Multi-View People Detection in Large Scenes via Supervised View-Wise Contribution Weighting
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
Vision-Language Navigation with Energy-Based Policy
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
SurgCheck: Do Vision-Language Models Really Look at Images in Surgical VQA?
par: Shin, Jongmin, et autres
Publié: (2026)
par: Shin, Jongmin, et autres
Publié: (2026)
Head-Aware Visual Cropping: Enhancing Fine-Grained VQA with Attention-Guided Subimage
par: Xie, Junfei, et autres
Publié: (2026)
par: Xie, Junfei, et autres
Publié: (2026)
InstantAvatar: Efficient 3D Head Reconstruction via Surface Rendering
par: Canela, Antonio, et autres
Publié: (2023)
par: Canela, Antonio, et autres
Publié: (2023)
3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language Navigation
par: Gao, Jianzhe, et autres
Publié: (2026)
par: Gao, Jianzhe, et autres
Publié: (2026)
Enhancing Document VQA Models via Retrieval-Augmented Generation
par: López, Eric, et autres
Publié: (2025)
par: López, Eric, et autres
Publié: (2025)
Look to Locate: Vision-Based Multisensory Navigation with 3-D Digital Maps for GNSS-Challenged Environments
par: Elmaghraby, Ola, et autres
Publié: (2025)
par: Elmaghraby, Ola, et autres
Publié: (2025)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2023)
par: Wang, Liuyi, et autres
Publié: (2023)
Adaptive Event Stream Slicing for Open-Vocabulary Event-Based Object Detection via Vision-Language Knowledge Distillation
par: Zhang, Jinchang, et autres
Publié: (2025)
par: Zhang, Jinchang, et autres
Publié: (2025)
Interpreting Low-level Vision Models with Causal Effect Maps
par: Hu, Jinfan, et autres
Publié: (2024)
par: Hu, Jinfan, et autres
Publié: (2024)
UrbanSAM: Learning Invariance-Inspired Adapters for Segment Anything Models in Urban Construction
par: Li, Chenyu, et autres
Publié: (2025)
par: Li, Chenyu, et autres
Publié: (2025)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
par: Guo, Wenxuan, et autres
Publié: (2026)
par: Guo, Wenxuan, et autres
Publié: (2026)
From Street View to Visual Network: Mapping the Visibility of Urban Landmarks with Vision-Language Models
par: Fan, Zicheng, et autres
Publié: (2025)
par: Fan, Zicheng, et autres
Publié: (2025)
Vision-Based Localization in Dense Urban Environments: A Case Study of an Urban Village in China
par: Wu, Menglin, et autres
Publié: (2026)
par: Wu, Menglin, et autres
Publié: (2026)
SurgAnt-ViVQA: Learning to Anticipate Surgical Events through GRU-Driven Temporal Cross-Attention
par: Dhake, Shreyas C., et autres
Publié: (2025)
par: Dhake, Shreyas C., et autres
Publié: (2025)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
par: Zhou, Xunchu, et autres
Publié: (2024)
par: Zhou, Xunchu, et autres
Publié: (2024)
IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models
par: Shahgir, Haz Sameen, et autres
Publié: (2024)
par: Shahgir, Haz Sameen, et autres
Publié: (2024)
On the Role of Visual Grounding in VQA
par: Reich, Daniel, et autres
Publié: (2024)
par: Reich, Daniel, et autres
Publié: (2024)
RoboSurg-VQA: A Multimodal Benchmark for Surgical Segmentation-Aware Visual Question Answering
par: Zhang, Chengyi, et autres
Publié: (2026)
par: Zhang, Chengyi, et autres
Publié: (2026)
Documents similaires
-
Uncertainty-Aware Gaussian Map for Vision-Language Navigation
par: Gao, Jianzhe, et autres
Publié: (2026) -
Vision-Based Autonomous UAV Navigation and Landing for Urban Search and Rescue
par: Mittal, Mayank, et autres
Publié: (2019) -
Vision-Based Risk Aware Emergency Landing for UAVs in Complex Urban Environments
par: de la Torre-Vanegas, Julio, et autres
Publié: (2025) -
Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision
par: Li, Yu, et autres
Publié: (2026) -
Empowering Dynamic Urban Navigation with Stereo and Mid-Level Vision
par: Zhou, Wentao, et autres
Publié: (2025)