Enhancing the Travel Experience for People with Visual Impairments through Multimodal Interaction: NaviGPT, A Real-Time AI-Driven Mobile Navigation System
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, He, Falletta, Nicholas J., Xie, Jingyi, Yu, Rui, Lee, Sooyeon, Billah, Syed Masum, Carroll, John M. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Emerging Practices for Large Multimodal Model (LMM) Assistance for People with Visual Impairments: Implications for Design
par: Xie, Jingyi, et autres
Publié: (2024)
par: Xie, Jingyi, et autres
Publié: (2024)
Beyond Visual Perception: Insights from Smartphone Interaction of Visually Impaired Users with Large Multimodal Models
par: Xie, Jingyi, et autres
Publié: (2025)
par: Xie, Jingyi, et autres
Publié: (2025)
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
par: Islam, Md Touhidul, et autres
Publié: (2025)
par: Islam, Md Touhidul, et autres
Publié: (2025)
ToPSen: Task-Oriented Priming and Sensory Alignment for Comparing Coding Strategies Between Sighted and Blind Programmers
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2025)
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2025)
VoiceAlign: A Shimming Layer for Enhancing the Usability of Legacy Voice User Interface Systems
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2026)
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2026)
NaviSense: A Multimodal Assistive Mobile application for Object Retrieval by Persons with Visual Impairment
par: Sridhar, Ajay Narayanan, et autres
Publié: (2025)
par: Sridhar, Ajay Narayanan, et autres
Publié: (2025)
Climate Change and Impacts on Human Health: An Experience of Coastal Region People in Bangladesh
par: Mohammad Shaheen Alam, et autres
Publié: (2025)
par: Mohammad Shaheen Alam, et autres
Publié: (2025)
Identifying Crucial Objects in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Wheeler: A Three-Wheeled Input Device for Usable, Efficient, and Versatile Non-Visual Interaction
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Demonstration of Wheeler: A Three-Wheeled Input Device for Usable, Efficient, and Versatile Non-Visual Interaction
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Logic-RAG: Augmenting Large Multimodal Models with Visual-Spatial Knowledge for Road Scene Understanding
par: Kabir, Imran, et autres
Publié: (2025)
par: Kabir, Imran, et autres
Publié: (2025)
The Energy Exclusion Principle: A Dynamical Mechanism for Cosmological Redshift and Vacuum Evolution
par: A.B.M Masum Billah Mim
Publié: (2026)
par: A.B.M Masum Billah Mim
Publié: (2026)
COVID-19 Pandemic: Experiences of People with Visual Impairment
par: María del Pilar Oviedo-Cáceres
Publié: (2021)
par: María del Pilar Oviedo-Cáceres
Publié: (2021)
Light Effect on Amorphous Tin Oxide Thin‐Film Transistors
par: Christophe Avis, et autres
Publié: (2024)
par: Christophe Avis, et autres
Publié: (2024)
The Ambivalent Experience of Eye Contact for People with Visual Impairments: Mechanisms and Design Challenges
par: Wieland, Markus, et autres
Publié: (2026)
par: Wieland, Markus, et autres
Publié: (2026)
Exploring the Influence of Salinity Intrusion on the Physical and Menstrual Health Problem of Women in Coastal Bangladesh
par: Farhana Yasmin, et autres
Publié: (2026)
par: Farhana Yasmin, et autres
Publié: (2026)
Inclusive Service Experience Management: a Framework from the Perspective of People with Visual Impairment
par: Bibiana Conrad
Publié: (2019)
par: Bibiana Conrad
Publié: (2019)
Navigating Independence: A Survey of Visually Impaired People's Experiences and Needs
par: Bamdad, Banafshe Marziyeh, et autres
Publié: (2026)
par: Bamdad, Banafshe Marziyeh, et autres
Publié: (2026)
NaviDiffusor: Cost-Guided Diffusion Model for Visual Navigation
par: Zeng, Yiming, et autres
Publié: (2025)
par: Zeng, Yiming, et autres
Publié: (2025)
Do ESG Disclosure Scores Enhance Bank Stability and Financial Performance? Evidence From Explainable Artificial Intelligence Models
par: Buthiena Kharabsheh, et autres
Publié: (2026)
par: Buthiena Kharabsheh, et autres
Publié: (2026)
A Time Travel Dialogue
par: W. Carroll, John
Publié: (2018)
par: W. Carroll, John
Publié: (2018)
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
par: Bhatia, Gagan, et autres
Publié: (2024)
par: Bhatia, Gagan, et autres
Publié: (2024)
Redefining Qualitative Analysis in the AI Era: Utilizing ChatGPT for Efficient Thematic Analysis
par: Zhang, He, et autres
Publié: (2023)
par: Zhang, He, et autres
Publié: (2023)
A spectral boundary element method for acoustic interference problems
par: Falletta, Silvia, et autres
Publié: (2025)
par: Falletta, Silvia, et autres
Publié: (2025)
Anatomy at the threshold: Teaching the human body in a hybrid age
par: Katia Cortese, et autres
Publié: (2025)
par: Katia Cortese, et autres
Publié: (2025)
eNavi: Event-based Imitation Policies for Low-Light Indoor Mobile Robot Navigation
par: Ramesh, Prithvi Jai, et autres
Publié: (2026)
par: Ramesh, Prithvi Jai, et autres
Publié: (2026)
PISHYAR: A Socially Intelligent Smart Cane for Indoor Social Navigation and Multimodal Human-Robot Interaction for Visually Impaired People
par: Joo, Mahdi Haghighat, et autres
Publié: (2026)
par: Joo, Mahdi Haghighat, et autres
Publié: (2026)
VisionGPT: LLM-Assisted Real-Time Anomaly Detection for Safe Visual Navigation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Navigating Travel Decisions: The Influence of Uncertainty Tolerance, Risk Perception, and Experience on Chinese Outbound Travel Intentions
par: Ying Zhang, et autres
Publié: (2025)
par: Ying Zhang, et autres
Publié: (2025)
Vision-Based Assistive Technologies for People with Cerebral Visual Impairment: A Review and Focus Study
par: Gamage, Bhanuka, et autres
Publié: (2025)
par: Gamage, Bhanuka, et autres
Publié: (2025)
AsmRAG: LLM-Driven Malware Detection by Retrieving Functionally Similar Assembly Code
par: Karbab, ElMouatez Billah
Publié: (2026)
par: Karbab, ElMouatez Billah
Publié: (2026)
NaviNote: Enabling In-situ Spatial Annotation Authoring to Support Exploration and Navigation for Blind and Low Vision People
par: Chen, Ruijia, et autres
Publié: (2026)
par: Chen, Ruijia, et autres
Publié: (2026)
Memory-Maze: Scenario Driven Visual Language Navigation Benchmark for Guiding Blind People
par: Kuribayashi, Masaki, et autres
Publié: (2024)
par: Kuribayashi, Masaki, et autres
Publié: (2024)
Shaping Credibility Judgments in Human-GenAI Partnership via Weaker LLMs: A Transactive Memory Perspective on AI Literacy
par: Islam, Md Touhidul, et autres
Publié: (2026)
par: Islam, Md Touhidul, et autres
Publié: (2026)
Autonomous Navigation of Bio‐Intelligent Cyborg Insect Based on Insect Visual Perception
par: Chowdhury Mohammad Masum Refat, et autres
Publié: (2025)
par: Chowdhury Mohammad Masum Refat, et autres
Publié: (2025)
Autonomous Navigation of Bio‐Intelligent Cyborg Insect Based on Insect Visual Perception
par: Chowdhury Mohammad Masum Refat, et autres
Publié: (2025)
par: Chowdhury Mohammad Masum Refat, et autres
Publié: (2025)
Generating Academic Capital Through Travel: Academic Mothers Navigating the Ideal of Mobility
par: Merridee L. Bujaki, et autres
Publié: (2025)
par: Merridee L. Bujaki, et autres
Publié: (2025)
MateRobot: Material Recognition in Wearable Robotics for People with Visual Impairments
par: Zheng, Junwei, et autres
Publié: (2023)
par: Zheng, Junwei, et autres
Publié: (2023)
Voices Project: Technological Innovations in Social Inclusion of People with Visual Impairment
par: Janaina Cazin
Publié: (2013)
par: Janaina Cazin
Publié: (2013)
Documents similaires
-
Emerging Practices for Large Multimodal Model (LMM) Assistance for People with Visual Impairments: Implications for Design
par: Xie, Jingyi, et autres
Publié: (2024) -
Beyond Visual Perception: Insights from Smartphone Interaction of Visually Impaired Users with Large Multimodal Models
par: Xie, Jingyi, et autres
Publié: (2025) -
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
par: Islam, Md Touhidul, et autres
Publié: (2025) -
ToPSen: Task-Oriented Priming and Sensory Alignment for Comparing Coding Strategies Between Sighted and Blind Programmers
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2025) -
VoiceAlign: A Shimming Layer for Enhancing the Usability of Legacy Voice User Interface Systems
par: Ehtesham-Ul-Haque, Md, et autres
Publié: (2026)