Can ChatGPT assist visually impaired people with micro-navigation?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Junxian, Pundlik, Shrinivas, Luo, Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GesGPT: Speech Gesture Synthesis With Text Parsing from ChatGPT
par: Gao, Nan, et autres
Publié: (2023)
par: Gao, Nan, et autres
Publié: (2023)
How Good is ChatGPT at Audiovisual Deepfake Detection: A Comparative Study of ChatGPT, AI Models and Human Perception
par: Shahzad, Sahibzada Adil, et autres
Publié: (2024)
par: Shahzad, Sahibzada Adil, et autres
Publié: (2024)
Several questions of visual generation in 2024
par: Gu, Shuyang
Publié: (2024)
par: Gu, Shuyang
Publié: (2024)
ColorGPT: Leveraging Large Language Models for Multimodal Color Recommendation
par: Xia, Ding, et autres
Publié: (2025)
par: Xia, Ding, et autres
Publié: (2025)
VisionGPT: LLM-Assisted Real-Time Anomaly Detection for Safe Visual Navigation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
GazeGPT: Augmenting Human Capabilities using Gaze-contingent Contextual AI for Smart Eyewear
par: Konrad, Robert, et autres
Publié: (2024)
par: Konrad, Robert, et autres
Publié: (2024)
Evaluating how interactive visualizations can assist in finding samples where and how computer vision models make mistakes
par: Song, Hayeong, et autres
Publié: (2023)
par: Song, Hayeong, et autres
Publié: (2023)
The 3D-PC: a benchmark for visual perspective taking in humans and machines
par: Linsley, Drew, et autres
Publié: (2024)
par: Linsley, Drew, et autres
Publié: (2024)
ChatStitch: Visualizing Through Structures via Surround-View Unsupervised Deep Image Stitching with Collaborative LLM-Agents
par: Liang, Hao, et autres
Publié: (2025)
par: Liang, Hao, et autres
Publié: (2025)
Influence of field of view in visual prostheses design: Analysis with a VR system
par: Sanchez-Garcia, Melani, et autres
Publié: (2025)
par: Sanchez-Garcia, Melani, et autres
Publié: (2025)
GPT-5 Model Corrected GPT-4V's Chart Reading Errors, Not Prompting
par: Yang, Kaichun, et autres
Publié: (2025)
par: Yang, Kaichun, et autres
Publié: (2025)
"It's trained by non-disabled people": Evaluating How Image Quality Affects Product Captioning with Vision-Language Models
par: Garg, Kapil, et autres
Publié: (2025)
par: Garg, Kapil, et autres
Publié: (2025)
More than One Step at a Time: Designing Procedural Feedback for Non-visual Makeup Routines
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
par: Li, Franklin Mingzhe, et autres
Publié: (2025)
Can ChatGPT Read Who You Are?
par: Derner, Erik, et autres
Publié: (2023)
par: Derner, Erik, et autres
Publié: (2023)
Interactivity x Explainability: Toward Understanding How Interactivity Can Improve Computer Vision Explanations
par: Panigrahi, Indu, et autres
Publié: (2025)
par: Panigrahi, Indu, et autres
Publié: (2025)
From Development to Deployment of AI-assisted Telehealth and Screening for Vision- and Hearing-threatening diseases in resource-constrained settings: Field Observations, Challenges and Way Forward
par: Shakya, Mahesh, et autres
Publié: (2025)
par: Shakya, Mahesh, et autres
Publié: (2025)
Extending 3D body pose estimation for robotic-assistive therapies of autistic children
par: Santos, Laura, et autres
Publié: (2024)
par: Santos, Laura, et autres
Publié: (2024)
"I Use ChatGPT to Humanize My Words": Affordances and Risks of ChatGPT to Autistic Users
par: Ma, Renkai, et autres
Publié: (2026)
par: Ma, Renkai, et autres
Publié: (2026)
Using ChatGPT for Thematic Analysis
par: Turobov, Aleksei, et autres
Publié: (2024)
par: Turobov, Aleksei, et autres
Publié: (2024)
AV-EmoDialog: Chat with Audio-Visual Users Leveraging Emotional Cues
par: Park, Se Jin, et autres
Publié: (2024)
par: Park, Se Jin, et autres
Publié: (2024)
GAITEX: Human motion dataset of impaired gait and rehabilitation exercises using inertial and optical sensors
par: Spilz, Andreas, et autres
Publié: (2025)
par: Spilz, Andreas, et autres
Publié: (2025)
Unsupervised visualization of image datasets using contrastive learning
par: Böhm, Jan Niklas, et autres
Publié: (2022)
par: Böhm, Jan Niklas, et autres
Publié: (2022)
EduGage: Methods and Dataset for Sensor-Based Momentary Assessment of Engagement in Self-Guided Video Learning
par: Leng, Zikang, et autres
Publié: (2026)
par: Leng, Zikang, et autres
Publié: (2026)
ProTAL: A Drag-and-Link Video Programming Framework for Temporal Action Localization
par: He, Yuchen, et autres
Publié: (2025)
par: He, Yuchen, et autres
Publié: (2025)
"I Can See Forever!": Evaluating Real-time VideoLLMs for Assisting Individuals with Visual Impairments
par: Zhang, Ziyi, et autres
Publié: (2025)
par: Zhang, Ziyi, et autres
Publié: (2025)
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
par: Chen, Hongzhou, et autres
Publié: (2024)
par: Chen, Hongzhou, et autres
Publié: (2024)
GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents
par: Luo, Run, et autres
Publié: (2025)
par: Luo, Run, et autres
Publié: (2025)
AgentSense: Virtual Sensor Data Generation Using LLM Agents in Simulated Home Environments
par: Leng, Zikang, et autres
Publié: (2025)
par: Leng, Zikang, et autres
Publié: (2025)
Multi-scale structural complexity as a quantitative measure of visual complexity
par: Kravchenko, Anna, et autres
Publié: (2024)
par: Kravchenko, Anna, et autres
Publié: (2024)
Improve accessibility for Low Vision and Blind people using Machine Learning and Computer Vision
par: Shukurov, Jasur
Publié: (2024)
par: Shukurov, Jasur
Publié: (2024)
YOLOA: Real-Time Affordance Detection via LLM Adapter
par: Ji, Yuqi, et autres
Publié: (2025)
par: Ji, Yuqi, et autres
Publié: (2025)
Last Week with ChatGPT: A Weibo Study on Social Perspective Regarding ChatGPT for Education and Beyond
par: Tian, Yao, et autres
Publié: (2023)
par: Tian, Yao, et autres
Publié: (2023)
Towards user-centered interactive medical image segmentation in VR with an assistive AI agent
par: Spiegler, Pascal, et autres
Publié: (2025)
par: Spiegler, Pascal, et autres
Publié: (2025)
Exploring the Impact of ChatGPT on Wikipedia Engagement
par: Reeves, Neal, et autres
Publié: (2024)
par: Reeves, Neal, et autres
Publié: (2024)
The Illusion of Agreement with ChatGPT: Sycophancy and Beyond
par: Noshin, Kazi, et autres
Publié: (2026)
par: Noshin, Kazi, et autres
Publié: (2026)
SeamPose: Repurposing Seams as Capacitive Sensors in a Shirt for Upper-Body Pose Tracking
par: Yu, Tianhong Catherine, et autres
Publié: (2024)
par: Yu, Tianhong Catherine, et autres
Publié: (2024)
IVISIT: An Interactive Visual Simulation Tool for system simulation, visualization, optimization, and parameter management
par: Knoblauch, Andreas
Publié: (2024)
par: Knoblauch, Andreas
Publié: (2024)
CoCoG-2: Controllable generation of visual stimuli for understanding human concept representation
par: Wei, Chen, et autres
Publié: (2024)
par: Wei, Chen, et autres
Publié: (2024)
Virtual avatar generation models as world navigators
par: Mandava, Sai
Publié: (2024)
par: Mandava, Sai
Publié: (2024)
Generalizability analysis of deep learning predictions of human brain responses to augmented and semantically novel visual stimuli
par: Piskovskyi, Valentyn, et autres
Publié: (2024)
par: Piskovskyi, Valentyn, et autres
Publié: (2024)
Documents similaires
-
GesGPT: Speech Gesture Synthesis With Text Parsing from ChatGPT
par: Gao, Nan, et autres
Publié: (2023) -
How Good is ChatGPT at Audiovisual Deepfake Detection: A Comparative Study of ChatGPT, AI Models and Human Perception
par: Shahzad, Sahibzada Adil, et autres
Publié: (2024) -
Several questions of visual generation in 2024
par: Gu, Shuyang
Publié: (2024) -
ColorGPT: Leveraging Large Language Models for Multimodal Color Recommendation
par: Xia, Ding, et autres
Publié: (2025) -
VisionGPT: LLM-Assisted Real-Time Anomaly Detection for Safe Visual Navigation
par: Wang, Hao, et autres
Publié: (2024)