Improve accessibility for Low Vision and Blind people using Machine Learning and Computer Vision
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Shukurov, Jasur |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Methodology to Deploy CNN-Based Computer Vision Models on Immersive Wearable Devices
par: Malek, Kaveh, et autres
Publié: (2024)
par: Malek, Kaveh, et autres
Publié: (2024)
Benchmarking Adaptive Intelligence and Computer Vision on Human-Robot Collaboration
par: Saraj, Salaar, et autres
Publié: (2024)
par: Saraj, Salaar, et autres
Publié: (2024)
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Use of a Multiscale Vision Transformer to predict Nursing Activities Score from Low Resolution Thermal Videos in an Intensive Care Unit
par: Lee, Isaac YL, et autres
Publié: (2024)
par: Lee, Isaac YL, et autres
Publié: (2024)
Bridging Human Concepts and Computer Vision for Explainable Face Verification
par: Doh, Miriam, et autres
Publié: (2024)
par: Doh, Miriam, et autres
Publié: (2024)
VocalEyes: Enhancing Environmental Perception for the Visually Impaired through Vision-Language Models and Distance-Aware Object Detection
par: Chavan, Kunal, et autres
Publié: (2025)
par: Chavan, Kunal, et autres
Publié: (2025)
Computer Vision for Objects used in Group Work: Challenges and Opportunities
par: Jung, Changsoo, et autres
Publié: (2025)
par: Jung, Changsoo, et autres
Publié: (2025)
Supporting Experts with a Multimodal Machine-Learning-Based Tool for Human Behavior Analysis of Conversational Videos
par: Arakawa, Riku, et autres
Publié: (2024)
par: Arakawa, Riku, et autres
Publié: (2024)
Interactivity x Explainability: Toward Understanding How Interactivity Can Improve Computer Vision Explanations
par: Panigrahi, Indu, et autres
Publié: (2025)
par: Panigrahi, Indu, et autres
Publié: (2025)
Training a Vision Language Model as Smartphone Assistant
par: Dorka, Nicolai, et autres
Publié: (2024)
par: Dorka, Nicolai, et autres
Publié: (2024)
AVERE: Improving Audiovisual Emotion Reasoning with Preference Optimization
par: Chaubey, Ashutosh, et autres
Publié: (2026)
par: Chaubey, Ashutosh, et autres
Publié: (2026)
InterVLS: Interactive Model Understanding and Improvement with Vision-Language Surrogates
par: Huang, Jinbin, et autres
Publié: (2023)
par: Huang, Jinbin, et autres
Publié: (2023)
Predicting and Explaining Mobile UI Tappability with Vision Modeling and Saliency Analysis
par: Schoop, Eldon, et autres
Publié: (2022)
par: Schoop, Eldon, et autres
Publié: (2022)
Continuous Human Action Recognition for Human-Machine Interaction: A Review
par: Gammulle, Harshala, et autres
Publié: (2022)
par: Gammulle, Harshala, et autres
Publié: (2022)
Toward Scalable Co-located Practical Learning: Assisting with Computer Vision and Multimodal Analytics
par: Li, Xinyu, et autres
Publié: (2026)
par: Li, Xinyu, et autres
Publié: (2026)
SpiderNets: Vision Models Predict Human Fear From Aversive Images
par: Pegler, Dominik, et autres
Publié: (2025)
par: Pegler, Dominik, et autres
Publié: (2025)
Customizable Avatars with Dynamic Facial Action Coded Expressions (CADyFACE) for Improved User Engagement
par: Witherow, Megan A., et autres
Publié: (2024)
par: Witherow, Megan A., et autres
Publié: (2024)
Machine Vision-Based Surgical Lighting System:Design and Implementation
par: Gharghabi, Amir, et autres
Publié: (2025)
par: Gharghabi, Amir, et autres
Publié: (2025)
Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation
par: Muryn, Viktor, et autres
Publié: (2025)
par: Muryn, Viktor, et autres
Publié: (2025)
No Need to Sacrifice Data Quality for Quantity: Crowd-Informed Machine Annotation for Cost-Effective Understanding of Visual Data
par: Klugmann, Christopher, et autres
Publié: (2024)
par: Klugmann, Christopher, et autres
Publié: (2024)
Real-Time Cellist Postural Evaluation With On-Device Computer Vision
par: Wang, Paolo, et autres
Publié: (2026)
par: Wang, Paolo, et autres
Publié: (2026)
Helios 2.0: A Robust, Ultra-Low Power Gesture Recognition System Optimised for Event-Sensor based Wearables
par: Bhattacharyya, Prarthana, et autres
Publié: (2025)
par: Bhattacharyya, Prarthana, et autres
Publié: (2025)
"It's trained by non-disabled people": Evaluating How Image Quality Affects Product Captioning with Vision-Language Models
par: Garg, Kapil, et autres
Publié: (2025)
par: Garg, Kapil, et autres
Publié: (2025)
Unsupervised visualization of image datasets using contrastive learning
par: Böhm, Jan Niklas, et autres
Publié: (2022)
par: Böhm, Jan Niklas, et autres
Publié: (2022)
Assessing Graphical Perception of Image Embedding Models using Channel Effectiveness
par: Lee, Soohyun, et autres
Publié: (2024)
par: Lee, Soohyun, et autres
Publié: (2024)
Zero-shot Human Pose Estimation using Diffusion-based Inverse solvers
par: Karnoor, Sahil Bhandary, et autres
Publié: (2025)
par: Karnoor, Sahil Bhandary, et autres
Publié: (2025)
Detecting Clues for Skill Levels and Machine Operation Difficulty from Egocentric Vision
par: Long-fei, Chen, et autres
Publié: (2019)
par: Long-fei, Chen, et autres
Publié: (2019)
Learning Confident Classifiers in the Presence of Label Noise
par: Hashmi, Asma Ahmed, et autres
Publié: (2023)
par: Hashmi, Asma Ahmed, et autres
Publié: (2023)
Biometrics and Behavior Analysis for Detecting Distractions in e-Learning
par: Becerra, Álvaro, et autres
Publié: (2024)
par: Becerra, Álvaro, et autres
Publié: (2024)
VAAD: Visual Attention Analysis Dashboard applied to e-Learning
par: Navarro, Miriam, et autres
Publié: (2024)
par: Navarro, Miriam, et autres
Publié: (2024)
Coupled Confusion Correction: Learning from Crowds with Sparse Annotations
par: Zhang, Hansong, et autres
Publié: (2023)
par: Zhang, Hansong, et autres
Publié: (2023)
Vision-Language Models for Ergonomic Assessment of Manual Lifting Tasks: Estimating Horizontal and Vertical Hand Distances from RGB Video
par: Rajabi, Mohammad Sadra, et autres
Publié: (2026)
par: Rajabi, Mohammad Sadra, et autres
Publié: (2026)
Citizen Science and Machine Learning for Research and Nature Conservation: The Case of Eurasian Lynx, Free-ranging Rodents and Insects
par: Skorupska, Kinga, et autres
Publié: (2024)
par: Skorupska, Kinga, et autres
Publié: (2024)
Toward a Surgeon-in-the-Loop Ophthalmic Robotic Apprentice using Reinforcement and Imitation Learning
par: Gomaa, Amr, et autres
Publié: (2023)
par: Gomaa, Amr, et autres
Publié: (2023)
GuideNav: User-Informed Development of a Vision-Only Robotic Navigation Assistant For Blind Travelers
par: Hwang, Hochul, et autres
Publié: (2025)
par: Hwang, Hochul, et autres
Publié: (2025)
Weak-Annotation of HAR Datasets using Vision Foundation Models
par: Bock, Marius, et autres
Publié: (2024)
par: Bock, Marius, et autres
Publié: (2024)
DOTA: Distributional Test-Time Adaptation of Vision-Language Models
par: Han, Zongbo, et autres
Publié: (2024)
par: Han, Zongbo, et autres
Publié: (2024)
A Deep Learning-based Multimodal Depth-Aware Dynamic Hand Gesture Recognition System
par: Mahmud, Hasan, et autres
Publié: (2021)
par: Mahmud, Hasan, et autres
Publié: (2021)
Computational Trichromacy Reconstruction: Empowering the Color-Vision Deficient to Recognize Colors Using Augmented Reality
par: Zhu, Yuhao, et autres
Publié: (2024)
par: Zhu, Yuhao, et autres
Publié: (2024)
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models
par: Tsangko, Iosif, et autres
Publié: (2026)
par: Tsangko, Iosif, et autres
Publié: (2026)
Documents similaires
-
Methodology to Deploy CNN-Based Computer Vision Models on Immersive Wearable Devices
par: Malek, Kaveh, et autres
Publié: (2024) -
Benchmarking Adaptive Intelligence and Computer Vision on Human-Robot Collaboration
par: Saraj, Salaar, et autres
Publié: (2024) -
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024) -
Use of a Multiscale Vision Transformer to predict Nursing Activities Score from Low Resolution Thermal Videos in an Intensive Care Unit
par: Lee, Isaac YL, et autres
Publié: (2024) -
Bridging Human Concepts and Computer Vision for Explainable Face Verification
par: Doh, Miriam, et autres
Publié: (2024)