Identifying Crucial Objects in Blind and Low-Vision Individuals' Navigation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Islam, Md Touhidul, Kabir, Imran, Pearce, Elena Ariel, Reza, Md Alimoor, Billah, Syed Masum |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
par: Islam, Md Touhidul, et autres
Publié: (2025)
par: Islam, Md Touhidul, et autres
Publié: (2025)
Logic-RAG: Augmenting Large Multimodal Models with Visual-Spatial Knowledge for Road Scene Understanding
par: Kabir, Imran, et autres
Publié: (2025)
par: Kabir, Imran, et autres
Publié: (2025)
Rice Leaf Disease Detection: A Comparative Study Between CNN, Transformer and Non-neural Network Architectures
par: Mehnaz, Samia, et autres
Publié: (2025)
par: Mehnaz, Samia, et autres
Publié: (2025)
Vision-Based Lane Following and Traffic Sign Recognition for Resource-Constrained Autonomous Vehicles
par: Islam, Md Tanjemul, et autres
Publié: (2026)
par: Islam, Md Tanjemul, et autres
Publié: (2026)
Automated Wicket-Taking Delivery Segmentation and Trajectory-Based Dismissal-Zone Analysis in Cricket Videos Using OCR-Guided YOLOv8
par: Karmoker, Joy, et autres
Publié: (2025)
par: Karmoker, Joy, et autres
Publié: (2025)
In-Depth Analysis of Automated Acne Disease Recognition and Classification
par: Jeny, Afsana Ahsan, et autres
Publié: (2025)
par: Jeny, Afsana Ahsan, et autres
Publié: (2025)
ChartZero: Synthetic Priors Enable Zero Shot Chart Data Extraction
par: Islam, Md Touhidul, et autres
Publié: (2026)
par: Islam, Md Touhidul, et autres
Publié: (2026)
Blending 3D Geometry and Machine Learning for Multi-View Stereopsis
par: Vats, Vibhas, et autres
Publié: (2025)
par: Vats, Vibhas, et autres
Publié: (2025)
HeBA: Heterogeneous Bottleneck Adapters for Robust Vision-Language Models
par: Islam, Md Jahidul
Publié: (2026)
par: Islam, Md Jahidul
Publié: (2026)
A Computer Vision Based Approach for Stalking Detection Using a CNN-LSTM-MLP Hybrid Fusion Model
par: Hasan, Murad, et autres
Publié: (2024)
par: Hasan, Murad, et autres
Publié: (2024)
In Pursuit of Many: A Review of Modern Multiple Object Tracking Systems
par: Bashar, Mk, et autres
Publié: (2022)
par: Bashar, Mk, et autres
Publié: (2022)
Wheeler: A Three-Wheeled Input Device for Usable, Efficient, and Versatile Non-Visual Interaction
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
Demonstration of Wheeler: A Three-Wheeled Input Device for Usable, Efficient, and Versatile Non-Visual Interaction
par: Islam, Md Touhidul, et autres
Publié: (2024)
par: Islam, Md Touhidul, et autres
Publié: (2024)
GC-MVSNet: Multi-View, Multi-Scale, Geometrically-Consistent Multi-View Stereo
par: Vats, Vibhas K., et autres
Publié: (2023)
par: Vats, Vibhas K., et autres
Publié: (2023)
A Domain-Adapted Lightweight Ensemble for Resource-Efficient Few-Shot Plant Disease Classification
par: Islam, Anika, et autres
Publié: (2025)
par: Islam, Anika, et autres
Publié: (2025)
Leveraging Pre-trained CNNs for Efficient Feature Extraction in Rice Leaf Disease Classification
par: Sobuj, Md. Shohanur Islam, et autres
Publié: (2024)
par: Sobuj, Md. Shohanur Islam, et autres
Publié: (2024)
Real-Time Multi-Modal Embedded Vision Framework for Object Detection Facial Emotion Recognition and Biometric Identification on Low-Power Edge Platforms
par: Zahid, S. M. Khalid Bin, et autres
Publié: (2026)
par: Zahid, S. M. Khalid Bin, et autres
Publié: (2026)
ReHARK: Refined Hybrid Adaptive RBF Kernels for Robust One-Shot Vision-Language Adaptation
par: Islam, Md Jahidul
Publié: (2026)
par: Islam, Md Jahidul
Publié: (2026)
ELMF4EggQ: Ensemble Learning with Multimodal Feature Fusion for Non-Destructive Egg Quality Assessment
par: Hassan, Md Zahim, et autres
Publié: (2025)
par: Hassan, Md Zahim, et autres
Publié: (2025)
ElderFallGuard: Real-Time IoT and Computer Vision-Based Fall Detection System for Elderly Safety
par: Riahi, Tasrifur, et autres
Publié: (2025)
par: Riahi, Tasrifur, et autres
Publié: (2025)
Quantitative Currency Evaluation in Low-Resource Settings through Pattern Analysis to Assist Visually Impaired Users
par: Ovi, Md Sultanul Islam, et autres
Publié: (2025)
par: Ovi, Md Sultanul Islam, et autres
Publié: (2025)
Are Large Vision-Language Models Ready to Guide Blind and Low-Vision Individuals?
par: Kim, Eunki, et autres
Publié: (2025)
par: Kim, Eunki, et autres
Publié: (2025)
Few-Shot Learning Pipeline for Monkeypox Skin Disease Classification Using CNN Feature Extractors
par: Rashid, Md. Safirur, et autres
Publié: (2026)
par: Rashid, Md. Safirur, et autres
Publié: (2026)
Reliable Deep Learning for Small-Scale Classifications: Experiments on Real-World Image Datasets from Bangladesh
par: Suny, Alfe, et autres
Publié: (2026)
par: Suny, Alfe, et autres
Publié: (2026)
A Comprehensive Survey on Visual Question Answering Datasets and Algorithms
par: Kabir, Raihan, et autres
Publié: (2024)
par: Kabir, Raihan, et autres
Publié: (2024)
Shaping Credibility Judgments in Human-GenAI Partnership via Weaker LLMs: A Transactive Memory Perspective on AI Literacy
par: Islam, Md Touhidul, et autres
Publié: (2026)
par: Islam, Md Touhidul, et autres
Publié: (2026)
Explainable AI-Driven Detection of Human Monkeypox Using Deep Learning and Vision Transformers: A Comprehensive Analysis
par: Hossain, Md. Zahid, et autres
Publié: (2025)
par: Hossain, Md. Zahid, et autres
Publié: (2025)
SonoVision: A Computer Vision Approach for Helping Visually Challenged Individuals Locate Objects with the Help of Sound Cues
par: Zishan, Md Abu Obaida, et autres
Publié: (2025)
par: Zishan, Md Abu Obaida, et autres
Publié: (2025)
CS-Mixer: A Cross-Scale Vision MLP Model with Spatial-Channel Mixing
par: Cui, Jonathan, et autres
Publié: (2023)
par: Cui, Jonathan, et autres
Publié: (2023)
Comparative Performance Analysis of Transformer-Based Pre-Trained Models for Detecting Keratoconus Disease
par: Ahmed, Nayeem, et autres
Publié: (2024)
par: Ahmed, Nayeem, et autres
Publié: (2024)
A Two-Stage Multitask Vision-Language Framework for Explainable Crop Disease Visual Question Answering
par: Hossain, Md. Zahid, et autres
Publié: (2026)
par: Hossain, Md. Zahid, et autres
Publié: (2026)
ANNA: A Deep Learning Based Dataset in Heterogeneous Traffic for Autonomous Vehicles
par: Kamal, Mahedi, et autres
Publié: (2024)
par: Kamal, Mahedi, et autres
Publié: (2024)
Vision-Language Models for Automated Chest X-ray Interpretation: Leveraging ViT and GPT-2
par: Islam, Md. Rakibul, et autres
Publié: (2025)
par: Islam, Md. Rakibul, et autres
Publié: (2025)
ColorFoil: Investigating Color Blindness in Large Vision and Language Models
par: Samin, Ahnaf Mozib, et autres
Publié: (2024)
par: Samin, Ahnaf Mozib, et autres
Publié: (2024)
DExNet: Combining Observations of Domain Adapted Critics for Leaf Disease Classification with Limited Data
par: Ahmed, Sabbir, et autres
Publié: (2025)
par: Ahmed, Sabbir, et autres
Publié: (2025)
Attention Is not Everything: Efficient Alternatives for Vision
par: Kazi, Nur Mohammad, et autres
Publié: (2026)
par: Kazi, Nur Mohammad, et autres
Publié: (2026)
An Image Dataset of Common Skin Diseases of Bangladesh and Benchmarking Performance with Machine Learning Models
par: Hossain, Sazzad, et autres
Publié: (2026)
par: Hossain, Sazzad, et autres
Publié: (2026)
An Explainable Vision-Language Model Framework with Adaptive PID-Tversky Loss for Lumbar Spinal Stenosis Diagnosis
par: Sk., Md. Sajeebul Islam, et autres
Publié: (2026)
par: Sk., Md. Sajeebul Islam, et autres
Publié: (2026)
A Computer Vision Hybrid Approach: CNN and Transformer Models for Accurate Alzheimer's Detection from Brain MRI Scans
par: Hoque, Md Mahmudul, et autres
Publié: (2026)
par: Hoque, Md Mahmudul, et autres
Publié: (2026)
Documents similaires
-
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
par: Islam, Md Touhidul, et autres
Publié: (2024) -
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
par: Islam, Md Touhidul, et autres
Publié: (2025) -
Logic-RAG: Augmenting Large Multimodal Models with Visual-Spatial Knowledge for Road Scene Understanding
par: Kabir, Imran, et autres
Publié: (2025) -
Rice Leaf Disease Detection: A Comparative Study Between CNN, Transformer and Non-neural Network Architectures
par: Mehnaz, Samia, et autres
Publié: (2025) -
Vision-Based Lane Following and Traffic Sign Recognition for Resource-Constrained Autonomous Vehicles
par: Islam, Md Tanjemul, et autres
Publié: (2026)