Real-Time Currency Detection and Voice Feedback for Visually Impaired Individuals
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shreya, Saraf Anzum, Siddique, MD. Abu Ismail, Tasnim, Sharaf |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DB-FGA-Net: Dual Backbone Frequency Gated Attention Network for Multi-Class Brain Tumor Classification with Grad-CAM Interpretability
par: Shreya, Saraf Anzum, et autres
Publié: (2025)
par: Shreya, Saraf Anzum, et autres
Publié: (2025)
Quantitative Currency Evaluation in Low-Resource Settings through Pattern Analysis to Assist Visually Impaired Users
par: Ovi, Md Sultanul Islam, et autres
Publié: (2025)
par: Ovi, Md Sultanul Islam, et autres
Publié: (2025)
Real-time Yemeni Currency Detection
par: AL-Edreesi, Edrees, et autres
Publié: (2024)
par: AL-Edreesi, Edrees, et autres
Publié: (2024)
DISHA: Low-Energy Sparse Transformer at Edge for Outdoor Navigation for the Visually Impaired Individuals
par: Nagil, Praveen, et autres
Publié: (2024)
par: Nagil, Praveen, et autres
Publié: (2024)
Real-Time Pill Identification for the Visually Impaired Using Deep Learning
par: Dang, Bo, et autres
Publié: (2024)
par: Dang, Bo, et autres
Publié: (2024)
Real-Time Human Fall Detection using a Lightweight Pose Estimation Technique
par: Alam, Ekram, et autres
Publié: (2024)
par: Alam, Ekram, et autres
Publié: (2024)
Turn-by-Turn Indoor Navigation for the Visually Impaired
par: Srinivasaiah, Santosh, et autres
Publié: (2024)
par: Srinivasaiah, Santosh, et autres
Publié: (2024)
SLAM for Visually Impaired People: a Survey
par: Bamdad, Marziyeh, et autres
Publié: (2022)
par: Bamdad, Marziyeh, et autres
Publié: (2022)
AI-based Wearable Vision Assistance System for the Visually Impaired: Integrating Real-Time Object Recognition and Contextual Understanding Using Large Vision-Language Models
par: Baig, Mirza Samad Ahmed, et autres
Publié: (2024)
par: Baig, Mirza Samad Ahmed, et autres
Publié: (2024)
RaceGAN: A Framework for Preserving Individuality while Converting Racial Information for Image-to-Image Translation
par: Pervin, Mst Tasnim, et autres
Publié: (2025)
par: Pervin, Mst Tasnim, et autres
Publié: (2025)
Evaluating YOLO Architectures: Implications for Real-Time Vehicle Detection in Urban Environments of Bangladesh
par: Hossain, Ha Meem, et autres
Publié: (2025)
par: Hossain, Ha Meem, et autres
Publié: (2025)
HazardNet: A Small-Scale Vision Language Model for Real-Time Traffic Safety Detection at Edge Devices
par: Tami, Mohammad Abu, et autres
Publié: (2025)
par: Tami, Mohammad Abu, et autres
Publié: (2025)
MR.NAVI: Mixed-Reality Navigation Assistant for the Visually Impaired
par: Pfitzer, Nicolas, et autres
Publié: (2025)
par: Pfitzer, Nicolas, et autres
Publié: (2025)
The VVAD-LRS3 Dataset for Visual Voice Activity Detection
par: Lubitz, Adrian, et autres
Publié: (2021)
par: Lubitz, Adrian, et autres
Publié: (2021)
YOLOv13: Real-Time Object Detection with Hypergraph-Enhanced Adaptive Visual Perception
par: Lei, Mengqi, et autres
Publié: (2025)
par: Lei, Mengqi, et autres
Publié: (2025)
Real-Time Idling Vehicles Detection using Combined Audio-Visual Deep Learning
par: Li, Xiwen, et autres
Publié: (2023)
par: Li, Xiwen, et autres
Publié: (2023)
Diversity Matters: Dataset Diversification and Dual-Branch Network for Generalized AI-Generated Image Detection
par: Tasnim, Nusrat, et autres
Publié: (2026)
par: Tasnim, Nusrat, et autres
Publié: (2026)
Real-Time Deepfake Detection in the Real-World
par: Cavia, Bar, et autres
Publié: (2024)
par: Cavia, Bar, et autres
Publié: (2024)
Voice-Assisted Real-Time Traffic Sign Recognition System Using Convolutional Neural Network
par: Manawadu, Mayura, et autres
Publié: (2024)
par: Manawadu, Mayura, et autres
Publié: (2024)
Face2Parts: Exploring Coarse-to-Fine Inter-Regional Facial Dependencies for Generalized Deepfake Detection
par: Uddin, Kutub, et autres
Publié: (2026)
par: Uddin, Kutub, et autres
Publié: (2026)
Deep Learning-Powered Visual SLAM Aimed at Assisting Visually Impaired Navigation
par: Bamdad, Marziyeh, et autres
Publié: (2025)
par: Bamdad, Marziyeh, et autres
Publié: (2025)
Money Recognition for the Visually Impaired: A Case Study on Sri Lankan Banknotes
par: Bandara, Akshaan
Publié: (2025)
par: Bandara, Akshaan
Publié: (2025)
AMAVA: Adaptive Motion-Aware Video-to-Audio Framework for Visually-Impaired Assistance
par: Klein, Benjamin, et autres
Publié: (2026)
par: Klein, Benjamin, et autres
Publié: (2026)
Efficient Visual Anomaly Detection at the Edge: Enabling Real-Time Industrial Inspection on Resource-Constrained Devices
par: Stropeni, Arianna, et autres
Publié: (2026)
par: Stropeni, Arianna, et autres
Publié: (2026)
Robust and Real-Time Bangladeshi Currency Recognition: A Dual-Stream MobileNet and EfficientNet Approach
par: Subreena, et autres
Publié: (2026)
par: Subreena, et autres
Publié: (2026)
Real-time Bangla Sign Language Translator
par: Pranto, Rotan Hawlader, et autres
Publié: (2024)
par: Pranto, Rotan Hawlader, et autres
Publié: (2024)
FastTracker: Real-Time and Accurate Visual Tracking
par: Hashempoor, Hamidreza, et autres
Publié: (2025)
par: Hashempoor, Hamidreza, et autres
Publié: (2025)
Real-Time Privacy Preservation for Robot Visual Perception
par: Choi, Minkyu, et autres
Publié: (2025)
par: Choi, Minkyu, et autres
Publié: (2025)
Uncovering Critical Features for Deepfake Detection through the Lottery Ticket Hypothesis
par: Amin, Lisan Al, et autres
Publié: (2025)
par: Amin, Lisan Al, et autres
Publié: (2025)
ACCSAMS: Automatic Conversion of Exam Documents to Accessible Learning Material for Blind and Visually Impaired
par: Wilkening, David, et autres
Publié: (2024)
par: Wilkening, David, et autres
Publié: (2024)
AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations
par: Cai, Zhixi, et autres
Publié: (2025)
par: Cai, Zhixi, et autres
Publié: (2025)
An IoT-Enabled Smart Aquarium System for Real-Time Water Quality Monitoring and Automated Feeding
par: Ayon, MD Fatin Ishraque, et autres
Publié: (2026)
par: Ayon, MD Fatin Ishraque, et autres
Publié: (2026)
A Visually Impaired Assistance Benchmark for VLM-as-a-Judge Evaluation
par: Zhao, Yi, et autres
Publié: (2026)
par: Zhao, Yi, et autres
Publié: (2026)
LiDAR-based Object Detection with Real-time Voice Specifications
par: Kulkarni, Anurag
Publié: (2025)
par: Kulkarni, Anurag
Publié: (2025)
AquaFuse: Waterbody Fusion for Physics Guided View Synthesis of Underwater Scenes
par: Siddique, Md Abu Bakr, et autres
Publié: (2024)
par: Siddique, Md Abu Bakr, et autres
Publié: (2024)
An Embedded Real-time Object Alert System for Visually Impaired: A Monocular Depth Estimation based Approach through Computer Vision
par: Anjom, Jareen, et autres
Publié: (2025)
par: Anjom, Jareen, et autres
Publié: (2025)
RTGen: Real-Time Generative Detection Transformer
par: Ruan, Chi, et autres
Publié: (2025)
par: Ruan, Chi, et autres
Publié: (2025)
Heeding the Inner Voice: Aligning ControlNet Training via Intermediate Features Feedback
par: Konovalova, Nina, et autres
Publié: (2025)
par: Konovalova, Nina, et autres
Publié: (2025)
MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing
par: Kadambi, Shreya, et autres
Publié: (2025)
par: Kadambi, Shreya, et autres
Publié: (2025)
Pavlok-Nudge: A Feedback Mechanism for Atomic Behaviour Modification with Snoring Usecase
par: Hasan, Md Rakibul, et autres
Publié: (2023)
par: Hasan, Md Rakibul, et autres
Publié: (2023)
Documents similaires
-
DB-FGA-Net: Dual Backbone Frequency Gated Attention Network for Multi-Class Brain Tumor Classification with Grad-CAM Interpretability
par: Shreya, Saraf Anzum, et autres
Publié: (2025) -
Quantitative Currency Evaluation in Low-Resource Settings through Pattern Analysis to Assist Visually Impaired Users
par: Ovi, Md Sultanul Islam, et autres
Publié: (2025) -
Real-time Yemeni Currency Detection
par: AL-Edreesi, Edrees, et autres
Publié: (2024) -
DISHA: Low-Energy Sparse Transformer at Edge for Outdoor Navigation for the Visually Impaired Individuals
par: Nagil, Praveen, et autres
Publié: (2024) -
Real-Time Pill Identification for the Visually Impaired Using Deep Learning
par: Dang, Bo, et autres
Publié: (2024)