A CNN Based Framework for Unistroke Numeral Recognition in Air-Writing
Fuente:
arXiv
Guardado en:
| Autores principales: | Roy, Prasun, Ghosh, Subhankar, Pal, Umapada |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Position and Rotation Invariant Sign Language Recognition from 3D Kinect Data with Recurrent Neural Networks
por: Roy, Prasun, et al.
Publicado: (2020)
por: Roy, Prasun, et al.
Publicado: (2020)
STEFANN: Scene Text Editor using Font Adaptive Neural Network
por: Roy, Prasun, et al.
Publicado: (2019)
por: Roy, Prasun, et al.
Publicado: (2019)
Multi-scale Attention Guided Pose Transfer
por: Roy, Prasun, et al.
Publicado: (2022)
por: Roy, Prasun, et al.
Publicado: (2022)
Effects of Degradations on Deep Neural Network Architectures
por: Roy, Prasun, et al.
Publicado: (2018)
por: Roy, Prasun, et al.
Publicado: (2018)
Real-Time Hand Gesture Recognition: Integrating Skeleton-Based Data Fusion and Multi-Stream CNN
por: Yusuf, Oluwaleke, et al.
Publicado: (2024)
por: Yusuf, Oluwaleke, et al.
Publicado: (2024)
Finger in Camera Speaks Everything: Unconstrained Air-Writing for Real-World
por: Wu, Meiqi, et al.
Publicado: (2024)
por: Wu, Meiqi, et al.
Publicado: (2024)
Semantically Consistent Person Image Generation
por: Roy, Prasun, et al.
Publicado: (2023)
por: Roy, Prasun, et al.
Publicado: (2023)
Exploring Mutual Cross-Modal Attention for Context-Aware Human Affordance Generation
por: Roy, Prasun, et al.
Publicado: (2025)
por: Roy, Prasun, et al.
Publicado: (2025)
Scene Aware Person Image Generation through Global Contextual Conditioning
por: Roy, Prasun, et al.
Publicado: (2022)
por: Roy, Prasun, et al.
Publicado: (2022)
TIPS: Text-Induced Pose Synthesis
por: Roy, Prasun, et al.
Publicado: (2022)
por: Roy, Prasun, et al.
Publicado: (2022)
MVTN: A Multiscale Video Transformer Network for Hand Gesture Recognition
por: Garg, Mallika, et al.
Publicado: (2024)
por: Garg, Mallika, et al.
Publicado: (2024)
Multiscaled Multi-Head Attention-based Video Transformer Network for Hand Gesture Recognition
por: Garg, Mallika, et al.
Publicado: (2025)
por: Garg, Mallika, et al.
Publicado: (2025)
GestFormer: Multiscale Wavelet Pooling Transformer Network for Dynamic Hand Gesture Recognition
por: Garg, Mallika, et al.
Publicado: (2024)
por: Garg, Mallika, et al.
Publicado: (2024)
MathWriting: A Dataset For Handwritten Mathematical Expression Recognition
por: Gervais, Philippe, et al.
Publicado: (2024)
por: Gervais, Philippe, et al.
Publicado: (2024)
FASTER: A Font-Agnostic Scene Text Editing and Rendering Framework
por: Das, Alloy, et al.
Publicado: (2023)
por: Das, Alloy, et al.
Publicado: (2023)
Air Signing and Privacy-Preserving Signature Verification for Digital Documents
por: Sarveswarasarma, P., et al.
Publicado: (2024)
por: Sarveswarasarma, P., et al.
Publicado: (2024)
Night Eyes: A Reproducible Framework for Constellation-Based Corneal Reflection Matching
por: Maquiling, Virmarie, et al.
Publicado: (2026)
por: Maquiling, Virmarie, et al.
Publicado: (2026)
d-Sketch: Improving Visual Fidelity of Sketch-to-Image Translation with Pretrained Latent Diffusion Models without Retraining
por: Roy, Prasun, et al.
Publicado: (2025)
por: Roy, Prasun, et al.
Publicado: (2025)
ConvMixFormer- A Resource-efficient Convolution Mixer for Transformer-based Dynamic Hand Gesture Recognition
por: Garg, Mallika, et al.
Publicado: (2024)
por: Garg, Mallika, et al.
Publicado: (2024)
Methodology to Deploy CNN-Based Computer Vision Models on Immersive Wearable Devices
por: Malek, Kaveh, et al.
Publicado: (2024)
por: Malek, Kaveh, et al.
Publicado: (2024)
Learning Annotation Consensus for Continuous Emotion Recognition
por: Shoer, Ibrahim, et al.
Publicado: (2025)
por: Shoer, Ibrahim, et al.
Publicado: (2025)
A Dataset for Crucial Object Recognition in Blind and Low-Vision Individuals' Navigation
por: Islam, Md Touhidul, et al.
Publicado: (2024)
por: Islam, Md Touhidul, et al.
Publicado: (2024)
Unsupervised Domain Adaptation for RF-based Gesture Recognition
por: Zhang, Bin-Bin, et al.
Publicado: (2021)
por: Zhang, Bin-Bin, et al.
Publicado: (2021)
SOS: A Shuffle Order Strategy for Data Augmentation in Industrial Human Activity Recognition
por: Ha, Anh Tuan, et al.
Publicado: (2025)
por: Ha, Anh Tuan, et al.
Publicado: (2025)
Exploring Thermography Technology: A Comprehensive Facial Dataset for Face Detection, Recognition, and Emotion
por: Abuhussein, Mohamed Fawzi Abdelshafie, et al.
Publicado: (2024)
por: Abuhussein, Mohamed Fawzi Abdelshafie, et al.
Publicado: (2024)
EmoCLIP: A Vision-Language Method for Zero-Shot Video Facial Expression Recognition
por: Foteinopoulou, Niki Maria, et al.
Publicado: (2023)
por: Foteinopoulou, Niki Maria, et al.
Publicado: (2023)
WEAR: An Outdoor Sports Dataset for Wearable and Egocentric Activity Recognition
por: Bock, Marius, et al.
Publicado: (2023)
por: Bock, Marius, et al.
Publicado: (2023)
Video Joint-Embedding Predictive Architectures for Facial Expression Recognition
por: Eing, Lennart, et al.
Publicado: (2026)
por: Eing, Lennart, et al.
Publicado: (2026)
OccRobNet : Occlusion Robust Network for Accurate 3D Interacting Hand-Object Pose Estimation
por: Garg, Mallika, et al.
Publicado: (2025)
por: Garg, Mallika, et al.
Publicado: (2025)
OMG-Bench: A New Challenging Benchmark for Skeleton-based Online Micro Hand Gesture Recognition
por: Chang, Haochen, et al.
Publicado: (2025)
por: Chang, Haochen, et al.
Publicado: (2025)
DEFT-LLM: Disentangled Expert Feature Tuning for Micro-Expression Recognition
por: Zhang, Ren, et al.
Publicado: (2025)
por: Zhang, Ren, et al.
Publicado: (2025)
Efficient Expression Neutrality Estimation with Application to Face Recognition Utility Prediction
por: Grimmer, Marcel, et al.
Publicado: (2024)
por: Grimmer, Marcel, et al.
Publicado: (2024)
GLIMPSE : Real-Time Text Recognition and Contextual Understanding for VQA in Wearables
por: Ramachandran, Akhil, et al.
Publicado: (2026)
por: Ramachandran, Akhil, et al.
Publicado: (2026)
DeepSORT-Driven Visual Tracking Approach for Gesture Recognition in Interactive Systems
por: Zhang, Tong, et al.
Publicado: (2025)
por: Zhang, Tong, et al.
Publicado: (2025)
LiDAR-based Human Activity Recognition through Laplacian Spectral Analysis
por: Sharifipour, Sasan, et al.
Publicado: (2025)
por: Sharifipour, Sasan, et al.
Publicado: (2025)
DRG-Font: Dynamic Reference-Guided Few-shot Font Generation via Contrastive Style-Content Disentanglement
por: Chakraborty, Rejoy, et al.
Publicado: (2026)
por: Chakraborty, Rejoy, et al.
Publicado: (2026)
Shape vs. Context: Examining Human--AI Gaps in Ambiguous Japanese Character Recognition
por: Haraguchi, Daichi
Publicado: (2026)
por: Haraguchi, Daichi
Publicado: (2026)
The Latency Wall: Benchmarking Off-the-Shelf Emotion Recognition for Real-Time Virtual Avatars
por: Benyamin, Yarin
Publicado: (2026)
por: Benyamin, Yarin
Publicado: (2026)
egoEMOTION: Egocentric Vision and Physiological Signals for Emotion and Personality Recognition in Real-World Tasks
por: Jammot, Matthias, et al.
Publicado: (2025)
por: Jammot, Matthias, et al.
Publicado: (2025)
Towards Cross-Subject EMG Pattern Recognition via Dual-Branch Adversarial Feature Disentanglement
por: Niu, Xinyue, et al.
Publicado: (2025)
por: Niu, Xinyue, et al.
Publicado: (2025)
Ejemplares similares
-
Position and Rotation Invariant Sign Language Recognition from 3D Kinect Data with Recurrent Neural Networks
por: Roy, Prasun, et al.
Publicado: (2020) -
STEFANN: Scene Text Editor using Font Adaptive Neural Network
por: Roy, Prasun, et al.
Publicado: (2019) -
Multi-scale Attention Guided Pose Transfer
por: Roy, Prasun, et al.
Publicado: (2022) -
Effects of Degradations on Deep Neural Network Architectures
por: Roy, Prasun, et al.
Publicado: (2018) -
Real-Time Hand Gesture Recognition: Integrating Skeleton-Based Data Fusion and Multi-Stream CNN
por: Yusuf, Oluwaleke, et al.
Publicado: (2024)