Breaking the Barriers: Video Vision Transformers for Word-Level Sign Language Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Brettmann, Alexander, Grävinghoff, Jakob, Rüschoff, Marlene, Westhues, Marie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks
par: Shawon, Jubayer Ahmed Bhuiyan, et autres
Publié: (2025)
par: Shawon, Jubayer Ahmed Bhuiyan, et autres
Publié: (2025)
MM-WLAuslan: Multi-View Multi-Modal Word-Level Australian Sign Language Recognition Dataset
par: Shen, Xin, et autres
Publié: (2024)
par: Shen, Xin, et autres
Publié: (2024)
ISLR101: an Iranian Word-Level Sign Language Recognition Dataset
par: Ranjbar, Hossein, et autres
Publié: (2025)
par: Ranjbar, Hossein, et autres
Publié: (2025)
Breaking the Encoder Barrier for Seamless Video-Language Understanding
par: Li, Handong, et autres
Publié: (2025)
par: Li, Handong, et autres
Publié: (2025)
Revolutionizing Traffic Sign Recognition: Unveiling the Potential of Vision Transformers
par: Mingwin, Susano, et autres
Publié: (2024)
par: Mingwin, Susano, et autres
Publié: (2024)
BdSLW60: A Word-Level Bangla Sign Language Dataset
par: Rubaiyeat, Husne Ara, et autres
Publié: (2024)
par: Rubaiyeat, Husne Ara, et autres
Publié: (2024)
Video-based Sign Language Recognition without Temporal Segmentation
par: Huang, Jie, et autres
Publié: (2018)
par: Huang, Jie, et autres
Publié: (2018)
LA-Sign: Looped Transformers with Geometry-aware Alignment for Skeleton-based Sign Language Recognition
par: Pu, Muxin, et autres
Publié: (2026)
par: Pu, Muxin, et autres
Publié: (2026)
Training Strategies for Isolated Sign Language Recognition
par: Kvanchiani, Karina, et autres
Publié: (2024)
par: Kvanchiani, Karina, et autres
Publié: (2024)
SegSLR: Promptable Video Segmentation for Isolated Sign Language Recognition
par: Schreiber, Sven, et autres
Publié: (2025)
par: Schreiber, Sven, et autres
Publié: (2025)
Logos as a Well-Tempered Pre-train for Sign Language Recognition
par: Ovodov, Ilya, et autres
Publié: (2025)
par: Ovodov, Ilya, et autres
Publié: (2025)
BdSLW401: Transformer-Based Word-Level Bangla Sign Language Recognition Using Relative Quantization Encoding (RQE)
par: Rubaiyeat, Husne Ara, et autres
Publié: (2025)
par: Rubaiyeat, Husne Ara, et autres
Publié: (2025)
Siformer: Feature-isolated Transformer for Efficient Skeleton-based Sign Language Recognition
par: Pu, Muxin, et autres
Publié: (2025)
par: Pu, Muxin, et autres
Publié: (2025)
EvSign: Sign Language Recognition and Translation with Streaming Events
par: Zhang, Pengyu, et autres
Publié: (2024)
par: Zhang, Pengyu, et autres
Publié: (2024)
Word-level Sign Language Recognition with Multi-stream Neural Networks Focusing on Local Regions and Skeletal Information
par: Maruyama, Mizuki, et autres
Publié: (2021)
par: Maruyama, Mizuki, et autres
Publié: (2021)
SignIT: A Comprehensive Dataset and Multimodal Analysis for Italian Sign Language Recognition
par: Micieli, Alessia, et autres
Publié: (2025)
par: Micieli, Alessia, et autres
Publié: (2025)
SignMAE: Segmentation-Driven Self-Supervised Learning for Sign Language Recognition
par: Xie, Kunyuan, et autres
Publié: (2026)
par: Xie, Kunyuan, et autres
Publié: (2026)
Stack Transformer Based Spatial-Temporal Attention Model for Dynamic Sign Language and Fingerspelling Recognition
par: Hirooka, Koki, et autres
Publié: (2025)
par: Hirooka, Koki, et autres
Publié: (2025)
Sign Language Recognition in the Age of LLMs
par: Javorek, Vaclav, et autres
Publié: (2026)
par: Javorek, Vaclav, et autres
Publié: (2026)
IlluSign: Illustrating Sign Language Videos by Leveraging the Attention Mechanism
par: Bruner, Janna, et autres
Publié: (2025)
par: Bruner, Janna, et autres
Publié: (2025)
BdSL-SPOTER: A Transformer-Based Framework for Bengali Sign Language Recognition with Cultural Adaptation
par: Azad, Sayad Ibna, et autres
Publié: (2025)
par: Azad, Sayad Ibna, et autres
Publié: (2025)
Cross-Modal Consistency Learning for Sign Language Recognition
par: Wu, Kepeng, et autres
Publié: (2025)
par: Wu, Kepeng, et autres
Publié: (2025)
Denoising-Contrastive Alignment for Continuous Sign Language Recognition
par: Guo, Leming, et autres
Publié: (2023)
par: Guo, Leming, et autres
Publié: (2023)
Towards Online Continuous Sign Language Recognition and Translation
par: Zuo, Ronglai, et autres
Publié: (2024)
par: Zuo, Ronglai, et autres
Publié: (2024)
FlashSign: Pose-Free Guidance for Efficient Sign Language Video Generation
par: Zhang, Liuzhou, et autres
Publié: (2026)
par: Zhang, Liuzhou, et autres
Publié: (2026)
Slovo: Russian Sign Language Dataset
par: Kapitanov, Alexander, et autres
Publié: (2023)
par: Kapitanov, Alexander, et autres
Publié: (2023)
Improving Continuous Sign Language Recognition with Adapted Image Models
par: Hu, Lianyu, et autres
Publié: (2024)
par: Hu, Lianyu, et autres
Publié: (2024)
Sign Language Recognition Based On Facial Expression and Hand Skeleton
par: Long, Zhiyu, et autres
Publié: (2024)
par: Long, Zhiyu, et autres
Publié: (2024)
Transfer Learning from Visual Speech Recognition to Mouthing Recognition in German Sign Language
par: Pham, Dinh Nam, et autres
Publié: (2025)
par: Pham, Dinh Nam, et autres
Publié: (2025)
DiffSign: AI-Assisted Generation of Customizable Sign Language Videos With Enhanced Realism
par: Krishnamurthy, Sudha, et autres
Publié: (2024)
par: Krishnamurthy, Sudha, et autres
Publié: (2024)
Disentangled Concepts Speak Louder Than Words: Explainable Video Action Recognition
par: Lee, Jongseo, et autres
Publié: (2025)
par: Lee, Jongseo, et autres
Publié: (2025)
Bukva: Russian Sign Language Alphabet
par: Kvanchiani, Karina, et autres
Publié: (2024)
par: Kvanchiani, Karina, et autres
Publié: (2024)
SignVTCL: Multi-Modal Continuous Sign Language Recognition Enhanced by Visual-Textual Contrastive Learning
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Beyond Words: AuralLLM and SignMST-C for Sign Language Production and Bidirectional Accessibility
par: Li, Yulong, et autres
Publié: (2025)
par: Li, Yulong, et autres
Publié: (2025)
Benchmarking Vision-Language Models on Optical Character Recognition in Dynamic Video Environments
par: Nagaonkar, Sankalp, et autres
Publié: (2025)
par: Nagaonkar, Sankalp, et autres
Publié: (2025)
Generative Sign-description Prompts with Multi-positive Contrastive Learning for Sign Language Recognition
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
Dual-view Spatio-Temporal Feature Fusion with CNN-Transformer Hybrid Network for Chinese Isolated Sign Language Recognition
par: Jing, Siyuan, et autres
Publié: (2025)
par: Jing, Siyuan, et autres
Publié: (2025)
Visual-Word Tokenizer: Beyond Fixed Sets of Tokens in Vision Transformers
par: Gee, Leonidas, et autres
Publié: (2024)
par: Gee, Leonidas, et autres
Publié: (2024)
Sign Language Recognition using Bidirectional Reservoir Computing
par: Singh, Nitin Kumar, et autres
Publié: (2025)
par: Singh, Nitin Kumar, et autres
Publié: (2025)
SSL-SLR: Self-Supervised Representation Learning for Sign Language Recognition
par: Madjoukeng, Ariel Basso, et autres
Publié: (2025)
par: Madjoukeng, Ariel Basso, et autres
Publié: (2025)
Documents similaires
-
Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks
par: Shawon, Jubayer Ahmed Bhuiyan, et autres
Publié: (2025) -
MM-WLAuslan: Multi-View Multi-Modal Word-Level Australian Sign Language Recognition Dataset
par: Shen, Xin, et autres
Publié: (2024) -
ISLR101: an Iranian Word-Level Sign Language Recognition Dataset
par: Ranjbar, Hossein, et autres
Publié: (2025) -
Breaking the Encoder Barrier for Seamless Video-Language Understanding
par: Li, Handong, et autres
Publié: (2025) -
Revolutionizing Traffic Sign Recognition: Unveiling the Potential of Vision Transformers
par: Mingwin, Susano, et autres
Publié: (2024)