From Rule-Based Models to Deep Learning Transformers Architectures for Natural Language Processing and Sign Language Translation Systems: Survey, Taxonomy and Performance Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Shahin, Nada, Ismail, Leila |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ADAT: Time-Series-Aware Adaptive Transformer Architecture for Sign Language Translation
por: Shahin, Nada, et al.
Publicado: (2025)
por: Shahin, Nada, et al.
Publicado: (2025)
GLoT: A Novel Gated-Logarithmic Transformer for Efficient Sign Language Translation
por: Shahin, Nada, et al.
Publicado: (2025)
por: Shahin, Nada, et al.
Publicado: (2025)
HATL: Hierarchical Adaptive-Transfer Learning Framework for Sign Language Machine Translation
por: Shahin, Nada, et al.
Publicado: (2026)
por: Shahin, Nada, et al.
Publicado: (2026)
Chat-Driven Text Generation and Interaction for Person Retrieval
por: Xie, Zequn, et al.
Publicado: (2025)
por: Xie, Zequn, et al.
Publicado: (2025)
Cytoarchitecture in Words: Weakly Supervised Vision-Language Modeling for Human Brain Microscopy
por: Sutton, Matthew, et al.
Publicado: (2026)
por: Sutton, Matthew, et al.
Publicado: (2026)
Scaling Large Vision-Language Models for Enhanced Multimodal Comprehension In Biomedical Image Analysis
por: Umeike, Robinson, et al.
Publicado: (2025)
por: Umeike, Robinson, et al.
Publicado: (2025)
Motion-Based Sign Language Video Summarization using Curvature and Torsion
por: Sartinas, Evangelos G., et al.
Publicado: (2023)
por: Sartinas, Evangelos G., et al.
Publicado: (2023)
MOVE: A Mixture-of-Vision-Encoders Approach for Domain-Focused Vision-Language Processing
por: Skripkin, Matvey, et al.
Publicado: (2025)
por: Skripkin, Matvey, et al.
Publicado: (2025)
FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models
por: Dua, Karan, et al.
Publicado: (2025)
por: Dua, Karan, et al.
Publicado: (2025)
ChatGPT, Let us Chat Sign Language: Experiments, Architectural Elements, Challenges and Research Directions
por: Shahin, Nada, et al.
Publicado: (2024)
por: Shahin, Nada, et al.
Publicado: (2024)
Deep Learning based Key Information Extraction from Business Documents: Systematic Literature Review
por: Rombach, Alexander Michael, et al.
Publicado: (2024)
por: Rombach, Alexander Michael, et al.
Publicado: (2024)
WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation
por: Niu, Yuwei, et al.
Publicado: (2025)
por: Niu, Yuwei, et al.
Publicado: (2025)
Cross-Lingual Generalization and Compression: From Language-Specific to Shared Neurons
por: Riemenschneider, Frederick, et al.
Publicado: (2025)
por: Riemenschneider, Frederick, et al.
Publicado: (2025)
Semantic Similarity is a Spurious Measure of Comic Understanding: Lessons Learned from Hallucinations in a Benchmarking Experiment
por: Driggers-Ellis, Christopher, et al.
Publicado: (2026)
por: Driggers-Ellis, Christopher, et al.
Publicado: (2026)
KidsNanny: A Two-Stage Multimodal Content Moderation Pipeline Integrating Visual Classification, Object Detection, OCR, and Contextual Reasoning for Child Safety
por: Panchal, Viraj, et al.
Publicado: (2026)
por: Panchal, Viraj, et al.
Publicado: (2026)
Visual Aesthetic Benchmark: Can Frontier Models Judge Beauty?
por: Feng, Yichen, et al.
Publicado: (2026)
por: Feng, Yichen, et al.
Publicado: (2026)
YETI (YET to Intervene) Proactive Interventions by Multimodal AI Agents in Augmented Reality Tasks
por: Bandyopadhyay, Saptarashmi, et al.
Publicado: (2025)
por: Bandyopadhyay, Saptarashmi, et al.
Publicado: (2025)
Training-Free Diffusion Priors for Text-to-Image Generation via Optimization-based Visual Inversion
por: Dell'Erba, Samuele, et al.
Publicado: (2025)
por: Dell'Erba, Samuele, et al.
Publicado: (2025)
Kastor: Fine-tuned Small Language Models for Shape-based Active Relation Extraction
por: Celian, Ringwald, et al.
Publicado: (2025)
por: Celian, Ringwald, et al.
Publicado: (2025)
Robustness of Large Language Models to Perturbations in Text
por: Singh, Ayush, et al.
Publicado: (2024)
por: Singh, Ayush, et al.
Publicado: (2024)
Unified Modeling Language Code Generation from Diagram Images Using Multimodal Large Language Models
por: Bates, Averi, et al.
Publicado: (2025)
por: Bates, Averi, et al.
Publicado: (2025)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
por: Chua, Jaymari, et al.
Publicado: (2025)
por: Chua, Jaymari, et al.
Publicado: (2025)
Scaling Laws for State Dynamics in Large Language Models
por: Li, Jacob X, et al.
Publicado: (2025)
por: Li, Jacob X, et al.
Publicado: (2025)
OkanNet: A Lightweight Deep Learning Architecture for Classification of Brain Tumor from MRI Images
por: Uçar, Okan, et al.
Publicado: (2026)
por: Uçar, Okan, et al.
Publicado: (2026)
DocShield: Towards AI Document Safety via Evidence-Grounded Agentic Reasoning
por: Zeng, Fanwei, et al.
Publicado: (2026)
por: Zeng, Fanwei, et al.
Publicado: (2026)
Pipeline and Dataset Generation for Automated Fact-checking in Almost Any Language
por: Drchal, Jan, et al.
Publicado: (2023)
por: Drchal, Jan, et al.
Publicado: (2023)
Automating Clinical Information Retrieval from Finnish Electronic Health Records Using Large Language Models
por: Saukkoriipi, Mikko, et al.
Publicado: (2026)
por: Saukkoriipi, Mikko, et al.
Publicado: (2026)
Systematic Comparison of Projection Methods for Monocular 3D Human Pose Estimation on Fisheye Images
por: Käs, Stephanie, et al.
Publicado: (2025)
por: Käs, Stephanie, et al.
Publicado: (2025)
Vision transformers in domain adaptation and domain generalization: a study of robustness
por: Alijani, Shadi, et al.
Publicado: (2024)
por: Alijani, Shadi, et al.
Publicado: (2024)
Language Predicts Identity Fusion Across Cultures and Reveals Divergent Pathways to Violence
por: Wright, Devin R., et al.
Publicado: (2026)
por: Wright, Devin R., et al.
Publicado: (2026)
Vision Transformer-based Model for Severity Quantification of Lung Pneumonia Using Chest X-ray Images
por: Slika, Bouthaina, et al.
Publicado: (2023)
por: Slika, Bouthaina, et al.
Publicado: (2023)
Improving LLMs with a knowledge from databases
por: Máša, Petr
Publicado: (2025)
por: Máša, Petr
Publicado: (2025)
CR-LT-KGQA: A Knowledge Graph Question Answering Dataset Requiring Commonsense Reasoning and Long-Tail Knowledge
por: Guo, Willis, et al.
Publicado: (2024)
por: Guo, Willis, et al.
Publicado: (2024)
Overcoming the Generalization Limits of SLM Finetuning for Shape-Based Extraction of Datatype and Object Properties
por: Ringwald, Célian, et al.
Publicado: (2025)
por: Ringwald, Célian, et al.
Publicado: (2025)
DIsoN: Decentralized Isolation Networks for Out-of-Distribution Detection in Medical Imaging
por: Wagner, Felix, et al.
Publicado: (2025)
por: Wagner, Felix, et al.
Publicado: (2025)
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
por: Aharon, Eliya Naomi, et al.
Publicado: (2026)
por: Aharon, Eliya Naomi, et al.
Publicado: (2026)
MIRAGE: Scaling Test-Time Inference with Parallel Graph-Retrieval-Augmented Reasoning Chains
por: Wei, Kaiwen, et al.
Publicado: (2025)
por: Wei, Kaiwen, et al.
Publicado: (2025)
Spatially-Aware Speaker for Vision-and-Language Navigation Instruction Generation
por: Gopinathan, Muraleekrishna, et al.
Publicado: (2024)
por: Gopinathan, Muraleekrishna, et al.
Publicado: (2024)
MeMo: Towards Language Models with Associative Memory Mechanisms
por: Zanzotto, Fabio Massimo, et al.
Publicado: (2025)
por: Zanzotto, Fabio Massimo, et al.
Publicado: (2025)
Ego-Motion Aware Target Prediction Module for Robust Multi-Object Tracking
por: Mahdian, Navid, et al.
Publicado: (2024)
por: Mahdian, Navid, et al.
Publicado: (2024)
Ejemplares similares
-
ADAT: Time-Series-Aware Adaptive Transformer Architecture for Sign Language Translation
por: Shahin, Nada, et al.
Publicado: (2025) -
GLoT: A Novel Gated-Logarithmic Transformer for Efficient Sign Language Translation
por: Shahin, Nada, et al.
Publicado: (2025) -
HATL: Hierarchical Adaptive-Transfer Learning Framework for Sign Language Machine Translation
por: Shahin, Nada, et al.
Publicado: (2026) -
Chat-Driven Text Generation and Interaction for Person Retrieval
por: Xie, Zequn, et al.
Publicado: (2025) -
Cytoarchitecture in Words: Weakly Supervised Vision-Language Modeling for Human Brain Microscopy
por: Sutton, Matthew, et al.
Publicado: (2026)