Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation
Fuente:
arXiv
Saved in:
| Main Authors: | Kim, Jungeun, Jeon, Hyeongwoo, Bae, Jongseong, Kim, Ha Young |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DiffSLT: Enhancing Diversity in Sign Language Translation via Diffusion Model
by: Moon, JiHwan, et al.
Published: (2024)
by: Moon, JiHwan, et al.
Published: (2024)
Gloss-Free Sign Language Translation: An Unbiased Evaluation of Progress in the Field
by: Sincan, Ozge Mercanoglu, et al.
Published: (2026)
by: Sincan, Ozge Mercanoglu, et al.
Published: (2026)
Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation
by: Wong, Ryan, et al.
Published: (2024)
by: Wong, Ryan, et al.
Published: (2024)
Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion
by: Bae, Jongseong, et al.
Published: (2024)
by: Bae, Jongseong, et al.
Published: (2024)
FEA-SLT: A Gloss-Free End-to-End Framework for Facial-Expression-Aware Sign Language Translation
by: Tu, Guobin, et al.
Published: (2026)
by: Tu, Guobin, et al.
Published: (2026)
Improving Gloss-free Sign Language Translation by Reducing Representation Density
by: Ye, Jinhui, et al.
Published: (2024)
by: Ye, Jinhui, et al.
Published: (2024)
SignDPO: Multi-level Direct Preference Optimisation for Skeleton-based Gloss-free Sign Language Translation
by: Pu, Muxin, et al.
Published: (2026)
by: Pu, Muxin, et al.
Published: (2026)
A Spatio-Temporal Representation Learning as an Alternative to Traditional Glosses in Sign Language Translation and Production
by: Hwang, Eui Jun, et al.
Published: (2024)
by: Hwang, Eui Jun, et al.
Published: (2024)
Beyond Gloss: A Hand-Centric Framework for Gloss-Free Sign Language Translation
by: Asasi, Sobhan, et al.
Published: (2025)
by: Asasi, Sobhan, et al.
Published: (2025)
C${^2}$RL: Content and Context Representation Learning for Gloss-free Sign Language Translation and Retrieval
by: Chen, Zhigang, et al.
Published: (2024)
by: Chen, Zhigang, et al.
Published: (2024)
Hierarchical Feature Alignment for Gloss-Free Sign Language Translation
by: Asasi, Sobhan, et al.
Published: (2025)
by: Asasi, Sobhan, et al.
Published: (2025)
MVFormer: Diversifying Feature Normalization and Token Mixing for Efficient Vision Transformers
by: Bae, Jongseong, et al.
Published: (2024)
by: Bae, Jongseong, et al.
Published: (2024)
GLOS: Sign Language Generation with Temporally Aligned Gloss-Level Conditioning
by: Lee, Taeryung, et al.
Published: (2025)
by: Lee, Taeryung, et al.
Published: (2025)
ChatEXAONEPath: An Expert-level Multimodal Large Language Model for Histopathology Using Whole Slide Images
by: Kim, Sangwook, et al.
Published: (2025)
by: Kim, Sangwook, et al.
Published: (2025)
Gloss2Text: Sign Language Gloss translation using LLMs and Semantically Aware Label Smoothing
by: Fayyazsanavi, Pooya, et al.
Published: (2024)
by: Fayyazsanavi, Pooya, et al.
Published: (2024)
Contrastive Pretraining with Dual Visual Encoders for Gloss-Free Sign Language Translation
by: Sincan, Ozge Mercanoglu, et al.
Published: (2025)
by: Sincan, Ozge Mercanoglu, et al.
Published: (2025)
RVLF: A Reinforcing Vision-Language Framework for Gloss-Free Sign Language Translation
by: Rao, Zhi, et al.
Published: (2025)
by: Rao, Zhi, et al.
Published: (2025)
Towards Temporal Fusion Beyond the Field of View for Camera-based Semantic Scene Completion
by: Bae, Jongseong, et al.
Published: (2025)
by: Bae, Jongseong, et al.
Published: (2025)
Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation
by: Guo, Jianyuan, et al.
Published: (2025)
by: Guo, Jianyuan, et al.
Published: (2025)
SAGE: Segment-Aware Gloss-Free Encoding for Token-Efficient Sign Language Translation
by: Low, JianHe, et al.
Published: (2025)
by: Low, JianHe, et al.
Published: (2025)
Think in Latent Thoughts: A New Paradigm for Gloss-Free Sign Language Translation
by: Jiang, Yiyang, et al.
Published: (2026)
by: Jiang, Yiyang, et al.
Published: (2026)
SignDATA: Data Pipeline for Sign Language Translation
by: Chen, Kuanwei, et al.
Published: (2026)
by: Chen, Kuanwei, et al.
Published: (2026)
Fingerspelling within Sign Language Translation
by: Tanzer, Garrett
Published: (2024)
by: Tanzer, Garrett
Published: (2024)
LLMs are Good Sign Language Translators
by: Gong, Jia, et al.
Published: (2024)
by: Gong, Jia, et al.
Published: (2024)
Direct Translation between Sign Languages
by: Wu, Zetian, et al.
Published: (2026)
by: Wu, Zetian, et al.
Published: (2026)
Using Sign Language Production as Data Augmentation to enhance Sign Language Translation
by: Walsh, Harry, et al.
Published: (2025)
by: Walsh, Harry, et al.
Published: (2025)
Autoregressive Sign Language Production: A Gloss-Free Approach with Discrete Representations
by: Hwang, Eui Jun, et al.
Published: (2023)
by: Hwang, Eui Jun, et al.
Published: (2023)
American Sign Language Video to Text Translation
by: Roy, Parsheeta, et al.
Published: (2024)
by: Roy, Parsheeta, et al.
Published: (2024)
Spatio-temporal Sign Language Representation and Translation
by: Hamidullah, Yasser, et al.
Published: (2025)
by: Hamidullah, Yasser, et al.
Published: (2025)
SignBind-LLM: Multi-Stage Modality Fusion for Sign Language Translation
by: Thomas, Marshall, et al.
Published: (2025)
by: Thomas, Marshall, et al.
Published: (2025)
Scaling Sign Language Translation
by: Zhang, Biao, et al.
Published: (2024)
by: Zhang, Biao, et al.
Published: (2024)
ESREAL: Exploiting Semantic Reconstruction to Mitigate Hallucinations in Vision-Language Models
by: Kim, Minchan, et al.
Published: (2024)
by: Kim, Minchan, et al.
Published: (2024)
Bangla Sign Language Translation: Dataset Creation Challenges, Benchmarking and Prospects
by: Rubaiyeat, Husne Ara, et al.
Published: (2025)
by: Rubaiyeat, Husne Ara, et al.
Published: (2025)
Visually Guided Decoding: Gradient-Free Hard Prompt Inversion with Language Models
by: Kim, Donghoon, et al.
Published: (2025)
by: Kim, Donghoon, et al.
Published: (2025)
An Efficient Sign Language Translation Using Spatial Configuration and Motion Dynamics with LLMs
by: Hwang, Eui Jun, et al.
Published: (2024)
by: Hwang, Eui Jun, et al.
Published: (2024)
Real-time Bangla Sign Language Translator
by: Pranto, Rotan Hawlader, et al.
Published: (2024)
by: Pranto, Rotan Hawlader, et al.
Published: (2024)
AutoSign: Direct Pose-to-Text Translation for Continuous Sign Language Recognition
by: Johnny, Samuel Ebimobowei, et al.
Published: (2025)
by: Johnny, Samuel Ebimobowei, et al.
Published: (2025)
Towards Compact Sign Language Translation: Frame Rate and Model Size Trade-offs
by: Chen, Kuanwei, et al.
Published: (2026)
by: Chen, Kuanwei, et al.
Published: (2026)
Drawing the Line: Enhancing Trustworthiness of MLLMs Through the Power of Refusal
by: Wang, Yuhao, et al.
Published: (2024)
by: Wang, Yuhao, et al.
Published: (2024)
VARCO-VISION: Expanding Frontiers in Korean Vision-Language Models
by: Ju, Jeongho, et al.
Published: (2024)
by: Ju, Jeongho, et al.
Published: (2024)
Similar Items
-
DiffSLT: Enhancing Diversity in Sign Language Translation via Diffusion Model
by: Moon, JiHwan, et al.
Published: (2024) -
Gloss-Free Sign Language Translation: An Unbiased Evaluation of Progress in the Field
by: Sincan, Ozge Mercanoglu, et al.
Published: (2026) -
Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation
by: Wong, Ryan, et al.
Published: (2024) -
Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion
by: Bae, Jongseong, et al.
Published: (2024) -
FEA-SLT: A Gloss-Free End-to-End Framework for Facial-Expression-Aware Sign Language Translation
by: Tu, Guobin, et al.
Published: (2026)