SignVLA: A Gloss-Free Vision-Language-Action Framework for Real-Time Sign Language-Guided Robotic Manipulation
Fuente:
arXiv
Guardado en:
| Autores principales: | Tan, Xinyu, Bai, Ningwei, Gardener, Harry, Zhong, Zhengyang, Zhang, Luoyu, Yang, Liuhaichen, Duan, Zhekai, Galeitsiwe, Monkgogi, Tang, Zezhi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RVLF: A Reinforcing Vision-Language Framework for Gloss-Free Sign Language Translation
por: Rao, Zhi, et al.
Publicado: (2025)
por: Rao, Zhi, et al.
Publicado: (2025)
Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation
por: Wong, Ryan, et al.
Publicado: (2024)
por: Wong, Ryan, et al.
Publicado: (2024)
Sign Language Gloss Embedding Models
por: McGill, Euan, et al.
Publicado: (2024)
por: McGill, Euan, et al.
Publicado: (2024)
Beyond Gloss: A Hand-Centric Framework for Gloss-Free Sign Language Translation
por: Asasi, Sobhan, et al.
Publicado: (2025)
por: Asasi, Sobhan, et al.
Publicado: (2025)
Selective Contrastive Learning For Gloss Free Sign Language Translation
por: Lai, Changhao, et al.
Publicado: (2026)
por: Lai, Changhao, et al.
Publicado: (2026)
Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation
por: Kim, Jungeun, et al.
Publicado: (2024)
por: Kim, Jungeun, et al.
Publicado: (2024)
Hierarchical Feature Alignment for Gloss-Free Sign Language Translation
por: Asasi, Sobhan, et al.
Publicado: (2025)
por: Asasi, Sobhan, et al.
Publicado: (2025)
Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation
por: Guo, Jianyuan, et al.
Publicado: (2025)
por: Guo, Jianyuan, et al.
Publicado: (2025)
Text2Sign Diffusion: A Generative Approach for Gloss-Free Sign Language Production
por: Feng, Liqian, et al.
Publicado: (2025)
por: Feng, Liqian, et al.
Publicado: (2025)
Gloss-Free Sign Language Translation: An Unbiased Evaluation of Progress in the Field
por: Sincan, Ozge Mercanoglu, et al.
Publicado: (2026)
por: Sincan, Ozge Mercanoglu, et al.
Publicado: (2026)
Contrastive Pretraining with Dual Visual Encoders for Gloss-Free Sign Language Translation
por: Sincan, Ozge Mercanoglu, et al.
Publicado: (2025)
por: Sincan, Ozge Mercanoglu, et al.
Publicado: (2025)
Autoregressive Sign Language Production: A Gloss-Free Approach with Discrete Representations
por: Hwang, Eui Jun, et al.
Publicado: (2023)
por: Hwang, Eui Jun, et al.
Publicado: (2023)
Multilingual Gloss-free Sign Language Translation: Towards Building a Sign Language Foundation Model
por: Tan, Sihan, et al.
Publicado: (2025)
por: Tan, Sihan, et al.
Publicado: (2025)
SAGE: Segment-Aware Gloss-Free Encoding for Token-Efficient Sign Language Translation
por: Low, JianHe, et al.
Publicado: (2025)
por: Low, JianHe, et al.
Publicado: (2025)
Think in Latent Thoughts: A New Paradigm for Gloss-Free Sign Language Translation
por: Jiang, Yiyang, et al.
Publicado: (2026)
por: Jiang, Yiyang, et al.
Publicado: (2026)
Gloss2Text: Sign Language Gloss translation using LLMs and Semantically Aware Label Smoothing
por: Fayyazsanavi, Pooya, et al.
Publicado: (2024)
por: Fayyazsanavi, Pooya, et al.
Publicado: (2024)
Continuous Sign Language Recognition Using Intra-inter Gloss Attention
por: Ranjbar, Hossein, et al.
Publicado: (2024)
por: Ranjbar, Hossein, et al.
Publicado: (2024)
GLOS: Sign Language Generation with Temporally Aligned Gloss-Level Conditioning
por: Lee, Taeryung, et al.
Publicado: (2025)
por: Lee, Taeryung, et al.
Publicado: (2025)
Improving Gloss-free Sign Language Translation by Reducing Representation Density
por: Ye, Jinhui, et al.
Publicado: (2024)
por: Ye, Jinhui, et al.
Publicado: (2024)
SignDPO: Multi-level Direct Preference Optimisation for Skeleton-based Gloss-free Sign Language Translation
por: Pu, Muxin, et al.
Publicado: (2026)
por: Pu, Muxin, et al.
Publicado: (2026)
Factorized Learning Assisted with Large Language Model for Gloss-free Sign Language Translation
por: Chen, Zhigang, et al.
Publicado: (2024)
por: Chen, Zhigang, et al.
Publicado: (2024)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
por: Wang, Hongyu, et al.
Publicado: (2025)
por: Wang, Hongyu, et al.
Publicado: (2025)
Using Sign Language Production as Data Augmentation to enhance Sign Language Translation
por: Walsh, Harry, et al.
Publicado: (2025)
por: Walsh, Harry, et al.
Publicado: (2025)
Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation
por: Fan, Yiguo, et al.
Publicado: (2025)
por: Fan, Yiguo, et al.
Publicado: (2025)
FEA-SLT: A Gloss-Free End-to-End Framework for Facial-Expression-Aware Sign Language Translation
por: Tu, Guobin, et al.
Publicado: (2026)
por: Tu, Guobin, et al.
Publicado: (2026)
Sign Stitching: A Novel Approach to Sign Language Production
por: Walsh, Harry, et al.
Publicado: (2024)
por: Walsh, Harry, et al.
Publicado: (2024)
Continuous Bangla Sign Language Translation: Mitigating the Expense of Gloss Annotation with the Assistance of Graph
por: Arib, Safaeid Hossain, et al.
Publicado: (2025)
por: Arib, Safaeid Hossain, et al.
Publicado: (2025)
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
por: Yan, Hongyu, et al.
Publicado: (2026)
por: Yan, Hongyu, et al.
Publicado: (2026)
VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
por: Sun, Jingwen, et al.
Publicado: (2026)
por: Sun, Jingwen, et al.
Publicado: (2026)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
por: Shi, Hao, et al.
Publicado: (2025)
por: Shi, Hao, et al.
Publicado: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
por: Li, Runhao, et al.
Publicado: (2025)
por: Li, Runhao, et al.
Publicado: (2025)
EveryDayVLA: A Vision-Language-Action Model for Affordable Robotic Manipulation
por: Chopra, Samarth, et al.
Publicado: (2025)
por: Chopra, Samarth, et al.
Publicado: (2025)
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
por: Peng, Xiongfeng, et al.
Publicado: (2026)
por: Peng, Xiongfeng, et al.
Publicado: (2026)
Sign Language: Towards Sign Understanding for Robot Autonomy
por: Agrawal, Ayush, et al.
Publicado: (2025)
por: Agrawal, Ayush, et al.
Publicado: (2025)
AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation
por: Sun, Jianli, et al.
Publicado: (2026)
por: Sun, Jianli, et al.
Publicado: (2026)
A Spatio-Temporal Representation Learning as an Alternative to Traditional Glosses in Sign Language Translation and Production
por: Hwang, Eui Jun, et al.
Publicado: (2024)
por: Hwang, Eui Jun, et al.
Publicado: (2024)
Introducing A Bangla Sentence - Gloss Pair Dataset for Bangla Sign Language Translation and Research
por: Saha, Neelavro, et al.
Publicado: (2025)
por: Saha, Neelavro, et al.
Publicado: (2025)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
por: Wei, Xiangyi, et al.
Publicado: (2025)
por: Wei, Xiangyi, et al.
Publicado: (2025)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
por: Gbagbe, Koffivi Fidèle, et al.
Publicado: (2024)
por: Gbagbe, Koffivi Fidèle, et al.
Publicado: (2024)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
por: Wen, Junjie, et al.
Publicado: (2024)
por: Wen, Junjie, et al.
Publicado: (2024)
Ejemplares similares
-
RVLF: A Reinforcing Vision-Language Framework for Gloss-Free Sign Language Translation
por: Rao, Zhi, et al.
Publicado: (2025) -
Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language Translation
por: Wong, Ryan, et al.
Publicado: (2024) -
Sign Language Gloss Embedding Models
por: McGill, Euan, et al.
Publicado: (2024) -
Beyond Gloss: A Hand-Centric Framework for Gloss-Free Sign Language Translation
por: Asasi, Sobhan, et al.
Publicado: (2025) -
Selective Contrastive Learning For Gloss Free Sign Language Translation
por: Lai, Changhao, et al.
Publicado: (2026)