MultimodalHugs: Enabling Sign Language Processing in Hugging Face
Fuente:
arXiv
Guardado en:
| Autores principales: | Sant, Gerard, Jiang, Zifan, Escolano, Carlos, Moryossef, Amit, Müller, Mathias, Sennrich, Rico, Ebling, Sarah |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SignCLIP: Connecting Text and Sign Language by Contrastive Learning
por: Jiang, Zifan, et al.
Publicado: (2024)
por: Jiang, Zifan, et al.
Publicado: (2024)
Pose-Based Sign Language Appearance Transfer
por: Moryossef, Amit, et al.
Publicado: (2024)
por: Moryossef, Amit, et al.
Publicado: (2024)
Real-Time Multilingual Sign Language Processing
por: Moryossef, Amit
Publicado: (2024)
por: Moryossef, Amit
Publicado: (2024)
SignBank+: Preparing a Multilingual Sign Language Dataset for Machine Translation Using Large Language Models
por: Moryossef, Amit, et al.
Publicado: (2023)
por: Moryossef, Amit, et al.
Publicado: (2023)
Meaningful Pose-Based Sign Language Evaluation
por: Jiang, Zifan, et al.
Publicado: (2025)
por: Jiang, Zifan, et al.
Publicado: (2025)
Evaluation of Pose Estimation Systems for Sign Language Translation
por: O'Brien, Catherine, et al.
Publicado: (2026)
por: O'Brien, Catherine, et al.
Publicado: (2026)
Can Large Language Models Help Multimodal Language Analysis? MMLA: A Comprehensive Benchmark
por: Zhang, Hanlei, et al.
Publicado: (2025)
por: Zhang, Hanlei, et al.
Publicado: (2025)
sign.mt: Real-Time Multilingual Sign Language Translation Application
por: Moryossef, Amit
Publicado: (2023)
por: Moryossef, Amit
Publicado: (2023)
Traj-MLLM: Can Multimodal Large Language Models Reform Trajectory Data Mining?
por: Liu, Shuo, et al.
Publicado: (2025)
por: Liu, Shuo, et al.
Publicado: (2025)
Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal Utterances
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
Text2Sign Diffusion: A Generative Approach for Gloss-Free Sign Language Production
por: Feng, Liqian, et al.
Publicado: (2025)
por: Feng, Liqian, et al.
Publicado: (2025)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
por: Wu, Zichen, et al.
Publicado: (2025)
por: Wu, Zichen, et al.
Publicado: (2025)
A Survey on Image-text Multimodal Models
por: Guo, Ruifeng, et al.
Publicado: (2023)
por: Guo, Ruifeng, et al.
Publicado: (2023)
Interpretable Multimodal Misinformation Detection with Logic Reasoning
por: Liu, Hui, et al.
Publicado: (2023)
por: Liu, Hui, et al.
Publicado: (2023)
Towards Robust Multimodal Sentiment Analysis with Incomplete Data
por: Zhang, Haoyu, et al.
Publicado: (2024)
por: Zhang, Haoyu, et al.
Publicado: (2024)
DLF: Disentangled-Language-Focused Multimodal Sentiment Analysis
por: Wang, Pan, et al.
Publicado: (2024)
por: Wang, Pan, et al.
Publicado: (2024)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2025)
por: Zhou, Qianrui, et al.
Publicado: (2025)
Enhancing Multimodal Affective Analysis with Learned Live Comment Features
por: Deng, Zhaoyuan, et al.
Publicado: (2024)
por: Deng, Zhaoyuan, et al.
Publicado: (2024)
A Survey of Generative Categories and Techniques in Multimodal Generative Models
por: Han, Longzhen, et al.
Publicado: (2025)
por: Han, Longzhen, et al.
Publicado: (2025)
Shapley Value-based Contrastive Alignment for Multimodal Information Extraction
por: Luo, Wen, et al.
Publicado: (2024)
por: Luo, Wen, et al.
Publicado: (2024)
A Multimodal Framework for Explainable Evaluation of Soft Skills in Educational Environments
por: Guerrero-Sosa, Jared D. T., et al.
Publicado: (2025)
por: Guerrero-Sosa, Jared D. T., et al.
Publicado: (2025)
Knowledge-Guided Dynamic Modality Attention Fusion Framework for Multimodal Sentiment Analysis
por: Feng, Xinyu, et al.
Publicado: (2024)
por: Feng, Xinyu, et al.
Publicado: (2024)
GeoGuess: Multimodal Reasoning based on Hierarchy of Visual Information in Street View
por: Cheng, Fenghua, et al.
Publicado: (2025)
por: Cheng, Fenghua, et al.
Publicado: (2025)
SemEval-2024 Task 3: Multimodal Emotion Cause Analysis in Conversations
por: Wang, Fanfan, et al.
Publicado: (2024)
por: Wang, Fanfan, et al.
Publicado: (2024)
HuggingGraph: Understanding the Supply Chain of LLM Ecosystem
por: Rahman, Mohammad Shahedur, et al.
Publicado: (2025)
por: Rahman, Mohammad Shahedur, et al.
Publicado: (2025)
PTA: Enhancing Multimodal Sentiment Analysis through Pipelined Prediction and Translation-based Alignment
por: Song, Shezheng, et al.
Publicado: (2024)
por: Song, Shezheng, et al.
Publicado: (2024)
Temporal-Spatial Decouple before Act: Disentangled Representation Learning for Multimodal Sentiment Analysis
por: Meng, Chunlei, et al.
Publicado: (2026)
por: Meng, Chunlei, et al.
Publicado: (2026)
SIN-Bench: Tracing Native Evidence Chains in Long-Context Multimodal Scientific Interleaved Literature
por: Ren, Yiming, et al.
Publicado: (2026)
por: Ren, Yiming, et al.
Publicado: (2026)
Tailored Teaching with Balanced Difficulty: Elevating Reasoning in Multimodal Chain-of-Thought via Prompt Curriculum
por: Yang, Xinglong, et al.
Publicado: (2025)
por: Yang, Xinglong, et al.
Publicado: (2025)
Doctor Sun: A Bilingual Multimodal Large Language Model for Biomedical AI
por: Xue, Dong, et al.
Publicado: (2025)
por: Xue, Dong, et al.
Publicado: (2025)
Sample then Identify: A General Framework for Risk Control and Assessment in Multimodal Large Language Models
por: Wang, Qingni, et al.
Publicado: (2024)
por: Wang, Qingni, et al.
Publicado: (2024)
Multimodal Misinformation Detection using Large Vision-Language Models
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
Retrieval-Augmented Generation for Electrocardiogram-Language Models
por: Song, Xiaoyu, et al.
Publicado: (2025)
por: Song, Xiaoyu, et al.
Publicado: (2025)
Medical MLLM is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models
por: Huang, Xijie, et al.
Publicado: (2024)
por: Huang, Xijie, et al.
Publicado: (2024)
HugAgent: Benchmarking LLMs for Simulation of Individualized Human Reasoning
por: Li, Chance Jiajie, et al.
Publicado: (2025)
por: Li, Chance Jiajie, et al.
Publicado: (2025)
OmnixR: Evaluating Omni-modality Language Models on Reasoning across Modalities
por: Chen, Lichang, et al.
Publicado: (2024)
por: Chen, Lichang, et al.
Publicado: (2024)
MusicAIR: A Multimodal AI Music Generation Framework Powered by an Algorithm-Driven Core
por: Liao, Callie C., et al.
Publicado: (2025)
por: Liao, Callie C., et al.
Publicado: (2025)
A Bounding Box is Worth One Token: Interleaving Layout and Text in a Large Language Model for Document Understanding
por: Lu, Jinghui, et al.
Publicado: (2024)
por: Lu, Jinghui, et al.
Publicado: (2024)
Multimodal LLMs Can Reason about Aesthetics in Zero-Shot
por: Jiang, Ruixiang, et al.
Publicado: (2025)
por: Jiang, Ruixiang, et al.
Publicado: (2025)
SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing
por: Ma, Ziyang, et al.
Publicado: (2026)
por: Ma, Ziyang, et al.
Publicado: (2026)
Ejemplares similares
-
SignCLIP: Connecting Text and Sign Language by Contrastive Learning
por: Jiang, Zifan, et al.
Publicado: (2024) -
Pose-Based Sign Language Appearance Transfer
por: Moryossef, Amit, et al.
Publicado: (2024) -
Real-Time Multilingual Sign Language Processing
por: Moryossef, Amit
Publicado: (2024) -
SignBank+: Preparing a Multilingual Sign Language Dataset for Machine Translation Using Large Language Models
por: Moryossef, Amit, et al.
Publicado: (2023) -
Meaningful Pose-Based Sign Language Evaluation
por: Jiang, Zifan, et al.
Publicado: (2025)