Empowering the Deaf and Hard of Hearing Community: Enhancing Video Captions Using Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Fathallah, Nadeen, Bhole, Monika, Staab, Steffen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLMs4Life: Large Language Models for Ontology Learning in Life Sciences
por: Fathallah, Nadeen, et al.
Publicado: (2024)
por: Fathallah, Nadeen, et al.
Publicado: (2024)
AccessGuru: Leveraging LLMs to Detect and Correct Web Accessibility Violations in HTML Code
por: Fathallah, Nadeen, et al.
Publicado: (2025)
por: Fathallah, Nadeen, et al.
Publicado: (2025)
Retrieval-Augmented Generation of Ontologies from Relational Databases
por: Nayyeri, Mojtaba, et al.
Publicado: (2025)
por: Nayyeri, Mojtaba, et al.
Publicado: (2025)
From Tokens to Lattices: Emergent Lattice Structures in Language Models
por: Xiong, Bo, et al.
Publicado: (2025)
por: Xiong, Bo, et al.
Publicado: (2025)
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
por: Potyka, Nico, et al.
Publicado: (2023)
por: Potyka, Nico, et al.
Publicado: (2023)
Hybrid Reasoning Based on Large Language Models for Autonomous Car Driving
por: Azarafza, Mehdi, et al.
Publicado: (2024)
por: Azarafza, Mehdi, et al.
Publicado: (2024)
Captioning and Subtitling for d/Deaf and Hard of Hearing Audiences
por: Zárate, Soledad
Publicado: (2021)
por: Zárate, Soledad
Publicado: (2021)
Deaf and Hard of Hearing Access to Intelligent Personal Assistants: Comparison of Voice-Based Options with an LLM-Powered Touch Interface
por: DeVries, Paige S., et al.
Publicado: (2026)
por: DeVries, Paige S., et al.
Publicado: (2026)
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Empowering Molecule Discovery for Molecule-Caption Translation with Large Language Models: A ChatGPT Perspective
por: Li, Jiatong, et al.
Publicado: (2023)
por: Li, Jiatong, et al.
Publicado: (2023)
F -- A Model of Events based on the Foundational Ontology DOLCE+DnS Ultralite
por: Scherp, Ansgar, et al.
Publicado: (2024)
por: Scherp, Ansgar, et al.
Publicado: (2024)
Expanding Expressivity in Transformer Models with MöbiusAttention
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
por: Cheng, Wei-Yuan, et al.
Publicado: (2026)
por: Cheng, Wei-Yuan, et al.
Publicado: (2026)
Geometric Structural Knowledge Graph Foundation Model
por: Xin, Ling, et al.
Publicado: (2025)
por: Xin, Ling, et al.
Publicado: (2025)
Large Language Model Enhanced Hard Sample Identification for Denoising Recommendation
por: Song, Tianrui, et al.
Publicado: (2024)
por: Song, Tianrui, et al.
Publicado: (2024)
LMT-Net: Lane Model Transformer Network for Automated HD Mapping from Sparse Vehicle Observations
por: Mink, Michael, et al.
Publicado: (2024)
por: Mink, Michael, et al.
Publicado: (2024)
Large Language Models are Advanced Anonymizers
por: Staab, Robin, et al.
Publicado: (2024)
por: Staab, Robin, et al.
Publicado: (2024)
From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models
por: Dai, Muzhi, et al.
Publicado: (2025)
por: Dai, Muzhi, et al.
Publicado: (2025)
Kenyan Sign Language (KSL) Dataset: Using Artificial Intelligence (AI) in Bridging Communication Barrier among the Deaf Learners
por: Wanzare, Lilian, et al.
Publicado: (2024)
por: Wanzare, Lilian, et al.
Publicado: (2024)
Beyond Memorization: Violating Privacy Via Inference with Large Language Models
por: Staab, Robin, et al.
Publicado: (2023)
por: Staab, Robin, et al.
Publicado: (2023)
Do Audio-Visual Large Language Models Really See and Hear?
por: Selvakumar, Ramaneswaran, et al.
Publicado: (2026)
por: Selvakumar, Ramaneswaran, et al.
Publicado: (2026)
BioELX: Cross-lingual Biomedical Entity Linking via Alias-based Retrieval and LLM Ranking
por: Wang, Yi, et al.
Publicado: (2026)
por: Wang, Yi, et al.
Publicado: (2026)
Towards Foundation Models for Relational Databases with Language Models and Graph Neural Networks
por: Wu, Jingcheng, et al.
Publicado: (2026)
por: Wu, Jingcheng, et al.
Publicado: (2026)
Empowering Large Language Models on Robotic Manipulation with Affordance Prompting
por: Cheng, Guangran, et al.
Publicado: (2024)
por: Cheng, Guangran, et al.
Publicado: (2024)
The Illusion of Diminishing Returns: Measuring Long Horizon Execution in LLMs
por: Sinha, Akshit, et al.
Publicado: (2025)
por: Sinha, Akshit, et al.
Publicado: (2025)
Mathematical Reasoning for Unmanned Aerial Vehicles: A RAG-Based Approach for Complex Arithmetic Reasoning
por: Azarafza, Mehdi, et al.
Publicado: (2025)
por: Azarafza, Mehdi, et al.
Publicado: (2025)
Full-History Graphs with Edge-Type Decoupled Networks for Temporal Reasoning
por: Mohammed, Osama, et al.
Publicado: (2025)
por: Mohammed, Osama, et al.
Publicado: (2025)
PACE: A Pragmatic Agent for Enhancing Communication Efficiency Using Large Language Models
por: Li, Jiaxuan, et al.
Publicado: (2024)
por: Li, Jiaxuan, et al.
Publicado: (2024)
Towards Foundation Model on Temporal Knowledge Graph Reasoning
por: Pan, Jiaxin, et al.
Publicado: (2025)
por: Pan, Jiaxin, et al.
Publicado: (2025)
Empowering Large Language Models for Textual Data Augmentation
por: Li, Yichuan, et al.
Publicado: (2024)
por: Li, Yichuan, et al.
Publicado: (2024)
CoddLLM: Empowering Large Language Models for Data Analytics
por: Zhang, Jiani, et al.
Publicado: (2025)
por: Zhang, Jiani, et al.
Publicado: (2025)
Empowering Working Memory for Large Language Model Agents
por: Guo, Jing, et al.
Publicado: (2023)
por: Guo, Jing, et al.
Publicado: (2023)
eSPARQL: Representing and Reconciling Agnostic and Atheistic Beliefs in RDF-star Knowledge Graphs
por: Pan, Xinyi, et al.
Publicado: (2024)
por: Pan, Xinyi, et al.
Publicado: (2024)
Large AI Model Empowered Multimodal Semantic Communications
por: Jiang, Feibo, et al.
Publicado: (2023)
por: Jiang, Feibo, et al.
Publicado: (2023)
QCaption: Video Captioning and Q&A through Fusion of Large Multimodal Models
por: Wang, Jiale, et al.
Publicado: (2026)
por: Wang, Jiale, et al.
Publicado: (2026)
From Shapes to Shapes: Inferring SHACL Shapes for Results of SPARQL CONSTRUCT Queries (Extended Version)
por: Seifer, Philipp, et al.
Publicado: (2024)
por: Seifer, Philipp, et al.
Publicado: (2024)
EconAgent: Large Language Model-Empowered Agents for Simulating Macroeconomic Activities
por: Li, Nian, et al.
Publicado: (2023)
por: Li, Nian, et al.
Publicado: (2023)
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
Logic-of-Thought: Empowering Large Language Models with Logic Programs for Solving Puzzles in Natural Language
por: Li, Naiqi, et al.
Publicado: (2025)
por: Li, Naiqi, et al.
Publicado: (2025)
General-Purpose Aerial Intelligent Agents Empowered by Large Language Models
por: Zhao, Ji, et al.
Publicado: (2025)
por: Zhao, Ji, et al.
Publicado: (2025)
Ejemplares similares
-
LLMs4Life: Large Language Models for Ontology Learning in Life Sciences
por: Fathallah, Nadeen, et al.
Publicado: (2024) -
AccessGuru: Leveraging LLMs to Detect and Correct Web Accessibility Violations in HTML Code
por: Fathallah, Nadeen, et al.
Publicado: (2025) -
Retrieval-Augmented Generation of Ontologies from Relational Databases
por: Nayyeri, Mojtaba, et al.
Publicado: (2025) -
From Tokens to Lattices: Emergent Lattice Structures in Language Models
por: Xiong, Bo, et al.
Publicado: (2025) -
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
por: Potyka, Nico, et al.
Publicado: (2023)