SynesLM: A Unified Approach for Audio-visual Speech Recognition and Translation via Language Model and Synthetic Data

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Lu, Yichen, Song, Jiaqi, Chang, Xuankai, Bian, Hengwei, Maiti, Soumi, Watanabe, Shinji
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!