TMT: Tri-Modal Translation between Speech, Image, and Text by Processing Different Modalities as Different Languages

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Kim, Minsu, Jung, Jee-weon, Rha, Hyeongseop, Maiti, Soumi, Arora, Siddhant, Chang, Xuankai, Watanabe, Shinji, Ro, Yong Man
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!