CoAVT: A Cognition-Inspired Unified Audio-Visual-Text Pre-Training Model for Multimodal Processing

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Yue, Xianghu, Tian, Xiaohai, Lu, Lu, Zhang, Malu, Wu, Zhizheng, Li, Haizhou
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!