Improving Audio Captioning Models with Fine-grained Audio Features, Text Embedding Supervision, and LLM Mix-up Augmentation

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wu, Shih-Lun, Chang, Xuankai, Wichern, Gordon, Jung, Jee-weon, Germain, François, Roux, Jonathan Le, Watanabe, Shinji
Format: Preprint
Published: 2023
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!