From Contrast to Commonality: Audio Commonality Captioning for Enhanced Audio-Text Cross-modal Understanding in Multimodal LLMs

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Jia, Yuhang, Zhang, Xu, Guo, Yujie, Chen, Yang, Zhao, Shiwan
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items