Sagare, S., S, H., Sarabhai, K., Ullegaddi, P., & SA, R. (2024). Audio-visual training for improved grounding in video-text LLMs.
Chicago-Zitierstil (17. Ausg.)Sagare, Shivprasad, Hemachandran S, Kinshuk Sarabhai, Prashant Ullegaddi, und Rajeshkumar SA. Audio-visual Training for Improved Grounding in Video-text LLMs. 2024.
MLA-Zitierstil (9. Ausg.)Sagare, Shivprasad, et al. Audio-visual Training for Improved Grounding in Video-text LLMs. 2024.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.