Chen, G., Wang, G., Huang, X., & Sang, J. (2024). Semantically consistent Video-to-Audio Generation using Multimodal Language Large Model.
Style de citation Chicago (17e éd.)Chen, Gehui, Guan'an Wang, Xiaowen Huang, et Jitao Sang. Semantically Consistent Video-to-Audio Generation Using Multimodal Language Large Model. 2024.
Style de citation MLA (9e éd.)Chen, Gehui, et al. Semantically Consistent Video-to-Audio Generation Using Multimodal Language Large Model. 2024.
Attention : ces citations peuvent ne pas être correctes à 100%.