Wu, X., Huang, S., & Wei, F. (2024). Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation.
Cita Chicago Style (17a ed.)Wu, Xun, Shaohan Huang, y Furu Wei. Multimodal Large Language Model Is a Human-Aligned Annotator for Text-to-Image Generation. 2024.
Cita MLA (9a ed.)Wu, Xun, et al. Multimodal Large Language Model Is a Human-Aligned Annotator for Text-to-Image Generation. 2024.
Precaución: Estas citas no son 100% exactas.