Han, Z., Zhu, F., Lao, Q., & Jiang, H. (2023). Zero-shot Referring Expression Comprehension via Structural Similarity Between Images and Captions.
Chicago Style (17th ed.) CitationHan, Zeyu, Fangrui Zhu, Qianru Lao, and Huaizu Jiang. Zero-shot Referring Expression Comprehension via Structural Similarity Between Images and Captions. 2023.
MLA (9th ed.) CitationHan, Zeyu, et al. Zero-shot Referring Expression Comprehension via Structural Similarity Between Images and Captions. 2023.
Warning: These citations may not always be 100% accurate.