Zhao, B., Fang, J., Dai, Z., Wang, Z., Zha, J., Zhang, W., . . . Li, Y. (2025). UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces.
Chicago Style (17th ed.) CitationZhao, Baining, et al. UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces. 2025.
MLA (9th ed.) CitationZhao, Baining, et al. UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces. 2025.
Warning: These citations may not always be 100% accurate.