Li, H., Chen, J., Wei, Z., Huang, S., Hui, T., Gao, J., . . . Liu, S. (2025). LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding.
Chicago Style (17th ed.) CitationLi, Hongyu, Jinyu Chen, Ziyu Wei, Shaofei Huang, Tianrui Hui, Jialin Gao, Xiaoming Wei, and Si Liu. LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding. 2025.
MLA (9th ed.) CitationLi, Hongyu, et al. LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding. 2025.
Warning: These citations may not always be 100% accurate.