Luo, B., Wang, T., Chen, C., & Ding, X. (2026). ST-SimDiff: Balancing Spatiotemporal Similarity and Difference for Efficient Video Understanding with MLLMs.
Cita Chicago Style (17a ed.)Luo, Bingjun, Tony Wang, Chaoqi Chen, y Xinpeng Ding. ST-SimDiff: Balancing Spatiotemporal Similarity and Difference for Efficient Video Understanding with MLLMs. 2026.
Cita MLA (9a ed.)Luo, Bingjun, et al. ST-SimDiff: Balancing Spatiotemporal Similarity and Difference for Efficient Video Understanding with MLLMs. 2026.
Precaución: Estas citas no son 100% exactas.