Hooshanfar, K., Hosseini, A., Kalhor, A., & Araabi, B. N. (2025). DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction.
Cita Chicago Style (17a ed.)Hooshanfar, Kiana, Alireza Hosseini, Ahmad Kalhor, y Babak Nadjar Araabi. DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction. 2025.
Cita MLA (9a ed.)Hooshanfar, Kiana, et al. DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction. 2025.
Precaución: Estas citas no son 100% exactas.