Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Zhang, Linghao, Li, Jungang, Hei, Yonghua, Tao, Sicheng, Dai, Song, Yan, Yibo, Dongfang, Zihao, Liu, Weiting, Qin, Chenxi, Li, Hanqian, Zou, Xin, Zhang, Jiahao, Xun, Shuhang, Jiang, Haiyun, Hu, Xuming
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!