Seeing Beyond the Scene: Enhancing Vision-Language Models with Interactional Reasoning

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Liang, Dayong, Zheng, Changmeng, Wen, Zhiyuan, Cai, Yi, Wei, Xiao-Yong, Li, Qing
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!