How and What to Imagine? Visual Thinking in Unified Multimodal Models for Cross-View Spatial Reasoning

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Yang, Qian, Sikarwar, Ankur, Le, Huy, Zhang, Le, Shi, Zhuan, Taslakian, Perouz, Agrawal, Aishwarya
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!