SpatialPIN: Enhancing Spatial Reasoning Capabilities of Vision-Language Models through Prompting and Interacting 3D Priors

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Ma, Chenyang, Lu, Kai, Cheng, Ta-Ying, Trigoni, Niki, Markham, Andrew
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!