Robotic Manipulation is Vision-to-Geometry Mapping ($f(v) \rightarrow G$): Vision-Geometry Backbones over Language and Video Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Song, Zijian, Li, Qichang, Zhou, Jiawei, Yuan, Zhenlong, Chen, Tianshui, Lin, Liang, Wang, Guangrun
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!