Grasp Any Region: Towards Precise, Contextual Pixel Understanding for Multimodal LLMs

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wang, Haochen, Wang, Yuhao, Zhang, Tao, Zhou, Yikang, Li, Yanwei, Wang, Jiacong, Zheng, Jiani, Tian, Ye, Meng, Jiahao, Huang, Zilong, Mai, Guangcan, Wang, Anran, Tong, Yunhai, Wang, Zhuochen, Li, Xiangtai, Zhang, Zhaoxiang
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!