SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhu, Muzhi, Tian, Yuzhuo, Chen, Hao, Zhou, Chunluan, Guo, Qingpei, Liu, Yang, Yang, Ming, Shen, Chunhua
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!