FOCUS: Unified Vision-Language Modeling for Interactive Editing Driven by Referential Segmentation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yang, Fan, Zhu, Yousong, Li, Xin, Zhan, Yufei, Zhao, Hongyin, Zheng, Shurong, Wang, Yaowei, Tang, Ming, Wang, Jinqiao
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!