Omni-RGPT: Unifying Image and Video Region-level Understanding via Token Marks

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Heo, Miran, Chen, Min-Hung, Huang, De-An, Liu, Sifei, Radhakrishnan, Subhashree, Kim, Seon Joo, Wang, Yu-Chiang Frank, Hachiuma, Ryo
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!