SurgLLM: A Versatile Large Multimodal Model with Spatial Focus and Temporal Awareness for Surgical Video Understanding

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Chen, Zhen, Luo, Xingjian, Yuan, Kun, Wu, Jinlin, Chan, Danny T. M., Navab, Nassir, Liu, Hongbin, Lei, Zhen, Luo, Jiebo
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!