ViT-CoMer: Vision Transformer with Convolutional Multi-scale Feature Interaction for Dense Predictions

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Xia, Chunlong, Wang, Xinliang, Lv, Feng, Hao, Xin, Shi, Yifeng
Formato: Preprint
Publicado: 2024
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!