F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language Model

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Bi, Hanbo, Yuan, Zhiqiang, Jia, Zexi, Zhang, Jiapei, Li, Chongyang, Luo, Peixiang, Deng, Ying, Duan, Xiaoyue, Zhang, Jinchao
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!