Saltar al contenido
VuFind
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzado
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
Imagen de Portada

Guardado en:
Detalles Bibliográficos
Autores principales: Lim, DongHoon, Kim, YoungChae, Kim, Dong-Hyun, Yang, Da-Hee, Chang, Joon-Hyuk
Formato: Preprint
Publicado: 2025
Materias:
Computer Vision and Pattern Recognition
Artificial Intelligence
Multimedia
Audio and Speech Processing
Signal Processing
Acceso en línea:https://arxiv.org/abs/2508.18734
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Existencias
  • Descripción
  • Tabla de Contenidos
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2508.18734

Ejemplares similares

  • Zero-AVSR: Zero-Shot Audio-Visual Speech Recognition with LLMs by Learning Language-Agnostic Speech Representations
    por: Yeo, Jeong Hun, et al.
    Publicado: (2025)
  • AlignVSR: Audio-Visual Cross-Modal Alignment for Visual Speech Recognition
    por: Liu, Zehua, et al.
    Publicado: (2024)
  • Robust LLM-based Audio-Visual Speech Recognition with Sparse Modality Alignment and Visual Unit-Guided Refinement
    por: Su, Fei, et al.
    Publicado: (2026)
  • CatchPhrase: EXPrompt-Guided Encoder Adaptation for Audio-to-Image Generation
    por: Oh, Hyunwoo, et al.
    Publicado: (2025)
  • AKVSR: Audio Knowledge Empowered Visual Speech Recognition by Compressing Audio Knowledge of a Pretrained Model
    por: Yeo, Jeong Hun, et al.
    Publicado: (2023)

Opciones de búsqueda

  • Historial de Búsqueda
  • Búsqueda Avanzada

Buscar Más

  • Revisar el Catálogo
  • Lista Alfabética
  • Explorar canales
  • Reservas de Curso
  • Nuevos ejemplares

¿Necesita Ayuda?

  • Consejos de búsqueda
  • Consulte a un Bibliotecario
  • Preguntas Frecuentes