Saltar al contenido
VuFind
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzado
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
Imagen de Portada

Guardado en:
Detalles Bibliográficos
Autores principales: Ge, Mengying, Li, Mingyang, Tang, Dongkai, Li, Pengbo, Liu, Kuo, Deng, Shuhao, Pu, Songbai, Liu, Long, Song, Yang, Zhang, Tao
Formato: Preprint
Publicado: 2024
Materias:
Multimedia
Artificial Intelligence
Sound
Audio and Speech Processing
Acceso en línea:https://arxiv.org/abs/2409.18971
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Existencias
  • Descripción
  • Tabla de Contenidos
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2409.18971

Ejemplares similares

  • Dopamine Audiobook: A Training-free MLLM Agent for Emotional and Immersive Audiobook Generation
    por: Rong, Yan, et al.
    Publicado: (2025)
  • Efficient Adapter Tuning for Joint Singing Voice Beat and Downbeat Tracking with Self-supervised Learning Features
    por: Deng, Jiajun, et al.
    Publicado: (2025)
  • Robust LLM-based Audio-Visual Speech Recognition with Sparse Modality Alignment and Visual Unit-Guided Refinement
    por: Su, Fei, et al.
    Publicado: (2026)
  • Voice Evaluation of Reasoning Ability: Diagnosing the Modality-Induced Performance Gap
    por: Lin, Yueqian, et al.
    Publicado: (2025)
  • Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion
    por: Deng, Zeyu, et al.
    Publicado: (2025)

Opciones de búsqueda

  • Historial de Búsqueda
  • Búsqueda Avanzada

Buscar Más

  • Revisar el Catálogo
  • Lista Alfabética
  • Explorar canales
  • Reservas de Curso
  • Nuevos ejemplares

¿Necesita Ayuda?

  • Consejos de búsqueda
  • Consulte a un Bibliotecario
  • Preguntas Frecuentes