Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix
Imagen de Portada

MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Ma, Ziyang, Ma, Yinghao, Zhu, Yanqiao, Yang, Chen, Chao, Yi-Wen, Xu, Ruiyang, Chen, Wenxi, Chen, Yuanzhe, Chen, Zhuo, Cong, Jian, Li, Kai, Li, Keliang, Li, Siyou, Li, Xinfeng, Li, Xiquan, Lian, Zheng, Liang, Yuzhe, Liu, Minghao, Niu, Zhikang, Wang, Tianrui, Wang, Yuping, Wang, Yuxuan, Wu, Yihao, Yang, Guanrou, Yu, Jianwei, Yuan, Ruibin, Zheng, Zhisheng, Zhou, Ziya, Zhu, Haina, Xue, Wei, Benetos, Emmanouil, Yu, Kai, Chng, Eng-Siong, Chen, Xie
Formato: Preprint
Publicado: 2025
Materias:
Sound
Computation and Language
Multimedia
Audio and Speech Processing
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2505.13032

Ejemplares similares

  • SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing
    por: Ma, Ziyang, et al.
    Publicado: (2026)
  • Resonate: Reinforcing Text-to-Audio Generation via Online Feedback from Large Audio Language Models
    por: Li, Xiquan, et al.
    Publicado: (2026)
  • SLAM-AAC: Enhancing Audio Captioning with Paraphrasing Augmentation and CLAP-Refine through LLMs
    por: Chen, Wenxi, et al.
    Publicado: (2024)
  • URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models
    por: Yan, Ruiqi, et al.
    Publicado: (2025)
  • DRCap: Decoding CLAP Latents with Retrieval-Augmented Generation for Zero-shot Audio Captioning
    por: Li, Xiquan, et al.
    Publicado: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar